2.5 Resumen: R base
A modo de referencia rápida, la siguiente tabla recoge las tareas más
habituales de manipulación de datos vistas en este capítulo. En el
Capítulo 5 se retomará esta misma lista mostrando el
equivalente en dplyr/tidyr para cada tarea (ver el resumen
comparativo de la Sección 5.7):
| Tarea | R base |
|---|---|
| Leer texto/CSV | read.table(), read.delim() |
| Leer Excel | openxlsx::read.xlsx() |
| Escribir texto/CSV | write.table() |
| Seleccionar columnas | df[, c("a","b")] |
| Renombrar columnas | names(df)[i] <- "x" |
| Filtrar filas | subset(df, cond), df[cond, ] |
| Ordenar filas | df[order(df$x), ] |
| Crear/transformar variable | df$z <- expr |
| Recodificar/categorizar | cut(), ifelse() |
| Resumir | aggregate(), tapply() |
| Agrupar y resumir | aggregate(y ~ g, df, FUN) |
| Unir tablas (join) | merge() |
| Filtrar por coincidencia | df1[df1$x %in% df2$x, ] |
| Encadenar operaciones | llamadas anidadas |