2.5 Resumen: R base

A modo de referencia rápida, la siguiente tabla recoge las tareas más habituales de manipulación de datos vistas en este capítulo. En el Capítulo 5 se retomará esta misma lista mostrando el equivalente en dplyr/tidyr para cada tarea (ver el resumen comparativo de la Sección 5.7):

Tarea R base
Leer texto/CSV read.table(), read.delim()
Leer Excel openxlsx::read.xlsx()
Escribir texto/CSV write.table()
Seleccionar columnas df[, c("a","b")]
Renombrar columnas names(df)[i] <- "x"
Filtrar filas subset(df, cond), df[cond, ]
Ordenar filas df[order(df$x), ]
Crear/transformar variable df$z <- expr
Recodificar/categorizar cut(), ifelse()
Resumir aggregate(), tapply()
Agrupar y resumir aggregate(y ~ g, df, FUN)
Unir tablas (join) merge()
Filtrar por coincidencia df1[df1$x %in% df2$x, ]
Encadenar operaciones llamadas anidadas