Remodelar y leer
12 pasos en 5 series de R.
Llevar los datos a la forma que el resto del tidyverse espera. Pivotear en ambas direcciones, separar columnas, anidar un data frame dentro de una columna y rellenar huecos.
La última serie es readr con tipos de columna explícitos, que es la diferencia entre una importación limpia y una tarde depurando por qué una columna llegó como character.
Pivotear
- pivot_longerLas columnas anchas se vuelven filas: la forma que la mayoría del tidyverse quiere.
- pivot_widerLa inversa: una fila por id, una columna por clave.
- Pivotear con tidyrReformar entre ancho y largo, al estilo tidyverse.
Separar columnas
- Dividir y unir columnasseparate_wider_delim divide una columna en varias; unite deshace el camino.
- Limpieza con tidyrDividir, unir y rellenar columnas.
Anidado y huecos
- AnidaciónUna columna de listas con data frames, uno por grupo — el modo tidy de modelar por grupo.
- Valores faltantesdrop_na, replace_na y fill: tres respuestas a un hueco.
- Rellenar los huecoscomplete y expand_grid crean las filas que deberían existir y no existen.
Leer y seleccionar
- readrread_csv es más rápido que read.csv, y te dice qué adivinó.
- readrLectura rápida y predecible de archivos delimitados.
- Selección tidyEl lenguaje de selección que comparten select, across, pivot_longer y el resto.
Bis
- tidy_report.RUn pipeline tidyverse entero: leer, limpiar, reformar, modelar por grupo, graficar.