Distintos y duplicados en R
Descartar filas repetidas, y encontrar las que se repiten.
library(dplyr)
runs <- tibble(
lang = c("r", "r", "python", "python", "python"),
day = c(1, 1, 2, 3, 3),
tpm = c(88, 88, 104, 99, 101)
)
print(distinct(runs))
print(distinct(runs, lang))
print(distinct(runs, lang, .keep_all = TRUE))
print(filter(count(runs, lang, day), n > 1))
print(n_distinct(runs$lang), nrow(runs))
Cómo funciona
distinctsobre un subconjunto de columnas conserva la primera fila de cada uno..keep_allretiene las demás columnas.countcon un filtro es cómo se encuentran los duplicados.
El intento, en números
- Líneas
- 13
- Caracteres a escribir
- 320
- Tokens
- 119
- Ritmo de tres estrellas
- 95 tpm
Al ritmo de tres estrellas de 95 tokens por minuto, este intento toma unos 75 segundos.
Paso 3 de 5 en Filas; paso 7 de 27 en dplyr.