typestar

Distintos y duplicados en R

Descartar filas repetidas, y encontrar las que se repiten.

library(dplyr)

runs <- tibble(
  lang = c("r", "r", "python", "python", "python"),
  day = c(1, 1, 2, 3, 3),
  tpm = c(88, 88, 104, 99, 101)
)

print(distinct(runs))
print(distinct(runs, lang))
print(distinct(runs, lang, .keep_all = TRUE))
print(filter(count(runs, lang, day), n > 1))
print(n_distinct(runs$lang), nrow(runs))

Cómo funciona

  1. distinct sobre un subconjunto de columnas conserva la primera fila de cada uno.
  2. .keep_all retiene las demás columnas.
  3. count con un filtro es cómo se encuentran los duplicados.

El intento, en números

Líneas
13
Caracteres a escribir
320
Tokens
119
Ritmo de tres estrellas
95 tpm

Al ritmo de tres estrellas de 95 tokens por minuto, este intento toma unos 75 segundos.

Escribe este fragmento

Paso 3 de 5 en Filas; paso 7 de 27 en dplyr.

← Anterior Siguiente →