Agregar de varias maneras en Python
group_by().agg() toma una lista de expresiones, cada una con nombre.
import polars as pl
tabla = pl.DataFrame({
"lang": ["python", "python", "rust", "rust", "sql"],
"tpm": [104, 91, 98, 88, 79],
"errors": [1, 4, 0, 2, 3],
})
resumen = tabla.group_by("lang").agg(
pl.len().alias("runs"),
pl.col("tpm").max().alias("best"),
pl.col("tpm").mean().round(1).alias("average"),
(pl.col("errors") == 0).sum().alias("clean"),
).sort("average", descending=True)
print(resumen)
Cómo funciona
- Cada agregado es una expresión: puede filtrar dentro de sí mismo.
pl.lencuenta las filas del grupo.- El resultado tiene una fila por grupo y una columna por expresión.
Palabras clave y builtins usados aquí
asprint
El intento, en números
- Líneas
- 16
- Caracteres a escribir
- 399
- Tokens
- 182
- Ritmo de tres estrellas
- 110 tpm
Al ritmo de tres estrellas de 110 tokens por minuto, este intento toma unos 99 segundos.
Paso 2 de 3 en Agregación; paso 13 de 32 en Polars.