Quinta sesión del taller semanal. Qué es dbt y que archivos genera Prophecy en el repo.
Cuarta sesión del taller semanal. Qué hacer cuando la query está bien escrita pero el Scan igual lee todo: data skipping, qué es Liquid Clustering, cómo elegir las claves…
Segunda sesión del taller semanal. Cinco patrones de SQL que aparecen una y otra vez en los pipelines: SELECT *, filtros que no podan archivos, joins explosivos, filtrar…
Primera sesión del taller semanal de buenas prácticas.
Quiero hacer una réplica de mí mismo — un bot que responda sobre Databricks basado en mi blog. Para eso necesito orquestar 7+ recursos. En esta charla vemos cómo DABs…
Python, SQL, Spark, dbt, Databricks — el orden importa. Slides del episodio del podcast Spark de Ideas.