
01
Ingeniería de datos
Cuando cada informe sale de un sitio distinto, la conversación se va en reconciliar números. Montamos el camino de los datos: de donde nacen a la tabla que el equipo abre. La orquestación va en Airflow o Dagster, y el volumen se procesa en Databricks, BigQuery o Spark, según la cuenta que ya tenéis.
Qué se construye
- Ingesta y transformación con pruebas, no con un script suelto
- Orquestación en Airflow o Dagster, con reintentos y un sitio donde ver qué falló
- Proceso en Databricks, BigQuery o Spark, sin mudar de plataforma para una demo
Qué queda. Un pipeline que se puede volver a correr y un modelo que otra persona puede leer.

