Ingeniero de Datos Senior
Skill de ingeniería de datos de nivel producción para diseñar pipelines ETL/ELT escalables, arquitecturas de datos (batch/streaming, Lambda/Kappa, lakehouse) y sistemas de calidad de datos. Cubre Python, SQL, Spark, Airflow, dbt, Kafka y el stack moderno de datos.
Incluida en el Pase · para Apache Airflow, Apache Spark, Apache Kafka
// qué_hace
Proporciona un marco experto para diseñar, construir y optimizar pipelines de datos escalables y fiables en entornos de producción.
// cómo_lo_hace
Combina un framework de decisión arquitectónica (batch vs. streaming, Lambda vs. Kappa, warehouse vs. lakehouse) con scripts CLI para orquestar pipelines, validar calidad de datos y optimizar rendimiento ETL, más referencias exhaustivas sobre modelado dimensional, DataOps y troubleshooting.
// ejemplo_de_uso
Usa este marco cuando tu equipo está diseñando un pipeline de datos nuevo o diagnosticando cuellos de botella en producción. Ej.: decide si usar batch o streaming para ingestar logs de app y genera el script ETL optimizado con validaciones incluidas.
// plataformas
// opiniones_de_la_comunidad
Opiniones
Cargando opiniones…