Data Engineering & Pipelines
Diseñar, desarrollar e implementar pipelines de datos robustos y escalables (batch y streaming). Construir procesos de ingesta, transformación y carga (ETL/ELT) desde múltiples fuentes de datos. Integrar sistemas heterogéneos (bases de datos, APIs, archivos) mediante flujos automatizados. Asegurar la correcta alimentación de data lakes y data warehouses.
Cloud & Infraestructura
Construir y mantener la infraestructura de datos en AWS (S3, Glue, Redshift, Lambda, Step Functions, Athena, EMR). Garantizar disponibilidad, performance y escalabilidad de las soluciones implementadas. Colaborar en la definición de arquitecturas de datos modernas en la nube.
Calidad & Optimización
Aplicar técnicas de limpieza, validación y estandarización de datos. Implementar controles de calidad, monitoreo y data lineage. Optimizar consultas SQL, pipelines y uso de recursos. Monitorear tiempos de carga, volúmenes y errores en producción.
Documentación & Buenas Prácticas
Documentar pipelines, modelos de datos y arquitecturas. Promover buenas prácticas de ingeniería de datos. Trabajar con versionado de código (Git) y procesos colaborativos.
Colaboración
Trabajar junto a Data Analysts, Data Scientists y stakeholders de negocio. Traducir requerimientos funcionales en soluciones técnicas. Participar en ceremonias ágiles (Scrum / Kanban).