geniero de Datos con experiencia en construcción de pipelines de datos e integración de información proveniente de entornos Mainframe. Es indispensable el manejo de Python, Spark, AWS Glue, DB2 Mainframe y procesos ETL para el procesamiento de grandes volúmenes de datos.
Funciones:
- Construir y mantener pipelines batch.
- Extraer y procesar datos desde DB2 Mainframe y VSAM.
- Desarrollar procesos ETL con Python.
- Implementar transformaciones utilizando Spark.
- Diseñar procesos de carga con AWS Glue.
- Validar la calidad e integridad de los datos.
Habilidades técnicas:
- Python.
- Apache Spark.
- AWS Glue.
- DB2 Mainframe.
- VSAM.
- ETL y procesamiento de datos.
- Interpretación de estructuras COBOL.
- Integración y transformación de datos.