DATA ENGINEER · PROGRAMA HIGH CODE · CONSTRUYE PIPELINES DE DATOS ROBUSTOS →

Programa técnico High Code · 11 módulos
Data Engineer
Construye y mantén pipelines de datos robustos
Un programa intensivo y de alto componente de código, diseñado para ingenieros de datos actuales y futuros que quieren dominar Python, SQL, el modelado de datos y el CI/CD. A lo largo de once módulos aprenderás a desarrollar, automatizar y mantener pipelines de datos fiables y escalables, combinando estudio autoguiado con sesiones en directo y práctica en la plataforma EDUKATE.AI.
El programa
Ingeniería de datos práctica y de extremo a extremo
El itinerario recorre todo el trabajo del ingeniero de datos: procesar y modelar datos, construir bases de datos y pipelines, automatizar con CI/CD y desplegar productos de datos escalables en la nube, sin olvidar la calidad, la gobernanza y la ética. Cada módulo combina estudio autoguiado con sesiones en directo y prácticas evaluadas.
11
Módulos, incluido un hackathon práctico.
~20 h
De dedicación por módulo.
30
Participantes máximo por cohorte.
High Code
Python, SQL, Docker, Kubernetes, Terraform y Spark.
Competencias
Qué dominarás
Python y procesamiento de datos
Python, manipulación y limpieza de datos con Pandas, control de versiones con Git y testing unitario.
SQL y bases de datos
SQL de fundamentos a avanzado, window functions y las diferencias entre estructuras SQL y NoSQL.
Pipelines y automatización
Pipelines ETL, procesamiento batch y en streaming, y automatización con Apache Spark, Kafka y Luigi.
DevOps y contenerización
Ciclo de vida del software, CI/CD con GitHub Actions, contenedores Docker, Kubernetes y Terraform.
Cloud y arquitecturas escalables
Servicios de datos en la nube (AWS, GCP y Azure), sistemas de ficheros distribuidos y planes de continuidad.
Calidad, gobernanza y ética
Las seis dimensiones de calidad (DAMA), cifrado, principios de ética de datos y cumplimiento normativo.
Temario
El temario, módulo a módulo
Once módulos que te llevan del código y las bases de datos a los pipelines, la nube y un hackathon final. Cada uno con sus tecnologías clave y su nivel de código.
1
Python y Pandas para procesamiento de datos
Python
Pandas
Git y testing
Nivel de código
2
Conceptos de ingeniería de datos
Ciclo de vida
Esquemas
Data warehousing
Nivel de código
3
Bases de datos, SQL y NoSQL
SQL
Window functions
NoSQL
Nivel de código
4
Gestión de producto de datos
Roadmapping
Stakeholders
Ciclo de producto
Nivel de código
5
DevOps y contenerización
CI/CD
Docker
Kubernetes y Terraform
Nivel de código
6
Calidad, gobernanza y ética de los datos
DAMA
Cifrado
Cumplimiento
Nivel de código
7
Pipelines de datos y automatización
ETL
Spark
Kafka y Luigi
Nivel de código
8
Implementación de productos de datos
Requisitos
Documentación
Arquitecturas
Nivel de código
9
Técnicas avanzadas de ingeniería de datos
AWS · GCP · Azure
Sistemas distribuidos
Continuidad (BCP)
Nivel de código
10
Tendencias y tecnologías emergentes
Cloud-native
MLOps
DataOps
Nivel de código
11
Hackathon práctico
Proyecto en equipo
Dataset real
Presentaciones
Nivel de código

¿Quieres formar a tu equipo como Data Engineers?
Adaptamos el itinerario al nivel de partida y a los objetivos de tu organización. Cuéntanos tu contexto y preparamos una propuesta con los módulos, el formato y el calendario que mejor encajen con tu equipo.