DATA ENGINEER · PROGRAMA HIGH CODE · CONSTRUYE PIPELINES DE DATOS ROBUSTOS →

Programa técnico High Code · 11 módulos

Data Engineer

Construye y mantén pipelines de datos robustos

Un programa intensivo y de alto componente de código, diseñado para ingenieros de datos actuales y futuros que quieren dominar Python, SQL, el modelado de datos y el CI/CD. A lo largo de once módulos aprenderás a desarrollar, automatizar y mantener pipelines de datos fiables y escalables, combinando estudio autoguiado con sesiones en directo y práctica en la plataforma EDUKATE.AI.

El programa

Ingeniería de datos práctica y de extremo a extremo

El itinerario recorre todo el trabajo del ingeniero de datos: procesar y modelar datos, construir bases de datos y pipelines, automatizar con CI/CD y desplegar productos de datos escalables en la nube, sin olvidar la calidad, la gobernanza y la ética. Cada módulo combina estudio autoguiado con sesiones en directo y prácticas evaluadas.

11

Módulos, incluido un hackathon práctico.

~20 h

De dedicación por módulo.

30

Participantes máximo por cohorte.

High Code

Python, SQL, Docker, Kubernetes, Terraform y Spark.

Competencias

Qué dominarás

Python y procesamiento de datos

Python, manipulación y limpieza de datos con Pandas, control de versiones con Git y testing unitario.

SQL y bases de datos

SQL de fundamentos a avanzado, window functions y las diferencias entre estructuras SQL y NoSQL.

Pipelines y automatización

Pipelines ETL, procesamiento batch y en streaming, y automatización con Apache Spark, Kafka y Luigi.

DevOps y contenerización

Ciclo de vida del software, CI/CD con GitHub Actions, contenedores Docker, Kubernetes y Terraform.

Cloud y arquitecturas escalables

Servicios de datos en la nube (AWS, GCP y Azure), sistemas de ficheros distribuidos y planes de continuidad.

Calidad, gobernanza y ética

Las seis dimensiones de calidad (DAMA), cifrado, principios de ética de datos y cumplimiento normativo.

Temario

El temario, módulo a módulo

Once módulos que te llevan del código y las bases de datos a los pipelines, la nube y un hackathon final. Cada uno con sus tecnologías clave y su nivel de código.

1
Python y Pandas para procesamiento de datos

Python

Pandas

Git y testing

Nivel de código

2
Conceptos de ingeniería de datos

Ciclo de vida

Esquemas

Data warehousing

Nivel de código

3
Bases de datos, SQL y NoSQL

SQL

Window functions

NoSQL

Nivel de código

4
Gestión de producto de datos

Roadmapping

Stakeholders

Ciclo de producto

Nivel de código

5
DevOps y contenerización

CI/CD

Docker

Kubernetes y Terraform

Nivel de código

6
Calidad, gobernanza y ética de los datos

DAMA

Cifrado

Cumplimiento

Nivel de código

7
Pipelines de datos y automatización

ETL

Spark

Kafka y Luigi

Nivel de código

8
Implementación de productos de datos

Requisitos

Documentación

Arquitecturas

Nivel de código

9
Técnicas avanzadas de ingeniería de datos

AWS · GCP · Azure

Sistemas distribuidos

Continuidad (BCP)

Nivel de código

10
Tendencias y tecnologías emergentes

Cloud-native

MLOps

DataOps

Nivel de código

11
Hackathon práctico

Proyecto en equipo

Dataset real

Presentaciones

Nivel de código

¿Quieres formar a tu equipo como Data Engineers?

Adaptamos el itinerario al nivel de partida y a los objetivos de tu organización. Cuéntanos tu contexto y preparamos una propuesta con los módulos, el formato y el calendario que mejor encajen con tu equipo.