Description du poste
Responsabilidades
- Diseñar, desarrollar y mantener pipelines de datos escalables y eficientes utilizando Python.
- Construir, automatizar y optimizar procesos ETL/ELT usan Python para la ingesta, transformación y carga de datos desde múltiples fuentes.
- Desarrollar soluciones de procesamiento de datos mediante librerías como Pandas, NumPy y PySpark.
- Garantizar la calidad, consistencia, trazabilidad, monitoreo y disponibilidad de los datos.
- Implementar validaciones y controles de calidad sobre los flujos de información.
- Procesar grandes volúmenes de datos estructurados y no estructurados mediante Python.
- Diseñar e integrar soluciones mediante APIs REST, servicios web y conectores de datos, con Python.
- Colaborar con equipos de analítica, ciencia de datos, desarrollo y negocio para traducir requerimientos en soluciones técnicas.
- Participar en la definición e implementación de arquitecturas de datos sobre entornos cloud.
- Apoyarse en herramientas de IA Generativa, Copilot y agentes inteligentes para acelerar el desarrollo,
documentación y resolución de incidentes.
- Documentar desarrollos, procesos, flujos de datos y buenas prácticas de ingeniería.
- Interactuar directamente con clientes, entendiendo necesidades de negocio y proponiendo soluciones tecnológicas de valor.
- Realizar optimización y monitoreo continuo del rendimiento de procesos y pipelines de datos.
Profil
Requisitos Técnicos
- Experiência sólida desarrollando soluciones de datos con Python.
- Dominio de librerías para procesamiento y análisis de datos como Pandas, NumPy y PySpark.
- Experiência en desarrollo de procesos ETL/ELT y automatización de flujos de datos.
- Conocimiento avanzado de SQL para consultas, transformaciones y optimización de rendimiento.
- Experiência con bases de datos relacionales y no relacionales (PostgreSQL, MySQL, SQL Server, MongoDB, DynamoDB u otras).
- Experiência práctica con Apache Spark y PySpark para procesamiento distribuido de datos.
📌 Ingeniero de Datos (Bogotá)
🏢 Inetum
📍 Bogotá