11 oct
|
Gi Group
|
Bogotá
Objetivo Diseñar, desarrollar e implementar un modelo avanzado de clusterización (segmentación) optimizado para grandes volúmenes de datos transaccionales directamente sobre la infraestructura de Databricks del cliente, estructurando el entorno y los datos de salida para habilitar la futura fase de proyecciones de comportamiento.
Requisitos
Responsabilidad Recopilar, limpiar y estructurar grandes volúmenes de datos. Conexión, extracción y procesamiento eficiente de grandes volúmenes de datos transaccionales. Modelamiento y Clusterización Estructuración de la base de datos particionada, entrega del pipeline automatizado de asignación en Python y diseño técnico del roadmap para la analítica predictiva de comportamiento. Orquestación del pipeline mediante Databricks. Formación: Título en Ingeniería Informática o afín. 7+ años de experiencia en proyectos de ciencia de datos.
Experiencia comprobable en el rol. Conocimientos técnicos: Lenguajes: Python Librerías: PySpark o librería a fin. Experiencia Avanzada en Databricks: Desarrollo sobre Databricks Notebooks, configuración y optimización de clusters (nodos de cómputo), y gestión de entornos de librerías. Experiencia en bases de datos relacionales y NoSQL. Conocimientos en estadística avanzada y modelado matemático. Deseable herramientas de visualización: Power BI, Tableau, matplotlib, seaborn. Deseable experiencia en cloud (AWS, Azure, GCP). Experiencia Avanzada en Databricks: Desarrollo sobre Databricks, configuración y optimización de clusters y gestión de entornos de librerías.
Incentivos
Proyecto de 5 semanas
📌 Data Scientist (Bogotá)
🏢 Gi Group
📍 Bogotá