Se requiere un Ingeniero SRE DevOps para fortalecer la confiabilidad de servicios críticos. El rol concentra la gestión de disponibilidad, resiliencia y observabilidad de la plataforma. Se busca experiencia en Site Reliability Engineering, manejo de incidentes y automatización operativa. Se gestionarán SLO, SLI y error budgets, asegurando el cumplimiento de métricas DORA. La posición contribuye directamente a la continuidad del negocio mediante la implementación de prácticas de Infraestructura como Código (IaC) y Procesos de Integración Continua/Entrega Continua (CI/CD), con un enfoque en la automatización y el uso de tecnologías como Kubernetes y plataformas cloud. El objetivo es optimizar el rendimiento y la estabilidad de los sistemas.
Responsabilidades:
- Diseñar implementar y mantener sistemas de alta disponibilidad escalabilidad y confiabilidad.
- Definir y monitorear Service Level Objectives (SLO) y Service Level Indicators (SLI).
- Gestionar y optimizar el uso de Error Budgets para priorizar el desarrollo y la estabilidad.
- Implementar y mantener soluciones de observabilidad (métricas logs trazas) para la monitorización proactiva.
- Automatizar despliegues configuraciones y operaciones utilizando herramientas de IaC y CI/CD.
- Administrar y optimizar entornos basados en Kubernetes y plataformas cloud.
- Participar en la resolución de incidentes críticos realizando análisis post-mortem y definiendo acciones correctivas.
- Colaborar con equipos de desarrollo y operaciones para mejorar la resiliencia y el rendimiento de los servicios.
- Aplicar principios de ingeniería de confiabilidad para reducir la incidencia de fallos y mejorar los tiempos de recuperación (MTTR).
- Contribuir a la mejora continua de los procesos y herramientas SRE/DevOps.
Requerimientos:
- Experiencia mínima de 3 a 5 años en roles de ingeniería de sistemas SRE o DevOps.
- Dominio de conceptos de SRE: SLO SLI Error Budgets MTTR MTTD.
- Experiencia comprobada en implementación y gestión de observabilidad (APM Logs Métricas Trazabilidad).
- Conocimiento profundo en orquestación de contenedores preferiblemente Kubernetes y Helm.
- Experiencia sólida en Infraestructura como Código (IaC) con herramientas como Terraform o similar.
- Experiencia en diseño e implementación de pipelines de CI/CD.
- Experiencia trabajando con proveedores de Cloud (AWS Azure GCP).
- Dominio de lenguagenes de scripting como Python Bash o PowerShell.
- Conocimiento en la aplicación de inteligencia artificial para la optimización de sistemas.
- Capacidad para analizar y resolver incidentes complejos en entornos de producción.
- Comprensión de las métricas DORA y su aplicación para la mejora continua.
- Formación técnica avanzada tecnólogo o cualificado en Ingeniería de Sistemas Software Infraestructura DevOps Cloud Telecomunicaciones o áreas afines.
- Inglés técnico intermedio para lectura de documentación y comunicación.
Nivel de educación:
- Profesional
Sectores laborales:
- Software informática y telecomunicaciones
- Producción Operarios y Manufactura
- Servicios generales Aseo y Seguridad