Ingeniero/a de Estabilidad DevOps Pleno

Compañía
Descripción
Resumen del Puesto: Mantener la continuidad operativa, disponibilidad y resiliencia del toolchain DevOps y su infraestructura, operando prácticas definidas para evitar interrupciones y degradaciones en flujos CI/CD. Puntos Destacados: 1. Operar y mantener el toolchain DevOps SaaS y PaaS 2. Participar en la resolución de incidentes y estrategias de alta disponibilidad 3. Desarrollo progresivo de autonomía técnica en tareas complejas Mantener la continuidad operativa, disponibilidad y resiliencia del toolchain DevOps y de la infraestructura que lo soporta, operando las prácticas, procedimientos y automatizaciones definidos por el equipo para evitar interrupciones o degradaciones en los flujos de integración, testing y despliegue. Ejecutar tareas de monitoreo, mantención, respaldo y atención de incidentes bajo los lineamientos establecidos por los perfiles Senior, participando en la resolución de incidentes y en la aplicación de las estrategias de alta disponibilidad y recuperación, mientras desarrolla progresivamente la autonomía técnica que le permitirá abordar tareas de mayor complejidad. En este rol tendrás la oportunidad de: Operar y mantener el toolchain DevOps SaaS y PaaS según los procedimientos y estándares definidos por el equipo.Ejecutar tareas de monitoreo, alertamiento y verificación del desempeño de la infraestructura que soporta los pipelines CI/CD.Atender incidentes sobre el Toolchain como primera línea, aplicando los runbooks definidos y escalando los casos críticos o complejos a los perfiles Senior.Apoyar la ejecución de actualizaciones, parches y migraciones del toolchain bajo planificación existente.Ejecutar y verificar respaldos (backup) y participar en las pruebas periódicas de recuperación (DR drills).Apoyar el análisis de causa raíz (RCA) de incidentes recurrentes, aportando datos y evidencias.Mantener actualizada la documentación operativa (runbooks) y registrar los cambios y hallazgos.Colaborar con los equipos pares dentro de la Subgerencia DevOps en las tareas de operación y soporte.Desarrollar y mantener scripts y automatizaciones de monitoreo o tareas repetitivas, bajo diseño definido.Reportar el estado de la operación, incidentes y métricas a los perfiles Senior y a la jefatura del área. Para tener éxito en esta posición necesitas: Educación: Profesional universitario del área Informática, Industrial o equivalente con grado de Ingeniero de Ejecución o Civil. **Experiencia:** \+2 años en roles de administración de infraestructura, DevOps, soporte de plataformas o Ingeniería de Sistemas.Nube: Conocimiento de Azure (Azure DevOps, infraestructura); deseable AWS o GCP.Sistemas Operativos / Infraestructura: Experiencia en Linux (RHEL) y/o Windows Server, con nociones de administración de infraestructura on\-premise e híbrida.Herramientas del Toolchain: Deseable experiencia utilizando o administrando Azure DevOps, GitHub, Jenkins o Nexus, u otras equivalentes (GitLab, TeamCity, Artifactory). (Al menos 1 de ellas)Scripting / Automatización: Conocimientos en PowerShell, Python o Bash; deseable nociones de Infraestructura como Código (Terraform, Ansible). Es aún mejor si tienes: Idiomas: Deseable Inglés escrito nivel básico o intermedio (lectura de documentación técnica).Monitoreo y Observabilidad: Deseable experiencia con herramientas como Grafana, Prometheus, Dynatrace, Zabbix o similares.1\. Certificaciones de Infraestructura y Plataforma (Nivel Fundamentos / Asociado)Idealmente poseer o estar en proceso de obtener al menos una de estas: ITIL Foundation – fundamentos de gestión de incidentes, problemas y cambios.Microsoft Certified: Azure Fundamentals (AZ\-900\) – fundamentos de la nube Azure.Microsoft Certified: Azure Administrator Associate (AZ\-104\) – administración de infraestructura Azure (deseable).SRE Foundation – fundamentos de Site Reliability Engineering.Certificado en DevOps.2\. Certificaciones Técnicas / Operación (Nivel Práctico)Jenkins Certified Engineer – administración de Jenkins.HashiCorp Certified: Terraform Associate – Infraestructura como Código.Linux Professional Institute (LPIC\-1\) – administración de sistemas Linux.3\. Cursos y Capacitaciones ValoradasEs positivo si el candidato demuestra cursos recientes en: Gestión de Incidentes (ITIL): procesos de respuesta y registro ante fallas.Fundamentos de Alta Disponibilidad y Backup: conceptos de continuidad y recuperación.Monitoreo y Observabilidad: uso de herramientas de monitoreo y alertamiento.Automatización e IaC: nociones de Terraform, Ansible o scripting de tareas.
Publicado por

Sofía Muñoz
MyJob · HR