Vista previa de la oferta
Chaos & Resilience Engineer
mid · Operations
- 4 años de experiencia, Profesional hasta Especialización/ Maestría
- Salario a convenir
- Bogotá, D.C.
Requisitos para aplicar a la vacante:
En Davivienda buscamos un Buscamos un talento apasionado por la automatización, la observabilidad y la confiabilidad, que nos ayude a anticiparnos a las fallas y fortalecer la resiliencia de nuestros sistemas.🚀
🎯 Propósito del rol:
Diseñar, automatizar y ejecutar estrategias que permitan validar la tolerancia a fallos, mejorar la resiliencia de arquitecturas distribuidas y anticipar posibles impactos en la experiencia del usuario, integrando prácticas de Site Reliability Engineering (SRE), Ingeniería de Caos y Observabilidad dentro del ciclo de vida del software.
🔍 Funciones principales:
• Diseñar y ejecutar experimentos de Ingeniería de Caos e inyección controlada de fallas para identificar vulnerabilidades en los sistemas antes de que impacten al usuario.
• Automatizar escenarios de resiliencia e integrarlos a los pipelines CI/CD, desarrollando SDKs, librerías compartidas y Golden Paths para estandarizar el monitoreo y las pruebas de resiliencia.
• Implementar Observabilidad como Código (OaC) e Infraestructura como Código (IaC), optimizando la gestión y despliegue de componentes de observabilidad.
• Diseñar y administrar estrategias de telemetría, colectores, sampling y modelos semánticos, buscando eficiencia y optimización de costos de ingesta y almacenamiento.
• Definir, implementar, iterar y validar estrategias de resiliencia y confiabilidad en ambientes controlados.
📚 Conocimientos técnicos:
• SRE, Observabilidad e Ingeniería de Caos
• Open Telemetry (OTel), Elastic, Prometheus y Grafana
• Herramientas de Chaos Engineering como Litmus, Chaos Mesh, Chaos Monkey o Gremlin
• Terraform, Ansible, Helm y Kubernetes
• Experiencia en al menos una plataforma Cloud: AWS o GCP
• GitHub / GitLab y manejo de pipelines CI/CD
• Automatización y prácticas de Infrastructure as Code (IaC)
• Conocimiento de herramientas de monitoreo y observabilidad como Dynatrace o SolarWinds
• Deseable conocimiento en IA aplicada a automatización, analítica predictiva y AIOps
✨ ¿Qué buscamos además de lo técnico?
Una persona con pensamiento analítico, capacidad para diseñar estrategias, experimentar, iterar y aprender de las fallas, con mentalidad de automatización y orientación a la mejora continua.
📌 Experiencia: Mínimo 4 años en roles técnicos relacionados con SRE, automatización, observabilidad, infraestructura o tecnologías afines.
Información importante para tu postulación
Una vez te inscribas, te confirmaremos los próximos pasos.
👩🏻💼 Consultora a cargo: Stefania Pineda
¡No te quedes por fuera!
Antes de postularte, asegúrate de:
• Tener tu hoja de vida completa en los módulos 1, 2 y 3
• Responder todas las preguntas filtro de la vacante
⚠ ️ De lo contrario, tu aplicación quedará en estado “pendiente” y no será considerada.
👀 Puedes revisar el estado de tu postulación en la sección de postulaciones.
Habilidades
- Observabilidad y Telemetría
- Infraestructura y Cloud
- FinOps
Palabras clave:
sre, sot, AIOps, Site Reliability Engineering
Ver empresa: Davivienda
¡Ten cuidado con el fraude!
Magneto y sus empresas aliadas nunca te pedirán dinero a cambio en un proceso de selección. Ten cuidado, revisa bien la vacante y si ves algo sospechoso repórtalo.Reportar fraudeAplicarCompartir en: