Chaos & Resilience Engineer

Davivienda · Bogotá, D.C. · Colombia

Chaos & Resilience Engineer mid · Operations

Vista previa de la oferta

Chaos & Resilience Engineer

mid · Operations

En Davivienda buscamos un Buscamos un talento apasionado por la automatización, la observabilidad y la confiabilidad, que nos ayude a anticiparnos a las fallas y fortalecer la resiliencia de nuestros sistemas.🚀

🎯 Propósito del rol:

Diseñar, automatizar y ejecutar estrategias que permitan validar la tolerancia a fallos, mejorar la resiliencia de arquitecturas distribuidas y anticipar posibles impactos en la experiencia del usuario, integrando prácticas de Site Reliability Engineering (SRE), Ingeniería de Caos y Observabilidad dentro del ciclo de vida del software.

🔍 Funciones principales:

• Diseñar y ejecutar experimentos de Ingeniería de Caos e inyección controlada de fallas para identificar vulnerabilidades en los sistemas antes de que impacten al usuario.

• Automatizar escenarios de resiliencia e integrarlos a los pipelines CI/CD, desarrollando SDKs, librerías compartidas y Golden Paths para estandarizar el monitoreo y las pruebas de resiliencia.

• Implementar Observabilidad como Código (OaC) e Infraestructura como Código (IaC), optimizando la gestión y despliegue de componentes de observabilidad.

• Diseñar y administrar estrategias de telemetría, colectores, sampling y modelos semánticos, buscando eficiencia y optimización de costos de ingesta y almacenamiento.

• Definir, implementar, iterar y validar estrategias de resiliencia y confiabilidad en ambientes controlados.

📚 Conocimientos técnicos:

• SRE, Observabilidad e Ingeniería de Caos

• Open Telemetry (OTel), Elastic, Prometheus y Grafana

• Herramientas de Chaos Engineering como Litmus, Chaos Mesh, Chaos Monkey o Gremlin

• Terraform, Ansible, Helm y Kubernetes

• Experiencia en al menos una plataforma Cloud: AWS o GCP

• GitHub / GitLab y manejo de pipelines CI/CD

• Automatización y prácticas de Infrastructure as Code (IaC)

• Conocimiento de herramientas de monitoreo y observabilidad como Dynatrace o SolarWinds

• Deseable conocimiento en IA aplicada a automatización, analítica predictiva y AIOps

✨ ¿Qué buscamos además de lo técnico?

Una persona con pensamiento analítico, capacidad para diseñar estrategias, experimentar, iterar y aprender de las fallas, con mentalidad de automatización y orientación a la mejora continua.

📌 Experiencia: Mínimo 4 años en roles técnicos relacionados con SRE, automatización, observabilidad, infraestructura o tecnologías afines.

Información importante para tu postulación

Una vez te inscribas, te confirmaremos los próximos pasos.

👩🏻‍💼 Consultora a cargo: Stefania Pineda

¡No te quedes por fuera!

Antes de postularte, asegúrate de:

• Tener tu hoja de vida completa en los módulos 1, 2 y 3

• Responder todas las preguntas filtro de la vacante

⚠ ️ De lo contrario, tu aplicación quedará en estado “pendiente” y no será considerada.

👀 Puedes revisar el estado de tu postulación en la sección de postulaciones.

Habilidades

Palabras clave:

sre, sot, AIOps, Site Reliability Engineering

Ver empresa: Davivienda

¡Ten cuidado con el fraude!

Magneto y sus empresas aliadas nunca te pedirán dinero a cambio en un proceso de selección. Ten cuidado, revisa bien la vacante y si ves algo sospechoso repórtalo.Reportar fraudeAplicar

Compartir en:

Encuentra más ofertas como esta

Explora más ofertas activas de esta empresa o crea una cuenta en Insider Jobs para buscar, guardar y seguir oportunidades en todo el job board.