Magneto para:
¿Eres empresa? Descubre nuestras soluciones y agenda una cita haciendoclic aquí

Blog

Logo Magneto

Cargando resultados

En este momento estamos cargando los resultados disponibles

https://static.magneto365.com/lib/assets/2.93.12/9321e901f2689afe.svg icon item

/ empleos

/ Chaos & Resilience Engineer

Trabajo en Davivienda

Chaos & Resilience Engineer

Davivienda | Término indefinido, 1 cupos
Fecha de publicación 2026-09-10
iconReportar

    Requisitos para aplicar a la vacante:

  • Briefcase-icon4 años de experiencia, Profesional hasta Especialización/ Maestría
  • DollarCircle-iconSalario a convenir
  • Location-iconBogotá, D.C.

En Davivienda buscamos un Buscamos un talento apasionado por la automatización, la observabilidad y la confiabilidad, que nos ayude a anticiparnos a las fallas y fortalecer la resiliencia de nuestros sistemas.🚀



🎯 Propósito del rol:

Diseñar, automatizar y ejecutar estrategias que permitan validar la tolerancia a fallos, mejorar la resiliencia de arquitecturas distribuidas y anticipar posibles impactos en la experiencia del usuario, integrando prácticas de Site Reliability Engineering (SRE), Ingeniería de Caos y Observabilidad dentro del ciclo de vida del software.



🔍 Funciones principales:

Diseñar y ejecutar experimentos de Ingeniería de Caos e inyección controlada de fallas para identificar vulnerabilidades en los sistemas antes de que impacten al usuario.

Automatizar escenarios de resiliencia e integrarlos a los pipelines CI/CD, desarrollando SDKs, librerías compartidas y Golden Paths para estandarizar el monitoreo y las pruebas de resiliencia.

Implementar Observabilidad como Código (OaC) e Infraestructura como Código (IaC), optimizando la gestión y despliegue de componentes de observabilidad.

Diseñar y administrar estrategias de telemetría, colectores, sampling y modelos semánticos, buscando eficiencia y optimización de costos de ingesta y almacenamiento.

Definir, implementar, iterar y validar estrategias de resiliencia y confiabilidad en ambientes controlados.



📚 Conocimientos técnicos:

SRE, Observabilidad e Ingeniería de Caos

Open Telemetry (OTel), Elastic, Prometheus y Grafana

Herramientas de Chaos Engineering como Litmus, Chaos Mesh, Chaos Monkey o Gremlin

Terraform, Ansible, Helm y Kubernetes

Experiencia en al menos una plataforma Cloud: AWS o GCP

GitHub / GitLab y manejo de pipelines CI/CD

Automatización y prácticas de Infrastructure as Code (IaC)

Conocimiento de herramientas de monitoreo y observabilidad como Dynatrace o SolarWinds

Deseable conocimiento en IA aplicada a automatización, analítica predictiva y AIOps


✨ ¿Qué buscamos además de lo técnico?


Una persona con pensamiento analítico, capacidad para diseñar estrategias, experimentar, iterar y aprender de las fallas, con mentalidad de automatización y orientación a la mejora continua.


📌 Experiencia: Mínimo 4 años en roles técnicos relacionados con SRE, automatización, observabilidad, infraestructura o tecnologías afines.



Información importante para tu postulación

Una vez te inscribas, te confirmaremos los próximos pasos.

👩🏻‍💼 Consultora a cargo: Stefania Pineda

¡No te quedes por fuera!

Antes de postularte, asegúrate de:

Tener tu hoja de vida completa en los módulos 1, 2 y 3

Responder todas las preguntas filtro de la vacante

⚠ ️ De lo contrario, tu aplicación quedará en estado “pendiente” y no será considerada.

👀 Puedes revisar el estado de tu postulación en la sección de postulaciones.


subtitle-iconHabilidades

  • Observabilidad y Telemetría
  • Infraestructura y Cloud
  • FinOps

subtitle-iconPalabras clave:

sre, sot, AIOps, Site Reliability Engineering

subtitle-iconVer empresa: Davivienda