Ingeniero/a SRE2 - Site Reliability Engineer

Digital Profit Colombia S.A.S

Bogotá ciudad

Híbrido

COP 89.280.000 - 156.240.000

Jornada completa

Hace 4 días
Sé de los primeros/as/es en solicitar esta vacante
Generador de candidaturas

Consigue una respuesta de este empleador — un currículum y una carta de presentación adaptados exactamente a lo que busca para contratar.

Supera los filtros ATS

Descripción de la vacante

Digital Profit Colombia S.A.S. en Bogotá busca un/a Ingeniero/a SRE2 – Site Reliability Engineer para fortalecer la confiabilidad, resiliencia y disponibilidad de servicios digitales. Se valoran 3 a 5 años de experiencia en operaciones de misión crítica.

El rol implica implementar prácticas SRE, gestionar incidentes mayores, mejorar la observabilidad, definir SLIs/SLOs y liderar iniciativas de automatización y reducción de Toil, con modalidad híbrida 3x2 y contrato indefinido.

Formación

  • Profesional en Ingeniería de Sistemas, Electrónica, Telecomunicaciones o afines.
  • Experiencia 3 a 5 años en operación de servicios digitales de misión crítica.
  • Certificación SRE Foundation requerida.

Responsabilidades

  • Implementar prácticas de SRE en las tribus asignadas y liderar resolución de incidentes mayores.
  • Impulsar mejoras de confiabilidad, observabilidad y SLIs/SLOs.
  • Diseñar planes de automatización y reducir Toil operativo.
  • Liderar pruebas de resiliencia y ejercicios de ingeniería del caos.
  • Analizar incidentes y definir acciones de mejora con seguimiento de RCA.

Conocimientos

Observability
Automation
Incident management
Chaos engineering
SRE practices

Educación

Engineering degree in Systems, Electronics, or Telecommunications
SRE Foundation certification

Descripción del empleo

En Digital Profit estamos buscando un/a Ingeniero/a SRE2 – Site Reliability Engineer, para fortalecer la confiabilidad, resiliencia y disponibilidad de servicios digitales (SECTOR ASEGURADOR)

¿Qué buscamos?

Profesional en Ingeniería de Sistemas, Electrónica, Telecomunicaciones o carreras afines. Deseable especialización en Ingeniería de Software, Arquitectura TI o áreas relacionadas. Experiencia: 3 a 5 años en operación de servicios digitales de misión crítica. Certificaciones: SRE Foundation (requerida)

¿Cuál será tu reto?

Implementar técnicamente las prácticas de Site Reliability Engineering (SRE) en las tribus asignadas, liderar la resolución de incidentes mayores, impulsar mejoras estructurales de confiabilidad y transferir conocimiento a los SRE1, trabajando con autonomía y mínimo acompañamiento.

Monitoreo & Observabilidad
  • Instrumentalizar la observabilidad en las tribus.
  • Impulsar la adopción de prácticas de observabilidad.
  • Mejorar el SLO Score.
  • Coordinar y gestionar necesidades de monitoreo y observabilidad.
SLIs & SLOs
  • Implementar los SLIs y SLOs definidos con el dueño del servicio.
  • Configurar alertas y tableros.
  • Dar seguimiento a los indicadores de confiabilidad de los servicios.
Presupuesto de Error
  • Liderar la aplicación de la política de Error Budget.
  • Participar desde el Planning.
  • Recomendar prioridades de acuerdo con los niveles de confiabilidad.
  • Aplicar las reglas de decisión establecidas.
Automatización & reducción de Toil
  • Identificar y priorizar oportunidades de automatización.
  • Diseñar y liderar iniciativas para reducir Toil.
  • Implementar mejoras que disminuyan tareas operativas repetitivas y aumenten la eficiencia.
Ingeniería del Caos
  • Diseñar escenarios e hipótesis de prueba.
  • Preparar planes y decks para ejercicios de resiliencia.
  • Liderar técnicamente las pruebas de Chaos Engineering.
Postmortem & mejora continua
  • Liderar el análisis técnico posterior a incidentes.
  • Identificar la causa raíz (RCA).
  • Definir y priorizar acciones de mejora de confiabilidad.
  • Dar seguimiento a las acciones preventivas y correctivas.
Ingeniería de Lanzamiento
  • Evaluar el riesgo de confiabilidad asociado a nuevos cambios.
  • Identificar desviaciones.
  • Proponer mejoras para realizar lanzamientos más seguros y confiables.
Incidentes Mayores

Serás parte fundamental del gobierno técnico de incidentes, liderando:

  • Resolución técnica.
  • Formulación de hipótesis.
  • Definición de estrategias de mitigación.
  • Validación de recuperación del servicio.
  • Coordinación técnica durante situaciones críticas.
Buscamos un perfil con mentalidad SRE

Confiabilidad + Observabilidad + Automatización + Resiliencia + Análisis de incidentes + Mejora continua

Una persona con capacidad para pasar de la reacción ante un incidente a la prevención y mejora estructural del servicio.

Ubicación: Bogotá, Colombia

Modalidad: Híbrida 3x2

Contrato: Indefinido

Horario: Lunes a viernes, 8:00 a.m. – 6:00 p.m.

Experiencia: 3 a 5 años

Consigue la evaluación confidencial y gratuita de tu currículum.

o arrastra y suelta tu archivo aquí

Similar jobs

Puestos de trabajo similares que vale la pena comparar

Ingeniero SRE2: Confiabilidad y Observabilidad
Ingeniero SRE2: Confiabilidad y Observabilidad

Digital Profit Colombia S.A.S • Bogotá ciudad

Híbrido
COP 89.280.000 - 156.240.000
Analista Sre Senior Bogotá
Analista Sre Senior Bogotá

Digital Profit Colombia S.A.S • Bogotá ciudad

Híbrido
COP 120.000.000 - 180.000.000
Líder de Site Reliability Engineering (SRE)
Líder de Site Reliability Engineering (SRE)

TALYCAP GLOBAL SAS • Bogotá ciudad

Presencial
COP 120.000.000 - 230.000.000
SRE Senior: Lidera Incidentes, Observabilidad y Automatización
SRE Senior: Lidera Incidentes, Observabilidad y Automatización

Digital Profit Colombia S.A.S • Bogotá ciudad

Híbrido
COP 120.000.000 - 180.000.000
Site Reliability Engineer (SRE)
Site Reliability Engineer (SRE)

Michael Page Colombia • San Gil

Presencial
COP 228.815.000 - 343.224.000
Crecimiento profesional a través de desafíos técnicos
Trabajo con tecnologías cloud de vanguardia
Exposición a prácticas SRE modernas
Site Reliability Engineer- SRE
Site Reliability Engineer- SRE

CINTE Colombia • Colombia

Presencial
COP 45.000 - 60.000
Analista Ssr. DevOps – SRE / Observability
Analista Ssr. DevOps – SRE / Observability

MailAmericas • Bogotá ciudad

Presencial
COP 120.000.000 - 180.000.000
Líder SRE — Resiliencia, Observabilidad y Automatización
Líder SRE — Resiliencia, Observabilidad y Automatización

TALYCAP GLOBAL SAS • Bogotá ciudad

Híbrido
COP 120.000.000 - 230.000.000
Ingeniero SRE de Servicios TI: Confiabilidad y Automatización
Ingeniero SRE de Servicios TI: Confiabilidad y Automatización

Bancolombia • Zona Cartón Colombia

Presencial
COP 60.000.000 - 100.000.000
Planes de ahorro
Seguro de vida
Bonos
Service Reliability Engineer
Service Reliability Engineer

1083 Amadeus IT Group Colombia, S.A.S. • Colombia

Presencial
COP 182.089.000 - 254.926.000
Competitive remuneration
Vacation and holiday paid time off
Health insurances
+3