Ingeniero de Confiabilidad de Sitio (SRE) y Observabilidad

AvantGarde Human Capital Consultants

Ciudad de México

Presencial

MXN 540.000 - 860.000

Jornada completa

14 días+
Generador de candidaturas

Consigue una respuesta de este reclutador — un currículum y una carta de presentación adaptados exactamente a lo que busca para contratar.

Supera los filtros ATS

Descripción de la vacante

AvantGarde Human Capital Consultants busca un(a) Site Reliability Engineer (SRE) y Observability Engineer con experiencia en entornos de misión crítica, enfocado en garantizar la disponibilidad, estabilidad y desempeño de plataformas tecnológicas de alta disponibilidad.

Serás responsable de asegurar la estabilidad y observabilidad de servicios críticos mediante monitoreo proactivo, automatización, gestión de incidentes y análisis de causa raíz, con foco en reducción de toil y mejora continua.

Formación

  • Experiencia comprobable en SRE y observabilidad de entornos de misión crítica.
  • Conocimientos para establecer SLIs/SLOs y gestionar budgets de error.
  • Capacidad para trabajar de forma proactiva ante incidentes y automar procesos operativos.

Responsabilidades

  • Diseñar, administrar y evolucionar la plataforma de observabilidad (métricas, logs y trazas).
  • Definir e implementar indicadores de confiabilidad (SLIs/SLOs) y administrar budgets de error.
  • Liderar la respuesta técnica ante incidentes críticos (Sev1 y Sev2).
  • Realizar análisis de causa raíz (RCA) y conducir post-mortems.
  • Automatizar procesos operativos para reducir toil y minimizar errores.
  • Implementar mejoras para incrementar disponibilidad y resiliencia de servicios.
  • Colaborar con desarrollo, infraestructura y operaciones para fortalecer la confiabilidad.

Conocimientos

SRE
Observability
Monitoreo
Automatización
Gestión de incidentes

Descripción del empleo

Empresa del sector financiero busca un(a) Site Reliability Engineer (SRE) & Observability Engineer con experiencia en ambientes de misión crítica, enfocado en garantizar la disponibilidad, estabilidad y desempeño de plataformas tecnológicas de alta disponibilidad.

¿Cuál será tu misión?

Serás responsable de asegurar la estabilidad y observabilidad de servicios críticos mediante prácticas de Site Reliability Engineering (SRE), liderando iniciativas de monitoreo proactivo, automatización, gestión de incidentes, análisis de causa raíz y mejora continua.

Responsabilidades principales
  • Diseñar, administrar y evolucionar la plataforma de observabilidad (métricas, logs y trazas).
  • Definir e implementar indicadores de confiabilidad (SLIs/SLOs) y administrar error budgets.
  • Liderar la respuesta técnica ante incidentes críticos (Sev1 y Sev2).
  • Realizar análisis de causa raíz (RCA) y conducir post-mortems.
  • Automatizar procesos operativos para reducir trabajo manual (toil) y minimizar errores.
  • Implementar mejoras continuas para incrementar la disponibilidad y resiliencia de los servicios.
  • Colaborar con equipos de desarrollo, infraestructura y operaciones para fortalecer la confiabilidad de las plataformas.
Consigue la evaluación confidencial y gratuita de tu currículum.

o arrastra y suelta tu archivo aquí

Similar jobs

Puestos de trabajo similares que vale la pena comparar

Líder de SRE y Observabilidad para Plataformas Críticas
Líder de SRE y Observabilidad para Plataformas Críticas

AvantGarde Human Capital Consultants • Ciudad de México

Presencial
MXN 540.000 - 860.000
Site Reliability Engineer
Site Reliability Engineer

Confidencial • México

Presencial
MXN 900.000 - 1.200.000
Ingeniero de Fiabilidad del Sitio (SRE) - Observabilidad & CI/CD
Ingeniero de Fiabilidad del Sitio (SRE) - Observabilidad & CI/CD

GrainChain Inc • Región Centro

Presencial
Site Reliability Engineer
Site Reliability Engineer

D4 Consultores • Chihuahua

Presencial
MXN 420.000 - 720.000
Prestaciones superiores
Presencial
Nomina 100%
Senior SRE: Lidera Confiabilidad, Observabilidad y CI/CD
Senior SRE: Lidera Confiabilidad, Observabilidad y CI/CD

Confidencial • México

Presencial
MXN 900.000 - 1.200.000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

adlytics GmbH • Región Centro

Híbrido
MXN 900.000 - 1.300.000
Sueldo acorde a experiencia
Esquema 100% nómina
Prestaciones de Ley
+5
Ingeniero de Confiabilidad de Sitios (SRE/DevOps)
Ingeniero de Confiabilidad de Sitios (SRE/DevOps)

D4 Consultores • Chihuahua

Presencial
MXN 420.000 - 720.000
Prestaciones superiores
Presencial
Nomina 100%
IC3 Infra SRE Engineer - Automation & Reliability
IC3 Infra SRE Engineer - Automation & Reliability

Spin • Monterrey

Presencial
MXN 420.000 - 620.000
SRE Engineer/DevOps
SRE Engineer/DevOps

D4 Consultores • Chihuahua

Presencial
MXN 600.000 - 1.000.000
Prestaciones superiores
Presencial
Esquema 100% nomina
Senior Site Reliability Engineer
Senior Site Reliability Engineer

Capital Empresarial Horizonte • Región Centro

Híbrido
MXN 720.000 - 1.080.000