Site Reliability Engineer (SRE)

BC Tecnología

Ciudad de México

Presencial

MXN 800.000 - 1.000.000

Jornada completa

14 días+

Recibe más respuestas de empleadores

Envía un currículum específico para el puesto de trabajo en cuestión de minutos.

Descripción de la vacante

BC Tecnología busca un/a Site Reliability Engineer (SRE) en Ciudad de México. El rol se enfoca en garantizar la disponibilidad y estabilidad de plataformas tecnológicas críticas mediante el monitoreo y la automatización de tareas.

Los candidatos deben tener experiencia en gestión de incidentes, stacks de observabilidad y trabajar en entornos de alta disponibilidad. Se valorarán certificaciones como AWS Certified y experiencia con herramientas como Grafana y Zabbix.

Formación

  • Experiencia comprobable en implementación y operación de stacks de observabilidad en ambientes productivos.
  • Conocimientos sólidos en alta disponibilidad, monitoreo, performance y automatización.
  • Experiencia gestionando incidentes críticos P1/P2 y elaboración de RCA.

Responsabilidades

  • Revisión continua del estado de plataformas: métricas, capacidad, rendimiento y latencias.
  • Detección temprana de riesgos operativos y recomendaciones preventivas.
  • Monitoreo y revisión de observabilidad: métricas, logs y alertas definidas por el cliente.

Conocimientos

Observabilidad en ambientes productivos
Gestión de incidentes críticos P1/P2
Automatización y scripting
Monitoreo y performance

Herramientas

Grafana
Zabbix
OpenTelemetry
Wazuh
AWS
Linux / Red Hat

Descripción del empleo

Nos encontramos en búsqueda de un/a Site Reliability Engineer (SRE), quien será responsable de garantizar la disponibilidad, estabilidad, continuidad operativa y desempeño de las plataformas tecnológicas del cliente, administrando y evolucionando el ecosistema de observabilidad y monitoreo de ambientes críticos, con foco en la detección temprana de incidentes, automatización y mejora continua de la operación.

Principales responsabilidades
  • Revisión continua del estado de plataformas: métricas, capacidad, rendimiento y latencias.
  • Detección temprana de riesgos operativos y recomendaciones preventivas.
  • Monitoreo y revisión de observabilidad: métricas, logs y alertas definidas por el cliente.
  • Análisis y gestión de alertas durante el horario del servicio, proponiendo acciones de mitigación.
  • Revisión y validación de configuraciones de alta disponibilidad, replicación y failover.
  • Automatización de tareas críticas y repetitivas mediante scripts y procesos.
  • Participación en análisis de incidentes críticos y elaboración de RCA (Root Cause Analysis).
  • Construcción de dashboards, alertamiento proactivo y correlación de eventos.
  • Análisis de desempeño end-to-end de plataformas y servicios.
Tecnologías y herramientas
  • Grafana
  • Zabbix
  • OpenTelemetry
  • Wazuh
  • AWS
  • Linux / Red Hat
  • Herramientas de automatización y scripting
Requisitos
  • Experiencia comprobable en implementación y operación de stacks de observabilidad en ambientes productivos.
  • Experiencia gestionando incidentes críticos P1/P2 y elaboración de RCA.
  • Experiencia trabajando bajo esquemas on-call y atención fuera de horario hábil.
  • Conocimientos sólidos en alta disponibilidad, monitoreo, performance y automatización.

Buscamos una persona analítica, proactiva y orientada a la mejora continua, con capacidad para actuar rápidamente ante incidentes críticos y colaborar en entornos de alta disponibilidad y operación continua.

Certificaciones deseables
  • Deseable experiencia en entornos cloud AWS y administración Linux.
  • AWS Certified SysOps Administrator – Associate
  • AWS Certified DevOps Engineer – Professional
  • ITIL Foundation
  • Red Hat Certified System Administrator (RHCSA) o RHCE
  • Grafana Certified Associate
Consigue la evaluación confidencial y gratuita de tu currículum.
o arrastra y suelta tu archivo aquí
Similar jobs

Puestos de trabajo similares que vale la pena comparar

Ingeniero de Confiabilidad de Sitio (SRE) y Observabilidad
Ingeniero de Confiabilidad de Sitio (SRE) y Observabilidad

AvantGarde Human Capital Consultants • Ciudad de México

Presencial
MXN 540.000 - 860.000
Líder de SRE y Observabilidad para Plataformas Críticas
Líder de SRE y Observabilidad para Plataformas Críticas

AvantGarde Human Capital Consultants • Ciudad de México

Presencial
MXN 540.000 - 860.000
SRE — Disponibilidad, Observabilidad y Automatización
SRE — Disponibilidad, Observabilidad y Automatización

BC Tecnología • Ciudad de México

Presencial
MXN 800.000 - 1.000.000
Site Reliability Engineer
Site Reliability Engineer

Confidencial • México

Presencial
MXN 900.000 - 1.200.000
Site Reliability Engineer
Site Reliability Engineer

D4 Consultores • Chihuahua

Presencial
MXN 420.000 - 720.000
Prestaciones superiores
Presencial
Nomina 100%
SRE Engineer/DevOps
SRE Engineer/DevOps

D4 Consultores • Chihuahua

Presencial
MXN 600.000 - 1.000.000
Prestaciones superiores
Presencial
Esquema 100% nomina
Ing de SRE
Ing de SRE

CONTPAQi • Región Centro

Presencial
MXN 1.000.000 - 1.800.000
Espíritu colaborativo
Desarrollo y crecimiento
Prestaciones superiores a la ley
+1
Ingeniero de Confiabilidad de Sitios (SRE/DevOps)
Ingeniero de Confiabilidad de Sitios (SRE/DevOps)

D4 Consultores • Chihuahua

Presencial
MXN 420.000 - 720.000
Prestaciones superiores
Presencial
Nomina 100%
SRE Semi Senior - AWS, Kubernetes & Observabilidad
SRE Semi Senior - AWS, Kubernetes & Observabilidad

Sngular • Ciudad de México

Presencial
MXN 550.000 - 850.000
Seguro de Salud
Seguro de Vida
Vales Despensa
+5
Ingeniero SRE: Nube, Observabilidad y CI/CD
Ingeniero SRE: Nube, Observabilidad y CI/CD

CONTPAQi • Región Centro

Presencial
MXN 1.000.000 - 1.800.000
Espíritu colaborativo
Desarrollo y crecimiento
Prestaciones superiores a la ley
+1