Senior SRE Lead: Reliability, Observability & AI Ops

Cloudsufi

Región Centro

Presencial

MXN 900.000 - 1.400.000

Jornada completa

Hace 2 días
Sé de los primeros/as/es en solicitar esta vacante
Generador de candidaturas

Transforma esta oferta en una entrevista — un currículum y una carta de presentación creados pensando en lo que quiere el empleador.

Supera los filtros ATS

Descripción de la vacante

Cloudsufi is seeking a Lead SRE Engineer to drive reliability across Guadalajara-based enterprise environments. The role requires hands-on expertise with observability platforms, incident management, and AWS/Kubernetes ecosystems.

You will mentor engineers and push for AI-enabled reliability improvements. Ideal candidates have 6–10 years of SRE/DevOps experience, proficiency with Terraform and monitoring tools, and a proven track record in incident RCA and postmortems.

Formación

  • 6–10 years of experience in SRE/DevOps or related roles.
  • Strong observability, monitoring, and incident management experience.
  • Hands-on with APM platforms and log management tools.
  • Experience with alerting, paging, and incident response processes.

Responsabilidades

  • Lead SRE initiatives across enterprise production environments.
  • Improve reliability, availability, scalability, and performance.
  • Lead P1/P2 incident response, RCA, and postmortems.
  • Define and improve SLI/SLO/Error Budget practices.
  • Build observability through monitoring dashboards and alerts.
  • Automate ops using Python/Bash and APIs.
  • Manage IaC with Terraform.
  • Support AWS cloud infrastructure including Kubernetes/EKS, ECS/Fargate, Lambda, RDS/Aurora, SQS/SNS.
  • Mentor SRE/DevOps engineers and collaborate with teams.
  • Contribute to AI-enabled reliability and AIOps initiatives.

Conocimientos

Observability/Monitoring
Distributed tracing
Dashboards & monitoring
Alerting/Incident Management
SRE/DevOps practices
Python/Bash scripting
Kubernetes/EKS familiarity
IaC with Terraform
AWS cloud infrastructure
AIOps awareness
Mentoring/leadership

Herramientas

Datadog
New Relic
Dynatrace
Grafana/Prometheus
Splunk/OpenSearch/ELK
CloudWatch
AppDynamics
PagerDuty
Grafana Alerting
Kubernetes
Terraform
Python

Descripción del empleo

Cloudsufi is seeking a Lead SRE Engineer to drive reliability across Guadalajara-based enterprise environments. The role requires hands-on expertise with observability platforms, incident management, and AWS/Kubernetes ecosystems.

You will mentor engineers and push for AI-enabled reliability improvements. Ideal candidates have 6–10 years of SRE/DevOps experience, proficiency with Terraform and monitoring tools, and a proven track record in incident RCA and postmortems.

Consigue la evaluación confidencial y gratuita de tu currículum.

o arrastra y suelta tu archivo aquí

Similar jobs

Puestos de trabajo similares que vale la pena comparar

Lead SRE Engineer
Lead SRE Engineer

Cloudsufi • Región Centro

Presencial
MXN 900.000 - 1.400.000
Remote SRE Lead - Observability, IaC & Automation
Remote SRE Lead - Observability, IaC & Automation

Xideral • Región Centro

A distancia
MXN 700.000 - 900.000
Attractive Salary
Performance bonuses
SGMM Medical insurance
Senior SRE Lead (IC): Reliability & AI Automation
Senior SRE Lead (IC): Reliability & AI Automation

Hobbsnews • México

A distancia
MXN 1.750.000 - 2.276.000
Site Reliability Engineering (SRE) Lead - 2770
Site Reliability Engineering (SRE) Lead - 2770

Xideral • Región Centro

A distancia
MXN 700.000 - 900.000
Attractive Salary
Performance bonuses
SGMM Medical insurance
Senior SRE Engineer - Remote (Guadalajara)
Senior SRE Engineer - Remote (Guadalajara)

Salesloft • Región Centro

Presencial
MXN 900.000 - 1.200.000
Senior Cloud SRE — AWS/Azure, Kubernetes, Remote Mexico
Senior Cloud SRE — AWS/Azure, Kubernetes, Remote Mexico

Xideral • Región Centro

Híbrido
MXN 1.200.000 - 1.500.000
Premium Benefits
Performance bonuses
SGMM Medical insurance
Cloud SRE Engineer - IaC, Kubernetes & Observability
Cloud SRE Engineer - IaC, Kubernetes & Observability

NTT DATA North America • Región Centro

Presencial
MXN 420.000 - 660.000
Remote Senior SRE: High-Impact Reliability & Observability
Remote Senior SRE: High-Impact Reliability & Observability

Jobgether • México

A distancia
MXN 900.000 - 1.300.000
Fully remote working environment
Global engineering organization
Ownership over production reliability
Remote SRE Engineer - Automate, Observe & Own Reliability
Remote SRE Engineer - Automate, Observe & Own Reliability

AgileEngine • Ciudad de México

Híbrido
MXN 1.049.000 - 1.400.000
Senior SRE Architect — AI-Driven Reliability & Observability
Senior SRE Architect — AI-Driven Reliability & Observability

Capital One • Ciudad de México

Híbrido
MXN 1.400.000 - 2.100.000