AI-Driven SRE & DevOps Engineer: Observability

Luxoft

México

Presencial

MXN 900.000 - 1.200.000

Jornada completa

Hace 3 días
Sé de los primeros/as/es en solicitar esta vacante
Generador de candidaturas

Destaca en este puesto — genera un currículum adaptado y una carta de presentación en aproximadamente un minuto.

Supera los filtros ATS

Descripción de la vacante

Luxoft in Mexico is seeking an experienced Observability Engineer to design and maintain SLO-based monitoring and alerting for a distributed healthcare data platform. You will implement PromQL queries, Grafana dashboards, and automation tools to improve reliability and visibility across 110-140 services.

The role emphasizes AI-assisted development, telemetry quality, and collaboration with platform teams to drive observability adoption in cloud-native environments.

Formación

  • Strong experience in Observability, SRE, or Platform Engineering.
  • Advanced PromQL expertise, including identifying misleading or incorrect query results.
  • Hands-on experience designing and implementing SLOs and multi-window burn-rate alerting.
  • Experience with Grafana provisioning and configuration as code.
  • Ability to build automation tools and code generators using Python or TypeScript.
  • Hands-on experience using AI-assisted development tools such as Claude Code, GitHub Copilot, or equivalent. AI-assisted engineering is an expected part of the development workflow.
  • Strong analytical mindset with a healthy skepticism toward telemetry data.
  • Experience validating signals through multiple independent sources before operationalizing alerts.
  • Experience with cloud-native or distributed systems environments.

Responsabilidades

  • Design and maintain SLO-based monitoring and alerting solutions.
  • Create and optimize PromQL queries and multi-window burn-rate alerts.
  • Build and manage Grafana dashboards using configuration-as-code practices.
  • Develop automation and monitoring configuration generators in Python or TypeScript.
  • Contribute to Terraform-based observability infrastructure.
  • Validate monitoring signals and improve alert quality.
  • Collaborate with engineering and platform teams to enhance reliability and operational visibility.

Conocimientos

Observability / SRE
PromQL expert
Grafana provisioning
Python or TypeScript
AI-assisted development tools
Telemetry validation

Herramientas

Grafana
Terraform
Prometheus
Python
TypeScript
GitHub Copilot

Descripción del empleo

Luxoft in Mexico is seeking an experienced Observability Engineer to design and maintain SLO-based monitoring and alerting for a distributed healthcare data platform. You will implement PromQL queries, Grafana dashboards, and automation tools to improve reliability and visibility across 110-140 services.

The role emphasizes AI-assisted development, telemetry quality, and collaboration with platform teams to drive observability adoption in cloud-native environments.

Consigue la evaluación confidencial y gratuita de tu currículum.

o arrastra y suelta tu archivo aquí

Similar jobs

Puestos de trabajo similares que vale la pena comparar

SRE & DevOps — Observability & SLO Expert
SRE & DevOps — Observability & SLO Expert

Luxoft • México

Presencial
MXN 800.000 - 1.100.000
Senior SRE Lead: Reliability, Observability & AI Ops
Senior SRE Lead: Reliability, Observability & AI Ops

Cloudsufi • Región Centro

Presencial
MXN 900.000 - 1.400.000
Senior SRE Architect — AI-Driven Reliability & Observability
Senior SRE Architect — AI-Driven Reliability & Observability

Capital One • Ciudad de México

Híbrido
MXN 1.400.000 - 2.100.000
Remote Senior SRE: High-Impact Reliability & Observability
Remote Senior SRE: High-Impact Reliability & Observability

Jobgether • México

A distancia
MXN 900.000 - 1.300.000
Fully remote working environment
Global engineering organization
Ownership over production reliability
Observability & AI Full-Stack Systems Engineer
Observability & AI Full-Stack Systems Engineer

Nutanix • Ciudad de México

Presencial
MXN 700.000 - 1.000.000
SRE (Engineering & Administration Background)
SRE (Engineering & Administration Background)

Fulcrum Digital • Ciudad de México

Híbrido
MXN 900.000 - 1.500.000
Full-Stack Engineer for AI-Driven Observability
Full-Stack Engineer for AI-Driven Observability

Qualcomm • Ciudad de México

Presencial
MXN 600.000 - 900.000
Senior Linux Systems Engineer — SRE & Kubernetes
Senior Linux Systems Engineer — SRE & Kubernetes

Luxoft • México

Presencial
MXN 420.000 - 720.000
Agentic AI & Observability Software Engineer
Agentic AI & Observability Software Engineer

Qualcomm • Ciudad de México

Presencial
MXN 600.000 - 900.000
AI Reliability Engineer – Observability & Safe Deployments
AI Reliability Engineer – Observability & Safe Deployments

Applaudo • Estado de México

Presencial
MXN 1.085.000 - 1.447.000