SRE & DevOps — Observability & SLO Expert

Luxoft

México

Presencial

MXN 800.000 - 1.100.000

Jornada completa

Hace 7 días
Sé de los primeros/as/es en solicitar esta vacante
Generador de candidaturas

Consigue una respuesta de este empleador — un currículum y una carta de presentación adaptados exactamente a lo que busca para contratar.

Supera los filtros ATS

Descripción de la vacante

Luxoft is seeking a specialist to join a healthcare data platform team focused on SLO-based monitoring and alerting across 110-140 services, including an internal SLA visibility app.

You will design instrumentation, validated signals, and observability adoption across distributed systems, using Grafana, PromQL, and configuration-as-code in Python or TypeScript, with AI-assisted development encouraged. This role emphasizes reliability and collaboration within a flexible Agile environment.

Formación

  • Strong experience in Observability, SRE, or Platform Engineering.
  • Advanced PromQL expertise, including the ability to identify misleading or incorrect query results.
  • Hands-on experience designing and implementing SLOs and multi-window burn-rate alerting.
  • Experience with Grafana provisioning and configuration as code.
  • Ability to build automation tools and code generators using Python or TypeScript.
  • Hands-on experience using AI-assisted development tools such as Claude Code, GitHub Copilot, or equivalent.
  • Strong analytical mindset with a healthy skepticism toward telemetry data.
  • Experience validating signals through multiple independent sources before operationalizing alerts.
  • Experience with cloud-native or distributed systems environments.

Responsabilidades

  • Design and maintain SLO-based monitoring and alerting solutions.
  • Create and optimize PromQL queries and multi-window burn-rate alerts.
  • Build and manage Grafana dashboards using configuration-as-code practices.
  • Develop automation and monitoring configuration generators in Python or TypeScript.
  • Contribute to Terraform-based observability infrastructure.
  • Validate monitoring signals and improve alert quality.
  • Collaborate with engineering and platform teams to enhance reliability and operational visibility.

Conocimientos

Observability/SRE
PromQL expertise
SLOs & burn-rate alerts
Grafana as code
Python/TypeScript automation
Terraform observability
AI-assisted development
Telemetry data analysis
Multi-source signal validation
Cloud-native distributed systems

Herramientas

Grafana
Terraform
Python
TypeScript

Descripción del empleo

Luxoft is seeking a specialist to join a healthcare data platform team focused on SLO-based monitoring and alerting across 110-140 services, including an internal SLA visibility app.

You will design instrumentation, validated signals, and observability adoption across distributed systems, using Grafana, PromQL, and configuration-as-code in Python or TypeScript, with AI-assisted development encouraged. This role emphasizes reliability and collaboration within a flexible Agile environment.

Consigue la evaluación confidencial y gratuita de tu currículum.

o arrastra y suelta tu archivo aquí

Similar jobs

Puestos de trabajo similares que vale la pena comparar

AI-Driven SRE & DevOps Engineer: Observability
AI-Driven SRE & DevOps Engineer: Observability

Luxoft • México

Presencial
MXN 900.000 - 1.200.000
Lead SRE: Observability, Reliability & Cloud Automation
Lead SRE: Observability, Reliability & Cloud Automation

CLOUDSUFI • Región Centro

Presencial
MXN 900.000 - 1.500.000
Lead SRE Engineer
Lead SRE Engineer

CLOUDSUFI • Región Centro

Presencial
MXN 900.000 - 1.500.000
SRE (Engineering & Administration Background)
SRE (Engineering & Administration Background)

Fulcrum Digital • Ciudad de México

Híbrido
MXN 900.000 - 1.500.000
Senior Linux Systems Engineer — SRE & Kubernetes
Senior Linux Systems Engineer — SRE & Kubernetes

Luxoft • México

Presencial
MXN 420.000 - 720.000
Remote Senior SRE: High-Impact Reliability & Observability
Remote Senior SRE: High-Impact Reliability & Observability

Jobgether • México

A distancia
MXN 900.000 - 1.300.000
Fully remote working environment
Global engineering organization
Ownership over production reliability
Site Reliability Engineer ID53670
Site Reliability Engineer ID53670

AgileEngine • Rosarito

Híbrido
MXN 870.000 - 1.306.000
Professional growth
Competitive compensation
Exciting projects
+1
Senior Site Reliability Engineer
Senior Site Reliability Engineer

N-iX • México

Híbrido
MXN 1.200.000 - 1.600.000
Flexible working format
Competitive compensation package
Professional development
Analytics Operations Analyst (SRE) — Hybrid/Remote
Analytics Operations Analyst (SRE) — Hybrid/Remote

SimCorp • Ciudad de México

Híbrido
MXN 420.000 - 780.000
Hybrid work model
Competitive compensation
Professional development opportunities
Site Reliability Engineer ID60188
Site Reliability Engineer ID60188

AgileEngine • Ciudad de México

Híbrido
MXN 1.049.000 - 1.400.000
Professional growth: Mentorship, TechTalks, and personalized growth roadmaps.
Competitive compensation: USD-based pay with education, fitness, and team activity budgets.
Exciting projects: Modern solutions with Fortune 500 and top product companies.
+1