Senior SRE & Observability Engineer: Incident & Reliability

TransUnion

Mexico

Hybrid

PHP 600,000 - 900,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

TransUnion’s Reliability Engineering team ensures the stability, availability, and performance of mission-critical platforms. The role focuses on observability, incident management, and platform engineering to support business operations.

This on-site position requires in-person work at a TU office location. The candidate will lead incident responses, perform RCAs, and define SLIs/SLOs to drive continuous improvement.

Qualifications

  • Bachelor’s degree in Computer Science, Systems Engineering, Telecommunications Engineering, or a related technical discipline.
  • Proven experience in Site Reliability Engineering (SRE) or Production Operations.
  • Strong knowledge of distributed systems, observability practices, incident management, and troubleshooting methodologies.
  • Experience managing major incidents and root cause analysis processes.
  • Understanding of reliability frameworks including SLOs, SLIs, and error budgets.

Responsibilities

  • Ensure the reliability, stability, and availability of mission-critical services through SRE best practices.
  • Operate and improve the observability platform, including metrics, logs, traces, and alerting.
  • Monitor critical systems and respond to incidents to minimize service disruption.
  • Lead major incident response activities and coordinate recovery efforts and communications.
  • Conduct RCA and blameless post-mortems to identify improvements.
  • Define and monitor SLIs, SLOs, and error budgets.
  • Automate processes to reduce toil through scripting and platform engineering.
  • Support and troubleshoot distributed environments including Cassandra, Kafka, Kubernetes, and databases.
  • Collaborate with teams to improve deployment reliability and platform performance.
  • Drive continuous improvement in monitoring, availability, and resilience.

Skills

SRE
Observability
Incident management

Education

Bachelor's degree in Computer Science

Tools

Apache Cassandra
Kafka
Kubernetes

Job description

TransUnion’s Reliability Engineering team ensures the stability, availability, and performance of mission-critical platforms. The role focuses on observability, incident management, and platform engineering to support business operations.

This on-site position requires in-person work at a TU office location. The candidate will lead incident responses, perform RCAs, and define SLIs/SLOs to drive continuous improvement.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Senior Site Reliability & Observability Engineer (SRE)
Senior Site Reliability & Observability Engineer (SRE)

TransUnion • Mexico

Hybrid
PHP 600,000 - 900,000
Senior SRE & Observability Engineer — Reliability & Automation
Senior SRE & Observability Engineer — Reliability & Automation

TransUnion • Mexico

Hybrid
PHP 3,663,000 - 5,495,000
Senior SRE: Enterprise Observability & Platform Reliability
Senior SRE: Enterprise Observability & Platform Reliability

ICIMS • Mexico

On-site
PHP 9,130,000 - 11,564,000
Journey SRE - Reliability & Observability Engineer
Journey SRE - Reliability & Observability Engineer

UnionBank • Pasig

On-site
PHP 600,000 - 1,100,000
Site Reliability Engineer
Site Reliability Engineer

UnionBank • Pasig

On-site
PHP 600,000 - 1,100,000
Associate SRE — Platform Reliability & Automation
Associate SRE — Platform Reliability & Automation

Railway Corp • Mexico

On-site
PHP 5,474,000 - 7,908,000
IoT Telemetry SRE: Reliability, Automation & 24x7 Ops
IoT Telemetry SRE: Reliability, Automation & 24x7 Ops

Acquire Intelligence • Taguig

On-site
PHP 900,000 - 1,500,000
SRE: Observability & Incident-Driven Reliability
SRE: Observability & Incident-Driven Reliability

Pan Asia Resources • Philippines

On-site
PHP 1,200,000 - 2,000,000
Site Reliability Engineer — Automation & Observability Lead
Site Reliability Engineer — Automation & Observability Lead

Trends Group, Inc. • Makati

On-site
PHP 900,000 - 1,500,000
Technical Lead SRE: Reliability & Observability
Technical Lead SRE: Reliability & Observability

London Stock Exchange Group • Taguig

On-site
PHP 3,937,000 - 5,149,000
Healthcare
Retirement planning
Paid volunteering days
+1