Senior Production Engineer

Charterhouse Partnership

Taguig

On-site

PHP 1,200,000 - 2,000,000

Full time

48 hours ago
Be an early applicant
Application generator

An application made for this job — a tailored resume and cover letter that speak straight to the posting.

Get past ATS filters

Job summary

Charterhouse Partnership is seeking a Senior Production Engineer to own the stability, performance, and reliability of mission-critical trading applications. This role offers a clear path into Site Reliability Engineering (SRE) with opportunities to drive automation, observability, and platform resilience initiatives.

You will lead incident resolution, own production health, and collaborate with global teams across Engineering, DevOps, and Operations to improve MTTR and reduce toil.

Qualifications

  • 5+ years of experience in Production Support, Production Engineering, Application Support, or Site Reliability Engineering.
  • Strong AWS operational experience, including load balancing, failover strategies, compute services, and managed database platforms.
  • Experience supporting high-availability, business-critical applications and platforms.
  • Strong incident management, troubleshooting, and root cause analysis skills.
  • Experience with monitoring and observability tools such as Grafana, CloudWatch, ELK, or Splunk.
  • Understanding of change management, deployment validation, and operational risk controls.
  • Experience working within global support environments and managing stakeholder communications effectively.

Responsibilities

  • Lead the investigation and resolution of complex production incidents and major outages.
  • Own production health, monitoring, alerting, and operational readiness for critical services.
  • Drive root cause analysis and long-term remediation of recurring issues.
  • Lead technical response efforts during major incidents and recovery activities.
  • Improve observability, service monitoring, and overall platform reliability.
  • Champion automation initiatives to reduce operational toil and improve MTTD and MTTR.
  • Collaborate with Engineering, DevOps, Operations, and Business stakeholders across global teams.
  • Support change management, release activities, and production risk assessments.
  • Contribute to the adoption of SRE practices, reliability metrics, and continuous improvement initiatives.

Skills

AWS
Incident management
Monitoring & observability
SRE practices
Global stakeholder communication

Tools

Grafana
CloudWatch
ELK
Splunk

Job description

We're looking for a Senior Production Engineer to take ownership of the stability, performance, and operational reliability of business-critical trading applications. This role offers a strong pathway into Site Reliability Engineering (SRE), with opportunities to drive automation, observability, and platform resilience initiatives.

Responsibilities
  • Lead the investigation and resolution of complex production incidents and major outages.
  • Own production health, monitoring, alerting, and operational readiness for critical services.
  • Drive root cause analysis and long-term remediation of recurring issues.
  • Lead technical response efforts during major incidents and recovery activities.
  • Improve observability, service monitoring, and overall platform reliability.
  • Champion automation initiatives to reduce operational toil and improve MTTD and MTTR.
  • Collaborate with Engineering, DevOps, Operations, and Business stakeholders across global teams.
  • Support change management, release activities, and production risk assessments.
  • Contribute to the adoption of SRE practices, reliability metrics, and continuous improvement initiatives.
Requirements
  • 5+ years of experience in Production Support, Production Engineering, Application Support, or Site Reliability Engineering.
  • Strong AWS operational experience, including load balancing, failover strategies, compute services, and managed database platforms.
  • Experience supporting high-availability, business-critical applications and platforms.
  • Strong incident management, troubleshooting, and root cause analysis skills.
  • Experience with monitoring and observability tools such as Grafana, CloudWatch, ELK, or Splunk.
  • Understanding of change management, deployment validation, and operational risk controls.
  • Experience working within global support environments and managing stakeholder communications effectively.
Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Senior Production Engineer
Senior Production Engineer

Hammerjack Pty Ltd • Philippines

On-site
PHP 1,200,000 - 1,800,000
Senior Production Engineer
Senior Production Engineer

863 Parameta Solutions (Singapore) Pte. Limited • Taguig

On-site
PHP 558,000 - 781,200
Senior Production Engineer — SRE & Reliability Leader
Senior Production Engineer — SRE & Reliability Leader

Charterhouse Partnership • Taguig

On-site
PHP 1,200,000 - 2,000,000
Team Lead - Production Engineering
Team Lead - Production Engineering

768 TP ICAP Management Services Ltd (Philippines Branch) • Taguig

On-site
PHP 1,200,000 - 1,500,000
VS01700 - SRE & Production Reliability Engineer
VS01700 - SRE & Production Reliability Engineer

E4 Software Services Pvt Ltd. • Hinoba-an

On-site
PHP 893,000 - 1,674,000
Production Support Engineer
Production Support Engineer

UST • Taguig

On-site
PHP 500,000 - 800,000
Site Reliability Engineer
Site Reliability Engineer

V2 Solutions • Hinoba-an

On-site
PHP 900,000 - 1,500,000
Senior Production Engineer — SRE & Reliability Leader
Senior Production Engineer — SRE & Reliability Leader

Hammerjack Pty Ltd • Philippines

On-site
PHP 1,200,000 - 1,800,000
Production Engineer
Production Engineer

768 TP ICAP Management Services Ltd (Philippines Branch) • Taguig

On-site
PHP 446,400 - 669,600
Application / Production Support Engineer
Application / Production Support Engineer

ExcelGens, Inc. • Quezon City

On-site
PHP 558,000 - 1,004,000