Cloud Platform SRE: Observability, Automation & Resilience

Manulife Financial

Waterloo

Hybrid

CAD 77,000 - 95,000

Full time

4 days ago
Be an early applicant

Get more replies from employers

Send a job-specific resume in minutes.

Benefits offered by this job

Health benefits
Pension plan
Paid time off
Flexible work arrangement

Job summary

Manulife Bank Technology is seeking a Site Reliability Engineer (SRE) to design, build, and maintain reliable, scalable services for banking operations. You will collaborate with engineering and operations teams to improve resilience, observability, automation, and incident response across cloud environments.

You will monitor production systems, develop dashboards, contribute to SLOs/SLIs, and participate in on-call rotations, with hybrid work in the Waterloo region.

Qualifications

  • Minimum 2-5 years+ of experience in Site Reliability Engineering, DevOps, Platform Engineering, Cloud Operations, or related field.
  • Experience supporting applications and services in cloud environments such as Azure, AWS, or Google Cloud Platform.
  • Experience developing automation and scripting solutions usingPython, Bash, PowerShell, or similar technologies.
  • Experience with monitoring, logging, and observability platforms such as New Relic, Grafana, ADX, or comparable tools.
  • Strong troubleshooting, analytical, and problem-solving skills with ability to manage priorities and respond during service disruptions.
  • Excellent communication and collaboration skills across technical and business teams.

Responsibilities

  • Design, build, and maintain infrastructure, automation, and tooling to improve reliability and efficiency.
  • Partner with engineering to embed reliability and observability across the SDLC.
  • Monitor production systems, troubleshoot issues, minimize customer impact.
  • Develop observability capabilities: metrics, logging, tracing, dashboards, alerts.
  • Participate in incident response and on-call support.
  • Conduct root cause analyses and drive corrective actions.

Skills

Site Reliability Engineering
DevOps
Cloud Operations
Automation
Python
Bash
PowerShell
Observability
Incident management

Tools

New Relic
Grafana
ADX
Docker
Kubernetes

Job description

Manulife Bank Technology is seeking a Site Reliability Engineer (SRE) to design, build, and maintain reliable, scalable services for banking operations. You will collaborate with engineering and operations teams to improve resilience, observability, automation, and incident response across cloud environments.

You will monitor production systems, develop dashboards, contribute to SLOs/SLIs, and participate in on-call rotations, with hybrid work in the Waterloo region.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Cloud & Platform SRE — Reliability & Observability
Cloud & Platform SRE — Reliability & Observability

Socket.dev • Southwestern Ontario

Hybrid
CAD 86,000 - 136,000
Senior SRE Engineer — Automation & Platform Reliability
Senior SRE Engineer — Automation & Platform Reliability

RBC • Toronto

On-site
CAD 110,000 - 140,000
Site Reliability Engineer - Cloud & Platform Engineering, Manulife Bank Technology
Site Reliability Engineer - Cloud & Platform Engineering, Manulife Bank Technology

Socket.dev • Southwestern Ontario

Hybrid
CAD 86,000 - 136,000
Senior SRE & Resiliency Engineer, Multi-Cloud
Senior SRE & Resiliency Engineer, Multi-Cloud

Intact Financial Corporation • Montreal (administrative region)

Hybrid
CAD 109,000 - 135,000
Flexible work arrangements
Possibility to purchase up to 5 extra days off
Wellness benefits including telemedicine
+1
Site Reliability Engineer - Cloud & Platform Engineering, Manulife Bank Technology
Site Reliability Engineer - Cloud & Platform Engineering, Manulife Bank Technology

Manulife Insurance Malaysia • Southwestern Ontario

Hybrid
CAD 86,000 - 136,000
Health insurance
Dental insurance
Vision benefits
+2
SRE Lead - AI-Driven Reliability & Automation
SRE Lead - AI-Driven Reliability & Automation

Bank of Montreal • Toronto

On-site
CAD 122,000 - 212,000
Health insurance
Tuition reimbursement
Accident and life insurance
+1
Senior Cloud Operations and Reliability Engineer
Senior Cloud Operations and Reliability Engineer

Scotiabank • Toronto

On-site
CAD 120,000 - 180,000
Diversity, Equity, Inclusion & Allyhip
Accessibility and Workplace Accommod"
Upskilling through online courses
+1
Senior SRE & AIOps Engineer: Reliable Automation
Senior SRE & AIOps Engineer: Reliable Automation

RBC • Toronto

On-site
CAD 120,000 - 180,000
Total Rewards Program
Bonuses and flexible benefits
World-class training program
+2
Site Reliability Engineer (SRE) – Observability
Site Reliability Engineer (SRE) – Observability

Astra-North Infoteck Inc. ~ Conquering today’s challenges, achieving tomorrow’s vision! • Toronto

Hybrid
CAD 75,000 - 95,000
Staff Site Reliability Developer, Protected Data SRE
Staff Site Reliability Developer, Protected Data SRE

Socket.dev • Southwestern Ontario

On-site
CAD 216,000 - 221,000