Senior Site Reliability Engineer – Chaos & Observability

Fidelity Investments

Westlake (TX)

On-site

USD 150,000 - 190,000

Full time

14 days+
Application generator

A complete application in a minute — tailored resume and cover letter, ready to send.

Get past ATS filters

Job summary

Fidelity Investments is seeking a Principal Site Reliability Engineer to deliver high-scale, highly available services through automation and infrastructure as code. You will advance resiliency, observability, and chaos testing across pipelines and platforms, partnering with Product and Platform teams to raise reliability and performance.

You will mentor engineers, design resilient cloud-native systems, and guide adoption of policy-driven, scalable practices across business units.

Qualifications

  • Bachelor's or Master's with years of experience in SRE and container/cloud automation as stated in the ad.
  • Experience designing and automating container and cloud-based platform products within production environments.

Responsibilities

  • Provides cloud support and enhances cloud capabilities per SRE principles—observability, automation, resiliency.
  • Develops and enhances internal chaos framework for chaos executions and reporting.
  • Facilitates chaos engineering adoption by application teams and analyzes critical apps to improve resiliency.
  • Develops products around SRE to improve platform stability and availability.
  • Collaborates with business and tech teams to scale products and automation.
  • Mentors team members to build core SRE competencies.

Education

Bachelor's degree in Computer Science, Engineering, Information Technology, Information Systems, or a closely related field
Master's degree in Computer Science, Engineering, Information Technology, Information Systems or a closely related field

Tools

Kubernetes
Terraform
Azure ARM
Datadog
Splunk
Jenkins
Azure DevOps
Team Foundation Version Control
CloudFormation
Python
AWS
Azure
LAMBDA
API Gateway
Chaos Studio

Job description

Fidelity Investments is seeking a Principal Site Reliability Engineer to deliver high-scale, highly available services through automation and infrastructure as code. You will advance resiliency, observability, and chaos testing across pipelines and platforms, partnering with Product and Platform teams to raise reliability and performance.

You will mentor engineers, design resilient cloud-native systems, and guide adoption of policy-driven, scalable practices across business units.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Senior Site Reliability Engineer — Cloud, Chaos & Automation
Senior Site Reliability Engineer — Cloud, Chaos & Automation

Soteria Reinsurance Ltd. • Town of Texas (WI), Northern (KY)

Hybrid
USD 150,000 - 210,000
Lead SRE: Scalable, High-Availability Systems
Lead SRE: Scalable, High-Availability Systems

Socket.dev • North Carolina

On-site
USD 150,000 - 210,000
Principal SRE: Build Resilient, Scalable Cloud Systems
Principal SRE: Build Resilient, Scalable Cloud Systems

Worky • Durham (NC)

On-site
USD 150,000 - 210,000
Principal Site Reliability Engineer
Principal Site Reliability Engineer

Fidelity Investments • Westlake (TX)

On-site
USD 150,000 - 190,000
Principal Site Reliability Engineer
Principal Site Reliability Engineer

Soteria Reinsurance Ltd. • Town of Texas (WI), Northern (KY)

On-site
USD 150,000 - 210,000
Senior Cloud & Systems Engineer | Automation & Resilience
Senior Cloud & Systems Engineer | Automation & Resilience

Soteria Reinsurance Ltd. • Town of Texas (WI), Northern (KY)

Hybrid
USD 140,000 - 210,000
Principal Site Reliability Engineer
Principal Site Reliability Engineer

Socket.dev • North Carolina

On-site
USD 150,000 - 210,000
Sr. Site Reliability Engineer
Sr. Site Reliability Engineer

MeridianLink, Inc. • Northern (KY)

Hybrid
USD 140,000 - 210,000
Senior Cloud Systems Engineer - Resilient Infra Automation
Senior Cloud Systems Engineer - Resilient Infra Automation

Fidelity Investments • Westlake (TX)

On-site
USD 140,000 - 190,000
Principal Site Reliability Engineer
Principal Site Reliability Engineer

Worky • Durham (NC)

On-site
USD 150,000 - 210,000