Principal SRE: Build Resilient, Scalable Cloud Systems

Worky

Durham (NC)

On-site

USD 150,000 - 210,000

Full time

3 days ago
Be an early applicant
Application generator

An application made for this job — a tailored resume and cover letter that speak straight to the posting.

Get past ATS filters

Job summary

Fidelity Investments in Durham, NC seeks a Principal Site Reliability Engineer to deploy and support distributed systems at scale across AWS. You will design and operate resilient platforms, implement observability, and lead SRE practices with SLOs, SLIs, and incident response strategies.

The role emphasizes CI/CD, Kubernetes, and cloud-native architectures, while driving performance testing, automation, and data-driven reliability improvements across complex environments.

Qualifications

  • Candidates must have strong reliability engineering experience in financial services or equivalent.
  • Experience with performance benchmarking and CI/CD in AWS environments.
  • Familiarity with observability tools and incident response practices.

Responsibilities

  • Defines and leads enterprise-level reliability strategies.
  • Architects resilient systems and infrastructure.
  • Creates and publishes performance test results with recommendations.
  • Maintains scalability and resiliency of complex environments.
  • Implements advanced observability practices at scale.
  • Manages and interprets large datasets using query languages and visualization tools.
  • Advises senior leadership on reliability engineering best practices.
  • Mentors junior engineers.
  • Performs complex technical analyses for multiple initiatives.
  • Develops innovative solutions to improve system availability, scalability, and performance.
  • Designs, implements, and maintains performance test frameworks.

Skills

Reliability engineering
Performance testing
Observability
Cloud architecture
CI/CD automation

Education

Bachelor's degree in Computer Science or related
Master's degree in related field

Tools

AWS
Kubernetes
Jenkins
Docker
Datadog
Grafana
ELK stack
JMeter
Python
Shell scripting

Job description

Fidelity Investments in Durham, NC seeks a Principal Site Reliability Engineer to deploy and support distributed systems at scale across AWS. You will design and operate resilient platforms, implement observability, and lead SRE practices with SLOs, SLIs, and incident response strategies.

The role emphasizes CI/CD, Kubernetes, and cloud-native architectures, while driving performance testing, automation, and data-driven reliability improvements across complex environments.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Lead SRE: Scalable, High-Availability Systems
Lead SRE: Scalable, High-Availability Systems

Socket.dev • North Carolina

On-site
USD 150,000 - 210,000
Senior Site Reliability Engineer – Chaos & Observability
Senior Site Reliability Engineer – Chaos & Observability

Fidelity Investments • Westlake (TX)

On-site
USD 150,000 - 190,000
Senior Site Reliability Engineer — Cloud, Chaos & Automation
Senior Site Reliability Engineer — Cloud, Chaos & Automation

Soteria Reinsurance Ltd. • Town of Texas (WI), Northern (KY)

Hybrid
USD 150,000 - 210,000
Senior Cloud Systems Engineer - Resilient Infra Automation
Senior Cloud Systems Engineer - Resilient Infra Automation

Fidelity Investments • Westlake (TX)

On-site
USD 140,000 - 190,000
Senior SRE: Scale Cloud Infra, Pipelines & Observability
Senior SRE: Scale Cloud Infra, Pipelines & Observability

2T Consulting • Bayonne (NJ)

On-site
USD 128,000 - 216,000
Principal SRE: Hybrid Cloud Reliability & Observability
Principal SRE: Hybrid Cloud Reliability & Observability

Hewlett Packard Enterprise • San Juan (PR)

Hybrid
USD 120,000 - 160,000
Principal SRE — Cloud Platform & Reliability Lead (Hybrid)
Principal SRE — Cloud Platform & Reliability Lead (Hybrid)

ShipperHQ • Austin (TX)

Hybrid
USD 140,000 - 200,000
22 days PTO
401k Match
Medical, Dental, Vision Insurance
+3
Senior Cloud & Systems Engineer | Automation & Resilience
Senior Cloud & Systems Engineer | Automation & Resilience

Soteria Reinsurance Ltd. • Town of Texas (WI), Northern (KY)

Hybrid
USD 140,000 - 210,000
Principal Software Engineer: Secure, Scalable Web Apps
Principal Software Engineer: Secure, Scalable Web Apps

Soteria Reinsurance Ltd. • Durham (NC), Northern (KY)

Hybrid
USD 140,000 - 180,000
Senior SRE & Cloud Reliability Architect
Senior SRE & Cloud Reliability Architect

United States Digital Space LLC • United States

Remote
USD 180,000 - 250,000