Hybrid Principal SRE - Reliability at Scale & Observability

Early Warning Services LLC

Scottsdale (AZ)

Hybrid

USD 194,000 - 237,000

Full time

4 days ago
Be an early applicant
Application generator

Don’t send a generic resume — generate a resume and cover letter tailored to this exact role.

Get past ATS filters

Benefits offered by this job

Healthcare Coverage
401(k) Plan
Paid Time Off
Parental Leave
Discretionary incentive plan

Job summary

Early Warning Services LLC is seeking a Principal Site Reliability Engineer in the United States with extensive experience in large-scale systems. You will lead reliability initiatives, partner with software engineering teams, and drive observable, scalable, and resilient production services across the enterprise.

You will define SLIs/SLOs, mentor engineers, and shape best practices for incident response, automation, and On-call efficiency, enabling safer, faster payments platforms while working

Qualifications

  • 15+ years in software or systems engineering roles.
  • Experience with public cloud technologies, preferably AWS.
  • Strong analytical, problem-solving and communication skills.
  • Experience with CI/CD, IaC, containers, observability.

Responsibilities

  • Improve reliability, observability, and operational health of production services.
  • Define and implement SLIs/SLOs and error budgets.
  • Lead incident response and blameless post-incident reviews.
  • Partner with software engineering teams to ensure reliability in lifecycle.

Skills

Site Reliability Engineering
Distributed systems
Automation / DevOps
Programming / Scripting
Observability & monitoring

Education

Bachelor's degree in Computer Science or related field

Tools

AWS cloud platform
CI/CD
Infrastructure as Code
Containers / Orchestration
Monitoring tools (Prometheus / Grafana)

Job description

Early Warning Services LLC is seeking a Principal Site Reliability Engineer in the United States with extensive experience in large-scale systems. You will lead reliability initiatives, partner with software engineering teams, and drive observable, scalable, and resilient production services across the enterprise.

You will define SLIs/SLOs, mentor engineers, and shape best practices for incident response, automation, and On-call efficiency, enabling safer, faster payments platforms while working

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Principal SRE: Enterprise Reliability & Automation
Principal SRE: Enterprise Reliability & Automation

Early Warning Services LLC • Chicago (IL)

Hybrid
USD 194,000 - 284,000
Healthcare Coverage
401(k) Retirement Plan
Paid Time Off
+1
Senior SRE - Hybrid, Observability & Reliability
Senior SRE - Hybrid, Observability & Reliability

Early Warning Services LLC • Chicago (IL)

Hybrid
USD 106,000 - 130,000
Healthcare Coverage
401(k) Plan with match
PTO and Holidays
+1
Principal Site Reliability Engineer – Hybrid Role
Principal Site Reliability Engineer – Hybrid Role

Early Warning Services LLC • San Francisco (CA)

Hybrid
USD 194,000 - 284,000
Healthcare coverage
401(k) with company match
Paid time off
Senior SRE: Scale Reliability, Observability & Resilience
Senior SRE: Scale Reliability, Observability & Resilience

Early Warning Services LLC • Scottsdale (AZ)

Hybrid
USD 106,000 - 130,000
Healthcare Coverage
401(k) Retirement Plan
Paid Time Off
+2
Principal SRE — Observability & Cloud Reliability
Principal SRE — Observability & Cloud Reliability

T. Rowe Price • Washington

Hybrid
USD 159,000 - 339,000
Competitive compensation
Annual bonus eligibility
Hybrid work schedule
+2
Senior SRE: Scalable Infra, Observability & Automation
Senior SRE: Scalable Infra, Observability & Automation

Early Warning • Scottsdale (AZ)

Hybrid
USD 106,000 - 156,000
Healthcare Coverage
401(k) Company Match
Paid Time Off
+2
Hybrid SRE Engineer for Scalable Reliability & Equity
Hybrid SRE Engineer for Scalable Reliability & Equity

EarnIn • Mountain View (CA)

Hybrid
USD 139,000 - 232,000
Lead SRE: Scalable, High-Availability Systems
Lead SRE: Scalable, High-Availability Systems

Socket.dev • North Carolina

On-site
USD 150,000 - 210,000
Principal SRE: Hybrid Cloud Reliability & Observability
Principal SRE: Hybrid Cloud Reliability & Observability

Hewlett Packard Enterprise • San Juan (PR)

Hybrid
USD 120,000 - 160,000
Senior SRE: Automate Reliability & Observability
Senior SRE: Automate Reliability & Observability

United States Digital Space LLC • Charlotte (TX)

On-site
USD 153,000 - 192,000
Discretionary incentive eligible
Benefits package