Principal SRE — Cloud Platform & Reliability Lead (Hybrid)

ShipperHQ

Austin (TX)

Hybrid

USD 140,000 - 200,000

Full time

14 days+
Application generator

Don’t send a generic resume — generate a resume and cover letter tailored to this exact role.

Get past ATS filters

Benefits offered by this job

22 days PTO
401k Match
Medical, Dental, Vision Insurance
Maternity and Paternity Leave
Hybrid work in Austin
Compensation based on experience

Job summary

ShipperHQ is seeking a Principal Site Reliability Engineer to lead the evolution of our cloud platform, reliability strategy, and infrastructure architecture. This is a hands-on leadership role responsible for scalable, resilient systems and engineering best practices that enable teams to move quickly and confidently.

You will own the vision and roadmap for cloud infrastructure, design highly available AWS environments, and drive IaC, CI/CD, observability, and incident management while mentoring

Qualifications

  • 10+ years in Site Reliability Engineering, Platform Engineering, DevOps, Cloud Infrastructure, or Software Engineering.
  • Proven experience operating large-scale, highly available cloud infrastructure in AWS.
  • Strong software engineering background with production-grade code/automation skills.
  • Expert-level Infrastructure as Code experience, preferably Terraform.
  • Deep experience with CI/CD pipelines in GitLab or similar.
  • Strong knowledge of Kubernetes and cloud-native architectures.
  • Extensive observability, logging, monitoring, and incident response experience.
  • Experience defining SLOs/SLIs and reliability best practices.
  • Solid networking, security, Linux admin, and cloud architecture fundamentals.
  • Experience supporting high-traffic SaaS and production environments.
  • Proven ability to influence technical direction and mentor multiple teams.
  • Experience in Agile environments.

Responsibilities

  • Own the technical vision and roadmap for the cloud infrastructure and platform engineering initiatives.
  • Design, build, and maintain highly available, scalable, and secure cloud infrastructure in AWS.
  • Define and evolve Infrastructure as Code standards across environments (Terraform).
  • Design and optimize CI/CD pipelines to enable fast, reliable software delivery.
  • Define reliability standards, SLOs, SLIs, and incident management practices.
  • Lead observability, monitoring, logging, and alerting across the platform.
  • Build self-service platform capabilities and automation to reduce operational overhead.
  • Drive modernization initiatives including containerization, orchestration, and scalability.
  • Collaborate with Security for cloud security practices and governance.
  • Mentor engineers and promote best practices across teams.
  • Evaluate new technologies to improve scalability and developer productivity.
  • Participate in incident response and continuous improvement of production systems.

Skills

Site Reliability
Platform Engineering
DevOps
Cloud Infrastructure
AWS
Terraform
Kubernetes
CI/CD
Observability
Security
Incident Response
Mentoring
Agile

Tools

Terraform
GitLab
Kubernetes

Job description

ShipperHQ is seeking a Principal Site Reliability Engineer to lead the evolution of our cloud platform, reliability strategy, and infrastructure architecture. This is a hands-on leadership role responsible for scalable, resilient systems and engineering best practices that enable teams to move quickly and confidently.

You will own the vision and roadmap for cloud infrastructure, design highly available AWS environments, and drive IaC, CI/CD, observability, and incident management while mentoring

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Principal SRE: Hybrid Cloud Reliability & Observability
Principal SRE: Hybrid Cloud Reliability & Observability

Hewlett Packard Enterprise • San Juan (PR)

Hybrid
USD 120,000 - 160,000
Senior SRE & Cloud Reliability Architect
Senior SRE & Cloud Reliability Architect

United States Digital Space LLC • United States

Remote
USD 180,000 - 250,000
Principal SRE - Cloud Reliability Lead (Multi-Cloud)
Principal SRE - Cloud Reliability Lead (Multi-Cloud)

Motion Recruitment • Tempe (AZ)

Hybrid
USD 150,000 - 210,000
Bonus or Commission eligible
Medical, Dental, Vision Insurance
Vacation Time
+1
Principal Site Reliability Engineer - Austin, Texas
Principal Site Reliability Engineer - Austin, Texas

Zowta, LLC • Austin (TX)

Hybrid
USD 130,000 - 160,000
22 days of PTO plus public holidays
401k Match
Medical, Dental, and Vision Insurance
+1
Principal Site Reliability Engineer – Hybrid Multi‑Cloud
Principal Site Reliability Engineer – Hybrid Multi‑Cloud

PowerPlan, Inc. • Smyrna (GA)

Hybrid
USD 140,000 - 200,000
Hybrid work model
Onsite office in Smyrna, GA
Senior Principal SRE Lead — Cloud Reliability & Automation
Senior Principal SRE Lead — Cloud Reliability & Automation

Oracle • United States

On-site
USD 105,000 - 264,000
Principal Site Reliability Engineer - Austin, Texas
Principal Site Reliability Engineer - Austin, Texas

ShipperHQ • Austin (TX)

Hybrid
USD 140,000 - 200,000
22 days PTO
401k Match
Medical, Dental, Vision Insurance
+3
Principal SRE — Observability & Cloud Reliability
Principal SRE — Observability & Cloud Reliability

T. Rowe Price • Washington

Hybrid
USD 159,000 - 339,000
Competitive compensation
Annual bonus eligibility
Hybrid work schedule
+2
Senior SRE Lead — Cloud Reliability & Platform Architect
Senior SRE Lead — Cloud Reliability & Platform Architect

Shieldai • San Diego (CA)

On-site
USD 150,000 - 230,000
Principal SRE / Hybrid / Tempe
Principal SRE / Hybrid / Tempe

Motion Recruitment • Tempe (AZ)

Hybrid
USD 150,000 - 210,000
Bonus or Commission eligible
Medical, Dental, Vision Insurance
Vacation Time
+1