Senior SRE Lead: Cloud, Observability & Automation

Frontier Airlines

Denver (CO)

On-site

USD 110,000 - 146,000

Full time

2 days ago
Be an early applicant
Application generator

An application made for this job — a tailored resume and cover letter that speak straight to the posting.

Get past ATS filters

Benefits offered by this job

Medical coverage
401(k) retirement savings options
Travel privileges
Buddy passes
Employee discounts
Hybrid schedule for Denver HQ roles
HOPE League support

Job summary

Frontier Airlines seeks a Lead Site Reliability Engineer (SRE) to drive reliability, scalability, and performance of mission‑critical platforms. You will partner with engineering, platform, security, and operations teams to implement resilient systems and automate operations.

This senior role requires deep AWS, Kubernetes, observability, and DevSecOps expertise, shaping reliability practices across the enterprise and mentoring teams toward best‑in‑class availability.

Qualifications

  • Bachelor’s degree in computer science, Engineering, Information Technology, or a related discipline.
  • 10+ years of experience in software engineering, cloud architecture, infrastructure engineering, or enterprise architecture.
  • 5+ years of hands‑on AWS architecture and cloud transformation experience.
  • Proven success leading large‑scale cloud migrations and modernization initiatives.
  • Experience designing and supporting highly available, mission‑critical, customer‑facing platforms.
  • Deep understanding of Kubernetes, container orchestration, microservices, and distributed systems.
  • Extensive experience with DevSecOps, CI/CD pipelines, Infrastructure as Code, and automation frameworks.
  • Strong knowledge of Site Reliability Engineering (SRE), operational excellence, and platform reliability practices.
  • Experience implementing cloud governance, FinOps, and cost optimization programs.

Responsibilities

  • Lead the design and implementation of highly available, resilient, and scalable cloud platforms leveraging AWS services and cloud-native technologies.
  • Define and execute reliability engineering strategies, service level objectives (SLOs), service level indicators (SLIs), and error budgets across critical business services.
  • Architect and operate Kubernetes-based platforms supporting containerized and microservices-based applications.
  • Establish enterprise standards for reliability, availability, disaster recovery, resiliency testing, and operational excellence.
  • Partner with software engineering, platform engineering, security, and operations teams to improve service reliability and reduce operational risk.
  • Drive adoption of DevSecOps practices, CI/CD automation, Infrastructure as Code (IaC), and self-service platform capabilities.
  • Define and implement observability standards including monitoring, logging, distributed tracing, synthetic monitoring, and operational intelligence.
  • Lead incident response, post-incident reviews, root cause analyses (RCA), and continuous improvement initiatives.
  • Identify and eliminate single points of failure through proactive reliability engineering and resilient architecture practices.
  • Design and implement automated remediation, self-healing capabilities, and proactive alerting solutions to improve operational efficiency.
  • Lead capacity planning, performance engineering, availability management, and scalability assessments.
  • Partner with FinOps and engineering teams to optimize cloud resource utilization while maintaining reliability objectives.
  • Evaluate emerging technologies, AIOps, Generative AI, and intelligent automation solutions to improve platform reliability and operational effectiveness.
  • Mentor SREs, platform engineers, and software engineers in reliability practices, observability, automation, and operational excellence.
  • Develop executive-level reliability roadmaps, operational strategies, and platform investment recommendations.

Skills

AWS architecture
Kubernetes
DevSecOps
CI/CD automation
Observability
Distributed systems

Education

Bachelor’s degree in CS/Engineering/IT

Tools

Terraform
CloudFormation
EKS

Job description

Frontier Airlines seeks a Lead Site Reliability Engineer (SRE) to drive reliability, scalability, and performance of mission‑critical platforms. You will partner with engineering, platform, security, and operations teams to implement resilient systems and automate operations.

This senior role requires deep AWS, Kubernetes, observability, and DevSecOps expertise, shaping reliability practices across the enterprise and mentoring teams toward best‑in‑class availability.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Senior SRE - Cloud Reliability & Automation
Senior SRE - Cloud Reliability & Automation

Frontier-Airlines • Denver (CO)

Hybrid
USD 110,000 - 146,000
Medical/Dental/Vision
401(k) retirement plan
Travel privileges
+3
Lead Site Reliability Engineer - Hybrid Cloud & Observability
Lead Site Reliability Engineer - Hybrid Cloud & Observability

Frontier Airlines, Inc. • Denver (CO), Northern (KY)

Hybrid
USD 110,000 - 146,000
Medical, dental and vision
401(k) retirement savings
Paid holidays, vacation time and sick
+6
Senior SRE: Scale Reliability, Observability & Resilience
Senior SRE: Scale Reliability, Observability & Resilience

Early Warning Services LLC • Scottsdale (AZ)

Hybrid
USD 106,000 - 130,000
Healthcare Coverage
401(k) Retirement Plan
Paid Time Off
+2
Senior SRE: Cloud Reliability, Observability Lead
Senior SRE: Cloud Reliability, Observability Lead

CentralReach • Fort Lauderdale (FL)

Hybrid
USD 160,000 - 180,000
Hybrid work model
Health benefits
PTO & 401(k) matching
+1
Senior SRE Leader: Cloud, Reliability & Scale
Senior SRE Leader: Cloud, Reliability & Scale

AVG • Tempe (AZ), Northern (KY)

Hybrid
USD 140,000 - 190,000
Senior SRE Lead: Reliability, Observability & Cloud
Senior SRE Lead: Reliability, Observability & Cloud

Shieldai • San Mateo (CA)

On-site
USD 180,000 - 240,000
Senior Cloud Platform & SRE Leader - Scale & Reliability
Senior Cloud Platform & SRE Leader - Scale & Reliability

Techfellow Limited • Boston (MA)

On-site
USD 220,000 - 260,000
Relocation funded
Senior SRE: Architect Scalable, Reliable Cloud Infra
Senior SRE: Architect Scalable, Reliable Cloud Infra

The ReWork Group • New York (NY)

On-site
USD 120,000 - 160,000
Senior SRE: Automate Reliability & Observability
Senior SRE: Automate Reliability & Observability

United States Digital Space LLC • Charlotte (TX)

On-site
USD 153,000 - 192,000
Discretionary incentive eligible
Benefits package
Senior Cloud SRE — AWS, Automation & Security
Senior Cloud SRE — AWS, Automation & Security

United States Digital Space LLC • Bellevue (CA)

On-site
USD 180,000 - 260,000
Amazing Benefits
Making Social Impact
Diversity, Equity & Inclusion