Senior SRE: Enterprise-Scale Cloud, Terraform & Telemetry

Staffing Science

Arizona

On-site

USD 180,000 - 240,000

Full time

5 days ago
Be an early applicant
Application generator

Don’t send a generic resume — generate a resume and cover letter tailored to this exact role.

Get past ATS filters

Job summary

Staffing Science is seeking a Senior Site Reliability Engineer (Cloud Communications / High-Compliance Enterprise SaaS) to join a global, always-on platform. You will own AWS infrastructure at scale, implement Terraform/Terragrunt modules, and drive CI/CD across infrastructure and apps.

The role emphasizes deep OS/networking, production experience with Tomcat/Java, and advanced observability using Prometheus, Grafana, and ELK. Expect on-call rotations and collaboration with security leadership.

Qualifications

  • 15+ years of Linux/UNIX systems engineering, with meaningful time in SRE/DevOps roles at enterprise scale.
  • Expert-level AWS (EC2, S3, RDS, VPC, IAM, Lambda, ECS/EKS, CloudWatch) and infrastructure design best practices.
  • Expert-level Terraform and Terragrunt (module authorship required).
  • Strong production experience in Python and Go.
  • Deep enterprise networking fundamentals — DNS, TCP/IP, mail routing and delivery troubleshooting.

Responsibilities

  • Design, write, and maintain Terraform and Terragrunt modules managing AWS infrastructure at scale.
  • Own and evolve CI/CD pipelines across GitHub Actions and AWS CodePipeline for infrastructure and deployments.
  • Troubleshoot deep networking and mail deliverability issues at global scale.
  • Maintain Apache and Postfix-based mail infrastructure in production.
  • Provide SRE support into Tomcat/Java-based environments and diagnose memory/GC issues.
  • Build and maintain observability and alerting with Prometheus, Grafana, OpenTelemetry, and ELK; define SLOs/SLIs.

Skills

Linux/UNIX
AWS expert
SRE/DevOps
Python/Go
Networking fundamentals
Java/Tomcat
Agile/Scrum
On-call experience

Tools

Terraform
Terragrunt
GitHub Actions
AWS CodePipeline
Prometheus
Grafana
OpenTelemetry
ELK stack
New Relic
Jaeger
Zipkin
Docker
ECS/EKS

Job description

Staffing Science is seeking a Senior Site Reliability Engineer (Cloud Communications / High-Compliance Enterprise SaaS) to join a global, always-on platform. You will own AWS infrastructure at scale, implement Terraform/Terragrunt modules, and drive CI/CD across infrastructure and apps.

The role emphasizes deep OS/networking, production experience with Tomcat/Java, and advanced observability using Prometheus, Grafana, and ELK. Expect on-call rotations and collaboration with security leadership.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Remote Senior SRE: AWS, Kubernetes & Terraform
Remote Senior SRE: AWS, Kubernetes & Terraform

Motion Recruitment Partners LLC • Chicago (IL), Northern (KY)

Hybrid
USD 140,000 - 170,000
Senior SRE: Cloud Reliability, Terraform & Kubernetes (Remote)
Senior SRE: Cloud Reliability, Terraform & Kubernetes (Remote)

Motion Recruitment • Chicago (IL)

On-site
USD 140,000 - 190,000
Sr. Site Reliability Engineer
Sr. Site Reliability Engineer

Staffing Science • Arizona

On-site
USD 180,000 - 240,000
Site Reliability Engineer
Site Reliability Engineer

Motion Recruitment Partners LLC • Chicago (IL), Northern (KY)

Hybrid
USD 140,000 - 170,000
Senior SRE: AI-Driven Infra, Observability, Security
Senior SRE: AI-Driven Infra, Observability, Security

Socket.dev • United States

On-site
USD 150,000 - 180,000
Remote-friendly culture
Hybrid work in Nashville
Medical, dental, vision insurance
+3
Senior SRE & Automation Engineer (AWS, Observability)
Senior SRE & Automation Engineer (AWS, Observability)

Tata Consultancy Services • Englewood Cliffs (NJ)

On-site
USD 110,000 - 125,000
Senior SRE: GCP, Kubernetes, Terraform
Senior SRE: GCP, Kubernetes, Terraform

Stord-Warehous • Atlanta (GA)

Remote
USD 150,000 - 210,000
Senior AWS SRE — Reliability & Automation Lead (Onsite)
Senior AWS SRE — Reliability & Automation Lead (Onsite)

System One • Columbia (SC)

On-site
USD 140,000 - 180,000
Health & welfare benefits
401(k) plan
Senior Site Reliability Engineer
Senior Site Reliability Engineer

Axiom Pursuits • San Francisco (CA)

On-site
USD 150,000 - 180,000
Senior SRE & Observability Lead — New Relic, Terraform
Senior SRE & Observability Lead — New Relic, Terraform

The Judge Group • Illinois

Hybrid
USD 140,000 - 170,000
Competitive Salary
Equity
Comprehensive Benefits