Senior AWS SRE — Reliability & Automation Lead (Onsite)

System One

Columbia (SC)

On-site

USD 140,000 - 180,000

Full time

7 days ago
Be an early applicant
Application generator

Don’t send a generic resume — generate a resume and cover letter tailored to this exact role.

Get past ATS filters

Benefits offered by this job

Health & welfare benefits
401(k) plan

Job summary

System One is seeking a Senior AWS Site Reliability Engineer (SRE) to lead reliability for enterprise AWS workloads. You will drive SRE practices, define SLIs/SLOs, and own infrastructure automation across Terraform-based IaC and AWS native tooling.

You will build robust CI/CD pipelines with Jenkins and GitLab, implement comprehensive monitoring with Splunk, OpenTelemetry, and CloudWatch, and mentor teams on resilience and incident response.

Qualifications

  • 8+ years of hands-on AWS engineering experience in enterprise production environments.
  • Experience across AWS services such as ECS, EC2, RDS, Lambda, Route 53, Step Functions, Redshift, EMR, DynamoDB, S3, and CloudWatch.
  • Proven implementation of core SRE practices including SLIs/SLOs, error budgets, monitoring, alerting and incident response.

Responsibilities

  • Implement and improve SRE practices across AWS hosted enterprise applications and services.
  • Define and monitor SLIs/SLOs, error budgets, alarms, availability, and reliability metrics.
  • Automate infrastructure and operational processes using Python or Java.
  • Develop and maintain infrastructure as code using Terraform and AWS native tooling.
  • Build and enhance CI/CD pipelines using Jenkins, GitLab, and related technologies.
  • Implement monitoring, APM, distributed tracing, dashboards, and alerting using Splunk, SignalFx, OpenTelemetry, and CloudWatch.
  • Improve application resilience, failover readiness, recovery automation, and production stability.
  • Analyze application and infrastructure performance, identify recurring reliability issues, and implement sustainable improvements.
  • Troubleshoot AWS workloads, application performance, data pipelines, networking/DNS, CI/CD, and infrastructure automation issues.
  • Support production incidents, releases, platform upgrades, vulnerability remediation, and controlled infrastructure changes.
  • Establish performance baselines and help improve monitoring and operational readiness.
  • Lead technical discussions and coordinate resolution across teams.

Skills

SRE practices
Ownership & collaboration
Analytical troubleshooting
Communication
On-call experience

Tools

Terraform
Jenkins
GitLab
Splunk
OpenTelemetry
CloudWatch
Python
Java

Job description

System One is seeking a Senior AWS Site Reliability Engineer (SRE) to lead reliability for enterprise AWS workloads. You will drive SRE practices, define SLIs/SLOs, and own infrastructure automation across Terraform-based IaC and AWS native tooling.

You will build robust CI/CD pipelines with Jenkins and GitLab, implement comprehensive monitoring with Splunk, OpenTelemetry, and CloudWatch, and mentor teams on resilience and incident response.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Senior AWS SRE: Reliability, IaC & CI/CD Champion
Senior AWS SRE: Reliability, IaC & CI/CD Champion

System One • Birmingham (AL)

On-site
USD 120,000 - 180,000
Health insurance
Dental insurance
Vision insurance
+3
Site Reliability Engineer
Site Reliability Engineer

Motion Recruitment Partners LLC • Chicago (IL), Northern (KY)

Hybrid
USD 140,000 - 170,000
Senior AWS Site Reliability Engineer (SRE)
Senior AWS Site Reliability Engineer (SRE)

System One • Columbia (SC)

On-site
USD 140,000 - 180,000
Health & welfare benefits
401(k) plan
Senior AWS Site Reliability Engineer (SRE)
Senior AWS Site Reliability Engineer (SRE)

System One • Birmingham (AL)

On-site
USD 120,000 - 180,000
Health insurance
Dental insurance
Vision insurance
+3
Remote Senior SRE: AWS, Kubernetes & Terraform
Remote Senior SRE: AWS, Kubernetes & Terraform

Motion Recruitment Partners LLC • Chicago (IL), Northern (KY)

Hybrid
USD 140,000 - 170,000
Site Reliability Engineer
Site Reliability Engineer

TalentDome Staffing • United States

On-site
USD 140,000 - 210,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

Kovoro • Denver (CO), Northern (KY)

Hybrid
USD 150,000 - 190,000
Senior SRE & Automation Engineer (AWS, Observability)
Senior SRE & Automation Engineer (AWS, Observability)

Tata Consultancy Services • Englewood Cliffs (NJ)

On-site
USD 110,000 - 125,000
Senior SRE: Cloud Reliability, Terraform & Kubernetes (Remote)
Senior SRE: Cloud Reliability, Terraform & Kubernetes (Remote)

Motion Recruitment • Chicago (IL)

On-site
USD 140,000 - 190,000
SRE (Site Realiability Engineer)
SRE (Site Realiability Engineer)

STRATIS Cloud Tech Solutions INC • Arkansas

On-site
USD 110,000 - 150,000
Competitive salary
Growth and learning opportunities
Friendly, collaborative team