Cloud Site Reliability Engineer: Observability & Automation

Amplifire AI Learning

United States

On-site

USD 120,000 - 170,000

Full time

14 days+
Application generator

An application made for this job — a tailored resume and cover letter that speak straight to the posting.

Get past ATS filters

Job summary

Amplifire is seeking a Site Reliability Engineer to improve the reliability, scalability, performance, and operational efficiency of our cloud-based platform. You will work with DevOps within Platform Operations to elevate observability, automate workflows, and reduce incidents.

The role emphasizes collaboration with software engineering, QA, security, and DevOps, to embed reliability practices and enable safe, confident changes.

Qualifications

  • 4+ years of experience in Site Reliability Engineering, DevOps, cloud infrastructure, or related role.
  • Experience supporting production cloud environments.
  • Hands-on experience designing, deploying, and operating production workloads on AWS.
  • Experience with Infrastructure as Code, observability solutions, incident response, and CI/CD automation.
  • Experience reducing operational toil through automation and self-service tooling.

Responsibilities

  • Establish and maintain SLIs, SLOs, error budgets, and health metrics.
  • Build and improve monitoring, logging, tracing, dashboards, and alerts for visibility.
  • Respond to production incidents with urgency and sound judgment.
  • Develop runbooks, recovery procedures, and operational practices to improve resilience.
  • Embed reliability and observability throughout the development lifecycle with software teams.

Skills

SRE experience
AWS
CI/CD
Incident response
Automation
On-call
Monitoring & alerting
System observability
Problem solving

Tools

Docker
Kubernetes
Terraform
AWS CDK
Linux

Job description

Amplifire is seeking a Site Reliability Engineer to improve the reliability, scalability, performance, and operational efficiency of our cloud-based platform. You will work with DevOps within Platform Operations to elevate observability, automate workflows, and reduce incidents.

The role emphasizes collaboration with software engineering, QA, security, and DevOps, to embed reliability practices and enable safe, confident changes.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Site Reliability Engineer
Site Reliability Engineer

Amplifire AI Learning • United States

On-site
USD 120,000 - 170,000
Remote Site Reliability Engineer - Cloud & Observability
Remote Site Reliability Engineer - Cloud & Observability

OneStream Software • Rochester (MI)

On-site
USD 114,000 - 148,000
Vision Insurance
Medical Insurance
Life Insurance
+2
Platform Reliability Engineer - Cloud, Observability, IaC
Platform Reliability Engineer - Cloud, Observability, IaC

Kalepa • Cincinnati (OH), Northern (KY)

Hybrid
USD 120,000 - 160,000
Medical insurance
Dental insurance
Vision insurance
+5
Senior Site Reliability Engineer - Cloud Platform & Growth
Senior Site Reliability Engineer - Cloud Platform & Growth

RXinsider LTD. • Cranberry Township

Hybrid
USD 120,000 - 180,000
Senior Site Reliability Engineer: Scalable Infra & Observability
Senior Site Reliability Engineer: Scalable Infra & Observability

Early Warning • Chicago (IL)

Hybrid
USD 106,000 - 130,000
Healthcare Coverage
401(k) Matching
Paid Time Off
+1
Senior SRE - Cloud & Observability
Senior SRE - Cloud & Observability

Ridgeline • Reno (NV)

Hybrid
USD 153,000 - 210,000
Unlimited vacation
Education reimbursement
Wellness reimbursement
+1
Platform SRE - Cloud Infra, Automation & Reliability
Platform SRE - Cloud Infra, Automation & Reliability

Withacclaim • Austin (TX)

On-site
USD 140,000 - 180,000
Site Reliability Engineer: Observability & Autonomy (Equity)
Site Reliability Engineer: Observability & Autonomy (Equity)

MaintainX • United States

On-site
USD 120,000 - 180,000
Senior Site Reliability Engineer - Cloud & Observability
Senior Site Reliability Engineer - Cloud & Observability

OneStream Software LLC • Northern (KY)

Hybrid
USD 114,000 - 148,000
Platform SRE Engineer: Observability & Automation
Platform SRE Engineer: Observability & Automation

Fathom • United States

Remote
USD 120,000 - 180,000