Site Reliability Engineer - Scalable AWS SaaS Platform

instrumental-inc-

Palo Alto (CA)

On-site

USD 140,000 - 165,000

Full time

14 days+
Application generator

Get a reply from this employer — a resume and cover letter tailored to exactly what they’re hiring for.

Get past ATS filters

Benefits offered by this job

Health insurance
Vision insurance
Dental
Commuter benefits
Parental leave

Job summary

Instrumental is seeking a Site Reliability Engineer to operate, improve, and scale our AWS-based SaaS platform. You will blend production operations with engineering to enhance reliability, automation, observability, and operational excellence.

You’ll participate in a bi-weekly on-call rotation and own production issues end-to-end, collaborating with software engineers to build resilient systems and drive long-term solutions.

Qualifications

  • 3–4 years in SRE/DevOps or related roles for production SaaS.
  • 3–4 years of experience supporting production SaaS environments.
  • Strong AWS experience: EC2, VPC, IAM, RDS, ECS, S3.
  • IaC experience with Terraform or equivalent.
  • Experience designing/ supporting CI/CD pipelines (GitHub Actions, Jenkins, GitLab CI/CD).
  • Datadog observability including dashboards, alerting, logging, and APM.
  • Docker and Kubernetes experience.
  • Scripting in Python and/or Bash.
  • On-call production support and incident response.
  • Ownership of production issues from investigation to long-term resolution.

Responsibilities

  • Operate, improve, and scale the AWS-based SaaS platform.
  • Combine production operations with engineering to improve reliability, automation, observability, and operational excellence.
  • Participate in a bi-weekly on-call rotation and drive issue remediation.
  • Collaborate with software engineers to make services production-ready and resilient.

Skills

SRE fundamentals
On-call incident response
Automation mindset
System troubleshooting

Tools

AWS
Terraform
Docker
Kubernetes
Datadog
GitHub Actions
Jenkins
GitLab CI/CD

Job description

Instrumental is seeking a Site Reliability Engineer to operate, improve, and scale our AWS-based SaaS platform. You will blend production operations with engineering to enhance reliability, automation, observability, and operational excellence.

You’ll participate in a bi-weekly on-call rotation and own production issues end-to-end, collaborating with software engineers to build resilient systems and drive long-term solutions.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Site Reliability Engineer — Scale an AI‑Powered SaaS Platform
Site Reliability Engineer — Scale an AI‑Powered SaaS Platform

Instrumental Inc. • Palo Alto (CA)

On-site
USD 140,000 - 165,000
Health insurance
Vision insurance
Dental plan
+2
Senior Site Reliability Engineer — PubTech Scale
Senior Site Reliability Engineer — PubTech Scale

Amazon • Seattle (WA)

On-site
USD 151,000 - 205,000
Health insurance
401(k) matching
Paid time off
+1
Senior SRE: Scale & Reliability for AI-Driven SaaS Platform
Senior SRE: Scale & Reliability for AI-Driven SaaS Platform

Instrumental Inc. • Palo Alto (CA)

On-site
USD 175,000 - 229,000
Health benefits
Commuter plans
Parental leave
Site Reliability Engineer II — Scale & Resilience
Site Reliability Engineer II — Scale & Resilience

DAT Freight Solutions • Seattle (WA)

Hybrid
USD 95,000 - 134,000
Medical, Dental, Vision, Life, AD&D
401k matching
Employee Stock Purchase Plan
+4
Senior Site Reliability Engineer
Senior Site Reliability Engineer

MeridianLink, Inc. • Northern (KY)

On-site
USD 120,000 - 170,000
Site Reliability Engineer - Scale & Observability
Site Reliability Engineer - Scale & Observability

gamma.app • San Francisco (CA)

On-site
USD 120,000 - 160,000
Flexible work-from-home options
Creative and collaborative team environment
Senior Site Reliability Engineer: Scalable Infra & Observability
Senior Site Reliability Engineer: Scalable Infra & Observability

Early Warning • Chicago (IL)

Hybrid
USD 106,000 - 130,000
Healthcare Coverage
401(k) Matching
Paid Time Off
+1
Senior Site Reliability Engineer
Senior Site Reliability Engineer

Apply • Northern (KY)

On-site
USD 120,000 - 150,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

MeridianLink • United States

On-site
USD 140,000 - 180,000
Staff Site Reliability Engineer - Scale Global AWS Infra
Staff Site Reliability Engineer - Scale Global AWS Infra

Pearl Street Technologies • Pittsburgh

On-site
USD 130,000 - 180,000