Site Reliability Engineer: CI/CD, Kubernetes & Observability

MyFitnessPal

United States

On-site

USD 120,000 - 165,000

Full time

14 days+
Application generator

A complete application in a minute — tailored resume and cover letter, ready to send.

Get past ATS filters

Benefits offered by this job

Healthcare benefits
401(k) with company match
Annual performance bonus
Wellness allowance
Technology allowance
Responsible time off
Volunteer days

Job summary

MyFitnessPal is seeking a Software Engineer III - Site Reliability to join the PEAS team. You will own reliability across production services, lead incident response, and strengthen CI/CD security and observability.

You will design and operate scalable infrastructure with Terraform and Kubernetes, improve SLI/SLO programs, and collaborate with Security and Reliability teams to ship safely at scale.

Qualifications

  • 5+ years in site reliability, platform, or infrastructure engineering with ownership of production systems.
  • Strong programming skills for automation and tooling (Go, Python, Typescript).
  • Hands-on experience with AWS, Kubernetes, and Infrastructure as Code (Terraform).
  • Proven incident response leadership and SLO-driven reliability practices.
  • Experience with observability tooling (Datadog).
  • Security integrated into CI/CD pipelines (SAST/DAST/SCA).
  • Cloud security fundamentals (IAM, least privilege).
  • Policy-as-code frameworks (Kyverno, OPA/Rego, Conftest).
  • Exposure to regulated environments (SOC 2, PCI DSS, HIPAA).
  • Chaos engineering or game-day experience.

Responsibilities

  • Own and evolve SLI/SLO and error-budget frameworks.
  • Lead incident response and postmortems, drive systemic fixes.
  • Build and maintain observability across metrics, logs, and traces (Datadog).
  • Design and operate scalable infrastructure using Terraform.
  • Manage production Kubernetes and container workloads.
  • Own CI/CD pipelines and safe deployment strategies (canary, progressive rollout).
  • Integrate security controls in the delivery pipeline (SAST/DAST/SCA).
  • Implement policy-as-code to block unsafe changes at admission time.
  • Drive vulnerability triage and remediation SLAs for pipelines and infra.
  • Collaborate with Security Engineers and broader Reliability teams.
  • Improve on-call rotation; write runbooks and automation.
  • Mentor teammates on reliability patterns.

Skills

Go
Python
Typescript
Observability tooling
Incident response
Cloud platforms
Kubernetes
Terraform
Security in CI/CD
Policy-as-code

Tools

Datadog
GitHub Actions
Terraform
Kubernetes
OPA/Rego
Kyverno
Conftest

Job description

MyFitnessPal is seeking a Software Engineer III - Site Reliability to join the PEAS team. You will own reliability across production services, lead incident response, and strengthen CI/CD security and observability.

You will design and operate scalable infrastructure with Terraform and Kubernetes, improve SLI/SLO programs, and collaborate with Security and Reliability teams to ship safely at scale.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Senior Site Reliability Engineer, CI/CD & Observability
Senior Site Reliability Engineer, CI/CD & Observability

Myfitnesspal • Austin (TX)

On-site
USD 120,000 - 165,000
Healthcare benefits
Parental planning
Mental health benefits
+5
Senior Site Reliability Engineer — CI/CD, Security & Observability
Senior Site Reliability Engineer — CI/CD, Security & Observability

MyFitnessPal, Inc. • United States

Remote
USD 120,000 - 180,000
Senior Site Reliability Engineer — CI/CD & Security
Senior Site Reliability Engineer — CI/CD & Security

MyFitnessPal • United States

On-site
USD 120,000 - 165,000
Healthcare
401(k) with match
Parental planning
+1
Site Reliability Engineer
Site Reliability Engineer

NextGen | GTA: A Kelly Telecom Company • Mount Laurel Township (NJ)

On-site
USD 110,000 - 170,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

Axiom Pursuits • San Francisco (CA)

On-site
USD 150,000 - 180,000
Site Reliability Engineer — ML Infra & Observability
Site Reliability Engineer — ML Infra & Observability

Baseten • San Francisco (CA)

On-site
USD 135,000 - 285,000
Competitive compensation including equity
100% coverage of medical, dental, and vision insurance
Flexible PTO policy
+3
Site Reliability Engineer
Site Reliability Engineer

TalentDome Staffing • United States

On-site
USD 140,000 - 210,000
Platform SRE - Scale Kubernetes, Cloud Infra & Reliability
Platform SRE - Scale Kubernetes, Cloud Infra & Reliability

Specter • San Francisco (CA)

On-site
USD 180,000 - 230,000
Site Reliability Engineer: Observability & Autonomy (Equity)
Site Reliability Engineer: Observability & Autonomy (Equity)

MaintainX • United States

On-site
USD 120,000 - 180,000
Site Reliability Engineer, AI Infra & Observability
Site Reliability Engineer, AI Infra & Observability

Sierra • California (MO)

On-site
USD 150,000 - 210,000
Unlimited PTO
Medical, dental, vision
Retirement plan
+4