Site Reliability & Observability Engineer

Stability Technology

United States

On-site

USD 120,000 - 170,000

Full time

15 hours ago
Be an early applicant

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

Stability Technology is seeking a Site Reliability / Observability Engineer to build and own monitoring, logging, tracing, and alerting across our nationwide healthcare platform. You will define healthy system criteria, develop dashboards, and reduce alert noise while ensuring reliability for telehealth and RCM services.

The role requires strong technical judgement, collaboration with Enterprise Tech, and hands-on work with Datadog, Grafana/Prometheus, CloudWatch, and AWS services.

Qualifications

  • 3+ years of experience building and operating observability infrastructure in production.
  • Experience defining, tracking, and communicating SLIs/SLOs.
  • Strong AWS fundamentals are required, particularly CloudWatch, Lambda, and EventBridge.
  • Scripting or automation experience using Python, Node.js, or similar.

Responsibilities

  • Design and implement monitoring, logging, and distributed tracing across internal platforms and telephony.
  • Define and track SLIs and SLOs for critical systems.
  • Build actionable, low-noise alerting that identifies meaningful operational issues.
  • Own the observability toolchain across metrics, logs, traces, dashboards, and on-call tooling.
  • Support incident response with real-time visibility and lead post-incident analysis.
  • Instrument new systems and integrations, including AWS-based telephony and EHR.
  • Track and report system reliability trends to technology leadership.
  • Tune thresholds and retire alerts that reflect meaningful risk.

Skills

Observability
AWS fundamentals
Scripting
Incident response
Alerting
Monitoring

Tools

Datadog
New Relic
Grafana
Prometheus
CloudWatch
AWS Lambda
EventBridge
PagerDuty
GitHub
Confluence
Jira
Slack

Job description

Stability Technology is seeking a Site Reliability / Observability Engineer to build and own monitoring, logging, tracing, and alerting across our nationwide healthcare platform. You will define healthy system criteria, develop dashboards, and reduce alert noise while ensuring reliability for telehealth and RCM services.

The role requires strong technical judgement, collaboration with Enterprise Tech, and hands-on work with Datadog, Grafana/Prometheus, CloudWatch, and AWS services.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Site Reliability Engineer
Site Reliability Engineer

Stability Technology • United States

On-site
USD 120,000 - 170,000
Senior Site Reliability Engineer — Cloud, Observability & Automation
Senior Site Reliability Engineer — Cloud, Observability & Automation

Nocd- • Chicago (IL)

Hybrid
USD 160,000 - 200,000
Downtown Chicago office with on-site =
Hybrid work model (3x a week in-office
Competitive pay with incentives
Senior Site Reliability Engineer — Scale & Observability
Senior Site Reliability Engineer — Scale & Observability

Pivotal Health • New York (NY)

Hybrid
USD 230,000 - 260,000
Equity
Health, dental, vision
401(k)
+2
Senior Site Observability Engineer - Remote
Senior Site Observability Engineer - Remote

United States Digital Space LLC • United States

Remote
USD 100,000 - 150,000
Senior Observability Platform Engineer - Scale & Reliability
Senior Observability Platform Engineer - Scale & Reliability

CVS Health • West Virginia

Hybrid
USD 83,000 - 222,000
Observability Engineer – Production Systems & Reliability
Observability Engineer – Production Systems & Reliability

Trs Healthcare • Alabama

On-site
USD 105,000 - 165,000
Senior Observability Platform Engineer — Scale & Reliability
Senior Observability Platform Engineer — Scale & Reliability

Koitecc Solutions • Michigan

On-site
USD 83,000 - 222,000
Remote Site Reliability Engineer - Cloud & Observability
Remote Site Reliability Engineer - Cloud & Observability

Prove • United States

On-site
USD 120,000 - 150,000
Competitive salary
Equity Plan
401(k) match
+2
Remote Observability Platform Engineer
Remote Observability Platform Engineer

Bright Vision Technologies • Bellevue (WA)

On-site
USD 100,000 - 150,000
Senior Observability Platform Engineer: Scale & Reliability
Senior Observability Platform Engineer: Scale & Reliability

CVS Health • Nebraska

Hybrid
USD 83,000 - 222,000