Staff Reliability Engineer - Observability & AI Ops

IonQ

Santa Clara (CA)

Hybrid

USD 180,000 - 280,000

Full time

4 days ago
Be an early applicant
Application generator

Get a reply from this employer — a resume and cover letter tailored to exactly what they’re hiring for.

Get past ATS filters

Job summary

IonQ in Santa Clara, CA seeks a Staff Service Reliability and Operational Intelligence Engineer to define technical direction for reliability across regions and services. You will own the reliability strategy, establish standards, and mentor teams while hands-on designing observability platforms and governance of SLO programs.

You will lead incident response, capacity management, and AI Ops initiatives, partnering with cross-functional teams to deliver resilient cloud-native systems for quantum

Qualifications

  • 8+ years of production engineering, site reliability, or cloud operations.
  • Hands-on ownership of large-scale, fault-tolerant systems on AWS or GCP.
  • Expertise in observability, SLIs/SLOs, and incident response.
  • Proven ability to lead reliability standards across teams and services.
  • Strong software engineering and automation skills (Python/Go).

Responsibilities

  • Shape multi-year reliability roadmap for production readiness across environments.
  • Govern service ownership standards, runbooks, and escalation paths.
  • Evolve the shared observability platform with consistent logs, metrics, and traces.
  • Define dashboards, alert policies, and synthetic monitoring standards.
  • Lead incident response, post-incident reviews, and systemic remediation.
  • Drive capacity planning, performance testing, and resource rightsizing.
  • Deliver AI Ops capabilities for event correlation and automated triage.
  • Provide hands-on technical leadership during major incidents and launches.

Skills

SRE leadership
Cloud production systems
Kubernetes
Python/Go automation
Observability architecture
Incident management

Tools

AWS
GCP
CI/CD
Telemetry/Monitoring
Observability platforms

Job description

IonQ in Santa Clara, CA seeks a Staff Service Reliability and Operational Intelligence Engineer to define technical direction for reliability across regions and services. You will own the reliability strategy, establish standards, and mentor teams while hands-on designing observability platforms and governance of SLO programs.

You will lead incident response, capacity management, and AI Ops initiatives, partnering with cross-functional teams to deliver resilient cloud-native systems for quantum

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Senior Service Reliability & AI Ops Engineer
Senior Service Reliability & AI Ops Engineer

NightDragon Acquisition Corp. • Santa Clara (CA)

On-site
USD 170,000 - 210,000
Home technology stipend
Medical, dental, vision coverage
401(k) matching
+1
Staff SRE & AI-Driven Observability Architect
Staff SRE & AI-Driven Observability Architect

Physics World • Santa Clara (CA)

Hybrid
USD 170,000 - 250,000
Senior Staff Reliability & Observability Architect
Senior Staff Reliability & Observability Architect

Ionq • Santa Clara (CA)

On-site
USD 162,000 - 270,000
Staff Site Reliability Engineer - Platform Resilience
Staff Site Reliability Engineer - Platform Resilience

Physics World • Santa Clara (CA)

Hybrid
USD 180,000 - 240,000
Staff Site Reliability Engineer: Platform Resilience & Observability
Staff Site Reliability Engineer: Platform Resilience & Observability

IonQ • Santa Clara (CA)

Hybrid
USD 180,000 - 240,000
Lead Site Reliability Engineer — AI Ops & Resilience
Lead Site Reliability Engineer — AI Ops & Resilience

NightDragon Acquisition Corp. • Santa Clara (CA)

On-site
USD 152,000 - 228,000
Staff Site Reliability Engineer
Staff Site Reliability Engineer

IonQ • Santa Clara (CA)

Hybrid
USD 180,000 - 240,000
Staff Site Reliability Engineer
Staff Site Reliability Engineer

Physics World • Santa Clara (CA)

Hybrid
USD 180,000 - 240,000
Staff Service Reliability and Operational Intelligence Engineer
Staff Service Reliability and Operational Intelligence Engineer

Physics World • Santa Clara (CA)

Hybrid
USD 170,000 - 250,000
Staff DevOps Engineer: CI/CD Platform Lead
Staff DevOps Engineer: CI/CD Platform Lead

NightDragon Acquisition Corp. • Santa Clara (CA)

Hybrid
USD 180,000 - 240,000