Senior SRE: Scalable Cloud Reliability & Observability

Latitude AI

Palo Alto (CA)

On-site

USD 179,200 - 268,800

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Benefits offered by this job

Health insurance
401(k) match
Unlimited vacation
Paid parental leave
Wellness stipend

Job summary

Latitude AI is hiring a Site Reliability Engineer to help build and operate mission-critical ADAS platform services for Ford’s autonomous roadmap. You will implement monitoring, alerting and automation to ensure health, reliability, and performance across cloud-native services.

You will work with ingest, mapping, ML, and release teams to design scalable components, build Kubernetes controllers, and drive incident response improvements through on-call rotations and postmortems.

Qualifications

  • Bachelor's degree in Computer Engineering, CS, EE, or Robotics with relevant work experience.
  • Advanced degree optional with demonstrated production software experience.
  • Experience building reliable, scalable cloud services and Kubernetes controllers.

Responsibilities

  • Build and run mission-critical systems with a focus on reliability and observability.
  • Develop monitoring, alerting, and runbooks to improve incident response.
  • Collaborate across ingestion, mapping, ML, and deployment teams to scale services.
  • Design platform components and Kubernetes automation to support features.
  • Participate in on-call rotation and blameless postmortems.

Skills

Go
Python
Linux internals
Cloud experience (AWS/GCP)
Kubernetes operations
SLOs & reliability
Debugging & on-call
Communication

Education

Bachelor's degree in Computer Engineering/CS/EE/Robotics
Master's degree or PhD (related field)

Tools

Terraform
CloudFormation
Kubernetes
Prometheus
Elasticsearch
Loki
Jaeger
Tempo
AWS
GCP

Job description

Latitude AI is hiring a Site Reliability Engineer to help build and operate mission-critical ADAS platform services for Ford’s autonomous roadmap. You will implement monitoring, alerting and automation to ensure health, reliability, and performance across cloud-native services.

You will work with ingest, mapping, ML, and release teams to design scalable components, build Kubernetes controllers, and drive incident response improvements through on-call rotations and postmortems.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Senior Site Reliability Engineer – Kubernetes & Cloud
Senior Site Reliability Engineer – Kubernetes & Cloud

Latitude AI • United States

On-site
USD 179,000 - 269,000
Competitive compensation packages
Medical, dental, and vision insurance
Health savings account with employer-m
+5
Senior SRE: Scale Reliability & Observability
Senior SRE: Scale Reliability & Observability

Megaport • Abbeyville (CO)

On-site
USD 130,000 - 190,000
Contractor (PJ)
Paid Time Off
Competitive Compensation
+4
Senior SRE — Fleet Reliability for Autonomous Driving
Senior SRE — Fleet Reliability for Autonomous Driving

EngineersOfAI • Germany (OH)

On-site
USD 90,000 - 130,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

Latitude AI • United States

On-site
USD 179,000 - 269,000
Competitive compensation packages
Medical, dental, and vision insurance
Health savings account with employer-m
+5
Senior SRE: AI Cloud Platform & Kubernetes Expert
Senior SRE: AI Cloud Platform & Kubernetes Expert

Lambda • Bellevue (WA)

On-site
USD 180,000 - 260,000
Health insurance
Dental insurance
Vision insurance
+3
Senior Site Reliability Engineer
Senior Site Reliability Engineer

Latitude AI • Palo Alto (CA)

On-site
USD 179,000 - 269,000
Health insurance
401(k) match
Unlimited vacation
+2
Senior SRE: AI & Data Platform—Remote (ET)
Senior SRE: AI & Data Platform—Remote (ET)

Systematix group • Maryland

On-site
USD 150,000 - 210,000
Remote contract
Senior SRE - Cloud & Observability
Senior SRE - Cloud & Observability

Ridgeline • Reno (NV)

Hybrid
USD 153,000 - 210,000
Unlimited vacation
Education reimbursement
Wellness reimbursement
+1
Senior SRE: Cloud Automation & AI-Driven Reliability
Senior SRE: Cloud Automation & AI-Driven Reliability

Ll Oefentherapie • Frankfort (KY)

On-site
USD 120,000 - 160,000
Director, Cloud SRE & Observability (Hybrid/On‑Prem)
Director, Cloud SRE & Observability (Hybrid/On‑Prem)

Ford Motor Company • Helena (MT)

Hybrid
USD 142,000 - 268,000
Vehicle discount program
Tuition assistance
Paid time off and holidays
+1