Site Reliability Engineer, Data Center Infra — Onsite

Spacex

Bastrop (TX)

On-site

USD 140,000 - 200,000

Full time

3 days ago
Be an early applicant
Application generator

A complete application in a minute — tailored resume and cover letter, ready to send.

Get past ATS filters

Job summary

SpaceX is seeking a Site Reliability Engineer for Data Center Infrastructure to strengthen reliability across manufacturing platforms including Starship and Starlink. You will own capacity planning, incident response, and the scaling of compute, storage, and networking infrastructures at multiple sites and programs.

The role requires strong software engineering fundamentals, ownership mindset, and the ability to communicate effectively with stakeholders.

Qualifications

  • Bachelor’s degree in computer science, information systems, or an engineering discipline or 3+ years of SRE/DevOps experience in lieu of a degree.
  • 1+ years of software development experience.
  • Experience with Linux operating systems.

Responsibilities

  • Deploy, upgrade, operate, maintain, and scale compute, storage, and networking for manufacturing systems across Starship, Starlink, Starshield, and Terafab.
  • Manage infrastructure as code and use observability to provide a complete picture of platform health.
  • Design for reliability, stability, and scale; find and remove bottlenecks with measurement and engineering.
  • Practice proactive maintenance: capacity planning, lifecycle management, and reducing toil before it becomes an incident.
  • Partner with software engineers, manufacturing stakeholders, and site teams to build operable, maintainable systems.
  • Improve the full lifecycle—from design through deployment, operation, and continuous refinement.
  • Practice sustainable incident response and blameless postmortems.
  • Provide high-quality support to manufacturing and engineering users.
  • Communicate clearly with stakeholders and teammates.
  • Participate in on-call and travel to sites as needed for deployments, incidents, and cross-site reliability

Skills

Software development
SRE/DevOps practices
Linux

Education

Bachelor’s degree in CS/IS/Engineering
3+ years SRE/DevOps experience in lieu of a degree

Tools

Terraform
Ansible
Puppet
Docker
Kubernetes
vSphere
QEMU
KVM
PostgreSQL
ClickHouse

Job description

SpaceX is seeking a Site Reliability Engineer for Data Center Infrastructure to strengthen reliability across manufacturing platforms including Starship and Starlink. You will own capacity planning, incident response, and the scaling of compute, storage, and networking infrastructures at multiple sites and programs.

The role requires strong software engineering fundamentals, ownership mindset, and the ability to communicate effectively with stakeholders.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Senior Site Reliability Engineer — Global, Multi-Region Infra
Senior Site Reliability Engineer — Global, Multi-Region Infra

Starlink • Hawthorne (CA)

On-site
USD 165,000 - 265,000
Site Reliability Engineer — Mission-Critical Systems
Site Reliability Engineer — Mission-Critical Systems

Iac/interactivecorp • Sacramento (CA)

On-site
USD 120,000 - 170,000
Stock options
Health insurance
Paid vacation
SRE: Data Center Infra for High-Uptime Manufacturing
SRE: Data Center Infra for High-Uptime Manufacturing

Linuxconfig • Bastrop (TX), Northern (KY)

Hybrid
USD 140,000 - 190,000
Onsite SRE: Manufacturing Infrastructure (Multi-site)
Onsite SRE: Manufacturing Infrastructure (Multi-site)

SPACE EXPLORATION TECHNOLOGIES CORP • Bastrop (TX)

On-site
USD 120,000 - 180,000
Senior Site Reliability Engineer – Starlink Global Infra
Senior Site Reliability Engineer – Starlink Global Infra

SpaceX • Palo Alto (CA)

On-site
USD 165,000 - 280,000
Stock options
401(k)
Medical, vision, dental
+3
Senior Site Reliability Engineer – Global, Multi-Region Infra
Senior Site Reliability Engineer – Global, Multi-Region Infra

Starlink • Palo Alto (CA)

On-site
USD 165,000 - 280,000
Stock options
401(k) plan
Medical, vision, dental coverage
+2
Manufacturing Infra SRE: Scale Factory Systems
Manufacturing Infra SRE: Scale Factory Systems

Starlink • Bastrop (TX)

On-site
USD 120,000 - 180,000
Manufacturing Infra SRE: Reliability & Scale
Manufacturing Infra SRE: Reliability & Scale

SpaceX • Town of Texas (WI)

On-site
USD 120,000 - 180,000
Senior Site Reliability Engineer — Multi-Region Systems
Senior Site Reliability Engineer — Multi-Region Systems

SpaceX • Hawthorne (CA)

On-site
USD 165,000 - 265,000
Senior Site Reliability Engineer — Multi-Region Impact
Senior Site Reliability Engineer — Multi-Region Impact

SPACE EXPLORATION TECHNOLOGIES CORP • Redmond (WA), Northern (KY)

Hybrid
USD 165,000 - 230,000
Company stock
Long-term cash awards
Discretionary bonuses
+9