Site Reliability Architect

Summit Hosting LLC

United States

On-site

USD 150,000 - 190,000

Full time

12 days ago

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

Summit Hosting LLC is seeking a full-time remote Site Reliability Architect to own the vision for observability and reliability across platforms. You will design resilient systems, define standards, and mentor engineering teams to improve performance and reliability across the organization.

You will drive SLOs, SLIs, and SLAs, oversee governance of observability frameworks, and collaborate with multi-cloud stakeholders to ensure scalable, compliant operations. Remote in United States.

Qualifications

  • Experience designing observability and reliability platforms at scale.
  • Ability to influence architecture across technical teams.
  • Experience with ELK, Grafana or Prometheus.
  • Automation skills with Ansible or Terraform.
  • Familiar with multi-cloud and compliance-heavy industries.

Responsibilities

  • Define observability and reliability architecture strategy across platforms.
  • Implement SLOs, SLIs, and SLAs across teams.
  • Oversee design and governance of observability frameworks and standards.
  • Mentor engineering teams to improve performance and reliability.

Skills

Observability design
SRE architecture
Automation
Multi-cloud
ELK
Grafana
Prometheus

Tools

Ansible
Terraform

Job description

Owning the vision and strategy for observability and reliability platforms, the full-time remote Site Reliability Architect will design resilient systems, implement site reliability concepts, and mentor engineering teams to enhance performance across the organization.

Key responsibilities
  • Define the observability and reliability architecture strategy across platforms and services
  • Implement site reliability concepts such as SLOs, SLIs, and SLAs across teams
  • Oversee the design and governance of observability frameworks and standards
Required qualifications
  • Proven experience in designing and implementing observability and reliability platforms at scale
  • Strong background in influencing architecture and strategy across technical teams
  • Experience with observability stacks like ELK, Grafana, or Prometheus
  • Advanced automation skills using tools like Ansible or Terraform
  • Familiarity with compliance-heavy industries and multi-cloud environments
Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Remote Site Reliability Architect: Observability Platform
Remote Site Reliability Architect: Observability Platform

Summit Hosting LLC • United States

On-site
USD 150,000 - 190,000
Site Reliability Architect: Observability & Resilience (Remote)
Site Reliability Architect: Observability & Resilience (Remote)

Summit • United States

On-site
USD 136,000 - 175,000
Flexible Time Off
Medical, Dental & Vision
401(k) with match
+4
Sr. Site Reliability Engineer
Sr. Site Reliability Engineer

MeridianLink • United States

Remote
USD 140,000 - 190,000
Site Reliability Engineering Manager
Site Reliability Engineering Manager

O.C. Tanner • Salt Lake City (UT)

On-site
USD 180,000 - 260,000
Sr. Site Reliability Engineer
Sr. Site Reliability Engineer

MeridianLink, Inc. • Northern (KY)

Hybrid
USD 140,000 - 210,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

Jobtailor • Arlington (VA)

On-site
USD 140,000 - 200,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

O.C. Tanner • Salt Lake City (UT)

On-site
USD 130,000 - 180,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

Veloc Inc • Coppell (TX)

On-site
USD 140,000 - 190,000
Lead Site Reliability Engineer
Lead Site Reliability Engineer

Luxoft • Buffalo (NY)

On-site
USD 140,000 - 190,000
Lead Site Reliability Engineer
Lead Site Reliability Engineer

Luxoft • Wilmington (DE)

On-site
USD 140,000 - 190,000