Senior Site Reliability Engineer (SRE)

Appit LLC

Seattle (WA)

On-site

USD 120,000 - 160,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Benefits offered by this job

Competitive salaries
Flexible work arrangements
Opportunities for career growth

Job summary

Appit LLC is seeking a Senior Site Reliability Engineer (SRE) in Seattle, USA, to lead site reliability engineering efforts. You will drive 99.99% availability targets through advanced observability, automation, and resilience engineering.

Key responsibilities include architecting observability platforms, mentoring team members, and leading incident response. The ideal candidate will have 6-9 years of experience in SRE or production engineering, along with strong expertise in Kubernetes and cloud infrastructure.

Benefits include competitive salaries and flexible work arrangements.

Qualifications

  • 6-9 years of SRE or production engineering experience with large-scale distributed systems.
  • Deep expertise in observability including metrics, logs, traces, and profiling at scale.
  • Advanced Kubernetes operations experience including multi-cluster management.

Responsibilities

  • Lead SRE strategy and practices across multiple product teams.
  • Architect and maintain enterprise-grade observability platforms.
  • Drive chaos engineering programs to identify failure modes.

Skills

SRE or production engineering experience
Observability including metrics, logs, traces
Kubernetes operations
Software engineering skills in Go, Python, or Rust
Managing SLO frameworks
Cloud infrastructure experience (AWS or GCP)

Tools

OpenTelemetry
Prometheus
Grafana
AWS
GCP

Job description

APPIT Software Solutions is hiring a Senior Site Reliability Engineer (SRE) in Seattle, USA. Lead site reliability engineering efforts for large-scale distributed systems, driving 99.99% availability targets through advanced observability, automation, and resilience engineering.

Responsibilities
  • Lead SRE strategy and practices across multiple product teams ensuring consistent reliability standards
  • Architect and maintain enterprise-grade observability platforms using OpenTelemetry, Prometheus, and Grafana
  • Drive chaos engineering programs to proactively identify failure modes and improve system resilience
  • Mentor SRE team members and embed reliability practices into the software development lifecycle
  • Lead high-severity incident response and establish processes for continuous improvement from postmortems
  • Design capacity planning models and automated scaling strategies for cost-efficient high availability
Requirements
  • 6-9 years of SRE or production engineering experience with large-scale distributed systems
  • Deep expertise in observability including metrics, logs, traces, and profiling at scale
  • Advanced Kubernetes operations experience including multi-cluster management and custom controllers
  • Strong software engineering skills in Go, Python, or Rust for building production-grade SRE tooling
  • Proven experience managing SLO frameworks and driving reliability improvements across organizations
  • Experience with cloud infrastructure (AWS or GCP) at scale with multi-region deployments
Nice to Have
  • Experience leading SRE teams or guilds in a large engineering organization
  • Background in performance engineering and profiling distributed systems
Benefits

Competitive salaries, flexible work arrangements, and opportunities for career growth across our global offices.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Senior SRE: Lead Reliability for Large-Scale Systems | Flexible Hours
Senior SRE: Lead Reliability for Large-Scale Systems | Flexible Hours

Appit LLC • Seattle (WA)

On-site
Site Reliability Engineer
Site Reliability Engineer

TalentDome Staffing • United States

On-site
USD 140,000 - 210,000
Site Reliability Engineer
Site Reliability Engineer

SRE • Puerto Rico

Hybrid
USD 120,000 - 180,000
Site Reliability Engineer
Site Reliability Engineer

Compunnel, Inc. • Greenwood Village (CO)

On-site
USD 120,000 - 150,000
Site Reliability Engineer
Site Reliability Engineer

Encora Digital Inc. • United States

On-site
USD 120,000 - 180,000
Site Reliability Engineer (SRE)
Site Reliability Engineer (SRE)

Methodic • San Francisco (CA)

On-site
USD 140,000 - 210,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

Mission Staffing • New York (NY)

Hybrid
Site Reliability Engineer (SRE)
Site Reliability Engineer (SRE)

Virtual Tech Gurus • Puerto Rico

On-site
USD 140,000 - 210,000
Site Reliability Engineer
Site Reliability Engineer

Involved Solutions • Austin (TX)

On-site
USD 110,000 - 150,000
Site Reliability Engineer
Site Reliability Engineer

Request Technology, LLC • Chicago (IL)

Hybrid
USD 150,000 - 155,000