Site Reliability Engineer: Distributed Systems Observability

engineeringjobs.net, Inc.

Sunnyvale (CA)

On-site

USD 140,000 - 210,000

Full time

4 days ago
Be an early applicant
Application generator

Get a reply from this employer — a resume and cover letter tailored to exactly what they’re hiring for.

Get past ATS filters

Job summary

engineeringjobs.net, Inc. is seeking an engineer to investigate and resolve performance and reliability issues across application, infrastructure, database, Kubernetes, and Linux layers, while recommending evidence-based improvements.

The role entails designing scalable, highly available distributed systems, planning capacity, improving observability, and collaborating with engineering teams and business stakeholders to deliver robust solutions.

Qualifications

  • Requires hands-on experience with distributed systems, performance engineering, Java troubleshooting, Kubernetes, Linux tuning, PostgreSQL optimization, cloud platforms, scripting, deployment automation, and monitoring.
  • Candidates must also have practical LLM experience, strong analytical and communication skills, and the ability to take ownership and work collaboratively.

Responsibilities

  • Investigate and resolve performance and reliability issues across application, infrastructure, database, Kubernetes, and Linux layers, and recommend evidence-based improvements.
  • Design and assess scalable, highly available distributed systems, plan capacity, improve observability, and collaborate with engineering teams and business stakeholders.

Skills

Distributed Systems
Performance Engineering
Java
Kubernetes
Linux Internals And Tuning
PostgreSQL
Azure
Python
Bash
PowerShell
High Availability
Capacity Planning
Monitoring And Observability
Deployment Pipelines
Large Language Models

Tools

PostgreSQL
Kubernetes
Azure

Job description

engineeringjobs.net, Inc. is seeking an engineer to investigate and resolve performance and reliability issues across application, infrastructure, database, Kubernetes, and Linux layers, while recommending evidence-based improvements.

The role entails designing scalable, highly available distributed systems, planning capacity, improving observability, and collaborating with engineering teams and business stakeholders to deliver robust solutions.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Site Reliability Engineer
Site Reliability Engineer

engineeringjobs.net, Inc. • Sunnyvale (CA)

On-site
USD 140,000 - 210,000
Site Reliability Engineer – Observability & Automation Lead
Site Reliability Engineer – Observability & Automation Lead

Talentify • Houston (TX)

On-site
USD 140,000 - 180,000
Site Reliability Engineer: Observability & Performance
Site Reliability Engineer: Observability & Performance

Cognizant • Town of Hartford (WI)

Hybrid
USD 132,000 - 152,000
Medical Insurance
PTO & Holidays
401(k) plan
+3
Site Reliability Engineer - Scale & Observability
Site Reliability Engineer - Scale & Observability

gamma.app • San Francisco (CA)

On-site
USD 120,000 - 160,000
Flexible work-from-home options
Creative and collaborative team environment
Senior Site Reliability Engineer – Scale & Observability
Senior Site Reliability Engineer – Scale & Observability

Inspire Brands, Inc. • Atlanta (GA)

On-site
USD 120,000 - 180,000
Senior Site Reliability Engineer: Scalable Infra & Observability
Senior Site Reliability Engineer: Scalable Infra & Observability

Early Warning • Chicago (IL)

Hybrid
USD 106,000 - 130,000
Healthcare Coverage
401(k) Matching
Paid Time Off
+1
Site Reliability Engineer
Site Reliability Engineer

The Judge Group • Buffalo (NY)

On-site
USD 120,000 - 150,000
Medical insurance
Dental insurance
Vision insurance
Site Reliability Engineer
Site Reliability Engineer

Request Technology, LLC • Chicago (IL)

On-site
USD 150,000 - 155,000
Senior Site Reliability Engineer: Observability & Cloud
Senior Site Reliability Engineer: Observability & Cloud

VBeyond Corporation • Jersey City (NJ)

On-site
USD 100,000 - 260,000
Site Reliability Engineer — ML Infra & Observability
Site Reliability Engineer — ML Infra & Observability

Baseten • San Francisco (CA)

On-site
USD 135,000 - 285,000
Competitive compensation including equity
100% coverage of medical, dental, and vision insurance
Flexible PTO policy
+3