Site Reliability Engineer

engineeringjobs.net, Inc.

Sunnyvale (CA)

On-site

USD 140,000 - 210,000

Full time

4 days ago
Be an early applicant
Application generator

Turn this role into an interview — a resume and cover letter built around what this employer wants.

Get past ATS filters

Job summary

engineeringjobs.net, Inc. is seeking an engineer to investigate and resolve performance and reliability issues across application, infrastructure, database, Kubernetes, and Linux layers, while recommending evidence-based improvements.

The role entails designing scalable, highly available distributed systems, planning capacity, improving observability, and collaborating with engineering teams and business stakeholders to deliver robust solutions.

Qualifications

  • Requires hands-on experience with distributed systems, performance engineering, Java troubleshooting, Kubernetes, Linux tuning, PostgreSQL optimization, cloud platforms, scripting, deployment automation, and monitoring.
  • Candidates must also have practical LLM experience, strong analytical and communication skills, and the ability to take ownership and work collaboratively.

Responsibilities

  • Investigate and resolve performance and reliability issues across application, infrastructure, database, Kubernetes, and Linux layers, and recommend evidence-based improvements.
  • Design and assess scalable, highly available distributed systems, plan capacity, improve observability, and collaborate with engineering teams and business stakeholders.

Skills

Distributed Systems
Performance Engineering
Java
Kubernetes
Linux Internals And Tuning
PostgreSQL
Azure
Python
Bash
PowerShell
High Availability
Capacity Planning
Monitoring And Observability
Deployment Pipelines
Large Language Models

Tools

PostgreSQL
Kubernetes
Azure

Job description

Investigate and resolve performance and reliability issues across application, infrastructure, database, Kubernetes, and Linux layers, and recommend evidence-based improvements. Design and assess scalable, highly available distributed systems, plan capacity, improve observability, and collaborate with engineering teams and business stakeholders.

Requirements: Requires hands-on experience with distributed systems, performance engineering, Java troubleshooting, Kubernetes, Linux tuning, PostgreSQL optimization, cloud platforms, scripting, deployment automation, and monitoring. Candidates must also have practical LLM experience, strong analytical and communication skills, and the ability to take ownership and work collaboratively.

Key Skills: Distributed Systems, Performance Engineering, Java, Kubernetes, Linux Internals And Tuning, PostgreSQL, Azure, Python, Bash, PowerShell, High Availability, Capacity Planning, Monitoring And Observability, Deployment Pipelines, Large Language Models

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Site Reliability Engineer: Distributed Systems Observability
Site Reliability Engineer: Distributed Systems Observability

engineeringjobs.net, Inc. • Sunnyvale (CA)

On-site
USD 140,000 - 210,000
Site Reliability Engineer
Site Reliability Engineer

Talentify • Houston (TX)

On-site
USD 140,000 - 180,000
Site Reliability Engineer – Observability & Automation Lead
Site Reliability Engineer – Observability & Automation Lead

Talentify • Houston (TX)

On-site
USD 140,000 - 180,000
Site Reliability Engineer
Site Reliability Engineer

Brooksource • San Antonio (TX)

On-site
USD 80,000 - 120,000
Site Reliability Engineer
Site Reliability Engineer

Request Technology, LLC • Chicago (IL)

On-site
USD 150,000 - 155,000
Site Reliability Engineer
Site Reliability Engineer

TalentDome Staffing • United States

On-site
USD 140,000 - 210,000
Site Reliability Engineer/System Engineer
Site Reliability Engineer/System Engineer

Reveille Technologies • Atlanta (GA)

On-site
USD 100,000 - 130,000
Sr. Site Reliability Engineer
Sr. Site Reliability Engineer

Clearwater Analytics • Boise (ID)

On-site
USD 130,000 - 170,000
Site Reliability Engineer
Site Reliability Engineer

Ethos Group • Irving (TX)

On-site
USD 110,000 - 160,000
Site Reliability Engineer
Site Reliability Engineer

Harvey Nash • United States

Remote
USD 120,000 - 150,000