Site Reliability Engineer - Kubernetes & Cloud

Hydrolix

United States

On-site

USD 110,000 - 150,000

Full time

14 days+
Application generator

A complete application in a minute — tailored resume and cover letter, ready to send.

Get past ATS filters

Job summary

A leading data management company in the United States is seeking a Site Reliability Engineer (SRE) to enhance the reliability and scalability of their cloud platform. The role requires deep expertise in system reliability, Kubernetes, and monitoring tools. Candidates should possess strong programming skills, proficiency in cloud platforms, and excellent communication skills. This position offers the opportunity to work collaboratively with cross-functional teams and play a key role in operational excellence.

Qualifications

  • Minimum five years of experience supporting complex distributed systems.
  • Experience with monitoring and debugging tools like Prometheus or Grafana.
  • Proficiency in at least one major cloud platform (AWS, GCP, Azure).
  • Strong experience with Linux systems including performance tuning.
  • Excellent written and verbal communication skills.

Responsibilities

  • Deploy and maintain a reliable fleet of Kubernetes clusters.
  • Design and implement systems to enhance service availability.
  • Develop monitoring and incident response strategies.
  • Automate repetitive tasks for operational efficiency.
  • Work closely with teams to integrate reliability practices.

Skills

SRE Expertise
Observability Tools
Cloud Platforms
Database Knowledge
Programming Skills
Linux Expertise
Communication Skills

Job description

A leading data management company in the United States is seeking a Site Reliability Engineer (SRE) to enhance the reliability and scalability of their cloud platform. The role requires deep expertise in system reliability, Kubernetes, and monitoring tools. Candidates should possess strong programming skills, proficiency in cloud platforms, and excellent communication skills. This position offers the opportunity to work collaboratively with cross-functional teams and play a key role in operational excellence.
Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Senior Site Reliability Engineer: Cloud, Kubernetes Uptime
Senior Site Reliability Engineer: Cloud, Kubernetes Uptime

Compunnel, Inc. • Greenwood Village (CO)

On-site
USD 120,000 - 150,000
Senior Site Reliability Engineer: Cloud, Kubernetes & CI/CD
Senior Site Reliability Engineer: Cloud, Kubernetes & CI/CD

Amiri Recruiting • Mountain View (CA)

On-site
USD 130,000 - 160,000
Senior Site Reliability Engineer: Observability & Cloud
Senior Site Reliability Engineer: Observability & Cloud

VBeyond Corporation • Jersey City (NJ)

On-site
USD 100,000 - 260,000
SRE Engineer: Cloud, Kubernetes & CI/CD Reliability
SRE Engineer: Cloud, Kubernetes & CI/CD Reliability

OPPO • Palo Alto (CA)

On-site
USD 100,000 - 200,000
Global Remote SRE for AI Infrastructure & Kubernetes
Global Remote SRE for AI Infrastructure & Kubernetes

Andromeda Cluster • San Francisco (CA)

Hybrid
USD 120,000 - 160,000
SRE: Build resilient Cloud Infra with Kubernetes & IaC
SRE: Build resilient Cloud Infra with Kubernetes & IaC

Edify Technologies • Irvine (CA)

On-site
USD 124,000 - 207,000
Health Insurance
Paid Time Off (PTO)
Paid Holidays
Senior SRE Engineer – Cloud, Kubernetes & Automation
Senior SRE Engineer – Cloud, Kubernetes & Automation

VBeyond Corporation • Dallas (TX)

On-site
USD 100,000 - 140,000
Site Reliability Engineer: Cloud, Kubernetes & Automation
Site Reliability Engineer: Cloud, Kubernetes & Automation

Knack Solutions • Richmond (VA)

On-site
USD 100,000 - 130,000
Senior SRE: Build Reliability for Global Bare Metal Cloud
Senior SRE: Build Reliability for Global Bare Metal Cloud

Latitude.sh • United States

Remote
USD 120,000 - 150,000
Paid Time Off
Competitive Compensation
Wellhub (former Gympass)
+2
Senior Site Reliability Engineer (SRE) – Automation & Cloud Ops
Senior Site Reliability Engineer (SRE) – Automation & Cloud Ops

Knack Solutions • Reston (VA)

On-site
USD 120,000 - 160,000