Site Reliability Engineer

Amiri Recruiting

Mountain View (CA)

On-site

USD 130,000 - 160,000

Full time

14 days+
Application generator

An application made for this job — a tailored resume and cover letter that speak straight to the posting.

Get past ATS filters

Job summary

A leading tech recruiting firm is seeking a Site Reliability Engineer to manage and optimize cloud infrastructure primarily using GCP or AWS. The role involves maintaining high availability through Kubernetes clusters and improving CI/CD pipelines with Terraform. Ideal candidates will have over 4 years of experience in SRE or DevOps and a strong understanding of security best practices. This internal-facing role requires no customer interaction and focuses on improving platform architecture and reliability.

Qualifications

  • 4+ years in SRE, DevOps, or Infrastructure Engineering.
  • Solid experience with GCP or AWS.
  • Hands-on with Terraform and CI/CD tools.

Responsibilities

  • Own and manage cloud infrastructure.
  • Build and maintain Kubernetes clusters.
  • Optimize CI/CD pipelines.

Skills

Site Reliability Engineering
DevOps
Infrastructure Engineering
Kubernetes management
Cloud infrastructure (GCP/AWS)
Terraform
CI/CD pipelines
Monitoring and Observability

Job description

Site Reliability Engineer
Onsite- Bay Area, CA
Skills
Relevant Skills and Experience
What You’ll Do (Day-to-Day)
  • Own and manage our cloud infrastructure (GCP or AWS, on-prem).
  • Build, maintain, and optimize Kubernetes clusters (including GPU-backed clusters).
  • Implement and improve CI/CD pipelines (GitHub Actions).
  • Write and maintain Infrastructure as Code (Terraform).
  • Monitor system health and performance using Grafana and other observability tools.
  • Ensure high availability, reliability, and uptime across platforms.
  • Handle infrastructure maintenance, upgrades, and scaling.
  • Administer and improve our platform architecture and apply general security best practices across the stack.

Note: This is an internal-facing role — no customer interaction.

Must-Have:
  • 4+ years in SRE, DevOps, or Infrastructure Engineering
  • Solid experience with GCP or AWS (hybrid/on-prem a plus)
  • Experience with Kubernetes cluster management (GPU experience a bonus)
  • Hands-on with Terraform and CI/CD (GitHub)
  • Experience with monitoring/observability (Grafana, etc.)
  • Strong understanding of high availability and infrastructure reliability
  • Familiarity with platform/cluster architecture and administration
  • Security mindset and ability to apply best practice
Nice-to-Have:
  • Startup experience (you enjoy building, not just maintaining)
  • Experience with scalable GPU infrastructure for AI/ML
Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Site Reliability Engineer
Site Reliability Engineer

Veritas Search Group • Tustin (CA)

On-site
USD 140,000 - 190,000
Site Reliability Engineer
Site Reliability Engineer

Harvey Nash • United States

Remote
USD 120,000 - 150,000
Site Reliability Engineer
Site Reliability Engineer

Latent • San Francisco (CA)

On-site
USD 140,000 - 200,000
Site Reliability Engineer
Site Reliability Engineer

Compunnel, Inc. • New Jersey

On-site
USD 120,000 - 150,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

The Recruiting Guy • Arlington (VA)

On-site
USD 175,000 - 250,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

The Recruiting Guy • San Francisco (CA)

On-site
USD 175,000 - 250,000
Infra Engineer - SRE(Kubernetes)
Infra Engineer - SRE(Kubernetes)

GMI Cloud • United States

On-site
USD 100,000 - 130,000
Site Reliability Engineer
Site Reliability Engineer

TalentDome Staffing • United States

On-site
USD 140,000 - 210,000
Site Reliability Engineer Lead
Site Reliability Engineer Lead

Good co India • United States

Remote
USD 120,000 - 160,000
Site Reliability Engineer
Site Reliability Engineer

Request Technology, LLC • Chicago (IL)

On-site
USD 150,000 - 155,000