Senior Observability & SRE Engineer — GCP/Kubernetes

Ontrac Solutions

United States

On-site

USD 120,000 - 180,000

Full time

14 days+
Application generator

Don’t send a generic resume — generate a resume and cover letter tailored to this exact role.

Get past ATS filters

Job summary

Ontrac Solutions is seeking an experienced Observability / Site Reliability Engineer (SRE) to design, scale, and maintain our enterprise monitoring and alerting ecosystems across multi-cloud environments. You will bridge development and operations by ensuring high availability, performance tuning, and deep visibility.

Responsibilities include architecting observability stacks with Grafana/Prometheus, managing GCP resources, implementing automation with Terraform and Ansible, and integrating

Qualifications

  • Experience building and maintaining cloud monitoring and compute resources in Google Cloud Platform (GCP).
  • Hands-on experience with Grafana and Prometheus for observability.
  • Strong Linux/Unix administration and scripting skills for automation.
  • Proficiency in at least one modern programming language (Python, Go, Java, or Shell).

Responsibilities

  • Architect, scale and maintain observability stacks across multi-cloud environments.
  • Ensure high availability and performance through tuning and monitoring.
  • Automate infrastructure with IaC tools (Terraform, Ansible).
  • Integrate CI/CD workflows in Kubernetes, GKE, or OpenShift environments.
  • Collaborate with development and operations to improve reliability (SLIs/SLOs).
  • Lead best-practice adoption of SRE principles and incident response.

Skills

GCP experience
Observability
Linux/Unix
Scripting
Programming

Tools

Grafana
Prometheus
GKE
OpenShift
Terraform
Ansible
Kubernetes
Google Cloud Platform

Job description

Ontrac Solutions is seeking an experienced Observability / Site Reliability Engineer (SRE) to design, scale, and maintain our enterprise monitoring and alerting ecosystems across multi-cloud environments. You will bridge development and operations by ensuring high availability, performance tuning, and deep visibility.

Responsibilities include architecting observability stacks with Grafana/Prometheus, managing GCP resources, implementing automation with Terraform and Ansible, and integrating

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Senior Observability & SRE Engineer (GCP/Kubernetes)
Senior Observability & SRE Engineer (GCP/Kubernetes)

Ontrac Solutions • New York (NY)

On-site
USD 120,000 - 190,000
Observability & SRE Engineer — Cloud, Kubernetes, & Automation
Observability & SRE Engineer — Cloud, Kubernetes, & Automation

Ontrac Solutions • Arizona

Hybrid
USD 140,000 - 190,000
Verification cost reimbursement
Observability Engineer / Site Reliability Engineer
Observability Engineer / Site Reliability Engineer

Ontrac Solutions • New York (NY)

On-site
USD 120,000 - 190,000
Observability Engineer Site Reliability Engineer
Observability Engineer Site Reliability Engineer

Ontrac Solutions • United States

On-site
USD 120,000 - 180,000
Observability Engineer Site Reliability Engineer
Observability Engineer Site Reliability Engineer

Ontrac Solutions • Arizona

Hybrid
USD 140,000 - 190,000
Verification cost reimbursement
GCP Observability SRE Lead: Terraform, Go & Grafana
GCP Observability SRE Lead: Terraform, Go & Grafana

Okta • Bellevue (WA)

On-site
USD 174,000 - 239,000
Health insurance
401(k)
Paid leave
+1
Senior Observability Architect & SRE Lead
Senior Observability Architect & SRE Lead

Ensono • United States

Hybrid
USD 140,000 - 180,000
Unlimited Paid Days Off
Three health plan options
401k with company match
+4
GCP SRE | Kubernetes & Cloud Reliability Engineer
GCP SRE | Kubernetes & Cloud Reliability Engineer

MSRcosmos LLC • Dallas (TX)

On-site
USD 120,000 - 180,000
Senior Site Reliability Engineer – Observability & Cloud
Senior Site Reliability Engineer – Observability & Cloud

Cosm Inc. • El Segundo (CA), Northern (KY)

Hybrid
USD 110,000 - 145,000
Lead Observability Engineer: GCP & OpenTelemetry
Lead Observability Engineer: GCP & OpenTelemetry

Scalence • Morristown (NJ)

On-site
USD 120,000 - 160,000