Hybrid Site Reliability Engineer: AKS Observability Lead

Unlimited Systems

Cincinnati (OH)

Hybrid

USD 120,000 - 160,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

Unlimited Systems is seeking a Site Reliability Engineer to own the observability strategy for our AKS-based production systems in Cincinnati, Ohio. You will define SLOs/SLIs, partner with DevOps and software engineering, and drive reliability as a first‑class concern to keep our services healthy and scalable.

You will build tooling and dashboards, refine incident response processes, and contribute to security reviews as we grow our cloud-native platform.

Qualifications

  • 5+ years in SRE/DevOps/Platform Engineering in production cloud.
  • Hands-on AKS: provisioning, upgrades, CNI, lifecycle management.
  • Splunk SPL authoring, dashboards, alerting, data onboarding.
  • Azure Monitor, Log Analytics, Application Insights proficiency.
  • IaC with Terraform; Helm and Kustomize familiarity.
  • Scripting in Python/Go/Bash.
  • Drive incident resolution and post-mortems.
  • Translate complex topics for non-technical stakeholders.

Responsibilities

  • Own the observability strategy for AKS-based production systems.
  • Define and drive meaningful SLOs and SLIs.
  • Collaborate with DevOps and software engineering to improve reliability.
  • Build internal tooling to reduce toil and accelerate incident response.
  • Participate in security reviews and threat modeling for platform capabilities.

Skills

AKS experience
Splunk SPL
Instana APM
Azure Monitor & Log Analytics
Terraform
Helm & Kustomize
Python/Go/Bash
Incident response
Clear communication

Tools

Terraform
Helm
Kustomize

Job description

Unlimited Systems is seeking a Site Reliability Engineer to own the observability strategy for our AKS-based production systems in Cincinnati, Ohio. You will define SLOs/SLIs, partner with DevOps and software engineering, and drive reliability as a first‑class concern to keep our services healthy and scalable.

You will build tooling and dashboards, refine incident response processes, and contribute to security reviews as we grow our cloud-native platform.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Site Reliability Engineer (Hybrid)
Site Reliability Engineer (Hybrid)

Unlimited Systems • Cincinnati (OH)

Hybrid
USD 120,000 - 160,000
Site Reliability Engineer
Site Reliability Engineer

Shya Workforce Solutions • Town of Florida (NY)

On-site
USD 100,000 - 140,000
Lead SRE - Build End-to-End Observability
Lead SRE - Build End-to-End Observability

TrulyHired • Atlanta (GA)

On-site
USD 140,000 - 190,000
Medical insurance
401k match
PTO
Senior Observability Engineer: Build Reliability & Dashboards
Senior Observability Engineer: Build Reliability & Dashboards

Ripple • New York (NY)

On-site
USD 160,000 - 200,000
Senior Site Reliability Engineer: Scalable Infra & Observability
Senior Site Reliability Engineer: Scalable Infra & Observability

Early Warning • Chicago (IL)

Hybrid
USD 106,000 - 130,000
Healthcare Coverage
401(k) Matching
Paid Time Off
+1
Sr. Site Reliability Engineer
Sr. Site Reliability Engineer

Mike Albert Fleet Solutions • Cincinnati (OH)

Hybrid
USD 100,000 - 135,000
Site Reliability Engineer – Observability, Kubernetes & Cloud
Site Reliability Engineer – Observability, Kubernetes & Cloud

Shya Workforce Solutions • Town of Florida (NY)

On-site
USD 100,000 - 140,000
Senior Site Reliability Engineer - Azure & Observability
Senior Site Reliability Engineer - Azure & Observability

Luxoft • United States

On-site
USD 140,000 - 180,000
Remote Site Reliability Engineer: Kubernetes & Observability
Remote Site Reliability Engineer: Kubernetes & Observability

ApplyMint • New Jersey

Remote
USD 100,000 - 150,000
Competitive base salary
Full-time W2 employment
In-house SOW
Sr. Site Reliability Engineer
Sr. Site Reliability Engineer

MeridianLink • United States

Remote
USD 140,000 - 190,000