Kubernetes Platform SRE – AWS, Istio & Automation

Okta

Bellevue (KY)

On-site

USD 194,000 - 267,000

Full time

14 days+
Application generator

A complete application in a minute — tailored resume and cover letter, ready to send.

Get past ATS filters

Job summary

Okta’s Workforce Identity Cloud team seeks a Site Reliability Engineer to design and manage Kubernetes platforms on AWS, with emphasis on high availability, cost optimization, and automation. You’ll work on Helm charts, Karpenter scaling, Istio service mesh, and CI/CD pipelines, ensuring secure, observable, production-grade infrastructure.

You will contribute to incident response, performance tuning, and secure cloud design while collaborating across teams to deliver scalable identity services

Qualifications

  • 4+ years of Kubernetes/Helm experience.
  • 4+ years of Terraform experience.
  • 5+ years of AWS experience.
  • Experience with multi-region cloud environments.
  • Proven AWS expertise (EC2, RDS, S3, CloudFormation, IAM, etc.).
  • Strong Kubernetes platform creation, management, and optimization experience.
  • Hands-on Helm experience for Kubernetes deployments.
  • Practical Karpenter experience for dynamic scaling and Istio management.
  • Proficiency with CI/CD tools (Jenkins, GitLab, CircleCI, Terraform, Ansible, Spinnaker) and scripting (Python, Bash, Go).
  • Experience with monitoring/logging: Prometheus, Grafana, CloudWatch, ELK.

Responsibilities

  • Kubernetes Platform Creation: design, implement, and maintain highly available, scalable, and fault-tolerant clusters.
  • AWS Infrastructure Management: build, optimize and secure cloud resources (EC2, RDS, S3, VPCs, IAM).
  • Helm Management: automate deployments with Helm charts for production readiness.
  • Karpenter Implementation: dynamically scale clusters to match workload demand.
  • Istio Service Mesh Management: configure service mesh for secure, observable traffic management.
  • Platform Automation & Scaling: automate deployment and scaling with CI/CD integration and minimal downtime.
  • Incident Management & Troubleshooting: diagnose and resolve performance, availability, and security issues.
  • Security & Compliance: enforce cloud security controls and compliance frameworks.
  • Documentation & Knowledge Sharing: maintain runbooks and best practices across teams.

Skills

Kubernetes
Helm
AWS
Terraform
CI/CD
Istio
Karpenter
Python Bash Go
Prometheus Grafana

Education

Bachelor's degree

Tools

Jenkins
GitLab
CircleCI
Ansible
Spinnaker
Terraform
Docker
CloudWatch

Job description

Okta’s Workforce Identity Cloud team seeks a Site Reliability Engineer to design and manage Kubernetes platforms on AWS, with emphasis on high availability, cost optimization, and automation. You’ll work on Helm charts, Karpenter scaling, Istio service mesh, and CI/CD pipelines, ensuring secure, observable, production-grade infrastructure.

You will contribute to incident response, performance tuning, and secure cloud design while collaborating across teams to deliver scalable identity services

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Kubernetes Platform SRE — AWS, Istio & Automation
Kubernetes Platform SRE — AWS, Istio & Automation

Okta • San Francisco (CA)

On-site
USD 194,000 - 267,000
Kubernetes Platform SRE — AWS, Istio & Automation
Kubernetes Platform SRE — AWS, Istio & Automation

Okta • Chicago (IL)

On-site
USD 174,000 - 239,000
Kubernetes Platform SRE | AWS, Istio & Automation
Kubernetes Platform SRE | AWS, Istio & Automation

Okta • Washington

On-site
USD 194,000 - 267,000
Equity
Bonus
Health insurance
+5
Kubernetes Platform SRE — AWS, Istio, Auto-Scaling
Kubernetes Platform SRE — AWS, Istio, Auto-Scaling

Okta • New York (NY)

On-site
USD 140,000 - 190,000
Senior Kubernetes SRE — Cloud-Native Platform Architect
Senior Kubernetes SRE — Cloud-Native Platform Architect

Okta Inc. • San Francisco (CA)

Hybrid
USD 194,000 - 267,000
Health, dental, vision
401(k)
Paid leave
+1
Kubernetes SRE — Cloud Platform Reliability & Automation
Kubernetes SRE — Cloud Platform Reliability & Automation

Okta • Chicago (IL)

On-site
USD 174,000 - 214,000
Equity
Health insurance
Paid leave
+2
Staff Site Reliability Engineer - Kubernetes
Staff Site Reliability Engineer - Kubernetes

Okta • New York (NY)

On-site
USD 140,000 - 190,000
Staff Site Reliability Engineer - Kubernetes
Staff Site Reliability Engineer - Kubernetes

Segment (Twilio) • Chicago (IL), New York (NY), Bellevue (WA)

On-site
USD 174,000 - 214,000
Equity
Health insurance
Paid leave
+2
Remote Kubernetes SRE — Automation & Cloud Reliability
Remote Kubernetes SRE — Automation & Cloud Reliability

Eitacies Inc • Santa Clara (CA)

Remote
USD 110,000 - 160,000
Senior SRE: Build Resilient AWS/Kubernetes Infrastructure
Senior SRE: Build Resilient AWS/Kubernetes Infrastructure

Kontakt.io • United States

On-site
USD 150,000 - 190,000