Kubernetes Platform SRE – Cloud Infra & Automation

Okta

Bellevue (WA)

On-site

USD 174,000 - 214,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

Okta seeks a Site Reliability Engineer to design and manage Kubernetes-based platforms on AWS. You will ensure high availability, scalable performance, and cost optimization while automating deployments and scaling through Helm, Karpenter, and Istio.

The role emphasizes incident response, security, and CI/CD automation with Terraform, Jenkins, and GitLab. Collaboration across teams and hands-on cloud-native expertise are essential.

Qualifications

  • 4+ years of Kubernetes/Helm experience.
  • 4+ years of Terraform experience.
  • 5+ years of AWS experience.
  • Experience in multi-region cloud environments.
  • Solid AWS services knowledge (EC2, RDS, S3, CloudFormation, IAM).
  • Strong Kubernetes platform creation and management skills.
  • Hands-on Helm deployment experience.
  • Karpenter for dynamic scaling and Istio for service mesh management.
  • CI/CD automation tooling proficiency.
  • Scripting in Python, Bash, or Go for infrastructure tasks.
  • Monitoring/logging with Prometheus, Grafana, CloudWatch, ELK.

Responsibilities

  • Design, implement, and maintain highly available Kubernetes platforms.
  • Manage AWS infrastructure including EKS, ECS, S3, VPCs, RDS, IAM with cost and security in mind.
  • Automate deployments with Helm charts for production workflows.
  • Implement and manage Karpenter for dynamic scaling.
  • Configure Istio for secure, observable service mesh operations.
  • Automate deployment and scaling with CI/CD pipelines and tooling.
  • Respond to incidents and troubleshoot performance, availability, and security issues.
  • Design secure cloud infrastructure with proper access controls and compliance.
  • Document platform setup and best practices, share knowledge across teams.

Skills

Kubernetes
Helm
AWS
Terraform
Multi-region cloud
Istio
Karpenter
CI/CD
Python/Bash/Go scripting
Monitoring/Logging

Education

Bachelor's degree in Computer Science or Engineering

Tools

Jenkins
GitLab
CircleCI
Spinnaker
Ansible

Job description

Okta seeks a Site Reliability Engineer to design and manage Kubernetes-based platforms on AWS. You will ensure high availability, scalable performance, and cost optimization while automating deployments and scaling through Helm, Karpenter, and Istio.

The role emphasizes incident response, security, and CI/CD automation with Terraform, Jenkins, and GitLab. Collaboration across teams and hands-on cloud-native expertise are essential.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Kubernetes Platform SRE — AWS, Istio, Auto-Scaling
Kubernetes Platform SRE — AWS, Istio, Auto-Scaling

Okta • New York (NY)

On-site
USD 140,000 - 190,000
Kubernetes SRE — Cloud Platform Reliability & Automation
Kubernetes SRE — Cloud Platform Reliability & Automation

Okta • Chicago (IL)

On-site
USD 174,000 - 214,000
Equity
Health insurance
Paid leave
+2
Senior Cloud SRE: Secure, Scalable Infra & Automation
Senior Cloud SRE: Secure, Scalable Infra & Automation

Okta • Bellevue (WA)

On-site
USD 147,000 - 202,000
Amazing Benefits
Making Social Impact
Fostering Diversity, Equity, Inclusion
Senior Cloud SRE - Automation, Security & Scale
Senior Cloud SRE - Automation, Security & Scale

Socket.dev • Bellevue (WA)

On-site
USD 147,000 - 202,000
Amazing Benefits
Social Impact
Diversity, Equity, Inclusion and Belon
+1
Kubernetes SRE Lead: Scalable Cloud Platform on AWS
Kubernetes SRE Lead: Scalable Cloud Platform on AWS

Okta • Bellevue (WA)

Hybrid
USD 174,000 - 214,000
Health, dental, and vision insurance
401(k) plan
Paid leave, including parental leave
Senior Cloud SRE: Automation, Security & Scale
Senior Cloud SRE: Automation, Security & Scale

Okta • San Francisco (CA)

On-site
USD 165,000 - 226,000
Amazing Benefits
Making Social Impact
Fostering Diversity, Equity, Inclusion
Senior Identity Infra SRE: Reliability & Automation
Senior Identity Infra SRE: Reliability & Automation

Okta • San Francisco (CA)

On-site
USD 194,000 - 267,000
Senior Cloud SRE: Edge Infra, Automation & Reliability
Senior Cloud SRE: Edge Infra, Automation & Reliability

Okta • Bellevue (WA)

On-site
USD 194,000 - 267,000
Senior Cloud SRE: Automation, Terraform & On-Call Ownership
Senior Cloud SRE: Automation, Terraform & On-Call Ownership

Okta • Washington

On-site
USD 174,000 - 239,000
Equity
Bonus
Health insurance
+6
Site Reliability Engineer
Site Reliability Engineer

NextGen | GTA: A Kelly Telecom Company • Mount Laurel Township (NJ)

On-site
USD 110,000 - 170,000