Senior SRE: Scale a Global SaaS Platform

Kong

Washington (Washington County)

On-site

USD 140,000 - 200,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Benefits offered by this job

Datadog observability
Prometheus/Grafana/Thanos stack
ArgoCD-managed CI/CD

Job summary

Kong Inc. seeks a Site Reliability Engineer to join the global Platform SRE team. You will build, operate, and scale Kong's multi-region SaaS platform across AWS, GCP, and Azure, focusing on reliability, scalability, and security.

You will automate production systems, run Kubernetes clusters, and own deployment pipelines. Collaboration with security and development teams will ensure compliant, resilient SaaS services in a 24/7 environment.

Qualifications

  • BS in Computer Science or equivalent practical experience.
  • Experience managing SaaS/PaaS at enterprise scale (multi-region & secure environments).
  • Deep Kubernetes expertise including fault tolerance and scalability.
  • Strong IaC skills with Terraform or Terragrunt.
  • Proficiency with CI/CD pipelines and GitOps (ArgoCD, Helm).
  • Programming ability in Go, Python, or Bash for automation.
  • Solid Linux/Unix and networking knowledge.
  • Experience with API gateway and service mesh tech.
  • Familiarity with streaming and observability tools.

Responsibilities

  • Operate and scale Kong's global SaaS platform with reliability and performance.
  • Build and maintain Kubernetes-based infrastructure and deployment workflows.
  • Design and optimize multi-region data/caching layers (PostgreSQL, Redis, ClickHouse, Druid).
  • Manage Kong Gateway and Kong Mesh environments for hybrid/distributed architectures.
  • Develop and maintain CI/CD pipelines and GitOps workflows.
  • Improve observability and incident response with Datadog/Prometheus/Grafana/Thanos.
  • Collaborate with development and security teams for compliant operations.
  • Participate in 24/7 on-call rotation and improve runbooks/postmortems.
  • Lead scaling initiatives for elasticity, reliability, and cost-efficiency.

Skills

Kubernetes
Terraform
CI/CD
Go/Python/Bash
Linux/Unix
Observability
24/7 production support
API gateway

Education

BS in Computer Science

Tools

Terraform
Terragrunt
ArgoCD
Helm
Datadog
Prometheus
Grafana
Thanos

Job description

Kong Inc. seeks a Site Reliability Engineer to join the global Platform SRE team. You will build, operate, and scale Kong's multi-region SaaS platform across AWS, GCP, and Azure, focusing on reliability, scalability, and security.

You will automate production systems, run Kubernetes clusters, and own deployment pipelines. Collaboration with security and development teams will ensure compliant, resilient SaaS services in a 24/7 environment.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Senior Site Reliability Engineer - SaaS & Multi-Region
Senior Site Reliability Engineer - SaaS & Multi-Region

Cacheflow • Washington

On-site
USD 140,000 - 210,000
Senior SRE, Managed Gateways - Cloud-Native Reliability
Senior SRE, Managed Gateways - Cloud-Native Reliability

Cacheflow • Washington

On-site
USD 190,000 - 230,000
Senior Site Reliability Engineer - Managed Gateways
Senior Site Reliability Engineer - Managed Gateways

Kong • United States

Remote
USD 190,000 - 230,000
Senior SRE, Managed Gateways
Senior SRE, Managed Gateways

Cacheflow • Washington

On-site
USD 190,000 - 230,000
Senior SRE: Scale Reliability with Kubernetes on AWS
Senior SRE: Scale Reliability with Kubernetes on AWS

Fountain • San Francisco (CA)

On-site
USD 150,000 - 190,000
Flexible vacation policy
Paid holidays
Monthly lunch stipend
+6
Senior Site Reliability Engineer, Kong Konnect
Senior Site Reliability Engineer, Kong Konnect

Kong • Washington

On-site
USD 140,000 - 200,000
Datadog observability
Prometheus/Grafana/Thanos stack
ArgoCD-managed CI/CD
Senior Site Reliability Engineer, Kong Konnect
Senior Site Reliability Engineer, Kong Konnect

Cacheflow • Washington

On-site
USD 140,000 - 210,000
Senior SRE: Scale, Reliability & Platform Observability
Senior SRE: Scale, Reliability & Platform Observability

Sanity • United States

On-site
USD 140,000 - 200,000
Competitive stock options program
Comprehensive health plans
Flexible, trust-based environment
+1
Senior SRE — Scale Reliability for Healthcare Data Platform
Senior SRE — Scale Reliability for Healthcare Data Platform

CertifyOS • United States

On-site
USD 120,000 - 170,000
Senior Software Engineering Manager, Managed Gateways SREs
Senior Software Engineering Manager, Managed Gateways SREs

Kong • United States

On-site
USD 128,000 - 165,000