Senior Site Reliability Engineer

BookCabin

Jakarta Pusat

On-site

IDR 250,000,000 - 420,000,000

Full time

13 days ago

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

BookCabin in Jakarta Pusat is seeking an experienced Site Reliability/DevOps Engineer to design, build, and maintain scalable, secure infrastructure across AWS and Azure, and to manage Kubernetes clusters for reliability and uptime.

You will own CI/CD pipelines, implement observability with Prometheus, Grafana, Loki and Alertmanager, and drive infrastructure as code with Terraform and CloudFormation. Expect on‑call rotations and close collaboration with development teams.

Qualifications

  • 5+ years in Site Reliability, DevOps, or Cloud Engineering.
  • Hands-on with AWS and Azure services; containerized apps on Kubernetes.
  • Experience with CI/CD pipelines and multi-cloud workflows.
  • Strong observability using Prometheus, Grafana, Loki, Alertmanager.
  • Proficiency in IaC tools like Terraform or CloudFormation; scripting Bash/Python.

Responsibilities

  • Design, build, and maintain scalable, secure infrastructure across AWS and Azure.
  • Operate and troubleshoot Kubernetes clusters to ensure uptime.
  • Develop CI/CD pipelines and automate deployments.
  • Implement observability and incident response through monitoring tools.
  • Manage IaC with Terraform/CloudFormation and secure access controls.
  • Collaborate with development teams to embed reliability throughout the lifecycle.
  • Participate in on-call rotations and perform root-cause analyses.

Skills

SRE/DevOps experience
Cloud platforms (AWS/Azure)
Kubernetes

Tools

Kubernetes (EKS/AKS)
Docker
Terraform
CloudFormation
Prometheus
Grafana
Loki
Alertmanager

Job description

  • Design, build, and maintain scalable, reliable, and secure infrastructure across AWS (including Elastic Beanstalk) and Azure.
  • Develop and manage CI/CD pipelines using Azure DevOps, GitHub Actions, or similar tools to ensure smooth and automated deployments.
  • Operate, monitor, and troubleshoot Kubernetes clusters (EKS, AKS, or self-managed) to ensure system stability and uptime.
  • Implement comprehensive observability solutions using Prometheus, Grafana, Loki, and Alertmanager.
  • Automate infrastructure provisioning and configuration using Terraform, Helm, CloudFormation, and/or Ansible.
  • Define, measure, and improve system reliability through SLOs, SLIs, and SLAs.
  • Enhance system resilience and incident response through proactive monitoring and capacity planning.
  • Manage secrets, access control, and security policies to maintain a robust and compliant infrastructure.
  • Participate in on-call rotations, respond to incidents, and drive root cause analysis and post-incident reviews.
  • Collaborate closely with development teams to embed reliability and scalability best practices throughout the software lifecycle.
Requirements
  • 5+ years of experience in a Site Reliability, DevOps, or Cloud Engineering role.
  • Strong hands‑on experience with AWS (EC2, VPC, IAM, CloudWatch, Elastic Beanstalk, RDS, S3) and familiarity with Azure services.
  • Proven experience deploying and managing containerized applications using Kubernetes (EKS/AKS) and Docker.
  • Skilled in CI/CD pipeline development and multi-cloud workflows (Azure DevOps, GitHub Actions, etc.).
  • Solid understanding of observability tools such as Prometheus, Grafana, Loki, and Alertmanager.
  • Proficiency in infrastructure‑as‑code tools like Terraform, CloudFormation, or similar.
  • Scripting skills in Bash, Python, or PowerShell.
  • Strong grasp of networking, Linux systems, and cloud security best practices.
  • Excellent problem‑solving skills with a focus on performance, scalability, and reliability.
Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Senior Site Reliability Engineer
Senior Site Reliability Engineer

StraitsX • Indonesia

On-site
IDR 300,000,000 - 540,000,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

StraitsX • Kebayoran Baru

On-site
IDR 600,000,000 - 1,000,000,000
Site Reliability Engineer
Site Reliability Engineer

Macquarie Group • Indonesia

On-site
IDR 400,000,000 - 650,000,000
Site Reliability Engineer
Site Reliability Engineer

PARTECH PARTNERS • Daerah Khusus Ibukota Jakarta

On-site
IDR 272,380,000 - 453,968,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

Quiet Capital • Jakarta Pusat

On-site
IDR 350,000,000 - 700,000,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

StraitsX • Jakarta Pusat

On-site
IDR 600,000,000 - 840,000,000
Senior Site Reliability Engineer (SRE)
Senior Site Reliability Engineer (SRE)

AccelByte • Sleman

On-site
Lead DevOps Engineer
Lead DevOps Engineer

SG-EDTS • Jakarta Pusat

On-site
IDR 446,400,000 - 892,800,000
Senior Site Reliability Engineer (SRE)
Senior Site Reliability Engineer (SRE)

AccelByte • Kota Yogyakarta

On-site
IDR 2,144,389,000 - 3,216,583,000
Site Reliability Engineer / DevOps
Site Reliability Engineer / DevOps

Catalyst Tech • Daerah Khusus Ibukota Jakarta

On-site
IDR 720,720,000 - 1,081,082,000