Site Reliability Engineer Lead

Hilabs

Pune District

On-site

INR 1,500,000 - 2,500,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

Hilabs in Pune is seeking a Senior DevOps Engineer with 7-10 years of experience focused on Site Reliability Engineering (SRE). The role involves designing, automating, deploying, and monitoring cloud-native environments primarily in AWS while ensuring high availability and performance.

The ideal candidate will have strong hands-on skills in Kubernetes, managed CI/CD processes, and excel in a fast-paced engineering culture. Responsibilities also include optimizing infrastructure and managing production incidents effectively.

Qualifications

  • 7 to 10 years of DevOps / SRE experience.
  • Production-grade Kubernetes experience.
  • Experience with monitoring and logging tools.

Responsibilities

  • Design, deploy, and manage highly available cloud infrastructure on AWS.
  • Implement Infrastructure as Code using Terraform.
  • Manage production incidents and perform root cause analysis.

Skills

AWS expertise
Kubernetes
Terraform
Jenkins
CI/CD automation
Linux administration
Shell Scripting
Monitoring tools (e.g., ELK, Prometheus)

Tools

AWS CloudFormation
Git
Bitbucket
Docker

Job description

Job Title: Senior DevOps Engineer (SRE Focus)

Experience: 7 to 10 Years

Location: Pune Kharadi(Work from Office)

About the Role

We are looking for a highly skilled Senior DevOps Engineer with strong Site Reliability Engineering (SRE) experience to join our growing engineering team. The ideal candidate should have hands‑on expertise in AWS cloud infrastructure, Kubernetes, Infrastructure as Code, CI/CD automation, and production reliability engineering.

This role requires someone who can design, automate, deploy, monitor, and optimize large‑scale cloud-native environments while ensuring high availability, scalability, security, and operational excellence.

Key Responsibilities
  • Design, deploy, and manage highly available cloud infrastructure on AWS.
  • Build and maintain scalable Kubernetes environments.
  • Implement Infrastructure as Code using Terraform and CloudFormation.
  • Develop and manage CI/CD pipelines using Jenkins.
  • Drive automation across infrastructure provisioning, deployments, monitoring, and incident management.
  • Work closely with engineering teams to improve system reliability, performance, and scalability.
  • Manage production incidents, root cause analysis, and postmortems.
  • Implement monitoring, alerting, logging, and observability solutions.
  • Optimize cloud infrastructure for cost, security, and performance.
  • Support containerized applications and microservices architectures.
  • Maintain and improve deployment workflows using Git and Bitbucket.
  • Contribute to SRE best practices including SLIs, SLOs, and error budgets.
Mandatory Skills
  • 7 to 10 years of DevOps / SRE experience.
  • Strong hands‑on experience with AWS.
  • Production‑grade Kubernetes (K8s) experience.
  • Expertise in Terraform.
  • Experience with AWS CloudFormation.
  • Strong Jenkins pipeline creation and administration experience.
  • CI/CD implementation and automation expertise.
  • Linux administration and troubleshooting.
  • Shell Scripting, Bash, or Python.
  • Monitoring and logging tools such as ELK, Prometheus, Grafana, CloudWatch, etc.
  • Experience handling production environments and critical incidents.
Preferred Skills
  • Site Reliability Engineering (SRE) experience.
  • Bitbucket administration and pipeline integration.
  • Docker and containerization technologies.
  • Azure cloud exposure.
  • Security, compliance, and infrastructure governance experience.
  • Experience working in Agile environments.
Ideal Candidate Profile
  • Strong hands‑on engineer, not a people manager.
  • Experience supporting large‑scale production environments.
  • Proven expertise in reliability engineering and operational excellence.
  • Startup or product company experience preferred.
  • Excellent troubleshooting and problem‑solving skills.
  • Strong communication and stakeholder management abilities.
Nice to Have
  • AWS Certifications.
  • Kubernetes Certifications.
  • Azure exposure.
  • Experience in healthcare, fintech, SaaS, or product‑based organizations.
Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Senior Site Reliability Engineer
Senior Site Reliability Engineer

F-Prime Capital • Pune District

On-site
INR 1,500,000 - 2,000,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

AcquireX • Pune District

On-site
INR 1,200,000 - 1,800,000
Health insurance
Flexible working hours
Training opportunities
Senior Site Reliability Engineer
Senior Site Reliability Engineer

AcquireX • Maharashtra

On-site
INR 1,800,000 - 2,500,000
Site Reliability Engineer
Site Reliability Engineer

SourcingXPress • Mumbai

On-site
INR 800,000 - 1,200,000
Senior Site Reliability Engineer (SRE) / DevOps Engineer
Senior Site Reliability Engineer (SRE) / DevOps Engineer

Umanist Staffing LLC • Maharashtra

On-site
INR 3,500,000 - 5,500,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

VMC Soft Technologies, Inc • Hyderabad

Hybrid
INR 1,500,000 - 2,000,000
Site Reliability Engineer
Site Reliability Engineer

ScaleneWorks People Solutions LLP • Pune District

On-site
INR 3,500,000 - 5,500,000
Senior Site Reliability Engineer - Cloud Infrastructure
Senior Site Reliability Engineer - Cloud Infrastructure

WITS Innovation Lab • Chandigarh

On-site
INR 1,800,000 - 3,000,000
Site Reliability Engineer (SRE)
Site Reliability Engineer (SRE)

Tekskills • Pune District

Hybrid
INR 2,800,000 - 3,800,000
Site Reliability Engineer (SRE)
Site Reliability Engineer (SRE)

Tekskills • Bulandshahr

Hybrid
INR 1,800,000 - 2,400,000