Site Reliability Engineer

PwC India

Bengaluru

On-site

INR 1,500,000 - 2,500,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

A leading global consulting firm is seeking an Azure Site Reliability Engineer (SRE) to enhance reliability across critical workloads. This role involves designing secure and efficient Azure platforms with a strong automation focus. Key responsibilities include managing SLIs/SLOs, conducting incident responses, and implementing CI/CD pipelines. Ideal candidates should have extensive experience in Azure SRE and automation tools. This position offers opportunities for continuous improvement and engagement in strategic project engagements.

Qualifications

  • 5+ years of overall IT experience, with 3+ years in Azure SRE.
  • Experience with AKS operations and container security.
  • Knowledge of DR/Backup services like ASR and Azure Backup.

Responsibilities

  • Define SLIs/SLOs and manage reliability risks.
  • Lead incident response and run chaos drills.
  • Implement CI/CD pipelines and automate processes.
  • Build observability tools using Azure Monitor and Grafana.

Skills

Azure Site Reliability Engineering
Automation
CI/CD
Security & Compliance
Monitoring

Tools

Azure DevOps
Terraform
PowerShell
Python

Job description

Job Description – Azure Site Reliability Engineer (SRE)

Role Title Azure Site Reliability Engineer (SRE)

Role Summary We are hiring Azure SREs to engineer reliability at scale across mission-critical workloads in a regulated environment. You will design and operate highly available, secure, and cost-efficient Azure platforms with a Terraform-first approach, strong automation, and deep observability. The role includes on-call, incident management, and continuous improvement to reduce toil and improve SLAs/SLOs.

Key Responsibilities
SRE Foundations
  • Define SLIs/SLOs, manage error budgets, and gate releases based on reliability risk.
  • Lead on-call rotations, major incident response, and blameless postmortems with action tracking.
  • Run game days, chaos/resilience drills, and drive toil reduction via automation.
  • Build CAF-aligned Landing Zones (hub-spoke/Virtual WAN), enforce Azure Policy as Code, tagging, and RBAC/PIM models.
  • Engineer secure network topologies: Private Link/Endpoints, Azure Firewall/WAF, DDoS, ExpressRoute, Private DNS.
Infrastructure as Code & Automation
  • Implement CI/CD with Azure DevOps/GitHub Actions; automate with PowerShell, Azure CLI, Python.
  • Use Key Vault & workload identity for secretless pipelines; enforce PR reviews and plan/apply gates.
  • Enforce Network Policies, Pod Security, admission control (OPA/Gatekeeper); secure secrets and images.
  • GitOps (Flux/ArgoCD), hardened ACR, image provenance and supply chain controls.
Observability & AIOps
  • Build full-stack monitoring with Azure Monitor, Log Analytics, Application Insights, Prometheus/Grafana.
  • Create KQL dashboards/alerts, enable synthetic monitoring, and correlate traces with OpenTelemetry.
  • Reduce MTTR using automated runbooks (Functions/Logic Apps/Automation) and optimize log/metrics cost.
Resilience, DR & Backup
  • Architect HA/DR using Azure Site Recovery (ASR) and region pairs; define & test RTO/RPO.
  • Operate Azure Backup with immutability/soft delete; enable Key Vault purge protection.
  • Conduct periodic failover/restore drills with evidence and remediation follow-ups.
Security & Compliance
  • Implement Zero Trust with Entra ID (RBAC, PIM, Conditional Access), Managed Identities, and least-privilege.
  • Enforce baselines with Defender for Cloud; integrate Microsoft Sentinel detections and SOAR playbooks.
  • Support audits with change control, evidence, and segregation of duties.
Cost & Capacity (FinOps)
  • Set budgets & alerts, rightsizing, reservations/savings plans, storage tiering.
  • Optimize observability/storage retention and data flows for cost efficiency.
Required Qualifications
  • 5+ years of overall IT industry experience with at least 3+ years of hands on expertise in Azure Site Reliability Engineering.
  • AKS operations and container security fundamentals.
  • DR/Backup expertise: ASR, Azure Backup, RTO/RPO planning and test execution.
  • Identity & security: Entra ID, RBAC/PIM, Key Vault, Defender for Cloud.
Nice to Have
  • Microsoft Sentinel (detections, hunting, SOAR runbooks).
  • Chaos Studio, performance/load testing, progressive delivery (Blue/Green, Canary, feature flags).
  • FinOps practices and cost optimization playbooks.
Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Senior Site Reliability Engineer (Azure) - S
Senior Site Reliability Engineer (Azure) - S

Tata Consultancy Services • Kolkata District, Chennai District, Bengaluru

On-site
INR 2,400,000 - 4,200,000
Site Reliability Engineer (SRE)
Site Reliability Engineer (SRE)

Zorba AI • Chennai District

On-site
INR 1,200,000 - 2,400,000
Site Reliability Engineer (Azure) - S
Site Reliability Engineer (Azure) - S

Tata Consultancy Services • Bengaluru

On-site
INR 2,500,000 - 4,500,000
Azure Site Reliability Engineer (SRE) - SaaS Operations
Azure Site Reliability Engineer (SRE) - SaaS Operations

Zensar • Pune District, Bengaluru

Hybrid
INR 1,800,000 - 2,400,000
SRE - AWS, GCP & Azure
SRE - AWS, GCP & Azure

PibyThree • Thane

On-site
INR 1,200,000 - 1,500,000
SRE - AWS, GCP & Azure
SRE - AWS, GCP & Azure

PibyThree • Navi Mumbai

On-site
INR 1,200,000 - 1,800,000
Senior Cloud Site Reliability Engineer
Senior Cloud Site Reliability Engineer

Augusta Infotech • Bengaluru

Hybrid
INR 1,500,000 - 2,500,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

ACG World • Mumbai

On-site
INR 2,200,000 - 3,200,000
SRE Engineer
SRE Engineer

Prodapt Solutions Private Limited • Chennai District

On-site
INR 1,800,000 - 3,000,000
Site Reliability Engineer
Site Reliability Engineer

MishiPay • Bengaluru

On-site
INR 2,500,000 - 3,800,000