Site Reliability Engineer

Mumba Technologies, Inc.

Gurugram District

Hybrid

INR 1,500,000 - 2,100,000

Full time

15 hours ago
Be an early applicant
Application generator

Get a reply from this employer — a resume and cover letter tailored to exactly what they’re hiring for.

Get past ATS filters

Job summary

Mumba Technologies, Inc. is seeking a Senior Site Reliability Engineer (SRE) in Gurgaon (Hybrid) to drive reliability, observability, automation, and cloud-native platform engineering.

The role emphasizes hands-on work with AWS, Kubernetes, Terraform, monitoring and incident management, and AEM environments, with on-call rotations and cross-functional collaboration.

Qualifications

  • 5–10 years of experience in SRE/DevOps/Cloud/Platform Engineering.
  • Strong AWS and Kubernetes experience.
  • Hands-on Terraform experience.
  • Strong knowledge of observability, monitoring, alerting, SLO/SLI, and incident management.
  • Experience with AEM Administration (Author/Publish/Dispatcher).
  • Experience with CDN technologies, preferably Cloudflare.

Responsibilities

  • Lead production incidents, RCA, problem management, and reliability improvements.
  • Build and maintain observability using Prometheus, Grafana, Dynatrace, Datadog, OpenTelemetry or similar tools.
  • Develop actionable alerting, dashboards, distributed tracing, and performance monitoring.
  • Drive automation and toil reduction across production operations.
  • Design and manage highly available AWS infrastructure using Terraform/Pulumi.
  • Manage Kubernetes clusters, including upgrades, autoscaling, networking, and resource optimization.
  • Drive cloud cost optimization, capacity planning, and infrastructure reliability.
  • Manage reliability and availability of AEM environments across Author, Publish, Dispatcher, and AEM as a Cloud Service.
  • Troubleshoot AEM performance issues and monitor health across Dev/QA/Prod.
  • Apply AIOps/AI-assisted tools for anomaly detection, incident triage, RCA, and automation.
  • Mentor junior and mid-level engineers and establish SRE best practices.
  • Participate in architecture reviews, on‑call rotations, and cross‑functional engineering initiatives.

Skills

Incident management
Observability
Automation
Cloud engineering
On-call rotations
Stakeholder management
SRE best practices

Tools

AWS
Kubernetes
Terraform
Prometheus
Grafana
Dynatrace
Datadog
OpenTelemetry
AEM Administration
Cloudflare CDN
CI/CD
DevSecOps

Job description

Job Title: Site Reliability Engineer (SRE)

Job Type: Full Time

Location: Gurgaon (Hybrid)

Job Summary

We are looking for a Senior Site Reliability Engineer (SRE) with 5–10 years of experience to drive reliability, observability, automation, and cloud-native platform engineering. The ideal candidate will have strong hands‑on experience with AWS, Kubernetes, Terraform, monitoring/observability, incident management, and AEM environments.

Key Responsibilities
Reliability & Observability
  • Lead production incidents, RCA, problem management, and reliability improvements.
  • Build and maintain observability using Prometheus, Grafana, Dynatrace, Datadog, OpenTelemetry or similar tools.
  • Develop actionable alerting, dashboards, distributed tracing, and performance monitoring.
  • Drive automation and toil reduction across production operations.
  • Design and manage highly available AWS infrastructure using Terraform/Pulumi.
  • Manage Kubernetes clusters, including upgrades, autoscaling, networking, and resource optimization.
  • Drive cloud cost optimization, capacity planning, and infrastructure reliability.
AEM Administration
  • Manage reliability and availability of Adobe Experience Manager (AEM) environments across Author, Publish, Dispatcher, and AEM as a Cloud Service.
  • Troubleshoot AEM performance, replication queues, OSGi configurations, DAM, and Dispatcher issues.
  • Monitor AEM application and infrastructure health across Dev, QA, and Production.
AI & Automation
  • Apply AIOps/AI-assisted tools for anomaly detection, incident triage, RCA, and operational automation.
  • Leverage LLM-based solutions to improve troubleshooting and reduce MTTR.
Security
  • Support vulnerability remediation across OS, containers, dependencies, and cloud infrastructure.
  • Integrate SAST, DAST, and SCA practices into CI/CD pipelines.
  • Mentor junior and mid-level engineers and establish SRE best practices.
  • Participate in architecture reviews, on‑call rotations, and cross‑functional engineering initiatives.
  • Partner with development, security, and product teams to improve overall platform reliability.
Required Skills
  • 5–10 years of experience in SRE, DevOps, Cloud Engineering, or Platform Engineering.
  • Strong AWS and Kubernetes experience.
  • Hands‑on Terraform experience.
  • Strong knowledge of observability, monitoring, alerting, SLO/SLI, and incident management.
  • Experience with AEM Administration, including Author/Publish/Dispatcher.
  • Experience with CDN technologies, preferably Cloudflare.
  • Strong Linux, scripting, troubleshooting, and automation skills.
  • Experience with CI/CD and DevSecOps practices.
  • Strong communication, problem‑solving, and stakeholder‑management skills.
Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Site Reliability Engineer
Site Reliability Engineer

SourcingXPress • Maharashtra

On-site
INR 700,000 - 1,800,000
Site Reliability Engineer
Site Reliability Engineer

Acesoft Labs • Hyderabad

On-site
INR 1,800,000 - 3,000,000
Site Reliability Engineer
Site Reliability Engineer

Acesoft Labs • Ahmedabad District

Hybrid
INR 400,000 - 700,000
Senior Site Reliability Engineer - Cloud Infrastructure
Senior Site Reliability Engineer - Cloud Infrastructure

WITS Innovation Lab • Chandigarh

On-site
INR 1,800,000 - 3,000,000
Site Reliability Engineer
Site Reliability Engineer

SourcingXPress • Mumbai

On-site
INR 800,000 - 1,200,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

Hilabs • Bengaluru

On-site
INR 2,200,000 - 3,500,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

VMC Soft Technologies, Inc • Hyderabad

On-site
INR 1,500,000 - 2,000,000
Software Engineer
Software Engineer

PwC • Hyderabad, Bengaluru

Hybrid
INR 2,800,000 - 5,200,000
Tech & Digital-Lead Site Reliability Engineer
Tech & Digital-Lead Site Reliability Engineer

Hdfc Bank • Bengaluru

On-site
INR 3,500,000 - 5,500,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

AcquireX • Pune District

On-site
INR 1,200,000 - 1,800,000
Health insurance
Flexible working hours
Training opportunities