Site Reliability Engineer

Mumba Technologies, Inc.

Gurugram District

Hybrid

INR 3,000,000 - 7,000,000

Full time

6 hours ago
Be an early applicant

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

Mumba Technologies, Inc. in Gurgaon is seeking a Senior Site Reliability Engineer (SRE) with 7–10 years of experience to drive reliability, observability, automation, and cloud-native platform engineering.

The ideal candidate will have strong hands-on experience with AWS, Kubernetes, Terraform, monitoring/observability, incident management, and AEM environments. You will lead production incidents, build observability dashboards, manage AWS infrastructure with Terraform/Pulumi, and mentor junior

Qualifications

  • 7–10 years of experience in SRE, DevOps, cloud engineering, or platform engineering.
  • Strong AWS and Kubernetes expertise with hands-on cloud infrastructure skills.
  • Deep knowledge of observability, monitoring, alerting, SLO/SLI, and incident management.
  • Experience with AEM Administration including Author/Publish/Dispatcher.
  • Familiarity with CDN technologies (Cloudflare preferred).
  • Proficient in Linux, scripting, troubleshooting, and automation.

Responsibilities

  • Lead production incidents, RCA, problem management, and reliability improvements.
  • Build and maintain observability using Prometheus, Grafana, Dynatrace, Datadog, OpenTelemetry.
  • Develop alerting, dashboards, tracing, and performance monitoring.
  • Drive automation and toil reduction across production operations.
  • Design and manage highly available AWS infrastructure using Terraform/Pulumi.
  • Manage Kubernetes clusters, including upgrades, autoscaling, networking, and optimization.
  • Drive cloud cost optimization, capacity planning, and reliability.
  • Apply AIOps/AI-assisted tools for anomaly detection and incident triage.
  • Mentor junior engineers and participate in architecture reviews and on-call rotations.

Skills

AWS
Kubernetes
Observability
Alerting & SLO/SLI
AEM Administration
CI/CD & DevSecOps
Automation & SRE tooling
Incident management
Terraform/Pulumi
Linux scripting

Job description

Job Title: Site Reliability Engineer (SRE)

Job Type: Full Time

Location: Gurgaon (Hybrid)

Job Summary

We are looking for a Senior Site Reliability Engineer (SRE) with 7–10 years of experience to drive reliability, observability, automation, and cloud-native platform engineering. The ideal candidate will have strong hands‑on experience with AWS, Kubernetes, Terraform, monitoring/observability, incident management, and AEM environments.

Key Responsibilities
Reliability & Observability
  • Lead production incidents, RCA, problem management, and reliability improvements.
  • Build and maintain observability using Prometheus, Grafana, Dynatrace, Datadog, OpenTelemetry or similar tools.
  • Develop actionable alerting, dashboards, distributed tracing, and performance monitoring.
  • Drive automation and toil reduction across production operations.
  • Design and manage highly available AWS infrastructure using Terraform/Pulumi.
  • Manage Kubernetes clusters, including upgrades, autoscaling, networking, and resource optimization.
  • Drive cloud cost optimization, capacity planning, and infrastructure reliability.
AEM Administration
  • Manage reliability and availability of Adobe Experience Manager (AEM) environments across Author, Publish, Dispatcher, and AEM as a Cloud Service.
  • Troubleshoot AEM performance, replication queues, OSGi configurations, DAM, and Dispatcher issues.
  • Monitor AEM application and infrastructure health across Dev, QA, and Production.
AI & Automation
  • Apply AIOps/AI-assisted tools for anomaly detection, incident triage, RCA, and operational automation.
  • Leverage LLM-based solutions to improve troubleshooting and reduce MTTR.
Security
  • Support vulnerability remediation across OS, containers, dependencies, and cloud infrastructure.
  • Integrate SAST, DAST, and SCA practices into CI/CD pipelines.
  • Mentor junior and mid-level engineers and establish SRE best practices.
  • Participate in architecture reviews, on-call rotations, and cross-functional engineering initiatives.
  • Partner with development, security, and product teams to improve overall platform reliability.
Required Skills
  • 7–10 years of experience in SRE, DevOps, Cloud Engineering, or Platform Engineering.
  • Strong AWS and Kubernetes experience.
  • Strong knowledge of observability, monitoring, alerting, SLO/SLI, and incident management.
  • Experience with AEM Administration, including Author/Publish/Dispatcher.
  • Experience with CDN technologies, preferably Cloudflare.
  • Strong Linux, scripting, troubleshooting, and automation skills.
  • Experience with CI/CD and DevSecOps practices.
  • Strong communication, problem-solving, and stakeholder-management skills.
Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Senior Site Reliability Engineer - Cloud Infrastructure
Senior Site Reliability Engineer - Cloud Infrastructure

WITS Innovation Lab • Chandigarh

On-site
INR 1,800,000 - 3,000,000
Site Reliability Engineer
Site Reliability Engineer

SourcingXPress • Maharashtra

On-site
INR 700,000 - 1,800,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

UST • Pune District

On-site
INR 1,800,000 - 3,000,000
Site Reliability Engineer (SRE) – Core IT Infrastructure
Site Reliability Engineer (SRE) – Core IT Infrastructure

TECEZE • Chennai District

On-site
INR 1,000,000 - 2,000,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

Falabella India • Bengaluru

On-site
INR 4,000,000 - 7,000,000
Site Reliability Engineer Lead
Site Reliability Engineer Lead

Hilabs • Pune District

On-site
INR 1,500,000 - 2,500,000
AWS Site Reliability Engineer (SRE)
AWS Site Reliability Engineer (SRE)

Zensar • Hyderabad, Pune District

Hybrid
INR 1,500,000 - 2,100,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

F-Prime Capital • Pune District

On-site
INR 1,500,000 - 2,000,000
Site Reliability Engineer
Site Reliability Engineer

Innodata Inc. • India

On-site
INR 2,400,000 - 4,000,000
Site Reliability Engineer
Site Reliability Engineer

Questhiring • Gurugram District

Hybrid
INR 1,200,000 - 1,800,000