SRE - Site Reliability Engineering

Build & Hire

Pune District

On-site

INR 1,500,000 - 2,300,000

Full time

13 days ago

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

Build & Hire in Pune, India is seeking an SRE Observability Engineer to design and implement end-to-end observability for cloud-native applications. You will build dashboards, define SLIs/SLOs, and collaborate with DevOps to improve reliability.

The role requires hands-on experience with Dynatrace, Grafana, Kibana, ELK, Splunk, and OpenTelemetry, plus cloud monitoring on AWS and/or Azure and Kubernetes.

Qualifications

  • Hands-on experience with modern observability platforms (Dynatrace, Grafana, Kibana, ELK)
  • Experience with Splunk and OpenTelemetry
  • Cloud monitoring experience on AWS and/or Azure
  • Strong understanding of distributed tracing and observability best practices
  • Experience monitoring Kubernetes-based apps and infra
  • Knowledge of SRE principles and incident management

Responsibilities

  • Design and implement end-to-end observability solutions using modern monitoring and logging platforms.
  • Define and monitor SLIs, SLOs, and KPIs to ensure system reliability.
  • Perform RCA, trend analysis, and support problem management initiatives.
  • Build dashboards, alerting rules, capacity reports, and anomaly detection mechanisms.
  • Analyze logs, metrics, and distributed traces to identify performance bottlenecks.
  • Identify monitoring gaps and enhance observability coverage across cloud-native apps.
  • Support load and performance testing activities.
  • Participate in Major Incident Management and ensure timely service recovery.
  • Collaborate with DevOps and Engineering teams to improve resilience, scalability, and operational excellence.
  • Develop and validate recovery plans while driving continuous reliability improvements.

Skills

Dynatrace
Grafana
Kibana
ELK Stack
OpenTelemetry
Splunk
AWS
Azure
Kubernetes monitoring
SRE principles
Incident management
Root Cause Analysis

Tools

Dynatrace
Grafana
Kibana
ELK Stack
Splunk
OpenTelemetry
AWS
Azure
Kubernetes

Job description

SRE Observability Engineer

We are currently hiring for an SRE Observability Engineer for a fast-growing software company in Pune, India

Key Responsibilities
  • Design and implement end-to-end observability solutions using modern monitoring and logging platforms.
  • Define and monitor Service Level Indicators (SLIs), Service Level Objectives (SLOs), and Key Performance Indicators (KPIs) to ensure system reliability.
  • Perform Root Cause Analysis (RCA), trend analysis, and support Problem Management initiatives.
  • Build dashboards, alerting rules, capacity reports, and anomaly detection mechanisms.
  • Analyze logs, metrics, and distributed traces to identify performance bottlenecks and improve system reliability.
  • Identify monitoring gaps and enhance observability coverage across cloud-native applications.
  • Support load and performance testing activities.
  • Participate in Major Incident Management and ensure timely service recovery.
  • Collaborate with DevOps and Engineering teams to improve system resilience, scalability, and operational excellence.
  • Develop and validate recovery plans while driving continuous reliability improvements.
Required Skills / Primary Skills
  • Strong experience with Dynatrace, Grafana, Kibana, and the ELK Stack.
  • Hands-on experience with Splunk and OpenTelemetry.
  • Experience with cloud monitoring on AWS and/or Azure.
  • Strong understanding of distributed tracing and observability best practices.
  • Experience monitoring Kubernetes-based applications and infrastructure.
  • Knowledge of Site Reliability Engineering (SRE) principles.
  • Experience with monitoring, alerting, incident management, and performance optimization.
  • Strong analytical, troubleshooting, and Root Cause Analysis (RCA) skills.
Additional Skills
  • SRE or DevOps certifications are preferred.
  • Experience supporting high-volume, real-time distributed systems.
  • Knowledge of cloud-native architectures and microservices.
  • Excellent problem-solving and communication skills.
  • Ability to collaborate effectively with cross-functional engineering and operations teams.
  • Self-driven with a proactive approach to improving system reliability and performance.
Notice Period
Immediate Joiners Preferred
Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Senior Site Reliability Engineer
Senior Site Reliability Engineer

AcquireX • Maharashtra

On-site
INR 1,800,000 - 2,500,000
Site Reliability Engineer (SRE)
Site Reliability Engineer (SRE)

United States Digital Space LLC • Maharashtra

On-site
INR 1,200,000 - 2,400,000
Senior Site Reliability Engineer (SRE) / DevOps Engineer
Senior Site Reliability Engineer (SRE) / DevOps Engineer

Umanist Staffing LLC • Maharashtra

On-site
INR 3,500,000 - 5,500,000
SRE(Site Reliability Engineer)
SRE(Site Reliability Engineer)

Cloudxtreme • Hyderabad, Chennai District, Bengaluru

Hybrid
INR 1,800,000 - 3,000,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

AcquireX • Pune District

On-site
INR 1,200,000 - 1,800,000
Health insurance
Flexible working hours
Training opportunities
Senior Site Reliability Engineer
Senior Site Reliability Engineer

VMC Soft Technologies, Inc • Hyderabad

Hybrid
INR 1,500,000 - 2,000,000
Site Reliability Engineer (SRE) / Observability Engineer
Site Reliability Engineer (SRE) / Observability Engineer

N Human Resources & Management Systems • Hyderabad

Hybrid
INR 4,000,000 - 7,000,000
Hybrid work
Certification reimbursement
Structured learning
SRE Engineer - Dynatrace
SRE Engineer - Dynatrace

Sandhata Technologies • Chennai District, Bengaluru, Mumbai

On-site
INR 1,200,000 - 1,800,000
SRE New Relic
SRE New Relic

Tekskills • Hyderabad, Chennai District, Bengaluru

Hybrid
INR 400,000 - 700,000
Observability Engineer (SRE)
Observability Engineer (SRE)

Cloudstepin • Hyderabad

On-site
INR 1,200,000 - 1,800,000