Director – Site Reliability Engineering (SRE)

Umanist NA

Mumbai

Presencial

INR 6 000 000 - 9 000 000

Tempo integral

há 16 horas
Torna-te num dos primeiros candidatos
Gerador de candidaturas

Uma candidatura completa num minuto — currículo e carta de apresentação personalizados, prontos a enviar.

Ultrapassa os filtros ATS

Resumo da oferta

Umanist NA seeks a Director of Site Reliability Engineering to lead reliability across multiple SaaS products. Shift focus to building scalable reliability programs, improving availability, and driving operational excellence through metrics and KPIs.

The role requires deep expertise in cloud infrastructure, observability, incident management, CI/CD, and distributed systems, with strong leadership and communication skills.

Qualificações

  • :18+ years of experience in Software Engineering, SRE, Site Reliability, or related roles.
  • :

Responsabilidades

  • Lead and develop SRE / Reliability Engineering teams across multiple SaaS products.
  • Define and drive reliability engineering strategy across the organization.
  • Define and manage SLIs, SLOs, SLAs, error budgets, and reliability KPIs.
  • Drive observability, monitoring, alerting, and proactive performance management.
  • Establish and improve incident response, escalation, troubleshooting, and post-incident reviews.
  • Partner with Software Engineering, Product, Cloud/Platform, Security, and Infrastructure teams.
  • Apply software engineering principles to automate reliability challenges.
  • Improve system availability, scalability, resilience, performance, and operational efficiency.
  • Drive CI/CD improvements and deployment reliability.
  • Architect and support apps/infrastructure on high-growth cloud platforms.
  • Lead reliability programs across multiple SaaS products.
  • Establish engineering metrics and use data/KPIs to identify gaps.
  • Drive automation and reduce repetitive operations.
  • Mentor engineering leaders and senior SREs.
  • Communicate reliability strategy and risk to leadership.
  • Influence teams to adopt best practices.

Conhecimentos

SRE leadership
Cloud architecture
Observability
CI/CD
Incident management
Distributed systems
Kubernetes
Automation/tooling
Stakeholder management
Communication

Formação académica

Bachelor's degree in CS/Engineering or related field

Ferramentas

Terraform
Prometheus
Grafana
Datadog
New Relic
Splunk
Kubernetes

Descrição da oferta de emprego

Job Title: Director – Site Reliability Engineering (SRE)

Industry: Candidate should be from B2B SaaS / Cloud Product companies in recent work experience

Experience: 18+ Years

Leadership: 5+ Years at Director / Senior Engineering Leadership Level(super-mandate, non-negotiable)

Notice Period: Immediate to 30 Days

Job Location: Hyderabad

Role Overview

We are looking for an experienced Director of Site Reliability Engineering (SRE) to lead reliability and operational excellence across multiple SaaS products.

The ideal candidate combines strong software engineering fundamentals with deep expertise in SRE, cloud infrastructure, observability, monitoring, incident management, CI/CD, and distributed systems.

This leader will be responsible for building scalable reliability programs, improving availability and performance, establishing SLI/SLO practices, and driving operational excellence through measurable metrics and KPIs.

Key Responsibilities
  • Lead and develop SRE / Reliability Engineering teams supporting multiple SaaS products.
  • Establish and drive reliability engineering strategy across the organization.
  • Define and manage SLIs, SLOs, SLAs, error budgets, and reliability KPIs.
  • Drive observability, monitoring, alerting, and proactive performance management.
  • Establish and improve incident response, escalation, troubleshooting, and post-incident review processes.
  • Partner with Software Engineering, Product, Cloud/Platform, Security, and Infrastructure teams.
  • Apply software engineering principles to automate and solve reliability and operational challenges.
  • Improve system availability, scalability, resilience, performance, and operational efficiency.
  • Drive CI/CD improvements and deployment reliability.
  • Architect and support applications and infrastructure running on high-growth cloud platforms.
  • Lead reliability programs across multiple B2B SaaS products.
  • Establish engineering metrics and use data/KPIs to identify and resolve operational gaps.
  • Drive automation and reduction of repetitive operational work.
  • Mentor engineering leaders and senior SRE engineers.
  • Communicate reliability strategy, risks, metrics, and business impact to senior leadership.
  • Influence engineering teams and cross-functional stakeholders to adopt reliability best practices.

Bachelor's degree in Computer Science, Information Systems, Engineering, or a related field.

  • 18+ years of experience in Software Engineering, SRE, Site Reliability, Platform Engineering, or related reliability/engineering roles.
  • 5+ years of leadership experience at Director level or equivalent.
  • Strong experience in SaaS / B2B SaaS / cloud product companies.
  • Proven ability to apply software engineering principles and practices to solve reliability and operational challenges.
  • Strong expertise in SLI/SLO, monitoring, observability, and reliability engineering.
  • Strong experience with CI/CD and modern software delivery practices.
  • Strong experience with incident response, problem management, RCA, and production operations.
  • Strong AWS expertise.
  • Experience with container orchestration, such as Kubernetes.
  • Experience leading reliability programs across multiple SaaS products.
  • Experience architecting applications or infrastructure for high-growth cloud platforms.
  • Experience with large-scale distributed systems in B2B SaaS environments.
  • Strong leadership, communication, stakeholder management, and influencing skills.
  • Demonstrated experience driving operational excellence through metrics, KPIs, SLOs, and reliability objectives.
Preferred Skills
  • Kubernetes / containerized environments
  • AWS cloud architecture
  • Infrastructure and application observability
  • Distributed systems
  • Microservices
  • Infrastructure automation
  • Infrastructure-as-Code
  • Terraform
  • Prometheus / Grafana
  • Datadog / New Relic / Splunk or similar observability platforms
  • CI/CD platforms
  • Disaster recovery and business continuity
  • Capacity and performance engineering
  • Chaos/resilience engineering

Skills: cloud,saas,b2b,monitoring,sli/slo,production operations,kubernetes,ci/cd,container orchestration,leadership,metrics,multiple saas products,aws,large-scale distributed systems,problem management,observability,reliability engineering,kpis,b2b saas environments,slos

Obtém a tua avaliação gratuita e confidencial do currículo.

ou arrasta e larga o ficheiro aqui.

Similar jobs

Ofertas semelhantes que vale a pena comparar

Director – Site Reliability Engineering (SRE)
Director – Site Reliability Engineering (SRE)

Umanist NA • Navi Mumbai

Presencial
INR 6 000 000 - 12 000 000
Director – Site Reliability Engineering (SRE)
Director – Site Reliability Engineering (SRE)

Umanist NA • Hyderabad

Presencial
INR 3 500 000 - 5 200 000
Software Engineer
Software Engineer

PwC • Hyderabad, Bengaluru

Híbrido
INR 2 800 000 - 5 200 000
Senior Consultant - Site Reliability Engineer
Senior Consultant - Site Reliability Engineer

HCA Healthcare • Hyderabad

Presencial
INR 3 000 000 - 5 200 000
Site Reliability Engineer
Site Reliability Engineer

Acesoft Labs • Ahmedabad District

Híbrido
INR 400 000 - 700 000
Site Reliability Engineer
Site Reliability Engineer

Mumba Technologies, Inc. • Gurugram District

Híbrido
INR 1 500 000 - 2 100 000
Tech & Digital-Lead Site Reliability Engineer
Tech & Digital-Lead Site Reliability Engineer

Hdfc Bank • Bengaluru

Presencial
INR 3 500 000 - 5 500 000
Site Reliability Engineer
Site Reliability Engineer

Acesoft Labs • Hyderabad

Presencial
INR 1 800 000 - 3 000 000
Site Reliability Engineering (SRE) Manager
Site Reliability Engineering (SRE) Manager

Acesoft Labs • Hyderabad

Híbrido
INR 4 000 000 - 6 000 000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

VMC Soft Technologies, Inc • Hyderabad

Presencial
INR 1 500 000 - 2 000 000