Lead Support Analyst - Shared Services and Production Management , Information Technology

CLSA

Pune District

On-site

INR 1,500,000 - 2,800,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

CLSA in Pune District, Maharashtra, seeks an experienced SRE/Monitoring Engineer to own and support our monitoring and observability stack. The role involves building and maintaining Prometheus pipelines, Grafana and Kibana dashboards, and Logstash data flows across distributed systems.

You will troubleshoot incidents, optimize Linux servers, and contribute to automation and DR/BCP activities, collaborating with engineering and infrastructure teams to improve resilience and performance.

Qualifications

  • Bachelor's degree in computer science or engineering.
  • 8+ years IT/Investment bank domain experience.
  • Strong experience with monitoring and observability platforms (Geneos, Prometheus, VictoriaMetrics, Elasticsearch, Grafana, Kibana).
  • Hands-on Prometheus pipelines: exporters, scraping, relabelling, long-term storage integrations.
  • Experience building and maintaining Logstash pipelines for logs into Elasticsearch.
  • Design and maintain Grafana and Kibana dashboards for metrics, logs and performance.
  • Solid understanding of metrics, logging, alerting and observability pipelines.
  • Strong Linux administration (RHEL 7/8/9) and incident management skills.

Responsibilities

  • Own and support monitoring and SRE operations for reliability and performance.
  • Build, enhance, and maintain monitoring solutions across tools.
  • Develop, optimize, and maintain alerting rules, dashboards, and observability pipelines.
  • Troubleshoot major incidents with clear communication.
  • Troubleshoot Linux servers (RHEL) including upgrades and patching.
  • Analyze logs and fault-find to identify performance issues.
  • Collaborate with engineering and infra teams to improve resilience and security.
  • Contribute to automation strategies and deployment processes.
  • Participate in on-call rotations and DR/BCP drills.
  • Continuously research and adopt modern monitoring and SRE practices.

Skills

IT Monitoring & SRE
Prometheus
Grafana
Kibana
Elasticsearch
VictoriaMetrics
Geneos (ITRS)
Linux (RHEL)
Bash
Python
Ansible
CI/CD
Automation
Logstash pipelines
Monitoring dashboards

Education

Bachelor's degree in computer science / engineering

Tools

ITRS Geneos
Prometheus
Grafana
Kibana
Elasticsearch
Logstash
VictoriaMetrics

Job description

  • Own and support monitoring and SRE operations, ensuring system reliability, availability, and performance.
  • Build, enhance, and maintain monitoring solutions using ITRS Geneos, Prometheus, Victoria‑Metrics, Elasticsearch, and Grafana.
  • Develop, optimize, and maintain alerting rules, dashboards, and observability pipelines.
  • Troubleshoot and resolve complex issues during major incidents, providing clear and timely communication.
  • Troubleshoot Linux servers (RHEL 7/8/9), including upgrades, configurations, patching, and maintenance, while determining appropriate monitoring requirements for system changes.
  • Analyze logs, investigate issues, and perform fault finding to identify performance exceptions.
  • Collaborate with engineering, application, and infrastructure teams to improve system resilience, stability, security, efficiency, and scalability.
  • Contribute to automation strategies, deployment processes, and continuous operational improvements.
  • Participate in on‑call rotations, including off‑hours and scheduled weekend support.
  • Participate in Disaster Recovery (DR) and Business Continuity Planning (BCP) drills.
  • Continuously research and adopt modern monitoring and SRE tools and practices.

Requirements

  • Bachelor’s degree in computer science / engineering
  • Minimum 8 years’ experience within IT / Investment bank.
  • Strong experience with monitoring and observability platforms, including: ITRS Geneos, Prometheus, Victoria‑Metrics, Elasticsearch, Grafana, and Kibana.
  • Hands‑on experience building and implementing Prometheus pipelines, including exporters, scraping configurations, relabelling, metric routing, and integrations with long‑term storage (e.g., Victoria‑Metrics).
  • Experience building and maintaining Logstash pipelines, including ingestion, parsing, filtering, enrichment, and routing of logs into Elasticsearch.
  • Ability to design, build, and maintain Grafana and Kibana dashboards for metrics, logs, and performance analytics across distributed systems.
  • Solid understanding of metrics, logging, alerting, dashboards, and observability pipelines.
  • Strong Linux administration skills (RHEL 7/8/9), including troubleshooting, upgrades, configuration, patching, and performance optimization.
  • Good understanding of SRE principles, high availability, scalability, incident management and DR (Disaster Recovery) / BCP (Business Continuity Planning) activities
  • Experience with automation (e.g., Bash, Python, Ansible, CI/CD tools) is an advantage.
  • Understanding of networking fundamentals, performance tuning, and troubleshooting distributed systems.
  • Prior experience in Production Support, SRE, Monitoring Engineering, or Shared Services Operations with participation in on‑call rotations, including after-hours and weekend support.
  • Strong analytical, problem‑solving and communication skills with the ability to work collaboratively under pressure.
  • Self‑motivated, adaptable and able to prioritize, learn continuously and manage multiple responsibilities effectively.
Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

SRE Lead
SRE Lead

Hdfc Securities • Mumbai

On-site
INR 3,500,000 - 5,500,000
Support Analyst - Shared Services and Production Management, Information Technology
Support Analyst - Shared Services and Production Management, Information Technology

CLSA • Pune District

On-site
INR 700,000 - 1,000,000
Production Support Engineer
Production Support Engineer

Moofwd • Pune District

On-site
INR 600,000 - 1,000,000
Site Reliability Engineer
Site Reliability Engineer

Lloyds Technology Centre • Hyderabad

On-site
INR 1,200,000 - 2,400,000
Application Support Analyst
Application Support Analyst

GoldenSource • Mumbai

On-site
INR 800,000 - 1,200,000
Senior Software Engineer - SRE
Senior Software Engineer - SRE

Incedo • Bengaluru

On-site
INR 2,500,000 - 4,000,000
Product Support Engineer
Product Support Engineer

Datavail • Mumbai

On-site
INR 1,200,000 - 1,800,000
SRE Trade Support
SRE Trade Support

Gemini Solutions Pvt. ltd. • Gurugram District

On-site
INR 1,200,000 - 1,500,000
SRE Expert
SRE Expert

HCLTech • Bengaluru

On-site
INR 1,500,000 - 2,400,000
Application Support Engineer (Monitoring & Grafana Dashboards)
Application Support Engineer (Monitoring & Grafana Dashboards)

Hdfc Securities • Mumbai

On-site
INR 1,200,000 - 1,800,000