Site Reliability Engineer (SRE)

Kameda Infologics Pvt. Ltd.

Thiruvananthapuram

On-site

INR 600,000 - 800,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

Kameda Infologics Pvt. Ltd. is seeking a Site Reliability Engineer (SRE) in Thiruvananthapuram, India. The candidate will monitor and maintain the stability and performance of healthcare applications, ensuring high system reliability and uptime.

With responsibilities that include system performance monitoring and incident management, the ideal candidate should have 2-5 years of experience in application support or DevOps, and possess skills in Linux, SQL Server, and monitoring tools.

Qualifications

  • 2–5 years of experience in Application Support, Production Support, DevOps, or Site Reliability Engineering.
  • Basic scripting skills using PowerShell, Python, or Shell.
  • Strong analytical and troubleshooting abilities.

Responsibilities

  • Continuously monitor application performance and ensure system stability.
  • Configure and maintain alerts for critical system events.
  • Provide monitoring support during application deployments and production releases.

Skills

Linux Server Administration
Windows Server Administration
SQL Server Monitoring
PostgreSQL Monitoring
Application Log Analysis
REST APIs Monitoring
PowerShell Scripting
Python Scripting
Shell Scripting
Monitoring Tools (Grafana, Prometheus, etc.)

Job description

We are seeking a proactive and detail-oriented Site Reliability Engineer (SRE) to monitor and maintain the stability, availability, and performance of enterprise healthcare applications. The ideal candidate will be responsible for continuously monitoring production environments, identifying issues proactively, coordinating with cross-functional teams for timely resolution, and ensuring high system reliability and uptime.

Key Responsibilities
Production System Monitoring
  • Continuously monitor application performance, databases, servers, integrations, message queues, and APIs.
  • Track system health metrics such as uptime, response time, CPU utilization, memory usage, disk space, database locks, backup status, and interface failures.
  • Ensure the overall stability and availability of production systems.
Alert Management
  • Configure and maintain monitoring alerts for critical system events.
  • Classify alerts based on severity (Critical, High, Medium, and Low).
  • Escalate incidents promptly to the appropriate technical teams following established escalation procedures.
  • Act as the first point of technical monitoring during production incidents.
  • Coordinate with Application Support, Infrastructure, Database Administration, Development, QA, and Project Management teams to ensure timely issue resolution.
  • Maintain incident timelines, support Root Cause Analysis (RCA), and confirm successful issue closure.
  • Prepare and share daily system health reports.
  • Generate weekly reports on system availability, uptime, incident trends, and recurring issues.
  • Identify potential system issues before they impact end users.
  • Monitor slow-running database queries, failed scheduled jobs, integration failures, and abnormal transaction patterns.
  • Recommend permanent fixes for recurring issues by collaborating with development and infrastructure teams.
Go-Live & Production Support
  • Provide dedicated monitoring support during application deployments, production releases, and go-live activities.
  • Closely monitor critical business workflows, integrations, and application performance during deployment windows.
  • Ensure system stability throughout release activities.
  • Develop scripts and automation tools for routine health checks, service validation, log analysis, restart verification, and notifications.
  • Continuously improve monitoring processes to reduce manual effort and improve operational efficiency.
Required Skills
  • Basic knowledge of Linux and Windows Server administration.
  • Understanding of SQL Server and/or PostgreSQL monitoring.
  • Experience in application log analysis and troubleshooting.
  • Knowledge of REST APIs and integration monitoring.
  • Basic scripting skills using PowerShell, Python, or Shell scripting.
  • Experience with monitoring tools such as Grafana, Prometheus, Zabbix, ELK Stack, Azure Monitor, CloudWatch, or equivalent.
  • Strong analytical, troubleshooting, and problem-solving abilities.
  • Excellent coordination, communication, and incident escalation skills.
  • Ability to work effectively in a production support environment.
Preferred Skills
  • Experience supporting enterprise or healthcare applications.
  • Understanding of application transaction flows and production support processes.
  • Familiarity with ITIL practices, incident management, and change management.
  • Exposure to DevOps practices and monitoring automation.
Experience
  • 2–5 years of experience in Application Support, Production Support, DevOps, Site Reliability Engineering (SRE), or a similar role.
Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Site Reliability Engineer
Site Reliability Engineer

Snapmint • Gurugram District

On-site
INR 800,000 - 1,200,000
Site Reliability Engineer (SRE)
Site Reliability Engineer (SRE)

Zorba AI • Chennai District

On-site
INR 1,200,000 - 2,400,000
Site Reliability Engineer
Site Reliability Engineer

Lloyds Technology Centre • Hyderabad

On-site
INR 1,200,000 - 2,400,000
Site Reliability Engineer Lead
Site Reliability Engineer Lead

Synechron • Bengaluru, Hyderabad

Hybrid
INR 4,200,000 - 6,300,000
Site Reliability Engineer(SRE)
Site Reliability Engineer(SRE)

MetaForgeIT • Hyderabad

On-site
INR 1,000,000 - 1,500,000
Site Reliability Engineer II
Site Reliability Engineer II

United States Digital Space LLC • Karnataka

On-site
INR 800,000 - 1,200,000
Site Reliability Engineer
Site Reliability Engineer

Spot Your Leaders & Consulting • Pune District

On-site
INR 2,500,000 - 4,000,000
SRE - AWS, GCP & Azure
SRE - AWS, GCP & Azure

PibyThree • Navi Mumbai

On-site
INR 1,200,000 - 1,800,000
SRE - AWS, GCP & Azure
SRE - AWS, GCP & Azure

PibyThree • Thane

On-site
INR 1,200,000 - 1,500,000
Site Reliability Engineer II
Site Reliability Engineer II

GreyOrange • Gurugram District

On-site
INR 3,000,000 - 5,500,000