Senior Site Reliability Engineer (SRE) – Application Observability & Readiness (Azure)

Engg

Colombia

A distancia

COP 180.000.000 - 240.000.000

Jornada completa

Hace 6 días
Sé de los primeros/as/es en solicitar esta vacante
Generador de candidaturas

Una candidatura completa en un minuto — currículum adaptado y carta de presentación, listos para enviar.

Supera los filtros ATS

Descripción de la vacante

Coforge is seeking a Senior Site Reliability Engineer (SRE) to drive application observability and readiness on Azure. You will implement monitoring, tracing, and logging across services, defining SLIs/SLOs and robust alerting. Remote role with global collaboration and strong cloud experience is required.

Join Coforge to enable reliable, scalable production systems and partner with engineering teams to drive proactive improvements and incident readiness across the stack.

Formación

  • 5+ years of Site Reliability Engineering, Cloud Operations, or related roles.
  • Hands-on experience with DBT, Databricks, and SQL (minimum 1 year).
  • Strong experience with Azure IaaS and application observability.
  • Experience implementing and managing APM solutions such as Application Insights or New Relic.
  • Ability to design dashboards with Azure Monitor and Log Analytics, and CI/CD with Azure DevOps and GitHub Actions.

Responsabilidades

  • Collaborate with development teams to design and implement monitoring, alerting, dashboards, and APM instrumentation across applications and services.
  • Lead the implementation, configuration, and optimization of APM solutions.
  • Apply observability best practices using Azure Monitor, Application Insights, New Relic, and Log Analytics (KQL).
  • Enable code-level instrumentation, distributed tracing, and structured logging for visibility and reliability.
  • Design and maintain application-level monitoring dashboards and health metrics.
  • Define SLIs and SLOs and effective alerting strategies based on latency, errors, traffic, and saturation.
  • Continuously improve monitoring and alerting through production insights and incident learnings.
  • Support production readiness reviews and identify operational risks and gaps before deployment.

Conocimientos

Azure IaaS
Azure Monitor
Application Insights
New Relic
Databricks
DBT
SQL
Azure DevOps
GitHub Actions
SRE
APM
Log Analytics
Observability
Distributed Tracing
Structured Logging

Herramientas

Azure Monitor
Application Insights
New Relic
Databricks
DBT
SQL
Azure DevOps
GitHub Actions
KQL

Descripción del empleo

Job Title: Senior Site Reliability Engineer (SRE) – Application Observability & Readiness (Azure)

Key Skills: Azure IaaS, Azure Monitor, Application Insights, New Relic, Databricks, DBT, SQL, Azure DevOps, GitHub Actions, Site Reliability Engineering (SRE), Application Performance Monitoring (APM), Log Analytics (KQL), Observability, Distributed Tracing, Structured Logging

Experience: 5+ years of experience in Site Reliability Engineering, Cloud Operations, or related roles.

Mandatory minimum of 1 year of hands-on experience with DBT, Databricks, and SQL.

Location: Legal residents of Peru, Colombia, Bolivia, Costa Rica, Mexico, and Brazil.

Work Mode: Remote

At Coforge, we are looking for a Senior Site Reliability Engineer (SRE) – Application Observability & Readiness (Azure) (#21013-18-1) with the following profile.

Main Responsibilities
  • Collaborate with development teams to design and implement monitoring, alerting, dashboards, and APM instrumentation across applications and services.
  • Lead the implementation, configuration, and optimization of Application Performance Monitoring (APM) solutions.
  • Apply observability best practices using tools such as Azure Monitor, Application Insights, New Relic, and Log Analytics (KQL).
  • Enable code-level instrumentation, distributed tracing, and structured logging to improve application visibility and reliability.
  • Design and maintain application-level monitoring dashboards and operational health metrics.
  • Define and implement Service Level Indicators (SLIs), Service Level Objectives (SLOs), and effective alerting strategies based on latency, error rates, traffic, and resource saturation.
  • Continuously improve monitoring and alerting mechanisms through production insights and incident learnings.
  • Participate in production readiness reviews, identifying operational risks, observability gaps, and potential failure scenarios before deployment.
  • Support incident analysis and post-incident improvements through enhanced telemetry and monitoring practices.
  • Partner with engineering teams to ensure applications are reliable, scalable, and production-ready.
Mandatory Requirements
  • Strong experience supporting and operating applications in Microsoft Azure IaaS environments.
  • Hands-on experience with application observability, monitoring, and reliability engineering practices.
  • Mandatory experience with DBT, Databricks, and SQL (minimum 1 year of experience).
  • Experience implementing and managing APM solutions such as Application Insights, New Relic, or similar platforms.
  • Experience designing dashboards and monitoring solutions using Azure Monitor, Application Insights, and Log Analytics (KQL).
  • Familiarity with CI/CD environments including Azure DevOps and GitHub Actions.
  • Solid understanding of cloud-native architectures and distributed application systems.
  • Practical SRE mindset with experience in incident analysis, root cause investigation, and proactive problem prevention.
  • Strong verbal and written English communication skills, with the ability to collaborate effectively with global teams.
Preferred Requirements
  • Experience with scripting and automation using PowerShell and/or Bash.
  • Knowledge of scalability, availability, and resilience patterns in modern cloud environments.
  • Experience driving production readiness and operational excellence initiatives.
  • Exposure to reliability engineering best practices in enterprise-scale environments.

Posted on: 28-09-2026

At Coforge, we hire professionals solely based on their skills and qualifications and do not discriminate on the basis of age, disability, religion, gender, sexual orientation, socioeconomic status, or nationality.

Consigue la evaluación confidencial y gratuita de tu currículum.

o arrastra y suelta tu archivo aquí

Similar jobs

Puestos de trabajo similares que vale la pena comparar

Azure SRE: Application Observability & Readiness (Remote)
Azure SRE: Application Observability & Readiness (Remote)

Engg • Colombia

A distancia
COP 180.000.000 - 240.000.000
Senior Site Reliability Engineer (SRE) | Bogotá
Senior Site Reliability Engineer (SRE) | Bogotá

remoti • Bogotá

Presencial
COP 300.060.000 - 433.420.000
Lead Data Engineer (DBT, Databricks, Azure)
Lead Data Engineer (DBT, Databricks, Azure)

Encora Inc. • Bogotá ciudad

Presencial
COP 372.694.000 - 559.041.000
Site Reliability Engineer (Cloud)
Site Reliability Engineer (Cloud)

Sharesource Australia BPO Corporation • Norte

Presencial
COP 110.000.000 - 180.000.000
Remote + Hybrid
Work-life balance
Open culture
+3
Senior Site Reliability Engineer
Senior Site Reliability Engineer

N-iX • Colombia

Presencial
COP 120.000.000 - 180.000.000
Flexible work format
Education reimbursement
Professional development
Site Reliability Engineer
Site Reliability Engineer

DCT • Bogotá

Presencial
COP 156.225.589 - 234.338.384
Career Growth & Mentorship
Flexible Work Environment
Generative & Collaborative Culture
Service Reliability Engineer
Service Reliability Engineer

1083 Amadeus IT Group Colombia, S.A.S. • Colombia

Presencial
COP 182.089.661 - 254.925.525
Competitive remuneration
Vacation and holiday paid time off
Health insurances
+3
Senior Monitoring and Observability Analyst Sr. (M-F)
Senior Monitoring and Observability Analyst Sr. (M-F)

Coderio • Bogotá

Presencial
COP 154.517.711 - 270.405.995
100% remote work
Long-term commitment
Collaborative international team
+1
Senior Data Engineer, Colombia
Senior Data Engineer, Colombia

CI&T • Colombia

Presencial
COP 111.600.000 - 167.400.000
Maternity and Parental leaves
Mobile services subsidy
Sick pay-Life insurance
+3
Site Reliability Engineering (SRE)
Site Reliability Engineering (SRE)

Joinimagine • Bogotá ciudad, Guavio

Presencial
COP 9.000.000 - 13.000.000