Senior Site Reliability Engineer (SRE) – Application Observability & Readiness (Azure)

Encora

Comisión de Fomento de Perú

Remoto

ARS 136.430.000 - 227.383.000

Tempo pieno

2 giorni fa
Candidati tra i primi
Generatore di candidature

Una candidatura fatta su misura per questo lavoro — un curriculum e una lettera di presentazione personalizzati, perfettamente in linea con l'annuncio.

Supera i filtri ATS

Descrizione del lavoro

Coforge is seeking a Senior Site Reliability Engineer (SRE) focused on Application Observability & Readiness in Azure. You will work with global teams to design and implement monitoring, tracing, and dashboards across applications and services.

Join a role that emphasizes SLIs/SLOs, production readiness, and proactive problem prevention, using Azure Monitor, Application Insights, New Relic, and Log Analytics to improve reliability and visibility.

Competenze

  • Strong experience with Microsoft Azure IaaS environments.
  • Hands-on experience with application observability, monitoring, and reliability engineering practices.
  • Mandatory experience with DBT, Databricks, and SQL (minimum 1 year).
  • Experience implementing and managing APM solutions such as Application Insights, New Relic, or similar platforms.
  • Experience designing dashboards and monitoring solutions using Azure Monitor, Application Insights, and Log Analytics (KQL).
  • Familiarity with CI/CD environments including Azure DevOps and GitHub Actions.
  • Solid understanding of cloud-native architectures and distributed application systems.
  • Practical SRE mindset with incident analysis and proactive problem prevention.
  • Strong verbal and written English communication skills for global collaboration.

Mansioni

  • Collaborate with development teams to design and implement monitoring, alerting, dashboards, and APM instrumentation across applications and services.
  • Lead the implementation, configuration, and optimization of Application Performance Monitoring (APM) solutions.
  • Apply observability best practices using tools such as Azure Monitor, Application Insights, New Relic, and Log Analytics (KQL).
  • Enable code-level instrumentation, distributed tracing, and structured logging to improve application visibility and reliability.
  • Design and maintain application-level monitoring dashboards and operational health metrics.
  • Define and implement SLIs/SLOs and effective alerting strategies based on latency, error rates, traffic, and saturation.
  • Continuously improve monitoring and alerting through production insights and incident learnings.
  • Participate in production readiness reviews, identifying operational risks and observability gaps before deployment.

Conoscenze

Azure
Observability
APM tooling
CI/CD
English

Strumenti

Application Insights
New Relic
Log Analytics
Azure Monitor
Databricks
DBT
GitHub Actions
Azure DevOps

Descrizione del lavoro

Senior Site Reliability Engineer (SRE) – Application Observability & Readiness (Azure)

Job Title: Senior Site Reliability Engineer (SRE) – Application Observability & Readiness (Azure)

Experience: 5+ years of experience in Site Reliability Engineering, Cloud Operations, or related roles. Mandatory minimum of 1 year of hands-on experience with DBT, Databricks, and SQL.

Location: Legal residents of Peru, Colombia, Bolivia, Costa Rica, Mexico, and Brazil.

Work Mode: Remote

At Coforge, we are looking for a Senior Site Reliability Engineer (SRE) – Application Observability & Readiness (Azure) (#21013-18-1) with the following profile.

Main Responsibilities
  • Collaborate with development teams to design and implement monitoring, alerting, dashboards, and APM instrumentation across applications and services.
  • Lead the implementation, configuration, and optimization of Application Performance Monitoring (APM) solutions.
  • Apply observability best practices using tools such as Azure Monitor, Application Insights, New Relic, and Log Analytics (KQL).
  • Enable code-level instrumentation, distributed tracing, and structured logging to improve application visibility and reliability.
  • Design and maintain application-level monitoring dashboards and operational health metrics.
  • Define and implement Service Level Indicators (SLIs), Service Level Objectives (SLOs), and effective alerting strategies based on latency, error rates, traffic, and resource saturation.
  • Continuously improve monitoring and alerting mechanisms through production insights and incident learnings.
  • Participate in production readiness reviews, identifying operational risks, observability gaps, and potential failure scenarios before deployment.
  • Support incident analysis and post-incident improvements through enhanced telemetry and monitoring practices.
  • Partner with engineering teams to ensure applications are reliable, scalable, and production-ready.
Mandatory Requirements
  • Strong experience supporting and operating applications in Microsoft Azure IaaS environments.
  • Hands-on experience with application observability, monitoring, and reliability engineering practices.
  • Mandatory experience withDBT, Databricks, and SQL (minimum 1 year of experience).
  • Experience implementing and managing APM solutions such as Application Insights, New Relic, or similar platforms.
  • Experience designing dashboards and monitoring solutions using Azure Monitor, Application Insights, and Log Analytics (KQL).
  • Familiarity with CI/CD environments including Azure DevOps and GitHub Actions.
  • Solid understanding of cloud-native architectures and distributed application systems.
  • Practical SRE mindset with experience in incident analysis, root cause investigation, and proactive problem prevention.
  • Strong verbal and written English communication skills, with the ability to collaborate effectively with global teams.
Preferred Requirements
  • Experience with scripting and automation using PowerShell and/or Bash.
  • Knowledge of scalability, availability, and resilience patterns in modern cloud environments.
  • Experience driving production readiness and operational excellence initiatives.
  • Exposure to reliability engineering best practices in enterprise-scale environments.

At Coforge, we hire professionals solely based on their skills and qualifications and do not discriminate on the basis of age, disability, religion, gender, sexual orientation, socioeconomic status, or nationality.

Ottieni la revisione del curriculum gratis e riservata.

o trascina qui il file.

Similar jobs

Offerte di lavoro simili che vale la pena confrontare

Senior Site Reliability Engineer (SRE) – Application Observability & Readiness (Azure)
Senior Site Reliability Engineer (SRE) – Application Observability & Readiness (Azure)

Encora10 • Argentina

In loco
MXN 900.000 - 1.300.000
Senior Site Reliability Engineer (SRE) – Application Observability & Readiness (Azure)
Senior Site Reliability Engineer (SRE) – Application Observability & Readiness (Azure)

Encora10 • Comisión de Fomento de Perú

In loco
ARS 121.858.000 - 182.788.000
Senior Site Reliability Engineer (Sre) Application Observability & Readiness (Azure)
Senior Site Reliability Engineer (Sre) Application Observability & Readiness (Azure)

Encora Inc. • Comisión de Fomento de Perú

Remoto
ARS 137.078.000 - 198.002.000
Remote Azure SRE: Observability & Reliability Lead
Remote Azure SRE: Observability & Reliability Lead

Encora10 • Comisión de Fomento de Perú

Remoto
ARS 121.858.000 - 182.788.000
Remote Azure SRE - Observability & Production Readiness
Remote Azure SRE - Observability & Production Readiness

Encora10 • Argentina

Ibrido
MXN 900.000 - 1.300.000
Remote Senior SRE — Azure Observability & Readiness
Remote Senior SRE — Azure Observability & Readiness

Encora • Comisión de Fomento de Perú

Remoto
ARS 136.430.000 - 227.383.000
SRE SR
SRE SR

Werben HR • Buenos Aires

Remoto
ARS 136.732.000 - 197.502.000
Senior SRE - Azure Observability & Readiness (Remote)
Senior SRE - Azure Observability & Readiness (Remote)

Encora Inc. • Comisión de Fomento de Perú

Remoto
ARS 137.078.000 - 198.002.000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

N-iX • Argentina

In loco
ARS 135.892.000 - 196.289.000
Flexible work format
Education reimbursement
Mentorship program
+2
Site Reliability Engineer
Site Reliability Engineer

Strategic Staffing Solutions • Argentina

Remoto
ARS 1.200.000 - 2.500.000
Full-time employment
Remote work 100%
Competitive salary in ARS
+1