Senior Observability & Reliability Engineer

blockchaincapital.com

New York (NY)

On-site

USD 130,000 - 180,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

Ripple is seeking a Senior Site Reliability Engineer to lead observability and incident management across production systems in a Windows/Azure environment. You will design dashboards in New Relic, implement SLOs/SLIs, tune alerts, and partner with engineering teams to improve reliability and performance.

Requirements include 7+ years in SRE/DevOps, hands-on engineering with mentoring, and strong experience with Terraform, Azure, AWS, and incident management platforms like Incident.IO or

Qualifications

  • 7+ years in Site Reliability Engineering, DevOps, or Platform Engineering with a focus on observability and production operations.
  • Proven ability to deliver hands-on engineering work while coaching and mentoring teams.
  • Experience working in Agile/Scrum environments and collaborating with cross-functional teams.

Responsibilities

  • Design and implement monitoring, alerting, and dashboards in New Relic across Azure and AWS; write NRQL queries for troubleshooting and reporting.
  • Define and implement SLOs/SLIs and error budgets; coach teams on balancing velocity with reliability.
  • Lead alert noise reduction, tune thresholds, and ensure actionable alerts.
  • Optimize observability costs through log ingestion management and configuration governance.
  • Partner with engineering to improve observability maturity: structured logging, metrics instrumentation, tracing, and dashboard patterns.
  • Develop and maintain Terraform IaC for monitoring resources; enforce governance standards.
  • Author and troubleshoot Azure DevOps pipelines; support deployment visibility and release hygiene.
  • Administer Incident.IO: alert routing, Slack/OpsGenie integration, and runbooks; establish incident management foundations.
  • Track MTTR/MTTD and incident frequency; drive continual improvement with engineering teams.
  • Facilitate post-incident reviews and real-time troubleshooting with stakeholders.
  • Enable teams through workshops and training; translate needs into self-service capabilities.

Skills

Site Reliability Engineering
DevOps
Observability
NRQL
Agile/Scrum
Mentoring
Cross-functional collaboration

Tools

Terraform
Azure
AWS
PowerShell
Azure DevOps
Octopus Deploy
Incident.IO
PagerDuty
OpsGenie
Slack
Jira

Job description

Ripple is seeking a Senior Site Reliability Engineer to lead observability and incident management across production systems in a Windows/Azure environment. You will design dashboards in New Relic, implement SLOs/SLIs, tune alerts, and partner with engineering teams to improve reliability and performance.

Requirements include 7+ years in SRE/DevOps, hands-on engineering with mentoring, and strong experience with Terraform, Azure, AWS, and incident management platforms like Incident.IO or

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Senior Observability & SRE Engineer
Senior Observability & SRE Engineer

Hidden Road • Chicago (IL)

Hybrid
USD 160,000 - 200,000
Equity
Bonuses
Healthcare
+4
Senior Observability & Reliability Engineer
Senior Observability & Reliability Engineer

Ripple • New York (NY)

On-site
USD 160,000 - 200,000
Competitive salary
Equity
Wellness benefits
+2
Senior SRE & Observability Engineer
Senior SRE & Observability Engineer

Hidden Road • Chicago (IL)

On-site
USD 160,000 - 200,000
Senior Observability Engineer: Build Reliability & Dashboards
Senior Observability Engineer: Build Reliability & Dashboards

Ripple • New York (NY)

On-site
USD 160,000 - 200,000
Senior SRE: Observability & Incident Champion (Azure/AWS)
Senior SRE: Observability & Incident Champion (Azure/AWS)

Hidden Road • New York (NY)

Hybrid
USD 160,000 - 200,000
Senior SRE: Observability & Incident Management
Senior SRE: Observability & Incident Management

Hidden Road • New York (NY)

Hybrid
USD 160,000 - 200,000
Equity
Bonuses
Healthcare
+4
Senior Site Reliability Engineer, Observability
Senior Site Reliability Engineer, Observability

blockchaincapital.com • New York (NY)

On-site
USD 130,000 - 180,000
Senior SRE: Observability, CI/CD & Security
Senior SRE: Observability, CI/CD & Security

Ripple • Chicago (IL)

On-site
USD 160,000 - 200,000
Competitive salary
Comprehensive healthcare benefits
Employee giving match
+2
Senior Site Reliability Engineer: Observability & CI/CD
Senior Site Reliability Engineer: Observability & CI/CD

Ripple • Chicago (IL)

On-site
USD 160,000 - 200,000
Competitive salary
Bonuses
Equity
+3
Site Reliability Engineer, Observability
Site Reliability Engineer, Observability

Hidden Road • New York (NY)

Hybrid
USD 160,000 - 200,000
Equity
Bonuses
Healthcare
+4