Senior SRE: Observability & Automation Leader (Hybrid)

Talentify

Holyoke (MA)

Hybrid

USD 134,000 - 170,000

Full time

14 days+
Application generator

Get a reply from this employer — a resume and cover letter tailored to exactly what they’re hiring for.

Get past ATS filters

Benefits offered by this job

Hybrid work environment
Relocation assistance
Tuition reimbursement
Professional development
Wellness programs
Onsite gym
Flexible work hours
401(k) planning
Onsite coffee

Job summary

ISO New England is seeking a Senior Site Reliability Engineer to enhance observability, automation, and reliability of IT services. You will own Splunk administration, automation, and IaC, collaborating across infrastructure, security, and applications teams to reduce toil and improve resilience.

The role emphasizes performance, capacity planning, and data-driven dashboards, with AI-assisted development tools to accelerate solutions while ensuring security and maintainability.

Qualifications

  • 5+ years of experience in SRE, DevOps, systems engineering, platform engineering, or IT operations.
  • Experience with enterprise monitoring and observability platforms; Splunk strongly preferred.
  • Experience designing/deploying infrastructure using Terraform and IaC.
  • Strong scripting/automation using Python, PowerShell, Bash.
  • Automation solutions that reduce manual operational effort in an enterprise environment.
  • Ability to read, understand, and refine code from engineering teams or AI-assisted tools.
  • Knowledge of distributed systems, networking, cloud platforms.
  • Familiarity with SRE principles: SLOs, error budgets, toil reduction.

Responsibilities

  • Build and maintain observability, monitoring, logging, alerting, and telemetry platforms (Splunk, Dynatrace, PRTG, OpsGenie).
  • Administer, maintain, automate, and improve Splunk platform including onboarding, indexing, dashboards, and health checks.
  • Develop and automate Splunk onboarding and operational workflows to improve reliability.
  • Create KPIs and dashboards for IT service health.
  • Engineer resilience patterns including HA, DR, and automated failover.
  • Collaborate with infra and apps teams to plan resilience testing and recovery exercises.
  • Perform performance testing, capacity modeling, and right-sizing.
  • Participate in major incident response to speed restoration and reliability improvements.
  • Design and deploy automation tooling with Python/PowerShell/Bash; use Terraform/IaC for infra.

Skills

SRE/DevOps
Terraform/IaC
Python/PowerShell/Bash
Splunk
Automation
AI-assisted development
Networking
Cloud platforms

Tools

Terraform
Splunk
Dynatrace
PRTG
OpsGenie

Job description

ISO New England is seeking a Senior Site Reliability Engineer to enhance observability, automation, and reliability of IT services. You will own Splunk administration, automation, and IaC, collaborating across infrastructure, security, and applications teams to reduce toil and improve resilience.

The role emphasizes performance, capacity planning, and data-driven dashboards, with AI-assisted development tools to accelerate solutions while ensuring security and maintainability.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Senior SRE: Observability, Splunk & Automation (Hybrid)
Senior SRE: Observability, Splunk & Automation (Hybrid)

ISO New England Inc. • Holyoke (MA)

Hybrid
USD 134,000 - 170,000
Hybrid work environment (3 days/week)
Senior SRE: Observability & Automation Lead
Senior SRE: Observability & Automation Lead

ISO New England Inc. • Holyoke (MA)

Hybrid
USD 134,000 - 170,000
Enhanced 401(k) and financial planning
Tuition reimbursement and professional
Onsite gym and wellness programs
+4
Senior SRE - Hybrid, Observability & Reliability
Senior SRE - Hybrid, Observability & Reliability

Early Warning Services LLC • Chicago (IL)

Hybrid
USD 106,000 - 130,000
Healthcare Coverage
401(k) Plan with match
PTO and Holidays
+1
Senior SRE - Hybrid, AWS & Observability
Senior SRE - Hybrid, AWS & Observability

Early Warning • San Francisco (CA)

Hybrid
USD 128,000 - 156,000
Healthcare coverage
401(k) plan
Paid time off
+2
Senior SRE: Scalable Infra, Observability & Automation
Senior SRE: Scalable Infra, Observability & Automation

Early Warning • Scottsdale (AZ)

Hybrid
USD 106,000 - 156,000
Healthcare Coverage
401(k) Company Match
Paid Time Off
+2
Senior SRE: Automate Reliability & Observability
Senior SRE: Automate Reliability & Observability

United States Digital Space LLC • Charlotte (TX)

On-site
USD 153,000 - 192,000
Discretionary incentive eligible
Benefits package
Senior SRE: Observability, Automation & Scalable Systems
Senior SRE: Observability, Automation & Scalable Systems

Replit • Northern (KY)

Hybrid
USD 140,000 - 190,000
Competitive Salary & Equity
401(k) 4% match (US)
Health, Dental, Vision & Life
+7
Senior SRE (Hybrid) - AI Resilience Platform
Senior SRE (Hybrid) - AI Resilience Platform

020 Cisco Systems, Inc. • San Jose (CA)

Hybrid
USD 168,000 - 245,000
Senior SRE - AI Platform Reliability (Hybrid)
Senior SRE - AI Platform Reliability (Hybrid)

Cisco • New York (NY)

Hybrid
USD 187,000 - 308,000
Medical insurance
Dental insurance
Vision insurance
+5
Senior SRE: Automation & Reliability Champion
Senior SRE: Automation & Reliability Champion

RXinsider LTD. • Philadelphia

On-site
USD 95,000 - 159,000
Annual incentive bonus
Country-specific benefits