Remote SRE: Observability & Automation Lead

Zachary Piper Solutions

United States

Remote

USD 120,000 - 145,000

Full time

4 days ago
Be an early applicant
Application generator

Stand out for this role — generate a tailored resume and cover letter in about a minute.

Get past ATS filters

Job summary

Piper Companies is seeking a Site Reliability Engineer (SRE) to join the Ops Stack / Platform Engineering team with a leading enterprise organization. This remote role focuses on observability, system health, patching, vulnerability remediation, and automation across large-scale environments.

You will build monitoring, dashboards, and automation, partner with security and infrastructure teams, and support production reliability in a remote US-based capacity.

Qualifications

  • 4+ years of experience in Site Reliability Engineering, Platform Engineering, DevOps, Cloud Engineering, or Infrastructure Engineering.
  • Strong experience with observability, monitoring, logging, alerting, and system-health strategies.
  • Hands-on experience with infrastructure patching, vulnerability remediation, or infrastructure lifecycle management.
  • Experience supporting Linux and/or Windows environments.
  • Strong scripting and automation experience using Python, PowerShell, Bash, or similar technologies.
  • Familiarity with infrastructure automation and configuration management technologies such as Ansible, Terraform, Puppet, or Chef.
  • Experience with observability platforms such as Splunk, Datadog, Dynatrace, Grafana, Prometheus, Elastic, or comparable technologies preferred.
  • Familiarity with containers and Kubernetes is a plus.

Responsibilities

  • Build, maintain, and enhance observability and monitoring capabilities across enterprise infrastructure and platform environments.
  • Develop dashboards, alerts, metrics, and logging strategies to improve visibility into system health, availability, and performance.
  • Monitor platform availability, reliability, capacity, and performance and proactively identify potential issues.
  • Own and improve OS and infrastructure patching processes, including scheduling, deployment, validation, and remediation.
  • Support vulnerability remediation initiatives and collaborate with security teams to resolve infrastructure findings.
  • Automate operational processes involving patching, monitoring, remediation, and routine system maintenance.
  • Troubleshoot complex production and infrastructure issues and conduct root cause analysis.
  • Partner with Platform Engineering, Infrastructure, Security, and application teams to improve platform reliability.

Skills

Observability
Monitoring
Automation
Python
PowerShell
Bash
Linux
Windows
Ansible
Terraform
Kubernetes
SRE/DevOps mindset

Tools

Ansible
Terraform
Puppet
Chef
Splunk
Datadog
Dynatrace
Grafana
Prometheus
Elastic
Kubernetes

Job description

Piper Companies is seeking a Site Reliability Engineer (SRE) to join the Ops Stack / Platform Engineering team with a leading enterprise organization. This remote role focuses on observability, system health, patching, vulnerability remediation, and automation across large-scale environments.

You will build monitoring, dashboards, and automation, partner with security and infrastructure teams, and support production reliability in a remote US-based capacity.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Remote SRE: Observability & Automation
Remote SRE: Observability & Automation

Piper Companies • United States

Remote
USD 120,000 - 145,000
Health insurance
Vision insurance
Dental insurance
+3
Remote SRE - Observability & Platform Reliability
Remote SRE - Observability & Platform Reliability

ZP Group • United States

Remote
USD 120,000 - 145,000
Health insurance
Vision insurance
Dental insurance
+1
Remote SRE: Observability & Automation Engineer
Remote SRE: Observability & Automation Engineer

Piper Companies • United States

Remote
USD 120,000 - 145,000
Health insurance
Vision insurance
Dental insurance
+1
Remote Site Reliability Engineer: Observability & Automation
Remote Site Reliability Engineer: Observability & Automation

ZP Group • United States

Remote
USD 100,000 - 140,000
Remote SRE: Observability, Automation & Platform Stability
Remote SRE: Observability, Automation & Platform Stability

Zachary Piper Solutions • United States

Remote
USD 120,000 - 160,000
Remote SRE: Automate, Secure, and Stabilize Cloud Ops
Remote SRE: Automate, Secure, and Stabilize Cloud Ops

Piper Companies • United States

Remote
USD 110,000 - 140,000
Comprehensive benefits
Fully remote
Long-term contract
Remote SRE: Build Resilient, Automated Cloud Platforms
Remote SRE: Build Resilient, Automated Cloud Platforms

Piper Companies • United States

Remote
USD 120,000 - 160,000
Medical, dental, vision benefits
Retirement plan
Remote work
Remote Site Reliability Engineer - SRE & Automation
Remote Site Reliability Engineer - SRE & Automation

ZP Group • United States

Remote
USD 110,000 - 140,000
Health, Vision, Dental
PTO & Holidays
Remote work
+1
Remote Site Reliability Engineer — Automation & Security
Remote Site Reliability Engineer — Automation & Security

Zachary Piper Solutions • United States

Remote
USD 110,000 - 140,000
Health benefits
Vision insurance
Dental insurance
+3
Remote SRE: Kubernetes, Terraform & Observability Lead
Remote SRE: Kubernetes, Terraform & Observability Lead

Zachary Piper Solutions • United States

Remote
USD 130,000 - 180,000
Medical insurance
Dental insurance
Vision insurance
+3