Night-Shift SRE (Remote) – AWS/ROSA & Observability

Peraton

Herndon (VA)

On-site

USD 104,000 - 166,000

Full time

4 days ago
Be an early applicant

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

Peraton is seeking a Site Reliability Engineer (SRE) to join a team responsible for the reliability of production systems running in AWS Commercial and AWS GovCloud environments, including ROSA/OpenShift. The SRE collaborates with platform, security, and application teams to meet reliability and security requirements.

The role is remote with a night shift (11pm–7am EST), involving on-call incident response, deployment automation, and ongoing improvement of observability and resilience across

Qualifications

  • U.S. Citizen with ability to obtain Public Trust clearance.
  • Bachelor's Degree with 8+ years of experience or HS diploma with 12+ years.
  • 7+ years hands-on SRE/DevOps/production systems experience.
  • Experience in AWS Commercial and GovCloud; ROSA or Kubernetes-based platforms.
  • Infrastructure-as-code with Terraform and Ansible.
  • CI/CD experience with GitLab and Jenkins; reliability gating.
  • Proficient in Linux and Windows Server administration.
  • Observability tools such as Dynatrace, Datadog, Splunk, OpenTelemetry.
  • Ownership of an SLI/SLO and alerting program, error budgets, noise reduction.
  • Scripting in Python, Bash, PowerShell, or Go.
  • Experience in federal/regulatory environments (FISMA, FedRAMP, NIST 800-53).

Responsibilities

  • Operate and maintain production infrastructure ensuring availability, reliability, performance, security.
  • Monitor services using SLIs/SLOs, dashboards, alerts; improve detection and resolution.
  • Define observability requirements with application teams and implement metrics, logs, traces, dashboards.
  • Manage production incidents including on-call response, troubleshooting, and post-incident actions.
  • Release applications and infrastructure via established pipelines with staging and production gates.
  • Manage lifecycle: upgrades, patching, configuration changes, maintenance, and refreshes.
  • Improve service resilience via capacity planning, DR, backup, and failover testing.
  • Identify reliability risks using metrics and incident trends to prioritize improvements.
  • Automate operations with an everything-as-code approach for consistency and efficiency.
  • Collaborate with platform and app teams to improve reliability and operability.

Skills

SRE / DevOps experience
Cloud platforms AWS
OpenShift ROSA / Kubernetes
IaC (Terraform, Ansible)
CI/CD (GitLab, Jenkins)
Linux administration
Windows Server administration
Observability tools (Dynatrace, Datadq
Scripting (Python, Bash, PowerShell,Go
Regulatory environments (FISMA, FedRMP

Education

Bachelor's Degree or equivalent experience
High School diploma/equivalent with 12 years experience

Tools

Terraform
Ansible
GitLab
Jenkins
Dynatrace
Datadog
Splunk
OpenTelemetry

Job description

Peraton is seeking a Site Reliability Engineer (SRE) to join a team responsible for the reliability of production systems running in AWS Commercial and AWS GovCloud environments, including ROSA/OpenShift. The SRE collaborates with platform, security, and application teams to meet reliability and security requirements.

The role is remote with a night shift (11pm–7am EST), involving on-call incident response, deployment automation, and ongoing improvement of observability and resilience across

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Remote Night-Shift SRE — Cloud Infra Reliability
Remote Night-Shift SRE — Cloud Infra Reliability

Peraton • Reston (VA)

On-site
USD 104,000 - 166,000
Remote Evening SRE: ROSA & AWS Observability Expert
Remote Evening SRE: ROSA & AWS Observability Expert

Peraton • Northern (KY)

Hybrid
USD 104,000 - 166,000
Remote Night-Shift SRE: AWS/GovCloud Reliability Engineer
Remote Night-Shift SRE: AWS/GovCloud Reliability Engineer

Peraton • Northern (KY)

Hybrid
USD 104,000 - 166,000
Evening SRE – Remote Cloud & OpenShift Reliability Engineer
Evening SRE – Remote Cloud & OpenShift Reliability Engineer

Peraton • Reston (VA)

On-site
USD 104,000 - 166,000
Evening SRE - Remote Cloud Reliability Engineer (AWS/ROSA)
Evening SRE - Remote Cloud Reliability Engineer (AWS/ROSA)

Peraton • Herndon (VA)

On-site
USD 104,000 - 166,000
External Job Posting Title Site Reliability Engineer (SRE) – Night Shift
External Job Posting Title Site Reliability Engineer (SRE) – Night Shift

Peraton • Northern (KY)

Hybrid
USD 104,000 - 166,000
Senior SRE - Remote Observability & Reliability Leader
Senior SRE - Remote Observability & Reliability Leader

DOMA Technologies • Leesburg (VA)

Remote
USD 120,000 - 150,000
Remote SRE — Scale, Resilience & Observability
Remote SRE — Scale, Resilience & Observability

Bright Vision Technologies • United States

On-site
USD 100,000 - 150,000
Competitive base salary
Health benefits
Long-term stability
Remote SRE II: Cloud, Data Ops & Incident Response
Remote SRE II: Cloud, Data Ops & Incident Response

Cohere Health, Inc. • Boston (MA)

Hybrid
USD 100,000 - 110,000
Fully remote
5% travel
Medical insurance
+7
Remote SRE Lead - Incident, Reliability & Observability
Remote SRE Lead - Incident, Reliability & Observability

NightDragon Acquisition Corp. • United States

On-site
USD 260,000 - 280,000
Hybrid & Remote Work
Competitive Compensation
Equity package