SRE DevOps Engineer - 99.9% Uptime, Multi-Cloud

IT Veterans

Washington (District of Columbia)

On-site

USD 120,000 - 180,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

IT Veterans is seeking a DevOps Site Reliability Engineer (SRE) to ensure reliability, performance, and 99.9% uptime for a mission-critical DoD platform in Washington, DC. The role blends development and operations, focusing on automated deployment, robust monitoring, incident response, and system automation across multi-cloud environments.

You will design dashboards, respond to incidents, and drive resilience.

Qualifications

  • TS/SCI security clearance required.
  • Strong understanding of Site Reliability Engineering (SRE) principles.
  • Hands-on experience deploying containerized apps with Kubernetes.
  • Experience managing multi-cloud environments (GCP, Azure, AWS).
  • Experience with enterprise monitoring, logging, and alerting.

Responsibilities

  • Monitor health and performance of enterprise infrastructure with automated telemetry.
  • Participate in on-call rotation and respond to incidents within one hour.
  • Develop and maintain automation scripts and internal tools.
  • Design dashboards for real-time platform health and uptime metrics.
  • Coordinate with cloud providers during outages to speed resolution.
  • Continuously assess reliability, logging, monitoring, and architecture.

Skills

SRE principles
On-call incident response
Automation scripting (Python/Bash)

Tools

Kubernetes
GCP
Azure
AWS
Monitoring & logging tools

Job description

IT Veterans is seeking a DevOps Site Reliability Engineer (SRE) to ensure reliability, performance, and 99.9% uptime for a mission-critical DoD platform in Washington, DC. The role blends development and operations, focusing on automated deployment, robust monitoring, incident response, and system automation across multi-cloud environments.

You will design dashboards, respond to incidents, and drive resilience.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

DevOps Site Reliability Engineer (SRE)
DevOps Site Reliability Engineer (SRE)

IT Veterans • Washington

On-site
USD 120,000 - 180,000
Senior SRE: 99.9% Uptime in Multi-Cloud
Senior SRE: 99.9% Uptime in Multi-Cloud

Gridiron IT • Arlington (VA)

On-site
USD 120,000 - 210,000
Medical Insurance
401(k) Plan
Disability & ADD Insurance
+1
Site Reliability Engineer
Site Reliability Engineer

Gridiron IT • Arlington (VA)

On-site
USD 120,000 - 210,000
Medical Insurance
401(k) Plan
Disability & ADD Insurance
+1
Senior DevOps Engineer — SRE & Cloud Automation
Senior DevOps Engineer — SRE & Cloud Automation

Communications Training Analysis Corporation • Falls Church (VA)

Hybrid
USD 110,000 - 140,000
SRE / DevOps Engineer: Cloud-Native Reliability & Automation
SRE / DevOps Engineer: Cloud-Native Reliability & Automation

Ampcus Inc • McLean (VA)

On-site
USD 95,000 - 125,000
Sr. Site Reliability Engineer
Sr. Site Reliability Engineer

CruitZi • Washington

Hybrid
USD 120,000 - 150,000
Site Reliability Engineer: Build Resilient, Automated Cloud
Site Reliability Engineer: Build Resilient, Automated Cloud

SRE • Puerto Rico

Hybrid
USD 120,000 - 180,000
Remote DevOps & SRE Engineer | CI/CD, Kubernetes, Cloud
Remote DevOps & SRE Engineer | CI/CD, Kubernetes, Cloud

United States Digital Space LLC • United States

Remote
Senior Site Reliability Engineer (SRE) – Automation & Cloud Ops
Senior Site Reliability Engineer (SRE) – Automation & Cloud Ops

Knack Solutions • Reston (VA)

On-site
USD 120,000 - 160,000
Senior DevOps & SRE — Multi-Cloud Reliability (Remote)
Senior DevOps & SRE — Multi-Cloud Reliability (Remote)

AgileEngine, LLC. • San Francisco (CA)

On-site
USD 150,000 - 190,000
Growth without limits
Competitive compensation
Remote work 100% with flexible hours
+3