Site Reliability Engineer (SRE)

ZipStaff Inc.

Scottsdale (AZ)

Hybrid

USD 120,000 - 160,000

Full time

2 days ago
Be an early applicant

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

ZipStaff Inc. is seeking a Site Reliability Engineer to support large-scale enterprise applications from Scottsdale, AZ in a hybrid, contract role.

The position focuses on cloud-native operations, observability, automation, and production support across on-prem and cloud environments. You will develop automation scripts, build APM dashboards, and implement OTEL observability while participating in 24x7 on-call rotations and incident response.

Qualifications

  • 5+ years in Site Reliability or related roles for large-scale apps.
  • 5 years creating automation scripts and end-to-end monitoring dashboards.
  • 3+ years programming in Go, Python, Java, or Rust.

Responsibilities

  • Support production operations and reliability for large-scale, high-performance applications.
  • Develop automation scripts and build APM dashboards to monitor end-to-end transaction journeys.
  • Implement observability using OpenTelemetry (OTEL), distributed tracing, monitoring, and incident management.
  • Manage containerized applications in Kubernetes environments (GKE, RKE, or AKS).
  • Support cloud migration and containerization initiatives (GCP, AWS, Azure, Rancher, OpenShift, or similar).
  • Participate in 24x7 on-call rotations and meet incident-response SLAs.
  • Troubleshoot distributed systems, networking, and API gateway issues.
  • Partner with engineering and operations teams to improve reliability, automation, and operational excellence.

Skills

Automation scripting
APM dashboards
Observability
Programming languages
Networking fundamentals
On-call rotations

Tools

Kubernetes
OpenTelemetry
Prometheus/Grafana
Splunk
Dynatrace
AppDynamics
GKE
RKE
AKS
OpenShift
GCP
AWS
Azure

Job description

Job Title: Site Reliability Engineer (SRE). Location: Scottsdale / Shea, AZ (Hybrid). Employment Type: Contract (W2 through ZipStaff).

About the Opportunity:

ZipStaff is seeking a Site Reliability Engineer to support large-scale enterprise applications for a major healthcare organization.

This is a hybrid role based at the Shea, AZ location and focused on cloud-native operations, observability, automation, and production support across hybrid (on-premises and cloud) environments. Immediate availability is preferred.

What You’ll Do:
  • Support production operations and reliability for large-scale, high-performance applications.
  • Develop automation scripts and build APM dashboards to monitor end-to-end transaction journeys.
  • Implement observability using OpenTelemetry (OTEL), distributed tracing, monitoring, and incident management.
  • Manage containerized applications in Kubernetes environments (GKE, RKE, or AKS).
  • Support cloud migration and containerization initiatives (GCP, AWS, Azure, Rancher, OpenShift, or similar).
  • Participate in 24x7 on-call rotations and meet incident-response SLAs.
  • Troubleshoot distributed systems, networking, and API gateway issues.
  • Partner with engineering and operations teams to improve reliability, automation, and operational excellence.
Required Qualifications:
  • 5 years of experience in Site Reliability Engineering, Production Operations, or Platform Engineering supporting large-scale applications in hybrid environments.
  • 5 years developing automation scripts and building APM dashboards for end-to-end transaction monitoring.
  • 3+ years of hands‑on programming in one or more of: Go, Python, Java, or Rust.
  • Working knowledge of relational and/or NoSQL databases (Oracle, SQL Server, PostgreSQL, MongoDB, Redis, ClickHouse, PL/SQL, or time‑series databases).
  • Experience with cloud migration and containerization (GCP, AWS, Azure, Rancher, OpenShift, or similar).
  • Experience managing containers in Kubernetes (GKE, RKE, or AKS).
  • Strong experience implementing observability (OTEL, distributed tracing, monitoring, incident management).
  • Strong networking fundamentals (TCP/IP, HTTP, DNS, load balancing, service mesh).
  • Experience participating in 24x7 on‑call rotations and meeting incident SLAs.
  • Ability to work hybrid in Scottsdale / Shea, AZ.
  • Must be legally authorized to work in the United States without sponsorship now or in the future.
Preferred Qualifications:
  • Experience managing highly available, customer‑facing platforms.
  • Hands‑on experience with Splunk, Dynatrace, AppDynamics, Grafana, and/or Prometheus.
  • Experience with CI/CD and Agile tools (Rally, Confluence, DevOps platforms).
  • Knowledge of in‑memory caching, especially Redis.
  • Strong troubleshooting across distributed systems and API gateways.
  • Experience with Google Cloud services (GCS, Cloud SQL, Spanner, BigQuery).
  • Experience supporting HashiCorp Vault.
  • Exposure to Vertex AI, Generative AI, or cloud analytics platforms.
  • Familiarity with GraphQL frameworks (Apollo, Prisma, or Hasura).
About ZipStaff:

ZipStaff partners with leading organizations to connect skilled technology professionals with high‑impact contract opportunities. We focus on quality matches and long‑term success.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Senior AI-Enabled Platform / SRE Engineer
Senior AI-Enabled Platform / SRE Engineer

ZipStaff Inc. • Dallas (TX)

Hybrid
USD 124,000 - 207,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

Storm2 • Scottsdale (AZ)

Hybrid
USD 140,000 - 150,000
Competitive healthcare, dental, and vision coverage
401(k) with company match
Generous PTO and paid holidays
+1
Site Reliability Engineer
Site Reliability Engineer

TalentDome Staffing • United States

On-site
USD 140,000 - 210,000
Site Reliability Engineer (SRE)
Site Reliability Engineer (SRE)

Randstad Digital Americas • Plano (TX)

On-site
USD 115,000 - 125,000
Medical insurance
401K plan
Principal Site Reliability Engineer (SRE)
Principal Site Reliability Engineer (SRE)

Symmetrio • United States

Hybrid
USD 120,000 - 160,000
Health Care Plan (Medical, Dental & Vision)
Retirement Plan (401k, IRA)
Paid Time Off (Vacation, Sick & Public Holidays)
Lead Site Reliability Engineer (SRE) / Principal Site Reliability Engineer (SRE)
Lead Site Reliability Engineer (SRE) / Principal Site Reliability Engineer (SRE)

Mindlance • Irving (TX)

Hybrid
USD 120,000 - 160,000
Site Reliability Engineer
Site Reliability Engineer

Knack Solutions • Richmond (VA)

On-site
USD 100,000 - 130,000
Site Reliability Engineer
Site Reliability Engineer

Stelvio Inc. • Town of Texas (WI)

On-site
USD 125,000 - 145,000
Site Reliability Engineer
Site Reliability Engineer

Request Technology, LLC • Chicago (IL)

Hybrid
USD 150,000 - 155,000
Site Reliability Engineer
Site Reliability Engineer

Dexian • Chandler (AZ)

Hybrid
USD 120,000 - 160,000