Senior SRE: Cloud Reliability & Automation

Palo Alto Networks, Inc.

Santa Clara (CA)

On-site

USD 152,000 - 246,000

Full time

4 days ago
Be an early applicant
Application generator

Turn this role into an interview — a resume and cover letter built around what this employer wants.

Get past ATS filters

Job summary

Palo Alto Networks is seeking a Principal Site Reliability Engineer for the ADEM team to deliver end-to-end visibility, self-healing capabilities, and reliability across global services. The role emphasizes automation, architecture, performance, observability, security, and IaC/Monitoring as Code, with a stack including Terraform, Kubernetes, GitLab CI, ArgoCD, Prometheus, Grafana, and cloud platforms.

Candidates will work with developers, researchers, and data scientists to produce scalable,

Qualifications

  • Must be a U.S. citizen due to federal government requirements.
  • 7+ years as an engineer in infrastructure, operations, DevOps, or system engineering.
  • Familiar with AI productivity tools such as Claude code, Cursor, Windsurf, or GitHub Copilot.
  • Expertise building high-availability, scalable cloud-native apps on GCP (preferred) or AWS.
  • IaC experience with Terraform, Helm, and Ansible.
  • Strong programming in Python, Go, or Java; Kafka or Pulsar experience is a plus.
  • Deep Kubernetes expertise (GKE/EKS), container networking, Linux internals.
  • Experience with GitOps tools like GitLab CI and ArgoCD.
  • Familiarity with FedRAMP, SOC2 and policy-as-code automation.
  • Excellent communication across multi-functional teams.
  • BS or MS in CS or equivalent professional/military experience.

Responsibilities

  • Drive SRE and DevOps success via CI/CD and AIOps initiatives toward self-healing infra.
  • Architect Golden Paths for service delivery with integrated SLOs and canary analysis.
  • Design, build, and operate reliable cloud infrastructure for high-scale observability.
  • Ensure production-ready, scalable, and resilient apps in collaboration with engineers.
  • Develop IaC and Monitoring as Code frameworks and automation tools.
  • Lead RCA of critical issues and drive preventive improvements.

Skills

SRE/DevOps
Cloud-native apps
Kubernetes
GCP/AWS
Python/Go/Java

Education

BS or MS in Computer Science

Tools

Terraform
Helm
Ansible
GitLab CI
ArgoCD
Prometheus
Grafana
Loki
Docker
GCP
AWS
Vault
Kafka
Go

Job description

Palo Alto Networks is seeking a Principal Site Reliability Engineer for the ADEM team to deliver end-to-end visibility, self-healing capabilities, and reliability across global services. The role emphasizes automation, architecture, performance, observability, security, and IaC/Monitoring as Code, with a stack including Terraform, Kubernetes, GitLab CI, ArgoCD, Prometheus, Grafana, and cloud platforms.

Candidates will work with developers, researchers, and data scientists to produce scalable,

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Principal SRE — Cloud Reliability & Self-Healing AI
Principal SRE — Cloud Reliability & Self-Healing AI

Palo Alto Networks • California (MO)

On-site
USD 152,000 - 246,000
Cloud SRE Architect — Automation & Reliability Lead
Cloud SRE Architect — Automation & Reliability Lead

Jobs Paloaltonetworks • California (MO)

On-site
USD 152,000 - 246,000
Senior SRE Manager: Reliability, Automation & Leadership
Senior SRE Manager: Reliability, Automation & Leadership

Palo Alto Networks, Inc. • Santa Clara (CA)

On-site
USD 180,000 - 260,000
Lead Cloud SRE & AI-Driven Infra Architect
Lead Cloud SRE & AI-Driven Infra Architect

Palo Alto Networks, Inc. • Santa Clara (CA)

On-site
USD 130,000 - 170,000
Employee benefits
Diverse workplace
Senior SRE – Observability & Cloud Reliability
Senior SRE – Observability & Cloud Reliability

Palo Alto Networks • Santa Clara (CA)

On-site
USD 133,000 - 215,000
Principal Cloud SRE & Automation Engineer
Principal Cloud SRE & Automation Engineer

Palo Alto Networks, Inc. • Santa Clara (CA)

On-site
USD 151,000 - 246,000
Senior SRE: AI-Driven, Cloud-Native Reliability (Hybrid)
Senior SRE: AI-Driven, Cloud-Native Reliability (Hybrid)

OutSystems • San Francisco (CA)

Hybrid
USD 140,000 - 210,000
Hybrid work model
Senior Staff DevOps Engineer - Cloud Reliability Automation
Senior Staff DevOps Engineer - Cloud Reliability Automation

Jobs Paloaltonetworks • California (MO)

On-site
USD 133,000 - 215,000
Senior SRE - AI-Powered Cloud Reliability (Remote)
Senior SRE - AI-Powered Cloud Reliability (Remote)

ServiceTitan, Inc. • Northern (KY)

Hybrid
USD 148,000 - 221,000
Senior SRE: Automate Reliability & Observability
Senior SRE: Automate Reliability & Observability

United States Digital Space LLC • Charlotte (TX)

On-site
USD 153,000 - 192,000
Discretionary incentive eligible
Benefits package