Senior Observability SRE – Kubernetes & Cloud

Cisco

San Francisco (CA)

Sur place

USD 168 000 - 245 000

Plein temps

Il y a 6 jours
Soyez parmi les premiers à postuler
Générateur de candidature

Une candidature complète en une minute — un CV et une lettre de motivation personnalisés, prêts à envoyer.

Passez les filtres ATS

Résumé du poste

Cisco is seeking a Senior Site Reliability Engineer within the Observability team of Cloud Network Platform Engineering. You will design, deploy, operate, and improve enterprise observability platforms for logs, metrics, traces, and alerts across large-scale cloud infrastructure.

Initial focus on Kubernetes-based workloads (Nextunnel) and broader SRE initiatives will follow. Responsibilities include building Splunk Enterprise/Cloud infra, Elasticsearch clusters, Grafana Tempo/OpenTelemetry

Qualifications

  • 7+ years of experience in Site Reliability Engineering or related field.
  • Experience administering Splunk Enterprise or Splunk Cloud in a production environment.
  • Solid understanding of Splunk SPL and production dashboards, alerts, analytics.
  • Experience designing, deploying, and operating Elasticsearch/ELK-based platforms.
  • Experience with Prometheus, Grafana, OpenTelemetry, Kafka, and distributed tracing.

Responsabilités

  • Design, deploy, operate, and improve enterprise observability platforms for logging, metrics, tracing, and alerting.
  • Build and maintain monitoring stacks including Splunk, Elasticsearch, Prometheus, Grafana, and Tempo.
  • Develop data instrumentation standards, retention policies, and observability patterns.
  • Automate infrastructure provisioning and configuration using Terraform and Ansible.
  • Participate in capacity planning, performance tuning, upgrades, and incident response.
  • Lead cross-functional collaboration to improve reliability and operational excellence.

Connaissances

SRE Experience
Distributed systems
On-call operations
Communication skills

Outils

Splunk Enterprise
Splunk Cloud
Elasticsearch
Tempo/OpenTelemetry
Prometheus
Grafana
Kibana
Kafka
Terraform
Ansible
AWS
Azure
GCP
Kubernetes
CI/CD

Description du poste

Cisco is seeking a Senior Site Reliability Engineer within the Observability team of Cloud Network Platform Engineering. You will design, deploy, operate, and improve enterprise observability platforms for logs, metrics, traces, and alerts across large-scale cloud infrastructure.

Initial focus on Kubernetes-based workloads (Nextunnel) and broader SRE initiatives will follow. Responsibilities include building Splunk Enterprise/Cloud infra, Elasticsearch clusters, Grafana Tempo/OpenTelemetry

Obtenez votre examen gratuit et confidentiel de votre CV.

ou faites glisser et déposez votre fichier ici.

Similar jobs

Postes similaires à comparer

Senior SRE - Observability & Cloud Reliability
Senior SRE - Observability & Cloud Reliability

Cisco Systems, Inc. • San Francisco (CA)

Sur place
USD 168 000 - 245 000
Medical benefits
401(k) matching
Parental leave
+1
Senior SRE: Observability & Cloud Platform Engineer
Senior SRE: Observability & Cloud Platform Engineer

Cisco • San Francisco (CA)

Sur place
USD 168 000 - 245 000
Medical, dental, and vision insurance
401(k) with Cisco matching
Paid parental leave
+3
Senior SRE - Observability & Cloud Platform Lead
Senior SRE - Observability & Cloud Platform Lead

Cisco • Nashville (TN)

Sur place
USD 168 000 - 245 000
Senior Site Reliability Engineer – Observability
Senior Site Reliability Engineer – Observability

Cisco • Boise (ID)

Sur place
USD 120 000 - 170 000
Senior Site Reliability Engineer: Observability & Cloud
Senior Site Reliability Engineer: Observability & Cloud

VBeyond Corporation • Jersey City (NJ)

Sur place
USD 100 000 - 260 000
Senior Observability & Reliability Engineer
Senior Observability & Reliability Engineer

Cisco • Boise (ID)

Sur place
USD 120 000 - 170 000
Site Reliability Engineer - Kubernetes & Cloud
Site Reliability Engineer - Kubernetes & Cloud

Hydrolix • États-Unis

Sur place
USD 110 000 - 150 000
Cloud SRE & Automation Engineer
Cloud SRE & Automation Engineer

Cisco Systems, Inc • Milpitas (CA)

Sur place
USD 155 000 - 223 000
Medical, dental and vision insurance
401(k) with Cisco matching
Paid parental leave
+1
Cloud SRE – Kubernetes, Observability & Reliability
Cloud SRE – Kubernetes, Observability & Reliability

TP-Link Systems Inc. • Irvine (CA)

Sur place
USD 100 000 - 140 000
Free snacks and drinks
Fridays lunch provided
Fully paid medical, dental, and vision
+3
Senior Observability & SRE Engineer (GCP/Kubernetes)
Senior Observability & SRE Engineer (GCP/Kubernetes)

Ontrac Solutions • New York (NY)

Sur place
USD 120 000 - 190 000