Senior SRE: Cloud-Native Reliability & Security

Ellation, Inc.

Los Angeles (CA)

On-site

USD 211,000 - 263,000

Full time

2 days ago
Be an early applicant
Application generator

Get a reply from this employer — a resume and cover letter tailored to exactly what they’re hiring for.

Get past ATS filters

Benefits offered by this job

Salary plus performance bonus
Flexible time off
Medical, dental, vision insurance
401(k) with employer match
Pet insurance

Job summary

Crunchyroll is seeking a Staff Site Reliability Engineer to join the Center for Data & Insights in the US. This senior role focuses on reliability, scalability, performance, and security of consumer-facing data platforms, partnering with Engineering, Data, Infrastructure, Product, and Security teams.

You will drive observability, incident management, capacity planning, disaster recovery, and SecOps initiatives.

Qualifications

  • 12+ years of SRE/Platform Engineering or related disciplines.
  • Deep expertise in Kubernetes and GCP for cloud-native platforms.
  • Strong IaC experience, preferably Terraform, with automation.
  • Solid Linux, networking, and distributed systems foundations.
  • Proficiency in Go, Python, Java, or Shell for automation.
  • Hands-on with modern observability platforms (Prometheus, Grafana, OpenTelemetry, Datadog).
  • Experience with incident management, capacity planning, and performance optimization.
  • Strong understanding of cloud security, container security, and CI/CD security.
  • Knowledge of security frameworks (OWASP, IAM, SSDLC) and security-by-design principles.
  • Excellent collaboration and technical leadership skills.

Responsibilities

  • Define, measure, and improve CDI platform reliability with SLIs and SLOs.
  • Lead incident management, postmortems, and service ownership across teams.
  • Build comprehensive observability, logging, tracing, and alerting capabilities.
  • Develop automation, self-service tooling, and self-healing mechanisms.
  • Design and optimize cloud-native infrastructure for scale and cost efficiency.
  • Drive IaC, platform standardization, and deployment automation.
  • Lead capacity planning and performance optimization to ensure scalable platforms.
  • Develop disaster recovery, backup, and business continuity strategies.
  • Partner with security teams to integrate SecOps controls and risk management.

Skills

Kubernetes
GCP
Terraform
IaC
Linux
Networking
Go Python Java Shell
Observability tools
SLIs SLOs Error budgets
SecOps Security practices

Tools

Prometheus
Grafana
OpenTelemetry
Datadog

Job description

Crunchyroll is seeking a Staff Site Reliability Engineer to join the Center for Data & Insights in the US. This senior role focuses on reliability, scalability, performance, and security of consumer-facing data platforms, partnering with Engineering, Data, Infrastructure, Product, and Security teams.

You will drive observability, incident management, capacity planning, disaster recovery, and SecOps initiatives.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Senior SRE — Cloud Data Platform & SecOps
Senior SRE — Cloud Data Platform & SecOps

Engg • San Francisco (CA)

On-site
USD 180,000 - 250,000
Senior Cloud-Native SRE & Platform Reliability Lead
Senior Cloud-Native SRE & Platform Reliability Lead

Engg • Los Angeles (CA)

On-site
USD 180,000 - 240,000
Staff Site Reliability Engineer
Staff Site Reliability Engineer

Engg • Los Angeles (CA)

On-site
USD 180,000 - 240,000
Staff Site Reliability Engineer
Staff Site Reliability Engineer

Engg • San Francisco (CA)

On-site
USD 180,000 - 250,000
Staff Site Reliability Engineer
Staff Site Reliability Engineer

Ellation, Inc. • Los Angeles (CA)

On-site
USD 211,000 - 263,000
Salary plus performance bonus
Flexible time off
Medical, dental, vision insurance
+2
Senior Database Reliability Engineer - 24x7 Ops & IaC
Senior Database Reliability Engineer - 24x7 Ops & IaC

Crunchyroll • San Francisco (CA)

On-site
USD 180,000 - 260,000
Competitive compensation package
Medical, dental, vision
HSA program
+4
Senior Enterprise Security Engineer - AI & Cloud
Senior Enterprise Security Engineer - AI & Cloud

Crunchyroll, LLC • Dallas (TX)

Hybrid
USD 140,000 - 200,000
Salary + bonus potential
Flexible time off
Medical, dental, vision
+3
Senior SRE: Cloud, Kubernetes & Automation
Senior SRE: Cloud, Kubernetes & Automation

Socure • Carson City (NV)

On-site
USD 150,000 - 190,000
Sr. Infrastructure Engineer – Edge & Cloud Networking
Sr. Infrastructure Engineer – Edge & Cloud Networking

Ellation, Inc. • Los Angeles (CA)

Hybrid
USD 183,000 - 229,000
Salary + Bonus
Flexible time off
Health insurance
+3
Senior SRE — Cloud Native Reliability & Observability
Senior SRE — Cloud Native Reliability & Observability

Scientific Games, LLC • Alpharetta (GA)

On-site
USD 140,000 - 190,000