Senior SRE: Cloud Reliability & Automation Leader

Roche & Company

Madrid

Presencial

EUR 70.000 - 100.000

Jornada completa

Hace 4 días
Sé de los primeros/as/es en solicitar esta vacante
Generador de candidaturas

Una candidatura completa en un minuto: currículum y carta de presentación adaptados, listos para enviar.

Supera los filtros ATS

Descripción de la vacante

Roche is building a global Site Reliability Engineering team to design, build and scale reliable distributed systems powering healthcare platforms. The role emphasizes reliability, automation and operational excellence with on-call rotation.

You will craft SLIs/SLOs, review services for reliability, and lead capacity planning across AWS/Azure environments, using Terraform and Kubernetes to improve efficiency and uptime.

Formación

  • Minimum bachelor’s degree in computer science, engineering, or related field, or equivalent professional experience.
  • Experience in site reliability engineering, software engineering or related fields with production on-call experience.
  • Solid experience with AWS and/or Azure, including setting up, monitoring, and maintaining cloud resources.

Responsabilidades

  • Define and implement SLIs, SLOs, and error budgets with product and engineering teams.
  • Conduct reliability reviews for new and existing services.
  • Design scalable, fault-tolerant architectures in AWS and Azure environments.
  • Lead capacity planning, performance and cost optimization initiatives.
  • Improve system resilience through automation and self-healing patterns.
  • Drive organizational observability maturity (metrics, logs, traces, alert quality).
  • Perform complex root cause analysis and drive rapid mitigation.
  • Participate in blameless postmortems and follow-through.
  • Improve MTTR, reduce incident frequency, and elevate production standards.
  • Collaborate with engineering teams to enable timely resolutions.
  • Handle requests and incidents, create and maintain runbooks.
  • Participation in a structured 24x7 on-call rotation.
  • Reduce operational toil through tooling and automation (Python or similar).
  • Improve CI/CD reliability and deployment safety mechanisms.
  • Build and maintain IaC (Terraform or equivalent).
  • Enhance Kubernetes platform reliability (EKS, AKS, or similar).
  • Partner with teams to embed reliability early in SDLC.
  • Mentor engineers and shape SRE practices.

Conocimientos

On-call experience
AWS/Azure
Observability tools
Incident management tools
Python scripting
Troubleshooting
Software engineering
English communication

Educación

Bachelor's degree in CS/engineering

Herramientas

AWS
Azure
Kubernetes
Terraform

Descripción del empleo

Roche is building a global Site Reliability Engineering team to design, build and scale reliable distributed systems powering healthcare platforms. The role emphasizes reliability, automation and operational excellence with on-call rotation.

You will craft SLIs/SLOs, review services for reliability, and lead capacity planning across AWS/Azure environments, using Terraform and Kubernetes to improve efficiency and uptime.

Consigue la evaluación confidencial y gratuita de tu currículum.
o arrastra y suelta tu archivo aquí
Similar jobs

Puestos de trabajo similares que vale la pena comparar

Senior SRE: Global Reliability & Cloud Automation
Senior SRE: Global Reliability & Cloud Automation

F. Hoffmann-La Roche AG • Sant Cugat del Vallès

Presencial
EUR 50.000 - 75.000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

F. Hoffmann-La Roche AG • Sant Cugat del Vallès

Presencial
EUR 50.000 - 75.000
Remote Senior SRE: Reliability, Automation & Observability
Remote Senior SRE: Reliability, Automation & Observability

QAD • Barcelona

Presencial
EUR 70.000 - 115.000
Senior SRE Engineer: Cloud-Native Automation Leader
Senior SRE Engineer: Cloud-Native Automation Leader

Stellar Cyber • España

A distancia
EUR 100.000 - 130.000
Remote Senior SRE: Reliability & Automation Leader
Remote Senior SRE: Reliability & Automation Leader

QAD • Barcelona

Presencial
EUR 90.000 - 150.000
Senior SRE: Reliability, Incidents & Automation
Senior SRE: Reliability, Incidents & Automation

Camlin Group • Málaga

Presencial
EUR 90.000 - 120.000
Senior SRE - Multi-Cloud Reliability (Remote)
Senior SRE - Multi-Cloud Reliability (Remote)

Palo Alto Networks • Madrid

Presencial
EUR 75.000 - 110.000
Senior SRE: AI Platform & Cloud Reliability
Senior SRE: AI Platform & Cloud Reliability

Doist • Barcelona

Híbrido
EUR 85.000 - 120.000
Hybrid onboarding
Health insurance
Professional development budget
+4
Senior SRE: Scale, Automation & Observability
Senior SRE: Scale, Automation & Observability

Hydrolix • España

Presencial
EUR 70.000 - 90.000
Senior Cloud DevOps Engineer – Global Infra
Senior Cloud DevOps Engineer – Global Infra

Roche & Company • Madrid

Presencial
EUR 90.000 - 120.000