Senior Kubernetes Platform Reliability Engineer

IONOS

Alcobendas

Híbrido

EUR 90.000 - 120.000

Jornada completa

14 días+

Recibe más respuestas de empleadores

Envía un currículum específico para el puesto de trabajo en cuestión de minutos.

Ventajas ofrecidas por este puesto de trabajo

Hybrid work model
Flexible compensation package
Discounts on Arsys products
Discounts on technology brands
Challenging technical environment
Access to advanced AI tools
Close collaboration with senior profиI

Descripción de la vacante

IONOS is building a Data-Driven Cloud Big Data platform hosted on our internal cloud. You will own platform operations, ensuring stability of a Kubernetes-based ecosystem and supporting internal users running Docker containers.

The role emphasizes deep troubleshooting, collaboration in 2-week sprints, and continuous improvement of runbooks and monitoring across a high-performance environment. Ideal candidates have 5+ years in SRE/infra ops, strong Kubernetes/Docker capabilities, and proficiency

Formación

  • 5+ years in Systems Operations, SRE, or Infrastructure Operations.
  • Kubernetes & Docker core platform operations, including pod lifecycle, ingress/service issues, and resource limits.
  • Strong troubleshooting mindset with habit of reading logs, analyzing metrics, and diagnosing failures.
  • Solid Linux fundamentals: CLI, processes, logs, recovery.
  • Experience with operational DevOps tooling (ArgoCD, Helm, Terraform).
  • Observability stack experience (Prometheus, Grafana); familiarity with Airflow, Trino, Hive, OpenShift is a plus.
  • Networking basics for troubleshooting DNS, TCP/IP, load balancers, and policies.
  • Ownership mindset, proactive collaboration, and knowledge sharing.
  • Good English communication to work with platform users and international teams.

Responsabilidades

  • Platform Operations & Stability: run, maintain, and monitor the Kubernetes-based cloud Big Data platform.
  • Troubleshooting & L2/L3 Incident Response: diagnose failures from logs and metrics, coordinate with users and teams.
  • User Application Operations: support internal apps running on Docker/Kubernetes, ensure health and scalability.
  • Root Cause Analysis (RCA): identify underlying causes and prevent recurrence.
  • Agile Collaboration: work in 2-week sprints addressing operational tickets and platform health tasks.
  • Continuous Operational Improvement: refine runbooks, monitoring, and incident response to reduce MTTR.

Conocimientos

Troubleshooting mindset
Linux fundamentals
Strong communication
English proficiency
Autonomy
Ownership

Herramientas

Kubernetes
Docker
ArgoCD
Helm
Terraform
Prometheus
Grafana
Airflow
Trino
Hive
OpenShift

Descripción del empleo

IONOS is building a Data-Driven Cloud Big Data platform hosted on our internal cloud. You will own platform operations, ensuring stability of a Kubernetes-based ecosystem and supporting internal users running Docker containers.

The role emphasizes deep troubleshooting, collaboration in 2-week sprints, and continuous improvement of runbooks and monitoring across a high-performance environment. Ideal candidates have 5+ years in SRE/infra ops, strong Kubernetes/Docker capabilities, and proficiency

Consigue la evaluación confidencial y gratuita de tu currículum.
o arrastra y suelta tu archivo aquí
Similar jobs

Puestos de trabajo similares que vale la pena comparar

Senior Cloud Data Platform DevOps Engineer
Senior Cloud Data Platform DevOps Engineer

IONOS Group • Madrid

Híbrido
EUR 50.000 - 70.000
Health insurance
Daycare allowance
Meal vouchers
+2
Senior Platform Operations Engineer (DevOps - Ops Focus)
Senior Platform Operations Engineer (DevOps - Ops Focus)

IONOS • Alcobendas

Híbrido
EUR 90.000 - 120.000
Hybrid work model
Flexible compensation package
Discounts on Arsys products
+4
Senior DevOps Engineer – Data Platform & Cloud Ops
Senior DevOps Engineer – Data Platform & Cloud Ops

IONOS Group • Barcelona

Híbrido
EUR 50.000 - 70.000
Health insurance
Flexible working hours
Meal vouchers
+3
AI Platform SRE: Kubernetes, GitOps & Observability
AI Platform SRE: Kubernetes, GitOps & Observability

IGLUBIT • Sevilla

Híbrido
EUR 60.000 - 90.000
Health insurance
Meal vouchers
Childcare support
+4
Senior Cloud Data Platform Engineer - Full Ownership
Senior Cloud Data Platform Engineer - Full Ownership

IONOS • Alcobendas

Híbrido
EUR 65.000 - 90.000
Hybrid work
Flexible compensation
Arsys/Tech discounts
+3
Staff Site Reliability Engineer
Staff Site Reliability Engineer

Hydrolix • España

Presencial
EUR 70.000 - 90.000
Senior Site Reliability Engineer — Reliability & Platform Ops
Senior Site Reliability Engineer — Reliability & Platform Ops

Codeway • Barcelona

Presencial
EUR 85.000 - 120.000
Senior SRE: Scale, Automation & Observability
Senior SRE: Scale, Automation & Observability

Hydrolix • España

Presencial
EUR 70.000 - 90.000
Senior Cloud Reliability Engineer - Kubernetes & AWS
Senior Cloud Reliability Engineer - Kubernetes & AWS

N26 • Barcelona

Híbrido
EUR 80.000 - 120.000
Work from home budget
Office days for teamwork weekly
Premium N26 personal account access
+2
Hybrid Cloud-Native SRE: Kubernetes & Automation
Hybrid Cloud-Native SRE: Kubernetes & Automation

Nexthink SA • Madrid

Híbrido
EUR 60.000 - 80.000
Health insurance
Unlimited vacation
Flexible hours
+1