(Senior) Site Reliability Engineer - STACKIT Control Plane (m/w/d)

emplify GmbH

Bad Friedrichshall

Vor Ort

EUR 90.000 - 130.000

Vollzeit

vor 34 Stunden
Sei unter den ersten Bewerbenden
Bewerbungsgenerator

Verschicke keinen generischen Lebenslauf — erstelle einen Lebenslauf und ein Anschreiben, die genau auf diese Rolle zugeschnitten sind.

Schaffe es an den ATS-Filtern vorbei

Zusammenfassung

emplify GmbH in Baden-Württemberg sucht eine erfahrene Reliability/Platform-Engineer, die Großsysteme betreibt, Cloud-Infrastruktur verbessert und Zuverlässigkeit sicherstellt. Du arbeitest eng mit Entwicklungsteams zusammen, optimierst CI/CD-Pipelines und gestaltest Canary-/Blue/Green-Deployments.

Du bringst Kubernetes-Expertise, Go-Kenntnisse und fundierte IaC-/Linux-Kenntnisse mit. On-Call-Rotation, Incident-Response und Post-Mortems gehören dazu; du arbeitest an der Schnittstelle von

Qualifikationen

  • Mehr als 3 Jahre Erfahrung in SRE/DevOps/Platform Engineering.
  • Expertenwissen über Kubernetes Control Plane (API Server, Controller Manager, Scheduler, etcd).
  • Go sicher beherrschen und produktionsreifen Code schreiben.
  • Fundierte Erfahrung mit Infrastructure as Code, Container-Infrastrukturen, Linux-Interna und Networking.
  • Erfahrung im Betrieb von Datastores (PostgreSQL, Redis) und Messaging-Systemen (Kafka, NATS).
  • Analytisch arbeiten, Automatisierung vorantreiben, proaktiv Lernen und Verantwortung übernehmen.

Aufgaben

  • Time-to-Detect verbessern durch Monitoring- und Alerting-Verbesserungen und SLO-Einhaltung.
  • Time-to-Mitigation durch Playbooks, Dashboards für First Responder und Telemetriedaten sicherstellen.
  • Reliability-Consultant unterstützen, Reliability-Patterns vermitteln und Shift-Left-Ansatz fördern.
  • CI/CD-Pipelines gestalten und Progressive-Delivery-Strategien (Canary, Blue/Green) unterstützen.
  • Kontrollebene Skalierbarkeit analysieren und Engpässe in Distributed-Consensus, DB-Durchsatz und Kernel-Networking beheben.
  • On-Call-Rotation, Incident-Responses leiten, Post-Mortems und Root-Cause-Analysen moderieren.

Kenntnisse

SRE/DevOps
Kubernetes-Kenntnisse
Go-Programmierung
Infrastructure as Code
Linux Networking
Datenbanken & Messaging
Problemlösung & Automatisierung

Jobbeschreibung

place Bad Friedrichshall calendar_today 15.09.2026 business Schwarz Digits

  • Du bringst mehr als 3 Jahre Erfahrung in Site Reliability Engineering, DevOps oder Platform Engineering mit, wobei dein Fokus auf dem Betrieb großer verteilter Systeme in Produktionsumgebungen liegt.
  • Du besitzt Expertenwissen über die Interna der Kubernetes Control Plane, einschließlich API Server, Controller Manager, Scheduler und etcd.
  • Du beherrschst Go sicher und schreibst produktionsreifen Code, um Automatisierungstools, Kubernetes Operatoren oder Integrations-Code zu entwickeln.
  • Du verfügst über fundierte Erfahrung mit Infrastructure as Code und Container-Infrastrukturen sowie tiefgehende Kenntnisse in Linux-Interna (Kernel-Tuning, Memory Management) und Networking (TCP/IP, CNI, Load Balancer, eBPF).
  • Du bringst Erfahrung im Betrieb von Datastores (z. B. PostgreSQL, Redis) und Messaging-Systemen (z. B. Kafka, NATS) in skalierbaren Umgebungen mit.
  • Du gehst Problemen auf den Grund, um daraus zu lernen, automatisierst dich selbst aus dem Job und verlässt dich nicht auf das Prinzip Hoffnung.
Einleitungstext

Schwarz Digits schafft das technologische Fundament für digitale Entscheidungsfreiheit in Europa. Als IT- und Digitalsparte der Schwarz Gruppe entwickeln und verantworten wir einerseits die IT-Infrastrukturen für die Handelssparten Lidl und Kaufland sowie die Schwarz Produktion und PreZero. Gleichzeitig agieren wir als unabhängiger Anbieter am externen Markt, um Unternehmen in ganz Europa bei ihrer digitalen Transformation zu unterstützen. Unsere Kernleistungen bündeln wir in den Bereichen Cloud, Cyber Security, Data & AI, Communication und Workspace. Trage auch du zur digitalen Entscheidungsfreiheit in Europa bei.
Bei uns arbeitest du an der Schnittstelle zwischen Agilität und Sicherheit: Du profitierst von den schnellen Entscheidungswegen, genießt echte Gestaltungsspielräume in deinen Projekten und baust dabei auf das stabile Fundament der Schwarz Gruppe.

Deine Aufgaben
  • Du arbeitest eng mit den Entwicklungsteams zusammen, um die “Time-to-Detect” zu verkürzen, indem du unsere Monitoring- und Alerting-Infrastruktur verbesserst und die Einhaltung der SLOs sicherstellst.
  • Deine Arbeit ist entscheidend für die kontinuierliche Optimierung der „Time-to-Mitigation“; dies erreichst du durch das Erstellen klarer Playbooks, das Design von Dashboards für First Responder und die Sicherstellung umfassender Telemetriedaten (Logs und Metriken).
  • Du agierst als Reliability Consultant für die Entwicklungsteams, vermittelst Wissen über Reliability-Patterns und unterstützt den „Shift Left“-Ansatz, um ein Modell der geteilten Verantwortung zu etablieren.
  • Du gestaltest und optimierst Entwicklungsprozesse wie CI/CD-Pipelines, um Progressive-Delivery-Strategien (z. B. Canary Releases und Blue/Green Deployments) zu unterstützen und Updates sicher und risikoarm auszurollen.
  • Du analysierst proaktiv die Skalierbarkeit der Control Plane und behebst Engpässe in Bereichen wie Distributed Consensus, Datenbank-Durchsatz und Kernel-Level-Networking.
  • Du nimmst an einer vergüteten On-Call-Rotation teil, leitest Incident Responses und moderierst Post-Mortems sowie Root Cause Analysen.
Hol dir deinen kostenlosen, vertraulichen Lebenslauf-Check.
oder ziehe deine Datei hierhin.
Similar jobs

Ähnliche Jobs, die dir auch gefallen könnten

(Senior) Site Reliability Engineer - STACKIT Control Plane (m/w/d)
(Senior) Site Reliability Engineer - STACKIT Control Plane (m/w/d)

Schwarz Digits • Heilbronn

Vor Ort
EUR 55.000 - 75.000
(Senior) Platform Engineer - STACKIT Control Plane Platform (m/w/d)
(Senior) Platform Engineer - STACKIT Control Plane Platform (m/w/d)

emplify GmbH • Bad Friedrichshall

Vor Ort
EUR 65.000 - 90.000
(Senior) Site Reliability Engineer - STACKIT Control Plane (m/w/d)
(Senior) Site Reliability Engineer - STACKIT Control Plane (m/w/d)

STACKIT • Heilbronn

Vor Ort
EUR 90.000 - 120.000
(Senior) Software Engineer - STACKIT Control Plane Platform (m/w/d)
(Senior) Software Engineer - STACKIT Control Plane Platform (m/w/d)

emplify GmbH • Bad Friedrichshall

Vor Ort
EUR 70.000 - 110.000
(Senior) Customer Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)
(Senior) Customer Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)

STACKIT • Heilbronn

Vor Ort
EUR 90.000 - 130.000
(Senior) Site Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)
(Senior) Site Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)

STACKIT • Heilbronn

Vor Ort
EUR 70.000 - 110.000
Site Reliability Engineer - Cloud Infrastructure - STACKIT (m/w/d)
Site Reliability Engineer - Cloud Infrastructure - STACKIT (m/w/d)

Schwarz Digits • Bad Friedrichshall

Vor Ort
EUR 90.000 - 130.000
Site Reliability Engineer - Cloud Infrastructure - STACKIT (m/w/d)
Site Reliability Engineer - Cloud Infrastructure - STACKIT (m/w/d)

STACKIT • Bad Friedrichshall

Vor Ort
EUR 70.000 - 110.000
(Senior) Site Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)
(Senior) Site Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)

Schwarz Digits • Heilbronn

Vor Ort
EUR 55.000 - 75.000
(Junior) Site Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)
(Junior) Site Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)

Schwarz Dienstleistung KG • Heilbronn

Vor Ort
EUR 55.000 - 75.000