Site Reliability Engineer - Cloud Infrastructure - STACKIT (m/w/d)

STACKIT

Bad Friedrichshall

Vor Ort

EUR 70.000 - 110.000

Teilzeit

14 Tage+
Bewerbungsgenerator

Eine komplette Bewerbung in einer Minute — maßgeschneiderter Lebenslauf und Anschreiben, versandbereit.

Schaffe es an den ATS-Filtern vorbei

Zusammenfassung

STACKIT sucht eine erfahrene SRE, die die Zuverlässigkeit unserer Services stärkt und mit Engineering-Teams robuste, toil-minimierte Systeme betreibt.

Sie fungieren als Mentor, steuern das Vorfallsmanagement als Incident Commander und leiten RCA-Maßnahmen ab. Sie standardisieren Prozesse, etablieren den Reliability Score und implementieren Tools zur Messung von SLOs.

Qualifikationen

  • Ausgeprägtes Reliability-First-Mindset und Balance zwischen Geschwindigkeit und Stabilität.
  • Fundierte Erfahrung im Site Reliability Engineering (SRE) und Kenntnisse von SLOs, Error Budgets und Toil-Management.
  • Sicher in der Durchführung von Root Cause Analyses (RCA) und Ableitung von Maßnahmen zur Fehlervermeidung.
  • Kenntnisse in der Entwicklung von Automatisierungsskripten oder internen Tools (z. B. Python, Go).
  • Zusammenarbeit mit Stakeholdern in einer dezentralen, europäischen Organisation.

Aufgaben

  • Du förderst eine Kultur der Zuverlässigkeit und unterstützt Engineering-Teams beim Betrieb resilenter Services mit minimalem Toil.
  • Du fungierst als Mentor und Advisor, um die Reliability-First-Multur zu verankern.
  • Du steuerst das Vorfallsmanagement – vom Incident Commander bis zur nachhaltigen Fehleranalyse (RCA).
  • Du standardisierst Operations-Prozesse und etablierst den Reliability Score zur Steigerung der operativen Exzellenz.
  • Du implementierst Werkzeuge zur Messbarkeit und Steuerung von SLOs.

Kenntnisse

Reliability-First Mindset
SRE-Erfahrung
Toil-Management
Root Cause Analysis
Stakeholder-Zusammenarbeit

Tools

Python
Go

Jobbeschreibung

Schwarz Digits schafft das technologische Fundament für digitale Entscheidungsfreiheit in Europa. Als IT- und Digitalsparte der Schwarz Gruppe entwickeln und verantworten wir einerseits die IT-Infrastrukturen für die Handelssparten Lidl und Kaufland sowie die Schwarz Produktion und PreZero. Gleichzeitig agieren wir als unabhängiger Anbieter am externen Markt, um Unternehmen in ganz Europa bei ihrer digitalen Transformation zu unterstützen. Unsere Kernleistungen bündeln wir in den Bereichen Cloud, Cyber Security, Data & AI, Communication und Workspace. Trage auch du zur digitalen Entscheidungsfreiheit in Europa bei.

Bei uns arbeitest du an der Schnittstelle zwischen Agilität und Sicherheit: Du profitierst von den schnellen Entscheidungswegen, genießt echte Gestaltungsspielräume in deinen Projekten und baust dabei auf das stabile Fundament der Schwarz Gruppe.

Deine Aufgaben
  • Du förderst eine Kultur der Zuverlässigkeit, indem du Engineering-Teams dabei unterstützt, resiliente Services mit minimalem manuellem Aufwand (Toil) zu betreiben.
  • Du agierst als Mentor und Advisor, um die „Reliability-First“-Mentalität in den Entwicklungsteams zu verankern.
  • Du steuerst das ganzheitliche Vorfallsmanagement – von der akuten Krisenkoordination als Incident Commander bis zur nachhaltigen Fehleranalyse (RCA) zur kontinuierlichen Systemverbesserung.
  • Du standardisierst Operations-Prozesse und etablierst den Reliability Score, um die operative Exzellenz gemeinsam mit den Teams nachhaltig zu steigern.
  • Du implementierst Werkzeuge zur Messbarkeit und Steuerung von Service Level Objectives (SLOs)
Dein Profil
  • Du verfügst über ein ausgeprägtes „Reliability-First“-Mindset und verstehst die Balance zwischen Geschwindigkeit und Stabilität.
  • Du hast fundierte Erfahrung im Site Reliability Engineering (SRE) und kennst die Prinzipien von SLOs, Error Budgets und Toil-Management.
  • Du bist sicher in der Durchführung von Root Cause Analyses (RCA) und der Ableitung von Maßnahmen zur Fehlervermeidung.
  • Du besitzt gute Kenntnisse in der Entwicklung von Automatisierungsskripten oder internen Tools (z. B. Python, Go).
  • Du hast Freude an der Zusammenarbeit mit verschiedenen Stakeholdern in einer dezentralen, europäischen Organisation.
Hol dir deinen kostenlosen, vertraulichen Lebenslauf-Check.
oder ziehe deine Datei hierhin.
Similar jobs

Ähnliche Jobs, die dir auch gefallen könnten

Site Reliability Engineer - Cloud Infrastructure - STACKIT (m/w/d)
Site Reliability Engineer - Cloud Infrastructure - STACKIT (m/w/d)

Schwarz Digits • Bad Friedrichshall

Vor Ort
EUR 90.000 - 130.000
(Senior) Customer Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)
(Senior) Customer Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)

STACKIT • Heilbronn

Vor Ort
EUR 90.000 - 130.000
(Senior) Site Reliability Engineer - STACKIT Control Plane (m/w/d)
(Senior) Site Reliability Engineer - STACKIT Control Plane (m/w/d)

Schwarz Digits • Heilbronn

Vor Ort
EUR 55.000 - 75.000
(Senior) Site Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)
(Senior) Site Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)

STACKIT • Heilbronn

Vor Ort
EUR 70.000 - 110.000
(Senior) Customer Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)
(Senior) Customer Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)

Schwarz Digits • Heilbronn

Vor Ort
EUR 70.000 - 110.000
(Senior) Customer Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)
(Senior) Customer Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)

Schwarz Dienstleistung KG • Heilbronn

Vor Ort
EUR 70.000 - 110.000
(Senior) Site Reliability Engineer - STACKIT Control Plane (m/w/d)
(Senior) Site Reliability Engineer - STACKIT Control Plane (m/w/d)

emplify GmbH • Bad Friedrichshall

Vor Ort
EUR 90.000 - 130.000
(Senior) Site Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)
(Senior) Site Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)

Schwarz Digits • Heilbronn

Vor Ort
EUR 55.000 - 75.000
(Senior) Site Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)
(Senior) Site Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)

Schwarz Dienstleistung KG • Heilbronn

Vor Ort
EUR 60.000 - 80.000
(Junior) Site Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)
(Junior) Site Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)

STACKIT • Heilbronn

Vor Ort
EUR 70.000 - 100.000