(Senior) Customer Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)

Schwarz Dienstleistung KG

Heilbronn

Vor Ort

EUR 70.000 - 110.000

Vollzeit

14 Tage+
Bewerbungsgenerator

Mach aus dieser Rolle ein Vorstellungsgespräch — ein Lebenslauf und ein Anschreiben, die darauf ausgerichtet sind, was dieser Arbeitgeber sucht.

Schaffe es an den ATS-Filtern vorbei

Zusammenfassung

Schwarz Dienstleistung KG sucht einen erfahrenen SRE/Platform Engineer, der direkt am Kunden arbeitet und komplexe Plattformen wie Kubernetes, KubeVirt, Ceph und Cilium betreut.

Sie analysieren Betrieb, Monitoring und Reliability, definieren SLOs und automatisieren wiederkehrende Aufgaben. Hohe Sicherheits- und Compliance-Anforderungen sind Bestandteil des Alltags.

Qualifikationen

  • Abgeschlossenes Studium der Informatik oder vergleichbare Qualifikation.
  • Mindestens 2 Jahre aktive Erfahrung im Betrieb von Cloud-Infrastrukturen mit Kubernetes.
  • Ausgeprägte Customer-First-Mentalität und Kundenfokus.
  • Tiefe Analyse von Log-Files, Traces und Metriken zur Fehlerbehebung.
  • Kenntnisse in Softwareentwicklung und Automatisierung wiederkehrender Aufgaben.
  • Bereitschaft zur Erfüllung strenger Compliance-Vorgaben sowie Rufbereitschaft.
  • Enge Zusammenarbeit mit SRE-Plattform-Team und Entwicklern.

Aufgaben

  • Du bist technischer Partner und Eskalationsstufe zugleich - direkt an der Seite des Kunden auf unseren hochkomplexen Plattformen (Kubernetes, KubeVirt, Cilium, Ceph, Talos).
  • Du analysierst Design, Betrieb und Monitoring von Kunden-Workloads, definierst SLOs und erstellst Guides zur Fehlersuche.
  • Du debuggst geschäftskritische Kunden-Workloads gemeinsam mit dem Kunden-Team und automatisierst wiederkehrende Probleme.
  • Du arbeitest in hoch sensiblen Umgebungen mit entsprechenden Sicherheits- und Compliance-Anforderungen.

Kenntnisse

Cloud-Infrastrukturen
Kubernetes
SRE/Incident Response
Automation/ Skripting

Ausbildung

Abgeschlossenes Studium der Informatik oder vergleichbare Qualifikation

Tools

KubeVirt
Ceph
Cilium
Talos

Jobbeschreibung

Wählen Sie aus, wie oft (in Tagen) Sie eine Benachrichtigung erhalten möchten:

Schwarz Digits schafft das technologische Fundament für digitale Entscheidungsfreiheit in Europa. Als IT- und Digitalsparte der Schwarz Gruppe entwickeln und verantworten wir einerseits die IT-Infrastrukturen für die Handelssparten Lidl und Kaufland sowie die Schwarz Produktion und PreZero. Gleichzeitig agieren wir als unabhängiger Anbieter am externen Markt, um Unternehmen in ganz Europa bei ihrer digitalen Transformation zu unterstützen. Unsere Kernleistungen bündeln wir in den Bereichen Cloud, Cyber Security, Data & AI, Communication und Workspace. Trage auch du zur digitalen Entscheidungsfreiheit in Europa bei.
Bei uns arbeitest du an der Schnittstelle zwischen Agilität und Sicherheit: Du profitierst von den schnellen Entscheidungswegen, genießt echte Gestaltungsspielräume in deinen Projekten und baust dabei auf das stabile Fundament der Schwarz Gruppe.

Deine Aufgaben
  • Du bist technischer Partner und Eskalationsstufe zugleich - direkt an der Seite des Kunden auf unseren hochkomplexen Plattformen (Kubernetes, KubeVirt, Cilium, Ceph, Talos). Tickets organisieren die Arbeit; die eigentliche Tätigkeit findet im gemeinsamen Debug-Session, Call und War Room statt - mit dem Kunden, nicht für ihn.
  • Du lebst Shared Fate: In PRRs analysierst du Design, Betrieb und Monitoring von Kunden-Workloads, identifizierst Reliability-Lücken und hilfst, messbare SLOs zu definieren. Mit Guides, Tutorials und Talks befähigst du Kunden, ihre Workloads von Anfang an richtig aufzubauen - statt reaktive Incidents zu debuggen.
  • Du analysierst geschäftskritische Kunden-Workloads in der Tiefe, debuggst komplexe Störungen gemeinsam mit dem Kunden-Team und beseitigst sie dauerhaft. Wiederkehrende Probleme behandelst du als Softwareaufgabe und automatisierst sie mit Tools und Skripten. Erkenntnisse fließen als präventive Optimierungen an das SRE-Kernteam zurück.
  • Du arbeitest in hochsensiblen Umgebungen, mit allen daraus folgenden Sicherheits- und Compliance-Anforderungen.
Dein Profil
  • Du hast ein abgeschlossenes Studium in Informatik oder eine vergleichbare Qualifikation und bringst eine ausgeprägte Leidenschaft für systemnahe Technologien mit.
  • Du besitzt mindestens 2 Jahre aktive Erfahrung im Betrieb von Cloud-Infrastrukturen mit Kubernetes und bringst eine ausgeprägte „Customer-First“-Mentalität mit - denn du weißt, dass eine stabile Plattform wertlos ist, wenn der Kunde sie nicht optimal nutzen kann.
  • Du liebst es, tief in Log-Files, Traces und Metriken einzutauchen, um komplexe Fehlerbilder im Systemverbund zu isolieren und nachhaltig zu beheben.
  • Du verfügst über Kenntnisse in der Softwareentwicklung und nutzt diese, um wiederkehrende Aufgaben dauerhaft und zuverlässig zu automatisieren.
  • Da wir in einem hochgradig regulierten Umfeld agieren, bringst du die Bereitschaft zur Erfüllung unserer strengen Compliance-Vorgaben sowie für die Teilnahme an einer flexiblen Rufbereitschaft mit.
  • Du schätzt den engen, organisationsweiten Austausch und arbeitest hochgradig partnerschaftlich mit dem SRE-Plattform-Team sowie unseren Software- und Produktentwicklern zusammen, um eine nahtlose Brücke zwischen Plattform-Infrastruktur und Anwendungsentwicklung zu schlagen.
Hol dir deinen kostenlosen, vertraulichen Lebenslauf-Check.
oder ziehe deine Datei hierhin.
Similar jobs

Ähnliche Jobs, die dir auch gefallen könnten

(Senior) Customer Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)
(Senior) Customer Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)

Schwarz Digits • Heilbronn

Vor Ort
EUR 70.000 - 110.000
(Senior) Customer Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)
(Senior) Customer Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)

STACKIT • Heilbronn

Vor Ort
EUR 90.000 - 130.000
(Senior) Site Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)
(Senior) Site Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)

Schwarz Dienstleistung KG • Heilbronn

Vor Ort
EUR 60.000 - 80.000
(Senior) Site Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)
(Senior) Site Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)

Schwarz Digits • Heilbronn

Vor Ort
EUR 55.000 - 75.000
(Junior) Site Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)
(Junior) Site Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)

Schwarz Dienstleistung KG • Heilbronn

Vor Ort
EUR 55.000 - 75.000
(Senior) Site Reliability Engineer - STACKIT Control Plane (m/w/d)
(Senior) Site Reliability Engineer - STACKIT Control Plane (m/w/d)

Schwarz Digits • Heilbronn

Vor Ort
EUR 55.000 - 75.000
Site Reliability Engineer - Cloud Infrastructure - STACKIT (m/w/d)
Site Reliability Engineer - Cloud Infrastructure - STACKIT (m/w/d)

STACKIT • Bad Friedrichshall

Vor Ort
EUR 70.000 - 110.000
Site Reliability Engineer - Cloud Infrastructure - STACKIT (m/w/d)
Site Reliability Engineer - Cloud Infrastructure - STACKIT (m/w/d)

Schwarz Digits • Bad Friedrichshall

Vor Ort
EUR 90.000 - 130.000
(Junior) Site Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)
(Junior) Site Reliability Engineer / Distributed Cloud - STACKIT (m/w/d)

Projectstudy • Deutschland

Vor Ort
EUR 90.000 - 130.000
(Senior) Site Reliability Engineer - STACKIT Control Plane (m/w/d)
(Senior) Site Reliability Engineer - STACKIT Control Plane (m/w/d)

emplify GmbH • Bad Friedrichshall

Vor Ort
EUR 90.000 - 130.000