Site Reliability Engineer (m/w/d)

Markant Gruppe

Offenburg

Vor Ort

EUR 70.000 - 100.000

Vollzeit

14 Tage+

Erhalte mehr Antworten von Arbeitgebern

Versende in nur wenigen Minuten einen passgenauen Lebenslauf.

Zusammenfassung

Markant Services International GmbH in Offenburg sucht eine/n Experten/in für Reliability & Observability zur Sicherung von Zuverlässigkeit, Verfügbarkeit und Leistungsfähigkeit der Developer Plattform. Sie entwickeln Observability-Lösungen, analysieren Störungen und leiten nachhaltige Verbesserungen ein.

Sie definieren Kennzahlen zu Verfügbarkeit und Performance, arbeiten eigenverantwortlich im Team und unterstützen Entwicklerteams bei Reliability-Anforderungen.

Qualifikationen

  • Abgeschlossene technische Ausbildung oder Studium im IT-Bereich.
  • Fundierte Kenntnisse in Hyperscalern, Kubernetes, Linux sowie Monitoring- und Observability-Lösungen.
  • Erfahrung im Betrieb und in der Optimierung komplexer IT-Plattformen und verteilter Systeme.
  • Kenntnisse in Monitoring-, Logging- und Alerting-Lösungen wie Grafana, Prometheus, Loki, Mimir, Tempo.
  • Know-how in Automatisierung, Infrastructure as Code sowie modernen Deployment-Verfahren.
  • Erfahrung in Fehleranalyse und nachhaltiger Ursachenforschung.
  • Ausgeprägtes analytisches Denkvermögen, Problemlösungsfähigkeiten, eigenverantwortliches Arbeiten.

Aufgaben

  • Du sicherst Zuverlässigkeit, Verfügbarkeit und Leistungsfähigkeit der Markant Developer Plattform.
  • Du entwickelst und betreibst Observability-Lösungen für Monitoring, Logging, Tracing und Alerting.
  • Du analysierst Betriebsstörungen, identifizierst Ursachen und leitest Maßnahmen zur Stabilität ein.
  • Du definierst Kennzahlen zu Verfügbarkeit, Performance und Servicequalität und treibst Verbesserungen voran.
  • Du planst Resilienz, Skalierbarkeit und Ausfallsicherheit unserer Entwicklungsplattform.
  • Du planst, koordinierst und führst Disaster-Recovery-Tests durch und bewertest Ergebnisse.
  • Du unterstützt Entwicklungsteams bei Reliability- und Observability-Anforderungen.
  • Du analysierst bereichsübergreifende Herausforderungen und pflegst Runbooks und Standards.

Kenntnisse

Hyperscaler
Kubernetes
Linux
Monitoring & Observability

Ausbildung

Technische Ausbildung / IT-Studium

Tools

Grafana
Prometheus
Loki
Mimir
Tempo

Jobbeschreibung

  • Du stellst die Zuverlässigkeit, Verfügbarkeit und Leistungsfähigkeit der Markant Developer Plattform sicher.
  • Du entwickelst und betreibst Observability-Lösungen für Monitoring, Logging, Tracing und Alerting.
  • Du analysierst Betriebsstörungen, identifizierst deren Ursachen und leitest nachhaltige Massnahmen zur Verbesserung der Stabilität ein.
  • Du definierst und etablierst Kennzahlen zur Bewertung von Verfügbarkeit, Performance und Servicequalität und treibst deren kontinuierliche Verbesserung voran.
  • Du konzipierst Massnahmen zur Erhöhung der Resilienz, Skalierbarkeit und Ausfallsicherheit unserer Entwicklungsplattform.
  • Du planst, koordinierst und führst Disaster-Recovery-Tests durch und bewertest deren Ergebnisse.
  • Du unterstützt und befähigst unsere Entwicklungsteams bei der Umsetzung von Reliability- und Observability-Anforderungen.
  • Du analysierst und löst komplexe bereichsübergreifende Herausforderungen.
  • Du pflegst kontinuierlich Betriebsdokumentationen, Standards und Runbooks.
  • Du wirkst an der Rufbereitschaft für die Entwicklungsplattform mit.
Ihr Bewerberprofil
  • Du verfügst über eine abgeschlossene technische Ausbildung, ein Studium im IT-Bereich oder eine vergleichbare Qualifikation.
  • Du bringst fundierte Kenntnisse in mindestens einem der folgenden Bereiche mit: Hyperscaler, Kubernetes, Linux sowie Monitoring- und Observability-Lösungen.
  • Du hast Erfahrung im Betrieb und in der Optimierung komplexer IT-Plattformen und verteilter Systeme.
  • Du kennst dich mit Monitoring-, Logging- und Alerting-Lösungen wie Grafana, Prometheus, Loki, Mimir, Tempo oder vergleichbaren Technologien aus.
  • Du verfügst über Kenntnisse in den Bereichen Automatisierung, Infrastructure as Code sowie modernen Betriebs- und Deploymentverfahren.
  • Du hast Erfahrung in der Analyse und Behebung komplexer Störungen sowie in der nachhaltigen Ursachenanalyse.
  • Du zeichnest dich durch ein ausgeprägtes analytisches Denkvermögen und starke Problemlösungsfähigkeiten aus.
  • Du arbeitest eigenverantwortlich, selbstständig und bist gleichzeitig ein echter Teamplayer.
  • Du überzeugst durch eine kunden- und lösungsorientierte Arbeitsweise.
  • Du verfügst über sehr gute Deutsch- und gute Englischkenntnisse.
Kontakt

Markant Services International GmbH

FrauLaura Kälble
Bereich Personal

Telefon: +49 781 616-5749

Hol dir deinen kostenlosen, vertraulichen Lebenslauf-Check.
oder ziehe deine Datei hierhin.
Similar jobs

Ähnliche Jobs, die dir auch gefallen könnten

Cloud Platform Engineer (m/w/d)
Cloud Platform Engineer (m/w/d)

Markant Gruppe • Offenburg

Vor Ort
EUR 85.000 - 110.000
DevOps/DataOps Engineer (m/w/d) für Daten- und KI-Plattformen
DevOps/DataOps Engineer (m/w/d) für Daten- und KI-Plattformen

Markant Gruppe • Offenburg

Hybrid
EUR 65.000 - 90.000
Site Reliability Engineer (m/w/d) – Konstanz, Berlin oder remote
Site Reliability Engineer (m/w/d) – Konstanz, Berlin oder remote

Jackalope Digital LLC • Konstanz, Berlin

Hybrid
EUR 70.000 - 100.000
Selbstorganisiertes Team
Vielfältiges Tech-Spektrum
Familienfreundliche Arbeitsbedingungen
+1
Site Reliability Engineer (m/w/d) – Konstanz, Berlin oder remote
Site Reliability Engineer (m/w/d) – Konstanz, Berlin oder remote

SEITENBAU • Konstanz

Remote
EUR 70.000 - 110.000
Selbstorganisiertes Team
Vielfältige Projekte
Langfristige Perspektive
+2
Software Reliability Engineer (m/w/d)
Software Reliability Engineer (m/w/d)

thor consulting GmbH • Bochum

Vor Ort
EUR 60.000 - 80.000
Betriebliche Altersvorsorge
Mobilityangebote
Mitarbeitervorteile
+3
Site Reliability Engineer (m/w/d)
Site Reliability Engineer (m/w/d)

Assecor GmbH • Berlin

Hybrid
EUR 55.000 - 75.000
Flexible Arbeitszeiten
Weiterbildungsmöglichkeiten
Betriebliche Altersvorsorge
+2
DevOps & Cloud Engineer (m/w/d) - Konstanz, Berlin oder remote
DevOps & Cloud Engineer (m/w/d) - Konstanz, Berlin oder remote

SEITENBAU • Konstanz

Hybrid
EUR 70.000 - 100.000
DevOps Server & Application Engineer (m/w/d)
DevOps Server & Application Engineer (m/w/d)

LKH • Lüneburg

Hybrid
Vertraulich
Mitarbeiterrabatte
Gleitzeit & Homeoffice-Möglichkeit
Vermögenswirksame Leistungen & betrieb
+2
IT-Consultant (m/w/d) Schwerpunkt Middleware
IT-Consultant (m/w/d) Schwerpunkt Middleware

United States Digital Space LLC • Hamburg

Vor Ort
EUR 65.000 - 90.000
Site Reliability Engineer (m/w/d) – Konstanz, Berlin oder remote
Site Reliability Engineer (m/w/d) – Konstanz, Berlin oder remote

SEITENBAU GmbH • Deutschland

Vor Ort
EUR 75.000 - 110.000