Senior Platform Operations Engineer / Site Reliability Engineer (m/w/d)

Netlution

Deutschland

Hybrid

EUR 70.000 - 110.000

Vollzeit

14 Tage+
Bewerbungsgenerator

Eine maßgeschneiderte Bewerbung für diese Stelle — ein maßgeschneiderter Lebenslauf und ein Anschreiben, die genau zur Stellenanzeige passen.

Schaffe es an den ATS-Filtern vorbei

Benefits dieser Stelle

Unbefristeter Arbeitsvertrag
Attraktive Vergütung
Weiterbildungen
Hybrid und Full Remote Modell
PC Ausstattung

Zusammenfassung

Netlution sucht eine erfahrene Senior Platform Operations Engineer, die zentrale Verantwortung für Betrieb, Stabilität und Performance moderner Plattformen übernimmt. Du betreibst hochverfügbare Systeme, kümmerst dich um Observability, Incident Management und Automation im Betriebsumfeld.

Im Fokus stehen Kubernetes-gestützte Plattformen, Monitoring-Stack, OpenSearch/ELK und CI/CD-Integration. Du arbeitest eng im Team, bringst deine Expertise ein und bringst dich in 24x7-Betriebssituationen ein.

Qualifikationen

  • Mehrjährige Erfahrung im Bereich Platform Operations oder SRE
  • Erfahrung mit Monitoring/Observability
  • Kenntnisse in Linux-Umgebungen
  • Verständnis von Kubernetes und containerisierten Plattformen
  • Sicherer Umgang mit REST APIs und Git
  • Englische Fachkenntnisse wünschenswert

Aufgaben

  • Betrieb, Betreuung und Weiterentwicklung von Monitoring- und Observability-Plattformen
  • Administration und Optimierung von Prometheus, Grafana sowie OpenSearch/ELK
  • Überwachung produktiver Systeme und Verbesserung von Monitoring-Konzepten
  • Bearbeitung von Incidents und Unterstützung bei Recovery
  • Durchführung von Root Cause Analysen und Störungsbeseitigung
  • Trading von CI/CD-Unterstützung mit Jenkins/ArgoCD (falls vorhanden)
  • Erstellung und Pflege von Runbooks und Betriebsprozessen
  • Automatisierung wiederkehrender Aufgaben
  • Rufbereitschaften und 24x7-Betriebsorganisation

Kenntnisse

Platform Operations
SRE
System Engineering
IT Operations

Tools

Prometheus
Grafana
ELK/OpenSearch
Elasticsearch/OpenSearch

Jobbeschreibung

Aufgabenspektrum

Sichere und betreibe moderne Plattformen auf Enterprise-Niveau.

Du begeisterst dich für hochverfügbare Plattformen, Monitoring-Lösungen und den stabilen Betrieb komplexer Kubernetes-Umgebungen? Dann suchen wir genau dich.

Als Senior Platform Operations Engineer (m/w/d) übernimmst du eine zentrale Rolle im Betrieb und der Weiterentwicklung moderner Plattform- und Observability-Lösungen. Dein Fokus liegt nicht auf klassischer Softwareentwicklung, sondern auf der Sicherstellung von Stabilität, Verfügbarkeit und Performance geschäftskritischer Systeme.

Du arbeitest an den Themen Monitoring, Observability, Incident Management, Kubernetes Operations sowie Automation im Betriebsumfeld und sorgst gemeinsam mit unserem Team für einen zuverlässigen Plattformbetrieb.

Deine Aufgaben
  • Betrieb, Betreuung und Weiterentwicklung von Monitoring- und Observability-Plattformen
  • Administration und Optimierung von Prometheus, Grafana sowie OpenSearch / ELK
  • Überwachung produktiver Systemlandschaften und kontinuierliche Verbesserung von Monitoring- und Alerting-Konzepten
  • Bearbeitung von Incidents sowie Unterstützung bei der Wiederherstellung kritischer Services
  • Durchführung von Root Cause Analysen und nachhaltige Beseitigung von Störungsursachen
  • Unterstützung bei Major Incidents und Koordination technischer Lösungsmaßnahmen
  • Betrieb und Optimierung containerisierter Plattformen auf Basis von Kubernetes
  • Unterstützung von CI/CD-Prozessen mit Jenkins und ArgoCD
  • Erstellung, Pflege und Weiterentwicklung von Runbooks, Betriebsprozessen und technischer Dokumentation
  • Automatisierung wiederkehrender Betriebsaufgaben
  • Teilnahme an Rufbereitschaften und Schichtmodellen in einer 24x7-Betriebsorganisation
Erfahrungen
Das bringst du mit:
Must-have
  • Mehrjährige Erfahrung im Bereich Platform Operations, Site Reliability Engineering, System Engineering oder IT Operations
  • Bereitschaft zur Durchführung bzw. Vorliegen einer Sicherheitsüberprüfung SÜ2
  • Sehr gute Kenntnisse in Linux-basierten Umgebungen
  • Verständnis für Kubernetes und containerisierte Plattformen
  • Praxiserfahrung mit:
    • Prometheus
    • Grafana
    • ELK Stack oder OpenSearch
    • Elasticsearch oder OpenSearch
  • Erfahrung im Monitoring, Alerting und Observability-Umfeld
  • Gute Kenntnisse von Netzwerkgrundlagen und Kommunikationsprotokollen
  • Erfahrung im Umgang mit REST APIs
  • Sicherer Umgang mit Git
  • Analytische Herangehensweise bei Fehleranalysen und Störungsbehebung
  • Gute Englischkenntnisse in Wort und Schrift
  • Bereitschaft zur Teilnahme an Rufbereitschaften und Schichtbetrieb
Nice-to-have
  • Erfahrung mit ArgoCD
  • Kenntnisse in Jenkins
  • Erfahrung mit Helm
  • Bash-Scripting
  • Python für Betriebsautomation und Operational Excellence
  • Erfahrung im Bereich Site Reliability Engineering (SRE)
  • Kenntnisse moderner Cloud- oder Plattformarchitekturen
Über uns

Die Netlution Gruppe mit über 250 Experten und der Netlution Enterprise Services als zentraler Bestandteil der Gruppe, versteht sich als Premium Partner für IT-Infrastruktur- und Application Services führender Unternehmen der deutschen Wirtschaft. Seit 2001 haben wir umfangreiche Erfahrungen gesammelt. Heute liegt der Schwerpunkt unserer Expertise in adaptiven, geschäftskritischen Enterprise IT-Services sowie Beratungsleistungen. Bei unseren Kunden, namhafte DAX-Konzerne und im gehobenen Mittelstand, konnten wir uns einen exzellenten Ruf erarbeiten. Unser Portfolio haben wir inzwischen um den Bereich Business- und Technologieconsulting erweitert.

Unsere erfolgreiche Geschichte wollen wir mit dir als Verstärkung unseres dynamischen Team weiter stärken. Bei uns erwartet dich ein Umfeld, bei dem du und deine Entwicklung im Mittelpunkt stehen. Das gelingt nur mit innovativen Ideen, Engagement und herausragendem Service. Werde Teil unseres Teams und gestalte die Zukunft der Netlution Gruppe mit!

Unsere Benefits:
  • Unbefristeter Arbeitsvertrag
  • Attraktive Vergütung
  • Weiterbildungen
  • Hybrid und Full Remote Modell
  • PC Ausstattung

Das war nur ein Auszug unserer Benefits!

Mehr findest du hier: https://our-people-make-the-difference.de/arbeiten-bei-netlution/_unsere-benefits/

Hol dir deinen kostenlosen, vertraulichen Lebenslauf-Check.

oder ziehe deine Datei hierhin.

Similar jobs

Ähnliche Jobs, die dir auch gefallen könnten

Senior Platform / DevOps Engineer (m/w/d)
Senior Platform / DevOps Engineer (m/w/d)

Lumenaza GmbH • Berlin

Vor Ort
EUR 70.000 - 90.000
Wettbewerbsfähige Vergütung
Deutschlandticket
Flexibles Arbeiten
Platform Reliability Engineer (m/w/d) - Konstanz, Berlin oder remote
Platform Reliability Engineer (m/w/d) - Konstanz, Berlin oder remote

SEITENBAU • Konstanz

Remote
EUR 70.000 - 110.000
Selbstorganisiertes Team
Langfristige Perspektive
Umfangreiche Benefits
Senior DevOps Engineer (m/w/d) für Brandenburg, Berlin, Braunschweig
Senior DevOps Engineer (m/w/d) für Brandenburg, Berlin, Braunschweig

Curato GmbH & Co. KG • Berlin

Vor Ort
EUR 90.000 - 130.000
(Senior) Site Reliability Engineer (m/w/d) | Hamburg
(Senior) Site Reliability Engineer (m/w/d) | Hamburg

ZABEL • Hamburg

Vor Ort
EUR 99.000 - 121.000
Deutschlandticket-Zuschuss
Urban Sports Club-Zuschuss
Sport- & Teamevents
Platform Engineer (w/m/d)
Platform Engineer (w/m/d)

Enovetic • Hildesheim

Hybrid
EUR 65.000 - 85.000
Betriebliche Altersvorsorge
Hybrid: 2 Tage Homeoffice
Hansefit
+1
Site Reliability Engineer (m/w/d) – Konstanz, Berlin oder remote
Site Reliability Engineer (m/w/d) – Konstanz, Berlin oder remote

SEITENBAU • Konstanz

Remote
EUR 70.000 - 110.000
Selbstorganisiertes Team
Vielfältige Projekte
Langfristige Perspektive
+2
Senior DevOps & Platform Engineer (m/w/d)
Senior DevOps & Platform Engineer (m/w/d)

StudySmarter GmbH • Deutschland

Remote
USD 55.729 - 97.527
Attraktive Vergütung
30 Tage Urlaub
Flexible Arbeitszeiten
+1
(Senior) DevOps Engineer - Platform Services (m/w/d)
(Senior) DevOps Engineer - Platform Services (m/w/d)

D-Trust • Berlin

Vor Ort
EUR 60.000 - 90.000
30 Tage Urlaub
Betriebliche Altersvorsorge
Individuelle Weiterbildungsmöglichkeiten
Site Reliability Engineer - Kubernetes / DevOps (m/w/d)
Site Reliability Engineer - Kubernetes / DevOps (m/w/d)

StudentJob • Karlsruhe

Vor Ort
EUR 60.000 - 90.000
Hybrid-Arbeitsmodell
Mitarbeitervergünstigungen
Mitarbeiterveranstaltungen
+2
Platform Engineer (m/w/d)
Platform Engineer (m/w/d)

novomind AG • Hamburg

Vor Ort
EUR 70.000 - 110.000
Lockere Arbeitsatmosphäre
Flexible Arbeitszeiten
30 Urlaubstage
+7