Senior Platform Operations Engineer / Site Reliability Engineer (m/w/d)

n_value group

Ludwigshafen am Rhein

Hybrid

EUR 90.000 - 120.000

Vollzeit

Vor 2 Tagen
Sei unter den ersten Bewerbenden
Bewerbungsgenerator

Hebe dich für diese Rolle von der Masse ab — erstelle in etwa einer Minute einen maßgeschneiderten Lebenslauf und ein Anschreiben.

Schaffe es an den ATS-Filtern vorbei

Benefits dieser Stelle

Unbefristeter Arbeitsvertrag
Attraktive Vergütung
Weiterbildungen
Hybrid und Full Remote Modell
PC Ausstattung

Zusammenfassung

Netlution Gruppe sucht eine/n Senior Platform Operations Engineer (m/w/d) zur Sicherstellung von Stabilität, Verfügbarkeit und Performance geschäftskritischer Systeme. Du betreibst Monitoring-, Observability- und Kubernetes-Plattformen, überwachst produktive Landschaften und arbeitest eng mit dem Team an Incident-Management sowie automationsgetriebenen Verbesserungen.

Zu Deinen Aufgaben zählen Betrieb, Weiterentwicklung von Monitoring-Plattformen, Weiterentwicklung von Runbooks und Support bei

Qualifikationen

  • Mehrjährige Erfahrung im Bereich Platform Operations, Site Reliability Engineering, System Engineering oder IT Operations.
  • Bereitschaft zur Sicherheitsüberprüfung SÜ2.
  • Sehr gute Kenntnisse in Linux-basierten Umgebungen.
  • Verständnis für Kubernetes und containerisierte Plattformen.
  • Praxis in Prometheus, Grafana, ELK/OpenSearch.
  • Erfahrung im Monitoring, Alerting und Observability-Umfeld.
  • Gute Kenntnisse von Netzwerktechniken und Kommunikationsprotokollen.
  • REST APIs sicher verwenden und Git beherrschen.
  • Gute Englischkenntnisse in Wort und Schrift.
  • Bereitschaft zu Rufbereitschaften und Schichtbetrieb.

Aufgaben

  • Betrieb, Betreuung und Weiterentwicklung von Monitoring- und Observability-Plattformen
  • Administration und Optimierung von Prometheus, Grafana sowie OpenSearch / ELK
  • Überwachung produktiver Systemlandschaften und Verbesserung von Monitoring- und Alerting-Konzepten
  • Bearbeitung von Incidents sowie Wiederherstellung kritischer Services
  • Durchführung von Root Cause Analysen und nachhaltige Behebung von Störungsursachen
  • Unterstützung bei Major Incidents und Koordination technischer Lösungsmaßnahmen
  • Betrieb und Optimierung containerisierter Plattformen auf Basis von Kubernetes
  • Unterstützung von CI/CD-Prozessen mit Jenkins und ArgoCD
  • Erstellung, Pflege und Weiterentwicklung von Runbooks, Betriebsprozessen und technischer Dokumentation
  • Automatisierung wiederkehrender Betriebsaufgaben
  • Teilnahme an Rufbereitschaften und Schichtmodellen in einer 24x7-Betriebsorganisation

Kenntnisse

Platform Operations
Site Reliability Engineering
Linux-Umgebungen
Kubernetes
Monitoring
Incident Management
CI/CD
REST APIs
Git
Englischkenntnisse

Tools

Prometheus
Grafana
OpenSearch
ELK Stack
Elasticsearch
Jenkins
ArgoCD
Helm
Bash-Scripting
Python

Jobbeschreibung

AufgabenspektrumSichere und betreibe moderne Plattformen auf Enterprise-Niveau.

Du begeisterst dich für hochverfügbare Plattformen, Monitoring-Lösungen und den stabilen Betrieb komplexer Kubernetes-Umgebungen? Dann suchen wir genau dich.

Als Senior Platform Operations Engineer (m/w/d) übernimmst du eine zentrale Rolle im Betrieb und der Weiterentwicklung moderner Plattform- und Observability-Lösungen. Dein Fokus liegt nicht auf klassischer Softwareentwicklung, sondern auf der Sicherstellung von Stabilität, Verfügbarkeit und Performance geschäftskritischer Systeme.

Du arbeitest an den Themen Monitoring, Observability, Incident Management, Kubernetes Operations sowie Automation im Betriebsumfeld und sorgst gemeinsam mit unserem Team für einen zuverlässigen Plattformbetrieb.

Deine Aufgaben
  • Betrieb, Betreuung und Weiterentwicklung von Monitoring- und Observability-Plattformen
  • Administration und Optimierung von Prometheus, Grafana sowie OpenSearch / ELK
  • Überwachung produktiver Systemlandschaften und kontinuierliche Verbesserung von Monitoring- und Alerting-Konzepten
  • Bearbeitung von Incidents sowie Unterstützung bei der Wiederherstellung kritischer Services
  • Durchführung von Root Cause Analysen und nachhaltige Beseitigung von Störungsursachen
  • Unterstützung bei Major Incidents und Koordination technischer Lösungsmaßnahmen
  • Betrieb und Optimierung containerisierter Plattformen auf Basis von Kubernetes
  • Unterstützung von CI/CD-Prozessen mit Jenkins und ArgoCD
  • Erstellung, Pflege und Weiterentwicklung von Runbooks, Betriebsprozessen und technischer Dokumentation
  • Automatisierung wiederkehrender Betriebsaufgaben
  • Teilnahme an Rufbereitschaften und Schichtmodellen in einer 24x7-Betriebsorganisation
ErfahrungenDas bringst du mit:
Must-have
  • Mehrjährige Erfahrung im Bereich Platform Operations, Site Reliability Engineering, System Engineering oder IT Operations
  • Bereitschaft zur Durchführung bzw. Vorliegen einer Sicherheitsüberprüfung SÜ2
  • Sehr gute Kenntnisse in Linux-basierten Umgebungen
  • Verständnis für Kubernetes und containerisierte Plattformen
  • Praxiserfahrung mit:
    • Prometheus
    • Grafana
    • ELK Stack oder OpenSearch
    • Elasticsearch oder OpenSearch
  • Erfahrung im Monitoring, Alerting und Observability-Umfeld
  • Gute Kenntnisse von Netzwerkgrundlagen und Kommunikationsprotokollen
  • Erfahrung im Umgang mit REST APIs
  • Sicherer Umgang mit Git
  • Analytische Herangehensweise bei Fehleranalysen und Störungsbehebung
  • Gute Englischkenntnisse in Wort und Schrift
  • Bereitschaft zur Teilnahme an Rufbereitschaften und Schichtbetrieb
Nice-to-have
  • Erfahrung mit ArgoCD
  • Kenntnisse in Jenkins
  • Erfahrung mit Helm
  • Bash-Scripting
  • Python für Betriebsautomation und Operational Excellence
  • Erfahrung im Bereich Site Reliability Engineering (SRE)
  • Kenntnisse moderner Cloud- oder Plattformarchitekturen
Über uns

Die Netlution Gruppe mit über 250 Experten und der Netlution Enterprise Services als zentraler Bestandteil der Gruppe, versteht sich als Premium Partner für IT-Infrastruktur- und Application Services führender Unternehmen der deutschen Wirtschaft. Seit 2001 haben wir umfangreiche Erfahrungen gesammelt. Heute liegt der Schwerpunkt unserer Expertise in adaptiven, geschäftskritischen Enterprise IT-Services sowie Beratungsleistungen. Bei unseren Kunden, namhafte DAX-Konzerne und im gehobenen Mittelstand, konnten wir uns einen exzellenten Ruf erarbeiten. Unser Portfolio haben wir inzwischen um den Bereich Business- und Technologieconsulting erweitert.

Unsere Benefits:
  • Unbefristeter Arbeitsvertrag
  • Attraktive Vergütung
  • Weiterbildungen
  • Hybrid und Full Remote Modell
  • PC Ausstattung

Das war nur ein Auszug unserer Benefits! Mehr findest du hier: https://our-people-make-the-difference.de/arbeiten-bei-netlution/_unsere-benefits/

Hol dir deinen kostenlosen, vertraulichen Lebenslauf-Check.
oder ziehe deine Datei hierhin.
Similar jobs

Ähnliche Jobs, die dir auch gefallen könnten

Senior Platform / DevOps Engineer (m/w/d)
Senior Platform / DevOps Engineer (m/w/d)

Lumenaza GmbH • Berlin

Hybrid
EUR 70.000 - 90.000
Wettbewerbsfähige Vergütung
Deutschlandticket
Flexibles Arbeiten
DevOps Engineer (m/w/d) Ansible & Automatisierung | AWX | PowerShell | Python
DevOps Engineer (m/w/d) Ansible & Automatisierung | AWX | PowerShell | Python

n_value group • Ludwigshafen am Rhein

Hybrid
EUR 70.000 - 100.000
Unbefristeter Arbeitsvertrag
Attraktive Vergütung
Weiterbildungen
+2
Data Center/ Platform Systems Engineer Operations (M/W/D)
Data Center/ Platform Systems Engineer Operations (M/W/D)

NTS Deutschland • Leipzig

Vor Ort
EUR 50.000 - 62.000
Weiterbildung
Firmen- und Abteilungsevents
Gesundheitsförderung (RELAX)
Cloud Platform Engineer (m/w/d) Eine ausgezeichnete Möglichkeit, in die IT-Branche einzusteigen. Professional München mehrere Standorte ab sofort
Cloud Platform Engineer (m/w/d) Eine ausgezeichnete Möglichkeit, in die IT-Branche einzusteigen. Professional München mehrere Standorte ab sofort

IP Dynamics GmbH • Deutschland

Remote
EUR 90.000 - 130.000
BusinessBike
EGYM Wellpass
Corporate Benefits
+4
Engineer Plattformbetriebssysteme (all gender)
Engineer Plattformbetriebssysteme (all gender)

ALTEN Germany • Siegburg

Hybrid
EUR 75.000 - 85.000
Unbefristeter Arbeitsvertrag
Attraktive Vergütung
Mobiles Arbeiten nach Absprache
+2
Senior DevOps Engineer (m/w/d) für Brandenburg, Berlin, Braunschweig
Senior DevOps Engineer (m/w/d) für Brandenburg, Berlin, Braunschweig

HyPlus Technology GmbH • Braunschweig

Hybrid
EUR 90.000 - 130.000
Hybrid-/Remote-Modell
Weiterbildung & Zertifizierungen
Zugang zur KI-Plattform
Platform Engineer (m/w/d)
Platform Engineer (m/w/d)

novomind AG • Hamburg

Hybrid
EUR 70.000 - 110.000
Lockere Arbeitsatmosphäre
Flexible Arbeitszeiten
30 Urlaubstage
+7
MS SQL Administrator (m/w/d)
MS SQL Administrator (m/w/d)

n_value group • Ludwigshafen am Rhein

Hybrid
EUR 42.000 - 54.000
Hybrid/Remote Arbeitsmodell
PC-Ausstattung
Data Center/ Platform Systems Engineer Operations (M/W/D)
Data Center/ Platform Systems Engineer Operations (M/W/D)

NTS NETZWERK TELEKOM SERVICE AG • Leipzig

Vor Ort
EUR 50.000 - 62.000
Weiterbildungsmöglichkeiten
Gesundheitsförderung
Moderne IT-Ausstattung
+1
Platform Engineer / System Engineer (all gender) | Kubernetes | Linux | Cloud & Automation
Platform Engineer / System Engineer (all gender) | Kubernetes | Linux | Cloud & Automation

ALTEN Germany • Siegburg

Hybrid
EUR 80.000 - 110.000
Mobiles Arbeiten
Weiterbildungen
Flexible Arbeitszeit
+2