Site Reliability Engineer (SRE) München (m/w/d)

ventx GmbH

München

Hybrid

EUR 90.000 - 130.000

Vollzeit

14 Tage+
Bewerbungsgenerator

Mach aus dieser Rolle ein Vorstellungsgespräch — ein Lebenslauf und ein Anschreiben, die darauf ausgerichtet sind, was dieser Arbeitgeber sucht.

Schaffe es an den ATS-Filtern vorbei

Benefits dieser Stelle

Kostenlose Kantine
Kostenlose Getränke
Essenszuschuss
Massagen
Wunschhardware
Hervorragende Arbeitsplatzausstattung
Chill-Out Area
Dusche

Zusammenfassung

ventx GmbH sucht einen Site Reliability Engineer, der die Zuverlässigkeit, Skalierbarkeit und Performance der Kundeninfrastrukturen sicherstellt. Du betreibst Kubernetes-Clustern in Cloud-Umgebungen, automatisierst Infrastructure-as-Code-Prozesse und analysierst Störungen.

Du arbeitest eng mit Entwicklungsteams zusammen, kommunizierst komplexe Sachverhalte verständlich und bringst Hands-on-Mentalität mit. Kenntnisse in Deutsch und Englisch sind willkommen.

Qualifikationen

  • Mindestens 3 Jahre Berufserfahrung als SRE/DevOps.
  • Erfahrung mit Infrastructure as Code (Terraform/Ansible/Pulumi).
  • Fundierte Kubernetes-Kenntnisse (EKS/GKE/AKS).
  • Erfahrung mit Monitoring-Lösungen wie Prometheus/Grafana/Datadog.
  • Praktische Erfahrung mit einer Public Cloud (AWS/Azure/GCP).
  • Git-basierte Workflows und CI/CD-Pipelines (GitLab CI/GitHub Actions/Jenkins).
  • Sehr gute Deutschkenntnisse; gutes Englisch.

Aufgaben

  • Aufbau und Wartung von Monitoring- und Alerting-Systemen.
  • Automatisierung von Infrastrukturprozessen mittels Infrastructure as Code.
  • Betrieb von Kubernetes-Clustern in Cloud-Umgebungen und Optimierung.
  • Analyse von Incidents und Post-Mortem-Dokumentation.
  • Entwicklung von Backup- und Disaster-Recovery-Strategien.
  • Zusammenarbeit mit Entwicklungsteams an Deployments und Release-Prozessen.
  • Erstellung und Pflege von Runbooks und technischer Dokumentation.

Kenntnisse

3 Jahre Erfahrung
IaC
Kubernetes
Monitoring
Public Cloud
CI/CD-Pipeline
Deutsch
Englisch

Tools

Terraform
Ansible
Pulumi

Jobbeschreibung

Als Site Reliability Engineer bei ventx arbeiten Sie an der Schnittstelle zwischen Entwicklung und Betrieb. Sie verantworten die Zuverlässigkeit, Skalierbarkeit und Performance unserer Kundeninfrastrukturen, die auf Kubernetes und Public Cloud Plattformen basieren.

Ihre Kernaufgaben umfassen den Aufbau und die Automatisierung von Monitoring-Lösungen, die Implementierung von Infrastructure-as-Code-Ansätzen sowie die kontinuierliche Verbesserung von CI/CD-Pipelines. Sie analysieren Störungen, entwickeln Lösungen zur Vermeidung von Wiederholungen und arbeiten eng mit den Entwicklungsteams zusammen.

Wir suchen einen Kandidaten, der bereits Erfahrung im Betrieb von verteilten Systemen mitbringt und Scrum-Methoden anwenden kann. Die Position erfordert Hands-on-Mentalität sowie die Fähigkeit, komplexe technische Sachverhalte verständlich zu kommunizieren.

Deine Aufgaben
  • Entwicklung und Wartung von Monitoring- und Alerting-Systemen zur Sicherstellung der Systemverfügbarkeit
  • Automatisierung von Infrastrukturprozessen mittels Infrastructure as Code
  • Betrieb und Optimierung von Kubernetes-Clustern in Cloud-Umgebungen
  • Analyse und Behebung von Incidents einschließlich Post-Mortem-Dokumentation
  • Implementierung von Backup- und Disaster-Recovery-Strategien
  • Zusammenarbeit mit Entwicklungsteams zur Verbesserung der Deployments und Release-Prozesse
  • Erstellung und Pflege von Runbooks sowie technischer Dokumentation
Dein Profil (Must-Haves)
  • Mindestens 3 Jahre Berufserfahrung als SRE, DevOps Engineer oder in vergleichbarer Rolle
  • Erfahrung mit Infrastructure as Code (Terraform, Ansible oder Pulumi)
  • Fundierte Kenntnisse in Kubernetes (EKS, GKE oder AKS)
  • Erfahrung mit Monitoring-Lösungen wie Prometheus, Grafana oder Datadog
  • Praktische Erfahrung mit mindestens einer Public Cloud Plattform (AWS, Azure oder GCP)
  • Erfahrung mit Git-basierten Workflows und CI/CD-Pipelines (GitLab CI, GitHub Actions oder Jenkins)
  • Sehr gute Deutschkenntnisse in Wort und Schrift
  • Gute Englischkenntnisse in Wort und Schrift
Wünschenswert (Nice-to-Haves)
  • Zertifizierungen wie CKA, CKAD, AWS Solutions Architect oder Azure Administrator
  • Erfahrung mit Service Mesh (Istio, Linkerd oder Consul Connect)
  • Kenntnisse in Programmiersprachen wie Python, Go oder Bash-Scripting
  • Erfahrung mit Container-Sicherheitstools (Trivy, Falco oder Aqua Security)
  • Kenntnisse von Chaos Engineering (Gremlin, Litmus oder Chaos Monkey)
  • Erfahrung mit Log-Aggregation (ELK Stack, Loki oder Splunk)
Benefits
  • Kostenlose Kantine
  • Kostenlose Getränke
  • Essenszuschuss und Snacks
  • Massagen
  • Zuschuss zu Mitarbeiteraktivitäten
  • Wunschhardware
  • Hervorragende Arbeitsplatzausstattung
  • Chill-Out Area
  • Wasch- und Bügelservice
  • Dusche

Hybrides Arbeiten: bis zu 50% Remote, der Rest vor Ort.

Hol dir deinen kostenlosen, vertraulichen Lebenslauf-Check.
oder ziehe deine Datei hierhin.
Similar jobs

Ähnliche Jobs, die dir auch gefallen könnten

Site Reliability Engineer (SRE) / DevOps Engineer (m/w/d)
Site Reliability Engineer (SRE) / DevOps Engineer (m/w/d)

eddyson • Göttingen

Hybrid
EUR 90.000 - 120.000
Sonderurlaubstage
betriebliche Krankenversicherung
Hansefit
+6
Site Reliability Engineer (w/m/d)
Site Reliability Engineer (w/m/d)

1&1 IONOS SE • Karlsruhe

Hybrid
EUR 75.000 - 105.000
Hybrides Arbeitsmodell
Vertrauensarbeitszeit
Kantine vor Ort (Standortabhängig)
+4
Site Reliability Engineer - Kubernetes / DevOps (m/w/d)
Site Reliability Engineer - Kubernetes / DevOps (m/w/d)

StudentJob • Karlsruhe

Hybrid
EUR 60.000 - 90.000
Hybrid-Arbeitsmodell
Mitarbeitervergünstigungen
Mitarbeiterveranstaltungen
+2
Site Reliability Engineer (SRE) / DevOps Engineer (m/w/d)
Site Reliability Engineer (SRE) / DevOps Engineer (m/w/d)

eddy's pulse • Göttingen

Hybrid
EUR 80.000 - 110.000
Sonderurlaubstage
Betriebliche Krankenversicherung
Hansefit
+5
Senior Site Reliability Engineer
Senior Site Reliability Engineer

ZABEL • Hamburg

Hybrid
EUR 72.000 - 120.000
Flexible Arbeitszeiten
Remote-Arbeit Ausland möglich
Weiterbildungsmöglichkeiten
+4
DevOps Cloud Engineer Public Cloud [München] (m/w/d)
DevOps Cloud Engineer Public Cloud [München] (m/w/d)

ventx GmbH • München

Hybrid
EUR 90.000 - 120.000
Kostenlose Kantine
Kostenlose Getränke
Essenszuschuss und Snacks
+7
Site Reliability Engineer (SRE) (m/w/d)
Site Reliability Engineer (SRE) (m/w/d)

Deutsche Telekom AG • Dresden

Vor Ort
EUR 80.000 - 130.000
Flexible Arbeitszeiten
Mobiles Arbeiten
Hybrides Arbeitsmodell
+2
Site Reliability Engineer - extern (m/w/d)
Site Reliability Engineer - extern (m/w/d)

aixigo AG • Deutschland

Hybrid
EUR 90.000 - 120.000
Großes Gestaltungsspielraum
Flexibles Arbeitsmodell (Office oder-H
Frisches Obst und Gemüse
+2
Site Reliability Engineer Kubernetes (m/w/d)
Site Reliability Engineer Kubernetes (m/w/d)

StudentJob • Karlsruhe

Hybrid
EUR 70.000 - 110.000
Hybrid Working Model
Flexible Arbeitszeiten
Kantin/Speisen vor Ort
+4
Site Reliability Engineer für Cloud-Lösungen | Kubernetes | 100% remote, bis 120.000 € (mwd)
Site Reliability Engineer für Cloud-Lösungen | Kubernetes | 100% remote, bis 120.000 € (mwd)

Vesterling AG • Deutschland

Vor Ort
EUR 90.000 - 120.000
Strukturiertes Onboarding
Moderne Arbeitsplätze
Weiterbildungsmaßnahmen
+9