Site Reliability Engineer (w/m/d)

1&1 IONOS SE

Karlsruhe

Hybrid

EUR 75.000 - 105.000

Vollzeit

Vor 11 Tagen

Erhalte mehr Antworten von Arbeitgebern

Versende in nur wenigen Minuten einen passgenauen Lebenslauf.

Benefits dieser Stelle

Hybrides Arbeitsmodell
Vertrauensarbeitszeit
Kantine vor Ort (Standortabhängig)
Kostenlose Getränke
Moderne Büroräume & gute Verkehrsanbid
Weiterbildungsangebote
Mitarbeiterevents

Zusammenfassung

1&1 IONOS SE in Karlsruhe sucht eine erfahrene Site Reliability Engineer (SRE) im Application Hosting Team. Sie gestalten die Kubernetes-Plattform mit, betreiben Managed Nextcloud, Nextcloud Workspace und IONOS GPT, und entwickeln neue Dienste, die auch unter Last zuverlässig funktionieren.

Sie automatisieren Infrastruktur mit Terraform, GitLab CI/CD und ArgoCD, überwachen Systeme proaktiv und verbessern kontinuierlich die Plattform durch robuste Lösungen und effektives Troubleshooting.

Qualifikationen

  • Mehrjährige Erfahrung als SRE oder in verwandten Rollen in Linux/Kubernetes-Umgebungen.
  • Sehr gute Linux-Kenntnisse und Container-Technologien, besonders Kubernetes.
  • Erfahrung mit Infrastructure as Code (Terraform) und CI/CD-Pipelines (GitLab CI/CD, GitHub Actions).
  • Programmier- oder Skriptsprache Go, Python oder Bash zur Automatisierung.
  • Erfahrung mit Monitoring/Logging in verteilten Produktionsumgebungen (Prometheus, Grafana, ELK, FluentD, VictoriaMetrics, icinga).
  • Proaktive, lösungsorientierte Arbeitsweise; gute Deutsch- und Englischkenntnisse.

Aufgaben

  • Weiterentwicklung der Infrastruktur/Plattform unserer Produkte und Integration neuer Dienste in Kubernetes-/Cloud-Infrastruktur.
  • Verantwortlich für stabilen, sicheren Betrieb der Produktplattform; Analysen & Optimierung der containerisierten Systeme.
  • Automatisierung mit Terraform, GitLab CI/CD und ArgoCD zur deklarativen Infrastrukturverwaltung.
  • Analyse und Behebung komplexer Probleme in verteilten Systemlandschaften; stetige Plattformverbesserung.
  • Entwicklung und Pflege von Monitoring-, Logging- und Alerting-Lösungen (Prometheus, Grafana, ELK, VictoriaMetrics) zur frühzeitigen Identifikation von Engpässen.

Kenntnisse

Linux-Systemadministration
Kubernetes
Automation / IaC
CI/CD
Programming/Scripting (Go/Python/Bash)
Problemlösung
Deutsch & Englisch

Tools

Terraform
GitLab CI/CD
ArgoCD
Helm Charts
GitHub Actions
Kubernetes
Prometheus/Grafana
ELK/FluentD/VictoriaMetrics

Jobbeschreibung

Aufgabenbereich

Als Site Reliability Engineer (SRE) in unserem Application Hosting Team bildest du das technische Rückgrat unserer Produktplattform für Managed Nextcloud, Nextcloud Workspace, IONOS GPT sowie weitere Web Services, die wir auf unserer Kubernetes Plattform betreiben. Gemeinsam mit erfahrenen Kolleg*innen entwirfst du neue Dienste und Produkte, die auch bei höchster Last performant und ausfallsicher bleiben.

Aufgabenbereich
  • Dein Haupteinsatzbereich ist die Weiterentwicklung der Infrastruktur/Plattform unserer Produkte, sowie die Integration neuer Produkte/Webdienste in unsere Kubernetes - und Cloud - Infrastruktur.
  • Du bist verantwortlich für den stabilen und sicheren Betrieb unserer Produktplattform. Deine Expertise ist gefragt, wenn es um tiefgreifende Analysen und die Optimierung unserer primär containerisierten und Kubernetes-basierten Anwensungsinfrastruktur geht.
  • Du lebst Automatisierung. Mit Tools wie Terraform, Gitlab CI/CD und ArgoCD provisionierst und verwaltest du unsere gesamte Infrastruktur deklarativ und reproduzierbar.
  • Du analysierst und behebst komplexe Probleme in einer verteilten Systemlandschaft und arbeitest an der stetigen Verbesserung unserer Plattform.
  • Du entwickelst und pflegst unsere Monitoring-, Logging- und Alerting-Lösung (z. B. mit Prometheus, Grafana, ELK-Stack), um proaktiv Engpässe und Fehlerquellen zu identifizieren.
Qualifikationen
  • Du hast mehrjährige Erfahrung als Site Reliability Engineer oder in einer verwandten Rolle (Linux System Administrator, Platform Engineer, DevOps Engineer, Full Stack Developer) in einem Linux und Kubernetes Umfeld.
  • Sehr gute Kenntnisse und mehrjährige Erfahrung in der Verwendung des Linux Betriebssystems, Container-Technologien sowie speziell in Kubernetes.
  • Du hast Erfahrung mit Infrastructure as Code (vorzugsweise Terraform), CI/CD-Pipelines (z. B. GitLab CI/CD oder GitHub Actions) und in der Nutzung und Verwendung von Helm Charts.
  • Du kannst sicher in mindestens einer Programmier- oder Skriptsprache (z. B. Go, Python, Bash) entwickeln, um Automatisierungs- und Monitoring-Aufgaben zu lösen und hast eventuell schon erste Erfahrungen im Bau von Operatoren gesammelt.
  • Erfahrung mit dem Betrieb und der Fehlersuche in hochverfügbaren und verteilten Produktionsumgebungen, einschließlich der Überwachung, der Alarmierung und der Protokollanalyse verteilter Anwendungen (z. B. Prometheus, Grafana, FluentD, ELK, VictoriaMetrics, icinga).
  • Du hast eine proaktive, lösungsorientierte, selbstständige Arbeitsweise und die Fähigkeit, komplexe technische Probleme systematisch zu analysieren und nachhaltig zu beheben.
  • Gute Deutsch- und Englischkenntnisse sind erforderlich.
Benefits
  • Hybrides Arbeitsmodell.
  • Flexible Arbeitszeiten durch Vertrauensarbeitszeit.
  • An einigen Standorten eine bezuschusste Kantine und verschiedene kostenfreie Getränke.
  • Moderne Büroflächen mit sehr guter Verkehrsanbindung.
  • Diverse Mitarbeiterrabatte für Aktivitäten und Produkte.
  • Mitarbeiterevents wie Sommer- und Winterfeiern, sowie Workshops.
  • Zahlreiche Weiterbildungs- und Entwicklungsmöglichkeiten.
  • Verschiedene Gesundheitsangebote, wie Sport- und Gesundheitskurse.
Hol dir deinen kostenlosen, vertraulichen Lebenslauf-Check.
oder ziehe deine Datei hierhin.
Similar jobs

Ähnliche Jobs, die dir auch gefallen könnten

Site Reliability Engineer (f/m/d)
Site Reliability Engineer (f/m/d)

IONOS Group • Berlin

Hybrid
EUR 70.000 - 110.000
Hybrid working model
Flexible hours
Canteen subsidy (where available)
+4
Site Reliability Engineer (f/m/d)
Site Reliability Engineer (f/m/d)

IONOS Group • Karlsruhe

Hybrid
EUR 80.000 - 120.000
Hybrid working model
Flexible working hours
Subsidized canteen at some locations
+4
Site Reliability Engineer (f/m/d)
Site Reliability Engineer (f/m/d)

1&1 IONOS SE • Berlin

Hybrid
EUR 90.000 - 120.000
Hybrid work model
Flexible working hours
Canteen subsidy at some locations
+5
Site Reliability Engineer (f/m/d)
Site Reliability Engineer (f/m/d)

1&1 IONOS SE • Karlsruhe

Hybrid
EUR 70.000 - 100.000
Hybrid work
Flexible hours
Canteen subsidy (at some locations)
+5
Site Reliability Engineer (f/m/d)
Site Reliability Engineer (f/m/d)

IONOS • Karlsruhe

Vor Ort
EUR 85.000 - 110.000
Subsidized canteen
Free drinks
Excellent transport links
+4
Site Reliability Engineer (w/m/d)
Site Reliability Engineer (w/m/d)

IONOS • Berlin

Hybrid
EUR 75.000 - 130.000
Hybrid work model
Flexible hours
Canteen subsidy
+6
Site Reliability Engineer (w/m/d) Application Hosting/TOSAAS
Site Reliability Engineer (w/m/d) Application Hosting/TOSAAS

Jackalope Digital LLC • Karlsruhe

Hybrid
EUR 90.000 - 120.000
Hybrides Arbeitsmodell
Flexible Arbeitszeiten durch Vertrau­e
Bezuschusste Kantine an Standorten
+5
Site Reliability Engineer (SRE) / DevOps Engineer (m/w/d)
Site Reliability Engineer (SRE) / DevOps Engineer (m/w/d)

eddyson • Göttingen

Hybrid
EUR 90.000 - 120.000
Sonderurlaubstage
betriebliche Krankenversicherung
Hansefit
+6
Site Reliability Engineer (w/m/d)
Site Reliability Engineer (w/m/d)

IONOS DE • Karlsruhe

Hybrid
EUR 90.000 - 125.000
Hybrides Arbeitsmodell
Flexible Arbeitszeiten
Belegschaftskantine an Standorten
+6
Site Reliability Engineer (m/w/d) – Konstanz, Berlin oder remote
Site Reliability Engineer (m/w/d) – Konstanz, Berlin oder remote

Jackalope Digital LLC • Konstanz, Berlin

Hybrid
EUR 70.000 - 100.000
Selbstorganisiertes Team
Vielfältiges Tech-Spektrum
Familienfreundliche Arbeitsbedingungen
+1