Site Reliability Engineer (SRE) (m/w/d)

Deutsche Telekom AG

Magdeburg

Vor Ort

EUR 75.000 - 105.000

Vollzeit

14 Tage+

Erhalte mehr Antworten von Arbeitgebern

Versende in nur wenigen Minuten einen passgenauen Lebenslauf.

Benefits dieser Stelle

Flexible Arbeitszeiten
Mobiles Arbeiten
Home-Office-Optionen
Fortbildungen und Karriereentwicklung

Zusammenfassung

Die Deutsche Telekom AG sucht einen Site Reliability Engineer (m/w/d) mit Schwerpunkt Observability, um Transparenz, Stabilität und Zuverlässigkeit unserer Cloud-, Edge- und Kubernetes-Plattformen sicherzustellen.

Sie implementieren OpenTelemetry, Jaeger und SIEM-Integration, automatisieren Prozesse mit Go/Python, und arbeiten an skalierbaren Telemetrie-Architekturen in einer verteilten Infrastruktur.

Qualifikationen

  • Sehr gute Kenntnisse in OpenTelemetry, insbesondere OpenTelemetry Collector, OTLP, SDKs und Auto-Instrumentation.
  • Fundierte Erfahrung mit Distributed Tracing, Span Correlation, Context Propagation und Sampling-Strategien.
  • Erfahrung im Aufbau und Betrieb von Jaeger, insbesondere Trace Storage, Indexierung und Query-Optimierung.
  • Fundierte Kenntnisse in der Integration von SIEM-Lösungen, im Security Event Management sowie im Einsatz von CEF‑ und Syslog-basierten Protokollen.
  • Gute Programmierkenntnisse in Go, Python oder Shell zur Umsetzung von Telemetrie-, Integrations- und Automatisierungsaufgaben.
  • Erfahrung im Bereich Kubernetes Observability, Cloud‑Native‑Plattformen sowie moderner Telemetrie‑Architekturen.
  • Ausgeprägtes Verständnis für IT‑Sicherheit und Security Awareness.
  • Analytische und strukturierte Arbeitsweise.
  • Erfahrung im Site Reliability Engineering oder Infrastruktur‑Betrieb.
  • Sehr gutes Deutsch in Wort und Schrift (C1‑Niveau).

Aufgaben

  • Implementierung, Konfiguration und Betrieb von OpenTelemetry für Metrics, Logs und Distributed‑Tracing‑Pipelines.
  • Integration, Administration und kontinuierliche Optimierung von Jaeger zur Visualisierung und Analyse verteilter Services.
  • Konzeption und Umsetzung von Korrelationsmechanismen zwischen Logs, Metrics und Traces für End‑to‑End‑Observability.
  • Integration von Security‑, Infrastruktur‑ und Plattform‑Events in zentrale SIEM‑ und Analyseplattformen.
  • Entwicklung und Etablierung von Telemetrie‑ und Observability‑Standards für Cloud‑Native‑ und Kubernetes‑Plattformen.
  • Sicherstellung eines zuverlässigen und performanten Betriebs von Observability‑Lösungen in Air‑Gap, Edge, Fog und verteilten Infrastrukturen.

Kenntnisse

OpenTelemetry
Distributed Tracing
Jaeger
SIEM-Integration
Go
Python
Shell
Kubernetes-Observability
Cloud-Native-Plattformen
IT-Sicherheit
Deutsch (C1)

Tools

OpenTelemetry Collector
OTLP
Auto-Instrumentation
Jaeger

Jobbeschreibung

Stellendetails zu: Site Reliability Engineer (SRE) (m/w/d)

Arbeitgeber: Deutsche Telekom AG

Beginn ab 01.10.2026

Arbeitsort: verschiedene Arbeitsorte

Anstellungsart: Vollzeit

Über die Position

Als Site Reliability Engineer mit Schwerpunkt Observability tragen Sie maßgeblich dazu bei, Transparenz, Stabilität und Zuverlässigkeit unserer verteilten Cloud-, Edge- und Kubernetes-Plattformen sicherzustellen. Sie übernehmen eine zentrale Rolle bei der Konzeption, Implementierung und kontinuierlichen Weiterentwicklung moderner Observability-Lösungen und schaffen die Grundlage für einen zuverlässigen Betrieb komplexer, cloud-nativer Infrastrukturen.

Sie implementieren und betreiben Jaeger als zentrale Plattform für Distributed Tracing und entwickeln Korrelationsmechanismen zwischen Logs, Metrics und Traces, um Fehlerursachen schnell zu identifizieren. Sie integrieren Security-, Infrastruktur- und Plattform-Events in zentrale SIEM-Lösungen und entwickeln standardisierte Telemetrie- und Instrumentierungskonzepte für Kubernetes- und Cloud‑Native‑Plattformen.

Mit Ihren Programmierkenntnissen in Go, Python oder Shell automatisieren Sie Integrations‑ und Betriebsprozesse und leisten einen wesentlichen Beitrag zur Weiterentwicklung einer skalierbaren Plattform.

Qualifikationen

Sehr gute Kenntnisse in OpenTelemetry, insbesondere im Umgang mit dem OpenTelemetry Collector, OTLP, SDKs sowie Auto‑Instrumentation.

  • Fundierte Erfahrung mit Distributed Tracing, Span Correlation, Context Propagation und Sampling‑Strategien.
  • Erfahrung im Aufbau und Betrieb von Jaeger, insbesondere hinsichtlich Trace Storage, Indexierung und Query‑Optimierung.
  • Fundierte Kenntnisse in der Integration von SIEM‑Lösungen, im Security Event Management sowie im Einsatz von CEF‑ und Syslog‑basierten Protokollen.
  • Gute Programmierkenntnisse in Go, Python oder Shell zur Umsetzung von Telemetrie‑, Integrations‑ und Automatisierungsaufgaben.
  • Erfahrung im Bereich Kubernetes Observability, Cloud‑Native‑Plattformen sowie moderner Telemetrie‑Architekturen.
  • Ausgeprägtes Verständnis für IT‑Sicherheit und Security Awareness.
  • Analytische und strukturierte Arbeitsweise.
  • Erfahrung im Site Reliability Engineering oder Infrastruktur‑Betrieb.
  • Sehr gutes Deutsch in Wort und Schrift (C1‑Niveau).
Aufgaben
  • Implementierung, Konfiguration und Betrieb von OpenTelemetry für Metrics, Logs und Distributed‑Tracing‑Pipelines.
  • Integration, Administration und kontinuierliche Optimierung von Jaeger zur Visualisierung und Analyse verteilter Services.
  • Konzeption und Umsetzung von Korrelationsmechanismen zwischen Logs, Metrics und Traces für End‑to‑End‑Observability.
  • Integration von Security‑, Infrastruktur‑ und Plattform‑Events in zentrale SIEM‑ und Analyseplattformen.
  • Entwicklung und Etablierung von Telemetrie‑ und Observability‑Standards für Cloud‑Native‑ und Kubernetes‑Plattformen.
  • Sicherstellung eines zuverlässigen und performanten Betriebs von Observability‑Lösungen in Air‑Gap, Edge, Fog und verteilten Infrastrukturen.
Was Sie erwarten

Eine anspruchsvolle Aufgabe im Umfeld moderner Cloud‑Native, Kubernetes, Edge und Observability‑Technologien. Sie arbeiten in einem technologisch anspruchsvollen Umfeld mit hohem Gestaltungsspielraum und leisten einen wesentlichen Beitrag zur Stabilität, Sicherheit und Skalierbarkeit geschäftskritischer Systeme.

Was wir bieten
  • Flexibilität und Work‑Life‑Balance: flexible Arbeitszeiten, mobile Arbeit und hybrides Modell.
  • Attraktive Vergütung: wettbewerbsfähiges Gehaltspaket.
  • Entwicklungsmöglichkeiten: umfangreiche Weiterbildungsangebote, Schulungen und Karriereentwicklungsprogramme.
  • Modernes Arbeitsumfeld: moderne Ausstattung und neueste Technologien.
  • Starke Unternehmenskultur: offene und kollegiale Arbeitsatmosphäre.
  • Gesundheit und Wohlbefinden: Gesundheitsförderung und Initiativen.
  • Zusatzleistungen: betriebliche Altersvorsorge, Mitarbeiterrabatte, Jobticket‑Optionen.
Hol dir deinen kostenlosen, vertraulichen Lebenslauf-Check.
oder ziehe deine Datei hierhin.
Similar jobs

Ähnliche Jobs, die dir auch gefallen könnten

Site Reliability Engineer (SRE) (m/w/d)
Site Reliability Engineer (SRE) (m/w/d)

Deutsche Telekom AG • Dresden

Vor Ort
EUR 80.000 - 130.000
Flexible Arbeitszeiten
Mobiles Arbeiten
Hybrides Arbeitsmodell
+2
Site Reliability Engineer (SRE) / DevOps Engineer (m/w/d)
Site Reliability Engineer (SRE) / DevOps Engineer (m/w/d)

eddy's pulse • Göttingen

Hybrid
EUR 80.000 - 110.000
Sonderurlaubstage
Betriebliche Krankenversicherung
Hansefit
+5
Site Reliability Engineer (SRE) / DevOps Engineer (m/w/d)
Site Reliability Engineer (SRE) / DevOps Engineer (m/w/d)

eddyson • Göttingen

Hybrid
EUR 90.000 - 120.000
Sonderurlaubstage
betriebliche Krankenversicherung
Hansefit
+6
Senior Site Reliability Engineer
Senior Site Reliability Engineer

ZABEL • Hamburg

Hybrid
EUR 99.000 - 121.000
Flexible Arbeitszeiten
Remote-Arbeit möglich
Weiterbildung
+4
Site Reliability Engineer (w/m/d)
Site Reliability Engineer (w/m/d)

1&1 IONOS SE • Karlsruhe

Hybrid
EUR 75.000 - 105.000
Hybrides Arbeitsmodell
Vertrauensarbeitszeit
Kantine vor Ort (Standortabhängig)
+4
Site Reliability Engineer (m/w/d)
Site Reliability Engineer (m/w/d)

Assecor GmbH • Berlin

Hybrid
EUR 55.000 - 75.000
Flexible Arbeitszeiten
Weiterbildungsmöglichkeiten
Betriebliche Altersvorsorge
+2
Site Reliability Engineer (w/m/d)
Site Reliability Engineer (w/m/d)

TieTalent • Karlsruhe

Vor Ort
EUR 50.000 - 65.000
Abgeschlossenes Studium der Informatik oder vergleichbares
38,5-Stunden-Woche und 32 Tage bezahlte Freistellung
100 % arbeitgeberfinanzierte betriebliche Altersvorsorge
+3
Devops Engineer im Bereich Digitale Identitäten (m/w/d)
Devops Engineer im Bereich Digitale Identitäten (m/w/d)

United States Digital Space LLC • Berlin

Vor Ort
EUR 50.000 - 70.000
Flexible Arbeitsbedingungen
30 Tage Urlaub
Betriebliche Altersvorsorge
+2
Senior Site Reliability Engineer (m/w/d)
Senior Site Reliability Engineer (m/w/d)

Remotely • Berlin

Hybrid
EUR 90.000 - 140.000
Remote Work aus Deutschland
Homeoffice-Budget
Learning & Development Budget
+2
Site Reliability Engineer (m/w/d)
Site Reliability Engineer (m/w/d)

Bundesdruckerei Gruppe GmbH • Berlin

Vor Ort
EUR 70.000 - 110.000