Principal DevOps Engineer (m/w/d) für Industrial AI Cloud

Deutsche Telekom

Reus

Hybrid

EUR 90,000 - 130,000

Full time

14 hours ago
Be an early applicant
Application generator

An application made for this job — a tailored resume and cover letter that speak straight to the posting.

Get past ATS filters

Benefits offered by this job

26+ Urlaubstage
Hybrides Arbeiten
Coursera Schulungen
Sprachkurse Englisch/Spanisch/Deutsch
Mentoring
Telemedizin
Krankenversicherung
Lebensversicherung
Essensgutscheine
Kinderbetreuung
Transport
Sozialfonds

Job summary

T-Systems in Deutschland ist führend in der Bereitstellung einer industriellen KI-Cloud für Europa. Als DevOps Engineer Principal begleiten Sie Unternehmenskunden durch Onboarding, Schulung und frühe Implementierung der KI-Plattform.

Sie gestalten PoCs, optimieren Workloads, implementieren KI-/ML-Pipelines und sichern eine reibungslose Integration komplexer Systeme. Sie arbeiten eng mit Kunden, Infrastruktur- und Sicherheitsteams zusammen, um maßgeschneiderte Architekturen zu entwerfen, Best

Qualifications

  • Mindestens 3 Jahre Erfahrung im Design und Bereitstellung von Systemen basierend auf IaaS, PaaS und SaaS.
  • Erfahrung mit GPU-basierter Infrastruktur.
  • Fundierte Kenntnisse in Kubernetes-Container-basierten Technologien.
  • Expertenkenntnisse in Python/Bash.
  • Expertenkenntnisse in Automatisierungstools und automatisierten Deployments (Ansible/Terraform/Helm/Salt-Stack).
  • Expertenkenntnisse in CI/CD in einer Kubernetes-Umgebung und Repository-Management.
  • Experte in Automatisierung mit Git (GitHub, GitLab) und CI/CD-Tools wie GitHub Actions oder GitLab CI/CD.
  • Ausgeprägte Erfahrung mit Linux OS.
  • Erfahrung mit Monitoring- und Visualisierungstools (Grafana, Prometheus).
  • Englisch auf B2-Niveau.
  • Gute Kommunikationsfähigkeiten, analytisches Denken, Teamfähigkeit.
  • Präsentationsfähigkeiten, Verhandlungsgeschick, grundlegende Projektmanagement- und Führungsfähigkeiten.
  • Fortgeschrittene Kenntnisse im Qualitätsmanagement.
  • Deutschkenntnisse als Vorteil.

Responsibilities

  • Beratung von Kunden zu technischen Aspekten rund um GPU-Infrastruktur und Plattformnutzung.
  • Leitung von Onboarding und Schulungen, Mentoring von Kundenspezialisten zur optimalen Nutzung ihrer GPU-Cluster und KI-Umgebungen.
  • Design und Implementierung von PoCs, einschließlich Umgebungssetup, Datenverarbeitungspipelines und Deployment-Workflows.
  • Durchführung von Anforderungsanalysen, Übersetzung von Geschäftsanforderungen in technische Spezifikationen.
  • Unterstützung von Kunden bei Performance-Optimierung, Troubleshooting, Feinabstimmung und Validierung gelieferter Lösungen.
  • Funktion als zentraler technischer Ansprechpartner, Koordination funktionsübergreifender Teams in Infrastruktur, Netzwerk, Automatisierung, Sicherheit und KI-Services.
  • Vorschlag und Entwicklung von Automatisierungskonzepten zur Verbesserung von Services, Prozessen und Betriebsmodellen.
  • Sicherstellung, dass Best Practices in Bezug auf Zuverlässigkeit, Skalierbarkeit und Sicherheit angewendet werden.
  • Unterstützung bei Monitoring, Observability und Kapazitätsplanung für KI-Workloads und GPU-Auslastung.

Skills

GPU-Infrastruktur
Kubernetes
Python
Bash
Ansible
Terraform
Helm
GitHub Actions
GitLab CI/CD
Linux-OS
Grafana
Prometheus
Englisch B2
Kommunikationsfähigkeiten
Teamfähigkeit
Präsentationsfähigkeiten
Verhandlungsgeschick
Projektmanagement-Grundlagen
Führungsfähigkeiten
Qualitätsmanagement

Tools

GitHub
GitLab
Docker
Grafana
Prometheus

Job description

NVIDIA und die Deutsche Telekom entwickeln gemeinsam eine industrielle KI-Cloud für Europa. Diese KI‑Fabrik in Deutschland wird 10.000 GPUs auf NVIDIA DGX B200-Systemen und RTX Pro Servern hosten. Als DevOps Engineer Principal begleitest du Unternehmenskunden durch Onboarding, Schulung und frühe Einführung der KI‑Plattform.

Zu deiner Verantwortung gehört es, Kundenanforderungen zu verstehen, Lösungsdesign zu unterstützen, Proofs of Concept (PoCs) durchzuführen und eine reibungslose Integration von Kunden-Workloads (LLMs, GPU‑Computing, KI‑Pipelines) sicherzustellen. Du agierst als vertrauenswürdiger technischer Berater und hilfst Kunden, ihre GPU‑Cluster und KI‑Toolchains effizient zu nutzen.

In dieser Position spielst du eine Schlüsselrolle dabei, Unternehmenskunden bei der erfolgreichen Einführung und Skalierung der KI‑Plattform zu unterstützen. Du begleitest Kunden durch Onboarding, Schulung und frühe Implementierung modernster KI‑Lösungen. Du arbeitest eng mit ihnen zusammen, um ihre technischen und geschäftlichen Anforderungen zu verstehen, unterstützt das Design maßgeschneiderter Architekturen und leitest Proofs of Concept, die den realen Mehrwert validieren. Du stellst die reibungslose Integration komplexer Workloads sicher – vom LLM‑Deployment und der GPU‑Computing‑Optimierung bis hin zum Aufbau durchgängiger KI/ML‑Pipelines. Als vertrauenswürdiger technischer Berater befähigst du Kunden, ihre GPU‑Cluster und KI‑Toolchains effizient zu nutzen, Herausforderungen zu beheben und Best Practices zu übernehmen, die ihre KI‑Reise beschleunigen.

Aufgaben
  • Beratung von Kunden zu allen technischen Aspekten rund um GPU‑Infrastruktur und Plattformnutzung
  • Leitung von Onboarding und Schulungen, Mentoring von Kundenspezialisten zur optimalen Nutzung ihrer GPU‑Cluster und KI‑Umgebungen
  • Design und Implementierung von PoCs, einschließlich Umgebungssetup, Datenverarbeitungspipelines und Deployment‑Workflows
  • Durchführung von Anforderungsanalysen, Übersetzung von Geschäftsanforderungen in technische Spezifikationen
  • Unterstützung von Kunden bei Performance‑Optimierung, Troubleshooting, Feinabstimmung und Validierung gelieferter Lösungen
  • Funktion als zentraler technischer Ansprechpartner, Koordination funktionsübergreifender Teams in den Bereichen Infrastruktur, Netzwerk, Automatisierung, Sicherheit und KI‑Services
  • Vorschlag und Entwicklung von Automatisierungskonzepten zur Verbesserung von Services, Prozessen und Betriebsmodellen
  • Sicherstellung, dass Best Practices in Bezug auf Zuverlässigkeit, Skalierbarkeit und Sicherheit über den gesamten Kundenlebenszyklus hinweg angewendet werden
  • Unterstützung bei Monitoring, Observability und Kapazitätsplanung für KI‑Workloads und GPU‑Auslastung
Dein Profil

Wir suchen einen DevOps Engineer Principal mit umfangreicher Erfahrung in Cloud‑Infrastruktur, GPU‑basierten Systemen, Kubernetes, Automatisierungstools und CI/CD‑Pipelines. Der ideale Kandidat sollte über ausgeprägte technische Expertise in Linux‑Umgebungen, Skriptsprachen und Monitoring‑Tools verfügen, kombiniert mit ausgezeichneten Kommunikations‑ und Führungsfähigkeiten.

Muss‑Kriterien
  • Mindestens 3 Jahre Erfahrung im Design und der Bereitstellung von Systemen basierend auf IaaS, PaaS und SaaS
  • Erfahrung mit GPU‑basierter Infrastruktur
  • Fundierte Kenntnisse in Kubernetes‑Container‑basierten Technologien
  • Expertenkenntnisse in Skriptsprachen (Python/Bash)
  • Expertenkenntnisse in Automatisierungstools und automatisierten Deployments (Ansible/Salt‑stack/Terraform/Helm)
  • Expertenkenntnisse in CI/CD in einer Kubernetes‑Umgebung und Repository‑Management
  • Experte in Automatisierung mit Git (GitHub, GitLab) und CI/CD‑Tools wie GitHub Actions oder GitLab CI/CD
  • Ausgeprägte Erfahrung mit Linux OS
  • Erfahrung mit Monitoring‑ und Visualisierungstools (Grafana, Prometheus)
  • Englisch auf B2‑Niveau
  • Gute Kommunikationsfähigkeiten
  • Analytisches Thinking
  • Teamfähigkeit
  • Präsentationsfähigkeiten
  • Verhandlungsgeschick
  • Grundlegende Projektmanagement‑Kenntnisse
  • Grundlegende Führungsfähigkeiten
  • Fortgeschrittene Kenntnisse im Qualitätsmanagement
Von Vorteil
  • Deutschkenntnisse
Über uns

T‑Systems ist Teil der Deutsche Telekom Gruppe mit rund 30.000 Mitarbeitern weltweit. Wir schaffen Technologie mit Sinn, um eine positive Wirkung auf die Gesellschaft zu erzielen. Wir suchen neugierige Talente, die lernbegierig sind, Herausforderungen annehmen und Ideen einbringen, die die Erfahrung unserer Kunden transformieren.

Wir vertrauen Menschen: Wir bieten Autonomie, kontinuierliche Unterstützung und ein kollaboratives Umfeld, in dem du ohne Grenzen wachsen kannst. Wir sind ein globales Team, geleitet von Respekt, Integrität und der Leidenschaft, jeden Tag besser zu werden.

Arbeitsumfeld & Flexibilität
  • Internationales, dynamisches und kollaboratives Umfeld
  • T Social: soziale Initiativen (Sport, Community, Gesundheit, ...)
  • Hybrides Arbeitsmodell (remote/vor Ort)
  • Flexible Arbeitszeiten
Wachstum & Entwicklung
  • Maßgeschneiderte Schulungen: Zugang zu Coursera, um zu lernen, was du willst, wann du willst
  • Wöchentliche Sprachkurse (Englisch, Spanisch & Deutsch)
  • Internationale Mentoring‑Sessions & Experience Days
Vergütung & Benefits
  • Flexibler Vergütungsplan (Krankenversicherung, Essensgutscheine, Kinderbetreuung, Transport)
  • Telemedizin
  • Lebens‑ und Unfallversicherung
  • Sozialfonds
Wohlbefinden & Freizeit
  • 26+ Arbeitstage Urlaub pro Jahr
  • Kostenloser Zugang zu Fachdiensten (medizinisch, rechtlich, Wellness)
  • 100% Gehaltsfortzahlung während Krankheitsurlaub
Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Principal DevOps Engineer (m/w/d) für Industrial AI Cloud
Principal DevOps Engineer (m/w/d) für Industrial AI Cloud

Deutsche Telekom • Sevilla

Hybrid
EUR 90,000 - 130,000
Hybrides Arbeitsmodell
Flexible Arbeitszeiten
26+ Urlaubstage
+2
Principal DevOps Engineer (m/w/d) für Industrial AI Cloud
Principal DevOps Engineer (m/w/d) für Industrial AI Cloud

Deutsche Telekom • La Coruña

Hybrid
EUR 90,000 - 140,000
Hybrides Arbeitsmodell
Flexible Arbeitszeiten
Coursera Kurse
+6
Principal DevOps Engineer (m/w/d) für Industrial AI Cloud
Principal DevOps Engineer (m/w/d) für Industrial AI Cloud

Deutsche Telekom • Gijón

Hybrid
EUR 90,000 - 130,000
Deutschkenntnisse
Principal DevOps Engineer (m/w/d) für Industrial AI Cloud
Principal DevOps Engineer (m/w/d) für Industrial AI Cloud

Deutsche Telekom • Madrid

Hybrid
EUR 110,000 - 160,000
Deutschkenntnisse
Principal DevOps Engineer (m/w/d) für Industrial AI Cloud
Principal DevOps Engineer (m/w/d) für Industrial AI Cloud

Deutsche Telekom • Granada

Hybrid
EUR 90,000 - 150,000
Krankenversicherung
Essensgutscheine
Kinderbetreuung
+6
Principal DevOps Engineer (m/w/d) für Industrial AI Cloud
Principal DevOps Engineer (m/w/d) für Industrial AI Cloud

Deutsche Telekom • Bilbao

Hybrid
EUR 90,000 - 130,000
Deutschkenntnisse
Senior DevOps Engineer (m/w/d) für Industrial AI Cloud
Senior DevOps Engineer (m/w/d) für Industrial AI Cloud

Deutsche Telekom • Gijón

Hybrid
EUR 70,000 - 100,000
Flexibles Arbeitsmodell
Weiterbildungsmöglichkeiten
Krankenschutz
Senior DevOps Engineer (m/w/d) für Industrial AI Cloud
Senior DevOps Engineer (m/w/d) für Industrial AI Cloud

Deutsche Telekom • Bilbao

Hybrid
EUR 60,000 - 90,000
Krankenversicherung
Essensgutscheine
Kinderbetreuung
+4
Senior DevOps Engineer (m/w/d) für Industrial AI Cloud
Senior DevOps Engineer (m/w/d) für Industrial AI Cloud

Deutsche Telekom • Sevilla

Hybrid
EUR 90,000 - 130,000
Flexible Arbeitszeiten
Hybrides Arbeitsmodell
Coursera Kurse
+4
Expert DevOps Engineer (m/w/d) für Industrial AI Cloud
Expert DevOps Engineer (m/w/d) für Industrial AI Cloud

Deutsche Telekom • Sevilla

Hybrid
EUR 90,000 - 130,000
Krankenversicherung
Essensgutscheine
Kinderbetreuung
+4