Principal DevOps Engineer (m/w/d) für Industrial AI Cloud

Deutsche Telekom

Gijón

Hybrid

EUR 90,000 - 130,000

Full time

17 hours ago
Be an early applicant
Application generator

Don’t send a generic resume — generate a resume and cover letter tailored to this exact role.

Get past ATS filters

Benefits offered by this job

Deutschkenntnisse

Job summary

Deutsche Telekom sucht einen DevOps Engineer Principal, der Kunden durch Onboarding, Schulung und frühe Implementierung moderner KI-Lösungen begleitet. Sie arbeiten eng mit Kunden zusammen, um Anforderungen zu verstehen, Architekturen zu entwerfen und PoCs zu leiten, damit LLM-Deployments, GPU-Computing und End-to-End-KI-Pipelines möglichst reibungslos laufen.

Sie fungieren als technischer Berater, unterstützen Skalierung, Optimierung von Workloads und Koordination funktionsübergreifender Teams

Qualifications

  • Mindestens 3 Jahre Erfahrung im Design und der Bereitstellung von Systemen basierend auf IaaS, PaaS und SaaS.
  • Erfahrung mit GPU-basierter Infrastruktur und Kubernetes-Containern.
  • Fundierte Kenntnisse in CI/CD in einer Kubernetes-Umgebung und Repository-Management.
  • Expertenkenntnisse in Automatisierung mit Git (GitHub, GitLab) und CI/CD-Tools wie GitHub Actions oder GitLab CI/CD.
  • Ausgeprägte Erfahrung mit Linux OS.
  • Englischkenntnisse auf B2-Niveau.
  • Gute Kommunikationsfähigkeiten, analytisches Denken, Teamfähigkeit und Präsentationsfähigkeiten.
  • Verhandlungsgeschick und grundlegende Projektmanagement-Kenntnisse.

Responsibilities

  • Beratung von Kunden zu technischen Aspekten rund um GPU-Infrastruktur und Plattformnutzung.
  • Leitung von Onboarding und Schulungen, Mentoring von Kundenspezialisten.
  • Design und Implementierung von PoCs inklusive Umgebungssetup und Deployment-Workflows.
  • Durchführung von Anforderungsanalysen und Übersetzung in technische Spezifikationen.
  • Unterstützung von Kunden bei Performance-Optimierung, Troubleshooting und Validierung.
  • Koordination funktionsübergreifender Teams in Infrastruktur, Netzwerk, Automatisierung, Sicherheit und KI-Services.
  • Entwicklung von Automatisierungskonzepten zur Verbesserung von Services und Betriebsmodellen.

Skills

GPU-Infrastruktur
Kubernetes
Automatisierung
CI/CD
Scripting Python/Bash
Linux OS
Monitoring Grafana/Prometheus
GitHub/GitLab Actions
Kommunikation
Teamfähigkeit
Präsentationsfähigkeiten
Verhandlungsgeschick
Projektmanagement
Führungsfähigkeiten
Qualitätsmanagement

Tools

Kubernetes
Ansible
SaltStack
Terraform
Helm
GitHub
GitLab
GitHub Actions
GitLab CI/CD
Grafana
Prometheus
Python
Bash

Job description

Deine Aufgabe

NVIDIA und die Deutsche Telekom entwickeln gemeinsam eine industrielle KI-Cloud für Europa. Diese KI-Fabrik in Deutschland wird 10.000 GPUs auf NVIDIA DGX B200-Systemen und RTX Pro Servern hosten. Als DevOps Engineer Principal begleitest du Unternehmenskunden durch Onboarding, Schulung und frühe Einführung der KI-Plattform. Deine Verantwortung umfasst das Verstehen von Kundenanforderungen, die Unterstützung beim Lösungsdesign, die Durchführung von Proofs of Concept (PoCs) und die Sicherstellung einer reibungslosen Integration von Kunden-Workloads (LLMs, GPU-Computing, KI-Pipelines). Du agierst als vertrauenswürdiger technischer Berater und hilfst Kunden, ihre GPU-Cluster und KI-Toolchains effizient zu nutzen.

Wir suchen einen DevOps Engineer Principal, der eine Schlüsselrolle dabei spielt, unseren Unternehmenskunden zu helfen, unsere KI-Plattform erfolgreich einzuführen und zu skalieren. In dieser Position begleitest du Kunden durch Onboarding, Schulung und frühe Implementierung modernster KI-Lösungen. Du arbeitest eng mit ihnen zusammen, um ihre technischen und geschäftlichen Anforderungen zu verstehen, unterstützt das Design maßgeschneiderter Architekturen und leitest Proofs of Concept, die den realen Mehrwert validieren. Du stellst die reibungslose Integration komplexer Workloads sicher – vom LLM-Deployment und der GPU-Computing-Optimierung bis hin zum Aufbau von End-to-End-KI/ML-Pipelines. Als vertrauenswürdiger technischer Berater befähigst du Kunden, ihre GPU-Cluster und KI-Toolchains effizient zu nutzen, Herausforderungen zu beheben und Best Practices zu übernehmen, die ihre KI-Reise beschleunigen.

Aufgaben
  • Beratung von Kunden zu allen technischen Aspekten rund um GPU-Infrastruktur und Plattformnutzung
  • Leitung von Onboarding und Schulungen, Mentoring von Kundenspezialisten zur optimalen Nutzung ihrer GPU-Cluster und KI-Umgebungen
  • Design und Implementierung von PoCs, einschließlich Umgebungssetup, Datenverarbeitungspipelines und Deployment-Workflows
  • Durchführung von Anforderungsanalysen, Übersetzung von Geschäftsanforderungen in technische Spezifikationen
  • Unterstützung von Kunden bei Performance-Optimierung, Troubleshooting, Feinabstimmung und Validierung gelieferter Lösungen
  • Agieren als zentraler technischer Ansprechpartner, Koordination funktionsübergreifender Teams in den Bereichen Infrastruktur, Netzwerk, Automatisierung, Sicherheit und KI-Services
  • Vorschlag und Entwicklung von Automatisierungskonzepten zur Verbesserung von Services, Prozessen und Betriebsmodellen
  • Sicherstellung, dass Best Practices in Bezug auf Zuverlässigkeit, Skalierbarkeit und Sicherheit über den gesamten Kundenlebenszyklus hinweg angewendet werden
  • Unterstützung bei Monitoring, Observability und Kapazitätsplanung für KI-Workloads und GPU-Auslastung
Dein Profil

Wir suchen einen DevOps Engineer Principal mit umfangreicher Erfahrung in Cloud-Infrastruktur, GPU-basierten Systemen, Kubernetes und Automatisierungstools. Der ideale Kandidat verfügt über ausgeprägte technische Expertise in Container-Technologien, CI/CD-Pipelines, Scripting und Monitoring sowie über ausgezeichnete Kommunikations- und Führungsfähigkeiten.

Muss-Kriterien
  • Mindestens 3 Jahre Erfahrung im Design und der Bereitstellung von Systemen basierend auf IaaS, PaaS und SaaS
  • Erfahrung mit GPU-basierter Infrastruktur
  • Fundierte Kenntnisse in Kubernetes-basierten Container-Technologien
  • Expertenkenntnisse in Skriptsprachen (Python/Bash)
  • Expertenkenntnisse in Automatisierungstools und automatisierten Deployments (Ansible/Salt-Stack/Terraform/Helm)
  • Expertenkenntnisse in CI/CD in einer Kubernetes-Umgebung und Repository-Management
  • Experte in Automatisierung mit Git (GitHub, GitLab) und CI/CD-Tools wie GitHub Actions oder GitLab CI/CD
  • Ausgeprägte Erfahrung mit Linux OS
  • Erfahrung mit Monitoring- und Visualisierungstools (Grafana, Prometheus)
  • Englischkenntnisse auf B2-Niveau
  • Gute Kommunikationsfähigkeiten
  • Analytisches Denken
  • Teamfähigkeit
  • Präsentationsfähigkeiten
  • Verhandlungsgeschick
  • Grundlegende Projektmanagement-Kenntnisse
  • Grundlegende Führungsfähigkeiten
  • Fortgeschrittene Kenntnisse im Qualitätsmanagement
Vorteile
  • Deutschkenntnisse
Über uns

T-Systems ist Teil der Deutsche Telekom Gruppe mit rund 30.000 Mitarbeitern weltweit. Wir schaffen Technologie mit Sinn, um eine positive Wirkung auf die Gesellschaft zu erzielen. Wir suchen neugierige Talente, die lernbegierig sind, Herausforderungen annehmen und Ideen einbringen, die die Erfahrung unserer Kunden transformieren.

Wir vertrauen Menschen: Wir bieten Autonomie, kontinuierliche Unterstützung und ein kollaboratives Umfeld, in dem du ohne Grenzen wachsen kannst. Wir sind ein globales Team, geleitet von Respekt, Integrität und der Leidenschaft, jeden Tag besser zu werden.

Arbeitsumfeld & Flexibilität
  • Internationales, dynamisches und kollaboratives Umfeld
  • T-Social: soziale Initiativen (Sport, Community, Gesundheit, ...)
  • Hybrides Arbeitsmodell (remote/vor Ort)
  • Flexible Arbeitszeiten
Wachstum & Entwicklung
  • Maßgeschneiderte Schulungen: Zugang zu Coursera, um zu lernen, was du willst, wann du willst
  • Wöchentliche Sprachkurse (Englisch, Spanisch & Deutsch)
  • Internationale Mentoring-Sessions & Experience Days
Vergütung & Benefits
  • Flexibler Vergütungsplan (Krankenversicherung, Essensgutscheine, Kinderbetreuung, Transport)
  • Telemedizin
  • Lebens- und Unfallversicherung
  • Sozialfonds
Wohlbefinden & Freizeit
  • 26+ Arbeitstage Urlaub pro Jahr
  • Kostenloser Zugang zu Fachdiensten (medizinisch, rechtlich, Wellness)
  • 100% Gehaltsfortzahlung während Krankheitsurlaub

T-Systems Iberia wird nur die Lebensläufe von Kandidaten bearbeiten, die die für jedes Angebot angegebenen Anforderungen erfüllen.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Principal DevOps Engineer (m/w/d) für Industrial AI Cloud
Principal DevOps Engineer (m/w/d) für Industrial AI Cloud

Deutsche Telekom • Madrid

Hybrid
EUR 110,000 - 160,000
Deutschkenntnisse
Principal DevOps Engineer (m/w/d) für Industrial AI Cloud
Principal DevOps Engineer (m/w/d) für Industrial AI Cloud

Deutsche Telekom • Granada

Hybrid
EUR 90,000 - 150,000
Krankenversicherung
Essensgutscheine
Kinderbetreuung
+6
Principal DevOps Engineer (m/w/d) für Industrial AI Cloud
Principal DevOps Engineer (m/w/d) für Industrial AI Cloud

Deutsche Telekom • Bilbao

Hybrid
EUR 90,000 - 130,000
Deutschkenntnisse
Senior DevOps Engineer (m/w/d) für Industrial AI Cloud
Senior DevOps Engineer (m/w/d) für Industrial AI Cloud

Deutsche Telekom • Gijón

Hybrid
EUR 70,000 - 100,000
Flexibles Arbeitsmodell
Weiterbildungsmöglichkeiten
Krankenschutz
Principal DevOps Engineer (m/w/d) für Industrial AI Cloud
Principal DevOps Engineer (m/w/d) für Industrial AI Cloud

Deutsche Telekom • La Coruña

Hybrid
EUR 90,000 - 140,000
Hybrides Arbeitsmodell
Flexible Arbeitszeiten
Coursera Kurse
+6
Principal DevOps Engineer (m/w/d) für Industrial AI Cloud
Principal DevOps Engineer (m/w/d) für Industrial AI Cloud

Deutsche Telekom • Reus

Hybrid
EUR 90,000 - 130,000
26+ Urlaubstage
Hybrides Arbeiten
Coursera Schulungen
+9
Principal DevOps Engineer (m/w/d) für Industrial AI Cloud
Principal DevOps Engineer (m/w/d) für Industrial AI Cloud

Deutsche Telekom • Sevilla

Hybrid
EUR 90,000 - 130,000
Hybrides Arbeitsmodell
Flexible Arbeitszeiten
26+ Urlaubstage
+2
Senior DevOps Engineer (m/w/d) für Industrial AI Cloud
Senior DevOps Engineer (m/w/d) für Industrial AI Cloud

Deutsche Telekom • La Coruña

Hybrid
EUR 70,000 - 95,000
Flexible Vergütungsplan
Krankenversicherung
Essensgutscheine
+6
Senior DevOps Engineer (m/w/d) für Industrial AI Cloud
Senior DevOps Engineer (m/w/d) für Industrial AI Cloud

Deutsche Telekom • Madrid

Hybrid
EUR 90,000 - 130,000
Krankenversicherung
Essensgutscheine
Kinderbetreuung
+4
Senior DevOps Engineer (m/w/d) für Industrial AI Cloud
Senior DevOps Engineer (m/w/d) für Industrial AI Cloud

Deutsche Telekom • Granada

Hybrid
EUR 90,000 - 135,000
Krankenversicherung
Essensgutscheine
Kinderbetreuung
+7