(Senior) AI Platform Engineer (m/f/d)

Join

Mainz

Hybrid

EUR 100.000 - 150.000

Vollzeit

Vor 6 Tagen
Sei unter den ersten Bewerbenden
Bewerbungsgenerator

Erhalte eine Antwort von diesem/dieser Recruiter:in — ein Lebenslauf und ein Anschreiben, die genau auf die Eigenschaften eingehen, die gesucht werden.

Schaffe es an den ATS-Filtern vorbei

Benefits dieser Stelle

Betriebliche Altersvorsorge
Teamevents
Weiterbildung
Corporate Benefits
Flexible Arbeitszeiten
Remote-Arbeit möglich

Zusammenfassung

Join sucht einen (Senior) AI Platform Engineer (m/w/d) in Deutschland. Sie entwickeln, betreiben und optimieren moderne AI-/ML-Plattformen auf Basis von Kubernetes; Sie gestalten GPU-Infrastrukturen, Model-Serving-Services und end-to-end MLOps-/LLMOps-Workflows.

Sie arbeiten eng mit Data-Science-, Data-Platform- und Entwicklungs-Teams zusammen, beraten Kunden zu Governance, Sicherheit und Best Practices und setzen innovative GenAI-Lösungen zuverlässig um.

Qualifikationen

  • Mindestens 3 Jahre Betriebserfahrung in Kubernetes-Umgebungen, On-Premise oder Cloud.
  • Fundierte Architekturkenntnisse für skalierbare AI-Plattformen mit GPU-Workloads.
  • Programmierkenntnisse in Python; Golang/Java sind von Vorteil.
  • Erfahrung mit Model-Serving-Frameworks und MLOps-Werkzeugen.
  • Know-how zu Infrastructure-as-Code, CI/CD und GitOps.

Aufgaben

  • Planung, Aufbau und Betrieb hochverfügbarer AI/ML-Plattformen in Kubernetes.
  • Design skalierbarer GPU-Infrastrukturen und GPU-Scheduling.
  • Aufbau von Model-Serving- und Inferenz-Diensten für ML/LLMs.
  • Entwicklung von MLOps-/LLMOps-Workflows inklusive Guardrails.
  • Fine-Tuning- und Re-Training-Workflows auf der Plattform.
  • Monitoring, Troubleshooting und Performance-Tuning der Plattformen.
  • Beratung zu AI-Governance, Datensicherheit und Best Practices.

Kenntnisse

Kubernetes
Python
Golang/Java
CI/CD
MLOps
GPU-Workloads
Cloud-Architektur
Deutsch/Englisch kommunizieren

Tools

Terraform
Ansible
Argo CD
Flux
Kubeflow
MLflow
KServe

Jobbeschreibung

Du brennst für Kubernetes, Plattform-Engineering und moderne AI-Technologien? Du möchtest nicht nur einzelne Modelle deployen, sondern die Infrastruktur und Plattformen schaffen, auf denen innovative AI-Anwendungen zuverlässig, sicher und skalierbar betrieben werden?

Dann bist du bei uns genau richtig.

Als (Senior) AI Platform Engineer (m/f/d) entwickelst, betreibst und optimierst du moderne AI- und ML-Plattformen für unsere Kunden. Du arbeitest mit Kubernetes, GPU-Infrastrukturen, Infrastructure as Code sowie modernen CI/CD-, MLOps- und LLMOps-Ansätzen und unterstützt Unternehmen dabei, Generative AI und Machine Learning erfolgreich in den produktiven Einsatz zu bringen.

Dich erwarten spannende Projekte in unterschiedlichsten Branchen, technologischer Gestaltungsspielraum und ein Team aus Cloud-, Plattform-, Data- und AI-Spezialisten, das Innovation nicht nur diskutiert, sondern täglich umsetzt.

Aufgaben
  • Planung, Aufbau und Betrieb von hochverfügbaren AI/ML-Plattformen und -Services, insbesondere auf Basis von Kubernetes in On-Premises-, Hybrid- und Cloud-Umgebungen.
  • Design und Umsetzung skalierbarer GPU-Infrastrukturen innerhalb von Kubernetes-Clustern – inklusive GPU-Scheduling und -Sharing (z. B. Kueue, KAI-Scheduler, Run:ai, NVIDIA MIG/Time-Slicing) mit Blick auf Auslastung und Kosteneffizienz.
  • Aufbau und Betrieb von Model-Serving- und Inferenz-Diensten (z. B. vLLM, NVIDIA Triton, KServe, NVIDIA NIM, Ray) für klassische ML-Modelle und Large Language Models.
  • Entwicklung und Betrieb von MLOps-/LLMOps-Workflows für produktive GenAI-Services – inklusive Guardrails & Policies, Evaluierung, Regressionstests sowie Kosten- und Qualitätsmonitoring.
  • Bereitstellung von Fine-Tuning- und Re-Training-Workflows (z. B. LoRA, kontinuierliches Re-Training) auf der Plattform.
  • Monitoring, Troubleshooting und Performance-Tuning von AI-Plattformen (u. a. GPU-Auslastung, Inferenz-Latenz, Durchsatz), um höchste Performance und Verfügbarkeit sicherzustellen.
  • Beratung unserer Kunden in Bezug auf Best Practices, AI-Governance, Datensicherheit und Datenschutz im Kontext von AI-Plattformen auf Kubernetes.
  • Enge Zusammenarbeit mit Data-Science-, Data-Platform- und Entwicklungsteams zur Sicherstellung der nahtlosen Integration von AI-Lösungen.
Qualifikation
  • Mindestens 3 Jahre Erfahrung im Betrieb und der Optimierung von Plattformen und Services at Scale in Kubernetes-Umgebungen, egal ob On-Premise oder in der Cloud.
  • Fundierte Kenntnisse in der Architektur und dem Betrieb von skalierbaren Lösungen unter Verwendung von Kubernetes, idealerweise inklusive GPU-Workloads.
  • Programmierkenntnisse in Python, idealerweise ergänzt um Golang oder Java.
  • Erfahrung mit mindestens einem Model-Serving-Framework (z. B. vLLM, NVIDIA Triton, KServe) sowie erste oder vertiefte Erfahrung mit MLOps-Werkzeugen (z. B. MLflow, Kubeflow, ClearML).
  • Erfahrung mit Infrastructure-as-Code-Tools wie Ansible und Terraform sowie CI/CD- und GitOps-Werkzeugen (z. B. Argo CD, Flux).
  • Sehr gute Kommunikationsfähigkeiten in Deutsch und Englisch. Idealerweise hast du bereits Kunden beraten und kannst technische Themen zielgruppengerecht vermitteln – vom Engineering-Team bis zum Management.

Für die Senior-Rolle zusätzlich:

  • Mindestens 5 Jahre einschlägige Erfahrung im Plattform-Engineering.
  • Architektur-Ownership: Du verantwortest das Design von AI-Plattformen end-to-end und triffst technologische Grundsatzentscheidungen.
  • Technische Führung in Kundenprojekten (Lead-Rolle) sowie Mentoring von Kolleginnen und Kollegen.

Darüber hinaus verfügst du idealerweise über:

  • Erfahrung mit Cloud-AI-Diensten (z. B. AWS SageMaker/Bedrock, Azure ML/Azure OpenAI/Azure AI Foundry) und deren Integration mit Kubernetes-Workloads.
  • Kenntnisse im Betrieb von LLM-basierten Architekturen, z. B. RAG-Pipelines, Vektordatenbanken und Embedding-Services sowie Agentic-AI-Ansätze und Model Context Protocol (MCP).
  • Verständnis von System-Level-Grundlagen des LLM-Servings (Rate Limiting, Token Streaming, Load Balancing) und LLM-Konzepten wie Reasoning, Tool Calling und Prompt Templates.
  • Erfahrung mit neuen Serving-Bausteinen wie llm-d oder Kubernetes Inference Gateway.
  • Kenntnisse in der Absicherung von AI-Plattformen, z. B. TLS, RBAC und Network Policies innerhalb von Kubernetes-Umgebungen, sowie Grundverständnis von AI-Governance (z. B. EU AI Act).
  • Zertifizierungen im Bereich relevanter Technologien (z. B. Certified Kubernetes Administrator/Developer, NVIDIA-Zertifizierungen).
  • Bereitschaft zu gelegentlichen Reisen im DACH-Raum.
Benefits

Wir bieten dir u.a.:

  • Betriebliche Altersvorsorge
  • Teamorientierte Unternehmenskultur mit regelmäßigen Teamevents
  • Gezielte Förderung deiner fachlichen Weiterentwicklung
  • Corporate Benefits Programm
  • Flexible Arbeitszeiten
  • Moderner Arbeitsplatz mit zeitgemäßer Ausstattung
  • Remote-Work-Möglichkeiten

We get IT done.

Hol dir deinen kostenlosen, vertraulichen Lebenslauf-Check.

oder ziehe deine Datei hierhin.

Similar jobs

Ähnliche Jobs, die dir auch gefallen könnten

(Senior) AI Platform Engineer (m/f/d)
(Senior) AI Platform Engineer (m/f/d)

DE01 evoila Germany GmbH • Mainz

Hybrid
EUR 90.000 - 140.000
Betriebliche Altersvorsorge
Remote-Work-Möglichkeiten
Team-Events
+2
(Senior) AI Platform Engineer (m/f/d)
(Senior) AI Platform Engineer (m/f/d)

evoila GmbH • Deutschland

Remote
EUR 110.000 - 160.000
Betriebliche Altersvorsorge
Remote-Work-Möglichkeiten
Flexible Arbeitszeiten
+2
AI Platform Engineer (all genders)
AI Platform Engineer (all genders)

Datagroup AG • Deutschland

Remote
EUR 90.000 - 140.000
Offene Kultur
Umfassende Einarbeitung
Strategische Rolle
+7
AI Platform Engineer (all genders)
AI Platform Engineer (all genders)

DATAGROUP • Gemeindeverwaltungsverband Pliezhausen

Vor Ort
EUR 85.000 - 120.000
Individuelles Weiterbildungsbudget für
Klare Karriere- und Entwicklungspfade
Offene Feedback-Kultur
DevOps Engineer Kubernetes & AI-Platform (m/w/d)
DevOps Engineer Kubernetes & AI-Platform (m/w/d)

Anstalt für Kommunale Datenverarbeitung in Bayern (AKDB) • Deutschland

Vor Ort
EUR 70.000 - 110.000
Flexible Arbeitszeiten
Bis zu 60% mobiles Arbeiten
30 Urlaubstage + 3 Freiertage
+1
AI Engineer (m/w/d)
AI Engineer (m/w/d)

ilume • Mainz

Hybrid
EUR 90.000 - 130.000
Betriebliche Altersvorsorge
Flexible Arbeitszeiten
Mobiles Arbeiten / Büro in Mainz
+5
AI Platform Engineer
AI Platform Engineer

Guldberg GmbH • München

Vor Ort
EUR 60.000 - 80.000
Senior Fullstack Developer (m/w/d)
Senior Fullstack Developer (m/w/d)

AltaSigma • Ulm

Vor Ort
EUR 65.000 - 85.000
Attraktives Gehalt mit Bonusvereinbarung
Flexibles Arbeiten
Schulungen und Fachkonferenzen
Senior AI Platform Engineer (all genders)
Senior AI Platform Engineer (all genders)

adesso SE • Hannover

Vor Ort
EUR 70.000 - 90.000
Senior AI Platform Engineer (all genders)
Senior AI Platform Engineer (all genders)

adesso SE • Dortmund

Vor Ort
EUR 70.000 - 90.000