(Senior) AI Platform Engineer (m/f/d)

DE01 evoila Germany GmbH

Mainz

Hybrid

EUR 90.000 - 140.000

Vollzeit

Vor 6 Tagen
Sei unter den ersten Bewerbenden
Bewerbungsgenerator

Eine maßgeschneiderte Bewerbung für diese Stelle — ein maßgeschneiderter Lebenslauf und ein Anschreiben, die genau zur Stellenanzeige passen.

Schaffe es an den ATS-Filtern vorbei

Benefits dieser Stelle

Betriebliche Altersvorsorge
Remote-Work-Möglichkeiten
Team-Events
Corporate Benefits Programm
Flexible Arbeitszeiten

Zusammenfassung

evoila Germany GmbH sucht eine/n (Senior) AI Platform Engineer (m/f/d) zur Planung, Aufbau und dem Betrieb von hochverfügbaren AI/ML-Plattformen auf Kubernetes in On-Premises-, Hybrid- und Cloud-Umgebungen.

Sie arbeiten an GPU-Infrastrukturen, Model-Serving-Diensten und MLOps-Workflows, beraten Kunden zu Governance, Datensicherheit und Datenschutz und arbeiten eng mit Data-Science-Teams zusammen. Remote-Work-Möglichkeiten werden geboten.

Qualifikationen

  • Mindestens 3 Jahre Betrieb und Optimierung von Plattformen und Services at Scale in Kubernetes-Umgebungen.
  • Fundierte Kenntnisse in Kubernetes-Architektur und -Betrieb, idealerweise GPU-Workloads.
  • Programmierkenntnisse in Python, idealerweise Golang oder Java.
  • Erfahrung mit Model-Serving-Frameworks und MLOps-Werkzeugen.
  • CI/CD- und GitOps-Wertschöpfung, z. B. Argo CD, Flux.

Aufgaben

  • Planung, Aufbau und Betrieb von hochverfügbaren AI/ML-Plattformen und -Services, insbesondere auf Basis von Kubernetes in On-Premises-, Hybrid- und Cloud-Umgebungen.
  • Design und Umsetzung skalierbarer GPU-Infrastrukturen innerhalb von Kubernetes-Clustern – inklusive GPU-Scheduling und -Sharing.
  • Aufbau und Betrieb von Model-Serving- und Inferenz-Diensten (z. B. vLLM, NVIDIA Triton, KServe) für ML-Modelle und Large Language Models.
  • Entwicklung und Betrieb von MLOps-/LLMOps-Workflows für produktive GenAI-Services – einschließlich Guardrails, Evaluierung und Monitoring.
  • Bereitstellung von Fine-Tuning- und Re-Training-Workflows auf der Plattform.
  • Monitoring, Troubleshooting und Performance-Tuning von AI-Plattformen.
  • Beratung unserer Kunden zu Best Practices, Governance, Datensicherheit und Datenschutz im Kontext von AI-Plattformen.
  • Enge Zusammenarbeit mit Data-Science-Teams zur nahtlosen Integration von AI-Lösungen.

Kenntnisse

Kubernetes
AI-Plattformen
Python
Golang/Java
Model-Serving-Frameworks
MLOps-Werkzeuge
CI/CD
Deutsch/Englisch-Kommunikation

Tools

Argo CD
Flux
Kubeflow
MLflow
NVIDIA Triton
vLLM
KServe

Jobbeschreibung

Karriere bei der evoila Germany GmbH

Du möchtest dein nächstes Karrierelevel erreichen und in einem dynamischen, leistungsstarken Team mit echten Zukunftschancen arbeiten? Die evoila Germany GmbH ist ein eigentümergeführtes IT‑Unternehmen mit Fokus auf Cloud, Security und Data. Unsere Kunden schätzen besonders unsere zukunftsorientierten Lösungen und unser DevOps‑Modell – von IT Consulting über Konzeption, Entwicklung und Implementierung bis hin zu Managed Services und Support. Bei uns erlebst du Teamgeist und ein Umfeld, in dem du aktiv mitgestalten kannst, mit klaren Perspektiven für deine persönliche und fachliche Weiterentwicklung.

(Senior) AI Platform Engineer (m/f/d)

Du brennst für Kubernetes, Plattform-Engineering und moderne AI-Technologien? Du möchtest nicht nur einzelne Modelle deployen, sondern die Infrastruktur und Plattformen schaffen, auf denen innovative AI-Anwendungen zuverlässig, sicher und skalierbar betrieben werden? Dann bist du bei uns genau richtig. Als (Senior) AI Platform Engineer (m/f/d) entwickelst, betreibst und optimierst du moderne AI- und ML-Plattformen für unsere Kunden. Du arbeitest mit Kubernetes, GPU-Infrastrukturen, Infrastructure as Code sowie modernen CI/CD-, MLOps- und LLMOps-Ansätzen und unterstützt Unternehmen dabei, Generative AI und Machine Learning erfolgreich in den produktiven Einsatz zu bringen. Dich erwarten spannende Projekte in unterschiedlichsten Branchen, technologischer Gestaltungsspielraum und ein Team aus Cloud-, Plattform-, Data- und AI-Spezialisten, das Innovation nicht nur diskutiert, sondern täglich umsetzt.

Tätigkeitsschwerpunkte:
  • Planung, Aufbau und Betrieb von hochverfügbaren AI/ML-Plattformen und -Services, insbesondere auf Basis von Kubernetes in On-Premises-, Hybrid- und Cloud-Umgebungen.
  • Design und Umsetzung skalierbarer GPU-Infrastrukturen innerhalb von Kubernetes-Clustern – inklusive GPU-Scheduling und -Sharing (z. B. Kueue, KAI-Scheduler, Run:ai, NVIDIA MIG/Time-Slicing) mit Blick auf Auslastung und Kosteneffizienz.
  • Aufbau und Betrieb von Model-Serving- und Inferenz-Diensten (z. B. vLLM, NVIDIA Triton, KServe, NVIDIA NIM, Ray) für klassische ML-Modelle und Large Language Models.
  • Entwicklung und Betrieb von MLOps-/LLMOps-Workflows für produktive GenAI-Services – inklusive Guardrails & Policies, Evaluierung, Regressionstests sowie Kosten- und Qualitätsmonitoring.
  • Bereitstellung von Fine-Tuning- und Re-Training-Workflows (z. B. LoRA, kontinuierliches Re-Training) auf der Plattform.
  • Monitoring, Troubleshooting und Performance-Tuning von AI-Plattformen (u. a. GPU-Auslastung, Inferenz-Latenz, Durchsatz), um höchste Performance und Verfügbarkeit sicherzustellen.
  • Beratung unserer Kunden in Bezug auf Best Practices, AI-Governance, Datensicherheit und Datenschutz im Kontext von AI-Plattformen auf Kubernetes.
  • Enge Zusammenarbeit mit Data-Science-, Data-Platform- und Entwicklungsteams zur Sicherstellung der nahtlosen Integration von AI-Lösungen.
Deine Qualifikation:
  • Mindestens 3 Jahre Erfahrung im Betrieb und der Optimierung von Plattformen und Services at Scale in Kubernetes-Umgebungen, egal ob On-Premise oder in der Cloud.
  • Fundierte Kenntnisse in der Architektur und dem Betrieb von skalierbaren Lösungen unter Verwendung von Kubernetes, idealerweise inklusive GPU-Workloads.
  • Programmierkenntnisse in Python, idealerweise ergänzt um Golang oder Java.
  • Erfahrung mit mindestens einem Model-Serving-Framework (z. B. vLLM, NVIDIA Triton, KServe) sowie erste oder vertiefte Erfahrung mit MLOps‑Werkzeugen (z. B. MLflow, Kubeflow, ClearML).
  • Erfahrung mit Infrastructure-as-Code-Tools wie Ansible und Terraform sowie CI/CD- und GitOps-Werkzeugen (z. B. Argo CD, Flux).
  • Sehr gute Kommunikationsfähigkeiten in Deutsch und Englisch.
  • Idealerweise hast du bereits Kunden beraten und kannst technische Themen zielgruppengerecht vermitteln – vom Engineering-Team bis zum Management.
Für die Senior‑Rolle zusätzlich:
  • Mindestens 5 Jahre einschlägige Erfahrung im Plattform-Engineering.
  • Architektur-Ownership: Du verantwortest das Design von AI-Plattformen end-to-end und triffst technologische Grundsatzentscheidungen.
  • Technische Führung in Kundenprojekten (Lead‑Rolle) sowie Mentoring von Kolleginnen und Kollegen.
  • Erfahrung mit Cloud‑AI‑Diensten (z. B. AWS SageMaker/Bedrock, Azure ML/Azure OpenAI/Azure AI Foundry) und deren Integration mit Kubernetes‑Workloads.
  • Kenntnisse im Betrieb von LLM‑basierten Architekturen, z. B. RAG‑Pipelines, Vektordatenbanken und Embedding‑Services sowie Agentic‑AI‑Ansätze und Model Context Protocol (MCP).
  • Verständnis von System‑Level‑Grundlagen des LLM‑Servings (Rate Limiting, Token Streaming, Load Balancing) und LLM‑Koncepts wie Reasoning, Tool Calling und Prompt Templates.
  • Erfahrung mit neuen Serving‑Bausteinen wie llm-d oder Kubernetes Inference Gateway.
  • Kenntnisse in der Absicherung von AI-Plattformen, z. B. TLS, RBAC und Network Policies innerhalb von Kubernetes‑Umgebungen, sowie Grundverständnis von AI‑Governance (z. B. EU AI Act).
  • Zertifizierungen im Bereich relevanter Technologien (z. B. Certified Kubernetes Administrator/Developer, NVIDIA‑Zertifizierungen).
  • Bereitschaft zu gelegentlichen Reisen im DACH‑Raum.
Wir bieten dir u.a.:
  • Betriebliche Altersvorsorge
  • Teamorientierte Unternehmenskultur mit regelmäßigen Teamevents
  • Gezielte Förderung deiner fachlichen Weiterentwicklung
  • Corporate Benefits Programm
  • Flexible Arbeitszeiten
  • Moderner Arbeitsplatz mit zeitgemäßer Ausstattung
  • Remote‑Work‑Möglichkeiten

We get IT done. Our growth is creating great opportunities! Creativity, know-how, enthusiasm

We create a cultural home for nerds. With cutting edge technologies, we shape the future for the progress of digital society.

Hol dir deinen kostenlosen, vertraulichen Lebenslauf-Check.

oder ziehe deine Datei hierhin.

Similar jobs

Ähnliche Jobs, die dir auch gefallen könnten

Cloud Engineer* Data & AI
Cloud Engineer* Data & AI

inovex • Deutschland

Vor Ort
USD 79.636 - 125.142
Flexibles Arbeiten
30 Tage Urlaub
inovex Academy
+1
DevOps Engineer Kubernetes & AI-Platform (m/w/d)
DevOps Engineer Kubernetes & AI-Platform (m/w/d)

Anstalt für Kommunale Datenverarbeitung in Bayern (AKDB) • Deutschland

Vor Ort
EUR 70.000 - 110.000
Flexible Arbeitszeiten
Bis zu 60% mobiles Arbeiten
30 Urlaubstage + 3 Freiertage
+1
Senior AI Engineer (m/w/d) - Dresden oder remote
Senior AI Engineer (m/w/d) - Dresden oder remote

accompio • Wuppertal

Hybrid
EUR 90.000 - 130.000
Unbefristete Festanstellung
Mentoring & Onboarding
Flexibles Arbeitszeitmodell
+5
Senior AI Engineer (w/m/d)
Senior AI Engineer (w/m/d)

United States Digital Space LLC • Deutschland

Hybrid
GBP 90.000 - 130.000
Homeoffice flexibel
Firmenwagen-Programm
Web-Entwicklung & Weiterbildung
Cloud Data & MLOps Senior Engineer (m/w/d)
Cloud Data & MLOps Senior Engineer (m/w/d)

prenode GmbH • Karlsruhe

Vor Ort
EUR 50.000 - 70.000
Flexible Arbeitszeiten
Remote Work
Apple Hardware
+2
Platform Engineer Analytics & KI-Platform (m/w/d)
Platform Engineer Analytics & KI-Platform (m/w/d)

REWE Digital GmbH • Köln

Vor Ort
EUR 55.000 - 75.000
Flexible Arbeitszeiten
30 Tage Urlaub
Betriebskindergarten
+4
Cloud Data & AI Engineer — GPU Infra & ML Pipelines (Flexible)
Cloud Data & AI Engineer — GPU Infra & ML Pipelines (Flexible)

inovex • Deutschland

Vor Ort
USD 79.636 - 125.142
Flexibles Arbeiten
30 Tage Urlaub
inovex Academy
+1
Sovereign AI Plattform Engineer (m/w/d/x)
Sovereign AI Plattform Engineer (m/w/d/x)

T-Systems International • Weingarten

Hybrid
EUR 90.000 - 130.000
Flexible Arbeitszeiten
Mobiles Arbeiten
Hybrides Arbeiten
+2
AI/ML Ops Engineer (w/m/d)
AI/ML Ops Engineer (w/m/d)

1&1 • Karlsruhe

Hybrid
EUR 85.000 - 110.000
Attraktives Gehalt
Teamorientierte Arbeitskultur
40% mobiles Arbeiten
+5
Sovereign AI Plattform Engineer (m/w/d/x)
Sovereign AI Plattform Engineer (m/w/d/x)

T-Systems International • Hamburg

Hybrid
EUR 90.000 - 110.000
Flexible Arbeitszeiten
Mobiles Arbeiten / hybrides Modell
Weiterbildungsmöglichkeiten
+2