LLM / AI Platform Architect (m/w/d)

SOMI Solutions GmbH

Kassel

Vor Ort

EUR 110.000 - 150.000

Vollzeit

Vor 6 Tagen
Sei unter den ersten Bewerbenden
Bewerbungsgenerator

Mach aus dieser Rolle ein Vorstellungsgespräch — ein Lebenslauf und ein Anschreiben, die darauf ausgerichtet sind, was dieser Arbeitgeber sucht.

Schaffe es an den ATS-Filtern vorbei

Zusammenfassung

SOMI Solutions GmbH sucht einen erfahrenen AI-/LLM-Architekten zum Aufbau einer zentralen On-Premise-Plattform für LLM-Inference und GPU-basierte Workloads. Sie leiten die technische Konzeption, arbeiten eng mit Infra-, Plattform- und Betriebsteams zusammen und sichern den eigenständigen Betrieb und Weiterentwicklung der Lösung.

In dieser Rolle planen Sie Betriebs- und Governance-Modelle, bewerten Open-Weight-Modelle und unterstützen deutschsprachige Anwendungen.

Qualifikationen

  • Mehrjährige Architektenerfahrung im LLM-/GenAI-Umfeld.
  • Nachweisbare Erfahrung mit dem produktiven Betrieb von LLM-/KI-Lösungen.
  • Sehr gute Kenntnisse in der Architektur GPU-basierter KI-Infrastrukturen.
  • Erfahrung mit On-Premise-Umgebungen, idealerweise regulierten bzw. öffentlichen Umfeldern.
  • Fundierte Kenntnisse zu Betriebs- und Governance-Modellen für KI-Plattformen.
  • Erfahrung bei der Bewertung und Auswahl leistungsfähiger Open-Weight-Modelle.
  • Erfahrung im Umfeld dokumentenbezogener KI-Verarbeitung.
  • Verständnis für GPU-Ressourcenmanagement, Segmentierung und Scheduling.
  • Kenntnisse relevanter Container-, Kubernetes- und AI-Plattform-Technologien.
  • Verständnis für IT-Betriebsprozesse sowie Datenschutz- und Security-Anforderungen.
  • Sehr gute Kommunikations- und Beratungskompetenz.
  • Fähigkeit, komplexe technische Sachverhalte verständlich zu vermitteln.
  • Sicheres Arbeiten in interdisziplinären Teams.

Aufgaben

  • Konzeption einer zentralen Plattform für LLM-Inference und weitere GPU-basierte KI-Workloads.
  • Entwicklung einer geeigneten Zielarchitektur für den produktiven On-Premise-Betrieb.
  • Planung und Bewertung von LLM-Serving- und Inference-Komponenten.
  • Definition von Betriebs-, Governance- und Bereitstellungsmodellen für die KI-Plattform.
  • Beratung bei der Auswahl geeigneter Open-Weight-Modelle, insbesondere für deutschsprachige Anwendungsfälle.
  • Bewertung von Anforderungen an GPU-Kapazitäten, deren Aufteilung und Nutzung.
  • Konzeption geeigneter Verfahren zur GPU-Segmentierung und Ressourcensteuerung.
  • Berücksichtigung von NVIDIA MIG sowie alternativen GPU-Sharing- und Scheduling-Ansätzen.
  • Begleitung der Integration der Plattform in bestehende Infrastruktur- und Betriebslandschaften.
  • Vorbereitung der technischen Anbindung bestehender dokumentenbasierter KI-Anwendungen.
  • Berücksichtigung von Datenschutz, Informationssicherheit, Datensouveränität und regulatorischen Anforderungen.
  • Abstimmung mit beteiligten Architektur-, Plattform- und Betriebsteams.
  • Erstellung technischer Konzepte, Entscheidungsgrundlagen und Betriebsdokumentationen.
  • Durchführung von Wissenstransfer und Befähigung der internen Teams.

Kenntnisse

LLM-Architektur
LLM-Betrieb
GPU-Infrastruktur
On-Premise
Governance
Open-Weight-Modelle
Dokumenten-KI
GPU-Resource-Management
Container/Kubernetes
IT-Betrieb/Datenschutz
Kommunikation
Technische Vermittlung
Teamarbeit

Tools

Tesseract
trOCR
ABBYY FlexiCapture

Jobbeschreibung

Für den Aufbau einer zentralen Plattform zur Nutzung von Large Language Models und weiteren KI-Anwendungen suchen wir einen erfahrenen AI-/LLM-Architekten. Du verantwortest die technische Konzeption der Plattform und begleitest deren Umsetzung bis in den produktiven Betrieb.

Der Fokus liegt auf einer sicheren und skalierbaren On-Premise-Architektur, die sowohl Inference-Anwendungen als auch weitere GPU-basierte Workloads unterstützt. Dabei arbeitest du eng mit Infrastruktur-, Plattform- und Betriebsteams zusammen und sorgst durch gezielten Wissenstransfer dafür, dass die Lösung anschließend eigenständig betrieben und weiterentwickelt werden kann.

  • Konzeption einer zentralen Plattform für LLM-Inference und weitere GPU-basierte KI-Workloads
  • Entwicklung einer geeigneten Zielarchitektur für den produktiven On-Premise-Betrieb
  • Planung und Bewertung von LLM-Serving- und Inference-Komponenten
  • Definition von Betriebs-, Governance- und Bereitstellungsmodellen für die KI-Plattform
  • Beratung bei der Auswahl geeigneter Open-Weight-Modelle, insbesondere für deutschsprachige Anwendungsfälle
  • Bewertung von Anforderungen an GPU-Kapazitäten, deren Aufteilung und Nutzung
  • Konzeption geeigneter Verfahren zur GPU-Segmentierung und Ressourcensteuerung
  • Berücksichtigung von NVIDIA MIG sowie alternativen GPU-Sharing- und Scheduling-Ansätzen
  • Begleitung der Integration der Plattform in bestehende Infrastruktur- und Betriebslandschaften
  • Vorbereitung der technischen Anbindung bestehender dokumentenbasierter KI-Anwendungen
  • Berücksichtigung von Datenschutz, Informationssicherheit, Datensouveränität und regulatorischen Anforderungen
  • Abstimmung mit beteiligten Architektur-, Plattform- und Betriebsteams
  • Erstellung technischer Konzepte, Entscheidungsgrundlagen und Betriebsdokumentationen
  • Durchführung von Wissenstransfer und Befähigung der internen Teams
  • Mehrjährige Erfahrung als Architekt im Umfeld von LLM-, GenAI- oder Model-Inference-Plattformen
  • Nachweisbare Erfahrung mit dem produktiven Betrieb von LLM-/KI-Lösungen
  • Sehr gute Kenntnisse in der Architektur GPU-basierter KI-Infrastrukturen
  • Erfahrung mit On-Premise-Umgebungen und idealerweise Projekten im regulierten bzw. öffentlichen Umfeld
  • Fundierte Kenntnisse zu Betriebs- und Governance-Modellen für KI-Plattformen
  • Erfahrung bei der Bewertung und Auswahl leistungsfähiger Open-Weight-Modelle
  • Erfahrung im Umfeld dokumentenbezogener KI-Verarbeitung
  • Praktische Kenntnisse mit Tesseract, trOCR und ABBYY FlexiCapture
  • Verständnis für GPU-Ressourcenmanagement, Segmentierung und Scheduling
  • Kenntnisse relevanter Container-, Kubernetes- und AI-Plattform-Technologien
  • Verständnis für IT-Betriebsprozesse sowie Datenschutz- und Security-Anforderungen
  • Sehr gute Kommunikations- und Beratungskompetenz
  • Fähigkeit, komplexe technische Sachverhalte verständlich zu vermitteln
  • Sicheres Arbeiten in interdisziplinären Teams
Hol dir deinen kostenlosen, vertraulichen Lebenslauf-Check.
oder ziehe deine Datei hierhin.
Similar jobs

Ähnliche Jobs, die dir auch gefallen könnten

Junior AI / LLM Engineer (m/w/d)
Junior AI / LLM Engineer (m/w/d)

SOMI Solutions GmbH • Kassel

Vor Ort
EUR 40.000 - 55.000
AI Platform Engineer
AI Platform Engineer

Guldberg GmbH • München

Vor Ort
EUR 60.000 - 80.000
(Senior) Software Engineer – LLM & AI Platform (m/w/d)
(Senior) Software Engineer – LLM & AI Platform (m/w/d)

werkstudenten-jobs • Bad Homburg vor der Höhe

Hybrid
EUR 90.000 - 120.000
Jahresbonus
Flexible Arbeitszeiten
Mobiles Arbeiten
+6
AI Platform Engineer (all genders)
AI Platform Engineer (all genders)

DATAGROUP • Gemeindeverwaltungsverband Pliezhausen

Vor Ort
EUR 85.000 - 120.000
Individuelles Weiterbildungsbudget für
Klare Karriere- und Entwicklungspfade
Offene Feedback-Kultur
Senior AI Platform Engineer (m/w/d)
Senior AI Platform Engineer (m/w/d)

Computer Futures • Hamburg

Hybrid
EUR 90.000 - 120.000
AI Development Manager
AI Development Manager

Amprion GmbH • Berlin

Vor Ort
EUR 90.000 - 150.000
AI Security Architect (m/f/d)
AI Security Architect (m/f/d)

Ekkiden • Köln

Vor Ort
EUR 85.000 - 110.000
Werkstudent/Praktikant (m/w/d) LLM & KI-Plattform
Werkstudent/Praktikant (m/w/d) LLM & KI-Plattform

werkstudenten-jobs • Bad Homburg vor der Höhe

Hybrid
EUR 70.000 - 110.000
Flexibles Arbeitsmodell
Mobiles Arbeiten
Team-Events
+2
IT Administrator (m/w/d) Schwerpunkt KI Plattform
IT Administrator (m/w/d) Schwerpunkt KI Plattform

kdw HR GmbH & Co. KG • Altenesch

Vor Ort
EUR 80.000 - 110.000
Unbefristetes Arbeitsverhältnis
Persönliche Betreuung auf Augenhöhe -
Übertarifliche Bezahlung
+5
AI Agent Engineer/ AI Expert (m/w/d)
AI Agent Engineer/ AI Expert (m/w/d)

Nicos Cdc • Münster

Hybrid
EUR 70.000 - 95.000
Flexible Arbeitszeiten
Hybrides Arbeiten
Individuelle Weiterbildung
+1