Forward Deployed Engineer (m/w/d)

Mayflower GmbH

Würzburg

Vor Ort

EUR 80.000 - 90.000

Vollzeit

14 Tage+

Erhalte mehr Antworten von Arbeitgebern

Versende in nur wenigen Minuten einen passgenauen Lebenslauf.

Benefits dieser Stelle

Flexible Arbeitszeiten
Option auf bis zu 4 Tage Homeoffice
Sabbatical möglich
30 Tage Urlaub, plus Familienbonus

Zusammenfassung

Mayflower GmbH sucht einen erfahrenen Forward Deployed Engineer, der AI-Systeme von der Discovery bis zum Produktions-Rollout in Kundensystemen verantwortet. Du arbeitest End-to-End, implementierst Modellausprägungen in die Infrastruktur und betreibst Gateways, RAG-Pipelines sowie spezialisierte Agenten.

Du bringst 10+ Jahre in der Softwareentwicklung mit, bist kompetent in LLM-Stacks, vLLM, Kubernetes und Inference-Infrastruktur und kommunizierst sicher auf Deutsch und Englisch.

Qualifikationen

  • Mindestens 10 Jahre in der Softwareentwicklung.
  • LLM-Systeme in Produktion gebracht – inkl. RAG-Implementierungen, Vector Databases, Agent-Frameworks (LangGraph, OpenAI Agent SDK) und Evals/MLOps.
  • Erfahrung mit der Integration von AI-Systemen in Enterprise-Architekturen (Auth, Legacy, Compliance).
  • Deutsch- und Englischkenntnisse auf C1-Niveau.

Aufgaben

  • End-to-End-Ownership: Deployments von Discovery bis Produktions-Rollout in der Kundeninfrastruktur.
  • Full-Stack: Arbeiten über alle Schichten – Model-Serving, Agent-Gateways, RAG-/GraphRAG-Pipelines.
  • Produkt-Stacks (mAIstack, VoiceAI, Amicable) beim Kunden deployen und erweitern.
  • Kundenworkshops, Trade-off-Entscheidungen treffen und Sachverhalte verständlich machen.
  • Whitepaper/Talks/Products: Beiträge zur Sichtbarkeit und Wissensvermittlung.

Kenntnisse

LLM-Systeme in Production gebracht
Kubernetes
LangGraph
OpenAI Agent SDK
RAG-Implementierungen
Vector Databases

Tools

vLLM
GPU-Serving

Jobbeschreibung

Wer wir sind

Die Mayflower GmbH baut Individualsoftware mit Fokus auf Generative AI – seit 1998 inhabergeführt.

Wir bringen komplette AI-Infrastrukturen in Produktion: Model-Serving, Agent-Gateways, Chat und Voice – direkt in der Umgebung des Kunden. Bei uns erwartet dich einagiles Arbeitsumfeldmit Verantwortung auf Augenhöhe - ohne Hierarchien.

Für unseren BereichForward Deployed Engineering suchen wir dich – jemanden, der AI-Systeme nicht empfiehlt, sondern baut, deployt und in Produktion verantwortet.

Was dich erwartet

Forward Deployed heißt bei uns: Du bist Beobachter, Architekt und Entwickler in einer Person. Dieselbe Person, die das Problem beim Kunden versteht, schreibt den Code, der es löst - und bleibt, bis es produktiv läuft.

  • End-to-End-Ownership:Du verantwortest Deployments von der Discovery über technisches Scoping, Architektur und Build bis zum Produktions-Rollout in der Infrastruktur des Kunden - eingebettet in dessen Engineering- und Fachteams.

  • Full-Stack, wörtlich gemeint:Du arbeitest über alle Schichten - Model-Serving (vLLM, eigene GPU-Cluster), Agent-Gateways und Runtimes, RAG-/GraphRAG-Pipelines, spezialisierte Agenten, Integration in ERP, CRM, DMS und Legacy-Systeme.

  • Auf erprobtem Fundament:Du deployst und erweiterst unsere Produkt-Stacks (mAIstack, VoiceAI, Amicable) beim Kunden, statt jedes Projekt bei null zu beginnen – mit LLMs wie GPT, Gemini, Claude oder Nemotron, Agent-Frameworks und agentischen Harnesses. Vector-Datenbanken und RAG sind dabei Handwerkszeug; als Senior sorgst du dafür, dass die Systeme im Betrieb messbar und beherrschbar bleiben – über Dataset-basierte Evaluations, Logging/Tracing und Observability.

  • Der Rückfluss ist Teil des Jobs:Was sich im Feld als wiederkehrendes Muster erweist, kodifizierst du mit deinem Team in unseren Produkten, Skills und Playbooks. Dein Projektwissen bleibt nicht beim Kunden liegen - es macht das nächste Deployment schneller.

  • Kunde auf Augenhöhe:Du entwickelst in Workshops ein gemeinsames Bild von Problem, Chancen und Lösung, triffst Trade-off-Entscheidungen zwischen Scope, Tempo und Qualität - und sprichst auch an, was der Kunde nicht hören will, wenn es das Ergebnis schützt.

  • Sichtbarkeit:Du bringst deine Erfahrungen in Whitepaper, Talks und unsere AI-Produkte ein - mit Unterstützung unserer technischen Redaktion.

Das solltest du mitbringen
  • Mindestens 10 Jahre in der Softwareentwicklung, idealerweise bei einem Individual-Software-Dienstleister oder in der IT-Beratung.

  • Du hast LLM-Systeme in Produktion gebracht - nicht nur prototypisiert: RAG-Implementierungen, Vector Databases, Agent-Frameworks (LangGraph, OpenAI Agent SDK o. ä.), Evals und MLOps.

  • Erfahrung mit der Integration von AI-Systemen in bestehende, gewachsene Enterprise-Architekturen - inklusive der unbequemen Teile (Auth, Legacy, Compliance).

  • Von Vorteil: Erfahrung mit Inference-Infrastruktur (vLLM, GPU-Serving), Kubernetes und On-Prem-/Private-Cloud-Deployments.

  • Die Kompetenz, AI-Konzepte Fachbereichen und C-Level anschaulich zu vermitteln - und die Standfestigkeit, Ownership für Entscheidungen zu übernehmen.

  • Deutsch- und Englischkenntnisse auf C1-Niveau.

  • Bereitschaft, phasenweise beim Kunden vor Ort zu arbeiten (projektabhängig, remote-embedded als Regelfall), plus Workshops und Konferenzen 1–2× im Monat innerhalb Deutschlands.

Das haben wir zu bieten
  • Kompetitive Vergütung:Je nach Erfahrung und Kompetenz vergüten wir die Stelle mit einem Bruttojahresgehalt von 80.000 € bis 90.000 € bei 40 Wochenstunden.

  • Echte Produktionsverantwortung:Deine Systeme laufen produktiv bei großen Unternehmensgruppen - nicht in der Demo-Umgebung.

  • Gute Software bauen:Deine latente Pedanterie in Bezug auf Code- und Softwarequalität wird hier geschätzt.

  • Kein 08/15:Abwechslung durch unterschiedliche Branchen, Use Cases und Technologien - vom GPU-Cluster bis zum Voice-Agenten.

  • Kundenbeziehung auf Augenhöhe:Wir pflegen eine ehrliche und vertrauensvolle Zusammenarbeit mit unseren Kunden.

  • Mache einen Unterschied:Viel Verantwortung, großer Gestaltungsspielraum - in einem Mittelständler, in dem dein Beitrag den wirtschaftlichen Erfolg direkt beeinflusst.

  • Lerne immer dazu:Weiterbildung (intern und extern), Training-on-the-job und regelmäßige Weiterentwicklungs- und Gehaltsgespräche.

  • Wie arbeiten selbstorganisiert: Wir geben dir den Freiraum, den Rahmen für gute Arbeit selbst mitzugestalten – im Team wie beim Kunden.

  • Werde berühmt:Eine technische Redaktion unterstützt dich beim Schreiben und Publizieren, sodass du als Experte nach außen sichtbar wirst.

  • Du musst nicht die klügste Person im Raum sein:Echte Sparring-Partner, die deine Ideen gemeinsam mit dir auf die Probe stellen und weiterentwickeln.

  • Schalte einfach ab:Niemand erwartet Erreichbarkeit nach Feierabend, im Urlaub oder trotz Krankmeldung. Viele Überstunden sind bei uns nicht üblich.

  • Gut für die Psyche:Ersthelfer psychische Gesundheit, Employee Assistance Programm und ein offener Umgang mit mentaler Gesundheit.

  • Freiraum für dein Privatleben:Flexible Arbeitszeiten, bis zu vier Tage Homeoffice die Woche, spontan einen Tag frei, Arbeiten aus dem EU-Ausland, Sabbatical oder 4 Wochen Urlaub am Stück.

  • Bring dein +1 mit:Brave Bürohunde oder Kinder an schulfreien Werktagen sind herzlich willkommen.

  • Finanzielle Benefits:Regelmäßige Teamevents, Wellpass, 30 Tage Urlaub, Kindergartenzuschuss, Deutsche Dienstrad.

Der Kontakt zu uns

Du hast Feedback oder Fragen zu der Stelle?

Schreib uns eine Email anbewerbung@mayflower.de

Hol dir deinen kostenlosen, vertraulichen Lebenslauf-Check.
oder ziehe deine Datei hierhin.
Similar jobs

Ähnliche Jobs, die dir auch gefallen könnten

Forward Deployed Engineer (m/w/d)
Forward Deployed Engineer (m/w/d)

Mayflower GmbH • München

Hybrid
EUR 80.000 - 90.000
30 Tage Urlaub
Homeoffice bis zu 4 Tage/Woche
Weiterbildungsmöglichkeiten
+1
Senior AI Solutions Entwickler:in (w/d/m)
Senior AI Solutions Entwickler:in (w/d/m)

Mayflower GmbH • Würzburg

Vor Ort
Vertraulich
30 Tage Urlaub
Flexible Arbeitszeiten
Homeoffice bis zu 4 Tage pro Woche
+1
Senior AI Solutions Engineer*in (w/d/m)
Senior AI Solutions Engineer*in (w/d/m)

Mayflower GmbH • München

Vor Ort
Vertraulich
Kompetitive Vergütung
Flexible Arbeitszeiten
30 Tage Urlaub
+2
Senior AI Solutions Entwickler:in
Senior AI Solutions Entwickler:in

Mayflower GmbH • München

Hybrid
EUR 80.000 - 85.000
Kompetitive Vergütung
Flexible Arbeitszeiten
30 Tage Urlaub
+2
Senior AI Solutions Entwickler:in (w/d/m)
Senior AI Solutions Entwickler:in (w/d/m)

Mayflower GmbH • München

Vor Ort
EUR 80.000 - 85.000
Kompetitive Vergütung
Flexible Arbeitszeiten
30 Tage Urlaub
+2
Senior AI Solutions Entwickler:in
Senior AI Solutions Entwickler:in

Mayflower GmbH • Würzburg

Hybrid
Vertraulich
30 Tage Urlaub
Flexible Arbeitszeiten
Homeoffice bis zu 4 Tage die Woche
+3
Senior AI Solutions Entwickler:in
Senior AI Solutions Entwickler:in

Mayflower GmbH • München

Hybrid
Vertraulich
30 Tage Urlaub
Flexible Arbeitszeiten
Weiterbildungsmöglichkeiten
+2
Software Engineer*in mit Schwerpunkt GenAI (w/d/m)
Software Engineer*in mit Schwerpunkt GenAI (w/d/m)

Mayflower GmbH • München

Vor Ort
EUR 65.000 - 75.000
Kompetitive Vergütung
Flexible Arbeitszeiten
30 Tage Urlaub
+1
Software Entwickler:in mit Schwerpunkt GenAI
Software Entwickler:in mit Schwerpunkt GenAI

Mayflower GmbH • München

Hybrid
EUR 65.000 - 75.000
Flexible Arbeitszeiten
30 Tage Urlaub
Regelmäßige Teamevents
+2
Software Entwickler:in mit Schwerpunkt GenAI
Software Entwickler:in mit Schwerpunkt GenAI

mayflower • München

Hybrid
EUR 65.000 - 75.000
Flexible Arbeitszeiten
Bis zu 4 Tage Homeoffice pro Woche
30 Tage Urlaub
+2