Démarquez-vous pour ce poste — générez un CV et une lettre de motivation personnalisés en environ une minute.
Onyx-Conseil recherche un Senior Python Engineer spécialisé IA Générative (LLM) pour concevoir et développer une plateforme IA générative on-premise, axée sur le développement logiciel et l'architecture applicative.
Vous serez en charge de concevoir des API robustes avec FastAPI, d’orchestrer des modèles LLM, de construire des architectures RAG performantes et de garantir la qualité via tests et CI/CD, tout en travaillant avec les équipes produit et infra.
Dans le cadre d’un projet stratégique au sein d’un acteur majeur du secteur des paiements, nous recherchons un Senior Python Engineer spécialisé en Intelligence Artificielle Générative (LLM).
Vous interviendrez au sein d’une équipe dédiée au développement d’une plateforme IA générative en environnement on-premise.
Le rôle est fortement orienté développement logiciel et architecture applicative : nous recherchons un profil capable de concevoir, développer et industrialiser des applications IA en production.
Vos principales responsabilités :
Concevoir et développer des applications backend Python intégrant des modèles de langage (LLM).
Développer des APIs robustes avec FastAPI (ou frameworks équivalents).
Concevoir des architectures RAG (Retrieval-Augmented Generation) performantes.
Mettre en œuvre les mécanismes d’ingestion documentaire, chunking, embeddings et recherche sémantique.
Intégrer et orchestrer différents modèles LLM (GPT, Mistral, Claude ou équivalents).
Développer des composants exploitables en production avec une approche qualité logicielle.
Participer aux choix d’architecture technique et aux bonnes pratiques de développement.
Mettre en place les pratiques de qualité : tests, revue de code, Clean Code, documentation technique.
Techniques
Python confirmé (développement applicatif backend)
FastAPI / Flask / Django
Développement d’API REST
Architecture backend et microservices
LLM : GPT, Mistral, Claude, OpenAI API, Anthropic API
RAG (Retrieval-Augmented Generation)
LangChain, LlamaIndex ou frameworks équivalents
Embeddings et recherche sémantique
Bases vectorielles : Qdrant, Pinecone, Weaviate, Chroma ou équivalent
PostgreSQL / bases de données relationnelles
Docker
CI/CD
Tests automatisés
Git et pratiques de revue de code
Esprit d’analyse et capacité à résoudre des problématiques complexes
Autonomie et force de proposition
Sens de la qualité logicielle
Capacité à travailler dans un environnement exigeant
Bon relationnel avec les équipes techniques et métiers
Curiosité technologique et veille active sur les évolutions IA