Senior LLMOps, RAG & Infra Architect

Adlin Science

Paris

Sur place

EUR 90 000 - 130 000

Plein temps

Il y a 2 jours
Soyez parmi les premiers à postuler
Générateur de candidature

N’envoyez pas un CV générique — générez un CV et une lettre de motivation adaptés à ce poste précis.

Passez les filtres ATS

Avantages offerts par ce poste

Restaurant d'entreprise
Tickets restauration

Résumé du poste

Adlin Science crée une plateforme de gouvernance et de gestion de données biomédicales multimodales et recherche un responsable LLM pour piloter l’architecture et l’intégration du socle IA au sein de l’équipe Data. Vous contribuerez à définir l’architecture modulaire et à déployer des solutions sans dépendance à des API externes en production.

Le rôle requiert une forte expérience en ML engineering/MLOps, une maîtrise avancée de Python et PyTorch, et une sensibilité à la sécurité et à la

Qualifications

  • Maîtrise de déploiement et exploitation de LLM/NLP sous contraintes de performance.
  • Maîtrise de Python, PyTorch et de l’écosystème Transformers.
  • Maîtrise d’au moins un moteur d’inférence haute performance et expérience avec quantization/GPU sizing.
  • Expérience pratique avec les architectures RAG, embeddings, recherche hybride et évaluation des systèmes génératifs.
  • Solides compétences Docker, Linux, CI/CD, observabilité et gestion des artefacts en environnements contrôlés.
  • Culture sécurité: gestion des secrets, contrôle d’accès, encryption et chaîne d’approvisionnement logicielle.
  • Capacité à documenter, expliquer les compromis et travailler avec plusieurs équipes sans dette technique isolée.
  • Connaissances Kubernetes, Terraform, MLflow, Prometheus/Grafana, OpenSearch et bases de données vectorielles locales comme Qdrant, Milvus, pgvector.
  • PEFT/LoRA/QLoRA, distillation, entraînement distribué et préparation de jeux de données supervisés.
  • Connaissances des contraintes du secteur de la santé, GDPR et environnements sécurisés.
  • Expérience en environnements isolés (air-gapped) et sur site, procédures d’importation contrôlées.
  • Contribution open-source ou évaluation critique de papiers scientifiques.
  • Autonomie décisionnelle et esprit critique pour avancer même en l’absence de définition complète.
  • Esprit proactif et communicatif, capable d’échanger avec des publics non techniques.

Responsabilités

  • Sélectionner, tester et qualifier des modèles ouverts compatibles déploiement local et contraintes licensing/confidentialité.
  • Définir une architecture modulaire permettant de changer le modèle ou la stratégie RAG sans couplage fort.
  • Mettre en œuvre le RAG local: embeddings, recherche vectorielle, hybrid search, reranking, filtrage et gestion des citations.
  • Déployer et faire opérer des moteurs d’inférence locaux tels que vLLM, llama.cpp, TGI, TensorRT-LLM, Triton ou équivalents.
  • Optimiser latence, débit, mémoire et stabilité via quantization, batching, KV-cache, parallélisme et choix de formats.
  • Mettre en place tests de charge, résilience et non-régression avant chaque release production.
  • Concevoir des pipelines packaging/versioning/validation/promotion/rollback des modèles, prompts et indices.
  • Définir un processus contrôlé d’importation de modèles et dépendances dans l’environnement sécurisé.
  • Containeriser les composants et les intégrer au CI/CD et outils d’orchestration.
  • Produire runbooks, procédures d’incident et documents d’architecture pour les revues sécurité et qualité.

Connaissances

LLM deployment
Python
PyTorch & Transformers
Inference engine
RAG architectures
Docker & CI/CD
Security culture
Documentation & communication
Kubernetes & Terraform
MLflow / Prometheus/Grafana
OpenSearch / vector DBs
PEFT/LoRA/QLoRA
GDPR & on-prem
Autonomie & proactivité
Open-source evaluation

Formation

Master’s degree or PhD in CS/AI

Outils

Qdrant
Milvus
pgvector
OpenSearch
Docker
Kubernetes
Terraform
MLflow
Prometheus/Grafana

Description du poste

Adlin Science crée une plateforme de gouvernance et de gestion de données biomédicales multimodales et recherche un responsable LLM pour piloter l’architecture et l’intégration du socle IA au sein de l’équipe Data. Vous contribuerez à définir l’architecture modulaire et à déployer des solutions sans dépendance à des API externes en production.

Le rôle requiert une forte expérience en ML engineering/MLOps, une maîtrise avancée de Python et PyTorch, et une sensibilité à la sécurité et à la

Obtenez votre examen gratuit et confidentiel de votre CV.

ou faites glisser et déposez votre fichier ici.

Similar jobs

Postes similaires à comparer

Senior LLMOps, RAG & infrastructure
Senior LLMOps, RAG & infrastructure

Adlin Science • Paris

Sur place
EUR 90 000 - 130 000
Restaurant d'entreprise
Tickets restauration
ML & GenAI Ops Engineer — AI Lifecycle Architect
ML & GenAI Ops Engineer — AI Lifecycle Architect

SmartRecruiters, Inc. • Levallois-Perret

Sur place
EUR 70 000 - 100 000
Architecte Plateforme IA Senior – RAG & MLOps
Architecte Plateforme IA Senior – RAG & MLOps

Lefebvre Dalloz • Courbevoie

Sur place
EUR 120 000 - 150 000
Ingénieur IA & MLOps — Plateforme biomédicale AGORA
Ingénieur IA & MLOps — Plateforme biomédicale AGORA

Institut Curie • Paris

Hybride
EUR 70 000 - 110 000
Architecte Plateforme IA & LLMOps – Scale & Sécurité
Architecte Plateforme IA & LLMOps – Scale & Sécurité

Free-Work • Paris

Sur place
EUR 90 000 - 140 000
Architecte Plateforme IA / LLMOps (IT) / Freelance
Architecte Plateforme IA / LLMOps (IT) / Freelance

Free-Work • Paris

Sur place
EUR 90 000 - 140 000
Senior Software & Data Engineer for AI Platforms
Senior Software & Data Engineer for AI Platforms

Talent-R • France

Sur place
EUR 70 000 - 110 000
AI Platform Lead: Scalable, Secure Data Solutions
AI Platform Lead: Scalable, Secure Data Solutions

bioMérieux SA • Craponne

Sur place
EUR 90 000 - 130 000
Senior Data & AI Architecture Lead
Senior Data & AI Architecture Lead

Saegus • Paris

Hybride
EUR 90 000 - 130 000
Remboursement des frais de transports
Titres restaurant
Prime vacances
+3
Ingénieur IA / MLOps (H/F)
Ingénieur IA / MLOps (H/F)

Institut Curie • Paris

Sur place
EUR 70 000 - 110 000