consultant expérimenté Data & Retrieval – IA Générative / RAG F/H

Smartpoint

Paris

Sur place

EUR 70 000 - 110 000

Plein temps

Il y a 2 jours
Soyez parmi les premiers à postuler
Générateur de candidature

Obtenez une réponse de cet employeur — un CV et une lettre de motivation adaptés exactement à ce qu’il recherche.

Passez les filtres ATS

Résumé du poste

Smartpoint, ESN pure player Data & IA, fondée en 2006 à Paris, conçoit et exploite des plateformes data de bout en bout et adopte une approche DataOps & IAOps 360°. Le poste vise une mission d’ingénierie data orientée indexation, retrieval et IA générative, avec des pipelines massifs, LLM et architectures RAG, et une emphase sur qualité, traçabilité et observabilité des données.

Vous évoluerez dans une équipe spécialisée et travaillez sur des stack modernes (Python, bases vectorielles,

Qualifications

  • Formation supérieure en informatique, data ou IA exigée et expérience significative en Data Engineering, Information Retrieval ou IA appliquée.
  • Maîtrise des pipelines data industrialisés, indexation et recherche sur de grands volumes de données.
  • Connaissance des embeddings, recherche vectorielle et architectures Retrieval et RAG.
  • Bonne aptitude à l’évaluation et à l’optimisation de la pertinence des résultats.
  • Sensitivity to data quality, traceability and versioning.

Responsabilités

  • Concevoir et industrialiser des pipelines d’ingestion et de traitement de données provenant de sources hétérogènes.
  • Mettre en œuvre le parsing, le nettoyage, la normalisation et le chunking des données.
  • Concevoir et maintenir des systèmes d’indexation à grande échelle.
  • Mettre en œuvre des bases vectorielles et des embeddings pour la recherche.
  • Garantir la qualité, la traçabilité et la scalabilité des données et des index.

Connaissances

Data Engineering
Information Retrieval
Embeddings / NLP
RAG / LLM
Recherche sémantique

Formation

Formation Supérieure en Informatique, Data ou IA

Outils

Python 3.11+
PostgreSQL
Bases vectorielles: Qdrant, Weaviate, pgvector, OpenSearch
Pytest
LangChain
OpenAI

Description du poste

Smartpoint en bref, qui sommes-nous et en quoi sommes-nous différents ?

Smartpoint est une ESN pure player Data & IA créée en 2006 à Paris. Nous concevons, modernisons, déployons et opérons des plateformes Data/IA de bout en bout, avec une approche DataOps & IAOps 360° : du cadrage à l’industrialisation, le run et l’amélioration continue. Notre valeur ajoutée : des architectures data production-ready, des pipelines automatisés et observables et une obsession de la valeur opérationnelle pour les métiers. Nos équipes interviennent sur l’ensemble des grands chantiers Data & IA : architecture et modernisation des plateformes, data engineering & XOps (DataOps, MLOps/LLMOps), IA / IA générative (LLM, RAG, agents), BI & analytics (modernisation BI, reporting, dashboards) ainsi que la gouvernance des données & qualité (catalogue, lineage, data quality, data contracts). Quelques repères : +300 experts, SmartLab (R&D inshore à Paris, agrément CIR), certifications ISO 27001/27701, engagement RSE et bilan carbone.

Vos responsabilités et le périmètre du poste

Au sein d’une équipe spécialisée en Data et Intelligence Artificielle, vous intervenez sur des problématiques à forte dimension technique autour de la gestion de données, de l’Information Retrieval et de l’IA générative. Votre mission consiste à concevoir et industrialiser les pipelines permettant de collecter, transformer, indexer et rechercher de grands volumes de données, afin d’alimenter des applications basées sur les LLM et les architectures RAG. Vous serez également impliqué dans les choix d’architecture, l’amélioration de la pertinence des recherches et l’industrialisation des solutions en production.

Vos principales missions Data Engineering & Indexation
  • Concevoir et industrialiser des pipelines d’ingestion de données provenant de sources hétérogènes.
  • Mettre en œuvre les traitements de parsing, nettoyage, normalisation et chunking.
  • Concevoir et maintenir des systèmes d’indexation à grande échelle.
  • Mettre en œuvre des bases vectorielles et des embeddings.
  • Garantir la qualité, la fraîcheur, la traçabilité et la scalabilité des données et des index.
Retrieval & RAG
  • Concevoir des stratégies de recherche sémantique et hybride.
  • Combiner recherche lexicale (BM25), embeddings, filtrage et reranking.
  • Mettre en place des indicateurs de pertinence : Recall, Precision, nDCG, MRR.
  • Optimiser les mécanismes de Retrieval alimentant les LLM et architectures RAG.
  • Travailler sur la gestion du contexte, la déduplication et la qualité des résultats.
Architecture & qualité
  • Participer aux choix techniques et à l’évolution de la stack Data/IA.
  • Mettre en place les bonnes pratiques de développement : Clean Code, SOLID, tests automatisés.
  • Assurer l’observabilité des pipelines et des services.
  • Contribuer à la sécurité et à la conformité des données.
  • Accompagner techniquement les équipes et partager les bonnes pratiques.
Environnement technique Indispensable:
  • Python 3.11+
  • Data Engineering / Information Retrieval
  • Embeddings / NLP
  • Recherche sémantique et hybride
  • RAG / LLM
  • Bases vectorielles : Qdrant, Weaviate, pgvector, OpenSearch
  • PostgreSQL
  • Tests avec Pytest
Environnement apprécié:
  • LangChain
  • OpenAI, Mistral, Amazon Bedrock
  • BM25 / reranking
  • Kafka
  • Redis
  • Airflow / Spark
  • Docker / Kubernetes
  • CI/CD
  • Go ou Java
Votre profil

De Formation Supérieure En Informatique, Data, IA Ou Domaine Équivalent, Vous Disposez D’une Expérience Significative En Data Engineering, Information Retrieval Ou IA Appliquée, Idéalement Sur Des Environnements à Forte Volumétrie. Vous Maîtrisez Notamment

  • la conception de pipelines Data industrialisés ;
  • l’indexation et la recherche sur de grands volumes de données ;
  • les embeddings et la recherche vectorielle ;
  • les architectures de Retrieval et RAG ;
  • l’évaluation et l’optimisation de la pertinence des résultats ;
  • les problématiques de qualité, traçabilité et versioning des données.

Vous êtes à l’aise dans les environnements techniques complexes et souhaitez participer à des projets au croisement de la Data Engineering et de l’IA générative. Un bon niveau d’anglais est requis pour évoluer dans un contexte international.

Obtenez votre examen gratuit et confidentiel de votre CV.
ou faites glisser et déposez votre fichier ici.
Similar jobs

Postes similaires à comparer

Data Scientist / AI Engineer Senior – IA générative & systèmes agentiques
Data Scientist / AI Engineer Senior – IA générative & systèmes agentiques

Onyx-Conseil • Montreuil-sur-Mer

Sur place
EUR 110 000 - 150 000
Data Engineer RAG
Data Engineer RAG

REACTIS Group • Aix-en-Provence

Sur place
EUR 45 000 - 65 000
Tickets-restaurant
RTT
Prime de cooptation (1 500 €)
+1
Data Engineer (F/H)
Data Engineer (F/H)

Nomadia • Paris

Hybride
EUR 65 000 - 95 000
Télétravail possible
Formation continue
Autonomie au sein d’une équipe experte
Senior Engineer Data & AI (Azure & IA Générative)
Senior Engineer Data & AI (Azure & IA Générative)

Projobnow • Paris

Hybride
EUR 45 000 - 60 000
Data Engineer confirmé - Intelligence Artificielle
Data Engineer confirmé - Intelligence Artificielle

Conseil d'Etat • Paris

Sur place
EUR 70 000 - 100 000
DATASCIENTIST H/F A NANTES
DATASCIENTIST H/F A NANTES

ELLISPHERE • Nantes

Sur place
EUR 48 000 - 54 000
AI Engineer (LLM / RAG) F/H
AI Engineer (LLM / RAG) F/H

Harvest Groupe • Paris

Sur place
EUR 70 000 - 120 000
Lead Tech IA / IA Gen - F/H
Lead Tech IA / IA Gen - F/H

Onepoint • Paris

Sur place
EUR 65 000 - 85 000
AI Engineering / Agentic AI Engineering Manager
AI Engineering / Agentic AI Engineering Manager

Accenture France • Paris

Sur place
EUR 70 000 - 90 000
Accès à des formations avancées
Évolution de carrière vers le niveau Senior Manager
Développeur Full Stack IA
Développeur Full Stack IA

INFOGENE • Île-de-France

Sur place
EUR 60 000 - 90 000
Equipe Agile mature
Environnement DevSecOps moderne
Formation IA / MLOps