
Share this job
Contexte de la Mission
Aux côtés d'une équipe d'experts passionnés, vous relèverez les plus hauts défis techniques de la société. En tant qu'Expert Data & Retrieval, vous êtes le garant de la matière première de notre IA : la collecte, l'ingestion, l'indexation et la recherche de pertinence sur des volumes massifs de documents spécialisés, le socle qui alimente nos modèles de langage et nos produits. Votre terrain de jeu : transformer la manière dont tout un secteur professionnel travaille au quotidien.
Votre mission n'est pas d'écrire un simple script, mais de concevoir des pipelines de données robustes capables d'ingérer, de nettoyer et d'indexer d'énormes corpus textuels, puis d'exposer une recherche rapide et pertinente (sémantique et hybride) au service de plusieurs équipes à travers l'Europe. Vous garantirez la fraîcheur des index et la qualité du retrieval tout en gérant une complexité technique de haut vol (volumétrie, hétérogénéité des sources, évaluation de la pertinence, scalabilité).
Objectifs et Missions Principales
Vos missions principales s'articulent autour de trois axes : bâtir, outiller et transmettre.
1. Collecte, Ingestion & Indexation
• Pipelines d'ingestion : Concevoir la collecte et le traitement de sources hétérogènes (open data, bases spécialisées, documents métier), le parsing, le nettoyage, le chunking et la normalisation des documents.
• Indexation & Embeddings : Choisir et industrialiser les modèles d'embeddings, alimenter et maintenir les bases vectorielles, gérer la fraîcheur et la reconstruction des index.
• Qualité & Volumétrie : Garantir la scalabilité de l'indexation sur des corpus massifs et la traçabilité des données (lignage, versioning des index).
2. Recherche & Pertinence (Retrieval)
• Stratégie de retrieval : Combiner recherche lexicale et sémantique (BM25 + embeddings) avec reranking et filtrage par métadonnées pour maximiser la pertinence.
• Évaluation continue : Mettre en place des jeux de tests et des métriques de pertinence (recall, precision, nDCG, MRR) pour mesurer et améliorer le retrieval.
• RAG : Structurer la phase de récupération qui alimente les LLM (contexte, citations, dé-duplication, gestion des fenêtres de contexte).
• Observabilité & Sécurité : Instrumenter les pipelines (logs, métriques, traces de qualité) et garantir la sécurité et la conformité des données (isolation par pays, conformité aux réglementations).
3. Leadership Technique & Gouvernance
• Culture Craftsmanship : Promouvoir les pratiques de Clean Code, SOLID, et tests automatisés.
Candidate profile
Diplôme requis : Master, Ph.D, Diplôme d'Ingénieur ou équivalent en Informatique / Data.
Compétences Attendues :
• Expérience avérée en Data Engineering / Information Retrieval sur des volumes massifs en production.
• Expertise Retrieval : maîtrise de l'indexation, des embeddings et de la recherche hybride, capacité à mesurer puis améliorer la pertinence.
• Culture Data : pipelines reproductibles, qualité et lignage des données, versioning des datasets et des index.
• Solide culture IA / ML : embeddings, NLP et bonne compréhension des LLM (sans nécessairement être un expert serving).
• Polyvalence appréciée : une appétence pour d'autres langages (Java notamment) pour prêter main-forte sur des sujets transverses est un vrai plus.
• Anglais fluide requis (contexte européen quotidien).
Working environment
Secteur : Édition Spécialisée & Services Technologiques | Périmètre International
Télétravail: 2 jours par semaine
Apply to this job!
Find your next career move from +9,000 jobs!
Manage your visibility
Salary, remote work... Define all the criteria that are important to you.
Get discovered
Recruiters come directly to look for their future hires in our CV library.
Join a community
Connect with like-minded tech and IT professionals on a daily basis through our forum.
TECH LEAD EXPERT DATA RETRIEVAL & RAG
MEETSHAKE
