Au sein d'une équipe spécialisée en Data et Intelligence Artificielle, vous intervenez sur des problématiques à forte dimension technique autour de la gestion de données, de l'Information Retrieval et de l'IA générative. Votre mission consiste à concevoir et industrialiser les pipelines permettant de collecter, transformer, indexer et rechercher de grands volumes de données, afin d'alimenter des applications basées sur les LLM et les architectures RAG. Vous serez également impliqué dans les choix d'architecture, l'amélioration de la pertinence des recherches et l'industrialisation des solutions en production. Vos principales missions Data Engineering & Indexation Concevoir et industrialiser des pipelines d'ingestion de données provenant de sources hétérogènes. Mettre en œuvre les traitements de parsing, nettoyage, normalisation et chunking. Concevoir et maintenir des systèmes d'indexation à grande échelle. Mettre en œuvre des bases vectorielles et des embeddings. Garantir la qualité, la fraîcheur, la traçabilité et la scalabilité des données et des index. Retrieval & RAG Concevoir des stratégies de recherche sémantique et hybride. Combiner recherche lexicale (BM25), embeddings, filtrage et reranking. Mettre en place des indicateurs de pertinence : Recall, Precision, nDCG, MRR. Optimiser les mécanismes de Retrieval alimentant les LLM et architectures RAG. Travailler sur la gestion du contexte, la déduplication et la qualité des résultats. Architecture & qualité Participer aux choix techniques et à l'évolution de la stack Data/IA. Mettre en place les bonnes pratiques de développement : Clean Code, SOLID, tests automatisés. Assurer l'observabilité des pipelines et des services. Contribuer à la sécurité et à la conformité des données. Accompagner techniquement les équipes et partager les bonnes pratiques. Environnement technique Indispensable : Python 3.11+ Data Engineering / Information Retrieval Embeddings / NLP Recherche sémantique et hybride RAG / LLM Bases vectorielles : Qdrant, Weaviate, pgvector, OpenSearch PostgreSQL Tests avec Pytest Environnement apprécié : LangChain OpenAI, Mistral, Amazon Bedrock BM25 / reranking Kafka Redis Airflow / Spark Docker / Kubernetes CI/CD Go ou Java
Dans le cadre du développement et de l'accompagnement de produits analytiques à destination des équipes Approvisionnement, nous recherchons un(e) Data Translation / Product Owner Data expérimenté(e). Vous interviendrez à l'interface entre les équipes métier et les équipes techniques (Data Science, Data Engineering, Data Viz) afin de valoriser les données et répondre à des problématiques clés liées notamment à la prévision des ventes et à la qualité d'approvisionnement. Vos principales missions seront : Volet Data Analyst – Analyses & InsightsCadrer, extraire et analyser les données de manière autonome. Réaliser des analyses ad hoc et produire des études décisionnelles. Restituer les résultats et insights aux équipes métier. Accompagner les utilisateurs dans la lecture et l'interprétation des résultats. Identifier et expliquer les éventuels biais d'analyse. Volet Product Owner Data – Gestion de produit & DeliveryPiloter la feuille de route et la livraison des produits analytiques. Recueillir et spécifier les besoins métier. Rédiger et prioriser les User Stories. Animer la méthodologie Agile et suivre le delivery. Mesurer la valeur apportée par les produits à travers des KPI d'impact. Accompagner l'adoption des solutions auprès des utilisateurs.