ContexteAu sein du Data Office de Coface, le consultant intervient dans un contexte international pour développer et industrialiser des solutions autour de la Data Management, Data Quality, Data Governance et de l'IA générative. Missions 1. Data Management, Data Governance & Data QualityConcevoir, développer et maintenir des applications et services Python destinés à automatiser les processus de Data Governance et Data Quality. Développer des mécanismes de contrôle de la qualité des données, de détection d'anomalies et de monitoring. Industrialiser les traitements de collecte, d'analyse et de reporting liés à la qualité des données. Développer des APIs REST et services MCP permettant d'interconnecter les outils du Data Office, Data Marketplace, catalogues de données, plateformes data et outils BI. Automatiser et optimiser les processus de gestion des données. Contribuer à la mise en place de solutions robustes, maintenables et conformes aux standards d'architecture et de sécurité du Groupe. 2. IA Générative & Agentic AIConcevoir et développer des assistants IA spécialisés pour les besoins du Data Office. Développer des solutions de Text-to-SQL permettant d'interroger des bases de données en langage naturel. Concevoir des architectures Agentic AI basées sur des LLM, avec mécanismes d'orchestration, raisonnement et accès aux différentes sources d'information. Développer des connecteurs et intégrations via le Model Context Protocol (MCP). Mettre en œuvre des architectures de type RAG et intégrer différentes sources de données et de connaissances. Participer à l'industrialisation et au déploiement des solutions IA en environnement de production. Veiller au respect des exigences de sécurité, gouvernance, architecture et exploitation. Contribuer aux initiatives IA existantes du Data Office, notamment : l'agent Jira permettant d'évaluer la qualité des tickets entrants et d'anticiper leur criticité ; l'agent de requêtage de bases de données en Text-to-SQL. 3. Industrialisation & accompagnementProduire du code, packages Python, APIs et services documentés, testés et maintenables. Mettre en place les pipelines d'intégration et de déploiement nécessaires à l'industrialisation des solutions. Rédiger la documentation technique et d'exploitation ainsi que les procédures de déploiement. Participer aux phases de tests, mise en production et maintien en conditions opérationnelles. Assurer un reporting régulier sur l'avancement, les risques, les dépendances et les arbitrages nécessaires. Communiquer efficacement les résultats et sujets techniques auprès d'interlocuteurs techniques et métiers.
Contexte de la Mission Aux côtés d'une équipe d'experts passionnés, vous relèverez les plus hauts défis techniques de la société. En tant qu'Expert Data & Retrieval, vous êtes le garant de la matière première de notre IA : la collecte, l'ingestion, l'indexation et la recherche de pertinence sur des volumes massifs de documents spécialisés, le socle qui alimente nos modèles de langage et nos produits. Votre terrain de jeu : transformer la manière dont tout un secteur professionnel travaille au quotidien. Votre mission n'est pas d'écrire un simple script, mais de concevoir des pipelines de données robustes capables d'ingérer, de nettoyer et d'indexer d'énormes corpus textuels, puis d'exposer une recherche rapide et pertinente (sémantique et hybride) au service de plusieurs équipes à travers l'Europe. Vous garantirez la fraîcheur des index et la qualité du retrieval tout en gérant une complexité technique de haut vol (volumétrie, hétérogénéité des sources, évaluation de la pertinence, scalabilité). Objectifs et Missions Principales Vos missions principales s'articulent autour de trois axes : bâtir, outiller et transmettre. 1. Collecte, Ingestion & Indexation • Pipelines d'ingestion : Concevoir la collecte et le traitement de sources hétérogènes (open data, bases spécialisées, documents métier), le parsing, le nettoyage, le chunking et la normalisation des documents. • Indexation & Embeddings : Choisir et industrialiser les modèles d'embeddings, alimenter et maintenir les bases vectorielles, gérer la fraîcheur et la reconstruction des index. • Qualité & Volumétrie : Garantir la scalabilité de l'indexation sur des corpus massifs et la traçabilité des données (lignage, versioning des index). 2. Recherche & Pertinence (Retrieval) • Stratégie de retrieval : Combiner recherche lexicale et sémantique (BM25 + embeddings) avec reranking et filtrage par métadonnées pour maximiser la pertinence. • Évaluation continue : Mettre en place des jeux de tests et des métriques de pertinence (recall, precision, nDCG, MRR) pour mesurer et améliorer le retrieval. • RAG : Structurer la phase de récupération qui alimente les LLM (contexte, citations, dé-duplication, gestion des fenêtres de contexte). • Observabilité & Sécurité : Instrumenter les pipelines (logs, métriques, traces de qualité) et garantir la sécurité et la conformité des données (isolation par pays, conformité aux réglementations). 3. Leadership Technique & Gouvernance • Culture Craftsmanship : Promouvoir les pratiques de Clean Code, SOLID, et tests automatisés.
Recherche d'un Développeur Fullstack senior PHP/Symfony, capable d'intervenir sur le back-end et le front-end. Maîtrise obligatoire de PHP/Symfony et React Native, avec une vraie expérience en développement mobile. Solide maîtrise de JavaScript, APIs, SQL, modèles de données et flux d'intégration. Forte exigence sur la qualité du code, tests unitaires/E2E, non-régression, CI/CD et pratiques Agile. Profil autonome et pragmatique, capable de gérer un contexte de fusion/rebranding à délais courts, avec utilisation quotidienne d'outils IA pour le développement.