En tant que Data Engineer, vous intégrerez une équipe pluridisciplinaire composée de de développeurs, de DevOps, de Scrum masters et de Product Owners, travaillant en méthodologie Agile : o Nos défis : Fiabiliser et industrialiser les flux de données du catalogue de contenus : métadonnées éditoriales, programmes, saisons, droits et disponibilités. Construire des pipelines performants, rejouables et scalables pour fournir des données fraîches et cohérentes. Méthode de travail : Agile / Scrum, intégration et déploiements continus, revue de code. o Environnement technique : Apache Spark, Apache Iceberg, Amazon S3, AWS, Python et/ou Scala, SQL, Git, CI/CD, monitoring et alerting.
📋 Informations sur la missionIntitulé du poste : Architecte Data / Architecte Plateforme Data Localisation : Métropole Lilloise / Roubaix (3 jours de présence sur site par semaine) TJM max : 500 € HT / jour Date de démarrage : 21/09/2026 Durée : Jusqu'au 31/12/2026 (Mission renouvelable) 🎯 Contexte de la missionDans le cadre de la synergie IT et de l'intégration de cas d'usage en IA Générative (GenAI) au sein des applications, le pôle Entrepôt de données recherche un Architecte Data senior. Au sein d'une équipe d'experts, vous aurez la charge de faire évoluer les modèles et patterns d'architecture de la plateforme Snowflake, aussi bien sur le périmètre France qu'à l'international. 📌 Objectifs & Responsabilités clésConception & Patterns d'Architecture : Concevoir, définir et documenter les nouveaux patterns d'architecture (fonctionnels, applicatifs et techniques) sur Snowflake pour l'ingestion, le traitement et la restitution de données structurées et non structurées. Rédiger les spécifications techniques de manière détaillée et exécutable pour les différentes entités et Business Units (BU). Servir d'interlocuteur privilégié pour l'intégration des usages et agents IA Générative (GenAI) au sein du pôle Data. Évolution & Gouvernance de la Plateforme : Contribuer au cadrage des nouveaux besoins techniques métiers et participer aux choix d'outils/technologies cibles. Faire évoluer le socle Data (automatisation, mécanismes de contrôle, règles de gouvernance). Accompagnement & Déploiement : Accompagner les équipes Data IT et métiers dans le déploiement et la prise en main de la plateforme Snowflake en France et à l'international. Assurer le support et l'acculturation technique auprès des différentes BU.
Le Data Analyst aura la charge de: Mesurer l'apport qualitatif des nouveaux développements : Réaliser des campagnes de tests comparant 2 versions du moteur d'identification et effectuer des analyses quantitatives et qualitatives des différences Analyser les remontées utilisateurs pour nourrir la roadmap produit : En collaboration avec les experts métiers, comprendre leur remontées, les analyser pour constuire avec le PO, les évolutions de règles à opérer pour améliorer la performance Outiller les analyses : Automatiser le travail d'analyse Enrichir les analyses avec des données provenant de sources internes ou externes ou via des algos Le candidat devra présenter une experience significative dans le domaine de l'analyse de données et être à l'aise avec les méthodologies de tests sur une application aux résultats incertains.
L'équipe utilise au quotidien plusieurs applications d'aide à la décision et des référentiels de données (marché et fondamentales) afin de mener à bien sa mission de conseil et de support au Trading. La Mission à réaliser se déclinera notamment à travers ces activités : • Développement et évolution de la plateforme data. • Collecte, ingestion, traitement, transformation et restitution des données • Optimisation des coûts et des performances. • Conception et développement d'outils d'aide à la décision • Maintenance évolutive et support technique / accompagnement des utilisateurs
Nous recherchons pour l'un de nos clients du secteur du transport un Data Engineer Snowflake pour accompagner l'évolution de son architecture Data vers un modèle Data Lakehouse. Participer à la migration des flux Talend vers Snowflake. Contribuer à la mise en place et à l'évolution de l'architecture Data Lakehouse. Développer et industrialiser les pipelines de données. Participer au décommissionnement progressif de Talend. Intervenir sur les évolutions, incidents et sujets de support Data. Documenter les flux, modèles et solutions développées.
Data Scientist AWS AgentCore/bedrock Client : pharmaceutique Bordeaux (obligatoire) 5 à 10 ans d'expérience anglais obligatoire Démarrage : asap Durée : min 3 mois Localisation : Bordeaux (obligatoire) Technologies : AWS Bedrock Agentcore Runtimes ST / LT memories Observability Agentcore identity Agentcore gateway Agentcore policy Cloudwatch Langchain + Lang-graph Github actions FE built with React FE likely hosted on OpenShift AWS API gateways Terraform for CICD pipelines along with Artifactory MCP and A2A agent protocols Nice to have: Knowledge of Neo4J Knowledge of GenBI platforms Weights and balances
RésuméUn poste d'ingénieur data est ouvert au sein d'une organisation axée sur les données, visant à maximiser l'exploitation des données pour développer de nouvelles offres, réduire les risques opérationnels et améliorer l'efficacité de l'équipe afin de mieux servir les clients. ResponsabilitésConstruire et améliorer le cadre commun (composants fonctionnels et techniques). Supporter le déploiement de la MDM dans différents pays. Concevoir et mettre en œuvre des composants de la plateforme tels que l'ingestion et le traitement des données. Distribuer les données aux différentes parties prenantes. Assurer la conformité avec les directives du groupe concernant l'utilisation des cadres internes et l'architecture. Collaborer avec d'autres parties prenantes du projet pour promouvoir des lignes directrices communes. Collecter, comprendre et affiner les exigences commerciales. Concevoir des solutions en suivant les directives d'architecture. Participer aux activités de développement en tant que rôle senior/expert. Écrire et mettre à jour la documentation technique en anglais. Communiquer efficacement avec toutes les équipes concernées. Compétences RequisesIngénierie logicielle : Design & Architecture logicielle, Python, Programmation Orientée Objet. Architecture des données : architecture en couches, solutions de stockage et d'exposition. Technologies Big Data : pipelines de données, HDFS/S3/Parquet. Modèles de Big Data : partitionnement, indexation, optimisation des requêtes. Compétences AWS : sécurité/IAM, S3, Lambda. Compétences AppréciéesExpérience en ingénierie des données. Compétences sur les structures de données / modélisation des données & SQL. Compréhension des processus DevOps et CI/CD. Autres DétailsLocalisation : l'équipe est principalement située en Ile-de-France avec des déplacements occasionnels à Lyon et Bruxelles. Durée de mission : Plus d'un an (maximum 3 ans) Télétravail : 50%
Dans le cadre du renforcement d'une équipe IT spécialisée dans l'analyse des marchés de l'énergie, nous recherchons un Senior Data Engineer / Software Engineer pour intervenir sur des applications métiers et une plateforme Data stratégique. Vous participerez au développement et à l'évolution de la plateforme Data, ainsi qu'à la collecte, l'ingestion, le traitement, la transformation et la restitution des données. Vous contribuerez également à la conception et au développement d'outils d'aide à la décision à destination des équipes métier. La mission comprend le développement de solutions en Python sur AWS, l'optimisation des performances et des coûts, ainsi que la maintenance corrective et évolutive des applications. Vous veillerez à la qualité des livrables et accompagnerez les utilisateurs dans un environnement exigeant et international.
📍 Localisation : Malakoff 📅 Démarrage : ASAP 🗓️ Phase critique : novembre – décembre 2026 🎯 Séniorité : Expert 🎯 ContexteDans le cadre d'un projet stratégique de digitalisation sécurisée des processus métiers, la DSI – Division Infrastructure – recherche un Architecte Cloud Souverain / Expert SecNumCloud pour accompagner un projet structurant de migration et de mise à disposition de ressources dans un Cloud souverain. Le projet s'inscrit dans une démarche de souveraineté numérique, de conformité réglementaire et de sécurisation des données, avec notamment des exigences liées au référentiel SecNumCloud 3.2 de l'ANSSI. Vous interviendrez au cœur du projet, avec une forte implication sur les phases de RFP, architecture, conformité et intégration. 🔎 Vos principales missionsPiloter le RFP Cloud souverain : rédaction des exigences, benchmarks, consultation des fournisseurs et analyse des réponses. Co-concevoir l'architecture de la Landing Zone Cloud souverain. Définir les principes d'architecture et les schémas d'intégration avec l'écosystème existant. Accompagner l'analyse des exigences SecNumCloud / ANSSI, de souveraineté et d'Export Control. Participer à l'analyse des risques et à la sécurisation de l'architecture. Garantir l'intégration de la solution retenue avec les infrastructures existantes. Travailler en transverse avec les équipes Infrastructure, SSI, métiers, achats et fournisseurs. Structurer et assurer le pilotage projet : planning, roadmap, reporting, KPIs, risques et plans d'actions. Préparer et animer les supports de météo hebdomadaire et COPIL mensuel. Contribuer à la transition et à la définition des recommandations en fin de projet. 🛠️ Environnement techniqueCloud souverain / SecNumCloud 3.2 AWS Cloud Platform VMware / Virtualisation ServiceNow / CMDB Windows & Red Hat Stockage NAS / SAN Veeam / NetBackup Veritas Appliance / Data Domain Architectures sécurisées multi-tiers DevSecOps Chiffrement / HSM Réversibilité Cloud Exigences Export Control Une expérience sur des environnements contenant des données régulées ou à caractère militaire serait un réel plus.
Contexte Dans le cadre d'un programme stratégique associant Data et intelligence artificielle générative, nous recherchons un Data Engineer AWS pour participer au développement et à l'évolution d'une Data Platform destinée à alimenter des solutions métiers et des cas d'usage IA. La plateforme est déjà en production sur AWS. La mission consiste à renforcer son architecture, développer de nouveaux pipelines et industrialiser la gestion des données selon une approche moderne de type Data Lakehouse. Missions Participer à la définition et à l'évolution de l'architecture de la Data Platform et du Lakehouse. Concevoir, développer et optimiser des pipelines d'ingestion et de transformation de données. Développer des jobs Data avec AWS Glue, Spark et PySpark. Intégrer les services AWS dédiés au Data Management. Développer et maintenir des API en Java 17/21 avec Spring Boot. Traiter des données internes et provenant de fournisseurs externes. Traduire les besoins fonctionnels en solutions techniques fiables et évolutives. Participer à la mise en place d'un environnement Data Lab. Industrialiser les développements et les déploiements avec des pipelines CI/CD. Mettre en place les tests automatisés et les contrôles de qualité du code. Garantir la sécurité, la performance et la maintenabilité des solutions. Participer aux mises en production. Assurer le support de production en cas d'incident majeur. Produire et maintenir la documentation technique. Compétences techniquesAWS : S3, Glue et services Data associés Data Engineering : Spark, PySpark et Hadoop Lakehouse : Apache Iceberg et Trino Développement : Java 17/21 et Spring Boot Bases de données : PostgreSQL et Oracle Tests : JUnit 5 et Mockito CI/CD : GitLab CI Qualité et gestion des dépendances : SonarQube, Maven et Artifactory Conteneurisation : Docker et Kubernetes GitOps et déploiement : Argo CD Formats : JSON, YAML et XML Outils : GitHub, GitHub Copilot, IntelliJ IDEA, Jira et SharePoint
Nous recherchons un DataEngineer confirmé ou senior pour intervenir sur une plateforme data moderne reposant sur Snowflake et dbt, avec une forte exigence en modélisation Data Vault. Contexte de la mission : Vous rejoindrez une équipe Data en charge de structurer et faire évoluer une architecture analytique robuste et scalable. La mission s'inscrit dans une logique d'industrialisation, de qualité et de standardisation des flux. Missions principales Concevoir et implémenter des modèles Data Vault (obligatoire). Développer et optimiser les transformations via dbt. Modéliser et structurer les données dans Snowflake. Participer à la définition des standards d'architecture et des bonnes pratiques. Assurer la qualité, la performance et la traçabilité des données. Collaborer avec les équipes BI (notamment Power BI) et métiers.
Notre client est une startup SaaS B2B française qui aide les équipes commerciales à prospecter plus efficacement grâce à une plateforme tout-en-un de sales intelligence. Le produit centralise la recherche de leads, l'enrichissement de données, l'engagement multicanal et la gestion du pipeline commercial. L'ambition : permettre aux sales d'arrêter de jongler entre plusieurs outils et de se concentrer sur la création d'opportunités. L'équipe tech entre aujourd'hui dans une phase clé : accélérer le delivery produit tout en assainissant l'existant. Dette technique, refacto, design system, legacy, process à simplifier, usage avancé de l'IA… les sujets sont nombreux, concrets, et à fort impact. C'est un environnement fait pour les profils qui aiment construire vite, coder proprement, prendre des sujets de A à Z et utiliser l'IA comme un vrai levier de productivité. 💼 Description du poste Votre mission 🚀 Rejoindre une équipe tech resserrée et contribuer directement à la construction d'un produit SaaS utilisé par des équipes sales, avec un double objectif : shippers des features utiles rapidement et renforcer la base technique sur le long terme. Vous interviendrez sur une stack moderne composée de TypeScript, Node.js, React, Next.js, PostgreSQL, Elasticsearch, Redis et AWS, dans un environnement en monorepo avec une approche Domain-Driven Development pragmatique. Ce que vous allez faire Livrer régulièrement de nouvelles features, avec une vraie culture du MVP et des cycles courts. Découper les sujets intelligemment pour aller vite sans dégrader la qualité. Contribuer à la réduction de la dette technique : refacto, librairies à mettre à jour, legacy à rationaliser. Participer à la consolidation du design system et à son meilleur alignement avec le code existant. Challenger les choix techniques et proposer des solutions simples, robustes et orientées impact. Utiliser l'IA au quotidien — notamment Claude — pour accélérer le développement, améliorer les prompts, générer du code et surtout challenger les outputs produits. Votre environnement Vous travaillerez avec une équipe produit composée notamment d'un designer, d'un CPO, de Product Managers et d'une équipe data. Les développeurs peuvent échanger directement avec le métier et contribuer au cadrage des sujets lorsque cela permet d'aller plus vite et mieux. Ici, l'enjeu n'est pas de sur-architecturer : il faut savoir prendre des décisions, livrer, apprendre, améliorer et garder un haut niveau d'exigence sur le code.
📋 Informations sur la mission Intitulé du poste : Data Steward – Données RH Localisation : Métropole Lilloise (2 jours de télétravail par semaine) TJM max : 400 € HT / jour Date de démarrage : ASAP Durée : Jusqu'au 31/08/2027 (Longue mission) 🎯 Contexte de la mission Dans le cadre du déploiement mondial d'un nouveau Core HR (Workday) couvrant 65 pays, l'équipe Gouvernance des Données RH recherche un Data Steward expérimenté. Au sein d'un grand groupe international, votre rôle sera de coordonner la préparation, la fiabilisation et la qualité des données RH locales et centrales avant leur migration finale vers le nouvel outil. 📌 Objectifs & Responsabilités clés Qualité & Préparation des Données : Piloter la collecte, le nettoyage et le contrôle qualité des jeux de données RH transversaux. Identifier les anomalies de données, définir les règles de gestion et coordonner la remédiation auprès des équipes locales. Coordination & Gouvernance : Assurer l'interface entre les entités pays, les Data Owners et les équipes techniques de migration. Documenter le dictionnaire de données et maintenir le catalogue de données dans l'outil de gouvernance. Veiller à la conformité aux exigences réglementaires et de sécurité (RGPD, politique de confidentialité RH). Validation & Recette : Réaliser les contrôles et validations préalables avant l'intégration définitive des données dans Workday. Assurer le suivi et la traçabilité des transformations de données (Data Lineage).
Contexte de la mission ASAP Technologies recherche deux Data Engineers seniors aux profils complémentaires pour accompagner un acteur majeur du secteur des transports et de la mobilité dans la conception, l'industrialisation et l'évolution de ses solutions data. Au sein du pôle Data Services, vous contribuerez à la stratégie Lakehouse et interviendrez sur des enjeux d'architecture, de modélisation et d'optimisation des pipelines à grande échelle. Vos missions Concevoir, développer et optimiser des pipelines de données batch, streaming et d'ingestion via API. Structurer les transformations selon une architecture Médaillon : Bronze, Silver et Gold. Développer et industrialiser les traitements avec DBT, Spark et Apache Iceberg. Contribuer aux choix techniques et à l'évolution de l'architecture Lakehouse. Déployer et maintenir les pipelines sur AWS, notamment avec S3, Glue et EMR. Orchestrer les workflows ETL/ELT avec Airflow. Mettre en œuvre l'Infrastructure as Code avec Terraform et exécuter les traitements dans des environnements Docker/Kubernetes. Garantir la disponibilité, la supervision et l'observabilité des traitements. Participer à la résolution des incidents et à l'amélioration continue. Automatiser les contrôles de qualité des données et documenter les architectures, pipelines et règles métier. Veiller à la conformité des flux, notamment en matière de RGPD.
En tant qu'Ingénieur Support & Fiabilité, vous serez responsable de la gestion et de l'assurance de la fiabilité des systèmes et processus de données au sein du département Data Technology. Vous travaillerez en étroite collaboration avec les équipes de développement, les ingénieurs de données et les data scientists pour garantir la disponibilité, la qualité et la performance des pipelines de données et des systèmes sous-jacents. Support et opérations des données Fournir un support de niveau 1 pour les domaines de données, gérer les alertes et incidents pendant le shift de Paris. Objectifs et livrables : Mettre en place les meilleures pratiques de support et la documentation Agir en tant que gatekeeper pour la gestion des versions de données (processus CMRM), gestion de la fiabilité des données Maintenir des pipelines de données fiables et évolutifs (collecte, stockage, traitement, livraison) Mettre en œuvre une surveillance proactive pour la qualité, l'intégrité et la cohérence des données Définir et appliquer les politiques de gestion des données (sauvegarde, récupération, sécurité) Automatisation et meilleures pratiques Automatiser les tâches de données récurrentes pour améliorer l'efficacité et réduire les erreurs Établir une surveillance continue pour détecter les anomalies Promouvoir les meilleures pratiques de développement axées sur la fiabilité des données Collaboration inter fonctionnelle Travailler avec les équipes de développement, quant dev, ingénieurs data et data scientists pour comprendre les besoins Résoudre ensemble les problèmes liés aux données Fournir des conseils techniques sur la gestion des données avec les meilleures pratiques
Bonjour, Nous recherchons pour notre client grand compte un Data Analyst confirmé : tests et data quality (text matching) Nous étudions - prioritairement - les candidatures qui nous sont adressées à freelance à insyco . fr avec les informations suivantes : Argumentaire écrit répondant de façon ciblée au besoin ci-dessous CV à jour en français Date de prochaine disponibilité Tarif journalier Merci d'indiquer la référence MDE/DATA/5530 dans l'objet de votre message Contexte de la prestation L'organisme de gestion collective distribue la majorité de ses droits d'auteur musicaux en fonction de la diffusion réelle des œuvres sur les plateformes de diffusion en ligne. Pour cela, il s'appuie sur un système développé en interne permettant de faire correspondre les données de déclarations d'exploitation transmises par les diffuseurs avec son référentiel d'œuvres. Ce rapprochement combine des codes internationaux de l'industrie musicale et des techniques de rapprochement texte à texte (titres, participants), dans un objectif constant d'amélioration du taux d'identification et de réduction de la marge d'erreur. L'équipe est composée d'un lead dev, de deux développeurs et d'un data analyst. Une expérience significative en analyse de données est attendue, avec l'aisance nécessaire pour appliquer des méthodologies de tests sur une application aux résultats par nature incertains. Activités principales Mesurer l'apport qualitatif des nouveaux développements Réaliser des campagnes de tests comparant deux versions du moteur d'identification et effectuer des analyses quantitatives et qualitatives des différences Analyser les remontées utilisateurs pour nourrir la roadmap produit En collaboration avec les experts métiers, comprendre leurs remontées et les analyser pour construire avec le Product Owner les évolutions de règles à opérer pour améliorer la performance Outiller les analyses Automatiser le travail d'analyse Enrichir les analyses avec des données provenant de sources internes ou externes ou via des algorithmes Liste des tâches Établir un protocole de tests permettant de mesurer l'impact des règles de rapprochement développées par l'équipe Piloter les campagnes de tests et produire une analyse quantitative des écarts permettant d'ajuster au mieux les critères de rapprochement Participer activement à l'automatisation des analyses de données pour accélérer le time to deliver Analyser les anomalies et remontées utilisateurs en collaboration avec les experts métiers Participer à la validation et à la non-régression des développements en lien avec le Product Owner et les développeurs Dans une démarche "shift-left", intervenir dès le cadrage pour aider à la rédaction des user stories à travers les critères d'acceptance et la stratégie de recette