Vos missionsEn tant que Data Test Engineer, vous assurez la définition et le pilotage de la stratégie de tests des produits Data, de leur conception jusqu'à leur mise en production. À ce titre, vous serez notamment chargé(e) de : Contribuer aux études, au chiffrage et à la planification des activités de tests ; Définir les périmètres, scénarios, jeux de données et moyens nécessaires aux tests ; Concevoir et piloter les stratégies de tests de bout en bout ; Exécuter des tests manuels et automatisés en environnement d'intégration ; Réaliser des tests bouchonnés, non bouchonnés, transverses et de performance ; Automatiser les tests d'intégration dans un environnement CI/CD ; Coordonner les activités avec les testeurs, développeurs, Product Owners et équipes projet ; Assurer le suivi des anomalies et réaliser leur premier niveau d'analyse ; Accompagner les équipes métier pendant la préparation et l'exécution des recettes ; Participer à la maintenance corrective et évolutive des produits ; Contribuer aux projets de migration, aux évolutions d'architecture et aux montées de version ; Suivre la qualité des produits de bout en bout et produire le reporting associé ; Rédiger et maintenir les stratégies, rapports, procès-verbaux et documents de tests ; Participer activement aux cérémonies Agile et SAFe.
Dans le cadre du renforcement d'une équipe Data au sein du secteur numérique, nous recherchons un(e) Data Engineer expérimenté(e) spécialisé(e) sur DBT. Vous interviendrez sur des projets de transformation et de modélisation de données en contribuant à la conception, à l'industrialisation et à l'optimisation des traitements Data. Vos principales missions seront les suivantes : Concevoir et développer des modèles de données avec DBT. Mettre en œuvre les tests de qualité, la documentation et les processus de déploiement. Concevoir et optimiser des requêtes SQL complexes. Participer à la structuration des architectures Data en couches (staging, intermediate et marts). Intervenir sur des environnements Data Cloud tels que Snowflake, BigQuery, Redshift ou équivalent. Contribuer aux processus de versionning et d'intégration continue à l'aide de Git et des pipelines CI/CD. Collaborer avec les équipes Data existantes dans un environnement technique exigeant et structuré.
CONTEXTE & MISSION Au sein de la Fabrique Digitale d'un grand opérateur de transport, vous intégrerez l'équipe de la plateforme Data dédiée aux projets Data, BI, Big Data et IA du Groupe, dans un environnement Agile Scrum. PRINCIPALES MISSIONS - Assurer le MCO et les évolutions de la plateforme Data - Encadrer techniquement l'équipe DevOps - Développer et industrialiser les infrastructures Cloud - Améliorer les performances, la sécurité et la résilience de la plateforme - Mettre en oeuvre les bonnes pratiques DevOps, CI/CD et FinOps - Participer aux incidents N2/N3, aux choix d'architecture et à la roadmap technique - Accompagner les équipes et diffuser les bonnes pratiques COMPÉTENCES INDISPENSABLES - Certification AWS active (obligatoire) - Minimum 8 ans d'expérience sur Terraform (outil principal) - Minimum 6 ans d'expérience sur AWS (administration, déploiement et orchestration) - Minimum 2 ans d'expérience sur Databricks en production avec des flux industrialisés - Expérience significative en GitLab CI/CD et Infrastructure as Code - Mise en place d'outils de monitoring, d'alerting et de gestion des logs - Expérience en environnement Agile Scrum (minimum 1 an) - Participation à des astreintes et environnements à forte disponibilité COMPÉTENCES FORTEMENT APPRÉCIÉES - Datadog - FinOps (optimisation des coûts AWS, EC2, Savings Plans) - Okta - Power BI - Azure Synapse - ITIL ENVIRONNEMENT TECHNIQUE AWS - Terraform - Databricks - GitLab CI/CD - Okta - Power BI - Azure Synapse - Datadog - Jira - Confluence - Agile Scrum - ITIL
Basée à Lille, Lyon, Nantes, Grenoble, Marseille, Paris et Bruxelles, Insitoo Freelances est une société du groupe Insitoo, spécialisée dans le placement et le sourcing des Freelances IT et Métier. Depuis 2007, Insitoo Freelances a su s'imposer comme une référence en matière de freelancing par son expertise dans l'IT et ses valeurs de transparence et de proximité. Actuellement, afin de répondre aux besoins de nos clients, nous recherchons un Data Scientist H/F à Lille, France. Contexte : Afin de piloter au mieux son activité et d'accompagner les points de vente dans leur performance, un acteur majeur du secteur de la distribution renforce son équipe Data Métier, directement intégrée au sein du Département Performance (Contrôle de gestion). Les missions attendues par le Data Scientist H/F : Transformer les données en leviers d'actions concrets pour le réseau de magasins. L'intervenant travaillera au carrefour des enjeux financiers, commerciaux et supply chain, en concevant des modèles de Machine Learning et des algorithmes de recommandation directement actionnables par les équipes sur le terrain. En tant que Data Scientist, vous interviendrez sur des projets innovants, touchant à l'optimisation commerciale, au pricing et à la supply chain. Vos principaux défis seront les suivants : Maximisation du potentiel commercial : Détection des produits "pépites" (à fort potentiel) afin d'alerter les points de vente et de les aider à dynamiser leur offre en rayon. Prototypage de moteurs de préconisation de merchandising sur les produits complémentaires pour optimiser les podiums et les mises en avant (Têtes de Gondole - TG). Analyse et optimisation du merchandising : Cartographie et analyse des métrages linéaires des magasins. Croisement de ces données avec les ventes, la disponibilité et le stock pour comprendre et optimiser les performances des familles de produits. Optimisation de la rentabilité (Pricing & Supply) : Création d'algorithmes prédictifs pour alerter sur le potentiel d'un produit à devenir un "stock toxique" (dormant). Détection et alerte sur les remises locales à la main des points de vente qui s'avèrent destructrices de valeur. Benchmark et conformité : Établissement de modèles de clustering de magasins afin de créer des groupes de comparaison pertinents et d'aider les directeurs à se benchmarker.
Contexte: Dans le cadre du renforcement d'une équipe Data, nous recherchons un(e) Data Engineer confirmé(e) pour intervenir sur une plateforme Big Data dédiée à la collecte, au traitement et à l'exploitation de données à grande échelle. Vous intégrerez une équipe en charge de la mise à disposition de données fiables et exploitables pour les équipes Data et participerez activement à l'évolution d'une plateforme moderne reposant sur des architectures distribuées et des technologies Cloud Native. Vos missions: Concevoir, développer et maintenir des pipelines de traitement de données avec PySpark / Spark. Préparer, nettoyer et mettre à disposition des jeux de données destinés aux équipes Data. Développer des indicateurs de performance (KPI) et des tableaux de bord sous Tableau. Superviser et maintenir une plateforme Big Data fonctionnant sur Kubernetes / OpenShift. Diagnostiquer et résoudre les incidents techniques liés aux traitements de données et aux applications. Participer à l'évolution des traitements Spark et des datasets. Déployer et maintenir les applications via Helm. Administrer les composants de la plateforme (Airflow, MinIO, MySQL, JupyterHub, etc.). Gérer les environnements de déploiement continu avec GitLab. Participer à l'administration du Data Lake (stockage, utilisateurs, règles de gestion). Contribuer à l'amélioration continue des performances, de la sécurité et de la disponibilité de la plateforme. Environnement technique : Python PySpark Apache Spark Scala Pandas Hadoop / HDFS Tableau Software Kubernetes OpenShift Helm GitLab Docker Airflow MinIO MySQL Data Lake Parquet
Entité : Client TJM Max : 500 euros Date de démarrage : ASAP Date de fin : 31/03/2027 Mission : Gouvernance Data & usages Animation de l'organisation Data fédérée de multiples Districts métiers Acculturation Formation Dictionnarisation Qualité de données Le Global Data Office (GDO) est l'équipe centrale Data pour le client au sein de la Direction Data Stratégie, gouvernance, management. Contribuer à la construction de la stratégie Data de la Banque et sa trajectoire de mise en œuvre architecture Data Centric Acculturer et Former les collaborateurs métiers et IT dans une culture data-driven Constituer un « Book de cas d'usages Data et IA permettant d'illustrer la valeur dégagée pour l'entreprise Orchestrer le partage et le référencement de la donnée (Golden source, Data Market Place), Organiser les échanges entre producteurs et consommateurs de données, et préparer les arbitrages nécessaires Construire et proposer, avec les parties prenantes, un catalogue de solution à la pointe de l'innovation (Data visualisation, Data Management, Data Quality, Analytics et IA) Prendre en charge les reporting et préparation des comités Opérationnels et Stratégiques Support au projet BCBS de la banque Une expérience bancaire avérée est appréciable Expérience de gouvernance des données en environnement bancaire réglementaire : BCBS 239/RDARR, CDE, lineage réglementaire, remédiation d'audit Pratique réelle de Collibra (metamodel, asset types, operating model), idéalement en contexte CIB Capacité à produire des livrables normatifs : avis data, cadres de gouvernance, spécifications fonctionnelles
Titre : Data Engineer Java / Spark / GCP (H/F) — Secteur Aéronautique Localisation : Toulouse (31) — Hybride 3/2 Démarrage : Dès que possible Durée : Jusqu'au 31/12/2026 — Mission renouvelable TJM : Jusqu'à 440 € Description de la mission Dans le cadre du renforcement de l'équipe Data d'un acteur incontournable du transport aérien, nous recherchons un Data Engineer / Tech Lead expérimenté pour intervenir sur le Datalake du groupe. Vous rejoignez une squad de 6 personnes et contribuez à l'alimentation, l'enrichissement et l'évolution de la plateforme de données (couches load et refined). Compétences requises Java — niveau confirmé (30 % du poste) Apache Spark (30 %) GCP : Dataproc, Dataform, Google Cloud Storage, Terraform (30 %) BigQuery (10 %) Python : bonne maîtrise Méthodologie Agile Expérience attendue : 5 ans minimum en Data Engineering Profil Tech Lead apprécié Conditions Rythme : 3j présentiel Toulouse / 2j télétravail TJM max : 440 €/j Mission jusqu'au 31/12/2026, renouvelable
Rejoignez un acteur majeur du secteur des transports en commun pour piloter la montée en maturité de sa plateforme Data. Vous structurerez et industrialiserez les pratiques de gouvernance, qualité et gestion des métadonnées au cœur d'un environnement Data complexe mêlant Data Lake, solutions de catalogage et gouvernance transverse. Vous interviendrez sur l'ensemble du cycle de vie des données du Groupe, en garantissant conformité, traçabilité et valorisation des actifs Data. Ce rôle combine expertise fonctionnelle approfondie, maîtrise des enjeux de qualité et capacité à fédérer des stakeholders métiers et informatiques dans l'application de règles de gouvernance ambitieuses. L'environnement technique repose sur une stack moderne (Databricks, outils de catalogage, SI transverse) et une organisation Agile/Scrum. Vous évolurez aux côtés de Data Owners, équipes projets et responsables IT pour déployer une gouvernance Data robuste et durable. Responsabilités : - Piloter les activités de Data Management et de gouvernance sur les plateformes Data du Groupe - Garantir la qualité, la cohérence et la conformité des métadonnées et des référentiels de données - Administrer et faire évoluer les outils de catalogage, de classification et de gouvernance des données - Assurer le Data Lineage entre Databricks, solutions de catalogage et outils du SI - Accompagner les Data Owners et équipes projets dans l'application des règles et standards de gouvernance - Contribuer à la mise en œuvre du programme de qualité des données à l'échelle du Groupe - Piloter les activités Data multi-projets et assurer le suivi des mises en production - Valider la qualité documentaire et la conformité des livrables Data - Produire les reportings, tableaux de bord et indicateurs de gouvernance Data - Coordonner les dispositifs de gouvernance transverse et les Contrats de Confiance Data Télétravail : 2 jours par semaine Localisation : Paris
ContexteDans le cadre de l'évolution et de l'optimisation de sa plateforme décisionnelle, notre client recherche un Data Engineer SQL & GCP expérimenté afin de renforcer l'équipe en charge du Datawarehouse. Vous interviendrez sur des projets liés à la gestion, à la transformation et à l'optimisation des données, avec un fort enjeu de performance et de qualité des traitements dans un environnement Cloud Google. Vos missionsConcevoir, développer et maintenir les traitements d'alimentation du Datawarehouse. Développer et optimiser des requêtes SQL complexes sur Teradata et Google BigQuery. Concevoir et maintenir les flux ETL sous PowerCenter et/ou IDMC (Informatica Intelligent Data Management Cloud). Participer à la migration et à l'industrialisation des traitements vers Google Cloud Platform. Garantir la qualité, la performance et la fiabilité des traitements de données. Participer aux phases d'analyse, de conception technique et de recette. Assurer le suivi des traitements batch et résoudre les incidents. Collaborer avec les équipes Data, BI, Architecture et Métiers dans un environnement Agile. Environnement techniqueBases de données & SQL (60%)SQL avancé Teradata Google BigQuery ETL (20%)Informatica PowerCenter Informatica IDMC Outils & Cloud (20%)Google Cloud Platform (GCP) Control-M Jira Git (apprécié) Profil recherchéMinimum 5 ans d'expérience en Data Engineering. Excellente maîtrise de SQL, notamment sur de gros volumes de données. Expérience significative sur Teradata et/ou Google BigQuery. Bonne maîtrise des outils Informatica PowerCenter ou IDMC. Expérience dans un environnement Google Cloud Platform (GCP). Connaissance des ordonnanceurs (Control-M) appréciée. Expérience en environnement Agile. Autonomie, rigueur et esprit d'équipe. Compétences indispensablesSQL avancé Teradata Google BigQuery Informatica PowerCenter ou IDMC Google Cloud Platform (GCP) Datawarehouse Optimisation de requêtes SQL Les plusExpérience dans un contexte industriel ou aéronautique. Connaissance des problématiques de migration vers le Cloud. Maîtrise des outils de suivi de projet (Jira). Sensibilité aux bonnes pratiques Data et à la qualité des données.
Organisme de données en France echerche un Data Scientist capable d'intervenir de manière autonome et de travailler en proximité avec les équipes métiers. Le consultant sera amené à collaborer principalement avec les équipes basées à Lyon, tandis que la prestation sera réalisée sur le site à Montrouge. avoir-être: • Rigueur, reproductibilité, travail incrémental et versionné. • Autonomie technique et bonne réceptivité à l'encadrement (points réguliers avec le SSP Lab). • Capacité de restitution écrite et orale en français pour des publics à la fois technique et métier. • Sensibilité aux exigences de la statistique publique : secret statistique, confidentialité, non-exfiltration des données, transparence, reproductibilité, auditabilité des traitements. 3. Prestation attendue • Code source reproductible et documenté dans un dépôt git • Comparer plusieurs modèles et approches : comparaison des performances par type de variable et identification du ou des modèles les plus adaptés au besoin • Evaluation: 1) Concordance entre la sortie du modèle et le fichier de référence FIQUAL (fichier de contrôle qualité) par variable et 2) concordance sur les divergences modèle / FICOD (fichier du prestataire de production) et FIQUAL (fichier de contrôle qualité) / FICOD (fichier du prestataire de production). Métriques de concordance par classe de variable et analyse des types d'erreurs. Score de confiance par variable. • Pipeline produisant une sortie au format du fichier FIQUAL et une comparaison automatique avec le fichier FICOD • Documentation technique, note méthodologique assurant la passation/réappropriation interne par l'Insee.
Pour un client défense, nous recherchons 2 consultants data bilingues anglais de minimum 7 ans d'expérience. Contrôle élémentaire (FICE) à prévoir. PROFIL HABILITABLE OBLIGATOIRE La mission est à Malakoff, avec des déplacements à prévoir, notamment à Massy. Démarrage tout début septembre. Le programme termine le 31.07.2027. Le calendrier du process étant très serré, merci d'envoyer les profils jeudi au plus tard. Tâches : - Qlik Replicate: Replication tasks (Source: SAP, Destination: Snowflake) - Snowflake: Medallion structure (Bronze: Raw, Silver: Core, Gold: Published) - Matillion: Data transformation tasks between Snowflake layers - Other data tools (Alteryx, Tableau, SAP Business Objects): Alteryx flows reading snowflake to publish Alteryx yxdb and Tableau data sets SAP Business Objects / BW reports distributed directly to end users via email. Répartition estimée des tâches : - Snowflake: 50% - Qlik Replicate: 15% - Matillion: 25% - Other data tools: 10% Mandatory skills - Qlik, Snowflake,Matillion Desired - SAP BO Bonus - Alteryx, Tableau
Dans le cadre du renforcement d'une équipe Data, nous recherchons un Data Engineer Microsoft Fabric confirmé afin de participer à la conception, au développement et à l'industrialisation des traitements de données sur la plateforme Microsoft Fabric. Vous interviendrez sur l'ensemble de la chaîne de traitement des données, de l'ingestion à la mise à disposition, en garantissant la qualité, la performance et la fiabilité des pipelines. Vos missionsConcevoir, développer et maintenir des pipelines de données sous Microsoft Fabric. Développer les traitements de transformation de données en Python, PySpark et SQL. Concevoir et exploiter des architectures Lakehouse, Delta Lake et Data Warehouse. Paramétrer et configurer les différents composants de l'écosystème Microsoft Fabric. Garantir la qualité, la performance et la fiabilité des traitements de données. Automatiser les déploiements et contribuer à l'industrialisation des développements (CI/CD). Participer aux phases de tests, de recette et de mise en production. Assurer la maintenance évolutive et corrective des solutions Data. Collaborer avec les équipes Data, BI, Architecture et Métiers afin de répondre aux besoins fonctionnels et techniques. Participer à l'amélioration continue des bonnes pratiques de développement et de gouvernance des données.
Senior Data Product Manager – Analytics/BI Anglais 530 e par j Expérience senior en Product Management de produits Data Forte expertise Analytics / BI / dashboards Capable de construire une vision produit, roadmap et priorisation à partir des besoins métier Bonne compréhension des architectures et problématiques Data Engineering Environnement : SQL, Tableau, Databricks, dbt Expérience avec Data Analysts, BI Engineers, DataEngineers et Data Governance Bonne connaissance du retail / parcours consommateur Une expérience Supply Chain est recherchée IA / predictive analytics appréciés Agile, Jira, Confluence Capable d'échanger en Anglais Le contexte porte sur des produits Data liés aux nouveaux modèles économiques et à l'économie circulaire, notamment la location. Attention : pas un PM digital généraliste. Je cherche quelqu'un ayant réellement piloté des Data Products / Analytics solutions. TJM max : 530 e
Nous recherchons un(e) PMO Data Senior pour accompagner un programme de transformation Data à grande échelle au sein d'un grand groupe. Vous interviendrez sur le pilotage de la trajectoire Data, en coordination avec les équipes Gouvernance Data, Architecture Data et les équipes de delivery. Vos principales missions : Piloter la roadmap et les plannings des projets Data. Coordonner les différents acteurs (Data Partners, Architectes Data, équipes projets). Suivre les dépendances, les risques, les coûts et les engagements. Produire les reportings et synthèses pour le management. Garantir la cohérence des trajectoires Data entre les différents domaines. Accompagner les équipes dans un environnement Agile/SAFe.
A LIRE ATTENTIVEMENT AVANT DE POSTULER ⬇ 📑 CDI (38-45 K€) - 🏠 2 jours de télétravail / semaine - 📍 Nantes - 🛠 Expérience de 3 ans minimum Nous poursuivons notre développement et recherchons actuellement un.e Data Engineer pour accompagner l'un de nos clients, acteur majeur dans son domaine d'activité, dans l'exploitation et l'évolution de ses plateformes data. 💻💼 Votre rôle : Vous intégrerez une équipe data en charge de la valorisation et de l'exploitation des données. Vous participerez au développement et à l'évolution de solutions décisionnelles, depuis l'alimentation des données sur Hadoop jusqu'à leur restitution via des outils de Data Visualisation, afin de répondre aux besoins métiers et d'accompagner la prise de décision. Au quotidien, vos missions seront les suivantes : Recueillir, analyser et challenger les besoins métiers Concevoir et développer des solutions décisionnelles adaptées aux enjeux de l'entreprise Développer et maintenir les flux de données et traitements d'alimentation sur l'environnement Hadoop Concevoir et faire évoluer les tableaux de bord et reportings sous Tableau Garantir la qualité, la fiabilité et la cohérence des données Réaliser les tests et assurer la validation des développements Documenter les réalisations et les processus mis en œuvre Accompagner les utilisateurs dans la prise en main des solutions Assurer le support et le traitement des incidents de niveau 3 Participer à l'amélioration continue des outils et des pratiques de l'équipe Environnement technique : Hadoop (écosystème Big Data) Java Tableau
A LIRE ATTENTIVEMENT AVANT DE POSTULER ⬇ 📑 Portage / Freelance - 🏠 2.5 jours de télétravail / semaine - 📍 Nantes - 🛠 Expérience de 3 ans minimum Nous poursuivons notre développement et recherchons actuellement un.e Data Engineer pour accompagner l'un de nos clients, issu du bancaire, intervenant sur des applications critiques liées au risque de crédit. 💻💼 Contexte : Vous participerez au développement et à l'évolution d'un Datawarehouse central qui alimente les processus métiers et le reporting réglementaire. Votre rôle : Au quotidien, vos missions seront les suivantes : Analyser les besoins fonctionnels en lien avec les équipes métier Concevoir et développer les composants techniques Participer à la mise en place et à l'évolution des Datamarts Garantir la qualité, la fiabilité et la disponibilité des données Développer et maintenir les pipelines de traitement et d'intégration des données Réaliser les tests, les recettes et accompagner les mises en production Participer aux activités de maintenance corrective et évolutive ainsi qu'au RUN Contribuer à l'amélioration continue des pratiques de développement et de l'environnement technique Travailler au sein d'une équipe organisée en Agile (rituels, collaboration, amélioration continue) Environnement technique : Teradata SQL Linux / Shell Unix (ksh) Big Data / Datawarehouse / BI décisionnelle SAS IBM DB2 Mainframe (des connaissances sont un plus) Cloud (une première expérience est appréciée mais pourra être acquise durant la mission) Votre profil : Vous disposez d'au moins 3 ans d'expérience sur des projets Data, BI ou Big Data, et avez déjà travaillé avec Teradata (idéalement dans le cadre de migration) Une expérience sur des projets liés au secteur bancaire ou au risque de crédit serait un véritable atout, sans être indispensable.