Dans le cadre d'un programme de transformation Data , nous recherchons un Data Engineers GCP confirmé pour participer à la migration complète d'un écosystème Data On-Premise vers Google Cloud Platform. L'objectif est de construire une architecture moderne et cloud-native, capable de traiter d'importants volumes de données tout en répondant à des enjeux de temps réel, de fraîcheur et de qualité des données. Missions * Concevoir et développer des pipelines de données batch et temps réel ; * Migrer les traitements On-Premise vers les services managés de GCP ; * Développer et optimiser les transformations ELT avec BigQuery et Dataform ; * Orchestrer les flux et traitements avec Cloud Composer ; * Déployer des composants serverless avec Cloud Run et Cloud Functions ; * Garantir la qualité, la disponibilité et la fraîcheur des données ; * Participer à l'industrialisation et à l'optimisation de la plateforme Data. Compétences recherchées * Expertise confirmée de Google Cloud Platform ; * Très bonne maîtrise de BigQuery, SQL et Dataform ; * Expérience significative sur Dataflow et Cloud Composer ; * Maîtrise de Cloud Run et Cloud Functions ; * Expérience des architectures Data temps réel ; * Bonne connaissance des problématiques de migration On-Premise vers le Cloud ; * Maîtrise des enjeux de qualité, d'observabilité et de performance des données. Profil attendu Data Engineer confirmé disposant d'une expérience solide sur des projets GCP en production, capable d'intervenir de manière autonome sur la conception, le développement et l'industrialisation de pipelines Data.
Notre client dans le secteur Agroalimentaire recherche un/une Data Engineer H/F Description de la mission : Pour renforcer son équipe en charge des sujets IA notre client recherche un freelance Data Engineer dans l'environnement GCP. Amont d'étude et structuration des données Cadrer les besoins métiers et les traduire en spécifications techniques data. Analyser et cartographier les sources de données (dont le legacy Teradata), concevoir les modèles de données et définir les règles de transformation et de qualité. Industrialisation Développer, déployer et maintenir les pipelines d'ingestion et de transformation vers le socle GCP / BigQuery. Industrialiser les solutions issues des POC : passage à l'échelle, optimisation des traitements, des performances et des coûts. Automatiser les déploiements (IaC, CI/CD) et assurer la supervision, la fiabilité et la sécurité des flux en production. Workflow, process et outillage Concevoir les workflows de bout en bout (chaînes de traitement, ordonnancement, procédures d'exploitation) et les interfaces d'échange avec les applications consommatrices. Contribuer aux standards et bonnes pratiques DataOps de la Data Factory, documenter et diffuser les compétences auprès des équipes. Langages & frameworks Python, SQL Cloud & data Google Cloud Platform (GCP), BigQuery, services d'ingestion GCP ETL / intégration Informatica, Teradata (existant / migration) Système Environnement Linux (shell scripting)
Contexte Notre client, acteur majeur du retail, recherche un Data Engineer Expert pour rejoindre son domaine Digital Data et intégrer une Squad Data en charge d'un périmètre fonctionnel. La mission s'inscrit dans le cadre de la création d'une nouvelle plateforme Data, ainsi que du développement, de l'optimisation et de la maintenance de solutions Data Analytics, avec une forte composante Google Cloud Platform. Missions - Participer aux rituels agiles de l'équipe ; - Recueillir, analyser, challenger et formaliser les besoins utilisateurs ; - Animer les échanges avec les interlocuteurs métiers et proposer des solutions adaptées ; - Traduire les besoins en spécifications fonctionnelles et techniques ; - Développer des solutions Data de bout en bout : alimentation, stockage, modélisation et restitution ; - Valider la qualité des développements de l'équipe ; - Améliorer et optimiser le patrimoine Data existant ; - Assurer le maintien en conditions opérationnelles et le RUN des solutions ; - Contribuer à la construction du nouveau socle et des services sur Google Cloud Platform ; - Accompagner les métiers sur les bonnes pratiques d'exploitation de la donnée. Responsabilités Data Le consultant sera garant de la qualité d'accès aux données et contribuera à leur bonne structuration et à leur exploitation. - Intégrer des données structurées et non structurées ; - Structurer et normaliser la donnée ; - Cartographier les données disponibles ; - Nettoyer et valider les données ; - Garantir la qualité des données alimentant le Data Lake ; - Créer, si nécessaire, des référentiels ; - Contribuer à la politique Data et au cycle de vie de la donnée. Environnement technique Compétences impératives - SQL - Expert - ETL - Expert Compétences importantes - CI/CD - GitHub - Terraform - Kafka BI / Restitution - Power BI - Looker Cloud - Google Cloud Platform - GCS - BigQuery Une expertise GCP / BigQuery est particulièrement intéressante pour le besoin.
Contexte Pour le compte d'un acteur du secteur du BTP, nous recherchons un(e) Développeur(se) Fullstack junior pour intervenir sur le développement et la mise en production de solutions digitales intégrant notamment des cas d'usage autour de l'intelligence artificielle. La mission s'inscrit dans un environnement 100 % Google Cloud Platform. Vos missionsVous interviendrez notamment sur : Le développement backend en Python ; Le développement d'interfaces web en React ; Le déploiement et la mise en production d'applications sur GCP ; L'utilisation de services serverless tels que Cloud Run et Cloud Functions ; La manipulation et l'exploitation de données via BigQuery et/ou PostgreSQL ; L'intégration de fonctionnalités et services liés à des cas d'usage IA. Environnement technique Python React Google Cloud Platform – GCP Cloud Run / Cloud Functions BigQuery PostgreSQL
L'équipe BCC assure la maintenance et le développement de la Base Connaissance Clients transverse. Cette base clients unique groupe vise à personnaliser la relation et améliorer la performance commerciale. Le produit Data est complexe en raison de la multiplicité des sources et de la forte volumétrie de données. L'équipe est en cours de transition vers un mode Agile Scrum et souhaite monter en capacité sur DBT. Missions : - Développer des évolutions fonctionnelles sur la Base Connaissance Clients - Traiter la dette technique de la solution - Développer avec DBT - Développer et maintenir les traitements SQL - Exploiter BigQuery dans les développements - Accompagner l'équipe dans sa montée en compétences sur DBT - Intervenir sur une base de données alimentée par de multiples sources - Prendre en compte les risques d'erreur liés à la multiplicité des sources - Traiter des volumes importants de données - Participer à la transition de l'équipe vers un mode Agile Scrum Profil attendu : Le profil recherché dispose d'une expérience confirmée en DBT et SQL, ainsi que d'une expérience confirmée sur BigQuery. Une expérience sur GCP est également attendue. La personne doit être présente ou proche du bassin niortais et accepter une présence temporaire de 2 jours sur site, avec une possible évolution vers 3 jours.
La chaîne data suit le parcours suivant : collecte et stockage dans Google Cloud Storage, orchestration des pipelines par DAG sous Airflow (on-premise et managé), transformation et nettoyage avec dbt, entreposage dans BigQuery, puis restitution dans Looker. L"nfrastructure est gérée en code avec Terraform et Terragrunt, et les développements passent par une CI Git. Objectifs et activités de la mission La mission consiste à concevoir, livrer et maintenir des tableaux de bord financiers et extra-financiers dans Looker, en lien direct avec les équipes métiers. 1. Cadrage des besoins Animer les ateliers avec les équipes métiers (investissement, finance, conformité, relations investisseurs). Formaliser les besoins en indicateurs, règles de calcul et maquettes. 2. Modélisation des données Définir le modèle de données adapté dans BigQuery, en cohérence avec les transformations dbt existantes. Concevoir la couche sémantique Looker en LookML (views, explores, models). 3. Développement des tableaux de bord Développer les dashboards et visualisations dans Looker. Contrôler la qualité et la cohérence des chiffres restitués avec les métiers. 4. Administration de Looker Contribuer à l'administration de l'instance : gestion des utilisateurs, des groupes et des droits d'accès. Appliquer les bonnes pratiques de versioning Git et de déploiement. 5. Maintien en conditions opérationnelles Garantir la continuité de production des tableaux de bord existants. Assurer la maintenance corrective et évolutive. Documenter les modèles, indicateurs et dashboards. Exemples de tableaux de bord et livrables attendus Les tableaux de bord couvrent le pilotage de l'activité et le suivi des fonds, par exemple : pilotage de l'activité de la société de gestion ; suivi des investissements et du portefeuille ; calcul et suivi des frais de gestion ; indicateurs extra-financiers (ESG, finance durable). Livrables attendus : modèles LookML versionnés et documentés ; tableaux de bord validés par les métiers ; documentation fonctionnelle (définition des indicateurs, règles de calcul) et technique ; suivi des évolutions et des incidents de production.
Rejoignez une grande enseigne du secteur de la distribution et du retail pour piloter la modernisation de son infrastructure data sur Google Cloud Platform. Vous participerez à la construction d'un socle data robuste et évolutif, en travaillant dans un environnement Agile et collaboratif. Vous intégrez une équipe dédiée à la transformation digitale et à l'optimisation des flux de données. Votre mission couvre l'ensemble du cycle de vie des données : de l'analyse des besoins métiers à la mise en production de solutions performantes et maintenables. Vous aurez l'opportunité de travailler avec des technologies cloud modernes et de contribuer à la gouvernance data de l'organisation. L'environnement technique s'appuie sur Google Cloud Platform (BigQuery, Dataflow, Pub/Sub et services connexes), une architecture orientée événementielle avec Kafka, et des outils de versioning (GitHub) pour la collaboration et l'intégration continue. Vous évoluerez dans une méthodologie Agile/Scrum, avec des sprints réguliers, des cérémonies structurées et une culture de continuous improvement. Responsabilités : - Concevoir et développer des pipelines de données fiables et scalables sur Google Cloud Platform et BigQuery - Modéliser les données en fonction des besoins métiers et des standards de gouvernance - Mettre en place et optimiser des solutions de stockage et de traitement des données - Participer aux cérémonies Agile (daily standup, planification, rétrospective, démo) - Analyser les besoins métiers en collaboration avec les stakeholders et l'équipe produit - Assurer le contrôle qualité des développements (tests, validation, documentation) - Maintenir et optimiser le patrimoine data existant - Accompagner les métiers dans l'adoption des bonnes pratiques data et la montée en compétence - Contribuer à la construction et l'évolution du socle data de l'organisation - Gérer la maintenance opérationnelle (RUN) des solutions en production Télétravail : 2 jours par semaine Localisation : Lille
Dans le cadre d'un projet stratégique au sein d'un acteur majeur du secteur automobile, vous rejoignez une équipe Data en charge de la prévision de la demande afin d'accompagner les métiers dans leurs prises de décision. Vos principales responsabilités seront les suivantes : Développer, améliorer et maintenir des modèles statistiques et de Machine Learning dédiés à la prévision de la demande. Construire des prévisions fiables à différentes granularités et sur plusieurs marchés. Automatiser les pipelines de préparation des données, de sélection des modèles et de génération des prévisions. Participer à l'industrialisation et à la mise en production des solutions Data Science développées. Réaliser des analyses de risques, de scénarios et des facteurs influençant la demande. Restituer les résultats et recommandations auprès des équipes métiers telles que la Supply Chain, la Production, les Ventes, le Marketing ou la Finance. Assurer une communication claire et adaptée auprès d'interlocuteurs techniques et non techniques. Environnement technique : Python SQL Dataiku GCP (Vertex AI / Agents Platform, BigQuery) Git Spotfire Le poste s'inscrit dans un environnement à forts volumes de données nécessitant des modèles robustes, fiables et industrialisables.
INGENIEUR DATA BI GENIO / SQL / BIG QUERY / TERADATA / GCP nous recherchons un Data Engineer entre 3 et 7 ans d'expérience qui aura la capacité de gérer à la fois les aspects MCO/TMA mais également la partie projets pour les différentes directions du groupe en collaboration avec le reste de l'équipe. À la suite d'une passation avec notre centre de service, il devra également être en mesure d'innover et d'améliorer les processus existants pour perfectionner l'efficience de l'équipe au quotidien dans ses différentes tâches. DESCRIPTION DE LA MISSION • Participe à l'analyse du besoin avec la supervision du PPO ou Manager et à la conception du modèle de données permettant de répondre aux enjeux. • Utilise l'analyse des données pour fournir des éléments significatifs et éclairer la conception/mise en œuvre des projets • Conçois, développe et maintien les pipelines de données pour l'acquisition, la transformation, le stockage et la mise à disposition des données. • Optimise les performances des développements pour assurer une disponibilité et une fiabilité maximale • Identifie et résout les goulots d'étranglement et les problèmes de performances dans les flux de données • Met en place des processus et des contrôles pour garantir la qualité des données • Conçoit et met en œuvre des systèmes d'alerte, de monitoring et de reprise automatique efficaces. • Réalise la recette technique et anime la recette fonctionnelle avec les utilisateurs • Rédaction des documents associés au projet (Spécification Fonctionnelles, Spécifications Techniques, Cahier de recette Technique, Document d'exploitation) • Être force de proposition sur l'amélioration de notre stack Data • Faire le reporting d'avancement des travaux • Support au déploiement • Assure la maintenance corrective ou évolutive • S'assure de la cohérence des livrables avec les règles et bonnes pratiques définies au sein de l'équipe ENVIRONNEMENT TECHNIQUE L'environnement Data dans le cadre de cette mission est actuellement constitué principalement d'une base de données Teradata (Cloud) ainsi qu'un environnement BigQuery. • Langages/Framework : SQL, BigQuery, Python, Java, Shell • Outils : OpenText GENIO, Talend • Base de données : Teradata, BigQuery, SQL Server, IBM DB2 PLANIFICATION ET LOCALISATION Démarrage ASAP / PARIS
Présentation du posteDans le cadre du développement de notre activité Data, nous recherchons un Data Analyst / Analytics Engineer pour intervenir sur des projets de transformation, de modélisation et de valorisation des données. Vous travaillerez à l'interface entre les équipes métiers, BI et Data Engineering afin de transformer les besoins opérationnels en modèles de données fiables, indicateurs pertinents et tableaux de bord exploitables. Vos missionsRecueillir et analyser les besoins des équipes métiers. Définir les indicateurs et les règles de gestion associées. Extraire, transformer et analyser les données avec SQL. Concevoir et maintenir des modèles de transformation avec dbt. Construire des modèles dimensionnels et des architectures en étoile. Développer et faire évoluer des rapports Power BI. Créer et optimiser des mesures et calculs DAX. Exploiter les données disponibles dans BigQuery. Mettre en place des contrôles de qualité et des tests de non-régression. Participer aux projets de migration et de modernisation des environnements décisionnels. Documenter les modèles, les traitements et les indicateurs. Restituer les analyses et formuler des recommandations auprès des métiers. Stack techniqueData Visualisation : Power BI Langages : SQL, DAX, Python Transformation : dbt Cloud : GCP, BigQuery Orchestration : Cloud Composer, Airflow Bases et outils décisionnels : SQL Server, PostgreSQL, SSIS Modélisation : modèles dimensionnels, modèles en étoile, Data Warehouse Qualité et déploiement : tests dbt, Git, CI/CD Data Science et IA : Vertex AI, RAG, LangChain, API OpenAI Compétences recherchéesTrès bonne maîtrise de SQL. Bonne connaissance de Power BI et DAX. Expérience opérationnelle avec dbt. Maîtrise de la modélisation dimensionnelle. Bonne compréhension d'une chaîne décisionnelle de bout en bout. Connaissance des principes de qualité, de fiabilisation et de gouvernance des données. Capacité à comprendre et formaliser les besoins métiers. Une première expérience sur GCP et BigQuery est appréciée. Une sensibilité aux sujets Data Science et IA générative constitue un plus.