A LIRE ATTENTIVEMENT AVANT DE POSTULER ⬇ 📑 CDI (36-42K€) - 🏠 2.5 jours de télétravail / semaine - 📍 Nantes - 🛠 Expérience de 3 ans minimum Nous poursuivons notre développement et recherchons actuellement un.e Data Engineer pour accompagner l'un de nos clients, issu du bancaire, intervenant sur des applications critiques liées au risque de crédit. 💻💼 Contexte : Vous participerez au développement et à l'évolution d'un Datawarehouse central qui alimente les processus métiers et le reporting réglementaire. Votre rôle : Au quotidien, vos missions seront les suivantes : Analyser les besoins fonctionnels en lien avec les équipes métier Concevoir et développer les composants techniques Participer à la mise en place et à l'évolution des Datamarts Garantir la qualité, la fiabilité et la disponibilité des données Développer et maintenir les pipelines de traitement et d'intégration des données Réaliser les tests, les recettes et accompagner les mises en production Participer aux activités de maintenance corrective et évolutive ainsi qu'au RUN Contribuer à l'amélioration continue des pratiques de développement et de l'environnement technique Travailler au sein d'une équipe organisée en Agile (rituels, collaboration, amélioration continue) Environnement technique : Teradata SQL Linux / Shell Unix (ksh) Big Data / Datawarehouse / BI décisionnelle SAS IBM DB2 Mainframe (des connaissances sont un plus) Cloud (une première expérience est appréciée mais pourra être acquise durant la mission) Votre profil : Vous disposez d'au moins 3 ans d'expérience sur des projets Data, BI ou Big Data, et avez déjà travaillé avec Teradata (idéalement dans le cadre de migration) Une expérience sur des projets liés au secteur bancaire ou au risque de crédit serait un véritable atout, sans être indispensable.
Votre missionDans le cadre du développement de notre plateforme Data, nous recherchons un Data Engineer pour concevoir, développer et maintenir des pipelines de données performants dans un environnement Cloud AWS. Vous participerez notamment à : Développer et optimiser les traitements d'ingestion et de transformation de données avec Python, Spark et Databricks. Mettre en place les flux de données entre différentes sources et le Data Lake. Orchestrer et superviser les traitements avec Airflow. Garantir la qualité, la disponibilité et les performances des pipelines. Assurer le support, la correction des anomalies et l'amélioration continue de la plateforme. Participer aux choix techniques, aux ateliers projet et à la documentation.
Rejoignez une grande structure du secteur de la distribution et du retail, où la data et les capacités analytiques sont au cœur de la transformation stratégique du groupe. Vous intégrez l'Analytics Factory, un centre d'excellence directement rattaché à la direction générale, pilotant la modernisation des processus analytiques et IA au service de tous les métiers : marketing, marchandises, exploitation, e-commerce, supply chain et services financiers. Dans un environnement hautement concurrentiel où les marges sont réduites, la fiabilité des prévisions de chiffre d'affaires est critique pour optimiser les investissements commerciaux et opérationnels. Vous contribuez à la conception et l'industrialisation de pipelines de données robustes et d'une plateforme d'exploitation analytique intégrant des modèles de machine learning avancés, exploitant de nombreux inducteurs (historique des ventes, tendances marché, calendrier commercial). Ces solutions doivent être intuitives et maintenables par les équipes métier de la finance et les différents départements. Vous évoluerez dans une stack technologique moderne basée sur Python, SQL et une infrastructure cloud native. Le projet s'inscrit dans une démarche agile et de craftsmanship logiciel, avec un fort accent sur la qualité, l'observabilité et les bonnes pratiques de développement. Vous travaillerez en étroite collaboration avec une équipe pluridisciplinaire (data scientists, développeurs, business analysts) et participerez à toutes les phases du cycle de vie logiciel, de la conception à la production et au run opérationnel. Responsabilités : - Concevoir, développer et industrialiser des pipelines de données complexes en SQL et Python, traitant des volumes significatifs et respectant les standards d'une infrastructure cloud moderne - Développer et maintenir une webapplication Python permettant aux utilisateurs métier d'interagir avec les prévisions et les modèles analytiques - Assurer l'industrialisation et l'observabilité des modèles de machine learning en production, en mettant en place des mécanismes de monitoring, logging et alerting robustes - Mettre en œuvre les principes de qualité logicielle (SOLID, YAGNI, couverture de tests, code review systématique avec Sonar) et les bonnes pratiques de craftsmanship - Participer à l'architecture technique des solutions, notamment dans une approche microservices et event-driven, et contribuer aux décisions d'arbitrage technique et fonctionnel - Encadrer, mentorer et animer une équipe de développeurs, en favorisant l'apprentissage continu et l'amélioration des pratiques - Collaborer étroitement avec les équipes métier pour analyser les besoins, valider les solutions et identifier les axes d'amélioration - Assurer la maintenance, l'évolution et l'optimisation des applications existantes en production - Participer activement aux rituels agiles (dailys, refinements,...
A LIRE ATTENTIVEMENT AVANT DE POSTULER ⬇ 📑 CDI (38-45 K€) - 🏠 2 jours de télétravail / semaine - 📍 Nantes - 🛠 Expérience de 3 ans minimum Nous poursuivons notre développement et recherchons actuellement un.e Data Engineer pour accompagner l'un de nos clients, acteur majeur dans son domaine d'activité, dans l'exploitation et l'évolution de ses plateformes data. 💻💼 Votre rôle : Vous intégrerez une équipe data en charge de la valorisation et de l'exploitation des données. Vous participerez au développement et à l'évolution de solutions décisionnelles, depuis l'alimentation des données sur Hadoop jusqu'à leur restitution via des outils de Data Visualisation, afin de répondre aux besoins métiers et d'accompagner la prise de décision. Au quotidien, vos missions seront les suivantes : Recueillir, analyser et challenger les besoins métiers Concevoir et développer des solutions décisionnelles adaptées aux enjeux de l'entreprise Développer et maintenir les flux de données et traitements d'alimentation sur l'environnement Hadoop Concevoir et faire évoluer les tableaux de bord et reportings sous Tableau Garantir la qualité, la fiabilité et la cohérence des données Réaliser les tests et assurer la validation des développements Documenter les réalisations et les processus mis en œuvre Accompagner les utilisateurs dans la prise en main des solutions Assurer le support et le traitement des incidents de niveau 3 Participer à l'amélioration continue des outils et des pratiques de l'équipe Environnement technique : Hadoop (écosystème Big Data) Java Tableau
A LIRE ATTENTIVEMENT AVANT DE POSTULER ⬇ 📑 Freelance / Portage - 🏠 2 jours de télétravail / semaine - 📍 Nantes - 🛠 Expérience de 3 ans minimum Nous poursuivons notre développement et recherchons actuellement un.e Data Engineer pour accompagner l'un de nos clients, acteur majeur dans son domaine d'activité, dans l'exploitation et l'évolution de ses plateformes data. 💻💼 Votre rôle : Vous intégrerez une équipe data en charge de la valorisation et de l'exploitation des données. Vous participerez au développement et à l'évolution de solutions décisionnelles, depuis l'alimentation des données sur Hadoop jusqu'à leur restitution via des outils de Data Visualisation, afin de répondre aux besoins métiers et d'accompagner la prise de décision. Au quotidien, vos missions seront les suivantes : Recueillir, analyser et challenger les besoins métiers Concevoir et développer des solutions décisionnelles adaptées aux enjeux de l'entreprise Développer et maintenir les flux de données et traitements d'alimentation sur l'environnement Hadoop Concevoir et faire évoluer les tableaux de bord et reportings sous Tableau Garantir la qualité, la fiabilité et la cohérence des données Réaliser les tests et assurer la validation des développements Documenter les réalisations et les processus mis en œuvre Accompagner les utilisateurs dans la prise en main des solutions Assurer le support et le traitement des incidents de niveau 3 Participer à l'amélioration continue des outils et des pratiques de l'équipe Environnement technique : Hadoop (écosystème Big Data) Java Tableau
Nous recherchons un(e) data Engineer DBT Snowflake capable de trouver des solutions innovantes et robustes à l'ensemble des problématiques Data. Vous aurez la charge de : • Participer à la conception et réalisation d'une solution Data depuis l'acquisition jusqu'à l'exploitation de la donnée en accompagnant la réflexion des directions métiers • Identifier, collecter et intégrer les données nécessaires à la résolution de problématiques métier et opérationnelles • Garantir la qualité des données en mettant en place les outils de mesure et de suivi adéquats en appliquant les règles de Data Gouvernance et de Data Management • Transcrire des besoins métier en règles de gestion data • Industrialiser le déploiement de vos réalisations à travers l'implémentation de tests unitaires, d'intégration et de non-régression Référence de l'offre : o8jpoxea2p
Date de démarrage : ASAP Date de fin : 31/10/2026 Localisation : Paris Tarif Journalier Moyen (TJM) Max : 660 € Descriptif de la MissionAu sein des équipes Data, vous interviendrez sur la conception, le développement, la gouvernance et l'optimisation de nos plateformes de données. Vos activités principales s'articuleront autour de quatre grands piliers : 1. Développement & Architecture DataConcevoir et développer des pipelines de données robustes et scalables sur Databricks (PySpark, Spark SQL, Delta Live Tables). Mettre en place des architectures Lakehouse basées sur Delta Lake. Industrialiser et orchestrer les workflows ETL/ELT à l'aide de Databricks Workflows. 2. Gestion et Administration de la Plateforme DatabricksAdministrer l'espace de travail (gestion des workspaces, configuration des clusters, gestion des permissions). Assurer l'optimisation des coûts (finops) via la configuration fine, l'autoscaling et le monitoring des clusters. Implémenter et faire respecter les bonnes pratiques de sécurité (Unity Catalog, gestion des accès, lineage de la donnée). 3. Gouvernance & Qualité des DonnéesMettre en place des mécanismes stricts de qualité et de validation des données (expectations, tests automatisés). Documenter rigoureusement les modèles et les flux sur la plateforme. Garantir la fiabilité, la cohérence et la fraîcheur des données mises à disposition. 4. Collaboration & SupportCollaborer étroitement avec les Data Analysts, Data Scientists et les équipes métiers. Accompagner et former les utilisateurs clés dans l'adoption et la prise en main de l'écosystème Databricks. Participer activement aux revues de code, à la standardisation et au partage des bonnes pratiques d'ingénierie. Compétences RequisesTechniques (Incontournables) :Développement : Excellente maîtrise de PySpark ou Spark SQL. Écosystème : Forte expérience pratique avec Databricks (pipelines, clusters, notebooks, Unity Catalog). Architecture : Solides connaissances des architectures Lakehouse, du data modeling, des concepts ETL/ELT et des stratégies d'ingestion (batch & streaming). Cloud : Connaissance approfondie d'au moins un des principaux fournisseurs cloud (Azure, AWS ou GCP). DevOps : Maîtrise de Git et des pratiques de CI/CD (Azure DevOps, GitHub Actions, etc.). Souhaitées (Un plus) :Connaissances en MLflow, orchestration de modèles et pratiques MLOps. Notions avancées en DataOps, cost optimization (FinOps) et outils de monitoring. Expérience dans l'exploitation d'APIs et l'ingestion de données en temps réel (ex: Kafka).
Nous recherchons un Data Engineer orienté modélisation analytics (dbt) pour rejoindre la DSI d'un grand groupe international du secteur du luxe, au sein d'une équipe Data & Innovation. Vous interviendrez sur une plateforme data moderne avec de forts enjeux de performance, qualité de données et optimisation des coûts (FinOps) dans un environnement Snowflake. Responsabilités : Concevoir, développer et maintenir des modèles de données robustes avec dbt (modélisation analytics, structuration des couches, bonnes pratiques) Optimiser les performances des traitements (modèles incrémentaux, gestion des volumes, tuning des requêtes Snowflake) Intégrer une logique FinOps dans les développements : optimisation des coûts de calcul, gestion des warehouses, monitoring de la consommation Mettre en place une stratégie de tests data avancés (tests génériques et custom, intégrité référentielle) Contribuer à l'amélioration continue des pratiques DataOps (CI/CD, versionning, qualité, monitoring) Produire une documentation technique claire et exploitable (dbt docs, description des modèles) Participer au chiffrage des sujets en intégrant les enjeux de volumétrie, performance et coûts
Dans le cadre du développement de projets technologiques majeurs pour l'un des leaders industriels mondiaux, nous recherchons un(e) Data Engineer H/F spécialisé(e) ou fortement acculturé(e) aux problématiques d'Intelligence Artificielle. Intégré(e) au sein des équipes R&D / Data du site de Montbéliard, vous serez un maillon essentiel pour concevoir, structurer et industrialiser les pipelines de données nécessaires au déploiement de solutions basées sur l'IA (maintenance prédictive, optimisation des processus complexes, systèmes connectés...). Vos responsabilités au quotidien : Conception & Architecture : Modéliser, développer et optimiser les architectures de données (Batch et Real-time) pour soutenir les cas d'usage IA et Data Science. Pipelines ETL/ELT : Construire, industrialiser et maintenir des pipelines de données robustes, fiables et scalables. Collaboration IA : Travailler en étroite collaboration avec les Data Scientists pour intégrer des modèles de Machine Learning et d'IA au sein des flux de production. Qualité & Gouvernance : Garantir la qualité, la traçabilité, la sécurité et la disponibilité de la donnée pour les différents métiers du groupe. Performance : Monitorer et optimiser la performance des requêtes et des systèmes de stockage.
Data Engineer Senior (H/F) – Full RemoteDans le cadre d'un programme de transformation Data d'envergure internationale, nous recherchons un Data Engineer Senior pour intervenir sur la conception et le développement de solutions data modernes. Vos missionsConcevoir, développer et maintenir des pipelines de données robustes et évolutifs. Développer et optimiser les processus ETL/ELT. Participer à la conception et à l'évolution d'une plateforme Data Cloud. Modéliser les données et garantir leur qualité. Concevoir des jeux de données destinés aux équipes Analytics et Business Intelligence. Optimiser les performances des traitements et des requêtes. Collaborer avec les équipes Data, Architecture, Produit et Métiers dans un environnement Agile. Rédiger la documentation technique et appliquer les bonnes pratiques de développement. Stack techniqueSnowflake SQL avancé Python ETL / ELT Modélisation de données Data Warehouse Cloud (AWS, Azure ou GCP) Outils d'orchestration (Airflow ou équivalent) Git CI/CD APIs REST Data Quality & Data Governance Méthodologie Agile / Scrum Profil recherchéMinimum 8 ans d'expérience en tant que Data Engineer. Excellente maîtrise de SQL et Python. Expérience confirmée sur Snowflake. Bonne connaissance des architectures Data Cloud. Solides compétences en modélisation de données et en optimisation des performances. Capacité à évoluer dans un environnement international. Anglais professionnel impératif. ConditionsMission de 6 mois renouvelable. Démarrage : dès que possible. Télétravail : 100 % (fuseau horaire européen). Environnement technique moderne et projet à forte visibilité.
Depuis 2012, nous mettons notre expertise au service des secteurs de l'IT et l'Ingénierie pour accompagner nos clients dans des projets ambitieux et innovants. Notre force ? Un management de proximité qui valorise vos aspirations, des opportunités de carrière concrètes et un engagement sincère pour le bien-être et l'épanouissement de nos collaborateurs. Rejoignez-nous sur des projets à fort impact au sein d'une entreprise où chaque talent compte ! Avanista recrute ! Toujours en recherche de nouveaux talents, nous souhaiterions intégrer un Data Engineer Senior (H/F) au sein de nos équipes pour l'un de nos clients du secteur bancaire. Le contexte ? La transformation des SI de nos Clients vers des architectures modulaires, type micro-services, l'essor de nos infrastructures et l'évolution des technologies associées, ou encore l'automatisation accrue sur nos socles et applications, génèrent une quantité massive de données devenues très hétérogènes, dispersées et silotées (équipes applicatives et socles multiples et dispersées). Prenant en compte ce cadre, vos missions seront plus spécifiquement : Maîtriser l'ensemble des techniques et technologies composant la Data Platform Accompagner les besoins et projets sur la collecte, transformation, stockage et mise à disposition des données, provenant de sources diverses en adéquation avec la Data Platform Concevoir et mettre à disposition les outils et processus (CI/CD) permettant d'automatiser les pipelines d'ingestion de données prenant en compte les besoins de fréquences (batch, temps réel, …) Développer et déployer des mécanismes de contrôle qualité ainsi que des routines de vérification pour garantir l'intégrité et la fiabilité des données Vos missions ? Participer à la conception des solutions techniques et fonctionnelles Être en relation avec les équipes opérationnelles de l'entreprise pour prise en compte des flux de données Assurer le support technique et fonctionnel, notamment analyse et résolution des incidents ou problèmes Mettre en œuvre en mode DevOps (CI/CD) Automatiser les installations des socles techniques Rédiger les documents fonctionnels et techniques, d'exploitation, en veillant au respect des normes existantes Gérer les données de l'entreprise (flux : collecte, traitement, stockage et leur cycle de vie) L'environnement technique ? Base de données de type Sql/NoSql Kafka Dataiku Scripting Python/SQL/Java Suite Elastic Suite de type Data Lakehouse (Spark, MinIO, Stockage s3, Iceberg, Trino)