Trouvez votre prochaine offre d’emploi ou de mission freelance Big Data

Ce qu’il faut savoir sur Big Data

Big Data désigne l’ensemble des données massives et complexes générées à grande vitesse par des sources variées, comme les réseaux sociaux, les capteurs IoT, les transactions en ligne, ou encore les applications mobiles. Ces données, souvent volumineuses, hétérogènes et en croissance continue, dépassent les capacités des outils traditionnels de gestion et d’analyse. Le Big Data repose sur les 3V : Volume (quantité de données), Vélocité (vitesse de génération et de traitement), et Variété (diversité des formats, structurés ou non). Il est souvent associé à un quatrième V : Véracité (fiabilité des données). Les technologies de Big Data, comme Hadoop, Spark, ou NoSQL, permettent de stocker, traiter et analyser ces données pour extraire des insights précieux. Ces analyses sont utilisées dans des domaines variés, comme le marketing personnalisé, la finance, la santé, ou encore l’optimisation industrielle. Le Big Data joue un rôle clé dans l’innovation, la prise de décision et la transformation numérique des entreprises.

Votre recherche renvoie 1 621 résultats.
Freelance

Mission freelanceLead Data Engineer (H/F)

LeHibou
Publiée le
AWS Glue
Copilot
Databricks

12 mois
650 €
Colombes, Île-de-France
Notre client dans le secteur Énergie et ressources naturelles recherche un/une Lead Data Engineer (H/F) H/F Description de la mission : Fiche de poste — Lead Data Engineer (H/F) Contexte et objectif de la mission Dans le cadre d'un programme de replatforming B2C, une organisation internationale construit une Data Platform centralisée à l'échelle mondiale, aujourd'hui fragmentée. L'objectif est de mettre en place une plateforme cloud-native, data-centric et scalable, au service des équipes data de plusieurs géographies, notamment la France, la Belgique et l'Australie. Le Core Model du programme repose sur un modèle de données unifié couvrant notamment les données clients, contrats et facturation. Le Lead Data Engineer intervient comme référent technique de la data platform, avec une responsabilité complète sur l'architecture, le delivery et la qualité des données. Stack technique • Data Platform : Databricks (lakehouse), Amazon S3, Amazon Managed Apache Flink • Gouvernance des données : Unity Catalogue, Collibra • Visualisation : Power BI • Cloud : AWS • Streaming : Confluent Kafka • Langages : Python, SQL • IA & coding : GitHub Copilot, Claude Code, outils LLM • Collaboration : Jira, Confluence, SonarQube Missions principales Stratégie & Architecture Data • Définir l'architecture de la data platform greenfield (lakehouse, zones bronze/silver/gold, data contracts) • Co-construire le Core Data Model commun aux différentes géographies tout en intégrant les spécificités locales • Mettre en place la gouvernance des données, la qualité et l'observabilité • Répondre aux besoins analytiques et fonctionnels des équipes métier via une approche de type catalogue as a service Leadership & Delivery • Être le référent technique data du programme • Choisir les partenaires et structurer une feature team de 5 à 6 personnes • Assurer la responsabilité end-to-end des pipelines, de l'ingestion à la restitution • Gérer le monitoring, la performance et l'optimisation FinOps des workloads data • Mettre en place les pratiques DataOps : automatisation des tests, CI/CD data, infrastructure as code IA & Vélocité • Exploiter GitHub Copilot, Claude Code ou équivalents pour accélérer le développement des pipelines et modèles • Intégrer des cas d'usage IA/ML dans la data platform, incluant data science, feature store et jeux de données prêts pour les LLM • Automatiser la génération de code, les tests de qualité des données et la documentation • Conserver la maîtrise technique tout en augmentant la vélocité grâce à l'IA Spécificités de l'équipe Le périmètre comprend un chantier amont de migration de l'ensemble des données France vers l'écosystème Kaluza, dans le cadre d'un programme de replatforming B2C. Cette migration implique deux modules en amont : • Module d'éligibilité : définir les paramètres business pour les parcours clients/agents • Module ETL : récupérer et transformer les données provenant de nombreux systèmes d'information avant injection dans Kaluza Complexité forte de l'ETL : • Orchestration multi-sources • Micro-batch quotidien pendant plusieurs mois • Gestion d'un service managé AWS (Glue, Step Functions, S3, Lambda…) • Connexions API pour orchestrer les flux Compétences appréciées • Expérience Unity Catalogue et gouvernance des données à l'échelle • Connaissance de Confluent Kafka et du streaming • Familiarité avec Collibra ou équivalent • Expérience en data modelling dans un contexte B2C • Déploiements IA/ML en production, incluant MLflow, feature engineering et pipelines LLM • Expérience de contextes multi-pays ou de data platform cross-entités Compétences / Qualités indispensables : Databricks et architecture lakehouse, AWS data managé (Glue, Step Functions, S3), Python / PySpark / SQL, DataOps et CI/CD data, Leadership technique et delivery end-to-end, Usage d'outils IA de développement (GitHub Copilot) Compétences / Qualités qui seraient un + : Unity Catalogue et gouvernance des données à l'échelle, Confluent Kafka et streaming, Collibra, data modelling B2C, déploiements IA/ML en production, contextes multi-pays ou cross-entités Informations concernant le télétravail : Environ 3 jours par semaine, flexible selon l'autonomie
Voir cette offre
Freelance
CDI

Offre d'emploiExpert IA, Data Engineering et Web Sémantique

Signe +
Publiée le
Pandas
Python

1 an
La Motte-Servolex, Auvergne-Rhône-Alpes
Description de la mission Dans le cadre de l'accélération numérique et du développement des usages de l'intelligence artificielle, un acteur du secteur de l'énergie hydraulique recherche une expertise confirmée en IA, Data Engineering et Web Sémantique. Vous interviendrez au sein d'un centre d'ingénierie hydraulique engagé dans plusieurs initiatives stratégiques destinées à structurer et valoriser son patrimoine de données et de connaissances, afin d'accélérer le développement de nouveaux usages fondés sur l'IA. Les travaux portent notamment sur : La modélisation sémantique des données métiers à travers la conception de modèles d'objets métier. La construction et l'exploitation de graphes de connaissances et de vues encyclopédiques. L'utilisation de l'intelligence artificielle pour extraire des entités nommées dans des corpus documentaires et réaliser des alignements de données. Le développement de solutions d'IA générative et de recherche augmentée reposant sur des approches RAG textuelles ou GraphRAG. L'intégration de données provenant de sources hétérogènes, notamment des espaces documentaires, des bases de données, des documents techniques et des applications métiers. Vos principales responsabilités seront les suivantes : Contribuer à la construction d'ontologies et de modèles sémantiques métiers. Mettre en œuvre des traitements informatiques, avec ou sans intelligence artificielle, afin de créer les instances associées aux modèles. Intervenir sur différents cas d'usage métiers, tels que des référentiels électromécaniques, des études d'autonomie de barrage, la description d'événements redoutés centraux dans les études de dangers, ainsi que des référentiels de retour d'expérience projet. Développer, en collaboration avec les utilisateurs finaux, des solutions d'IA s'appuyant sur des techniques de RAG, de recherche sémantique et de LLM. Exploiter les infrastructures internes d'IA générative, les services de RAG et les environnements de développement conversationnel disponibles. Produire la documentation technique et fonctionnelle liée aux solutions réalisées. Participer aux choix d'architecture ainsi qu'à la définition et à l'application des bonnes pratiques Data, IA et DevOps. L'environnement technique comprend notamment : Python pandas rdflib RDF OWL SKOS SPARQL LLM RAG GraphRAG Git GitLab Power Platform et Copilot Studio en complément
Voir cette offre
Freelance

Mission freelanceData Analyst Métrologie Environnements de Travail – Chartres

Bifora
Publiée le
Azure Active Directory
SQL

6 mois
300-560 €
Chartres, Centre-Val de Loire
Nous recherchons pour le compte de notre client dans le domaine des systèmes d'information et de la gestion des environnements de travail, un(e) Data Analyst. Environnement technique : Bases de données SQL Active Directory Azure Cloud Microsoft Graph ServiceNow Outils de dataviz / tableaux de bord décisionnels Contexte : Intégré(e) à une squad fonctionnant en mode Agile, dédiée à la donnée et à la métrologie des environnements de travail, vous rejoignez une équipe chargée de produire des tableaux de bord, des rapports analytiques et un suivi des usages liés aux postes de travail et aux applications associées. L'enjeu principal consiste à valoriser la donnée disponible afin de mieux piloter l'usage et l'adoption des solutions mises à disposition des utilisateurs. Missions : Échanger avec les équipes internes et contribuer aux ateliers de recueil des besoins métier Traduire les enjeux métier en problématiques analytiques concrètes et exploitables Analyser et formaliser les cahiers des charges des rapports de métrologie à produire Collecter et croiser des données issues de sources variées (bases SQL, Active Directory, Azure Cloud, Microsoft Graph, ServiceNow, etc.) Concevoir et développer des tableaux de bord orientés aide à la décision Mener des analyses statistiques pour dégager tendances, usages et pistes d'optimisation Rédiger la documentation d'architecture technique associée aux cas d'usage traités Documenter les dashboards produits afin d'en faciliter la compréhension par les utilisateurs Accompagner les équipes métier dans l'appropriation des indicateurs, des méthodes de calcul et de la donnée restituée Compétences attendues : Data Analyst, SQL, Active Directory, Azure Cloud, Microsoft Graph, ServiceNow, tableaux de bord, dataviz, analyse statistique, métrologie, documentation technique, environnement poste de travail
Voir cette offre
Freelance

Mission freelanceData Engineer - Databricks

VISIAN
Publiée le
CI/CD
Databricks
Delta Lake

1 an
Paris, France
Positionné au sein de la DSI de l'entreprise, le Data Engineer intègrera l'équipe Conso Data qui traite les données de consommation des clients afin de les exposer sur les canaux digitaux. Il devra : - Être force de proposition et participer à la conception des solutions techniques en collaboration avec les membres de l'équipe. - Comprendre les enjeux métiers afin de concevoir des solutions répondant aux besoins fonctionnels. - Participer aux cérémonies Agile SAFe (PI Planning, macro-chiffrage, refinements, rétrospectives, etc.). - Concevoir et faire évoluer les architectures de données basées sur l'approche Databricks Medallion Architecture (Bronze, Silver, Gold). - Garantir la qualité, la fiabilité et la performance des traitements de données en production. (Jobs Databricks et APIs) - Contribuer à l'amélioration continue de la plateforme en proposant des optimisations techniques, des bonnes pratiques et des innovations. Il sera notamment amené à : - Concevoir, développer et maintenir des pipelines de données (ETL) pour les flux d'intégration et les flux métiers. - Mettre en œuvre et orchestrer les traitements de données à l'aide des outils Databricks. - Modéliser les données dans les tables Delta Lake en appliquant les bonnes pratiques de partitionnement, indexation, optimisation et gouvernance. - Optimiser les performances des traitements Databricks (Spark, Delta Lake, gestion des coûts et du temps d'exécution). - Assurer le développement, les tests et le déploiement des composants techniques via des processus CI/CD. - Concevoir, développer et maintenir des APIs permettant l'exposition et la consommation des données. - Mettre en place des mécanismes de contrôle qualité des données (Data Quality), de monitoring et d'alerting. - Identifier, analyser et résoudre les incidents de production tout en assurant le suivi des actions correctives. - Rédiger et maintenir la documentation technique des solutions mises en œuvre. - Accompagner les équipes dans l'adoption des bonnes pratiques Data Engineering Environnement Technique : - Python, SQL - Spark, PySpark, DBUtils - FastApi, Pytest - Databricks, Unity Catalog - Ariflow (migration vers Databricks Workflow) - AWS (Lambda, secrect manager, Bucket S3, ECS) - Git et gestion du versioning - Déploiement pipeline CI/CD
Voir cette offre
CDI

Offre d'emploiData Engineer GCP

Atlanse
Publiée le
Agile Scrum
Alteryx
Bash

50k-60k €
Île-de-France, France
En lien avec l'équipe de production applicative / DevOps, vous serez en charge de la mise en œuvre technique des demandes métier dans le cadre du projet DataOps. Vous interviendrez sur l'ingestion, la préparation et la transformation des données ainsi que sur l'évolution des pipelines au sein de l'environnement GCP. Votre rôle Ingestion et transformation des données · Mettre en œuvre de nouvelles ingestions de données dans Cloud Storage et BigQuery · Développer les traitements de préparation et de transformation des données · Développer et maintenir les traitements en Python et SQL, notamment avec Pandas et/ou Dask · Intervenir sur les traitements distribués s'appuyant sur Spark lorsque nécessaire Développement et évolution des pipelines · Maintenir et faire évoluer les outils de gestion des pipelines de données · Développer et maintenir les scripts Bash nécessaires à leur exécution · Assurer le suivi et l'ordonnancement des traitements avec les outils du périmètre, notamment Control-M · Analyser et résoudre les problématiques techniques liés aux traitements et aux pipelines Evolution de la plateforme Data · Identifier les besoins d'évolution de la plateforme liés aux traitements et pipelines de données · Rédiger les spécifications techniques nécessaires aux évolutions mises en œuvre · Formaliser et transmettre à l'équipe DevOps les demandes relatives aux évolutions de la plateforme ________
Voir cette offre
CDI

Offre d'emploiBig Data Scientist

Nexus Jobs Limited
Publiée le

£75k-90k
Manchester, Royaume-Uni
Big Data Scientist - Expert – Manchester Our Client an international organisation is looking to recruit a Big Data Expert with 7 to 10 years expertise as a Big Data Scientist. You will have Natural Language Processing (NLP) knowledge and experience and understand and analyse large data sets to discover new insights. Working in a multi-disciplinary team within a highly technical and complex environment. Well versed in scalable data mining and machine learning techniques (using computers to improve as well as develop algorithms)Kernel Methods, Deep Learning, Statistical Relational Learning, Ensemble Methods Model using advanced statistical/ mathematical models, predict and segment data to hypothesize/ evolve uses cases to monetize data and generate other business value. Translate business needs to technical requirements and implementation. Experience of Big Data technologies/Big Data Analytics. C++, Java, Python, Shell Script R, Matlab, SAS Enterprise Miner Elastic search and understanding of Hadoop ecosystem Experience working with large data sets, experience working with distributed computing tools like Map/Reduce, Hadoop, Hive, Pig etc. Advanced use of Excel spread sheets for analytical purposes An MSc or PhD in Data Science or an analytical subject (Physics, Mathematics, Computing) or other quantitative discipline would be handy. The position is based close to Manchester. The salary for this Big Data Scientist position will be circa £75K - £85K plus benefits. Please send your CV to us in Word format along with salary and availability details.
Voir cette offre
Freelance

Mission freelanceBig Data Analyst

Nexus Jobs Limited
Publiée le

£300-450
Grand Londres, Royaume-Uni
Big Data Scientist – Docklands London Our Client an international organisation is looking to recruit a Big Data Expert with 2 to 5 years expertise as a Big Data Scientist. You will have Natural Language Processing (NLP) knowledge and experience and understand and analyse large data sets to discover new insights. Working in a multi-disciplinary team within a highly technical and complex environment. Well versed in scalable data mining and machine learning techniques (using computers to improve as well as develop algorithms)Kernel Methods, Deep Learning, Statistical Relational Learning, Ensemble Methods Model using advanced statistical/ mathematical models, predict and segment data to hypothesize/ evolve uses cases to monetize data and generate other business value. Translate business needs to technical requirements and implementation. Experience of Big Data technologies/Big Data Analytics. C++, Java, Python, Shell Script R, Matlab, SAS Enterprise Miner Elastic search and understanding of Hadoop ecosystem Experience working with large data sets, experience working with distributed computing tools like Map/Reduce, Hadoop, Hive, Pig etc. Advanced use of Excel spread sheets for analytical purposes An MSc or PhD in Data Science or an analytical subject (Physics, Mathematics, Computing) or other quantitative discipline would be handy. The position is based in the Docklands London. This is a 3 to 6 month contract assignment. Please send your CV to us in Word format along with daily rate and availability details.
Voir cette offre
Freelance

Mission freelance345 - Data Architect Principal

Nicholson SAS
Publiée le
Data analysis
Méthode Agile
Teradata

4 mois
560 €
Lyon, Auvergne-Rhône-Alpes
Informations clés Localisation : Lyon (2 jours de télétravail par semaine) TJM max : 560 € Démarrage : ASAP Durée : Jusqu'au 31/12/2026 Contexte de la mission Nous recherchons un Data Architect Principal / Modélisateur de données pour rejoindre nos équipes et jouer un rôle clé dans le développement et la gestion d'un modèle de données logique et cohérent pour notre plateforme de données unifiée (UDP). Vous collaborerez avec des équipes pluridisciplinaires pour garantir que les modèles de données sont optimisés, précis et alignés sur les objectifs stratégiques d'une organisation orientée data-driven. Missions principales Évolution du modèle de données : Soutenir l'évolution du modèle de données du groupe (VGDM) pour l'UDP, en couvrant l'ensemble du cycle de vie du modèle, les périmètres fonctionnels et le backlog de développement global. Normes & Méthodologie : Établir les directives, processus et méthodes de travail (gestion des changements, best practices, modèles de référence « golden examples » et composants réutilisables) pour les équipes dédiées. Accompagnement Produit : Guider les équipes Data Product dans la conception et le développement des modèles logiques et physiques (LDM/PDM). Mapping & Intégration : Assurer la mise en correspondance rapide entre les concepts métier/sources et la structure basée sur le modèle mLDM de Teradata pour accélérer les livraisons ciblées. Gouvernance & Qualité : Appliquer des contrôles qualité rigoureux (co-création) sur les modifications apportées aux modèles tout en garantissant la cohérence globale avec le glossaire métier et les règles de gouvernance. Suivi d'impact : Mesurer l'adoption et l'impact opérationnel du modèle de données.
Voir cette offre

Les métiers et les missions en freelance pour Big Data

Data scientist

Le/ La Data scientist utilise des outils et des techniques Big Data pour analyser des ensembles de données massifs, développer des modèles prédictifs et extraire des informations utiles à partir de données complexes.

Développeur·euse data (décisionnel / BI / Big Data / Data engineer)

Le/ La Développeur·euse data (décisionnel / BI / Big Data / Data engineer) conçoit et développe des solutions Big Data pour stocker, traiter et analyser de grandes quantités de données provenant de diverses sources.

Consultant·e en architecture

Le/ La Consultant·e en architecture conseille les entreprises sur l'architecture Big Data, en concevant des solutions adaptées pour gérer et analyser de grandes quantités de données tout en optimisant la performance et la scalabilité.

Data analyst

Le / La Data Analyst utilise des techniques de Big Data pour collecter, analyser et interpréter des données complexes afin de fournir des insights et des recommandations qui aident les entreprises à prendre des décisions éclairées.

Au service des talents IT

Free-Work est une plateforme qui s'adresse à tous les professionnels des métiers de l'informatique.

Ses contenus et son jobboard IT sont mis à disposition 100% gratuitement pour les indépendants et les salariés du secteur.

Free-workers
Ressources
A propos
Espace recruteurs
2026 © Free-Work / AGSI SAS
Suivez-nous