Find your next tech and IT Job or contract Big Data

What you need to know about Big Data

Big Data refers to the massive and complex data generated at high speed by various sources, such as social networks, IoT sensors, online transactions, or mobile applications. This data, often voluminous, heterogeneous, and continuously growing, exceeds the capabilities of traditional management and analysis tools. Big Data relies on the 3Vs: Volume (quantity of data), Velocity (speed of generation and processing), and Variety (diversity of formats, structured or not). It is often associated with a fourth V: Veracity (data reliability). Big Data technologies, such as Hadoop, Spark, or NoSQL, enable storing, processing, and analyzing this data to extract valuable insights. These analyses are used in various fields, such as personalized marketing, finance, healthcare, or industrial optimization. Big Data plays a key role in innovation, decision-making, and digital transformation of businesses.

Your search returns 72 results.
Permanent

Job VacancyPilote Opérationnel d'Infrastructure Big Data H/F

Experis France
Published on

35k-45k €
Cesson-Sévigné, Brittany
Pilote Opérationnel d'Infrastructure Big Data (POI) H/F - Rennes Rejoignez un environnement stratégique au cœur des infrastructures de donnéesDans le cadre du renforcement de ses équipes infrastructure, notre client recherche un Pilote Opérationnel d'Infrastructure (POI) spécialisé Big Data. Véritable coordinateur opérationnel, vous jouerez un rôle clé dans le pilotage des infrastructures Big Data et dans la gestion de la relation entre les différentes équipes techniques, les fournisseurs et les parties prenantes. Vous contribuerez activement à garantir la disponibilité, la performance et l'évolution des plateformes tout en assurant le respect des processus et des engagements de service. Vos missionsAu sein de la direction des infrastructures de données, vous êtes le garant du bon fonctionnement opérationnel des environnements Big Data. À ce titre, vous serez amené à : Assurer le pilotage opérationnel des infrastructures Big Data. Veiller à la disponibilité, à la performance et à la stabilité des plateformes. Assurer le suivi des processus ITIL : gestion des incidents, changements, problèmes et retours d'expérience. Participer et animer les comités de suivi opérationnels. Coordonner les différents acteurs internes et externes impliqués dans l'exploitation des services. Assurer le suivi des risques, des alertes et des plans d'actions associés. Piloter les fournisseurs et suivre les indicateurs de performance et de qualité de service. Contribuer à la définition et à la mise en œuvre de la roadmap technico-fonctionnelle. Participer aux projets d'évolution des infrastructures et à l'amélioration continue des services. Produire les reportings et les synthèses nécessaires à la prise de décision. Garantir une communication fluide entre les équipes techniques et les parties prenantes.
View this job
Contractor
Permanent

Job VacancyDéveloppeur Big Data Hadoop/PySpark/Python

Digistrat consulting
Published on
Apache Hive
Apache Spark
Hadoop

3 years
38k-43k €
300-400 €
Paris, France
🏭 Secteurs stratégiques : Banque d'investissement PAS DE FULL REMOTE NI SOUS TRAITANCE MERCI 🗓 Démarrage : ASAP 💡 Contexte /Objectifs : Le département a lancé un programme stratégique, qui comporte plusieurs projets d'harmonisation des processus et outils. L'un de ces streams a pour vocation de constituer un datalake sur une stack Hadoop, afin de servir les besoins en data et reporting. Ce datalake a également pour vocation de devenir la brique centrale de l'architecture du SI . Nous recherchons un profil Hadoop / PySpark qui sera en charge, en lien avec l'équipe de production applicative / devops, de mettre en œuvre techniquement les évolutions du datalake. Passionné par les données, capable de s'adapter à un environnement dynamique et en constante évolution, le prestataire doit faire preuve d'autonomie, d'initiative et d'une forte capacité d'analyse pour résoudre des problèmes complexes. 🤝Principales missions : Les tâches suivantes seront confiés au consultant : • Mettre en œuvre de nouvelles ingestions de données, data prep/transformation • Maintenir et faire évoluer nos outils de gestion des pipeline de données (Pyspark + shell scripting) • Adresser à l'équipe devops les demandes relatives aux évolutions de la plateforme • Eventuellement mettre en œuvre une couche d'APIs afin d'exposer nos données
View this job
Contractor

Contractor jobArchitecte Solution - Fonctionnel Data

CAT-AMANIA
Published on
Big Data

36 months
610-720 €
Hauts-de-Seine, France
Vous rejoindrez notre équipe en charge de la gouvernance, Usages Data et vous interviendrez en tant qu'Architecte fonctionnel / AMOA sur les projets de la phase de cadrage jusqu'au déploiement en production En étroite collaboration avec les urbanistes fonctionnels DATA, les Chefs de projets et les équipes de développements, la MOA et les métiers, vous serez en charge des missions suivantes : Accompagner la MOA et le métier durant les phases de cadrage des besoins Identifier et Instruire les demandes d'évolutions et/ou les nouveaux projets et s'assurer de la faisabilité de la solution proposée en coordination avec les chefs de projets, les éditeurs, les Ingénieurs Data et les experts solutions Concevoir et porter les solutions technico-fonctionnelles Réaliser la modélisation de données - Participer à la tenue à jour de la cartographie applicative du SI Décisionnel et opérationnel Participer à la définition de la trajectoire urbanistique du SI Décisionnel & opérationnel à court et moyen terme. Faire le lien avec les urbanistes Co-construire les spécifications fonctionnelles avec les ingénieurs Data - Accompagner l'équipe sur les aspects fonctionnels tout au long du projet Participer à la recette avec la MOA Apporter son expertise fonctionnelle lors de l'élaboration de la stratégie de test. Participer aux comités et communiquer sur les solutions data, les plannings, les chiffrages Contribuer à l'optimisation des processus, compléter les tableaux de suivis et mettre à jour les informations dans l'outil de suivi des projets et des budgets Communiquer auprès de l'équipe et de son manager l'état d'avancement des solutions, chiffrages, et plannings, remonter les alertes et les opportunités
View this job
Contractor

Contractor jobData Engineer Big Data / PySpark

DATAMED RESEARCH
Published on
Kubernetes

1 year
400-490 €
Ile-de-France, France
Contexte: Dans le cadre du renforcement d'une équipe Data, nous recherchons un(e) Data Engineer confirmé(e) pour intervenir sur une plateforme Big Data dédiée à la collecte, au traitement et à l'exploitation de données à grande échelle. Vous intégrerez une équipe en charge de la mise à disposition de données fiables et exploitables pour les équipes Data et participerez activement à l'évolution d'une plateforme moderne reposant sur des architectures distribuées et des technologies Cloud Native. Vos missions: Concevoir, développer et maintenir des pipelines de traitement de données avec PySpark / Spark. Préparer, nettoyer et mettre à disposition des jeux de données destinés aux équipes Data. Développer des indicateurs de performance (KPI) et des tableaux de bord sous Tableau. Superviser et maintenir une plateforme Big Data fonctionnant sur Kubernetes / OpenShift. Diagnostiquer et résoudre les incidents techniques liés aux traitements de données et aux applications. Participer à l'évolution des traitements Spark et des datasets. Déployer et maintenir les applications via Helm. Administrer les composants de la plateforme (Airflow, MinIO, MySQL, JupyterHub, etc.). Gérer les environnements de déploiement continu avec GitLab. Participer à l'administration du Data Lake (stockage, utilisateurs, règles de gestion). Contribuer à l'amélioration continue des performances, de la sécurité et de la disponibilité de la plateforme. Environnement technique : Python PySpark Apache Spark Scala Pandas Hadoop / HDFS Tableau Software Kubernetes OpenShift Helm GitLab Docker Airflow MinIO MySQL Data Lake Parquet
View this job
Contractor

Contractor jobData Engineer Senior Big Data & Cloud

ABSIS CONSEIL
Published on
Big Data

1 year
400-620 €
La Défense, Ile-de-France
Au sein d'une équipe Data & Digital, vous intervenez sur le développement et l'industrialisation de solutions Big Data à forte volumétrie dans un environnement exigeant et innovant. Vous contribuerez à la conception, au développement et à l'exploitation de plateformes Data reposant sur des technologies Cloud et Big Data. Vos missionsDévelopper des applications Data et des API REST en Java/Spring. Participer aux études de faisabilité et aux choix techniques. Concevoir et implémenter des traitements Big Data. Mettre en œuvre les bonnes pratiques de qualité logicielle (TDD/BDD). Automatiser les déploiements et contribuer à l'industrialisation des environnements. Optimiser les performances applicatives et la stabilité des plateformes. Accompagner les équipes métiers et participer au support des phases de tests. Assurer le maintien en conditions opérationnelles des solutions. Profil recherchéBac+5 École d'Ingénieur ou équivalent. Expérience significative en Data Engineering et environnements Big Data. Excellente maîtrise de Java. Solides compétences sur Spark et Hadoop. Expérience des environnements Cloud AWS et/ou Azure. Bonne maîtrise de Python et/ou Scala. Expérience des API REST et du framework Spring. Environnement techniqueJava Spring Boot Spark Hadoop HDFS Oozie Scala Python AWS Azure Shell Unix Git / GitHub Containers TDD / BDD
View this job
Permanent

Job VacancyIngénieur Exploitation Big Data – Hadoop / GCP / Kubernetes (H/F)

Craftman data
Published on
Ansible
BigQuery
ELK

40k-55k €
Ile-de-France, France
Rattaché à l'équipe Data, vous êtes garant du bon fonctionnement, de la fiabilité et de la performance de l'écosystème Big Data de l'entreprise. Vous intervenez sur une plateforme Hadoop hybride, articulée avec des services Cloud GCP et des environnements Kubernetes-as-a-Service. Exploitation et maintien en conditions opérationnelles Vous assurez le MCO de l'écosystème Hadoop et garantissez la disponibilité, la performance et la sécurité des clusters. Vous supervisez l'état de santé des composants (HDFS, Yarn, Hive, Spark, Oozie) et contribuez à la fiabilisation du socle technique en réduisant progressivement les points de fragilité identifiés. Gestion des incidents et support N2/N3 Vous prenez en charge les incidents, menez les analyses techniques, identifiez les causes racines (RCA) et proposez les plans d'actions correctifs. Vous assurez le suivi jusqu'à résolution complète et maintenez la documentation technique associée. Amélioration continue et automatisation Vous contribuez aux chantiers d'amélioration de la plateforme (performance, architecture, déploiements) et développez ou optimisez les scripts d'automatisation en Python, Shell ou Ansible. Vous participez aux évolutions de l'écosystème et aux projets de transformation Big Data. Environnement Cloud GCP Vous participez à l'exploitation et à l'évolution des services GCP liés au Big Data (BigQuery, Dataproc, Cloud Storage), contribuez aux migrations et interconnexions entre Hadoop et GCP, et assurez le monitoring, la gouvernance ainsi que l'optimisation des coûts Cloud. Plateformes KaaS Vous administrez et exploitez les environnements Kubernetes-as-a-Service (GKE, Anthos ou équivalent interne), déployez et maintenez les services Data et applicatifs associés, surveillez les clusters et gérez ressources, namespaces et montée en charge. Vous contribuez à la sécurisation et à la standardisation des déploiements.
View this job
Contractor

Contractor jobData ingénieur (H/F)

ALLEGIS GROUP
Published on
Apache Airflow
Big Data
DBT

12 months
Hauts-de-Seine, France
TEKsystems recherche pour l'un de ses clients grand compte un(e) Data ingénieur (H/F) Les tâches : Établir et sécuriser des connexions techniques robustes et évolutives avec les systèmes sources Corporate identifiés (ERP, Plateformes Financières, RH, ITSM etc.). Extraire et charger les données des domaines fonctionnels Corporate clés : finance, ressources humaines, référentiels, achats, etc. Concevoir et implémenter des pipelines d'ingestion automatisés fiables et performants, garantissant l'intégrité et la fraîcheur des données. Structurer et modéliser les données dans un entrepôt de données (Data Warehouse Snowflake) de manière logique, modulaire, réutilisable et optimisée pour l'analyse et la restitution. Mettre en place des mécanismes de gouvernance des données : gestion des métadonnées, logiques de rafraîchissement, suivi de la qualité des données et gestion des erreurs. Développer des vues et agrégats de données spécifiques aux besoins de restitution et d'analyse des différents départements Corporate. Documenter de manière exhaustive les pipelines d'ingestion, les modèles de données (logique et physique), les règles de transformation et les points de reprise pour assurer la maintenabilité et la transférabilité. Environnement technique Sources : Multiples systèmes Corporate (Systèmes Financiers, Plateformes Achats, Outils ITSM. - via APIs, exports ou connecteurs natifs). Destination : Snowflake(Data Warehouse Cloud). Orchestration : Airflow. Transformation : DBT Core / SQL, Python (Pandas/PySpark) ou équivalent. Modélisation : DrawIO, Lucidchart ou autre support outil libre. Visualisation / Restitution : Tableau. CI/CD / versioning : GitLab, GitHub. Documentation : Confluence, Jira, SharePoint.
View this job
Contractor

Contractor jobExpert Big Data Confirmé (Cloudera Data Platform)-(h/f)

emagine Consulting SARL
Published on

12 months
500-650 €
92400, France
Merci de contacter Sumi Delplanque. Nous recherchons un expert Big Data confirmé pour prendre en charge l'exploitation complète et la sécurisation d'un écosystème Cloudera Data Platform (CDP) en environnement de production, avec une architecture Lakehouse déjà en place. Le cœur du besoin : administration et MCO/MCS de Cloudera Nous avons besoin de quelqu'un qui assure : L'installation et l'administration du cluster avec TLS et Kerberos (donc un environnement sécurisé, pas un POC). MCO/MCS (Maintien en Conditions Opérationnelles/de Sécurité) des services cœur : HDFS, Yarn, Zookeeper, Cloudera Manager. Des morning checks quotidiens avec rédaction de rapports synthétisés : visibilité et traçabilité sur l'état de la plateforme, pas juste un "ça marche". Le périmètre technique : une architecture Lakehouse complète Nous requérons un profil capable de couvrir toute la chaîne de valeur de la donnée : Il assure le déploiement et le MCO/MCS de l'écosystème Cloudera (Cloudera manager, services Cloudera data platform : HDFS, Yarn, Zookeeper …). C'est un poste de généraliste expert plutôt que de spécialiste pointu sur un seul outil : nous voulons une personne qui parle à toute la stack, pas plusieurs experts séparés. Les compétences transverses attendues Automatisation : Ansible pour les configs, certificats, keystores. Réduction des interventions manuelles répétitives. Process de production : incidents, ticketing, ITIL (gestion des incidents, problèmes, changements). Opération dans un cadre structuré, probablement avec des SLA contractuels. Anglais technique : pour échanger directement avec l'éditeur Cloudera (support niveau 3, escalades). DevOps : Github, Jenkins pour le versionning et les packages. Linux avancé : analyse de logs pour le traitement d'incidents. Contribution active : force de proposition sur l'exploitabilité, participation aux comités et réunions d'équipe. Ce que ça signifie en synthèse : Nous avons besoin d'un administrateur systèmes expert Big Data qui combine trois casquettes : opérationnelle (exploitation quotidienne, incidents, SLA), technique transverse (toute la stack Lakehouse Cloudera) et amélioration continue (automatisation, proposition, reporting). C'est un poste clé pour la stabilité et la sécurité d'une plateforme de données critique en production. Lieu de travail : La Défense 2 jours de télétravail par semaine (full présentiel le 1er mois)
View this job
Permanent

Job Vacancy Développeur Big Data & Cloud (H/F) 

NSI France
Published on
Apache Spark
AWS Cloud
Azure

40k-55k €
Ile-de-France, France
Acteur majeur dans le domaine IT, depuis notre création en 1993, nous n'avons cessé de croître et d'évoluer. Avec une équipe dévouée de près de 1.400 collaborateurs répartis sur plusieurs sites en Belgique, au Luxembourg, en France et au Canada, NSI a suivi une trajectoire exceptionnelle. Notre entreprise est à la pointe de la révolution numérique, offrant une gamme complète de services IT, de l'analyse au développement de logiciels, en passant par l'architecture et la gouvernance IT. Votre rôle au sein de NSI Nous recherchons un(e) Développeur(se) Big Data & Cloud (H/F) afin d'intervenir au sein d'un grand acteur du secteur bancaire, sur le développement d'applications Big Data s'appuyant sur les API et l'automatisation. Descriptif des missions Vous rejoignez un centre de services partagés dédié aux solutions Digital et Data, qui accompagne les entités et filières du groupe dans la valorisation et l'accès agile aux données. Au sein de cette équipe, vous développez des solutions informatiques basées sur les technologies Big Data et les API, en validant la faisabilité technique des cas d'usage, en précisant leur intérêt métier et en définissant leur aspect opérationnel. Missions Développer des applications et des API REST avec le framework Spring Mettre en place et implémenter une stratégie de test (TDD/BDD) Assurer le déploiement automatisé des applications (containers) Réaliser le fine-tuning de la JVM afin d'optimiser et de garantir la stabilité des applications sous forte charge Développer sur les technologies Big Data (HDFS, Spark, Oozie) Intervenir sur les environnements Cloud (AWS, Azure) Rédiger la documentation nécessaire au partage et à la maintenance du code Assister les Business Analysts lors des tests fonctionnels et contribuer à l'aide au diagnostic Maintenir la production opérationnelle dans le respect des SLA
View this job
Permanent

Job VacancyData Engineer

█ █ █ ██ █ █
Published on
Big Data
Microsoft SQL Server
Python

Milton Keynes, England, United Kingdom

Imported from

Job from the tech market, identified automatically to give you a complete view of the opportunities.

Restricted access to the community

Join our platform to access the details of this job and get access to the best offers on the market.

View this job
Permanent

Job VacancySenior Data Engineer (Databricks)

█ █ █ ██ █ █
Published on
Apache Spark
Big Data
CI/CD

United Kingdom

Imported from

Job from the tech market, identified automatically to give you a complete view of the opportunities.

Restricted access to the community

Join our platform to access the details of this job and get access to the best offers on the market.

View this job

Contract roles and jobs for Big Data

Data Scientist

The Data Scientist uses Big Data tools and techniques to analyze large datasets, develop predictive models, and extract useful insights from complex data.

Data Developer (BI / Big Data / Data Engineer)

The Data Developer (Decision Support / BI / Big Data / Data Engineer) designs and develops Big Data solutions to store, process, and analyze large amounts of data from various sources.

Architecture Consultant

The Architecture Consultant advises businesses on Big Data architecture, designing solutions to manage and analyze large data quantities while optimizing performance and scalability.

Data Analyst

The Data Analyst uses Big Data techniques to collect, analyze, and interpret complex data to provide insights and recommendations that help businesses make informed decisions.

Connecting Tech-Talent

Free-Work, THE platform for all IT professionals.

Free-workers
Resources
About
Recruiters area
2026 © Free-Work / AGSI SAS
Follow us