Trouvez votre prochaine offre d’emploi ou de mission freelance Hadoop

Votre recherche renvoie 41 résultats.
Freelance
CDI

Offre d'emploiDirecteur de programmes IT/Data complexes

CAT-AMANIA
Publiée le
Cloudera
Teradata

1 an
40k-45k €
750-800 €
Paris, France
Je suis à la recherche d'un Directeur de programmes IT/Data complexes. Le client poursuit la centralisation et la modernisation du SI-RC. Le programme Plateformes Data & IA coordonne huit chantiers : BLEU/Microsoft Fabric, migration Teradata avant fin 2028, devenir Hadoop/Cloudera avant fin de support en juin 2027, trajectoire SAS, accès transitoire aux socles existants, plateforme Data On Premise souveraine, plateforme de services Data/IA et convergence ou migration du Cloud vers l'On Premise. Les patrimoines actuels comprennent notamment environ 52 To compressés sur Teradata et un Data Lake Hadoop/Cloudera d'environ 47 To. Les missions principales sont les suivantes : • Initialiser le programme : diagnostic du portefeuille, découpage, responsabilités, priorités, arbitrages et feuille de route pluriannuelle. • Piloter coûts, qualité, délais, risques, ressources, valeur, plannings, budgets, charges et dépendances interprojets. • Préparer les décisions et sécuriser les échéances Teradata (fin 2028), SAS (avril 2028) et Cloudera (juin 2027). • Appuyer les directeurs de projets internes sans se substituer à leurs responsabilités. • Éclairer les scénarios Cloud BLEU/Fabric, On Premise souverain, hybridation, convergence et réversibilité. • Garantir sécurité, conformité, souveraineté, indépendance numérique, standards ouverts et portabilité. • Tenir la cartographie consolidée des risques, organiser les revues de jalons et sécuriser le chemin critique. • Proposer et animer la comitologie stratégique, programme, opérationnelle et technique. Environnement technique : Teradata, Hadoop/Cloudera, SAS, Microsoft Fabric, Power BI, RAISE, GitHub Copilot, Microsoft 365 Copilot, ETL/ELT, Data Lake, Data Warehouse, Data Marts, API, événements, MLOps, agents, assistants IA, RPA, architectures Cloud / On Premise / hybrides, gouvernance et catalogue de données. Direction de programmes IT/Data complexes, multi-projets et multi-acteurs, avec budgets et échéances contraints Pilotage d'équipes importantes : ressources internes, éditeurs, intégrateurs, ESN et experts Architectures Data modernes Cloud, On Premise et hybrides Mise en œuvre de plateformes Data industrielles, gouvernées, sécurisées et exploitables Migration de plateformes décisionnelles/analytiques, données historiques, ETL/ELT, BI et data science Teradata, Hadoop/Cloudera, SAS, Microsoft Fabric, Power BI, gouvernance et catalogue Plateformes de services, API, événements, agents, assistants IA, MLOps et RPA Souveraineté, indépendance numérique, open source, portabilité, réversibilité, sécurité et RGPD
Voir cette offre
Freelance
CDI

Offre d'emploiIngénieur Data Spark/Scala H/F

Aleysia
Publiée le
Apache Spark
Big Data
Data Lake

1 an
40k-73k €
400-600 €
Nanterre, Île-de-France
Le contexteDans le cadre du maintien en conditions opérationnelles et de l'évolution d'un environnement Big Data / Datalake décisionnel, nous recherchons un(e) Ingénieur Data Spark/Scala – Gestion courante afin d'accompagner l'un de nos clients sur des enjeux de suivi d'exploitation, correction d'incidents et évolution de traitements Data. Quelques éléments pour mieux comprendre l'environnement : Secteur d'activité : Assurance 🛡️ Organisation : Équipe de Gestion Courante Décisionnel au sein de la Direction des Études Enjeux : Assurer le maintien de la qualité de service sur un périmètre applicatif décisionnel développé en Spark/Scala, en assurant le suivi des traitements, la résolution des incidents et la mise en œuvre des évolutions. Ce que tu feras concrètementDans le cadre de cette mission, tu seras notamment amené(e) à : ➞ Assurer le suivi quotidien des traitements en Spark/Scala ➞ Analyser et corriger les incidents fonctionnels, avec leurs éventuelles reprises de données ➞ Réaliser les évolutions confiées sur le périmètre ➞ Tester les corrections d'incidents et les développements réalisés ➞ Mettre à jour la documentation et assurer la mise en production des corrections et développements Ton environnementTechnologies : Spark, Scala, Hadoop, Hive, HDFS, YARN, Oozie, Parquet, Kafka, Spark Streaming, MongoDB, JSON, Avro Outils : Cloudera, Git Bases de données : Oracle
Voir cette offre
Freelance

Mission freelanceData Engineer Python Spark (H/F)

Insitoo Freelances
Publiée le
Apache Spark
Microsoft Power BI
Python

2 ans
500-550 €
Lyon, Auvergne-Rhône-Alpes
Les modalités Lieu : Lyon Télétravail : 50% Démarrage : 01/01/2027 Les missions attendues par le Data Engineer Python Spark (H/F) : Contexte Pour un acteur majeur du secteur de l'énergie, nous recherchons un Data Scientist / Développeur Big Data Senior pour rejoindre une équipe dédiée aux études et produits data innovants, notamment sur la maintenance prédictive et la mobilité électrique. Vous interviendrez en priorité sur des thématiques métiers complexes et sur la création d'un pipeline de mise à disposition de projets cartographiques à destination des équipes opérationnelles. La mission couvre l'intégralité de la chaîne de valeur, depuis l'analyse exploratoire et l'étude jusqu'à la mise en production des traitements de data science. Vos missions Animer des ateliers avec les experts métiers pour collecter, préciser et cadrer les besoins. Réaliser la recherche de données adéquates et mener des analyses exploratoires approfondies. Concevoir et développer des traitements de données et réaliser des études statistiques. Développer des modèles de Machine Learning selon les cas d'usage. Industrialiser les codes d'expérimentation en Python ou PySpark pour leur mise en production. Présenter les résultats et les synthétiser via des rapports d'étude ou des tableaux de bord interactifs. Assurer une veille technologique sur les outils de data science et partager les bonnes pratiques au sein de l'équipe. Environnement technique Python (pandas, polars, scikit-learn, matplotlib, xgboost, pandera, geopandas), PySpark, Hadoop, PostgreSQL, GitLab, GitLab-CI/CD, PowerBI, Jira, Confluence.
Voir cette offre
Freelance

Mission freelance266818/Data Engineer GCP

WorldWide People
Publiée le
Google Cloud Platform (GCP)

6 mois
400-420 €
Paris, France
Data Engineer GCPLe consultant idéal devra posséder les compétences suivantes : • Excellente maîtrise de la plateforme GCP, et autres outils de notre stack technique : BigQuery, cloud storage, SQL, Python orienté objet, Pandas et /ou Dask, bash scripting, GIT • Connaissances et expériences avec des outils complémentaires suivants seraient des atouts appréciables : Cloud functions, SAS, Alteryx, XLD/XLR, ControlM, Hadoop, Spark • Maîtrise de l'anglais, tant à l'écrit qu'à l'oral, pour faciliter les échanges avec nos interlocuteurs basés à Porto, qui représentent une part importante de notre équipe IT. • Expérience dans des environnements agiles, en particulier avec la méthodologie SCRUM. • Capacité à rédiger des spécifications techniques claires et précises. • Dynamisme, excellent relationnel et capacité à travailler en équipe. • Force de proposition et curiosité technique pour explorer de nouvelles solutions et technologies. Au sein du département IT de la DSI Groupe, l'équipe data a pour vocation de fournir aux différentes entités, l'ensemble des applications nécessaires à leur fonctionnement. Nous recherchons un profil Data Engineer GCP qui sera en charge, en lien avec l'équipe de production applicative / devops, de mettre en œuvre techniquement les demandes métier sur le projet DatOps. Passionné par le développement et le traitement des données, capable de s'adapter à un environnement dynamique et en constante évolution, le prestataire doit faire preuve d'autonomie, d'initiative et d'une forte capacité d'analyse pour résoudre des problèmes complexes. Les tâches suivantes seront confiées au consultant : • Mettre en œuvre de nouvelles ingestions de données, data prep/transformation • Maintenir et faire évoluer nos outils de gestion des pipelines de données => quel outil utilisé ?? • Adresser à l'équipe devops les demandes relatives aux évolutions de la plateforme Expected skillsSkillsSkill level HADOOP Confirmed SQL Confirmed GCP Confirmed Google Cloud Storage Advanced Spark Advanced BIGQUERY Confirmed Pandas Advanced GIT Advanced Python Advanced
Voir cette offre
Freelance

Mission freelanceDevOps / Intégrateur Data Senior - Python & PySpark (H/F)

Insitoo Freelances
Publiée le
Azure DevOps
Azure Kubernetes Service (AKS)
Kubernetes

2 ans
450-500 €
Lyon, Auvergne-Rhône-Alpes
Basée à Lille, Lyon, Nantes, Grenoble, Marseille, Paris et Bruxelles, Insitoo Freelances est une société du groupe Insitoo, spécialisée dans le placement et le sourcing des Freelances IT et Métier. Depuis 2007, Insitoo Freelances a su s'imposer comme une référence en matière de freelancing par son expertise dans l'IT et ses valeurs de transparence et de proximité. Actuellement, afin de répondre aux besoins de nos clients, nous recherchons un DevOps / Intégrateur Data Senior - Python & PySpark (H/F) à Lyon, France. Les missions attendues par le DevOps / Intégrateur Data Senior - Python & PySpark (H/F) : Vos missions : Construire et optimiser les pipelines CI/CD pour des applications web et des traitements Python / PySpark. Garantir le Maintien en Conditions Opérationnelles (MCO) et l'observabilité (logs, métriques) des produits. Maintenir et faire évoluer l'Infrastructure-as-Code. Administrer les environnements de dev, préprod, prod et les espaces "lab" dédiés aux Data Scientists. Gérer le traitement des vulnérabilités cyber et la montée en version des dépendances. Votre profil : Expérience : Au moins 5 ans en tant que DevOps, dont 2 ans minimum sur des projets Data Science / Machine Learning à fort volume. Stack technique : Kubernetes, Helm, Docker, GitLab CI/CD, Jenkins, Ansible, Python, PySpark, PostgreSQL, Kafka, Hadoop. Savoir-faire : Solides compétences en IaC, sécurité TLS, administration système/VM, réseaux et monitoring. Qualités : Autonomie, proactivité, rigueur et excellente communication pédagogique avec les équipes métiers et techniques. Les modalités : Lieu : Lyon Télétravail : 50 % Durée : Mission longue Démarrage : 1er janvier 2027
Voir cette offre
CDI
Freelance

Offre d'emploiData Engineer PySpark (H/F)

Signe +
Publiée le
PySpark

24 mois
45k-50k €
322-500 €
Paris, France
Nous recherchons un Data Engineer confirmé pour rejoindre l'équipe de la Direction des Systèmes d'Information au sein d'un grand groupe industriel. Vous serez responsable de la conception, du développement et de la maintenance d'un datalake stratégique, en travaillant étroitement avec les équipes de production applicative et DevOps pour mettre en œuvre des solutions de traitement de données robustes et performantes. Votre mission s'inscrit dans un environnement technologique moderne et agile. Vous participerez à l'évolution continue d'une plateforme données complexe, contribuerez à l'architecture des pipelines ETL et assurerez la qualité et la fiabilité des ingestions de données. L'environnement de travail est collaborative, dynamique et fondé sur les bonnes pratiques d'ingénierie logicielle (versioning, intégration continue, tests automatisés). Le datalake traite des volumes de données significatifs et nécessite une expertise technique pointue. Vous aurez l'occasion de travailler sur des sujets variés : conception de schémas de données, optimisation des performances, debugging en environnement distribué, et exploration de nouvelles technologies pour améliorer la stack existante. Responsabilités : - Mettre en œuvre et industrialiser de nouvelles ingestions de données, en respectant les standards de qualité et de performance du datalake - Concevoir et développer des transformations de données complexes en PySpark et Hive, optimisées pour les environnements Hadoop - Maintenir, documenter et faire évoluer les outils et scripts de gestion des pipelines de données (PySpark, shell scripting Unix/Linux) - Collaborer avec l'équipe DevOps pour l'évolution et l'optimisation de l'infrastructure de la plateforme données - Rédiger des spécifications techniques détaillées et participer à la validation des livrables avec les parties prenantes - Identifier et proposer des améliorations technologiques pour maintenir la compétitivité de la plateforme - Travailler en méthodologie Agile/Scrum, participer aux cérémonies d'équipe et contribuer à l'amélioration continue - Assurer le debugging et la résolution d'incidents en production, en coordination avec les équipes de support
Voir cette offre

Au service des talents IT

Free-Work est une plateforme qui s'adresse à tous les professionnels des métiers de l'informatique.

Ses contenus et son jobboard IT sont mis à disposition 100% gratuitement pour les indépendants et les salariés du secteur.

Free-workers
Ressources
A propos
Espace recruteurs
2026 © Free-Work / AGSI SAS
Suivez-nous