Find your next tech and IT Job or contract PySpark

Your search returns 24 results.
Contractor
Permanent

Job VacancyData Analyst (H.F)

NSI France
Published on
Apache Spark
PySpark
Python

1 year
Ile-de-France, France
Acteur majeur dans le domaine IT, depuis notre création en 1993, nous n'avons cessé de croître et d'évoluer. Avec une équipe dévouée de près de 1.400 collaborateurs répartis sur plusieurs sites en Belgique, au Luxembourg, en France et au Canada, NSI a suivi une trajectoire exceptionnelle. Notre entreprise est à la pointe de la révolution numérique, offrant une gamme complète de services IT, de l'analyse au développement de logiciels, en passant par l'architecture et la gouvernance IT. Votre rôle au sein de NSI Nous recherchons un(e) Consultant(e) Data Analyst – Big Data H/F afin d'intervenir au sein d'un grand acteur du secteur des télécoms, sur le pilotage de la qualité de service de son réseau fixe. Descriptif des missions Au sein d'une cellule dédiée à la qualité de service, vous produisez des analyses à partir de datasets que vous constituez sur les données issues des plateformes Big Data du client. Vous avez également la responsabilité de rendre disponibles les données une fois celles-ci nettoyées, préparées et formatées, sous forme de datasets ou de tables mis à disposition des Data Scientists de l'équipe. Vous développez enfin des tableaux de bord de suivi des KPI. Missions Constituer des datasets à partir des données des plateformes Big Data Nettoyer, préparer et formater les données Mettre à disposition des Data Scientists des datasets et des tables exploitables Développer des tableaux de bord de suivi des KPI Produire des analyses commentées
View this job
Contractor

Contractor job273 - Data Engineer Senior Databricks / GCP

Nicholson SAS
Published on
Apache Spark
CI/CD
Databricks

6 months
430 €
Meudon, Ile-de-France
Rôle : Data Engineer Senior Databricks / GCP TJM : 430 € / jour Localisation : Meudon (3 jours par semaine sur site / 2 jours de télétravail) Date de début : ASAP Durée de la mission : Jusqu'au 31/12/2026 Contexte de la missionAu sein d'une équipe pluridisciplinaire (chefs de projet, architectes, DevOps, Data Engineers), vous interviendrez sur la conception et le développement de projets d'intégration de données à forte valeur ajoutée. Vos principales responsabilités incluent : Développement de jobs d'intégration de données en PySpark, Spark et Python (modes streaming et batch) sur la plateforme Databricks. Mise en œuvre du CI/CD (GitHub, DevOps, Databricks Asset Bundles), de l'orchestration, du data management et de la sécurité. Optimisation des jobs existants et des ressources Cloud (GCP et Databricks). Mise en place de Dashboards FinOps afin de suivre et piloter l'usage des ressources GCP / Databricks. Participation aux astreintes et au support en production de l'application. Assurer une formation continue, le partage de connaissances et la rédaction de la documentation technique. Compétences clés requisesDatabricks : Excellente maîtrise de l'administration, de la gestion des catalogues (Unity Catalog), de Delta Lake et de l'optimisation des performances. Technologies Data : Maîtrise approfondie de PySpark, Spark, Python, SQL et GIT. Cloud (GCP) : Bonne connaissance de l'écosystème Google Cloud Platform, notamment GCS, Pub/Sub, GKE et les outils d'Alerting. Qualités professionnellesEsprit d'équipe, curiosité intellectuelle et envie d'évoluer dans un environnement collaboratif. Excellente capacité à communiquer, à vulgariser et à partager vos connaissances avec les différents membres de l'équipe.
View this job
Contractor
Permanent

Job VacancyData Engineer / Data Ops

VISIAN
Published on
AWS Cloud
AWS CloudFormation
Azure

1 year
Paris, France
MissionsLe rôle vise à apporter l'expertise nécessaire pour soutenir les projets data et l'écosystème Databricks au sein du groupe. L'équipe met à disposition des environnements d'évaluation et de test, définit les standards et bonnes pratiques d'usage, et accompagne les entités ayant des besoins spécifiques sur des périodes dédiées. Les interlocuteurs sont principalement des Data Specialists et Data Citizens. Les environnements techniques s'appuient sur Databricks AWS et Azure. Les activités se structurent autour de trois axes : Data Engineering : développement et opérations data DevOps / DataOps : déploiement, automatisation, Infrastructure-as-Code, administration des plateformes Expertise : veille technologique, anticipation des évolutions, test et validation des nouvelles fonctionnalités Dans ce contexte, les responsabilités confiées sont les suivantes : Administrer, surveiller et maintenir les espaces de travail Databricks du COE. Élaborer, documenter et faire évoluer les standards, bonnes pratiques et blueprints groupe. Garantir la qualité et la conformité des services fournis aux entités. Accompagner les équipes métiers et data dans l'adoption de l'écosystème Databricks et leur transition vers les normes groupe. Tester, évaluer et recommander les nouvelles fonctionnalités de l'éditeur ou d'outils complémentaires pour améliorer l'expérience globale. Veiller au respect des politiques groupe et accompagner leur mise en œuvre. Contribuer à la conception et à la réalisation des use cases stratégiques portés par les entités.
View this job
Permanent

Job VacancyData Engineer

█ █ █ ██ █ █
Published on
Apache Airflow
SQL

Lille, Hauts-de-France

Imported from

Job from the tech market, identified automatically to give you a complete view of the opportunities.

Restricted access to the community

Join our platform to access the details of this job and get access to the best offers on the market.

View this job
Contractor

Contractor job267 - Data Engineer / Architecte Databricks (H/F)

Nicholson SAS
Published on
Apache Kafka
Azure DevOps
CI/CD

5 months
660 €
Paris, France
Date de démarrage : ASAP Date de fin : 31/10/2026 Localisation : Paris Tarif Journalier Moyen (TJM) Max : 660 € Descriptif de la MissionAu sein des équipes Data, vous interviendrez sur la conception, le développement, la gouvernance et l'optimisation de nos plateformes de données. Vos activités principales s'articuleront autour de quatre grands piliers : 1. Développement & Architecture DataConcevoir et développer des pipelines de données robustes et scalables sur Databricks (PySpark, Spark SQL, Delta Live Tables). Mettre en place des architectures Lakehouse basées sur Delta Lake. Industrialiser et orchestrer les workflows ETL/ELT à l'aide de Databricks Workflows. 2. Gestion et Administration de la Plateforme DatabricksAdministrer l'espace de travail (gestion des workspaces, configuration des clusters, gestion des permissions). Assurer l'optimisation des coûts (finops) via la configuration fine, l'autoscaling et le monitoring des clusters. Implémenter et faire respecter les bonnes pratiques de sécurité (Unity Catalog, gestion des accès, lineage de la donnée). 3. Gouvernance & Qualité des DonnéesMettre en place des mécanismes stricts de qualité et de validation des données (expectations, tests automatisés). Documenter rigoureusement les modèles et les flux sur la plateforme. Garantir la fiabilité, la cohérence et la fraîcheur des données mises à disposition. 4. Collaboration & SupportCollaborer étroitement avec les Data Analysts, Data Scientists et les équipes métiers. Accompagner et former les utilisateurs clés dans l'adoption et la prise en main de l'écosystème Databricks. Participer activement aux revues de code, à la standardisation et au partage des bonnes pratiques d'ingénierie. Compétences RequisesTechniques (Incontournables) :Développement : Excellente maîtrise de PySpark ou Spark SQL. Écosystème : Forte expérience pratique avec Databricks (pipelines, clusters, notebooks, Unity Catalog). Architecture : Solides connaissances des architectures Lakehouse, du data modeling, des concepts ETL/ELT et des stratégies d'ingestion (batch & streaming). Cloud : Connaissance approfondie d'au moins un des principaux fournisseurs cloud (Azure, AWS ou GCP). DevOps : Maîtrise de Git et des pratiques de CI/CD (Azure DevOps, GitHub Actions, etc.). Souhaitées (Un plus) :Connaissances en MLflow, orchestration de modèles et pratiques MLOps. Notions avancées en DataOps, cost optimization (FinOps) et outils de monitoring. Expérience dans l'exploitation d'APIs et l'ingestion de données en temps réel (ex: Kafka).
View this job
Permanent

Job VacancyData Engineer

█ █ █ ██ █ █
Published on
Apache Spark
CI/CD
Github

£70k-80k
London, England, United Kingdom

Imported from

Job from the tech market, identified automatically to give you a complete view of the opportunities.

Restricted access to the community

Join our platform to access the details of this job and get access to the best offers on the market.

View this job

Connecting Tech-Talent

Free-Work, THE platform for all IT professionals.

Free-workers
Resources
About
Recruiters area
2026 © Free-Work / AGSI SAS
Follow us