Share this job
Vous aimez les plateformes de données qui tournent vraiment en production ? Rejoignez l'équipe qui fait vivre le datalake des fonctions Technologies & Opérations d'un grand groupe bancaire.
La DSI fournit aux directions technologiques, aux opérations et à la banque de proximité les applications et les données dont elles ont besoin au quotidien. Le datalake Hadoop en est une pièce centrale : il alimente le pilotage et les usages analytiques de plusieurs directions. Vous intervenez en lien direct avec la production applicative et l'équipe DevOps, au sein d'une équipe IT internationale.
Vos principales missions :
Concevoir et mettre en production de nouvelles ingestions de données : collecte, préparation, transformation.
Maintenir et faire évoluer les outils de gestion des pipelines de données (PySpark, shell scripting).
Porter auprès de l'équipe DevOps les évolutions nécessaires de la plateforme.
Rédiger des spécifications techniques claires et exploitables par l'équipe.
Ce que la mission vous apporte :
Un datalake en production, avec de vrais volumes et de vrais utilisateurs métier.
Une équipe internationale : l'anglais est utilisé au quotidien.
Une ouverture vers le cloud (GCP / BigQuery) pour qui veut élargir sa stack.
Environnement technique : Hadoop, PySpark, Spark, Hive, Python, SQL, Git, Jenkins, Jira, Unix / Linux — Scrum.
Candidate profile
Data Engineer de 3 à 6 ans d'expérience, à l'aise sur une plateforme Hadoop en production. Excellente maîtrise de Hadoop, du développement Python / PySpark et de Hive ; bonne connaissance de SQL, Git, Jenkins, Jira et du shell scripting Unix / Linux. Pratique de Scrum. Anglais courant, écrit et oral. Atouts : Indexima, Alteryx, Altair, GCP / BigQuery, bibliothèques Python orientées API.
Working environment
Mission en Île-de-France (Paris), avec télétravail partiel, au sein de la DSI d'un grand groupe bancaire. Équipe pluridisciplinaire, fonctionnement agile, interlocuteurs métier et techniques au quotidien.
Apply to this job!
Find your next career move from +8,000 jobs!
Manage your visibility
Salary, remote work... Define all the criteria that are important to you.
Get discovered
Recruiters come directly to look for their future hires in our CV library.
Join a community
Connect with like-minded tech and IT professionals on a daily basis through our forum.
Data Engineer Hadoop / PySpark — Datalake d'un grand groupe bancaire
CAT-AMANIA
