Share this job
Rejoignez-nous !
Nous recherchons un(e) Data Engineer Hadoop / PySpark pour intervenir sur une plateforme Data stratégique et contribuer aux évolutions d’un datalake.
Vous serez en charge de la mise en œuvre technique de nouvelles ingestions de données, des traitements de préparation et de transformation, ainsi que de la maintenance et de l’évolution des pipelines de données.
Vous travaillerez en étroite collaboration avec les équipes de production applicative et DevOps, dans un environnement Agile, dynamique et international.
Ce que vous ferez :
Mettre en œuvre de nouvelles ingestions de données au sein du datalake.
Développer les traitements de préparation et de transformation des données.
Maintenir et faire évoluer les pipelines de données en PySpark et shell scripting.
Développer et optimiser les traitements de données sur la plateforme Hadoop.
Exploiter Hive et SQL pour la manipulation, la transformation et l’analyse des données.
Collaborer avec l’équipe DevOps et lui adresser les demandes relatives aux évolutions de la plateforme.
Participer à l’intégration et au déploiement des évolutions via les outils de gestion de code source et d’intégration continue.
Rédiger des spécifications techniques claires et précises.
Analyser et résoudre des problématiques techniques complexes liées aux traitements et pipelines de données.
Contribuer à l’amélioration continue de la plateforme et être force de proposition sur les solutions et technologies à mettre en œuvre.
Votre positionnement vous permettra d’intervenir au cœur d’une plateforme Data stratégique, en interaction avec des équipes techniques multidisciplinaires et internationales.
Candidate profile
Ce que nous recherchons :
Formation : Bac+5 en informatique, Data Engineering, systèmes d’information ou équivalent.
Expérience : 3 à 6 ans d’expérience, avec une expérience significative en Data Engineering sur des environnements Hadoop et PySpark.
Compétences et expertises techniques :
Big Data : Excellente maîtrise de la plateforme Hadoop et de Hive.
Développement Data : Excellente maîtrise de Python et PySpark.
Bases de données et requêtage : Bonne maîtrise de SQL.
Systèmes et scripting : Shell scripting sous Unix/Linux.
CI/CD et gestion de code : Git et Jenkins.
Outils projet : Jira.
Méthodologies : Expérience des environnements Agile, notamment SCRUM.
Data & Cloud - un plus : connaissances d’Indexima, Alteryx, Altair, GCP / BigQuery et de bibliothèques Python orientées API.
Soft skills : Autonomie, esprit d’initiative, forte capacité d’analyse, dynamisme, curiosité technique, excellent relationnel, capacité à travailler en équipe et force de proposition.
Niveau d’anglais : Professionnel à l’écrit comme à l’oral, indispensable pour les échanges réguliers avec une partie de l’équipe IT basée au Portugal.
Un plus : Expérience sur des environnements Data complexes et évolutifs, ainsi qu’une pratique de technologies complémentaires telles qu’Indexima, Alteryx, Altair ou GCP / BigQuery.
Working environment
Pourquoi rejoindre Clostera ?
Une culture d’entreprise unique : innovation, expertise et proximité humaine.
Des projets variés et stimulants avec des clients grands groupes.
Un équilibre vie pro/vie perso : télétravail partiel.
Apply to this job!
Find your next career move from +8,000 jobs!
Manage your visibility
Salary, remote work... Define all the criteria that are important to you.
Get discovered
Recruiters come directly to look for their future hires in our CV library.
Join a community
Connect with like-minded tech and IT professionals on a daily basis through our forum.
Data Engineer Hadoop / PySpark - Plateforme Data (H/F)
Clostera
