Partager cette offre
Rejoignez-nous !
Nous recherchons un(e) Data Engineer Hadoop / PySpark pour intervenir sur une plateforme Data stratégique et contribuer aux évolutions d’un datalake.
Vous serez en charge de la mise en œuvre technique de nouvelles ingestions de données, des traitements de préparation et de transformation, ainsi que de la maintenance et de l’évolution des pipelines de données.
Vous travaillerez en étroite collaboration avec les équipes de production applicative et DevOps, dans un environnement Agile, dynamique et international.
Ce que vous ferez :
Mettre en œuvre de nouvelles ingestions de données au sein du datalake.
Développer les traitements de préparation et de transformation des données.
Maintenir et faire évoluer les pipelines de données en PySpark et shell scripting.
Développer et optimiser les traitements de données sur la plateforme Hadoop.
Exploiter Hive et SQL pour la manipulation, la transformation et l’analyse des données.
Collaborer avec l’équipe DevOps et lui adresser les demandes relatives aux évolutions de la plateforme.
Participer à l’intégration et au déploiement des évolutions via les outils de gestion de code source et d’intégration continue.
Rédiger des spécifications techniques claires et précises.
Analyser et résoudre des problématiques techniques complexes liées aux traitements et pipelines de données.
Contribuer à l’amélioration continue de la plateforme et être force de proposition sur les solutions et technologies à mettre en œuvre.
Votre positionnement vous permettra d’intervenir au cœur d’une plateforme Data stratégique, en interaction avec des équipes techniques multidisciplinaires et internationales.
Profil recherché
Ce que nous recherchons :
Formation : Bac+5 en informatique, Data Engineering, systèmes d’information ou équivalent.
Expérience : 3 à 6 ans d’expérience, avec une expérience significative en Data Engineering sur des environnements Hadoop et PySpark.
Compétences et expertises techniques :
Big Data : Excellente maîtrise de la plateforme Hadoop et de Hive.
Développement Data : Excellente maîtrise de Python et PySpark.
Bases de données et requêtage : Bonne maîtrise de SQL.
Systèmes et scripting : Shell scripting sous Unix/Linux.
CI/CD et gestion de code : Git et Jenkins.
Outils projet : Jira.
Méthodologies : Expérience des environnements Agile, notamment SCRUM.
Data & Cloud - un plus : connaissances d’Indexima, Alteryx, Altair, GCP / BigQuery et de bibliothèques Python orientées API.
Soft skills : Autonomie, esprit d’initiative, forte capacité d’analyse, dynamisme, curiosité technique, excellent relationnel, capacité à travailler en équipe et force de proposition.
Niveau d’anglais : Professionnel à l’écrit comme à l’oral, indispensable pour les échanges réguliers avec une partie de l’équipe IT basée au Portugal.
Un plus : Expérience sur des environnements Data complexes et évolutifs, ainsi qu’une pratique de technologies complémentaires telles qu’Indexima, Alteryx, Altair ou GCP / BigQuery.
Environnement de travail
Pourquoi rejoindre Clostera ?
Une culture d’entreprise unique : innovation, expertise et proximité humaine.
Des projets variés et stimulants avec des clients grands groupes.
Un équilibre vie pro/vie perso : télétravail partiel.
Postulez à cette offre !
Trouvez votre prochaine mission parmi +8 000 offres !
Fixez vos conditions
Rémunération, télétravail... Définissez tous les critères importants pour vous.
Faites-vous chasser
Les recruteurs viennent directement chercher leurs futurs talents dans notre CVthèque.
100% gratuit
Aucune commission prélevée sur votre mission freelance.
Data Engineer Hadoop / PySpark - Plateforme Data (H/F)
Clostera
