
Partager cette offre
• Concevoir et implémenter des pipelines d'ingestion et de transformation de données (batch et temps réel), robustes et scalables.
• Développer et maintenir les flux ETL Talend qui alimentent le datalake et les systèmes consommateurs.
• Développer des traitements Python / PySpark sur Databricks et mettre en œuvre les modèles de données cibles.
• Automatiser les transformations, la documentation et les tests de données avec dbt.
• Configurer les pipelines d'acheminement des données, y compris les flux CDC.
• Mettre en place les bonnes pratiques de qualité de données, de monitoring, d'alerting et de logging.
• Développer des modules réutilisables (templates de pipelines, librairies communes, CI/CD) et exploiter les modules existants dans les nouveaux projets.
• Réaliser les développements et les tests associés, et accompagner les mises en production.
Profil recherché
• Solide maîtrise de l'ETL Talend (développement, debug, industrialisation) et connaissance du langage Java.
• Bonne maîtrise de Python et PySpark.
• Expérience significative sur Databricks (jobs, workflows, Delta Lake, notebooks, optimisation).
• Très bonne maîtrise de SQL (requêtes analytiques complexes, optimisation).
• Pratique de dbt pour les modèles analytiques.
• Connaissance des outils CDC (Change Data Capture) ; Qlik Replicate (ex-Attunity) est un plus.
• Connaissance des plateformes de streaming ; Kafka est un plus.
• Expérience DevOps : CI/CD, versioning Git, automatisation des tests et des déploiements.
• Pratique des outils d'IA générative pour accélérer le développement (génération assistée de code PySpark, Python et SQL, refactoring, tests), avec une revue critique et une compréhension fine du code mis en production.
Environnement de travail
Dans le cadre du renforcement de l'équipe Data, la mission vise à sécuriser la livraison des projets stratégiques et la mise en place de la nouvelle plateforme Databricks. Le consultant intégrera l'équipe IT Data en charge des spécifications, de la conception et de la réalisation des modules nécessaires à la mise en production dans le datalake), ainsi que des premiers cas d'usage Databricks. L'équipe travaille en mode agile, au plus près des métiers 3D et Business Development et en coordination avec les autres équipes IT. La mission se déroule dans un contexte anglophone : la maîtrise de l'anglais est obligatoire.
Postulez à cette offre !
Trouvez votre prochaine mission parmi +10 000 offres !
Fixez vos conditions
Rémunération, télétravail... Définissez tous les critères importants pour vous.
Faites-vous chasser
Les recruteurs viennent directement chercher leurs futurs talents dans notre CVthèque.
100% gratuit
Aucune commission prélevée sur votre mission freelance.
Data Engineer
Sijo
