Le contexteDans le cadre du maintien en conditions opérationnelles et de l'évolution d'un environnement Big Data / Datalake décisionnel, nous recherchons un(e) Ingénieur Data Spark/Scala – Gestion courante afin d'accompagner l'un de nos clients sur des enjeux de suivi d'exploitation, correction d'incidents et évolution de traitements Data. Quelques éléments pour mieux comprendre l'environnement : Secteur d'activité : Assurance 🛡️ Organisation : Équipe de Gestion Courante Décisionnel au sein de la Direction des Études Enjeux : Assurer le maintien de la qualité de service sur un périmètre applicatif décisionnel développé en Spark/Scala, en assurant le suivi des traitements, la résolution des incidents et la mise en œuvre des évolutions. Ce que tu feras concrètementDans le cadre de cette mission, tu seras notamment amené(e) à : ➞ Assurer le suivi quotidien des traitements en Spark/Scala ➞ Analyser et corriger les incidents fonctionnels, avec leurs éventuelles reprises de données ➞ Réaliser les évolutions confiées sur le périmètre ➞ Tester les corrections d'incidents et les développements réalisés ➞ Mettre à jour la documentation et assurer la mise en production des corrections et développements Ton environnementTechnologies : Spark, Scala, Hadoop, Hive, HDFS, YARN, Oozie, Parquet, Kafka, Spark Streaming, MongoDB, JSON, Avro Outils : Cloudera, Git Bases de données : Oracle
Dans le cadre du renforcement d'un Chapitre Data au sein d'un grand acteur du secteur bancaire, nous recherchons un.e Data Engineer expérimenté.e pour rejoindre une squad métier et intervenir sur la conception, le développement, l'industrialisation et l'exploitation de solutions Data. Votre rôle Intégré.e à une équipe Agile, vous travaillerez en collaboration avec les PO, BA, développeurs et architectes sur l'ensemble du cycle de vie des solutions Data. Vous serez notamment amené.e à : Participer à la définition et à l'évolution de l'architecture Data ; Analyser et affiner les besoins avec les PO et BA et les traduire en solutions techniques ; Concevoir et développer des pipelines de collecte, ingestion, transformation et stockage ; Développer des traitements Spark en batch et en streaming ; Automatiser l'ingestion et orchestrer les flux de données ; Intervenir dans des environnements Hadoop / Cloudera ; Concevoir et exécuter les tests unitaires et automatisés ; Industrialiser et déployer les développements sur les différents environnements ; Assurer le bon fonctionnement des solutions en production et participer à la gestion des incidents ; Mettre en place et optimiser le monitoring et l'observabilité ; Contribuer à l'amélioration continue de la qualité du code et des pratiques de développement ; Participer aux sujets de gouvernance, qualité, protection et traçabilité des données.
Dans le cadre du renforcement d'une équipe dédiée à l'innovation et à l'industrialisation de solutions d'Intelligence Artificielle, nous recherchons un(e) Data Engineer / Développeur Fullstack Python Junior souhaitant évoluer sur des sujets mêlant Data Engineering, IA Générative et développement logiciel. Vous intégrerez une équipe à taille humaine intervenant sur des projets déjà en production autour du traitement documentaire, du Machine Learning et de l'IA générative. Vous participerez notamment à : Développer des applications et pipelines de traitement de données en Python. Concevoir et maintenir des traitements distribués autour des technologies Big Data. Participer au développement d'outils intégrant des modèles d'IA générative. Contribuer à l'amélioration continue des chaînes CI/CD ainsi qu'à l'automatisation des tests. Développer des interfaces et outils facilitant l'exploitation des solutions IA. Collaborer étroitement avec les équipes Data Engineering, Data Science et les métiers afin de transformer rapidement les besoins en solutions opérationnelles. Participer à la mise en production et à l'industrialisation des développements.