RésuméNous sommes en recherche d'un profil confirmé avec de bonnes compétences en ingénierie des données (Big Data) pour intervenir sur des sujets en lien avec le périmètre marketing. Le prestataire interviendra au sein d'une équipe Big Data d'une quinzaine de personnes travaillant en mode projet agile. ResponsabilitésIl contribuera au Run quotidien et à l'évolutivité des applications métiers tels que : la segmentation client marketing le calcul d'indicateurs de téléphonie le datamart marketing et bien d'autres. Must HavesMaîtrise d'Apache Airflow. Maîtrise d'Apache Kafka. Expérience significative avec Hadoop. Solides compétences en SQL et optimisation des requêtes. Capacité à travailler avec des bases relationnelles et NoSQL. Connaissances en CI/CD et DevOps. Compétences en Scala. Expérience en utilisant Spark. Nice to HaveDes compétences sur le cloud Azure et la conception de Webservices REST seraient appréciées. De manière générale il doit pouvoir documenter ses travaux, présenter ses réalisations en adaptant son discours et interagir avec l'ensemble des acteurs projets, ceux de l'équipe, des autres équipes IT et métiers. Autres DétailsMissions longue (maximum 3 ans) Localisation : Hauts-de-Seine (92)
Le contexteDans le cadre du maintien en conditions opérationnelles et de l'évolution d'un environnement Big Data / Datalake décisionnel, nous recherchons un(e) Ingénieur Data Spark/Scala – Gestion courante afin d'accompagner l'un de nos clients sur des enjeux de suivi d'exploitation, correction d'incidents et évolution de traitements Data. Quelques éléments pour mieux comprendre l'environnement : Secteur d'activité : Assurance 🛡️ Organisation : Équipe de Gestion Courante Décisionnel au sein de la Direction des Études Enjeux : Assurer le maintien de la qualité de service sur un périmètre applicatif décisionnel développé en Spark/Scala, en assurant le suivi des traitements, la résolution des incidents et la mise en œuvre des évolutions. Ce que tu feras concrètementDans le cadre de cette mission, tu seras notamment amené(e) à : ➞ Assurer le suivi quotidien des traitements en Spark/Scala ➞ Analyser et corriger les incidents fonctionnels, avec leurs éventuelles reprises de données ➞ Réaliser les évolutions confiées sur le périmètre ➞ Tester les corrections d'incidents et les développements réalisés ➞ Mettre à jour la documentation et assurer la mise en production des corrections et développements Ton environnementTechnologies : Spark, Scala, Hadoop, Hive, HDFS, YARN, Oozie, Parquet, Kafka, Spark Streaming, MongoDB, JSON, Avro Outils : Cloudera, Git Bases de données : Oracle
Data Scientist and Python Software Developer - London We're looking to recruit a Data Scientist and Python Software Developer with data science skills to join a product team that is focused on building well engineered products. The products provide an intuitive way for retailers and suppliers to interact and consume 'big data' analytics to make better business decisions. This role would consist of working together with a team of statistical analysts, understanding their methodologies and algorithms, and turning them into production ready code written in Python. This role would also require occasional travel to Paris or Munich. Main skills: Excellent knowledge of Python and it's related data science libraries (scikit, pandas, etc) Prior experience of using Python to perform calculations and generate datasets Good statistical knowledge Excellent communication and decision making skills Exposure to working with REST API's Any of the following skills would be an added bonus: Has run code across Hadoop/MapReduce clusters Has code running in a production environment Used SAS before (or at least can decipher SAS code) Worked with very large data sets before (billions of records) Knowledge of SQL/NoSQL database Knowledge or experience in D3.js Experience acting as a mentor/trainer in Python This is 6 month assignment in London with travel to Paris and Munich. Please send your CV to us in Word format along with daily rate and availability.