SAS Data Engineer Our client is looking for SAS data engineers with experience of SAP Data services. Hands on skills required: - SAP Data Services - SAP business objects - PL/SLQ - ETL/ELT - Data modelling - Informatica The role requires two to three days in Milton Keynes on a weekly basis. The contract is inside IR35 and for 6 months initially. To be considered please send over your latest CV. LA International is an award-winning partner of choice for many of the world's most influential companies and government organisations. Holding Enhanced Government Security Accreditation, we are recognised as the European market leader in the delivery of Security Cleared talent to organisations that demand the very highest levels of security, compliance and assurance. A multiple award-winning organisation, having secured the prestigious Queens Award for Enterprise: International Trade over consecutive years. We are committed to fostering an inclusive, equitable and accessible workplace where everyone feels valued and supported. We welcome applications from all individuals, regardless of background or identity, and we encourage candidates who may not meet every listed requirement to still apply. If you require any adjustments or support during the recruitment process, please let us know and we will work with you to ensure a fair and accessible experience. Please Note: If a high volume of applications is received, only candidates shortlisted will be contacted.
Contexte Dans le cadre des activités Data de la R&D Michelin, nous recherchons un Data Engineer Référent au sein du domaine DOTI / BS / RD / Analytics. Le rôle consiste à construire, transformer et fiabiliser les données afin d'alimenter les produits numériques utilisés par la Recherche & Développement, tout en jouant un rôle de leader technique et coach auprès des autres Data Engineers. L'environnement est en Agile à l'échelle (SAFe), avec des équipes proches des métiers. Positionnement Équipe : Data – Domaine Analytics R&D Rôle : Data Engineer Référent (Leader technique) Collaboration avec : Tech Lead du domaine Feature Teams DORD Data Engineers Niveau attendu : Leader / Coach (IS3) Missions principalesData Engineering Concevoir et développer des pipelines de données : intégration transformation nettoyage Connecter les systèmes sources et structurer les flux de données Mettre à disposition des données exploitables pour les produits Data Développement & intégration Développer des traitements en : Python Talend DI ponctuellement Java Spring Boot Intégrer les développements dans les pipelines CI/CD Participer à la gestion des versions (GitLab) Qualité & tests Réaliser : tests unitaires automatisés tests de qualification Rédiger les plans de tests Garantir la qualité et la fiabilité des données Documentation Rédiger la documentation : technique fonctionnelle Formaliser les modèles de données et les flux Support & maintien en conditions opérationnelles Assurer le support niveau 3 sur les flux Data (DataLake D1) Analyser et corriger les incidents Participer à l'amélioration continue des traitements Référent technique & coaching Accompagner les Data Engineers : bonnes pratiques de développement qualité de code industrialisation Contribuer à la montée en compétences de l'équipe Participer à la diffusion des standards techniques
Mission : La Digital Factory conçoit des services digitaux pour les activités commerciales et la valorisation des données de mon client. Elle simplifi e et automatise les processus (assortiment, promotions, prix, marketing). Ses équipes développent des solutions pour améliorer l'efficacité, l'expérience client et générer des insights à forte valeur. Dans le but de gérer l'agencement des produits sur les meubles des rayons pour chaque magasin, nous avons besoin de collecter, transformer/enrichir et exposer les données à un partenaire
La Digital Factory conçoit des services digitaux pour les activités commerciales et la valorisation des données de mon client. Elle simplifi e et automatise les processus (assortiment, promotions, prix, marketing). Ses équipes développent des solutions pour améliorer l'effi cacité, l'expérience client et générer des insights à forte valeur. Dans le but de générer automatiquement des planogrammes personnalisés pour chaque magasin, nous avons besoin de collecter, transformer/enrichir et exposer des données à un partenaire.
Dans le cadre du renforcement d'une équipe Data européenne, nous recherchons un(e) Data Engineer Senior pour concevoir, développer et maintenir des plateformes et produits de données évolutifs, destinés à répondre aux besoins métiers en matière de pilotage, de reporting et d'analyse. Vous interviendrez sur l'ensemble de la chaîne de valeur Data, de l'ingestion des données jusqu'à leur mise à disposition pour les équipes métiers et BI. Vos principales responsabilitésArchitecture & Plateforme Data Concevoir et mettre en œuvre des architectures de données robustes et évolutives (Raw / Curated / Consumption). Développer des solutions alignées avec les standards d'architecture Data modernes. Garantir la maintenabilité, la réutilisabilité et la scalabilité des développements. Data Engineering Concevoir, développer et optimiser des pipelines ETL/ELT. Mettre en place des traitements de données performants et industrialisés. Développer des modèles de transformation avec dbt. Orchestrer les traitements via Apache Airflow. Modélisation des données Concevoir des modèles dimensionnels (Star Schema, Data Marts). Produire des jeux de données fiables et prêts à l'exploitation (KPI-ready datasets). Qualité, Gouvernance & Sécurité Garantir la qualité, la fiabilité et l'intégrité des données. Mettre en œuvre les règles de gouvernance, de sécurité et de gestion des accès (RBAC). Participer à la documentation du lineage et des standards de développement. Performance & Industrialisation Optimiser les performances des pipelines et des traitements Snowflake. Améliorer les coûts d'exécution et de stockage. Mettre en place le monitoring, la supervision et les alertes. Collaboration Collaborer avec les équipes métiers, les Business Analysts, Product Owners et équipes BI. Participer aux ateliers fonctionnels et techniques. Assurer le transfert de connaissances et la documentation des solutions. Environnement techniqueSnowflake AWS dbt Apache Airflow SQL Git CI/CD Jira Confluence Lucid
• Analyse et cadrage Recueillir et analyser les besoins métiers. Formaliser les US en spécifications techniques exploitables. • Pilotage technique Assurer un pilotage intermédiaire sur un périmètre projet (coordination technique, suivi d'avancement). Contribuer aux choix techniques structurants. • Développement et expertise Réaliser des développements complexes. Assurer la maintenance applicative (Gestion des obsolescence et vulnérabilités) Apporter un support technique aux équipes sur les composants critiques. • Contribution agile Participer à l'élaboration et à la priorisation du backlog avec les PO et BA. Animer et contribuer aux rituels techniques (code reviews, challenger les estimations de charge etc.) • Architecture et standards Concevoir et mettre en oeuvre l'architecture applicative et technique. Veiller au respect des normes, bonnes pratiques et standards Groupe. • Qualité et documentation Garantir la qualité des livrables (revues de code, bonnes pratiques). Assurer la production et la maintenance de la documentation projet. • RUN Planification des activités, gestion du calendrier de l'équipe et priorisation des actions Assurer le suivi d'exploitation des traitements PySpark en production : supervision, résolution des incidents, analyse des performances et amélioration continue des traitements Maîtrise avancée des environnements de conteneurisation et d'orchestration, notamment Kubernetes et Docker, ainsi que de la gestion sécurisée des secrets avec HashiCorp Vault Maîtrise avancée des traitements Big Data, incluant PySpark 3 ainsi que la manipulation de formats de données distribués (Parquet, gestion des buckets). Maîtrise opérationnelle de l'orchestration de workflows de données à l'aide de l'outil Apache Airflow. Maîtrise confirmée des bases de données relationnelles, particulièrement PostgreSQL. Maîtrise des outils de gestion de code et de qualité logicielle, incluant GitLab, Fortify et SonarQube. Maîtrise des outils de stockage objet, notamment via l'utilisation des commandes MinIO. Maîtrise des outils de transfert de fichiers, en particulier CFT (Cross File Transfer). Pour l'ensemble du projet de titrisation Bail : • Dossiers d'architecture (schémas, principes techniques, choix structurants). • Backlog enrichi et priorisé en lien avec les parties prenantes. • Composants applicatifs développés, testés et documentés. • Comptes rendus des revues de code et plan d'amélioration continue. • Documentation projet à jour (Spécifications techniques, JIRA, Page Confluence, Runbook). • Reporting d'avancement sur le périmètre confié. • RUN : Reporting de type Morning check
Nous recherchons un Data Engineer confirmé ou senior pour intervenir sur une plateforme data moderne reposant sur Snowflake et dbt, avec une forte exigence en modélisation Data Vault. Contexte de la mission : Vous rejoindrez une équipe Data en charge de structurer et faire évoluer une architecture analytique robuste et scalable. La mission s'inscrit dans une logique d'industrialisation, de qualité et de standardisation des flux. Missions principales Concevoir et implémenter des modèles Data Vault (obligatoire). Développer et optimiser les transformations via dbt. Modéliser et structurer les données dans Snowflake. Participer à la définition des standards d'architecture et des bonnes pratiques. Assurer la qualité, la performance et la traçabilité des données. Collaborer avec les équipes BI (notamment Power BI) et métiers.
SAS Data Engineer - SC Cleared We are looking for a SAS data engineer. You will have experience of developing, maintaining, and optimizing data pipelines using SAS (SAS Enterprise Guide, and SAS Viya). Required Skills: - Hands-on use of SAS Enterprise Guide for data manipulation and workflow automation. - Ability to write complex queries, joins, aggregations, and performance-tuned SQL code - Exposure to cloud-enabled SAS environments and Viya-based analytics. - Experience performing unit testing, data validation, and reconciliation to ensure accuracy and completeness. - Strong ability to interpret Business Requirements and translate them into technical specifications - Understanding of data models, data flows, and business processes This will be on a 3 month contract (inside IR35) and is based remotely. Candidates need to be based in the UK. To be considered please send over your latest CV. Due to the nature and urgency of this post, candidates holding or who have held high level security clearance in the past are most welcome to apply. Please note successful applicants will be required to be security cleared prior to appointment which can take a minimum 10 weeks. LA International is an award-winning partner of choice for many of the world's most influential companies and government organisations. Holding Enhanced Government Security Accreditation, we are recognised as the European market leader in the delivery of Security Cleared talent to organisations that demand the very highest levels of security, compliance and assurance. An award-winning organisation, having secured the prestigious Queens Award for Enterprise: International Trade over multiple years. We are committed to fostering an inclusive, equitable and accessible workplace where everyone feels valued and supported. We welcome applications from all individuals, regardless of background or identity, and we encourage candidates who may not meet every listed requirement to still apply. If you require any adjustments or support during the recruitment process, please let us know and we will work with you to ensure a fair and accessible experience. Please Note: If a high volume of applications is received, only candidates shortlisted will be contacted.
Dans le cadre du renforcement d'une équipe dédiée à l'innovation et à l'industrialisation de solutions d'Intelligence Artificielle, nous recherchons un(e) Data Engineer / Développeur Fullstack Python Junior souhaitant évoluer sur des sujets mêlant Data Engineering, IA Générative et développement logiciel. Vous intégrerez une équipe à taille humaine intervenant sur des projets déjà en production autour du traitement documentaire, du Machine Learning et de l'IA générative. Vous participerez notamment à : Développer des applications et pipelines de traitement de données en Python. Concevoir et maintenir des traitements distribués autour des technologies Big Data. Participer au développement d'outils intégrant des modèles d'IA générative. Contribuer à l'amélioration continue des chaînes CI/CD ainsi qu'à l'automatisation des tests. Développer des interfaces et outils facilitant l'exploitation des solutions IA. Collaborer étroitement avec les équipes Data Engineering, Data Science et les métiers afin de transformer rapidement les besoins en solutions opérationnelles. Participer à la mise en production et à l'industrialisation des développements.
Mission de l'équipe : Au sein de l'équipe Stress Testing and Data Analytics, la mission consiste à renforcer les capacités de développement et d'industrialisation des traitements de données utilisés dans les exercices de stress testing réglementaires. L'équipe est responsable de la collecte, de la structuration, de la transformation et de la mise à disposition des données nécessaires aux projections réglementaires, aux exercices de stress testing et aux productions associées. Dans le cadre de la préparation de l'EBA Stress Test 2027, le consultant interviendra sur le périmètre Credit Risk afin de contribuer à la fiabilisation des données, à l'automatisation des traitements et à la sécurisation des livrables réglementaires dans un environnement Big Data. La mission s'inscrit dans un contexte international impliquant une collaboration étroite avec les équipes Data, IT, Finance, Risque et Modèles. 1. Développement et industrialisation des traitements de données_ _L'équipe est responsable du développement, de l'évolution et de la maintenance des pipelines de données nécessaires aux exercices réglementaires. Elle conçoit des traitements robustes et industrialisés sous Dataiku DSS v14, en s'appuyant sur Python, PySpark et SQL, afin d'assurer la production de données fiables, reproductibles et auditables. Les traitements développés doivent répondre à des exigences élevées de qualité, de performance et de traçabilité conformément aux principes BCBS 239. 2. Intégration et contrôle de la qualité des données_ _L'équipe assure l'intégration de données provenant de différentes sources réglementaires et internes. Elle est responsable de la transformation des données, de la mise en œuvre des contrôles de qualité, des contrôles de cohérence ainsi que des rapprochements entre les différentes sources. Les écarts détectés doivent être analysés puis faire l'objet d'actions de remédiation afin de garantir la fiabilité des livrables réglementaires. 3. Contribution aux exercices réglementaires_ _L'équipe contribue directement à la construction du Credit Starting Point dans le cadre de l'EBA Stress Test 2027. Elle participe à la préparation des datasets réglementaires, à l'alimentation des templates attendus ainsi qu'à la sécurisation des différentes phases de production jusqu'aux livraisons. Une forte implication est attendue durant les périodes critiques de préparation, de validation, de re-run et de remédiation. 4. Documentation et traçabilité_ _L'équipe est responsable de la documentation technique et fonctionnelle des traitements développés. Elle garantit la traçabilité complète des données, des règles de transformation et des contrôles mis en œuvre afin de répondre aux exigences d'audit et de conformité réglementaire. Prestations demandées : La mission interviendra principalement sur les activités suivantes : Développer et maintenir les pipelines de données sous Dataiku DSS v14. Concevoir, optimiser et exécuter des traitements en Python, PySpark et SQL. Contribuer à la construction du Credit Starting Point dans le cadre de l'EBA Stress Test 2027. Intégrer, transformer et contrôler des données réglementaires et internes. Automatiser les contrôles de qualité et les contrôles de cohérence des données. Réaliser les analyses d'écarts et participer aux actions de remédiation. Produire une documentation technique et fonctionnelle des traitements développés. Garantir la traçabilité et l'auditabilité des données conformément aux principes BCBS 239. Collaborer avec les équipes Data, IT, Finance, Risque, Modèles et les différentes parties prenantes du programme. Participer aux phases de recette, validation, re-run et sécurisation des livrables réglementaires. Expertises : Data Engineering Dataiku DSS v14 Développement de pipelines de données Python PySpark SQL Big Data Data Quality Data Lineage Data Transformation Data Remediation Stress Testing BCBS 239
Data Engineer Senior (H/F) – Full RemoteDans le cadre d'un programme de transformation Data d'envergure internationale, nous recherchons un Data Engineer Senior pour intervenir sur la conception et le développement de solutions data modernes. Vos missionsConcevoir, développer et maintenir des pipelines de données robustes et évolutifs. Développer et optimiser les processus ETL/ELT. Participer à la conception et à l'évolution d'une plateforme Data Cloud. Modéliser les données et garantir leur qualité. Concevoir des jeux de données destinés aux équipes Analytics et Business Intelligence. Optimiser les performances des traitements et des requêtes. Collaborer avec les équipes Data, Architecture, Produit et Métiers dans un environnement Agile. Rédiger la documentation technique et appliquer les bonnes pratiques de développement. Stack techniqueSnowflake SQL avancé Python ETL / ELT Modélisation de données Data Warehouse Cloud (AWS, Azure ou GCP) Outils d'orchestration (Airflow ou équivalent) Git CI/CD APIs REST Data Quality & Data Governance Méthodologie Agile / Scrum Profil recherchéMinimum 8 ans d'expérience en tant que Data Engineer. Excellente maîtrise de SQL et Python. Expérience confirmée sur Snowflake. Bonne connaissance des architectures Data Cloud. Solides compétences en modélisation de données et en optimisation des performances. Capacité à évoluer dans un environnement international. Anglais professionnel impératif. ConditionsMission de 6 mois renouvelable. Démarrage : dès que possible. Télétravail : 100 % (fuseau horaire européen). Environnement technique moderne et projet à forte visibilité.
Le client est le leader européen du retail spécialisé omnicanal, avec des marques iconiques. Vous êtes passionné par les outils BI et la data ? Rejoignez la Data & AI Factory entité qui regroupe les compétences fonctionnelles et techniques qui contribue au développement de l'activité grâce à la richesse de nos données et aux technologies avancées d'exploitation. En tant que Data Engineer, vous aurez la charge de concevoir, développer et d'optimiser des solutions Data adaptées aux besoins de nos différents métiers. Votre expertise avancée sur les différents services GCP, combinée à une solide maîtrise de SQL et python, sera essentielle pour concevoir des solutions performantes et alignées avec les besoins métiers. Vous serez un acteur clé de l'équipe technique de la Data Factory pour garantir la fiabilité et la performance des systèmes de traitement de données. Description • Concevoir et développer des pipelines de données robustes et scalables en utilisant Talend et les services de Google Cloud Platform (BigQuery, DataForm, Dataflow, Pub/Sub, CloudComposer). Vous serez au cœur de la construction d'une infrastructure de données moderne et performante. • Travaux sur le maintien des solutions au bon niveau technologique • Travaux sur la compliance réglementaire de nos assets • Améliorer la performance et la scalabilité des solutions existantes pour répondre aux besoins stratégiques de l'entreprise. • Collaborer étroitement avec les architectes, PO et Data Analyst pour garantir la qualité et l'exploitation optimale des données. • Maintenir une documentation technique précise et complète sur les processus et les solutions implémentés. • Réalise la recette technique et participe à animer la recette fonctionnelle avec les utilisateurs et le PO • Mettre en place et gérer des systèmes de monitoring et d'alerting pour assurer une supervision proactive des pipelines et systèmes de données, garantissant leur fiabilité et leur disponibilité. • Support au déploiement • Assure la maintenance corrective ou évolutive • S'assure de la cohérence des livrables avec les règles et bonnes pratiques définies au sein de l'équipe Livrables pipelines de données Documentations techniques Compétences
Dans le cadre d'un programme stratégique de modernisation de la plateforme Data, intervention en tant que Data Engineer Expert PySpark pour accompagner la migration des traitements de données d'une architecture On-Premise vers Google Cloud Platform (GCP). La mission vise à industrialiser les pipelines de données, optimiser les performances des traitements Big Data et mettre en place une architecture cloud scalable, sécurisée et résiliente. Principales responsabilitésParticiper à la définition de l'architecture cible Data sur GCP. Analyser les flux et traitements existants sur l'environnement On-Premise. Concevoir et développer des pipelines de données distribués avec PySpark. Migrer les traitements ETL/ELT vers les services GCP. Optimiser les performances des jobs Spark et réduire les temps de traitement. Industrialiser les workflows de traitement et d'intégration des données. Mettre en œuvre les bonnes pratiques de développement, de monitoring et de sécurité. Assurer la qualité, la fiabilité et la traçabilité des données. Participer aux phases de tests, validation et mise en production. Accompagner les équipes Data dans l'adoption des nouvelles solutions Cloud.
ContexteDans le cadre du renforcement de son équipe Data & IA, notre client recherche un Data Engineer / Administrateur Plateforme Data pour assurer l'administration, l'exploitation et l'évolution des infrastructures Data basées sur Cloudera CDP et les technologies Open Source. Vous interviendrez sur des plateformes critiques en collaboration avec les équipes applicatives, infrastructures, métiers et internationales afin de garantir la disponibilité, les performances et l'évolution des environnements Data. MissionsAdministration & ExploitationAdministrer et maintenir les plateformes Data Cloudera CDP. Garantir le maintien en condition opérationnelle des infrastructures. Superviser les plateformes et assurer le traitement des incidents. Participer aux astreintes et aux interventions hors horaires ouvrés. Optimiser les performances et la capacité des plateformes. Data EngineeringConcevoir les solutions d'ingestion de données (API). Mettre en œuvre des architectures de stockage (Hadoop, Ozone, Druid, ClickHouse...). Développer et automatiser les traitements de données. Mettre en place les tests unitaires et d'intégration. Industrialiser les traitements de nettoyage et de transformation des données. Évolution des plateformesParticiper aux migrations des clusters Hadoop Cloudera. Contribuer au déploiement des nouvelles plateformes Cloudera Data Services sous OpenShift/Kubernetes. Être force de proposition sur les évolutions techniques. Participer au design des infrastructures Data. Support & ExpertiseRésoudre les incidents complexes (Hive, Spark, Yarn...). Accompagner les équipes applicatives et métiers. Assurer un support technique de haut niveau. Participer à la documentation et au partage de connaissances. Environnement techniqueImpératifCloudera CDP 7.1.x RedHat Enterprise Linux 8 & 9 Python Java Ansible DevOps Très bonnes connaissancesHadoop Hive HBase Kafka Spark Solr Knox Ranger ZooKeeper Kerberos LDAP AppréciéesOpenShift Kubernetes Trino / Starburst Airflow Flink Maven Gradle ClickHouse Ozone Druid Profil recherchéFormation Bac+5 en informatique ou équivalent. Expérience significative sur des plateformes Big Data Cloudera. Expertise Linux RedHat. Bonne maîtrise des environnements Open Source Data. Solides compétences en automatisation (Ansible). Connaissances DevOps. Capacité à analyser et résoudre des incidents complexes. Esprit d'équipe, autonomie et bonnes capacités de communication. ConditionsCouverture de l'équipe : 8h00 – 19h00 Astreintes et interventions hors horaires ouvrés selon un planning de rotation. Niveau attendu : Confirmé / Senior (N4). Compétences clés : Cloudera CDP 7.1.x, RedHat 8/9, Hadoop, Spark, Hive, Kafka, Python, Java, Ansible, DevOps, OpenShift, Kubernetes.
Dans le cadre de la modernisation de sa plateforme de données, notre client recherche un(e) Data Engineer pour accompagner la transformation de traitements décisionnels existants vers un environnement Big Data et Cloud. Vous interviendrez sur des projets à fort impact, mêlant évolution des systèmes historiques, industrialisation des flux de données et mise en place de nouvelles architectures orientées performance et scalabilité. Vous intégrerez une équipe technique engagée dans l'amélioration continue des plateformes de données et contribuerez activement à la construction d'un écosystème moderne, robuste et pérenne. Vos missions: Modernisation des traitements de donnéesMigration de traitement Informatica et PL /SQL vers SPARK(java) Maintenance corrective et évolutive des traitements PL/SQL Refonte Cloud(Databricks)Conception et mise en oeuvre de pipelines de données sur Databricks Industrialisations des traitements dans un environnement moderne
Dans le cadre d'un projet de référentiel, vous intégrez une équipe dédiée à l'alimentation, la correction et la maintenance des données en mode RUN. Vos missions consisteront à : Analyser les incidents et anomalies remontés sur les données. Développer des solutions correctives (traitements, scripts, composants). Déployer les composants en environnement de production. Garantir la qualité et la fiabilité des données du référentiel. Environnement Technique Stockage des données : Solution MDM (Master Data Management). Traitements : Java et outil de Data Quality. Outils collaboratifs : Jira (suivi des incidents) et Confluence (documentation).