Plateforme On-Premise & Cloud Synthèse de la Mission : Rôle : Ingénieur Data Senior (> 7 ans d'expérience) Localisation : Paris ou Rennes (3 jours/semaine sur site, 2 jours en télétravail) TJM Max : 770 € / jour Date de démarrage : ASAP Durée : 5 à 6 mois (jusqu'au 27/11/2026) Contexte & Objectif de la Mission : Au sein d'un grand groupe média, l'objectif principal est de concevoir et construire le MVP d'une plateforme Data On-Premise basée sur des technologies Open Source. La plateforme permettra de : Gérer les transformations de données On-Premise et alimenter un Data Lake local. Servir de plateforme d'ingestion pour le Big Data sur GCP (Cloud Public). Faciliter la transition du mode Batch vers le Streaming (Temps réel). Valider la faisabilité de migration de flux ETL legacy (OpenText / Genio). Responsabilités & Missions Principales : Conception & Déploiement du MVP : Architecturer et intégrer la plateforme sur un socle existant (Kubernetes, GitLab CI, Prometheus/OpenTelemetry). Installer et configurer la stack Open Source : Kafka, NiFi, Spark, Iceberg, Trino. Validation Technique & Cas d'Usage : Migrer quelques flux ETL clés pour valider la valeur de la plateforme. Déployer des pipelines streaming (Kafka + Spark Structured Streaming). Mettre en place l'alimentation du Data Lake (Iceberg + Trino) et assurer l'interopérabilité avec GCP. Collaboration & Documentation : Travailler en synergie avec les équipes Data/IA et DevOps/Infra. Documenter l'architecture, les choix techniques et transmettre les compétences aux équipes internes.
Contexte de la mission Dans le cadre d'un programme de transformation digitale d'envergure, vous rejoindrez une équipe agile dédiée au développement d'une plateforme de données temps réel. Cette plateforme permet de centraliser, traiter et valoriser des données clients afin de proposer de nouveaux services digitaux et d'accompagner la modernisation du système d'information. Vous évoluerez au sein d'un environnement collaboratif, orienté qualité de code, amélioration continue et excellence technique. Vos missions Développer et mettre en œuvre de nouvelles fonctionnalités à partir des besoins métiers priorisés Concevoir des solutions techniques robustes et évolutives. Participer aux choix d'architecture et aux orientations techniques de l'équipe. Concevoir et développer des API. Automatiser les tests et promouvoir les bonnes pratiques de développement. Garantir la qualité, la performance et la maintenabilité des applications. Assurer le bon fonctionnement des solutions en production. Accompagner les membres de l'équipe dans une démarche d'amélioration continue. Environnement technique Langages & Frameworks Java Scala Apache Spark (Streaming & Batch) Apache Kafka Data & Big Data Hadoop / Cloudera HDFS Hive HBase Phoenix API & Intégration Développement d'API DevOps & Qualité GitLab CI/CD Jenkins Artifactory SonarQube ELK Grafana XRAY JUnit Automatisation des tests / Craftsmanship Méthodologie Agile Scrum
La mission consiste à : - Exposer les données utiles à l'entreprise pour les analyser et les utiliser afin d'améliorer l'expérience utilisateur et la productivité - Transformer des données issues du DataLake afin de les normaliser - Modéliser la sphère de données - Développer les flux - Exposer des données brutes et/ou agrégées au bon niveau de granularité aux différents métiers de l'entreprise - Travailler en lien avec des Data Scientists sur les données qu'il aura exposées - Mettre en place des rapports de Dataviz - Mission basée en métropole lilloise avec présence sur site 3j/semaine obligatoire Compétences demandées : - Formation supérieure en école d'ingénieur, école d'informatique ou Master spécialisé dans la Data Science - Première expérience en Data Engineering indispensable - Snowflake, GCP, BigQuery, DBT, SQL, Semarchy, Airflow, Python ... - Excellents savoir-être : rigueur, esprit analytique et de synthèse, communication... - Méthode Agile - Anglais
Dans le cadre du remplacement , nous recherchons un profil expérimenté capable d'assurer la reprise des activités, de garantir la continuité de service et de monter rapidement en autonomie Missions : Administration et exploitation des plateformes DevOps Administration des comptes et des organisations AWX Maintien des environnements d'exécution AWX Maintien et support des collections Ansible Support et maintien des runners GitLab Linux et Windows Maintien des images GitLab Windows (.NET) et des images de déploiement Support des pipelines CI/CD Infrastructure : Maintien des serveurs de production et des environnements de développement Administration des plateformes Linux et Windows Server Participation à l'exploitation des infrastructures VMware Support sur les composants d'infrastructure et réseau Support technique : Accompagnement des équipes sur les sujets DevOps Gestion des accès Gestion des licences Participation à la reprise et au support de la plateforme Database Environnement technique : Linux Kubernetes AWX Ansible GitLab Docker VMware Vault Artifactory Azure DevOps TFS PostgreSQL Windows Server Kafka MQ Infrastructure & Réseau ServiceNow Connaissances .NET appréciées Profil recherché : Ingénieur DevOps / Infrastructure confirmé Minimum 5 ans d'expérience dans des environnements Linux et DevOps Maîtrise des outils d'automatisation et des chaînes CI/CD Bonne connaissance des environnements Kubernetes Expérience des environnements d'infrastructure et d'exploitation
Nous cherchons un intégrateurs d'application Middleware confirmé (H/F) pour notre client, situé à proximité d'Aix en Provence pour une mission longue de 3 ans.. Au sein de l'équipe infrastructure composée de 9 personnes, vos missions consisteront notamment à : Monter les infras en collaboration avec l'Architecte, le Scrum Master et le Chef de Projet Elaborer le DAT : concevoir les socles et procédures Apporter conseil et soutien aux équipes de développement Intégrer et paramétrer avec les Templates proposés par sur XL Deploy Déployer des applications Middleware au sein d'un périmètre sensible à haut Niveau de Sécurité Assurer les Delivery sur différents environnements recette, prod... Packaging ( incluant les flux CFT) - delivery et supervision Déploiement et Orchestration sur la chaine CI/ CD Prendre par au PRA et PRI Assurer le RUN de Niveau 3 représentant 30 % de la mission. Prend la main sur l'homologation Bench pré prod et prod Etablissement des PV recette technique et fonctionnel Optimiser les métriques applicatives et les Dashboard en place Réaliser le Reporting des KPI Rythme = 2,5 jours Télétravail et 2,5 jours Présentiel – 1 er mois en Présentiel
Date de démarrage : ASAP Date de fin : 31/10/2026 Localisation : Paris Tarif Journalier Moyen (TJM) Max : 660 € Descriptif de la MissionAu sein des équipes Data, vous interviendrez sur la conception, le développement, la gouvernance et l'optimisation de nos plateformes de données. Vos activités principales s'articuleront autour de quatre grands piliers : 1. Développement & Architecture DataConcevoir et développer des pipelines de données robustes et scalables sur Databricks (PySpark, Spark SQL, Delta Live Tables). Mettre en place des architectures Lakehouse basées sur Delta Lake. Industrialiser et orchestrer les workflows ETL/ELT à l'aide de Databricks Workflows. 2. Gestion et Administration de la Plateforme DatabricksAdministrer l'espace de travail (gestion des workspaces, configuration des clusters, gestion des permissions). Assurer l'optimisation des coûts (finops) via la configuration fine, l'autoscaling et le monitoring des clusters. Implémenter et faire respecter les bonnes pratiques de sécurité (Unity Catalog, gestion des accès, lineage de la donnée). 3. Gouvernance & Qualité des DonnéesMettre en place des mécanismes stricts de qualité et de validation des données (expectations, tests automatisés). Documenter rigoureusement les modèles et les flux sur la plateforme. Garantir la fiabilité, la cohérence et la fraîcheur des données mises à disposition. 4. Collaboration & SupportCollaborer étroitement avec les Data Analysts, Data Scientists et les équipes métiers. Accompagner et former les utilisateurs clés dans l'adoption et la prise en main de l'écosystème Databricks. Participer activement aux revues de code, à la standardisation et au partage des bonnes pratiques d'ingénierie. Compétences RequisesTechniques (Incontournables) :Développement : Excellente maîtrise de PySpark ou Spark SQL. Écosystème : Forte expérience pratique avec Databricks (pipelines, clusters, notebooks, Unity Catalog). Architecture : Solides connaissances des architectures Lakehouse, du data modeling, des concepts ETL/ELT et des stratégies d'ingestion (batch & streaming). Cloud : Connaissance approfondie d'au moins un des principaux fournisseurs cloud (Azure, AWS ou GCP). DevOps : Maîtrise de Git et des pratiques de CI/CD (Azure DevOps, GitHub Actions, etc.). Souhaitées (Un plus) :Connaissances en MLflow, orchestration de modèles et pratiques MLOps. Notions avancées en DataOps, cost optimization (FinOps) et outils de monitoring. Expérience dans l'exploitation d'APIs et l'ingestion de données en temps réel (ex: Kafka).
🏭 Secteurs stratégiques : Banque d'investissement PAS DE FULL REMOTE NI SOUS TRAITANCE MERCI 🗓 Démarrage : ASAP 💡 Contexte /Objectifs : Application back office généraliste (multiproduits) et local (nombreux sites & utilisateurs dans le monde). L'entité Interface est en charge d'interfacer ce système avec les autres systèmes (booking, paiements, référentiels...) Il s'agit de contribuer aux développements des interfaces. Le code est principalement en C et Java avec un peu de shell (ksh, awk). 💡Les livrables attendus sont : Discussion sur les solutions techniques avec les architectes Orienter les clients et l'équipe vers la solution technique la plus appropriée Pilotage et encadrement des équipes de dev Développement des pipelines streaming pour la production et consommation avec la librairie apache-kafka Accompagnement et coaching des membres de l'équipe sur les bonnes pratiques techniques Porter la démarche d'amélioration continue associée (clean code..) Participer aux développements et à l'implémentation des solutions, notamment sur les phases sensibles du développement (développement web service Rest) Identification des points bloquants et analyser les obstacles de manière proactive afin de remplir le Sprint (gestion des incidents) DevOps : développent de la chaine CI/CD jenkins Revue de code et vérification des métriques (Jenkins, Sonar) pour garantir la qualité de code Organisation des réunions avec l'ensemble des interlocuteurs des applications qui s'interfacent avec le domaine de la garantie Participation à la rédaction des Document Architecture Technique avec les architectes techniques Participation à la roadmap des livraisons à moyen et long terme et négocier, avec le BO Onboarding des nouveaux arrivants
Nous recherchons pour l'un de nos clients, acteur financier en temps réel à forte volumétrie, un Architecte Platform senior, en CDI ou freelance, basé à Nanterre. Le poste Le Platform Architect est responsable de la vision technique, de la cohérence des socles et de la conception des architectures transverses qui soutiennent l'ensemble des équipes delivery, exploitation et production. Il agit comme un chef d'orchestre technique garantissant que tous les composants fonctionnent de manière intégrée, fiable et conforme. Domaines couverts IAM et sécurité : Keycloak, OAuth2, Zero Trust, DevSecOps Kubernetes et GitOps : ArgoCD, Helm, Terraform Observabilité : Prometheus, Grafana, Loki, Instana Middlewares : Kafka, HAProxy, ActiveMQ, Redis Data stores : PostgreSQL, MongoDB CI/CD : GitHub Actions, Jenkins Infrastructure hybride on-premise et cloud privé IA et exploitation de la plateforme Un élément différenciant fort du poste : la capacité à intégrer l'IA dans l'exploitation de la plateforme (AIOps, détection d'anomalies, prédiction d'incidents, auto-remédiation). Il ne s'agit pas d'un profil data scientist, mais d'un architecte qui comprend l'IA et sait la mettre au service de la fiabilité et de la performance des systèmes critiques. Gouvernance et responsabilités Construction des roadmaps socles Pilotage de la gestion des risques d'obsolescence (OS, base de données, middleware, clusters, IAM) Participation aux comités d'architecture Garantie de la cohérence des designs proposés par les différentes équipes Accompagnement des projets métiers et challenge des architectures applicatives Intervention en expert niveau 3 sur les incidents complexes
🚀 Opportunité – Expert Hadoop / Cloudera CDP / Ansible (H/F)Dans le cadre du renforcement d'une plateforme Big Data stratégique d'un grand groupe bancaire, nous recherchons un Expert Hadoop / Cloudera CDP pour intervenir sur des projets d'évolution, d'industrialisation et de maintien en conditions opérationnelles d'une infrastructure critique. Vos missionsAdministrer, maintenir et optimiser des clusters Hadoop (Cloudera CDP). Assurer la disponibilité, la performance et la sécurité de la plateforme Big Data. Automatiser les déploiements, patchs et configurations avec Ansible et Terraform. Participer aux montées de version des composants Hadoop. Intervenir sur des incidents complexes et contribuer aux task forces techniques. Déployer de nouvelles fonctionnalités d'infrastructure. Collaborer avec l'éditeur et les équipes techniques internes. Produire et maintenir la documentation technique. Environnement techniqueHadoop / Cloudera CDP 7.1.x Apache Kafka Apache NiFi Spark Ansible Terraform / Terragrunt Shell scripting GitHub / AWX Profil recherchéSolide expérience d'administration de plateformes Hadoop / Cloudera. Très bonne maîtrise d'Ansible et de l'automatisation d'infrastructure. Expérience sur Kafka, NiFi et Spark. Bonne connaissance des environnements Linux et des pratiques DevOps. Capacité à intervenir sur des problématiques techniques complexes et à accompagner les évolutions d'une plateforme Big Data. Informations complémentaires📍 Localisation : Île-de-France 🏢 Mission en présentiel 📅 Démarrage : ASAP ⏳ Mission longue durée (12 mois renouvelables) 📩 Si cette opportunité vous intéresse, n'hésitez pas à me contacter en message privé ou à envoyer votre CV.
ContexteDans le cadre du programme ITAM et la mise en place du Group Global Inventory ainsi que l'alimentation industrielle de la CMDB Group, le bénéficiaire renforce ses activités autour du produit BMC Helix Discovery. MissionsResponsable Discovery Data product : Développement des query API Discovery en regard des besoins production Construction des data sets dans l'outil de query engine Exposition du data product à la consommation opérationnelle Interfaçage au MCP pour alimenter l'IA Production MCO et optimisation des query et data sets DevOps Discovery : Configuration et paramétrage de BMC Discovery : configurer et paramétrer BMC Discovery pour collecter les données d'actifs informatiques, telles que les périphériques réseau, les logiciels, les matériels, etc. Intégration des données de BMC Discovery : intégrer les données de BMC Discovery dans le système de nettoyage des données pour enrichir les données existantes. Définition des règles de correspondance : définir des règles de correspondance pour associer les données de BMC Discovery avec les données existantes dans le système. Mise en place de la synchronisation des données : mettre en place la synchronisation des données entre BMC Discovery et le système de nettoyage des données. Gestion des erreurs et des exceptions : gérer les erreurs et les exceptions qui peuvent survenir lors de la collecte, de l'intégration et de la synchronisation des données. Outils & EnvironnementBMC Helix Discovery (mandatory) Starburst (Data product, MCP, AI) Spark / Pyspark ServiceNow ITSM (change, incident, problem, request) Jira / Confluence Nice to have : Tableau Server / Tableau Desktop / PowerBI / Dataikku Talend Real Time Big Data / ESB, ETL, EAI Talend Data Catalogue PostGreSQL / Apache Kafka / S3 storage Environnement techniqueL'expert utilisera BMC Discovery et d'autres outils pour collecter et intégrer les données, pour ensuite les exposer en data products afin d'alimenter des IA. DonnéesTravail avec des données d'actifs informatiques, notamment des informations sur les périphériques réseau, les logiciels, les matériels, etc. Système de nettoyage des donnéesL'expert doit comprendre le fonctionnement du système de nettoyage des données et comment les données de BMC Discovery peuvent être intégrées pour améliorer la qualité des données.