1. Contexte & Enjeux Dans le cadre du remplacement d'un consultant clé, le client recherche un expert capable de sécuriser la performance et la supervision de ses plateformes e-commerce. Le rôle est stratégique : 👉 garantir la stabilité des systèmes avant les pics d'activité 👉 structurer durablement la démarche d'observabilité et de performance 2. Missions principales (cœur du poste) A. Performance applicative Piloter l'ensemble de la stratégie de tests de performance Concevoir, exécuter et analyser des tests (charge, stress, endurance) Identifier les goulets d'étranglement et recommander des optimisations Intervenir sur des architectures Java / .NET Industrialiser les campagnes de tests via NeoLoad Accompagner les équipes dans l'intégration de la performance dès les phases projet (shift-left) Contribuer à l'évolution des outils et pratiques (ex : OctoPerf) 👉 Objectif : anticiper les incidents et garantir la tenue en charge lors des pics business B. Observabilité – PILIER STRATÉGIQUE Déployer et piloter la stratégie d'observabilité à l'échelle du SI Être le référent sur Datadog Construire des dashboards, alertes et indicateurs pertinents (logs, metrics, traces) Accompagner les équipes techniques (onboarding, formation, bonnes pratiques) Migrer les solutions legacy vers DataDog (ELK, Grafana…) Mettre en place une vision transverse de la performance applicative 👉 Objectif : améliorer la visibilité, réduire les temps de détection et de résolution des incidents 3. Missions complémentaires DevOps & Automatisation Automatiser les tests de performance et la supervision Intégrer les outils dans les pipelines CI/CD (GitLab) Scripting pour industrialisation Run & Support Maintien en condition opérationnelle des plateformes Support en période critique (haute saison) Participation à la surveillance proactive
Notre client, un grand groupe international de logistique multimodale (transport, portuaire, maritime, ferroviaire), mène un programme pluriannuel de transformation de son SI Logistique : remplacement des TMS existants par un TMS unique, digitalisation des processus opérationnels, intégration rationalisée au reste du SI. L'équipe programme, internationale, travaille en mode matriciel avec la DSI et les filiales. Dans ce cadre, nous recherchons un expert Monitoring & Observabilité pour concevoir, déployer et faire évoluer le dispositif de supervision du nouveau TMS, en intervenant dès les phases de Build pour garantir un niveau de supervision suffisant avant mise en production. Vos missions : - Définir la stratégie d'observabilité (métriques, logs, traces, indicateurs de disponibilité, performance, capacité). - Concevoir et déployer la supervision Datadog : dashboards Run/Infra/Applicatif/Management, Service Maps, monitors et alertes composites. - Concevoir et déployer la supervision Splunk : collecte et indexation des logs, dashboards, alertes de détection d'incidents. - Construire des indicateurs combinant technique et métier (volumes, taux de succès, temps de traitement). - Industrialiser l'alerting : seuils pertinents, criticité, circuits d'escalade, réduction des faux positifs. - Accompagner le passage Build → Run : dossier de supervision, documentation, formation des équipes.
Nous recherchons un Référent support fonctionnel confirmé avec une expérience en pilotage pour intervenir sur une 15aine d'applications : Analyse des anomalies de production (et parfois de recette) Préparation et animation d'instances de pilotage auprès des donneurs d'ordres Coordination des équipes internes et externes dans la résolution d'anomalies complexes Pourquoi nous rejoindre ? Certifié Great Place To Work depuis 2018 Possibilité d'être formé et certifié par Webnet Ambiance conviviale avec des évènements internes récurrents (activités sportives, loisirs etc…) ainsi que la garantie d'un équilibre entre votre vie privée et professionnelle Participation à des challenges hebdomadaires : Team #dragondefeu vs #dragondeglace Membre de la charte éthique & diversité (+ 15 nationalités représentées) & Dragon Funding (programme de soutien associatif) Nos petits + : 2 types de primes : de régie et participation Carte ticket restaurant : SWILE (9€ par jour) 🥣 Prise en charge à 80% des abonnements en transport en commun Des convaincus du télétravail Avantage ancienneté : à partir de 2 ans, Webnet vous rembourse un abonnement quel qu'il soit via des coins qui se cumulent
Dans le cadre d'un programme stratégique autour des Mobilités du Quotidien, nous recherchons un Référent Support Fonctionnel confirmé afin d'accompagner les équipes en charge d'un écosystème applicatif dédié à la distribution des titres de transport TER. Au sein d'une équipe support composée d'une quinzaine de collaborateurs, vous interviendrez sur le traitement des incidents et anomalies de production ainsi que sur la coordination des différents acteurs impliqués dans la résolution des problématiques applicatives
En tant qu'ingénieur DevOps/SRE Expert Observabilité, vos missions et livrables se découperont en 3 grands piliers : 1. Engineering & Développement (Core Build) : • Conception et développement de composants, d'API ou de collecteurs natifs OpenTelemetry (OTel) en langages Python et/ou Go (Golang). • Maintien, optimisation et tests de nos architectures d'infrastructure distribuées via Terraform (environnements multi-cloud GCP / AWS). • Conception et packaging de Helm Charts pour le déploiement automatisé et résilient de nos briques d'observabilité sur des clusters Kubernetes (K8s). • Conception et maintenance de composants Puppet et Ansible pour le déploiement de nos briques d'observabilité pour les VM. 2. Accompagnement & Gouvernance (Mass Migration) : • Accompagnement technique de proximité auprès des équipes applicatives (onboarding, revues d'architecture de leurs pipelines de données et suivi, accompagné de notre chef de projet). • Définition et évangélisation des bonnes pratiques d'observabilité (sampling rates, stratégies de tagging, gestion du cycle de vie des alertes). • Conception de mécanismes d'audit et de contrôle afin de vérifier la qualité de service, la conformité des configurations et prévenir les dérives de coûts (FinOps). 3. Run & Amélioration continue : • Prise en charge d'une partie du RUN du pôle Observabilité en méthodologie Agile ("You Build it, You run it"). • Rédaction et mise à jour de la base documentaire pour maximiser l'autonomie des utilisateurs finaux (Self-Service). • Suivi opérationnel de l'avancement dans Jira (création de Tasks et de User Stories).
Dans le cadre de l'évolution d'une plateforme digitale à fort trafic, nous recherchons un Lead DevOps / Developer Experience (DevEx) pour accompagner les équipes de développement dans l'amélioration de leur productivité, de leurs pratiques CI/CD et de leurs environnements Cloud. Le consultant interviendra dans un environnement AWS / Kubernetes, avec une forte dimension architecture, Infrastructure as Code, automatisation et accompagnement des développeurs. Missions principales * Piloter l'amélioration de la Developer Experience et des outils de productivité développeurs. * Étudier et mettre en place des solutions de portail développeur, catalogue de services et infrastructure self-service. * Concevoir et faire évoluer des architectures AWS scalables, hautement disponibles et adaptées à de fortes charges. * Optimiser les processus de CI/CD et de déploiement continu. * Développer et standardiser les pratiques Infrastructure as Code (IaC). * Collaborer avec les équipes Infrastructure, Développement et Architecture. * Sensibiliser les développeurs aux problématiques Ops : performance, disponibilité, monitoring et sécurité. * Assurer une veille technologique DevOps / Cloud et proposer les évolutions pertinentes. * Contribuer à la priorisation des projets et accompagner l'équipe dans l'atteinte de ses objectifs.
Dans le cadre de son ambitieux programme DRIVE 2030, AGL modernise en profondeur son système d'information afin d'accompagner la croissance du groupe MSC et de digitaliser ses activités logistiques. Ce programme stratégique, lancé pour une durée de 5 ans, vise notamment à : Remplacer les différents Transport Management Systems (TMS) par une plateforme unique. Digitaliser et optimiser les processus métiers. Standardiser les bonnes pratiques au sein des filiales. Moderniser l'ensemble des échanges entre le TMS et le système d'information. Vous rejoindrez une équipe internationale d'une quarantaine de collaborateurs basée au siège parisien et travaillerez en étroite collaboration avec les équipes Infrastructure, Applicatives, Run, Métiers et les filiales internationales. En tant qu'Expert Monitoring & Observabilité, vous serez garant de la supervision des applications critiques et de la stratégie d'observabilité du programme. Définition de la stratégie d'observabilitéDéfinir les standards de monitoring avant chaque mise en production. Identifier les composants critiques et les parcours utilisateurs à superviser. Définir les métriques, logs, traces et événements nécessaires au pilotage des applications. Participer à la feuille de route Datadog & Splunk. Structurer l'observabilité autour des notions de disponibilité, performance, capacité, erreurs et saturation. Mise en œuvre de la supervision DatadogDéployer et administrer les solutions Datadog. Configurer les intégrations et la collecte des métriques. Concevoir des dashboards adaptés aux équipes Run, Infrastructure, Applicatives et Management. Superviser les API, services, URL, certificats, traitements batch et files d'attente. Mettre en place les Service Maps afin de cartographier les dépendances applicatives. Créer les monitors, alertes composites et mécanismes de détection d'anomalies. Corréler métriques, traces et logs. Automatiser le déploiement des dashboards et des configurations.Supervision Splunk Déployer et administrer la collecte des logs. Construire les dashboards et alertes. Optimiser l'exploitation des données de supervision. Industrialisation du système d'alertingDéfinir des seuils d'alerte pertinents. Réduire les faux positifs et limiter le bruit opérationnel. Classifier les alertes selon leur criticité. Définir les workflows d'escalade. Documenter chaque alerte (diagnostic, actions, responsables, escalade). Intégrer les alertes aux outils de communication et de gestion des incidents. Participer à l'automatisation des incidents via ServiceNow.
ContexteDans le cadre d'un programme international de transformation digitale, nous recherchons un Expert Monitoring / Observability afin de concevoir, déployer et industrialiser une plateforme de supervision pour une application métier critique à forte volumétrie. Vous interviendrez sur un environnement stratégique nécessitant une haute disponibilité et accompagnerez les équipes techniques durant les phases de Build, Go-Live et Run. Votre mission sera de garantir une visibilité complète sur la performance des applications, d'anticiper les incidents et d'améliorer en continu la qualité de service grâce à une stratégie d'observabilité robuste. Vous évoluerez dans un contexte international et collaborerez avec des équipes Infrastructure, Production, Développement et Management. Vos missionsConcevoir et mettre en œuvre une architecture d'observabilité de bout en bout (Logs, Metrics, Traces, APM). Développer et maintenir des dashboards, monitors et alertes sur Datadog et Splunk. Définir les indicateurs de performance et de qualité de service (SLI, SLO, SLA). Industrialiser les modèles de supervision via des templates et standards de monitoring. Automatiser le déploiement des dashboards et des configurations de monitoring à l'aide d'outils IaC (Terraform, Ansible ou équivalent). Intégrer les solutions d'observabilité dans les pipelines CI/CD. Collaborer avec les équipes de développement pour améliorer l'instrumentation des applications (logs structurés, tracing distribué, APM). Analyser les incidents complexes grâce à la corrélation des logs, métriques, traces et données APM. Accompagner la transition des applications du Build vers le Run et contribuer à l'amélioration continue des processus d'exploitation. Produire des reportings et recommandations destinés aux équipes techniques et aux parties prenantes.
Dans le cadre du renforcement d'une équipe en charge de la fiabilité et de la performance des plateformes digitales de notre client, nous recherchons un Ingénieur Observabilité & Performance expérimenté. 📋 Vos missions Participer au déploiement et à l'évolution des solutions d'observabilité du SI Accompagner les équipes techniques dans l'adoption des bonnes pratiques de monitoring et de supervision Concevoir et maintenir des dashboards, métriques et dispositifs d'alerting Contribuer à la centralisation et à la corrélation des données techniques afin d'améliorer la visibilité des services Réaliser des campagnes de tests de charge et de performance sur différentes applications critiques Analyser les résultats des tests et formuler des recommandations d'optimisation Assurer le maintien opérationnel des outils de supervision existants Participer à une démarche DevOps orientée amélioration continue et automatisation 🛠️ Environnement Neoload · Datadog · Grafana · Environnements Cloud & On-Premise
CONTEXTE Au sein d'un acteur du transport en commun, la mission consiste à intervenir comme référent architecture et Tech Lead auprès des squads projets. Le consultant accompagnera les projets Data de la phase de cadrage jusqu'à la mise en production, en garantissant les choix d'architecture, la qualité des développements et l'application des bonnes pratiques sur un socle AWS / Databricks. Missions principales / Responsabilités • Accompagner les squads métiers dès le cadrage et jusqu'à la mise en service des cas d'usage • Challenger les choix techniques et architecturaux des projets • Assister les Tech Leads dans la définition des architectures et la rédaction des DAT • Concevoir et optimiser des pipelines d'ingestion et de transformation de données • Garantir les bonnes pratiques de développement, de performance, de FinOps et d'éco-conception • Contribuer à l'amélioration des frameworks et briques techniques de la plateforme • Participer au MCO des applications Data et intervenir en support N3 • Réaliser des PoC, audits techniques et études d'architecture Livrables attendus • Architectures solution • DAT • Pipelines d'ingestion et de transformation de données • PoC • Audits techniques • Études d'architecture Compétences / Qualités indispensables : Databricks, AWS, Spark / Scala, Architecture Solution Data, Data Engineering, Scrum Agile Compétences / Qualités qui seraient un + : Data Mesh, Power BI, FinOps, éco-conception numérique, industrialisation Data Platform, PoC et études d'architecture, accompagnement de squads Agile Informations concernant le télétravail : Oui — 2 jours/semaine
Rejoignez une Digital Factory en pleine transformation et prenez en charge le pilotage opérationnel du RUN d'une plateforme e-commerce stratégique. Rattaché au Product Owner Technique, vous serez le référent des activités de RUN et contribuerez à garantir la qualité, la stabilité et la performance de la plateforme au quotidien. Vous interviendrez sur quatre domaines clés : la gestion des demandes de services, le suivi des performances applicatives, l'analyse des logs de production et l'amélioration continue de l'expérience utilisateur. Au quotidien, vous réaliserez des interventions techniques sous Magento 2 et AWS, piloterez les traitements de données, analyserez les résultats des tests de charge, mettrez en place de nouveaux dashboards et alertes, et challengerez les équipes de développement afin de maintenir un haut niveau de qualité en production. Vous participerez également à l'évolution des outils et des bonnes pratiques de RUN dans un environnement DevOps moderne.
Basée à Lille, Lyon, Nantes, Grenoble, Marseille, Paris et Bruxelles, Insitoo Freelances est une société du groupe Insitoo, spécialisée dans le placement et le sourcing des Freelances IT et Métier. Depuis 2007, Insitoo Freelances a su s'imposer comme une référence en matière de freelancing par son expertise dans l'IT et ses valeurs de transparence et de proximité. Actuellement, afin de répondre aux besoins de nos clients, nous recherchons un Site reliability engineer H/F à Lille, France. Contexte : Rattaché au Leader de la Communauté Performance des Opérations (Perf4Ops) de la Digital Tech Platform (DTP) et en mission au sein d'une de nos plateformes digitales (applicatives, service, etc), la compétence recherchée est garante de l'Excellence des Opérations au sein de sa plateforme de rattachement. Les missions attendues par le Site reliability engineer H/F : - Être le responsable des opérations pour la communauté - Élaborer un plan de déploiement des compétences et pratiques Perf4Ops - Accompagner les ressources opérationnelles (Products team, équipes opérations BU), sur la mise en place des processus et bonnes pratiques pour le suivi des opérations et de la performance. - Rendre autonome les différents acteurs de la communauté sur les outils (ITSM, Monitoring, reporting, logs, ) - Accompagner les Product Owners de la communauté dans la mise en place de SLA et de KPI et les rendre autonome dans leur animation au quotidien - Evaluer la maturité de la communauté sur les opérations et adapter les plans de progrès - Alimenter la backlog des produits Perf4Ops pour les enrichir avec les besoins utilisateurs
Notre client, acteur majeur dans le secteur bancaire, recherche son futur Développeur orienté Platform / Automatisation (H/F) pour son site de Toulouse, dans le cadre du développement de sa plateforme technique et de l'industrialisation de ses environnements. Poste Intégré à une équipe transverse dédiée à la plateforme, vous intervenez principalement sur des sujets de Build, avec pour objectif de simplifier, automatiser et fiabiliser le travail des équipes de développement. Ce poste s'adresse à un développeur ayant évolué vers des problématiques d'infrastructure, d'automatisation et d'outillage, et souhaitant s'inscrire dans une logique de Platform Engineering. Vous évoluerez dans un environnement hybride GCP / Kubernetes On-Premise. Missions * Concevoir et développer des outils facilitant les déploiements et l'exploitation pour les équipes applicatives * Mettre en place et maintenir des pipelines CI/CD (GitLab CI, Jenkins, GitHub Actions) * Automatiser les environnements et les configurations (Infrastructure as Code) * Développer des scripts et solutions de provisioning pour améliorer l'autonomie des équipes * Mettre en place des outils d'observabilité (monitoring, dashboards, alerting) * Collaborer étroitement avec les équipes de développement pour fluidifier les processus * Participer à la fiabilisation des applications et à l'amélioration continue de la plateforme Compétences techniques * Développement : Node.js, Python ou Go (expérience significative) * CI/CD : GitLab CI, Jenkins, GitHub Actions * Automatisation / scripting * Infrastructure as Code : Terraform (ou équivalent) * Conteneurisation : Kubernetes, Docker * Cloud : GCP idéalement (ou AWS) * Observabilité : Datadog, Prometheus (ou équivalent) Une expérience dans des environnements microservices et distribués est un plus.
Nous recherchons actuellement un(e) Data Engineer Senior pour accompagner une équipe Data sur des sujets à forts enjeux autour de la Data Engineering, du Big Data et des architectures Lakehouse. 🔎 1 Data Engineer Senior 🎯 Missions principales : · Concevoir, développer et optimiser des pipelines de données à grande échelle · Mettre en œuvre des flux batch, streaming et ingestion via API · Structurer les transformations selon le modèle Médaillon (Bronze / Silver / Gold) · Développer et industrialiser les pipelines avec DBT, Spark et Iceberg · Contribuer à l'évolution et à l'optimisation de l'architecture Lakehouse · Déployer et maintenir les pipelines dans un environnement Cloud AWS · Orchestrer les workflows ETL / ELT avec Airflow · Mettre en œuvre l'Infrastructure as Code avec Terraform · Travailler sur des environnements conteneurisés avec Docker / Kubernetes · Garantir la disponibilité, la supervision et l'observabilité des traitements · Participer à la gestion des incidents et à l'amélioration continue · Définir et mettre en œuvre les règles de qualité des données : tests, validations et contrôles automatisés · Documenter les architectures, pipelines et règles métier · Garantir la conformité des flux, notamment dans le respect des exigences RGPD ⚙️ Environnement technique : · DBT / Data Catalog · Apache Spark · Apache Iceberg · AWS : Glue, EMR, S3… · Terraform · Airflow · Python · Trino / Starburst · Datadog · Docker / Kubernetes · Architectures Big Data / Lakehouse · Modélisation et collecte de données 🧑💻 Profil recherché : · Minimum 8 ans d'expérience en Data Engineering · Expertise confirmée des architectures Big Data et Lakehouse · Très bonne maîtrise de DBT, Spark, Iceberg, AWS et Terraform · Solide expérience sur les services AWS, notamment Glue, EMR et S3 · Connaissance de Trino / Starburst et Datadog · Bon niveau en Python · Forte capacité d'analyse et de compréhension des enjeux métiers · Expérience dans l'accompagnement et l'encadrement de profils juniors · Autonomie, rigueur et forte culture de l'amélioration continue 🌍 Contexte : · Environnement Data à grande échelle · Projets autour de la modernisation et de l'industrialisation des plateformes Data · Forts enjeux Lakehouse, Data Quality, Observabilité et Cloud · Collaboration avec des équipes Data, IT et métiers 📍 Localisation : Île-de-France – Hybride 🏠 Télétravail : 3 jours par semaine 📅 Démarrage : fin août 2026 💼 Mission longue durée Si vous êtes intéressé(e) ou connaissez un(e) Data Engineer Senior correspondant à ce profil, n'hésitez pas à me contacter en MP ou directement par téléphone. Cordialement,
L'équipe Engineering Platform est garante de l'architecture cloud hub & spoke du groupe, des landing zones mises à disposition des équipes internes, et de l'administration des outils transverses (GitHub, SonarCloud, Datadog). Dans une dynamique d'homogénéisation des outils et pratiques de sécurité, d'hébergement, de monitoring et d'alerting, nous recherchons un Platform Engineer capable d'intervenir sur l'ensemble du périmètre de la plateforme. Missions Vous concevez, faites évoluer et maintenez les briques de la plateforme d'ingénierie : landing zones, modules Terraform, pipelines CI/CD, outillage GitHub. Vous accompagnez les équipes de développement dans l'adoption des standards et golden paths définis par la plateforme, en mode self-service. Vous participez à la définition et à l'amélioration continue des pratiques DevSecOps du groupe : sécurité, automatisation, observabilité. Vous contribuez à la documentation, aux guidelines techniques et à l'animation de communautés de pratique auprès des équipes consommatrices de la plateforme. Vous assurez le run et le support de niveau 2/3 sur les services de la plateforme.
ContexteDans le cadre de la mise en œuvre d'une nouvelle plateforme digitale e-commerce, nous recherchons un DevOps Engineer expérimenté pour accompagner la conception, le déploiement et l'exploitation des pipelines CI/CD, des flux de données et des infrastructures Cloud. Présence sur site obligatoire : 3 jours minimum par semaine à Longpont-sur-Orge. Cette contrainte est non négociable. MissionsConcevoir, développer et maintenir les pipelines CI/CD et les pipelines de données Automatiser les déploiements et les tâches d'exploitation Gérer les ETL et les flux de données de bout en bout Mettre en place les outils de qualité, de tests et d'observabilité Superviser les environnements et optimiser les performances Cloud (AWS) Participer aux activités FinOps : suivi, optimisation et maîtrise des coûts Cloud Assurer le support technique, le troubleshooting et la résolution des incidents Collaborer avec les équipes métiers, les architectes et les équipes de développement Environnement techniqueAWS : EC2, Lambda, VPC, API Gateway, CloudWatch, CloudFront, Glue Terraform GitLab CI/CD AWS Pipelines Java / Spring Boot AWS Glue SonarQube Datadog, New Relic Jira, Confluence