Pour l'un de nos clients du secteur e-commerce / retail, nous recherchons un expert WhatsApp Business Platform / CRM conversationnel afin d'accompagner les équipes IT et métiers dans un projet d'intégration de WhatsApp au sein de leur écosystème CRM. Le client a fait le choix de développer sa propre solution en interne afin de conserver la maîtrise de son architecture, de ses données et de ses parcours CRM. L'objectif de la mission est donc d'apporter une expertise externe sur les bonnes pratiques WhatsApp, les choix d'architecture, les contraintes Meta / WhatsApp Business Platform et les recommandations adaptées à un environnement CRM complexe. L'expert interviendra en appui des équipes IT, CRM, marketing et métiers afin de : Cadrer les cas d'usage WhatsApp dans l'écosystème CRM existant ; Challenger et sécuriser les choix d'architecture cible ; Apporter les bonnes pratiques liées à WhatsApp Business Platform / WhatsApp Business API ; Accompagner les équipes sur les sujets d'opt-in, consentement, templates, règles d'envoi et gouvernance des messages ; Définir les recommandations d'intégration avec les outils CRM, data, marketing automation ou CDP ; Conseiller sur les flux techniques : API, webhooks, événements, tracking, monitoring, logs et gestion des erreurs ; Identifier les risques liés à la délivrabilité, à la conformité, à la sécurité et à la qualité de la donnée ; Produire des recommandations claires permettant aux équipes internes de développer la solution en autonomie ; Accompagner les équipes dans la mise en place d'un socle robuste, maintenable et scalable. Livrables attendus Analyse de l'existant CRM / data / architecture. Recommandations d'architecture WhatsApp. Bonnes pratiques d'intégration WhatsApp Business Platform. Recommandations sur la gestion des opt-in, templates et consentements. Schémas de flux fonctionnels et techniques. Liste des points de vigilance sécurité, RGPD, data et exploitation. Support aux équipes IT et métiers dans les arbitrages.
Dans le cadre du renforcement de ses équipes Infrastructure & Opérations, notre client recherche un Ingénieur Ops confirmé afin de garantir la disponibilité, la performance et la fiabilité de ses plateformes digitales. Au sein d'un environnement Cloud moderne et fortement orienté DevOps, vous intervenez sur l'exploitation, la supervision et l'amélioration continue des services. Véritable acteur de la fiabilité opérationnelle, vous assurez la gestion des incidents, l'analyse des causes racines et la mise en œuvre des actions correctives nécessaires au maintien d'un haut niveau de qualité de service. En collaboration avec les équipes produits, développement et exploitation, vos principales responsabilités seront : Assurer le maintien en conditions opérationnelles des plateformes. Superviser les environnements de production et piloter les incidents. Identifier et analyser les causes racines des dysfonctionnements. Mettre en place et améliorer les dispositifs de monitoring, d'observabilité et d'alerting. Exploiter les métriques, logs et indicateurs de performance afin d'optimiser la qualité de service. Participer à l'automatisation des opérations et à l'amélioration des pipelines de déploiement. Accompagner les équipes dans la définition et le suivi des SLA, SLO et KPI. Diffuser les bonnes pratiques DevOps et ITSM. Contribuer aux initiatives d'amélioration continue visant à renforcer la résilience et la performance des services. Cette mission s'inscrit dans un contexte international exigeant, avec de forts enjeux de disponibilité et de performance.
Dans le cadre de son ambitieux programme DRIVE 2030, AGL modernise en profondeur son système d'information afin d'accompagner la croissance du groupe MSC et de digitaliser ses activités logistiques. Ce programme stratégique, lancé pour une durée de 5 ans, vise notamment à : Remplacer les différents Transport Management Systems (TMS) par une plateforme unique. Digitaliser et optimiser les processus métiers. Standardiser les bonnes pratiques au sein des filiales. Moderniser l'ensemble des échanges entre le TMS et le système d'information. Vous rejoindrez une équipe internationale d'une quarantaine de collaborateurs basée au siège parisien et travaillerez en étroite collaboration avec les équipes Infrastructure, Applicatives, Run, Métiers et les filiales internationales. En tant qu'Expert Monitoring & Observabilité, vous serez garant de la supervision des applications critiques et de la stratégie d'observabilité du programme. Définition de la stratégie d'observabilitéDéfinir les standards de monitoring avant chaque mise en production. Identifier les composants critiques et les parcours utilisateurs à superviser. Définir les métriques, logs, traces et événements nécessaires au pilotage des applications. Participer à la feuille de route Datadog & Splunk. Structurer l'observabilité autour des notions de disponibilité, performance, capacité, erreurs et saturation. Mise en œuvre de la supervision DatadogDéployer et administrer les solutions Datadog. Configurer les intégrations et la collecte des métriques. Concevoir des dashboards adaptés aux équipes Run, Infrastructure, Applicatives et Management. Superviser les API, services, URL, certificats, traitements batch et files d'attente. Mettre en place les Service Maps afin de cartographier les dépendances applicatives. Créer les monitors, alertes composites et mécanismes de détection d'anomalies. Corréler métriques, traces et logs. Automatiser le déploiement des dashboards et des configurations.Supervision Splunk Déployer et administrer la collecte des logs. Construire les dashboards et alertes. Optimiser l'exploitation des données de supervision. Industrialisation du système d'alertingDéfinir des seuils d'alerte pertinents. Réduire les faux positifs et limiter le bruit opérationnel. Classifier les alertes selon leur criticité. Définir les workflows d'escalade. Documenter chaque alerte (diagnostic, actions, responsables, escalade). Intégrer les alertes aux outils de communication et de gestion des incidents. Participer à l'automatisation des incidents via ServiceNow.
Notre client dans le secteur Assurance recherche un/une Expert Cloud – Étude de migration d'application vers le cloud H/F Description de la mission : Étude de migration cloud application – Expert Cloud Contexte et objectif de la mission Dans le cadre de la modernisation de son système d'information, l'entreprise souhaite étudier la migration d'une application existante vers une plateforme cloud. Cette mission doit permettre d'arbitrer l'architecture cible, la trajectoire de migration et les conditions d'exploitation associées. Les objectifs principaux de l'étude sont les suivants : • Améliorer la disponibilité de la solution en garantissant un niveau minimal de 99,97 % • Définir une architecture PRI/PCI reposant sur un principe actif/actif • Garantir la continuité de service pendant les opérations de maintenance, notamment lors des montées de version techniques des composants de la solution L'environnement technique existant est composé de : • Applications containerisées sous Kubernetes • Bases de données MongoDB • Accès à des services externes, par exemple Google Maps Missions principales L'expert devra aider à la définition de l'architecture cloud cible au regard du contexte et produire les livrables associés : • Définir les services et fournisseurs cloud à utiliser • Définir les mécanismes de sécurité à implémenter, incluant la journalisation, la traçabilité, le contrôle d'accès et l'interconnexion au SI existant • Définir les dispositifs de supervision et de monitoring de la solution cible • Définir les mécanismes garantissant une disponibilité minimale de 99,97 %, y compris en période de maintenance • Définir les mécanismes de sauvegarde, de restauration et de reprise associés • Évaluer les impacts, les risques, les coûts de build et de run ainsi que les gains associés L'expert devra également aider à l'élaboration de la feuille de route de migration : • Définir les différentes étapes de migration • Identifier les prérequis techniques et organisationnels • Estimer les charges et les délais • Construire le plan de transition vers la production La mission intègre aussi les aspects FinOps et d'optimisation des coûts : • Choix des composants • Définition de la gestion opérationnelle de l'exploitation, notamment des périodes de disponibilité et d'indisponibilité par environnement • Industrialisation de la gestion de la plateforme et du suivi de la consommation Compétences / Qualités indispensables : Architecture Cloud, Kubernetes, MongoDB, IaaS / PaaS, FinOps, Security by Design Compétences / Qualités qui seraient un + : / Informations concernant le télétravail : Oui — 2 jours/semaine
Ingénieur de Production - Expert Monitoring & Observabilité (Operations Bridge Suite) 1. Contexte Au sein d'une Direction des Systèmes d'Information d'un grand groupe international, vous intégrerez une équipe en charge des services de production informatique. Cette équipe a pour mission de garantir la disponibilité, la performance et la fiabilité des infrastructures et des applications critiques. Dans un contexte de transformation des plateformes de supervision et de développement de l'observabilité, vous contribuerez à l'évolution des solutions de monitoring afin d'améliorer la qualité de service, la maîtrise des risques opérationnels et l'efficacité des opérations IT. Informations complémentaires : Démarrage : Septembre Durée de mission : 3 ans Télétravail : 2 jours à distance / 3 jours sur site 2. Missions En tant qu'Expert Monitoring & Observabilité, vous serez chargé(e) de : Assurer le suivi quotidien de la production des outils de monitoring (qualité de service, disponibilité, KPI, indicateurs de performance). Accompagner les équipes techniques et les projets dans la définition et la mise en œuvre de leurs besoins en supervision et observabilité. Concevoir, configurer et maintenir les solutions de monitoring basées sur la suite OpenText Operations Bridge (Operations Bridge Manager, Network Node Manager, Optic Data Lake, HSO) dans des environnements on-premise et Cloud (AWS, GCP). Déployer les pratiques d'observabilité en s'appuyant sur les standards OpenTelemetry. Participer aux comités de suivi et assurer une communication régulière avec les équipes techniques et les parties prenantes. Contribuer à l'amélioration continue de la plateforme : renforcement de la stabilité des solutions de supervision ; développement de nouvelles capacités de surveillance ; définition et suivi de KPI par typologie d'événements et d'équipements ; optimisation des processus de monitoring.
Dans le cadre d'une mission auprès d'un grand groupe du secteur de l'énergie, nous recherchons un(e) Expert(e) Technique WebMethods / CaaS pour rejoindre une équipe spécialisée dans les échanges de données, l'intégration applicative et l'API Management. Votre missionVous interviendrez au sein d'une équipe d'expertise en charge d'une plateforme iPaaS basée sur la suite webMethods d'IBM, dans un environnement à forts enjeux de disponibilité, de performance et de sécurité. Vos principales missions seront de : Apporter votre expertise dans la conception, l'implémentation et l'évolution de solutions autour de la suite webMethods ; Concevoir et implémenter des services transverses permettant l'industrialisation de la plateforme iPaaS ; Contribuer au maintien en condition opérationnelle (MCO) de la plateforme et assurer le support technique de niveau 3 (SN3) ; Analyser et traiter les incidents jusqu'à leur résolution ; Participer aux évolutions de la plateforme, de l'analyse du besoin jusqu'à la mise en production ; Concevoir des prototypes et des maquettes autour de sujets innovants : IA Générative / IA Gateway, API Management, IAM et sécurisation des échanges ; Réaliser des tests de performance et contribuer à l'optimisation de la plateforme ; Définir des patterns d'architecture, guides de bonnes pratiques, guides de configuration et documentation technique ; Participer à l'amélioration continue et à l'industrialisation des pratiques DevSecOps / CI-CD ; Travailler dans un environnement Agile en utilisant notamment Jira et Confluence.
Contexte Nous recherchons un Senior System Engineer Virtualization pour renforcer une équipe Infrastructure et intervenir sur des environnements critiques de virtualisation, stockage, sauvegarde, haute disponibilité et Disaster Recovery. Le consultant jouera un rôle clé dans le maintien de la performance, de la disponibilité et de la continuité des services IT dans le secteur public belge. Le posteLe System Engineer Virtualization & Storage assure quotidiennement la gestion et l'optimisation des systèmes et de l'infrastructure afin de garantir la performance et la disponibilité des services. Il gère les systèmes et infrastructures des datacenters nécessaires au fonctionnement des applications hébergées. Il est également responsable de la préparation et de la mise en œuvre des nouvelles installations, des changements et des mises à niveau.
Contexte de la missionDans le cadre de l'exploitation d'une prestation critique hébergée sur un Cloud privé, nous recherchons un Ingénieur de Production / Site Reliability Engineering (SRE) afin d'intégrer une équipe de 5 ingénieurs en charge du maintien en conditions opérationnelles (MCO) d'une plateforme stratégique pilotée par un ministère. Vous contribuerez à garantir la disponibilité, la fiabilité et la performance des applications en production tout en accompagnant la transformation vers un modèle SRE et Cloud. Vos missionsAssurer le MCO des applications et infrastructures en environnement Cloud privé. Garantir le respect des SLA et le traitement des tickets Jira. Superviser les plateformes, assurer le monitoring et l'observabilité des systèmes. Analyser les incidents, identifier les causes racines et mettre en œuvre des actions correctives durables. Automatiser les opérations d'exploitation via Ansible, scripts Bash et outils DevOps. Participer aux déploiements applicatifs et infrastructures (CI/CD, GitOps). Gérer les environnements Recette, Préproduction et Production. Administrer les plateformes Docker et Kubernetes. Optimiser les performances, la disponibilité et la résilience des services. Maintenir et enrichir la documentation d'exploitation. Collaborer avec les équipes de développement, infrastructure et Service Delivery. Compétences indispensablesAnsible Docker MySQL Observabilité / Monitoring Linux GitLab CI / GitOps Bash / scripting Kubernetes Gestion des incidents de production Français courant Compétences appréciéesZabbix Grafana OpenSearch Redis Rundeck Rancher RKE2 NGINX Vault Morpheus CMP S3 Airflow Réseau (LAN/WAN, routage, Load Balancer, TLS, PKI) ITIL ISO 27001 / ISO 9001 Soft SkillsExcellente capacité d'analyse et de résolution d'incidents. Résistance au stress et gestion des priorités. Esprit d'équipe et sens du service. Forte autonomie. Bonnes capacités de communication. Force de proposition et démarche d'amélioration continue. Capacité à évoluer dans un environnement critique. LivrablesRespect des SLA et traitement des tickets Jira. Documentation d'exploitation. Automatisation des procédures. Mise en production des évolutions. Suivi de la disponibilité et des performances des plateformes.
Contexte de la missionL'OPS assure la conduite et l'exploitation des applications afin d'en garantir la disponibilité et le maintien en condition opérationnelle, tout en contribuant à la boucle d'amélioration continue. Il coordonne les différents intervenants sur le cycle de vie des applications dont il a la charge (il peut en gérer plusieurs en parallèle). Assurer la disponibilité des applications, traiter les incidents et demandes de travaux (DT) Suivre et capitaliser sur la résolution des incidents, proposer des améliorations/industrialisations Coordonner les intervenants, identifier les points de blocage et solutions de contournement Sécuriser les changements et leur impact utilisateurs (planification, pilotage) Piloter l'exploitant applicatif de niveau 1 Contribuer aux volets Assistance Applicative, Conduite des Échanges et Gestion des Accès
Dans le cadre du maintien en conditions opérationnelles et de l'évolution des infrastructures d'un environnement de production critique, nous recherchons un(e) Expert Réseau & Infrastructure justifiant d'au moins 7 ans d'expérience. Vous intégrerez une Squad Agile et collaborerez avec les équipes Infrastructure, Production, Réseaux, Sécurité et les équipes projets afin de garantir la disponibilité, la performance, la sécurité et la fiabilité des plateformes. Tâches à réaliser : Dans le cadre de cette mission, vous serez amené(e) à : Administration et exploitation Assurer le maintien en conditions opérationnelles des infrastructures et des plateformes d'hébergement. Administrer et optimiser les infrastructures réseau (LAN, WAN, gestion des flux, interconnexions et sécurité réseau). Gérer et faire évoluer les environnements VMware, les infrastructures de stockage et les solutions de sauvegarde. Garantir la disponibilité, les performances et la capacité des infrastructures. Support et exploitation Prendre en charge les incidents et problèmes de niveau N2/N3 sur les environnements systèmes et réseaux. Réaliser les analyses techniques afin d'identifier les causes racines et mettre en oeuvre des solutions durables. Participer à l'amélioration continue de la qualité de service. Évolution des infrastructures Participer aux projets de déploiement, de migration et de modernisation des infrastructures. Contribuer aux évolutions des socles techniques, à leur standardisation et à la réduction de la dette technique. Formuler des recommandations techniques et participer aux choix d'architecture d'infrastructure. Sécurité Mettre en oeuvre les mesures de sécurité opérationnelle. Gérer les vulnérabilités et le durcissement des systèmes. Veiller au respect des standards de sécurité des systèmes d'information. Assurer le suivi des ouvertures et fermetures de flux réseau. Supervision et automatisation Superviser les infrastructures et améliorer la fiabilité des services grâce aux outils de monitoring. Développer et maintenir des scripts d'automatisation, notamment avec Ansible. Produire et maintenir la documentation technique ainsi que les procédures d'exploitation.
Contexte Dans le cadre de la montée en maturité de la plateforme Salesforce d'un grand compte du secteur assurance, la mission vise à accompagner les équipes en Maintenance en Conditions Opérationnelles (MCO) et les équipes Agile dans l'analyse des incidents techniques, la supervision de la plateforme et l'amélioration des performances. La prestation s'exerce en collaboration étroite avec la Design Authority, le MCO et les équipes Agile. L'enjeu principal est de rendre ces équipes autonomes dans la gestion courante des incidents, la Design Authority restant le support d'expertise sur les cas les plus complexes. Rôle et responsabilités principales Exploiter et promouvoir les outils de monitoring et d'observabilité Salesforce (Portail KPI, Event Monitoring, Smart Observer, Analytics, etc.). Analyser les incidents techniques et les problématiques de performance à l'aide des outils de supervision (Kibana, Elastic Search, logs Salesforce, monitoring des flux, etc.). Formaliser les bonnes pratiques d'investigation, de diagnostic et de résolution des incidents. Accompagner la montée en compétence des équipes MCO et Agile par le coaching, le transfert de connaissances et la documentation. Diffuser les bonnes pratiques Salesforce en matière de développement, d'architecture et de performance. Travailler en collaboration étroite avec la Design Authority, le MCO et les équipes Agile. Livrables attendus Documentation des bonnes pratiques d'investigation, de diagnostic et de résolution des incidents. Supports de transfert de compétences et de coaching à destination des équipes MCO et Agile. Recommandations et bonnes pratiques Salesforce en développement, architecture et performance.
Dans le cadre de l'industrialisation de solutions d'Intelligence Artificielle Générative au sein d'un environnement de cybersécurité, nous recherchons un Expert Observabilité IA & Agentic AI. Vous interviendrez au sein d'un environnement SOC sur des problématiques à la croisée de la cybersécurité, de l'IA générative, du Cloud et de l'observabilité. L'objectif du poste est de concevoir, implémenter et opérer les mécanismes permettant d'assurer la fiabilité, la sécurité, la performance, la qualité et la traçabilité des agents IA utilisés dans les opérations de cybersécurité. Vous contribuerez notamment à la mise en place d'une plateforme agentique industrialisée et à son intégration avec les outils du SOC, notamment Splunk. Vos principales responsabilités1. Observabilité des systèmes IADéfinir et mettre en œuvre la stratégie d'observabilité de la plateforme agentique. Mettre en place le monitoring des agents IA, workflows et chaînes d'orchestration. Superviser les architectures basées sur LangChain / LangGraph. Mettre en place la collecte et la corrélation des métriques techniques, fonctionnelles et métier. Concevoir des dashboards permettant de suivre en temps réel les performances et la qualité des agents. Assurer la traçabilité des interactions entre les utilisateurs, les agents, les LLM et les différents outils. Mettre en place des mécanismes de détection des comportements anormaux ou inattendus. Identifier les hallucinations, dérives et dégradations de performance des modèles. 2. AI Reliability EngineeringConcevoir et mettre en œuvre des frameworks d'évaluation continue des agents IA. Définir les KPI de qualité, performance et fiabilité des agents. Mettre en place des mécanismes de suivi des SLA / SLO. Identifier les causes racines des défaillances des agents et des workflows. Optimiser continuellement la qualité et les performances des solutions IA. Suivre et optimiser les coûts d'utilisation des modèles et infrastructures. 3. Sécurité des systèmes IAIdentifier et superviser les risques liés à l'utilisation de systèmes d'IA générative. Participer à la définition des mécanismes de gouvernance des agents IA. Détecter les comportements anormaux, malveillants ou dangereux des agents. Participer aux analyses de risques liées aux systèmes IA. Contrôler les accès, permissions et interactions entre les agents et les systèmes externes. Contribuer à la sécurisation des architectures RAG, LLM et Agentic AI. Mettre en place des mécanismes de traçabilité et d'audit des actions réalisées par les agents. 4. Intégration avec le SOC et SplunkIntégrer les événements et logs des plateformes IA dans Splunk. Concevoir les dashboards d'exploitation et de supervision. Développer des alertes de détection spécifiques aux systèmes IA. Créer des corrélations entre les événements de cybersécurité et les événements générés par les agents IA. Exploiter les capacités SIEM/SOAR pour superviser les risques liés aux agents. Contribuer à la création de nouveaux use cases de détection. Produire les indicateurs nécessaires aux équipes SOC et aux équipes opérationnelles. Participer à l'amélioration continue des capacités de détection et de réponse. 5. RUN & Amélioration continueAssurer le maintien en condition opérationnelle de la plateforme d'observabilité. Investiguer les incidents liés aux agents et aux composants IA. Analyser les dysfonctionnements et identifier les causes racines. Participer à la résolution des incidents de production. Optimiser les performances, la disponibilité et les coûts. Documenter les architectures, procédures et mécanismes de supervision. Participer à l'amélioration continue de la plateforme. Environnement techniqueIA Générative & Agentic AIArchitectures Agentic AI LangChain LangGraph AWS Bedrock Agents Bedrock LLM RAG Embeddings Bases de données vectorielles MCP LangSmith LLM Observability LLM Evaluation CybersécuritéEnvironnement SOC CERT / CSIRT Incident Response Threat Hunting MITRE ATT&CK Sécurité des systèmes IA AI Risk / AI Governance SIEM / SOARSplunk / Splunk Enterprise Security SOAR Cortex XSOAR Corrélation d'événements Détection et alerting Développement & DevOpsPython avancé APIs REST Git GitLab CI/CD Infrastructure as Code Terraform CloudAWS AWS Bedrock Services AWS liés à l'IA et à la sécurité
Vorstone recherche un Ingénieur DEVOPS Système Ansible pouun de nos clients basé à Marseille/Aix-en Provence. En tant qu'ingénieur DevOps intégré à l'équipe Systèmes, votre rôle est de piloter le maintien et l'évolution des scripts et produits applicatifs. Vous agirez soit en délégation de l'équipe Cloud & DevOps, et sous la responsabilité directe de l'équipe Systèmes, garantissant ainsi une continuité opérationnelle optimale. Domaines d'intervention : Observabilité & Monitoring : Mise en place et maintenance des outils d'observabilité pour l'ensemble des produits du Train et de la System Team, assurant une visibilité proactive sur la santé des systèmes. Accompagnement des équipes Agiles vers l'auto-suffisance technique via : La création de guidelines et de User Guides. L'animation de trainings dédiés. L'intégration de features spécifiques sur des outils clés comme EDB, Liquibase, ou Kasten. Intégration Continue (CI) : Déploiement et gestion des chaînes CI (notamment via Ansible Tower). Je veille à ce que ces solutions restent alignées avec les roadmaps de la System Team et du Cloud & DevOps. Automatisation des Tests : Conception et implémentation de solutions de tests automatisés pour sécuriser les cycles de livraison. Expertise Régilienne : Apport d'un haut niveau d'expertise technique sur les fonctions régaliennes au profit de la System Team, garantissant la conformité et la robustesse des infrastructures.
Nous recherchons pour l'un de nos clients un(e) Ingénieur IA – Google Cloud Platform (H/F). Pour le département IT Operations & Finance, nous recherchons un profil disposant d'une forte expertise en ingénierie IA afin de concevoir des agents IA, mettre en place des échanges agent à agent, et les intégrer dans un environnement Google Cloud Platform. L'objectif est de passer d'une preuve de concept à des solutions fiables, sécurisées et industrialisées, grâce à une approche mêlant développement Python, API, orchestration d'agents, observabilité et CI/CD. Missions principales Concevoir et développer des agents IA pour certains cas d'usage métiers. Développer des API et services Python asynchrones avec FastAPI. Conteneuriser les applications et les déployer sur Cloud Run. Mettre en place des serveurs MCP pour exposer de manière sécurisée des outils et données internes aux agents. Développer des workflows d'agents à l'aide du framework Concevoir des mécanismes de communication agent à agent basés sur des événements et/ou du RPC. Définir les schémas de messages, le routage, les mécanismes de retry et la gestion d'état. Intégrer les solutions avec Vertex AI ou un équivalent pour les appels modèles, les filtres de sécurité et les évaluations. Mettre en place l'observabilité : logs, traces, métriques, monitoring. Définir des guardrails de sécurité : DLP, gestion des secrets, IAM. Documenter l'architecture, les procédures d'exploitation et assurer la passation à l'équipe. Accompagner l'équipe métier dans l'adoption de cas d'usage liés à l'IA générative.
ContexteDans le cadre d'un programme stratégique de transformation digitale, nous recherchons un Migration Technical Lead pour accompagner le déploiement d'une nouvelle plateforme d'IA Agentique. Cette plateforme constituera le socle technologique des futurs projets d'Intelligence Artificielle de l'entreprise. Elle permettra de développer, orchestrer, sécuriser, héberger et superviser des agents IA autonomes capables d'interagir entre eux au sein d'une architecture multi-agents. Vous rejoindrez une équipe intervenant sur un projet innovant mêlant Cloud, DevOps, Platform Engineering et Intelligence Artificielle Générative. Vos missions En tant que Migration Technical Lead, vous serez le référent technique des équipes projets durant leur migration vers cette nouvelle plateforme d'IA. À ce titre, vous serez amené(e) à : Accompagnement des projetsAccompagner les équipes dans la migration de leurs applications vers la plateforme IA. Comprendre les besoins des différents projets et proposer les meilleures approches techniques. Identifier les risques techniques liés aux migrations. Garantir une migration fluide et sécurisée des applications. Support techniqueAnalyser les incidents et problématiques rencontrés lors des migrations. Qualifier et suivre les demandes via Jira et ServiceNow. Proposer des solutions techniques adaptées. Coordonner les actions de support avec les différentes équipes. DocumentationRédiger les guides de migration et les bonnes pratiques. Alimenter la documentation technique sous Confluence. Capitaliser les retours d'expérience afin d'améliorer les processus de migration. IndustrialisationParticiper à l'amélioration des pipelines CI/CD. Développer les scripts et composants nécessaires à l'automatisation des migrations. Contribuer aux outils facilitant l'intégration des projets sur la nouvelle plateforme. Collaboration transverseTravailler en étroite collaboration avec les équipes Cloud, DevOps, MLOps, Sécurité et Développement. Participer aux échanges techniques et accompagner les équipes dans la résolution des problématiques complexes. Être un véritable facilitateur entre les différentes parties prenantes. Environnement techniqueCloudGoogle Cloud Platform (GCP) Google Kubernetes Engine (GKE) AWS ou Azure (selon les projets) DevOps / Platform EngineeringGitLab CI/CD ArgoCD Docker Kubernetes API ManagementKong Apigee ObservabilitéDynatrace Monitoring Logging Intelligence Artificielle GénérativeLLM (Large Language Models) Mistral AI Google Gemini Plateformes d'IA Agentique Architecture multi-agents
1. Coordination de la conception et de l'implémentation de la sécurité : · Coordonner la conception, l'implémentation et le maintien des mesures de sécurité au sein des systèmes du département. · Coordonner la gestion des contrôles d'accès et des permissions basés sur les rôles, ainsi que la revue et le durcissement des comptes techniques. · Coordonner le maintien et l'audit des permissions d'export et de la configuration liée aux intégrations et aux contrôles d'accès API. 2. Coordination du Monitoring et du Logging : · Coordonner la mise en œuvre et le maintien des systèmes de surveillance et de journalisation de sécurité pour détecter et répondre aux menaces. · Coordonner la configuration des alertes de sécurité et le suivi des menaces, ainsi que la prévention des exports de données. 3. Plan de Reprise d'Activité (DRP) et Prévention de la Perte de Données (DLP) : · Coordonner le développement et l'implémentation des stratégies DLP pour empêcher la sortie de données sensibles. · Coordonner les stratégies DRP (définition du RTO et RPO avec les équipes business et plateforme), incluant les tests et simulations de reprise, en lien avec les éditeurs concernés et leurs équipes support. 4. Plan de Gestion de Crise : · Piloter la préparation d'un plan de gestion de crise cyber pour le département, définissant la chaîne de communication en cas d'incident (interne et externe), les personnes clés et leurs rôles, et les procédures d'escalade. · Prioriser ce plan sur le domaine D2C (Priorité 1), avec extension prévue aux autres domaines du département. 5. Gestion des Vulnérabilités : · Coordonner les évaluations de sécurité et les audits avec l'équipe Cybersécurité MH et le support aux équipes plateformes, sur l'ensemble des domaines du département. 6. Réponse à Incident : · Participer aux activités de réponse à incident liées aux brèches ou incidents de sécurité touchant les systèmes du département : investigation des événements de sécurité, contention des menaces, mise en œuvre des actions correctives. 7. Sensibilisation et Formation à la Sécurité : · Animer la sensibilisation à la sécurité auprès des équipes du département, afin de promouvoir les bonnes pratiques et réduire le risque d'incidents. 8. Documentation : · Créer et maintenir une documentation complète des configurations, politiques et procédures de sécurité du département.