Dans le cadre d'une équipe pluridisciplinaire dédiée à l'IA, le consultant contribuera à la construction et à l'industrialisation du socle technique. Il interviendra notamment sur : • La conception et la mise en œuvre de l'architecture technique des solutions IA. • Le déploiement et la configuration des environnements cloud, des services d'infrastructure et des composants nécessaires à l'exploitation des cas d'usage IA. • La mise en place des dispositifs de sécurité, de gestion des identités (IAM), de gestion des secrets et de conformité associés aux cas d'usage IA. • La construction et l'industrialisation des chaînes de déploiement CI/CD ainsi que des pratiques Infrastructure as Code (IaC). • L'intégration des briques IA : modèles, gateways LLM, orchestrateurs agentiques, APIs, connecteurs et bases documentaires. • La mise en œuvre des outils d'observabilité, de supervision, de monitoring, de logging et de suivi des performances. • La garantie de la robustesse, de la scalabilité, de la traçabilité, de la maîtrise des coûts et de la réversibilité de la plateforme. • La contribution aux choix d'architecture et aux recommandations permettant une exploitation industrielle durable. Livrables attendus : • Architecture technique détaillée de la plateforme. • Schémas d'intégration et d'urbanisation. • Socle technique déployé et opérationnel. • Pipelines CI/CD industrialisés. • Documentation d'exploitation et procédures opérationnelles. • Recommandations d'industrialisation, de sécurisation et de montée en charge. • Dossiers de supervision, d'observabilité et de maîtrise des coûts.
Le consultant interviendra sur l'ensemble du cycle de vie des solutions AI/ML, de l'identification des cas d'usage jusqu'à la mise en production, avec un fort enjeu de sécurité, scalabilité et industrialisation. Missions principales : - Identifier, analyser et prioriser les cas d'usage AI/ML appliqués à la cybersécurité et à l'IAM. - Développer des modèles de Machine Learning permettant de détecter les comportements utilisateurs anormaux, les schémas d'accès suspects et les potentielles menaces de sécurité. - Concevoir, tester et déployer des modèles AI/ML scalables intégrables aux plateformes de cybersécurité. - Développer des solutions AI, LLM et Advanced Analytics. - Concevoir et optimiser les prompts, les sorties structurées et les mécanismes d'évaluation des modèles. - Mettre en place le monitoring et l'évaluation des solutions AI/ML. - Industrialiser les modèles et solutions analytiques jusqu'à leur mise en production. - Garantir la qualité, la maintenabilité, les tests et l'intégration continue. - Prendre en charge les projets de bout en bout, de la phase de découverte jusqu'à la livraison. - Collaborer avec les équipes Engineering, Cybersécurité et métiers.
Dans le cadre d'une mission auprès d'un grand groupe du secteur de l'énergie, nous recherchons un(e) Expert(e) Technique WebMethods / CaaS pour rejoindre une équipe spécialisée dans les échanges de données, l'intégration applicative et l'API Management. Votre missionVous interviendrez au sein d'une équipe d'expertise en charge d'une plateforme iPaaS basée sur la suite webMethods d'IBM, dans un environnement à forts enjeux de disponibilité, de performance et de sécurité. Vos principales missions seront de : Apporter votre expertise dans la conception, l'implémentation et l'évolution de solutions autour de la suite webMethods ; Concevoir et implémenter des services transverses permettant l'industrialisation de la plateforme iPaaS ; Contribuer au maintien en condition opérationnelle (MCO) de la plateforme et assurer le support technique de niveau 3 (SN3) ; Analyser et traiter les incidents jusqu'à leur résolution ; Participer aux évolutions de la plateforme, de l'analyse du besoin jusqu'à la mise en production ; Concevoir des prototypes et des maquettes autour de sujets innovants : IA Générative / IA Gateway, API Management, IAM et sécurisation des échanges ; Réaliser des tests de performance et contribuer à l'optimisation de la plateforme ; Définir des patterns d'architecture, guides de bonnes pratiques, guides de configuration et documentation technique ; Participer à l'amélioration continue et à l'industrialisation des pratiques DevSecOps / CI-CD ; Travailler dans un environnement Agile en utilisant notamment Jira et Confluence.
Dans le cadre de son ambitieux programme DRIVE 2030, AGL modernise en profondeur son système d'information afin d'accompagner la croissance du groupe MSC et de digitaliser ses activités logistiques. Ce programme stratégique, lancé pour une durée de 5 ans, vise notamment à : Remplacer les différents Transport Management Systems (TMS) par une plateforme unique. Digitaliser et optimiser les processus métiers. Standardiser les bonnes pratiques au sein des filiales. Moderniser l'ensemble des échanges entre le TMS et le système d'information. Vous rejoindrez une équipe internationale d'une quarantaine de collaborateurs basée au siège parisien et travaillerez en étroite collaboration avec les équipes Infrastructure, Applicatives, Run, Métiers et les filiales internationales. En tant qu'Expert Monitoring & Observabilité, vous serez garant de la supervision des applications critiques et de la stratégie d'observabilité du programme. Définition de la stratégie d'observabilitéDéfinir les standards de monitoring avant chaque mise en production. Identifier les composants critiques et les parcours utilisateurs à superviser. Définir les métriques, logs, traces et événements nécessaires au pilotage des applications. Participer à la feuille de route Datadog & Splunk. Structurer l'observabilité autour des notions de disponibilité, performance, capacité, erreurs et saturation. Mise en œuvre de la supervision DatadogDéployer et administrer les solutions Datadog. Configurer les intégrations et la collecte des métriques. Concevoir des dashboards adaptés aux équipes Run, Infrastructure, Applicatives et Management. Superviser les API, services, URL, certificats, traitements batch et files d'attente. Mettre en place les Service Maps afin de cartographier les dépendances applicatives. Créer les monitors, alertes composites et mécanismes de détection d'anomalies. Corréler métriques, traces et logs. Automatiser le déploiement des dashboards et des configurations.Supervision Splunk Déployer et administrer la collecte des logs. Construire les dashboards et alertes. Optimiser l'exploitation des données de supervision. Industrialisation du système d'alertingDéfinir des seuils d'alerte pertinents. Réduire les faux positifs et limiter le bruit opérationnel. Classifier les alertes selon leur criticité. Définir les workflows d'escalade. Documenter chaque alerte (diagnostic, actions, responsables, escalade). Intégrer les alertes aux outils de communication et de gestion des incidents. Participer à l'automatisation des incidents via ServiceNow.
Un site e-commerce international utilisant Salesforce Marketing Cloud (SFMC) souhaité développer l'usage de WhatsApp à partir son environnement Salesforce et utiliser au maximum les crédits Salesforce déjà disponibles. Nous recherchons un profil capable de les accompagner sur la conception technique, comprendre l'architecture, et opérer l'intégration et la mise en œuvre des parcours WhatsApp dans l'écosystème Salesforce. Hard skills indispensables : Expertise de Salesforce Marketing Cloud. Expérience concrète de mise en œuvre de WhatsApp dans un environnement Salesforce (Priotité au outbound, les deux avec Inbound serait un plus). Très bonne maîtrise de : · Journey Builder · Automation Studio · Contact Builder · Data Extensions · Segmentation et gestion des audiences · Triggers événementiels · Gestion des messages transactionnels · Orchestration multicanale · Maîtrise de WhatsApp Business Platform / Meta. · Bonne connaissance des contraintes techniques et opérationnelles WhatsApp : · templates · Catégories de messages · Gestion des sessions de conversation · Opt-in / opt-out · Gestion des numéros · Gestion multi-pays / multilingue. Capacité à analyser les fonctionnalités Salesforce disponibles et à déterminer comment utiliser au mieux les crédits Salesforce existants. Le profil doit être capable de concevoir la solution en s'appuyant sur l'architecture existante et nécessaire à l'intégration WhatsApp / Salesforce. Compétences recherchées : · Salesforce Marketing Cloud APIs · REST API / SOAP API · WhatsApp Business Platform / Cloud API · Webhooks · Intégration Meta / Salesforce · Gestion des messages entrants et sortants · Triggering de Journey Builder depuis des événements externes · Synchronisation CRM / SFMC · Gestion des identifiants clients · Contact Key / Subscriber Key · Conception des Data Extensions · Gestion des consentements · Gestion des templates WhatsApp · Personnalisation dynamique des messages · Gestion des erreurs et mécanismes de retry · Monitoring des flux · Logging et traçabilité · Gestion des volumes et de la scalabilité · Sécurité des échanges API · Gestion des environnements DEV / QA / PROD. · Ecosystème Salesforce Une bonne compréhension de l'écosystème Salesforce au-delà de SFMC est souhaitée, notamment : · Service Cloud · Salesforce Messaging / Digital Engagement · Data Cloud · Salesforce CRM · Marketing Cloud Engagement · Éventuellement Marketing Cloud Next selon l'architecture existante. · Architecture attendue (en s'appuyant également sur les compétences internes) Devra être capable de challenger différentes options techniques, avec en priorité l'utilisation des crédits / salesforce native, et identifier les impacts en termes de licences, consommation de crédits Salesforce, coûts Meta, complexité technique, maintenance, scalabilité, réversibilité,… Soft skills : Nous recherchons quelqu'un : · Autonome · Senior · Pragmatique · Capable de challenger une architecture · Capable d'expliquer simplement des sujets techniques complexes · Structuré dans ses recommandations · Capable d'interagir avec les équipes Salesforce, CRM, IT et intégration · Capable de distinguer clairement ce qui est natif Salesforce de ce qui nécessite un développement ou une solution tierce · Ayant déjà participé à des projets Salesforce / WhatsApp en production.
- Réalisation de migrations d'infrastructures réseau. - Déploiement et configuration de nouveaux sites. - Mise en place et évolution de VPN. - Création et administration de VRF. - Réalisation d'upgrades majeurs des infrastructures réseau et sécurité. - Gestion de l'obsolescence des équipements. - Configuration et administration des équipements LAN / WAN. - Administration des firewalls et solutions de sécurité réseau. - Gestion des proxys. - Supervision et monitoring des infrastructures réseau. - Administration et évolution des infrastructures Wi-Fi. - Analyse et résolution des incidents complexes. - Participation aux phases de conception, déploiement, migration et validation des solutions. - Rédaction et mise à jour de la documentation technique. Compétences techniques attendues: Réseau: - LAN / WAN - Switching / Routing - VLAN / VRF - VPN - Wi-Fi - Monitoring / Supervision Sécurité réseau: - Firewalls - Proxy - VPN - Sécurisation des flux réseau - Gestion des règles de filtrage Constructeurs / Technologies Une bonne maîtrise d'un ou plusieurs des environnements suivants est attendue : - Cisco - Cisco Firepower - Palo Alto - Stormshield - Fortinet
Dans le cadre du renforcement de ses équipes Infrastructure & Opérations, notre client recherche un Ingénieur Ops confirmé afin de garantir la disponibilité, la performance et la fiabilité de ses plateformes digitales. Au sein d'un environnement Cloud moderne et fortement orienté DevOps, vous intervenez sur l'exploitation, la supervision et l'amélioration continue des services. Véritable acteur de la fiabilité opérationnelle, vous assurez la gestion des incidents, l'analyse des causes racines et la mise en œuvre des actions correctives nécessaires au maintien d'un haut niveau de qualité de service. En collaboration avec les équipes produits, développement et exploitation, vos principales responsabilités seront : Assurer le maintien en conditions opérationnelles des plateformes. Superviser les environnements de production et piloter les incidents. Identifier et analyser les causes racines des dysfonctionnements. Mettre en place et améliorer les dispositifs de monitoring, d'observabilité et d'alerting. Exploiter les métriques, logs et indicateurs de performance afin d'optimiser la qualité de service. Participer à l'automatisation des opérations et à l'amélioration des pipelines de déploiement. Accompagner les équipes dans la définition et le suivi des SLA, SLO et KPI. Diffuser les bonnes pratiques DevOps et ITSM. Contribuer aux initiatives d'amélioration continue visant à renforcer la résilience et la performance des services. Cette mission s'inscrit dans un contexte international exigeant, avec de forts enjeux de disponibilité et de performance.
Pour le compte d'un acteur majeur du transport et du digital, nous recherchons un Expert OpenTelemetry Azure (H/F) pour intervenir sur une mission à forte visibilité autour de l'observabilité et du monitoring cloud. Contexte Dans le cadre d'un projet d'amélioration de la supervision et de l'observabilité de son écosystème Azure, notre client souhaite industrialiser la collecte de logs, métriques et traces sur plusieurs centaines d'applications cloud. L'objectif est de déployer et configurer une solution de monitoring centralisée basée sur OpenTelemetry afin d'améliorer la visibilité, la performance et la fiabilité des services. Missions Définir et mettre en œuvre l'architecture OpenTelemetry sur Azure Installer et configurer les OpenTelemetry Collectors Instrumenter et superviser un parc important d'Azure Functions et Function Apps Assurer l'intégration avec les outils de monitoring et d'observabilité existants Accompagner les équipes techniques sur les bonnes pratiques de traçabilité et de supervision Participer à l'automatisation du déploiement et au suivi des performances Environnement technique OpenTelemetry (OTel) Azure Functions / Function Apps Azure Monitor Azure DevOps Infrastructure Cloud Azure
Dans le cadre du renforcement d'une équipe Infrastructure & Production, nous recherchons un DBA PostgreSQL Production confirmé à expert pour intervenir sur des environnements critiques à forte volumétrie. Le consultant sera en charge de l'administration, de l'exploitation, de l'optimisation et de la sécurisation des bases de données PostgreSQL, avec une forte expertise sur les problématiques de haute disponibilité, réplication, performance et production. Missions principales * Administrer et exploiter les bases PostgreSQL en production. * Assurer la supervision, le monitoring et l'optimisation des performances. * Mettre en œuvre et gérer les mécanismes de haute disponibilité et réplication. * Administrer les sauvegardes, restaurations et plans de reprise d'activité (PRA). * Gérer les incidents et assurer le support N2/N3. * Mettre en place et maintenir les procédures d'exploitation. * Automatiser les tâches d'administration et d'exploitation. * Participer aux projets de migration, d'évolution et d'architecture. * Renforcer la sécurité des accès aux bases de données. * Mettre en place et maintenir les solutions de monitoring. * Collaborer avec les équipes Systèmes, DevOps et Applicatives. * Contribuer à la définition et au respect des standards et normes DBA.
Contexte Nous recherchons un Senior System Engineer Virtualization pour renforcer une équipe Infrastructure et intervenir sur des environnements critiques de virtualisation, stockage, sauvegarde, haute disponibilité et Disaster Recovery. Le consultant jouera un rôle clé dans le maintien de la performance, de la disponibilité et de la continuité des services IT dans le secteur public belge. Le posteLe System Engineer Virtualization & Storage assure quotidiennement la gestion et l'optimisation des systèmes et de l'infrastructure afin de garantir la performance et la disponibilité des services. Il gère les systèmes et infrastructures des datacenters nécessaires au fonctionnement des applications hébergées. Il est également responsable de la préparation et de la mise en œuvre des nouvelles installations, des changements et des mises à niveau.
Pour l'un de nos clients du secteur e-commerce / retail, nous recherchons un expert WhatsApp Business Platform / CRM conversationnel afin d'accompagner les équipes IT et métiers dans un projet d'intégration de WhatsApp au sein de leur écosystème CRM. Le client a fait le choix de développer sa propre solution en interne afin de conserver la maîtrise de son architecture, de ses données et de ses parcours CRM. L'objectif de la mission est donc d'apporter une expertise externe sur les bonnes pratiques WhatsApp, les choix d'architecture, les contraintes Meta / WhatsApp Business Platform et les recommandations adaptées à un environnement CRM complexe. L'expert interviendra en appui des équipes IT, CRM, marketing et métiers afin de : Cadrer les cas d'usage WhatsApp dans l'écosystème CRM existant ; Challenger et sécuriser les choix d'architecture cible ; Apporter les bonnes pratiques liées à WhatsApp Business Platform / WhatsApp Business API ; Accompagner les équipes sur les sujets d'opt-in, consentement, templates, règles d'envoi et gouvernance des messages ; Définir les recommandations d'intégration avec les outils CRM, data, marketing automation ou CDP ; Conseiller sur les flux techniques : API, webhooks, événements, tracking, monitoring, logs et gestion des erreurs ; Identifier les risques liés à la délivrabilité, à la conformité, à la sécurité et à la qualité de la donnée ; Produire des recommandations claires permettant aux équipes internes de développer la solution en autonomie ; Accompagner les équipes dans la mise en place d'un socle robuste, maintenable et scalable. Livrables attendus Analyse de l'existant CRM / data / architecture. Recommandations d'architecture WhatsApp. Bonnes pratiques d'intégration WhatsApp Business Platform. Recommandations sur la gestion des opt-in, templates et consentements. Schémas de flux fonctionnels et techniques. Liste des points de vigilance sécurité, RGPD, data et exploitation. Support aux équipes IT et métiers dans les arbitrages.
Informations Mission Rôle : Ingénieur DevSecOps & SRE — Industrialisation IA Agentique Localisation : Colombes ou Toulouse (Rythme : 2 à 3 jours de télétravail par semaine) Budget / TJM d'achat max : 640 € HT / jour Date de démarrage : 01/10/2026 Durée : Jusqu'au 31/03/2028 (Mission longue durée) Contexte & Objectifs de la MissionAu sein de l'équipe dédiée aux initiatives IA agentiques, l'objectif est de concevoir, bâtir et opérer l'usine logicielle permettant d'industrialiser les développements et composants d'IA agentique à l'échelle du Groupe. L'enjeu est de garantir une chaîne CI/CD robuste, automatisée et sécurisée — de la validation du code jusqu'au packaging, à la publication et au déploiement des agents IA sur les environnements Cloud et la plateforme dédiée. Le profil agira comme référent DevSecOps / SRE / RUN auprès des équipes projets pour structurer les standards et fournir des kits d'industrialisation réutilisables.
Contexte de la missionDans le cadre de l'exploitation d'une prestation critique hébergée sur un Cloud privé, nous recherchons un Ingénieur de Production / Site Reliability Engineering (SRE) afin d'intégrer une équipe de 5 ingénieurs en charge du maintien en conditions opérationnelles (MCO) d'une plateforme stratégique pilotée par un ministère. Vous contribuerez à garantir la disponibilité, la fiabilité et la performance des applications en production tout en accompagnant la transformation vers un modèle SRE et Cloud. Vos missionsAssurer le MCO des applications et infrastructures en environnement Cloud privé. Garantir le respect des SLA et le traitement des tickets Jira. Superviser les plateformes, assurer le monitoring et l'observabilité des systèmes. Analyser les incidents, identifier les causes racines et mettre en œuvre des actions correctives durables. Automatiser les opérations d'exploitation via Ansible, scripts Bash et outils DevOps. Participer aux déploiements applicatifs et infrastructures (CI/CD, GitOps). Gérer les environnements Recette, Préproduction et Production. Administrer les plateformes Docker et Kubernetes. Optimiser les performances, la disponibilité et la résilience des services. Maintenir et enrichir la documentation d'exploitation. Collaborer avec les équipes de développement, infrastructure et Service Delivery. Compétences indispensablesAnsible Docker MySQL Observabilité / Monitoring Linux GitLab CI / GitOps Bash / scripting Kubernetes Gestion des incidents de production Français courant Compétences appréciéesZabbix Grafana OpenSearch Redis Rundeck Rancher RKE2 NGINX Vault Morpheus CMP S3 Airflow Réseau (LAN/WAN, routage, Load Balancer, TLS, PKI) ITIL ISO 27001 / ISO 9001 Soft SkillsExcellente capacité d'analyse et de résolution d'incidents. Résistance au stress et gestion des priorités. Esprit d'équipe et sens du service. Forte autonomie. Bonnes capacités de communication. Force de proposition et démarche d'amélioration continue. Capacité à évoluer dans un environnement critique. LivrablesRespect des SLA et traitement des tickets Jira. Documentation d'exploitation. Automatisation des procédures. Mise en production des évolutions. Suivi de la disponibilité et des performances des plateformes.
Notre client, grand groupe international du secteur du transport et de la logistique, déploie une stratégie ambitieuse de transformation par l'IA. Dans ce cadre, il recherche un Product Manager AI for All chargé de piloter la vision stratégique des solutions d'intelligence artificielle destinées à l'ensemble de ses collaborateurs (Microsoft Copilot, agents IA custom, LLM entreprise, etc.). 1. Roadmap produit Piloter la feuille de route des solutions IA grand public interne en collaboration avec les éditeurs (Microsoft, Mistral AI, etc.) Évaluer et prioriser les nouvelles fonctionnalités selon leur valeur métier Négocier et formaliser les engagements fournisseurs (SLA, délais, fonctionnalités) 2. Agents IA custom enterprise Définir la vision produit des agents IA déployés à l'échelle du groupe Cartographier les besoins métiers et les traduire en spécifications fonctionnelles Mesurer l'adoption et piloter l'optimisation continue 3. Connecteurs & intégrations Définir la roadmap des connecteurs (ERP, CRM, outils métiers) Superviser la gouvernance des accès, la conformité et la sécurité
Contexte de la missionL'OPS assure la conduite et l'exploitation des applications afin d'en garantir la disponibilité et le maintien en condition opérationnelle, tout en contribuant à la boucle d'amélioration continue. Il coordonne les différents intervenants sur le cycle de vie des applications dont il a la charge (il peut en gérer plusieurs en parallèle). Assurer la disponibilité des applications, traiter les incidents et demandes de travaux (DT) Suivre et capitaliser sur la résolution des incidents, proposer des améliorations/industrialisations Coordonner les intervenants, identifier les points de blocage et solutions de contournement Sécuriser les changements et leur impact utilisateurs (planification, pilotage) Piloter l'exploitant applicatif de niveau 1 Contribuer aux volets Assistance Applicative, Conduite des Échanges et Gestion des Accès
Ingénieur IA MLOps / Production (H/F)Contexte de la missionAu sein d'une équipe Data & IA d'un grand groupe international, vous intervenez sur l'exploitation, l'industrialisation et l'amélioration continue de solutions d'Intelligence Artificielle déployées en production. Les applications concernées couvrent notamment : Moteurs RAG (Retrieval-Augmented Generation) Agents conversationnels Systèmes multi-agents Solutions basées sur des LLM managés Modèles de Machine Learning industrialisés Vous évoluez dans un environnement Cloud AWS fortement industrialisé, intégrant les standards DevOps, MLOps, sécurité et gouvernance d'entreprise. Le poste présente une double dimension : Maintien en conditions opérationnelles (RUN) des solutions IA en production Contribution à l'industrialisation de la plateforme MLOps et des pratiques d'exploitation IA Missions principales1. Exploitation et support de productionAssurer le support applicatif de niveau 2 et 3 des solutions IA en production. Diagnostiquer les incidents, identifier les causes racines et piloter leur résolution. Garantir le respect des engagements de service (SLA, disponibilité, temps de rétablissement). Participer à la gestion des incidents majeurs et aux analyses post-mortem. Maintenir et enrichir la documentation d'exploitation (runbooks, procédures, schémas d'escalade). Mettre en œuvre les procédures de continuité de service et les modes dégradés. Accompagner les montées de versions des modèles IA et des composants applicatifs. Participer aux astreintes et interventions hors horaires ouvrés lorsque nécessaire. 2. Monitoring et observabilité des systèmes IAExploiter et améliorer les dispositifs de supervision applicative et infrastructure. Déployer et maintenir les outils d'observabilité dédiés aux systèmes IA et aux LLM. Concevoir des tableaux de bord de pilotage permettant de suivre : La disponibilité des services La latence des traitements Le coût des traitements IA Les performances des modèles La qualité des réponses générées Les dérives fonctionnelles et comportementales Affiner les stratégies d'alerting afin de réduire les faux positifs. Participer à la définition des politiques de surveillance et d'évolution des modèles. 3. Contribution aux pratiques MLOps et à l'industrialisationParticiper à la conception et à l'évolution des chaînes CI/CD dédiées aux projets IA. Contribuer à l'automatisation des déploiements et à l'amélioration continue des processus. Participer à la mise en place d'infrastructures reproductibles via l'Infrastructure as Code. Déployer et administrer les composants MLOps nécessaires à l'industrialisation des modèles. Accompagner les équipes de développement dans la résolution des problématiques liées aux pipelines d'intégration et de déploiement. Contribuer à la standardisation des architectures IA (RAG, fine-tuning, agents, LLMOps). 4. Gouvernance, sécurité et conformitéGarantir la conformité des solutions avec les normes internes et réglementaires. Participer à la mise en œuvre des mécanismes de traçabilité et d'audit des systèmes IA. Contribuer aux dispositifs de sécurisation des modèles et des usages d'IA générative. Participer aux exercices de continuité et de reprise d'activité. Maintenir l'ensemble de la documentation technique et opérationnelle. Veiller à l'application des politiques de sécurité et de gestion des risques. 5. Optimisation et innovationSuivre et optimiser les coûts d'exploitation des plateformes Cloud et IA. Identifier les opportunités d'amélioration suite aux incidents et retours d'expérience. Participer aux études technologiques et aux expérimentations autour des nouvelles solutions IA. Contribuer à la construction de composants réutilisables et mutualisés. Assurer une veille permanente sur les pratiques MLOps, GenAI, LLMOps et observabilité. Compétences comportementales recherchéesForte culture de production et sens du service. Capacité à intervenir efficacement en situation critique. Rigueur et sens de l'organisation. Esprit analytique et aptitude à la résolution de problèmes complexes. Excellentes capacités de communication. Autonomie et proactivité. Goût pour l'amélioration continue. Capacité à collaborer avec des équipes multidisciplinaires. Curiosité technologique et culture DevOps/MLOps. Anglais professionnel. Compétences techniques requisesIntelligence Artificielle & MLOpsExpérience significative sur des projets IA industrialisés. Connaissance des architectures RAG et des systèmes agentiques. Compréhension des problématiques liées aux LLM et à leur exploitation en production. Connaissance des pratiques LLMOps et MLOps. Gestion du cycle de vie des modèles et monitoring de performance. Cloud & InfrastructureExcellente maîtrise d'AWS : EKS Lambda EC2 CloudWatch IAM S3 Services IA managés Bonnes connaissances Kubernetes et conteneurisation Docker. DevOps & CI/CDGitLab CI GitHub Actions Terraform Infrastructure as Code Gestion des artefacts logiciels Gestion des secrets (Vault ou équivalent) Automatisation des déploiements Monitoring & ObservabilitéPrometheus Grafana CloudWatch APM Observabilité des applications IA Tracing distribué Monitoring des performances modèles Une connaissance des outils spécialisés tels que MLflow, LangFuse, LangSmith ou DeepEval constitue un atout. Sécurité & GouvernanceGestion des vulnérabilités. Sécurité Cloud. Gouvernance des modèles IA. Traçabilité et auditabilité. Connaissance des réglementations liées à l'IA et à la protection des données. DéveloppementPython avancé. APIs REST. Scripts d'automatisation. Connaissances SQL appréciées.