Pour le compte d'un acteur majeur du transport et du digital, nous recherchons un Expert OpenTelemetry Azure (H/F) pour intervenir sur une mission à forte visibilité autour de l'observabilité et du monitoring cloud. Contexte Dans le cadre d'un projet d'amélioration de la supervision et de l'observabilité de son écosystème Azure, notre client souhaite industrialiser la collecte de logs, métriques et traces sur plusieurs centaines d'applications cloud. L'objectif est de déployer et configurer une solution de monitoring centralisée basée sur OpenTelemetry afin d'améliorer la visibilité, la performance et la fiabilité des services. Missions Définir et mettre en œuvre l'architecture OpenTelemetry sur Azure Installer et configurer les OpenTelemetry Collectors Instrumenter et superviser un parc important d'Azure Functions et Function Apps Assurer l'intégration avec les outils de monitoring et d'observabilité existants Accompagner les équipes techniques sur les bonnes pratiques de traçabilité et de supervision Participer à l'automatisation du déploiement et au suivi des performances Environnement technique OpenTelemetry (OTel) Azure Functions / Function Apps Azure Monitor Azure DevOps Infrastructure Cloud Azure
ContexteDans le cadre d'un programme international de transformation digitale, nous recherchons un Expert Monitoring / Observability afin de concevoir, déployer et industrialiser une plateforme de supervision pour une application métier critique à forte volumétrie. Vous interviendrez sur un environnement stratégique nécessitant une haute disponibilité et accompagnerez les équipes techniques durant les phases de Build, Go-Live et Run. Votre mission sera de garantir une visibilité complète sur la performance des applications, d'anticiper les incidents et d'améliorer en continu la qualité de service grâce à une stratégie d'observabilité robuste. Vous évoluerez dans un contexte international et collaborerez avec des équipes Infrastructure, Production, Développement et Management. Vos missionsConcevoir et mettre en œuvre une architecture d'observabilité de bout en bout (Logs, Metrics, Traces, APM). Développer et maintenir des dashboards, monitors et alertes sur Datadog et Splunk. Définir les indicateurs de performance et de qualité de service (SLI, SLO, SLA). Industrialiser les modèles de supervision via des templates et standards de monitoring. Automatiser le déploiement des dashboards et des configurations de monitoring à l'aide d'outils IaC (Terraform, Ansible ou équivalent). Intégrer les solutions d'observabilité dans les pipelines CI/CD. Collaborer avec les équipes de développement pour améliorer l'instrumentation des applications (logs structurés, tracing distribué, APM). Analyser les incidents complexes grâce à la corrélation des logs, métriques, traces et données APM. Accompagner la transition des applications du Build vers le Run et contribuer à l'amélioration continue des processus d'exploitation. Produire des reportings et recommandations destinés aux équipes techniques et aux parties prenantes.
CONTEXTE & MISSION Au sein de la Fabrique Digitale d'un grand opérateur de transport, vous intégrerez l'équipe de la plateforme Data dédiée aux projets Data, BI, Big Data et IA du Groupe, dans un environnement Agile Scrum. PRINCIPALES MISSIONS - Assurer le MCO et les évolutions de la plateforme Data - Encadrer techniquement l'équipe DevOps - Développer et industrialiser les infrastructures Cloud - Améliorer les performances, la sécurité et la résilience de la plateforme - Mettre en oeuvre les bonnes pratiques DevOps, CI/CD et FinOps - Participer aux incidents N2/N3, aux choix d'architecture et à la roadmap technique - Accompagner les équipes et diffuser les bonnes pratiques COMPÉTENCES INDISPENSABLES - Certification AWS active (obligatoire) - Minimum 8 ans d'expérience sur Terraform (outil principal) - Minimum 6 ans d'expérience sur AWS (administration, déploiement et orchestration) - Minimum 2 ans d'expérience sur Databricks en production avec des flux industrialisés - Expérience significative en GitLab CI/CD et Infrastructure as Code - Mise en place d'outils de monitoring, d'alerting et de gestion des logs - Expérience en environnement Agile Scrum (minimum 1 an) - Participation à des astreintes et environnements à forte disponibilité COMPÉTENCES FORTEMENT APPRÉCIÉES - Datadog - FinOps (optimisation des coûts AWS, EC2, Savings Plans) - Okta - Power BI - Azure Synapse - ITIL ENVIRONNEMENT TECHNIQUE AWS - Terraform - Databricks - GitLab CI/CD - Okta - Power BI - Azure Synapse - Datadog - Jira - Confluence - Agile Scrum - ITIL
Ingénieur de Production - Expert Monitoring & Observabilité (Operations Bridge Suite) 1. Contexte Au sein d'une Direction des Systèmes d'Information d'un grand groupe international, vous intégrerez une équipe en charge des services de production informatique. Cette équipe a pour mission de garantir la disponibilité, la performance et la fiabilité des infrastructures et des applications critiques. Dans un contexte de transformation des plateformes de supervision et de développement de l'observabilité, vous contribuerez à l'évolution des solutions de monitoring afin d'améliorer la qualité de service, la maîtrise des risques opérationnels et l'efficacité des opérations IT. Informations complémentaires : Démarrage : Septembre Durée de mission : 3 ans Télétravail : 2 jours à distance / 3 jours sur site 2. Missions En tant qu'Expert Monitoring & Observabilité, vous serez chargé(e) de : Assurer le suivi quotidien de la production des outils de monitoring (qualité de service, disponibilité, KPI, indicateurs de performance). Accompagner les équipes techniques et les projets dans la définition et la mise en œuvre de leurs besoins en supervision et observabilité. Concevoir, configurer et maintenir les solutions de monitoring basées sur la suite OpenText Operations Bridge (Operations Bridge Manager, Network Node Manager, Optic Data Lake, HSO) dans des environnements on-premise et Cloud (AWS, GCP). Déployer les pratiques d'observabilité en s'appuyant sur les standards OpenTelemetry. Participer aux comités de suivi et assurer une communication régulière avec les équipes techniques et les parties prenantes. Contribuer à l'amélioration continue de la plateforme : renforcement de la stabilité des solutions de supervision ; développement de nouvelles capacités de surveillance ; définition et suivi de KPI par typologie d'événements et d'équipements ; optimisation des processus de monitoring.
Contexte Nous recherchons un Senior System Engineer Virtualization pour renforcer une équipe Infrastructure et intervenir sur des environnements critiques de virtualisation, stockage, sauvegarde, haute disponibilité et Disaster Recovery. Le consultant jouera un rôle clé dans le maintien de la performance, de la disponibilité et de la continuité des services IT dans le secteur public belge. Le posteLe System Engineer Virtualization & Storage assure quotidiennement la gestion et l'optimisation des systèmes et de l'infrastructure afin de garantir la performance et la disponibilité des services. Il gère les systèmes et infrastructures des datacenters nécessaires au fonctionnement des applications hébergées. Il est également responsable de la préparation et de la mise en œuvre des nouvelles installations, des changements et des mises à niveau.
Pour l'un de nos clients du secteur e-commerce / retail, nous recherchons un expert WhatsApp Business Platform / CRM conversationnel afin d'accompagner les équipes IT et métiers dans un projet d'intégration de WhatsApp au sein de leur écosystème CRM. Le client a fait le choix de développer sa propre solution en interne afin de conserver la maîtrise de son architecture, de ses données et de ses parcours CRM. L'objectif de la mission est donc d'apporter une expertise externe sur les bonnes pratiques WhatsApp, les choix d'architecture, les contraintes Meta / WhatsApp Business Platform et les recommandations adaptées à un environnement CRM complexe. L'expert interviendra en appui des équipes IT, CRM, marketing et métiers afin de : Cadrer les cas d'usage WhatsApp dans l'écosystème CRM existant ; Challenger et sécuriser les choix d'architecture cible ; Apporter les bonnes pratiques liées à WhatsApp Business Platform / WhatsApp Business API ; Accompagner les équipes sur les sujets d'opt-in, consentement, templates, règles d'envoi et gouvernance des messages ; Définir les recommandations d'intégration avec les outils CRM, data, marketing automation ou CDP ; Conseiller sur les flux techniques : API, webhooks, événements, tracking, monitoring, logs et gestion des erreurs ; Identifier les risques liés à la délivrabilité, à la conformité, à la sécurité et à la qualité de la donnée ; Produire des recommandations claires permettant aux équipes internes de développer la solution en autonomie ; Accompagner les équipes dans la mise en place d'un socle robuste, maintenable et scalable. Livrables attendus Analyse de l'existant CRM / data / architecture. Recommandations d'architecture WhatsApp. Bonnes pratiques d'intégration WhatsApp Business Platform. Recommandations sur la gestion des opt-in, templates et consentements. Schémas de flux fonctionnels et techniques. Liste des points de vigilance sécurité, RGPD, data et exploitation. Support aux équipes IT et métiers dans les arbitrages.
Contexte de la missionDans le cadre de l'exploitation d'une prestation critique hébergée sur un Cloud privé, nous recherchons un Ingénieur de Production / Site Reliability Engineering (SRE) afin d'intégrer une équipe de 5 ingénieurs en charge du maintien en conditions opérationnelles (MCO) d'une plateforme stratégique pilotée par un ministère. Vous contribuerez à garantir la disponibilité, la fiabilité et la performance des applications en production tout en accompagnant la transformation vers un modèle SRE et Cloud. Vos missionsAssurer le MCO des applications et infrastructures en environnement Cloud privé. Garantir le respect des SLA et le traitement des tickets Jira. Superviser les plateformes, assurer le monitoring et l'observabilité des systèmes. Analyser les incidents, identifier les causes racines et mettre en œuvre des actions correctives durables. Automatiser les opérations d'exploitation via Ansible, scripts Bash et outils DevOps. Participer aux déploiements applicatifs et infrastructures (CI/CD, GitOps). Gérer les environnements Recette, Préproduction et Production. Administrer les plateformes Docker et Kubernetes. Optimiser les performances, la disponibilité et la résilience des services. Maintenir et enrichir la documentation d'exploitation. Collaborer avec les équipes de développement, infrastructure et Service Delivery. Compétences indispensablesAnsible Docker MySQL Observabilité / Monitoring Linux GitLab CI / GitOps Bash / scripting Kubernetes Gestion des incidents de production Français courant Compétences appréciéesZabbix Grafana OpenSearch Redis Rundeck Rancher RKE2 NGINX Vault Morpheus CMP S3 Airflow Réseau (LAN/WAN, routage, Load Balancer, TLS, PKI) ITIL ISO 27001 / ISO 9001 Soft SkillsExcellente capacité d'analyse et de résolution d'incidents. Résistance au stress et gestion des priorités. Esprit d'équipe et sens du service. Forte autonomie. Bonnes capacités de communication. Force de proposition et démarche d'amélioration continue. Capacité à évoluer dans un environnement critique. LivrablesRespect des SLA et traitement des tickets Jira. Documentation d'exploitation. Automatisation des procédures. Mise en production des évolutions. Suivi de la disponibilité et des performances des plateformes.
Contexte de la missionL'OPS assure la conduite et l'exploitation des applications afin d'en garantir la disponibilité et le maintien en condition opérationnelle, tout en contribuant à la boucle d'amélioration continue. Il coordonne les différents intervenants sur le cycle de vie des applications dont il a la charge (il peut en gérer plusieurs en parallèle). Assurer la disponibilité des applications, traiter les incidents et demandes de travaux (DT) Suivre et capitaliser sur la résolution des incidents, proposer des améliorations/industrialisations Coordonner les intervenants, identifier les points de blocage et solutions de contournement Sécuriser les changements et leur impact utilisateurs (planification, pilotage) Piloter l'exploitant applicatif de niveau 1 Contribuer aux volets Assistance Applicative, Conduite des Échanges et Gestion des Accès
Dans le cadre du maintien en conditions opérationnelles et de l'évolution des infrastructures d'un environnement de production critique, nous recherchons un(e) Expert Réseau & Infrastructure justifiant d'au moins 7 ans d'expérience. Vous intégrerez une Squad Agile et collaborerez avec les équipes Infrastructure, Production, Réseaux, Sécurité et les équipes projets afin de garantir la disponibilité, la performance, la sécurité et la fiabilité des plateformes. Tâches à réaliser : Dans le cadre de cette mission, vous serez amené(e) à : Administration et exploitation Assurer le maintien en conditions opérationnelles des infrastructures et des plateformes d'hébergement. Administrer et optimiser les infrastructures réseau (LAN, WAN, gestion des flux, interconnexions et sécurité réseau). Gérer et faire évoluer les environnements VMware, les infrastructures de stockage et les solutions de sauvegarde. Garantir la disponibilité, les performances et la capacité des infrastructures. Support et exploitation Prendre en charge les incidents et problèmes de niveau N2/N3 sur les environnements systèmes et réseaux. Réaliser les analyses techniques afin d'identifier les causes racines et mettre en oeuvre des solutions durables. Participer à l'amélioration continue de la qualité de service. Évolution des infrastructures Participer aux projets de déploiement, de migration et de modernisation des infrastructures. Contribuer aux évolutions des socles techniques, à leur standardisation et à la réduction de la dette technique. Formuler des recommandations techniques et participer aux choix d'architecture d'infrastructure. Sécurité Mettre en oeuvre les mesures de sécurité opérationnelle. Gérer les vulnérabilités et le durcissement des systèmes. Veiller au respect des standards de sécurité des systèmes d'information. Assurer le suivi des ouvertures et fermetures de flux réseau. Supervision et automatisation Superviser les infrastructures et améliorer la fiabilité des services grâce aux outils de monitoring. Développer et maintenir des scripts d'automatisation, notamment avec Ansible. Produire et maintenir la documentation technique ainsi que les procédures d'exploitation.
Contexte Dans le cadre de la montée en maturité de la plateforme Salesforce d'un grand compte du secteur assurance, la mission vise à accompagner les équipes en Maintenance en Conditions Opérationnelles (MCO) et les équipes Agile dans l'analyse des incidents techniques, la supervision de la plateforme et l'amélioration des performances. La prestation s'exerce en collaboration étroite avec la Design Authority, le MCO et les équipes Agile. L'enjeu principal est de rendre ces équipes autonomes dans la gestion courante des incidents, la Design Authority restant le support d'expertise sur les cas les plus complexes. Rôle et responsabilités principales Exploiter et promouvoir les outils de monitoring et d'observabilité Salesforce (Portail KPI, Event Monitoring, Smart Observer, Analytics, etc.). Analyser les incidents techniques et les problématiques de performance à l'aide des outils de supervision (Kibana, Elastic Search, logs Salesforce, monitoring des flux, etc.). Formaliser les bonnes pratiques d'investigation, de diagnostic et de résolution des incidents. Accompagner la montée en compétence des équipes MCO et Agile par le coaching, le transfert de connaissances et la documentation. Diffuser les bonnes pratiques Salesforce en matière de développement, d'architecture et de performance. Travailler en collaboration étroite avec la Design Authority, le MCO et les équipes Agile. Livrables attendus Documentation des bonnes pratiques d'investigation, de diagnostic et de résolution des incidents. Supports de transfert de compétences et de coaching à destination des équipes MCO et Agile. Recommandations et bonnes pratiques Salesforce en développement, architecture et performance.
Nous recherchons pour l'un de nos clients un(e) Ingénieur IA – Google Cloud Platform (H/F). Pour le département IT Operations & Finance, nous recherchons un profil disposant d'une forte expertise en ingénierie IA afin de concevoir des agents IA, mettre en place des échanges agent à agent, et les intégrer dans un environnement Google Cloud Platform. L'objectif est de passer d'une preuve de concept à des solutions fiables, sécurisées et industrialisées, grâce à une approche mêlant développement Python, API, orchestration d'agents, observabilité et CI/CD. Missions principales Concevoir et développer des agents IA pour certains cas d'usage métiers. Développer des API et services Python asynchrones avec FastAPI. Conteneuriser les applications et les déployer sur Cloud Run. Mettre en place des serveurs MCP pour exposer de manière sécurisée des outils et données internes aux agents. Développer des workflows d'agents à l'aide du framework Concevoir des mécanismes de communication agent à agent basés sur des événements et/ou du RPC. Définir les schémas de messages, le routage, les mécanismes de retry et la gestion d'état. Intégrer les solutions avec Vertex AI ou un équivalent pour les appels modèles, les filtres de sécurité et les évaluations. Mettre en place l'observabilité : logs, traces, métriques, monitoring. Définir des guardrails de sécurité : DLP, gestion des secrets, IAM. Documenter l'architecture, les procédures d'exploitation et assurer la passation à l'équipe. Accompagner l'équipe métier dans l'adoption de cas d'usage liés à l'IA générative.
Vorstone recherche un Ingénieur DEVOPS Système Ansible pouun de nos clients basé à Marseille/Aix-en Provence. En tant qu'ingénieur DevOps intégré à l'équipe Systèmes, votre rôle est de piloter le maintien et l'évolution des scripts et produits applicatifs. Vous agirez soit en délégation de l'équipe Cloud & DevOps, et sous la responsabilité directe de l'équipe Systèmes, garantissant ainsi une continuité opérationnelle optimale. Domaines d'intervention : Observabilité & Monitoring : Mise en place et maintenance des outils d'observabilité pour l'ensemble des produits du Train et de la System Team, assurant une visibilité proactive sur la santé des systèmes. Accompagnement des équipes Agiles vers l'auto-suffisance technique via : La création de guidelines et de User Guides. L'animation de trainings dédiés. L'intégration de features spécifiques sur des outils clés comme EDB, Liquibase, ou Kasten. Intégration Continue (CI) : Déploiement et gestion des chaînes CI (notamment via Ansible Tower). Je veille à ce que ces solutions restent alignées avec les roadmaps de la System Team et du Cloud & DevOps. Automatisation des Tests : Conception et implémentation de solutions de tests automatisés pour sécuriser les cycles de livraison. Expertise Régilienne : Apport d'un haut niveau d'expertise technique sur les fonctions régaliennes au profit de la System Team, garantissant la conformité et la robustesse des infrastructures.
1. Coordination de la conception et de l'implémentation de la sécurité : · Coordonner la conception, l'implémentation et le maintien des mesures de sécurité au sein des systèmes du département. · Coordonner la gestion des contrôles d'accès et des permissions basés sur les rôles, ainsi que la revue et le durcissement des comptes techniques. · Coordonner le maintien et l'audit des permissions d'export et de la configuration liée aux intégrations et aux contrôles d'accès API. 2. Coordination du Monitoring et du Logging : · Coordonner la mise en œuvre et le maintien des systèmes de surveillance et de journalisation de sécurité pour détecter et répondre aux menaces. · Coordonner la configuration des alertes de sécurité et le suivi des menaces, ainsi que la prévention des exports de données. 3. Plan de Reprise d'Activité (DRP) et Prévention de la Perte de Données (DLP) : · Coordonner le développement et l'implémentation des stratégies DLP pour empêcher la sortie de données sensibles. · Coordonner les stratégies DRP (définition du RTO et RPO avec les équipes business et plateforme), incluant les tests et simulations de reprise, en lien avec les éditeurs concernés et leurs équipes support. 4. Plan de Gestion de Crise : · Piloter la préparation d'un plan de gestion de crise cyber pour le département, définissant la chaîne de communication en cas d'incident (interne et externe), les personnes clés et leurs rôles, et les procédures d'escalade. · Prioriser ce plan sur le domaine D2C (Priorité 1), avec extension prévue aux autres domaines du département. 5. Gestion des Vulnérabilités : · Coordonner les évaluations de sécurité et les audits avec l'équipe Cybersécurité MH et le support aux équipes plateformes, sur l'ensemble des domaines du département. 6. Réponse à Incident : · Participer aux activités de réponse à incident liées aux brèches ou incidents de sécurité touchant les systèmes du département : investigation des événements de sécurité, contention des menaces, mise en œuvre des actions correctives. 7. Sensibilisation et Formation à la Sécurité : · Animer la sensibilisation à la sécurité auprès des équipes du département, afin de promouvoir les bonnes pratiques et réduire le risque d'incidents. 8. Documentation : · Créer et maintenir une documentation complète des configurations, politiques et procédures de sécurité du département.
Descriptif de la mission : Dans le cadre d'un programme de transformation SI d'envergure, nous recherchons pour l'un de nos clients un(e) Delivery Manager IT. Vous interviendrez au sein d'une équipe dédiée, en lien étroit avec le Responsable Delivery, le PMO, les architectes, les Business Analysts et les développeurs, afin de sécuriser l'exécution des travaux, fluidifier la coordination et renforcer le pilotage des activités. Missions principales : Assurer le suivi opérationnel quotidien des activités de delivery IT. Organiser, prioriser et suivre l'affectation des tâches aux Business Analysts et développeurs. Suivre l'avancement, les dépendances, les blocages et les échéances. Maintenir à jour les tickets Jira, les statuts, les assignations et les informations de pilotage. Contribuer au suivi et à la fiabilisation des KPI delivery : avancement, reste à faire, vélocité, capacité, retards, tickets bloqués, risques, anomalies. Préparer et animer les points de suivi opérationnels. Produire un reporting clair et factuel à destination du Responsable Delivery, du PMO et des parties prenantes projet. Mettre à jour la documentation opérationnelle dans Confluence.
ContexteDans le cadre d'un programme stratégique de transformation digitale, nous recherchons un Migration Technical Lead pour accompagner le déploiement d'une nouvelle plateforme d'IA Agentique. Cette plateforme constituera le socle technologique des futurs projets d'Intelligence Artificielle de l'entreprise. Elle permettra de développer, orchestrer, sécuriser, héberger et superviser des agents IA autonomes capables d'interagir entre eux au sein d'une architecture multi-agents. Vous rejoindrez une équipe intervenant sur un projet innovant mêlant Cloud, DevOps, Platform Engineering et Intelligence Artificielle Générative. Vos missions En tant que Migration Technical Lead, vous serez le référent technique des équipes projets durant leur migration vers cette nouvelle plateforme d'IA. À ce titre, vous serez amené(e) à : Accompagnement des projetsAccompagner les équipes dans la migration de leurs applications vers la plateforme IA. Comprendre les besoins des différents projets et proposer les meilleures approches techniques. Identifier les risques techniques liés aux migrations. Garantir une migration fluide et sécurisée des applications. Support techniqueAnalyser les incidents et problématiques rencontrés lors des migrations. Qualifier et suivre les demandes via Jira et ServiceNow. Proposer des solutions techniques adaptées. Coordonner les actions de support avec les différentes équipes. DocumentationRédiger les guides de migration et les bonnes pratiques. Alimenter la documentation technique sous Confluence. Capitaliser les retours d'expérience afin d'améliorer les processus de migration. IndustrialisationParticiper à l'amélioration des pipelines CI/CD. Développer les scripts et composants nécessaires à l'automatisation des migrations. Contribuer aux outils facilitant l'intégration des projets sur la nouvelle plateforme. Collaboration transverseTravailler en étroite collaboration avec les équipes Cloud, DevOps, MLOps, Sécurité et Développement. Participer aux échanges techniques et accompagner les équipes dans la résolution des problématiques complexes. Être un véritable facilitateur entre les différentes parties prenantes. Environnement techniqueCloudGoogle Cloud Platform (GCP) Google Kubernetes Engine (GKE) AWS ou Azure (selon les projets) DevOps / Platform EngineeringGitLab CI/CD ArgoCD Docker Kubernetes API ManagementKong Apigee ObservabilitéDynatrace Monitoring Logging Intelligence Artificielle GénérativeLLM (Large Language Models) Mistral AI Google Gemini Plateformes d'IA Agentique Architecture multi-agents
Vous souhaitez rejoindre une équipe technique et participer au développement de services au cœur d'une plateforme métier ? Cette opportunité vous permettra d'intervenir sur des sujets de développement, de qualité logicielle et d'amélioration continue dans un environnement moderne. Au sein de l'équipe, vous serez notamment amené·e à : Développer et faire évoluer des microservices basés sur Spring Boot Participer à la maintenance corrective et évolutive des applications Concevoir et faire évoluer les API et les points d'entrée des microservices Mettre en place et maintenir des tests automatisés afin de garantir la qualité et la non-régression des applications Participer à l'amélioration de la supervision et du monitoring des applications Analyser et résoudre les anomalies rencontrées sur les différents environnements Collaborer avec les équipes techniques et métiers afin d'optimiser les flux et de répondre aux besoins fonctionnels Participer aux pratiques DevOps et aux processus d'intégration et de déploiement