Contexte de la mission : Dans le cadre du déploiement d'une solution FSM (Field Service Management) sur un système d'information existant, nous recherchons un Responsable Technique / Ingénieur DevOps Senior pour piloter le build et le run de la solution, de bout en bout, sur l'ensemble des environnements (développement, qualification, UAT, préproduction, production). Vous interviendrez comme référent technique sur un projet stratégique, avec une réelle autonomie sur la mise en œuvre de la chaîne CI/CD, la supervision applicative et la coordination avec les équipes d'exploitation. Vos missions : - Piloter techniquement le déploiement de la solution FSM sur l'ensemble des environnements (dev, qualif, UAT, préprod, prod) - Concevoir, maintenir et faire évoluer la chaîne d'intégration et de déploiement continu (CI/CD) - Mettre en place et exploiter la supervision applicative et infrastructure (Prometheus, Grafana, ELK) - Assurer la coordination avec les équipes d'exploitation pour garantir la stabilité du run - Garantir la sécurité, la qualité et la performance des livraisons - Rédiger et maintenir la documentation technique (en français) - Participer à la définition et à l'exécution des plans de test
Plateforme On-Premise & Cloud Synthèse de la Mission : Rôle : Ingénieur Data Senior (> 7 ans d'expérience) Localisation : Paris ou Rennes (3 jours/semaine sur site, 2 jours en télétravail) TJM Max : 770 € / jour Date de démarrage : ASAP Durée : 5 à 6 mois (jusqu'au 27/11/2026) Contexte & Objectif de la Mission : Au sein d'un grand groupe média, l'objectif principal est de concevoir et construire le MVP d'une plateforme Data On-Premise basée sur des technologies Open Source. La plateforme permettra de : Gérer les transformations de données On-Premise et alimenter un Data Lake local. Servir de plateforme d'ingestion pour le Big Data sur GCP (Cloud Public). Faciliter la transition du mode Batch vers le Streaming (Temps réel). Valider la faisabilité de migration de flux ETL legacy (OpenText / Genio). Responsabilités & Missions Principales : Conception & Déploiement du MVP : Architecturer et intégrer la plateforme sur un socle existant (Kubernetes, GitLab CI, Prometheus/OpenTelemetry). Installer et configurer la stack Open Source : Kafka, NiFi, Spark, Iceberg, Trino. Validation Technique & Cas d'Usage : Migrer quelques flux ETL clés pour valider la valeur de la plateforme. Déployer des pipelines streaming (Kafka + Spark Structured Streaming). Mettre en place l'alimentation du Data Lake (Iceberg + Trino) et assurer l'interopérabilité avec GCP. Collaboration & Documentation : Travailler en synergie avec les équipes Data/IA et DevOps/Infra. Documenter l'architecture, les choix techniques et transmettre les compétences aux équipes internes.
Le poste s'inscrit au sein de l'équipe BigData du domaine d'expertise Data & IA, avec pour mission de concevoir, implémenter et administrer une infrastructure Cloud Hybride. Une expertise approfondie est requise sur l'environnement Cloud Public : Google Cloud Plateforme ainsi que sur les infrastructures On-Premise. PÉRIMÈTRE D'INTERVENTION : Le périmètre s'étend de la conception du service à son maintien en condition opérationnelle en production. Le candidat évoluera dans un environnement technique complexe, distribué, sécurisé et hautement disponible, au sein d'une équipe dédiée aux produits et services d'intelligence artificielle. MISSIONS PRINCIPALES : Participer à la mise en œuvre et l'optimisation de la plateforme Cloud pour permettre une bonne exploitabilité. Développer et maintenir l'infrastructure as code (IaC) avec Terraform / Terragrunt Automatiser et maintenir les pipelines CI/CD des projets Cloud (GitLab) Collaborer avec les équipes applicatives, infrastructure et DevOps pour définir et implémenter les bonnes pratiques GROUPE. Documenter les procédures d'implémentation, d'utilisation et d'exploitation. Mettre en place des solutions d'alerting et de monitoring avancées (Prometheus, Grafana, ELK, Google Cloud Observability) Assurer le maintien en conditions opérationnelles en mode GitOps. ENVIRONNEMENT TECHNIQUE : Cloud et Infrastructure : GCP, Kubernetes, Openstack, Openshift, Docker Développement et Automatisation : Terraform, Terragrunt, Python, SQL, Ansible, Jenkins, GitLab CI, Kestra, Artifactory (Jfrog) Gestion des secrets et authentification : Vault Base de données : PostgreSQL Observabilité : GCP observability, ELK, Prometheus, Grafana, Xray/Trivy
Contexte de la mission Afin de soutenir la modernisation de ses infrastructures d'échange de données en temps réel, une entité spécialisée recherche un.e expert.e senior. La mission est centrée sur la conception, l'optimisation, la sécurisation et la gouvernance globale d'une architecture orientée événements reposant sur la solution Kafka Confluent, dans un objectif de haute disponibilité et de forte scalabilité. Objectifs et missions principales Les activités principales associées à ce poste s'articulent autour des axes suivants : Conception de l'architecture technique et déploiement des clusters Kafka Confluent. Gestion, administration avancée et maintien en conditions opérationnelles (MCO) de l'ensemble de la plateforme (topics, partitions, brokers). Implémentation et configuration des composants de l'écosystème (Schema Registry, Confluent Connect, ksqlDB). Définition et mise en œuvre des politiques de sécurité de la plateforme (RBAC, chiffrement TLS, authentification SASL/Kerberos, gestion des ACLs). Optimisation des performances (tuning des producteurs/consommateurs, gestion de la rétention, stratégies de re-balancing) et résolution des incidents complexes. Accompagnement technique des équipes de développement pour l'intégration des flux de streaming de données. Livrables attendus Les livrables à fournir au cours de la mission comprennent : les dossiers d'architecture technique (DAT) et les guides de préconisations pour les infrastructures de streaming. les scripts d'automatisation des configurations et des déploiements (Infrastructure as Code). les matrices de sécurité, politiques de gouvernance des schémas et configurations d'accès. les plans de secours, procédures opérationnelles d'exploitation et de gestion des sauvegardes/restaurations. les tableaux de bord de supervision et rapports de métriques de performance.
Contexte de la missionDans le cadre de la modernisation de son système d'information, notre client déploie une solution Google Apigee Hybrid pour industrialiser sa plateforme API Management. La mission vise à concevoir, sécuriser et opérer une plateforme robuste, scalable et conforme aux bonnes pratiques DevSecOps. Objectifs Accompagner les équipes internes sur les volets architecture, gouvernance, automatisation, sécurité et exploitation, en garantissant une intégration optimale avec l'écosystème cloud et DevOps existant. Objectifs et livrablesPérimètre Architecture & Design Conception de l'architecture cible Apigee Hybrid (runtime, management plane, synchronisation, monitoring). Intégration avec l'écosystème cloud (IAM, sécurité, logging, monitoring, registry d'artefacts). Définition des patterns d'exposition, de sécurité et de gouvernance API. Mise en place de Shared Flows, Policies et standards transverses. Implémentation & Industrialisation Déploiement d'Apigee Hybrid sur une plateforme conteneurisée (OpenShift/Kubernetes). Automatisation des pipelines CI/CD (Tekton, ArgoCD). Provisioning et configuration via Terraform. Automatisation des opérations via Ansible. Intégration avec un outil de gestion des secrets (type Vault). Sécurité & Gouvernance Définition et mise en œuvre des politiques de sécurité (OAuth2, JWT, mTLS, quotas, rate limiting). Mise en place d'un cadre de gouvernance API (naming, versioning, lifecycle management). Accompagnement sur la conformité et les bonnes pratiques DevSecOps. Support & Transfert de compétences Coaching des équipes de développement et d'exploitation. Rédaction de guides, standards et modèles (proxies, shared flows). Participation aux comités d'architecture et d'urbanisation.
🚀 Mission – Expert Kubernetes / OpenShift (H/F) Tu es passionné par les environnements cloud, la conteneurisation et les plateformes Kubernetes ? Tu aimes être au cœur des sujets techniques et faire évoluer des plateformes critiques ? Cette mission est pour toi 👇 🔎 Le contexte Tu interviens sur une plateforme OpenShift stratégique, avec un vrai rôle d'expert pour accompagner son évolution et répondre aux besoins des équipes. 💥 Tes missions principales Définir et proposer des solutions Kubernetes adaptées, en respectant les standards en place Déployer, tester et faire évoluer des clusters et composants techniques Assurer le MCO OpenShift (maintenance, patching, améliorations continues) Intervenir en support N3 sur des problématiques techniques pointues Partager ta veille et accompagner l'équipe dans la montée en compétences Transmettre ton savoir (docs, démos, ateliers…) 🛠️ Ton quotidien Faire évoluer la stack OpenShift et garantir sa stabilité Automatiser (Ansible, GitOps…) pour gagner en efficacité Travailler dans un environnement orienté DevOps / Agile Être force de conseil et autonome sur tes sujets 📦 Tes livrables ✔️ Documentation technique (installation, configuration, exploitation) ✔️ Procédures automatisées ✔️ Spécifications techniques détaillées ✔️ Supports de partage de connaissances ⚙️ Stack & compétences attendues Kubernetes & OpenShift (MCO + déploiement) GitOps (ArgoCD, Ansible, GitHub) Observabilité (Prometheus, Dynatrace) Écosystème Kubernetes (cert-manager, Kyverno, Velero…) Bonnes pratiques (Conventional Commits…) 💡 Le petit + Expérience en environnement Agile Connaissance Apache Tomcat 👉 Pourquoi c'est intéressant ? Rôle clé sur une plateforme stratégique Environnement technique moderne et stimulant Forte autonomie et impact direct Dimension expertise + partage
Contexte de la mission Dans le cadre d'un projet d'APIsation du système d'information, notre client déploie une solution de plateforme API Management. L'objectif est de concevoir, sécuriser, industrialiser et opérer une plateforme robuste, scalable et alignée sur les bonnes pratiques DevSecOps. Objectifs et livrables Mission Accompagner les équipes en tant qu'architecte/expert API Management. Définir les standards, industrialiser les processus et assurer le transfert de compétences. Périmètre Conception de l'architecture (runtime, management plane, synchronisation, monitoring). Intégration avec l'écosystème cloud et déploiement sur OpenShift/Kubernetes. Automatisation des pipelines CI/CD (Tekton, ArgoCD) et provisioning via IaC (Terraform, Ansible). Gestion des secrets (Vault) et mise en œuvre des politiques de sécurité (OAuth2, JWT, mTLS, quotas, rate limiting). Rédaction de guides, modèles de proxies et participation aux comités d'architecture.
En tant que référent technique DevOps pour l'ensemble du groupe, vous serez le gardien de notre excellence technique et le moteur de notre innovation. Votre mission est d'harmoniser nos pratiques et de guider nos choix technologiques. Sans être manager, votre leadership par l'influence sera la clé pour fédérer notre communauté technique, casser les silos et garantir l'efficacité de nos systèmes à long terme. Vos Responsabilités Concrètes Construire et piloter la vision technique DevOps : Vous définirez et maintiendrez la roadmap de nos outils clés (CI/CD, conteneurisation, observabilité, IaC) et identifierez les innovations qui feront la différence pour nous demain. Fédérer et faire grandir notre communauté technique : Vous animerez notre guilde DevOps à travers des ateliers, des démos et des sessions de partage pour diffuser les bonnes pratiques et renforcer la collaboration entre les équipes. Agir en tant qu'expert et mentor : Vous conseillez les équipes sur les choix d'architecture complexes et les accompagnerez dans la résolution de leurs problèmes techniques les plus ardus. Garantir la qualité et la sécurité de notre delivery : Vous mettrez en place des indicateurs de performance (métriques DORA) et intégrerez les meilleures pratiques de sécurité (DevSecOps) au cœur de nos pipelines, en collaboration étroite avec le RSSI. Piloter la Fiabilité et la Performance de nos Services en Production: Votre mission ultime est de garantir que nos services sont non seulement fonctionnels, mais aussi rapides, résilients et efficients pour nos utilisateurs. Profil recherché Le Profil que nous recherchons Titulaire d'un diplôme Bac+5 en école d'ingénieur, université ou équivalent, avec une spécialisation en informatique, systèmes distribués, cloud computing ou DevOps. Une certification Cloud (Azure, AWS, GCP) ou DevOps est un plus apprécié.
Vous rejoindrez une équipe de 5 ingénieurs infrastructure répartis sur 2 produits IA/LLM au sein de la Division IA & Data. Vous participerez au support d'une application de gateway d'accès LLM et contribuerez à l'exploitation d'un portefeuille de 3 produits majeurs : une plateforme d'inférence LLM, un pipeline de data-science et un service de mise à disposition de modèles IA. Vos missions principales couvriront plusieurs domaines : Gestion du RUN : Vous assurerez la supervision des alertes, incidents et changements, coordonnerez le triage (L1 → L2 → L3) avec l'équipe offshore, rédigerez et maintiendrez les runbooks, playbooks et SOP, et suivrez le MTTR, les escalades et le reporting aux parties prenantes. Incident Management & RCA : Vous conduirez des enquêtes post-mortem (RCA), mettrez en place des actions correctives et préventives, et gérerez le carnet d'incidents dans ServiceNow (SNOW). Optimisation des plateformes : Vous monitorerez les métriques (latence, utilisation GPU, capacité des nœuds), proposerez des optimisations (autoscaling, right-sizing, tuning des ressources) et gérerez les patchs de sécurité et le suivi des CVE. Automation & CI/CD : Vous automatiserez les tâches récurrentes via des scripts Python, Terraform et Ansible. Collaboration & gouvernance : Vous serez l'interface avec les Product Owners, les équipes DataScience et les fournisseurs d'infrastructure, participerez aux cérémonies Scrum/Kanban (stand-up, grooming, retro) et veillerez à la conformité ITSM (processes, KPI, SLA). Support aux utilisateurs : Vous gérerez les demandes d'accès, les droits RBAC et la documentation technique, et assurerez la formation ponctuelle (on-boarding) des nouveaux membres de l'équipe offshore. L'environnement technique comprend Kubernetes (cluster(s) on-prem & cloud hybride), Helm, Argo CD, CI/CD (GitLab / Jenkins), observabilité (Prometheus / Grafana, Loki), secrets management (Vault) et gestion des GPU (NVIDIA GRID). La méthodologie utilisée est Agile (Scrum/Kanban) avec tableau JIRA et suivi ITSM (ServiceNow).
INGENIEUR DE PRODUCTION - DEVOPS Démarrage : ASAP Durée : 3 ans Localisation : Ile de France (Proche Paris) Téletravail : 50% Mission : - Assistance au quotidien des utilisateurs front et middle office sur les différents problèmes qu'ils peuvent rencontrer dans l'utilisation ou la disponibilité de leurs outils - Analyse des problèmes et proposer une solution immédiate et adaptée aux contraintes métier pour assurer la continuité de leurs activités - Recueil des besoins des utilisateurs et contribution en collaboration avec les entités de développement - Assurance quotidienne des mises en production, les modifications de configuration et la disponibilité des applications Front-Office - Contribution aux migrations (techniques et fonctionnelles) et à l'amélioration continue de la plateforme. - Assurance au support et la gestion des incidents des outils. - Contribution à la maintenance et à l'évolution de la plateforme - Interface privilégié entre les différentes entités de Middle Office, Développement et production - Contribution aux initiatives d'amélioration continue pour une meilleure collaboration entre intervenants « support fonctionnel » - Contribution et pilotage éventuel aux initiatives d'amélioration du support, d'automatisation, basées sur des investigations techniques approfondies … - Développement d'outils d'assistance au support. - Maintenance et support des scripts. - Assistance directe sur sites aux utilisateurs.
Contexte de la missionContexte : Intégration dans une équipe en charge de l'ingénierie et du MCO d'une plateforme d'observabilité SaaS pour une entreprise. Objectifs et livrables Missions principales : Spécialisation logs : Intégration structurée des logs dans la plateforme (collecte, indexation, exploitation). Corrélation avancée logs/traces/métriques. Vision bout-en-bout : de la collecte à l'analyse. Gouvernance : standardisation, rétention, classification, RBAC. Observabilité : Contribution aux projets techniques autour de la plateforme. Intégration dans des environnements cloud hybrides (on-premise + cloud public). Amélioration du cycle de vie de la plateforme (conception → déploiement → exploitation). Observability as Code (intégration de SLO dans les pipelines CI/CD) Collaboration : Onboarding des applications/usages. Conseil et support technique aux équipes DevSecOps. Contribution à la communauté interne.
La mission porte sur la conception et le déploiement de POC autour des agents autonomes et des LLM appliqués aux données d'infrastructure IT (logs, CMDB, monitoring). L'objectif est de fournir des aides intelligentes à la production : supervision, automatisation et résolution proactive d'incidents, dans une logique d'industrialisation à terme. Vos missions : Concevoir et gérer des environnements d'expérimentation Kubernetes / Docker avec intégration CI/CD (Jenkins, GitLab CI, ArgoCD) Automatiser la collecte, le pré-traitement et l'exploitation des datasets d'infrastructure pour alimenter des agents basés sur LLM Développer et intégrer les pipelines de déploiement d'agents IA, en lien avec les data scientists et ingénieurs IA (LangChain, LangGraph, AutoGen ou équivalents) Implémenter des scripts et outils en Python, Bash, Go pour l'automatisation infra, l'orchestration et le monitoring Garantir la sécurité des développements et déploiements en environnement réglementé : DevSecOps, SAST/DAST, gestion des accès, conformité RGPD Produire la documentation technique des POC et les spécifications d'industrialisation Assurer une veille sur les architectures agentiques, les LLM et l'automatisation d'infrastructure
Plateforme de conteneurisation OpenShift 4.x en production critique, au sein d'un grand compte international. Les équipes N1/N2 sont basées à l'étranger : vous êtes le référent N3 OpenShift en France, en autonomie complète sur les incidents complexes et les évolutions de la plateforme. CONTEXTE - Environnement de production critique, forte volumétrie, exigence de disponibilité élevée. - Modernisation continue des infrastructures applicatives (Build + Run). - Coordination hebdomadaire avec les équipes N1/N2 internationales (anglais professionnel requis). MISSIONS PRINCIPALES - Administration et exploitation des clusters OpenShift 4.x en production. - Build : déploiement et intégration de nouvelles applications sur la plateforme. - Incidents N3 : diagnostic avancé (pods, nodes, réseau cluster), analyse des causes racines. - Upgrades de clusters : planification, exécution, validation. - Pipelines CI/CD (Jenkins, GitLab CI) et automatisation (Ansible, Terraform). - Gouvernance cluster : namespaces, RBAC, quotas, network policies. - Observabilité (Prometheus, Grafana) et sécurité des conteneurs (scanning d'images, conformité). - Rédaction des procédures d'exploitation et des dossiers d'architecture. PROFIL RECHERCHÉ - Expert OpenShift 4.x (administration cluster) — impératif. - Expérience confirmée en upgrade de cluster et gestion multi-tenant. - Kubernetes avancé, Helm / Kustomize, CI/CD, IaC (Ansible / Terraform). - Anglais professionnel (coordination N1/N2 internationale). - CKA ou expérience équivalente appréciée. - Autonomie N3 totale — aucune escalade locale possible. MODALITÉS - Freelance / portage accepté. TJM 550–600 € selon expérience. - Saint-Quentin-en-Yvelines (78) — présentiel 50 % (2,5 j/sem), télétravail 50 %. - Démarrage dès que possible, mission longue durée.
Responsable d'exploitation Localisation : la défense longue durée 3 jours sur site Taches : Animer et accompagner l'équipe SysOps (daily, 1:1, montée en compétence) " Prioriser et organiser les activités de RUN et de BUILD " Recueillir les besoins techniques des équipes produit en matière d'infrastructure et d'exploitation et préparer les cycles trimestriels" Garantir la disponibilité et la qualité des services fournis aux métiers (SLO/SLA) " Superviser incidents, alertes, météo applicative et batchs " Communiquer avec les parties prenantes en cas d'incident majeur" Standardiser les pipelines CI/CD sous GitLab et assurer la MCO de l'ensemble des outils et composants de la plateforme " Accompagner les évolutions majeures : migrations cloud AWS, Kubernetes " Renforcer l'observabilité : logs (OpenSearch), métriques (Prometheus, CloudWatch), dashboards (Grafana)" Définir et maintenir les bonnes pratiques de déploiement, de sécurité et de monitoring "
Maintien, Run et évolution de plus de 50 applications, pipelines CI/CD GitLab et Jenkins sur GCP • Intégration et automatisation via Terraform, Ansible, Vault, PKI, Artifactory. • Migration d'applications depuis le datacenter IBM vers GCP et Azure. • Monitoring complet avec Grafana/Prometheus/Telegraf (dashboards, alerting, log collection). • Automatisation du run et Finops: arrêt/redémarrage pods GKE ou VM Azure (réduction des coûts), gestion des logs, supervision jobs. • Participation aux phases DEV/REC/PPD/PRD, préparation des MEP et suivi post-production. Support N2/N3/N4, documentation et amélioration continue (Confluence, Jira).