EXPERT KUBERNETES / IA (H/F)Contexte de la missionNous recherchons pour le compte de notre client un(e) Expert(e) Kubernetes / IA pour assurer l'exploitation, la disponibilité, la performance et la stabilité d'un cluster IA reposant sur des infrastructures GPU/CPU, réseau et stockage. Le profil recherché devra également contribuer à l'automatisation de l'exploitation, au traitement des incidents et à l'amélioration continue de l'infrastructure. Missions principales Maintien en condition opérationnelle – MCO Garantir la disponibilité, la performance et la stabilité du cluster IA. Administrer les nœuds GPU/CPU, les infrastructures de stockage et les composants réseau. Assurer le suivi et l'optimisation des ressources de l'infrastructure. Piloter les opérations de maintenance et les mises à jour techniques. Administration Linux Installer, configurer et administrer les environnements Linux Ubuntu. Réaliser les opérations d'optimisation et de troubleshooting. Administrer et mettre à jour les pilotes NVIDIA, CUDA et composants associés. Kubernetes Administrer et exploiter les environnements Kubernetes. Réaliser les déploiements, le scaling et la gestion de la haute disponibilité (HA). Assurer le maintien en conditions opérationnelles des clusters. Piloter les mises à jour des composants Kubernetes. Gérer les problématiques liées aux ressources et à la capacité des clusters. Supervision et observabilité Mettre en place et maintenir la supervision des infrastructures. Exploiter Prometheus et Grafana pour le monitoring et l'analyse des performances. Identifier les anomalies et anticiper les incidents grâce à une approche proactive. Automatisation Automatiser les tâches d'administration et d'exploitation avec Ansible. Développer et maintenir des scripts Bash et Python. Optimiser les processus opérationnels afin de réduire les tâches manuelles. Gestion des jobs IA / GPU Assurer l'ordonnancement des tâches et jobs GPU. Gérer les quotas, priorités et ressources GPU. Optimiser l'allocation des ressources CPU/GPU. Gestion des incidents Prendre en charge les incidents techniques complexes. Réaliser les analyses de causes racines et les post-mortems. Définir et suivre les plans d'actions correctifs. Coordonner les interventions avec les différentes équipes techniques. Documentation Rédiger et maintenir la documentation d'exploitation. Formaliser les procédures techniques et les consignes de maintenance. Garantir la traçabilité et la continuité des opérations.
🚀 Mission Freelance – (H/F) 📍 Localisation : 🏠 Télétravail : 2 jours/semaine 📅 Démarrage : ASAP (consultant disponible immédiatement, sans préavis) ⏳ Durée : Mission longue durée 💰 TJM max : 640€ 📌 Date limite de candidature : 17/06/2026 Dans le cadre de l'évolution et du maintien en conditions opérationnelles d'infrastructures IT critiques, nous recherchons un Expert Virtualisation & Automatisation VMware pour intervenir sur un environnement complexe et multi-sites. 🎯 Vos missions ✅ Assurer le RUN et le MCO des plateformes virtualisées ✅ Administrer et exploiter les environnements VMware (vSphere, vCenter, ESXi) ✅ Gérer les infrastructures physiques (serveurs, baies de stockage) ✅ Superviser, diagnostiquer et optimiser les performances des environnements critiques ✅ Participer à l'intégration de nouvelles infrastructures de stockage sur plusieurs sites ✅ Contribuer au capacity planning et à la rationalisation des infrastructures ✅ Piloter et suivre les projets d'évolution (planning, coordination, reporting) ✅ Développer et industrialiser les processus via l'automatisation (Ansible principalement) 🛠 Compétences indispensables ✔ Expertise VMware : vSphere, vCenter, ESXi ✔ Solide expérience en MCO et gestion d'incidents ✔ Bonne connaissance des infrastructures physiques (serveurs, stockage) ✔ Automatisation avec Ansible ou équivalent ✔ Administration systèmes Linux ⭐ Compétences appréciées ➕ Libvirt ➕ Harvester ➕ OpenShift Virtualization Engine (VE) ➕ Capacity Planning ➕ Gestion d'environnements multi-sites 👤 Profil recherché 🔹 Ingénieur ou Expert Infrastructure / Virtualisation 🔹 Minimum 7 ans d'expérience 🔹 Forte autonomie et rigueur 🔹 Capacité à intervenir aussi bien sur des sujets RUN que projets d'évolution 🔹 Permis B obligatoire (déplacements réguliers sur plusieurs sites)
Contexte Securities Services a lancé le programme de transformation QUEST (Quality, Efficiency, Stability) afin d'élever le niveau de maturité de sa production IT. Un des streams du programme porte sur l'automatisation des gestes de la production : le but est de réduire les interventions manuelles, d'améliorer la fréquence de déploiement tout en assurant une plus grande stabilité grâce aux pratiques DevOps et Cloud. L'Expert Cloud DevOps rejoindra la Core Team en charge du stream Automation, équipe incluant notamment un directeur de projet et un leader technique basés à Paris ainsi qu'une équipe de relais techniques à Chennai et Lisbonne. Missions Le chargé d'expertise Cloud DevOps intervient sur tout ou partie des activités suivantes : Développement et maintenance des standards IT permettant une meilleure expérience utilisateur pour les équipes onboardées sur les Offres de Service du Groupe (Ansible Automation Platform, Argo CD, Digital AI Release, ...) Sensibilisation de la ligne managériale Accompagnement des équipes sur leur montée en autonomie : support au travers de divers canaux (outillage, documentation, training, sessions de travail), apport du conseil et des propositions d'amélioration, s'assurer de la bonne appropriation des pratiques, de la conformité aux standards, animation de l'amélioration continue Mise en place d'une visibilité des progrès / bénéfices pour les équipes au travers de la mise en place d'indicateurs pertinents et l'organisation de retours d'expérience Interface avec l'Offre de Service du Groupe pour retour d'expérience des besoins et propositions d'amélioration Outils & Environnement DevOps / SRE : CI/CD : Jenkins, Gitlab CI, Argo CD, Ansible, Digital AI Release Infrastructure as Code : Terraform, Ansible GitOps et gestion de configuration Déploiements automatisés Cloud / Conteneurs : Openshift, Docker, Kubernetes, Helm, sécurité des conteneurs Programmation & Scripting : Python, YAML, Shell Monitoring : Dynatrace, Grafana Systèmes & BDD : Administration Linux, Oracle, PostgreSQL Méthodologies : Agile/Scrum, Site Reliability Engineering (SRE), DevSecOps, ITIL
Ingénieur Systèmes Linux / DevSecOps – Azure Nous recherchons un Ingénieur Systèmes Linux / DevSecOps disposant d'une solide expérience en administration Linux et en exploitation (RUN). Le candidat devra maîtriser les outils d'automatisation, notamment Ansible, ainsi que Python pour le développement et la maintenance de playbooks. Une expérience en DevOps Azure est indispensable, tandis qu'une connaissance des environnements AWS constituera un véritable atout. Une bonne maîtrise de l'anglais, à l'écrit comme à l'oral, est également requise. Dans le cadre de cette mission, vous serez en charge de la conception, du déploiement, du maintien en conditions opérationnelles et de l'évolution des systèmes, des middlewares et des environnements conteneurisés du périmètre. Vous participerez à la conception et à la mise en œuvre des évolutions des architectures applicatives, tout en assurant l'administration des serveurs et des composants PaaS. Vous interviendrez également sur le support de niveaux N2 et N3, la gestion des plans de production des applications ainsi que l'accompagnement des équipes sur les problématiques techniques liées aux technologies du domaine. Vous contribuerez aux projets techniques et métiers, en assurant le traitement des demandes, incidents, problèmes, changements et plans d'actions conformément aux processus établis. Vous serez amené à développer et maintenir les chaînes d'intégration et de déploiement continus (CI/CD) nécessaires aux projets DevOps, à automatiser les processus et les tâches d'exploitation, ainsi qu'à déployer les composants dans le Cloud Public Azure. Vous apporterez également un support technique aux équipes de développement et participerez activement à la diffusion des bonnes pratiques DevSecOps au sein des équipes et des communautés techniques. Enfin, vous assurerez la mise à jour de la documentation technique et opérationnelle, l'alimentation des outils de suivi tels que Jira et ServiceNow, ainsi que la configuration des outils d'exploitation (supervision, sauvegarde, etc.). Vous pourrez être amené à participer aux astreintes et aux interventions planifiées en dehors des heures ouvrées lorsque les besoins de production l'exigent.
Développeur Python Dans le cadre des activités de CI/CD, l'équipe Services CI/CD et Automatisation recherche un Ingénieur DevOps – Dev Python. Missions : - Participer au développement de scripts, services et API (principalement en Python) - Participer à la mise en œuvre des outils DevOps, à leur configuration et à leur évolution - Participer au maintien en condition opérationnelle des outils, services et API du périmètre - Prendre en charge les incidents ou demandes d'évolution - Travailler en équipe Agile Compétences techniques : • Ansible : Création playbook, gestion de config, déploiement… (obligatoire) o Ansible (obligatoire) o AWX (souhaitable) o RedHat AAP (souhaitable) • CI / CD : o Git / Gitlab (obligatoire) o Jenkins (souhaitable) o Artifactory / Xray (souhaitable) o SonarQube (souhaitable) o Hashicorp Vault (obligatoire) • Langages & Scripting : o ssh, powershell (souhaitable) o Langages : Python (obligatoire - expérimenté) o Rest API (fortement souhaitable) • Data o ELK / Kibana (souhaitable) o Kafka (souhaitable) • Cloud o Kubernetes (souhaitable) • OS o Scripting & Administration Linux et Windows (souhaitable) Compétences relationnelles et organisationnelles : Aptitude de travail en équipe. Capacité à trouver sa place dans une organisation complexe avec de nombreux contributeurs. Capacité de communication orale et écrite. Force de proposition. Résolution de problèmes. Expérience : Profil confirmé sur Ansible, sur les outils DevOps et expérimenté en Python.