Dans le cadre d'un renfort, nous recherchons un Data Analyst confirmé. Vos principales missions seront de : Contrôler le bon fonctionnement des différents produits, services et jobs en production par un monitoring quotidien Accompagner le développement des nouvelles fonctionnalités en construisant des reportings pertinents Analyser les comportements clients et proposer des pistes d'amélioration de nos process, en collaboration avec le/la Product Manager Participer aux réunions d'équipe quotidiennes afin de partager les analyses produites et les éventuels incidents identifiés
Dans le cadre du renforcement d'une équipe de production, nous recherchons un(e) Ingénieur(e) Systèmes Linux pour intervenir sur des infrastructures On-Premise et contribuer au maintien en conditions opérationnelles, à l'automatisation des processus et à l'amélioration continue de l'environnement. Un enjeu particulier de la mission sera la reprise et la gestion de l'orchestration d'une ferme de calcul CPU avec SLURM. Vos missions : 🎯 Administrer et superviser les serveurs Linux : suivi des ressources, analyse des logs, traitement et résolution des incidents ; Assurer la maintenance préventive et curative des environnements : correctifs de sécurité, mises à jour, gestion des obsolescences ; Automatiser et industrialiser les tâches récurrentes à l'aide d'Ansible ; Intervenir en support de niveau 2/3 auprès des équipes internes ; Participer à l'amélioration continue, à la fiabilisation et à l'optimisation des infrastructures ; Prendre en charge progressivement l'administration et l'orchestration de la ferme de calcul CPU via SLURM ; Assurer la documentation technique des environnements et des interventions. Environnement technique : 🛠️ Linux, Ansible, Kubernetes, VMware, Proxmox, OpenLDAP, SMTP, IMAP, Apache, SLURM, Confluence, environnements On-Premise
Dans le cadre du renforcement d'une équipe de production, nous recherchons un(e) Ingénieur(e) Systèmes Linux pour intervenir sur des infrastructures On-Premise et contribuer au maintien en conditions opérationnelles, à l'automatisation des processus et à l'amélioration continue de l'environnement. Un enjeu particulier de la mission sera la reprise et la gestion de l'orchestration d'une ferme de calcul CPU avec SLURM. Vos missions : 🎯 Administrer et superviser les serveurs Linux : suivi des ressources, analyse des logs, traitement et résolution des incidents ; Assurer la maintenance préventive et curative des environnements : correctifs de sécurité, mises à jour, gestion des obsolescences ; Automatiser et industrialiser les tâches récurrentes à l'aide d'Ansible ; Intervenir en support de niveau 2/3 auprès des équipes internes ; Participer à l'amélioration continue, à la fiabilisation et à l'optimisation des infrastructures ; Prendre en charge progressivement l'administration et l'orchestration de la ferme de calcul CPU via SLURM ; Assurer la documentation technique des environnements et des interventions. Environnement technique : 🛠️ Linux, Ansible, Kubernetes, VMware, Proxmox, OpenLDAP, SMTP, IMAP, Apache, SLURM, Confluence, environnements On-Premise
EXPERT KUBERNETES / IA (H/F)Contexte de la missionNous recherchons pour le compte de notre client un(e) Expert(e) Kubernetes / IA pour assurer l'exploitation, la disponibilité, la performance et la stabilité d'un cluster IA reposant sur des infrastructures GPU/CPU, réseau et stockage. Le profil recherché devra également contribuer à l'automatisation de l'exploitation, au traitement des incidents et à l'amélioration continue de l'infrastructure. Missions principales Maintien en condition opérationnelle – MCO Garantir la disponibilité, la performance et la stabilité du cluster IA. Administrer les nœuds GPU/CPU, les infrastructures de stockage et les composants réseau. Assurer le suivi et l'optimisation des ressources de l'infrastructure. Piloter les opérations de maintenance et les mises à jour techniques. Administration Linux Installer, configurer et administrer les environnements Linux Ubuntu. Réaliser les opérations d'optimisation et de troubleshooting. Administrer et mettre à jour les pilotes NVIDIA, CUDA et composants associés. Kubernetes Administrer et exploiter les environnements Kubernetes. Réaliser les déploiements, le scaling et la gestion de la haute disponibilité (HA). Assurer le maintien en conditions opérationnelles des clusters. Piloter les mises à jour des composants Kubernetes. Gérer les problématiques liées aux ressources et à la capacité des clusters. Supervision et observabilité Mettre en place et maintenir la supervision des infrastructures. Exploiter Prometheus et Grafana pour le monitoring et l'analyse des performances. Identifier les anomalies et anticiper les incidents grâce à une approche proactive. Automatisation Automatiser les tâches d'administration et d'exploitation avec Ansible. Développer et maintenir des scripts Bash et Python. Optimiser les processus opérationnels afin de réduire les tâches manuelles. Gestion des jobs IA / GPU Assurer l'ordonnancement des tâches et jobs GPU. Gérer les quotas, priorités et ressources GPU. Optimiser l'allocation des ressources CPU/GPU. Gestion des incidents Prendre en charge les incidents techniques complexes. Réaliser les analyses de causes racines et les post-mortems. Définir et suivre les plans d'actions correctifs. Coordonner les interventions avec les différentes équipes techniques. Documentation Rédiger et maintenir la documentation d'exploitation. Formaliser les procédures techniques et les consignes de maintenance. Garantir la traçabilité et la continuité des opérations.
Nous recherchons pour notre client un(e) Expert Kubernetes /IA (H/F). Rôle principal : Garantir la disponibilité, performance et stabilité du cluster IA (GPU/CPU/réseau/stockage), automatiser son exploitation et assurer le support. Vos missions : Maintien en condition opérationnelle (MCO) du cluster IA, incluant la gestion des nœuds GPU/CPU, du stockage et du réseau. Administration des systèmes Linux : installation, configuration et optimisation. Exploitation et gestion des environnements Kubernetes : déploiement, montée en charge (scaling) et haute disponibilité (HA). Supervision et monitoring des infrastructures à l'aide d'outils tels que Prometheus et Grafana. Gestion des incidents techniques, analyse post-mortem et mise en place de plans d'action correctifs. Automatisation des tâches opérationnelles via Ansible et scripts Bash/Python. Gestion des jobs : ordonnancement des tâches GPU, gestion des quotas et priorités. Pilotage des mises à jour des systèmes d'exploitation, des pilotes NVIDIA et des composants Kubernetes. Gestion des incidents liés à l'infrastructure et coordination des interventions. Rédaction et mise à jour de la documentation d'exploitation pour assurer la traçabilité et la continuité des opérations. Profil recherché Vous êtes certifié Kubernetes, justifiez d'une expérience professionnelle minimum de 8 ans dans un poste similaire, et maîtrisez les environnements suivants : Infrastructure : Linux Ubuntu, Kubernetes, Docker, GPU NVIDIA (drivers, CUDA, MIG), Ansible, gestion des environnements distribués. Observabilité : Prometheus, Grafana Stockage : systèmes de fichiers distribués, stockage haute performance et stockage objet Réseau : comprendre l'architecture réseau d'un cluster (VLAN, Load balancing...) Méthodes : ITIL/ITSM, gestion des incidents et des changements, documentation d'exploitation.
Pour un acteur du secteur spatial, nous recherchons un Administrateur Système Linux expérimenté pour renforcer l'équipe de production IT. Objectifs de la mission : Renforcer l'équipe de PROD Linux sur le MCO des infrastructures ON-PREM du client. À ce titre, les activités attendues incluent : Administration et supervision des serveurs Linux (surveillance des ressources, gestion des incidents, analyse des logs). Maintenance préventive et curative : application des correctifs de sécurité, mises à jour des systèmes, gestion des obsolescences. Automatisation des tâches récurrentes via des outils d'infrastructure as code (Ansible) Support de niveau 2/3 auprès des équipes internes et contribution à l'amélioration continue de l'infrastructure. Un focus particulier est attendu sur la maitrise de l'orchestrateur SLURM afin reprendre la gestion de l'orchestration de l'environnement de ferme de calcul CPU.
Dans le cadre du renforcement de ses activités de Capacity Planning Mainframe, nous recherchons un Ingénieur Système sachant piloter la planification des capacités et anticiper les besoins en ressources afin de garantir la disponibilité et la performance des services. La mission vise à ajuster la capacité des plateformes aux besoins de performance exprimés par les clients, tout en garantissant une maîtrise des coûts. Vos missions Au sein de l'équipe Capacity Planning, vous interviendrez sur les environnements Mainframe / Système Z et participerez aux activités de Run et de Build. Vos principales missions seront les suivantes : Élaborer les plans de capacité mensuels et trimestriels. Analyser la consommation CPU, l'activité des partitions clients et les indicateurs de volumétrie. Modéliser et simuler des scénarios capacitaires à court et moyen terme. Produire des reportings, tableaux de bord et synthèses permettant d'orienter les décisions. Suivre les workloads, batchs et cut-off dans le cadre d'études spécifiques. Fournir des recommandations d'optimisation : provisioning, dimensionnement, évolution technologique. Apporter du conseil en amont des projets clients ou internes, notamment sur les sujets liés au WLM. Participer aux échanges avec les équipes clients, clusters et équipes Système Z.
Nous recherchons un Ingénieur IA pour intervenir sur l'intégration, l'optimisation et le déploiement opérationnel des systèmes IA au sein du système d'information. Vos principales missions seront les suivantes : Concevoir et optimiser des prompts avancés pour les usages d'IA générative. Mettre en œuvre des architectures RAG et des mécanismes de contextualisation des modèles (Context Engineering). Concevoir et déployer des chaînes d'ingestion documentaire, de vectorisation et de recherche sémantique. Intégrer les modèles IA au sein des applications métiers via API, SDK ou frameworks spécialisés. Développer et maintenir des pipelines IA dans des environnements Kubernetes on-premise. Mettre en œuvre les pratiques MLOps et LLMOps pour industrialiser les solutions IA. Déployer, superviser et optimiser les moteurs d'inférence. Concevoir les dispositifs de monitoring, d'observabilité et de supervision des plateformes IA. Mettre en place des mécanismes d'évaluation automatisée des modèles (factualité, robustesse, détection des hallucinations). Optimiser les performances des traitements IA (CPU, GPU, quantization, caching). Assurer la conformité des solutions vis-à-vis des exigences de sécurité, du RGPD et de l'AI Act. Participer au traitement des incidents, à l'amélioration continue et au maintien en conditions opérationnelles des plateformes IA.
Dans le cadre d'une mission d'audit de sa production IT,notre client, acteur du secteur bancaire, recherche un Consultant / AuditeurProduction IT afin d'évaluer son dispositif actuel et d'identifier les axesd'amélioration en matière d'exploitation, de disponibilité, de performance etde résilience de son système d'information. La mission est prévue sur la période de septembre àoctobre, pour une durée estimée de 10 à 15 jours. Vos missions Vous réaliserez un audit de la production IT autour des axessuivants : Exploitation et supervision des systèmes Auditer les dispositifs de surveillance et de supervision des infrastructures : serveurs, réseaux et baies de stockage ; Analyser les processus de contrôle et de suivi des traitements batch nocturnes ; Évaluer les procédures et pratiques d'exploitation actuellement en place. Gestion des environnements et des capacités Évaluer le maintien en condition opérationnelle (MCO) des serveurs et middleware ; Analyser la gestion des capacités : CPU, mémoire, stockage et anticipation des montées en charge ; Examiner les pratiques d'administration des bases de données ; Auditer la gestion des licences logicielles et des contrats de maintenance éditeurs. Gestion des incidents et des changements – ITIL Analyser le processus de gestion des incidents N1, N2 et N3, depuis le Helpdesk jusqu'aux équipes d'expertise ; Évaluer les processus de gestion des changements ; Identifier les éventuels points de fragilité et proposer des recommandations d'amélioration en cohérence avec les bonnes pratiques ITIL. Projets d'évolution et mises en production Auditer les processus d'intégration et de mise en production des nouvelles versions applicatives ; Analyser la gestion et l'organisation des environnements de test, recette et préproduction ; Évaluer la maîtrise des risques liés aux changements et aux mises en production. Continuité d'activité et résilience Évaluer les procédures de sauvegarde et de restauration, ainsi que la réalisation des tests associés ; Auditer les dispositifs de continuité et de reprise d'activité ; Analyser les exercices de basculement vers le site de secours / DRP (Disaster Recovery Plan). À l'issue de la mission, vous serez amené à formaliserles constats issus de l'audit, identifier les risques et axes d'amélioration etformuler des recommandations opérationnelles et priorisées.
Nous recherchons un Ingénieur IA pour intervenir sur l'intégration, l'optimisation et le déploiement opérationnel des systèmes IA au sein du système d'information. Vos principales missions seront les suivantes : Concevoir et optimiser des prompts avancés pour les usages d'IA générative. Mettre en œuvre des architectures RAG et des mécanismes de contextualisation des modèles (Context Engineering). Concevoir et déployer des chaînes d'ingestion documentaire, de vectorisation et de recherche sémantique. Intégrer les modèles IA au sein des applications métiers via API, SDK ou frameworks spécialisés. Développer et maintenir des pipelines IA dans des environnements Kubernetes on-premise. Mettre en œuvre les pratiques MLOps et LLMOps pour industrialiser les solutions IA. Déployer, superviser et optimiser les moteurs d'inférence. Concevoir les dispositifs de monitoring, d'observabilité et de supervision des plateformes IA. Mettre en place des mécanismes d'évaluation automatisée des modèles (factualité, robustesse, détection des hallucinations). Optimiser les performances des traitements IA (CPU, GPU, quantization, caching). Assurer la conformité des solutions vis-à-vis des exigences de sécurité, du RGPD et de l'AI Act. Participer au traitement des incidents, à l'amélioration continue et au maintien en conditions opérationnelles des plateformes IA.
Nous recherchons un Ingénieur IA pour intervenir sur l'intégration, l'optimisation et le déploiement opérationnel des systèmes IA au sein du système d'information. Vos principales missions seront les suivantes : Concevoir et optimiser des prompts avancés pour les usages d'IA générative. Mettre en œuvre des architectures RAG et des mécanismes de contextualisation des modèles (Context Engineering). Concevoir et déployer des chaînes d'ingestion documentaire, de vectorisation et de recherche sémantique. Intégrer les modèles IA au sein des applications métiers via API, SDK ou frameworks spécialisés. Développer et maintenir des pipelines IA dans des environnements Kubernetes on-premise. Mettre en œuvre les pratiques MLOps et LLMOps pour industrialiser les solutions IA. Déployer, superviser et optimiser les moteurs d'inférence. Concevoir les dispositifs de monitoring, d'observabilité et de supervision des plateformes IA. Mettre en place des mécanismes d'évaluation automatisée des modèles (factualité, robustesse, détection des hallucinations). Optimiser les performances des traitements IA (CPU, GPU, quantization, caching). Assurer la conformité des solutions vis-à-vis des exigences de sécurité, du RGPD et de l'AI Act. Participer au traitement des incidents, à l'amélioration continue et au maintien en conditions opérationnelles des plateformes IA.
Nous recherchons un Ingénieur IA pour intervenir sur l'intégration, l'optimisation et le déploiement opérationnel des systèmes IA au sein du système d'information. Vos principales missions seront les suivantes : Concevoir et optimiser des prompts avancés pour les usages d'IA générative. Mettre en œuvre des architectures RAG et des mécanismes de contextualisation des modèles (Context Engineering). Concevoir et déployer des chaînes d'ingestion documentaire, de vectorisation et de recherche sémantique. Intégrer les modèles IA au sein des applications métiers via API, SDK ou frameworks spécialisés. Développer et maintenir des pipelines IA dans des environnements Kubernetes on-premise. Mettre en œuvre les pratiques MLOps et LLMOps pour industrialiser les solutions IA. Déployer, superviser et optimiser les moteurs d'inférence. Concevoir les dispositifs de monitoring, d'observabilité et de supervision des plateformes IA. Mettre en place des mécanismes d'évaluation automatisée des modèles (factualité, robustesse, détection des hallucinations). Optimiser les performances des traitements IA (CPU, GPU, quantization, caching). Assurer la conformité des solutions vis-à-vis des exigences de sécurité, du RGPD et de l'AI Act. Participer au traitement des incidents, à l'amélioration continue et au maintien en conditions opérationnelles des plateformes IA.