Linux is a powerful open-source operating system used in various environments, from servers to desktops. It is known for its stability, security, and flexibility, making it a favorite among developers and IT professionals.
Nous recherchons pour notre client un(e) Expert Kubernetes /IA (H/F). Rôle principal : Garantir la disponibilité, performance et stabilité du cluster IA (GPU/CPU/réseau/stockage), automatiser son exploitation et assurer le support. Vos missions : Maintien en condition opérationnelle (MCO) du cluster IA, incluant la gestion des nœuds GPU/CPU, du stockage et du réseau. Administration des systèmes Linux : installation, configuration et optimisation. Exploitation et gestion des environnements Kubernetes : déploiement, montée en charge (scaling) et haute disponibilité (HA). Supervision et monitoring des infrastructures à l'aide d'outils tels que Prometheus et Grafana. Gestion des incidents techniques, analyse post-mortem et mise en place de plans d'action correctifs. Automatisation des tâches opérationnelles via Ansible et scripts Bash/Python. Gestion des jobs : ordonnancement des tâches GPU, gestion des quotas et priorités. Pilotage des mises à jour des systèmes d'exploitation, des pilotes NVIDIA et des composants Kubernetes. Gestion des incidents liés à l'infrastructure et coordination des interventions. Rédaction et mise à jour de la documentation d'exploitation pour assurer la traçabilité et la continuité des opérations.
Dans le cadre d'une mission longue chez l'un de nos clients grands comptes, nous recherchons un Référent Technique / Architecte Java Senior capable de conjuguer expertise technique hands-on et forte maîtrise de l'architecture applicative. Vous interviendrez comme référent auprès des équipes de développement et participerez activement aux choix et évolutions d'architecture. Le poste nécessite de rester proche du code et des problématiques concrètes de production : il ne s'agit pas d'un rôle d'architecte uniquement transverse ou documentaire. Vos principales missions : Définir, challenger et faire évoluer l'architecture technique et applicative ; Être le référent technique des équipes de développement ; Accompagner les développeurs sur les problématiques complexes et réaliser des revues de code ; Garantir les bonnes pratiques autour de Java, Spring/Spring Boot et Angular ; Participer aux choix de conception, patterns d'architecture et orientations techniques ; Traiter les problématiques de performance, disponibilité, résilience et continuité de service ; Intervenir sur les problématiques de production et de MCO / RUN / support N2-N3 ; Contribuer aux sujets de diagnostic et d'optimisation JVM et SQL ; Participer aux problématiques de HA, clustering, failover et PRA/PCA ; Produire et maintenir la documentation et les dossiers d'architecture technique.
Les Filles & les garçons de la tech recrutent un.e Ingénieur.e SRE / DevOps Kubernetes chargé d'assurer la fiabilité, la performance et la disponibilité des applications et infrastructures en production. Chez FGTech, 1 jour par semaine est dédié à l'amélioration continue, aux formations et certifications, au partage technique, aux actions associatives ou au repos (modèle 4+1). Vous intervenez notamment sur : Le maintien en conditions opérationnelles (MCO) des systèmes, applications et flux. La surveillance et l'observabilité des environnements afin d'anticiper et résoudre les incidents. La gestion des environnements de recette, préproduction et production. L'analyse des incidents, la recherche des causes racines et la mise en œuvre d'actions correctives. L'automatisation des opérations et des déploiements via CI/CD, GitOps et Infrastructure as Code. L'administration et la supervision d'environnements Kubernetes / Rancher. L'optimisation des performances, de la résilience et de la haute disponibilité. La gestion et la supervision d'infrastructures Cloud. La mise en place et le maintien de la documentation et des procédures d'exploitation. La collaboration avec les équipes développement, infrastructure et production dans une démarche SRE / DevOps.
Contexte La mission s'inscrit dans le cadre du renforcement d'une équipe en charge d'une plateforme d'infrastructure mutualisée. L'intervenant interviendra sur l'administration et l'évolution d'environnements conteneurisés Kubernetes et Red Hat OpenShift hébergés sur OVHcloud, au service de plusieurs clients principalement issus du secteur public. Activités principales Administrer et maintenir en conditions opérationnelles (MCO) les clusters Red Hat OpenShift, Kubernetes et les environnements Linux. Participer aux activités de BUILD et de RUN (installation, configuration, mises à jour, supervision et troubleshooting). Automatiser les opérations d'exploitation et de déploiement à l'aide d'Ansible et des outils DevOps. Contribuer à l'amélioration continue, à la standardisation et à la sécurisation des plateformes. Analyser les performances, résoudre les incidents complexes et optimiser les infrastructures. Compétences et Environnement Technique Obligatoires : OpenShift, Kubernetes, Linux RedHat, Ansible. Importants : Helm, ArgoCD. Appréciés : OVHcloud (ou autres plateformes cloud), outils CI/CD, solutions de supervision et de monitoring.
Dans le cadre de l'évolution de son système d'information, notre client recherche un(e) chef(fe) de projet technique senior pour piloter le rapatriement d'une plateforme de gestion électronique de documents vers son propre centre de données. Vous prendrez en charge la roadmap, la gouvernance, le suivi budgétaire et le reporting du projet. Vous coordonnerez les équipes techniques, sécurité, infrastructures, exploitation et métiers, tout en supervisant l'inventaire des actifs, la cartographie des dépendances, le transfert de connaissances et l'identification des engagements contractuels. Vous sécuriserez les scénarios de bascule et de retour arrière, préparerez les validations GO/NOGO, organiserez les recettes et accompagnerez la mise en exploitation de la solution. L'environnement comprend notamment ESX, VMware, Linux/RHEL, JBoss, PostgreSQL, Kubernetes et Docker. La mission s'inscrit dans un contexte hybride, avec deux jours de télétravail par semaine.
Nous sommes à la recherche d'un poste d'administrateur/ingénieur système plutôt sur les technologies Microsoft. D'un niveau minimum bac +4 avec 5 ans d'expérience sur un poste similaire. Avec une écoute, une force de travail en équipe, de la pédagogie, et des capacités d'adaptation reconnues. Maîtrisant les technologies Microsoft ( Windows Server, PowerShell, Active Directory, GPO, Exchange/O365 ), VMWare ( VCenter, ESX ), Rubrik Backup, l'automatisation via Ansible/AWX, et avec de bonnes connaissances sur les environnements Cloud Azure.
Dans le cadre du développement de nos activités, nous recherchons un Ingénieur OPS / Production H/F pour intervenir chez l'un de nos clients grands comptes du secteur de l'assurance, basé à Niort. Au sein d'une équipe en charge du maintien en condition opérationnelle et de l'évolution des environnements applicatifs, vous contribuerez à garantir la disponibilité, la performance et la fiabilité des solutions du système d'information. Vous interviendrez sur des environnements de production et hors production et participerez aux activités de déploiement, d'exploitation, d'industrialisation et d'automatisation, en collaboration avec les équipes projets, études, architecture et exploitation. Vos principales responsabilités pourront être les suivantes : Participer au maintien en condition opérationnelle des applications et des environnements du périmètre. Participer à l'élaboration des dossiers d'architecture avec les architectes et analyser les impacts des évolutions sur le SI. Accompagner les équipes projets dans les phases de déploiement et de mise en production. Vérifier la conformité et la complétude des dossiers d'exploitation fournis par les équipes Build. Planifier et suivre les changements majeurs et transverses. Réaliser les mises en production sur les différents environnements et évaluer les risques et impacts techniques associés. Administrer et faire évoluer les serveurs, environnements, outils et composants applicatifs. Industrialiser et automatiser les traitements et les actes d'exploitation. Mettre en œuvre et faire évoluer les chaînes d'intégration et de déploiement continu CI/CD. Analyser les alertes de supervision et proposer les plans de remédiation adaptés. Assurer le support de niveau 3 et contribuer à la résolution des incidents et problèmes en lien avec les équipes d'exploitation. Participer aux cellules de crise en cas d'incident majeur. Mettre en place et maintenir les outils et procédures d'exploitabilité, d'observabilité et de supervision. Rédiger et maintenir les dossiers d'exploitation, modes opératoires et documents nécessaires au suivi des environnements. Contribuer au partage des standards SI, des bonnes pratiques DevOps et des principes d'architecture auprès des différentes équipes. Vous évoluerez dans un environnement technique exigeant et collaboratif, mêlant enjeux de production, automatisation, industrialisation et amélioration continue de la disponibilité des services. La mission est basée à Niort avec 3 jours de présence sur site par semaine. Des interventions ponctuelles ou astreintes en horaires non ouvrés pourront être nécessaires dans le cadre de certaines mises en production.
Vous rejoignez une équipe de production Data d'une dizaine de personnes chez un grand compte du secteur bancaire, en Île-de-France. L'équipe construit et exploite les applications d'une plateforme de données de groupe hébergée sur Google Cloud Platform. VOS MISSIONS • Contribuer au développement de l'automatisation et de l'intégration continue (CI / CD) • Mettre en place les chaînes de traitement via l'ordonnanceur Control-M, en assurer le suivi et la supervision • Gérer les flux de fichiers via des outils de transfert de type CFT • Assurer la gestion des environnements hors production et production • Participer aux projets techniques sur Google Cloud Platform et contribuer à la stratégie de développement des projets cloud • Garantir le bon fonctionnement des applications métiers et assurer le support opérationnel aux utilisateurs • Diagnostiquer et résoudre les incidents de niveau 2, et formuler des recommandations • Développer des scripts, rédiger les procédures et la documentation d'exploitation CONTEXTE TECHNIQUE Une migration du patrimoine d'ordonnancement vers Control-M est en cours : la maîtrise de cet ordonnanceur est déterminante sur le poste. La chaîne de déploiement s'appuie sur XL Deploy, XL Release et Jenkins, dans une organisation DevOps. Mission longue durée, démarrage dès que possible. Poste basé à Charenton-le-Pont (94), avec deux jours de télétravail par semaine.
Rejoignez-nous pour une mission chez notre client grand compte du secteur de l'énergie basé à Montrouge (92) en tant qu'Administrateur Systèmes & Réseaux Confirmé. Vous serez responsable du build et de l'exploitation d'une infrastructure virtualisée. Votre champ d'action : support prioritaire sur les systèmes de sécurité bâtimentaire (en collaboration avec l'équipe d'architecture client), mais aussi sur d'autres projets d'infrastructure selon besoins. Pour la partie Build : Installation et configuration des serveurs designés par l'équipe d'architecture Déploiement des produits virtualisés Validation et tests en environnement de production Hardening et sécurisation selon standards ANSSI Pour la partie Run (MCO & Évolutions) : Supervision et monitoring de l'infrastructure Gestion des incidents et troubleshooting Maintenance préventive et optimisations Gestion des évolutions : versionning, upgrades, patches, nouvelles fonctionnalités Support opérationnel en production Informations complémentaires : Démarrage : Début octobre 2026 Contrat : CDI Localisation : Montrouge (92) Télétravail : 1 jour de télétravail Expérience : 10 ans d'expérience minimum Rémunération : 54 à 58 K€
Contexte : Administration, optimisation et sécurisation des bases de données critiques, amélioration des performances, haute disponibilité, automatisation et accompagnement des équipes projets. Si cette opportunité correspond à votre profil, n'hésitez pas à me communiquer votre TJM, ainsi que vos disponibilités. Je serai également ravie d'échanger avec vous afin de vous présenter la mission plus en détail et répondre à vos éventuelles questions. Les livrables attendus sont : ? Scripts d'amélioration ? Documentation d'architecture. ? Procédures d'exploitation. ? Rapports de performance. ? Rapports d'audit et recommandations. ? Plans de sauvegarde et de reprise Les principaux attendus de la prestation : Environnement technique : PostgreSQL 12 à 16, SQL avancé, Linux, PgBouncer, PgPool, Streaming Replication, Patroni, pgBackRest, Shell, Python, avec une exposition aux environnements Cloud et DevOps (Kubernetes, Ansible, Terraform, Jenkins). Profil recherché : Niveau 3 de prestation soit + de 9 ans d'expérience informations supplémentaires : Localisation : Nanterre (92), avec une partie de la mission réalisée en télétravail. Démarrage : Début septembre 2026. Durée : Jusqu'à fin décembre 2027.
L'intervention s'inscrit au sein de la Core Team en charge du stream Automation (incluant un directeur de projet, un leader technique et des relais techniques à Paris, Chennai et Lisbonne). Le périmètre d'intervention couvre tout ou partie des activités suivantes : Développement et maintenance des standards de 2S IT permettant une meilleur expérience utilisateur pour les équipes onboardées sur les Offres de Service du Groupe Sensibilisation de la ligne managériale Accompagnement les équipes sur leurs montée en autonomie: support au travers de divers canaux (outillage, documentation, training, sessions de travail), apport du conseil et des propositions d'amélioration, assurance de la bonne appropriation des pratiques, de la conformité aux standards, animation de l'amélioration continue mise en place d'une visibilitée des progrès / bénéfices pour les équipes au travers de la mise en place d'indicateurs pertinents et l'organisation de retours d'expérience Interface avec l'Offre de Service du Groupe pour retour d'expérience des besoins et propositions d'amélioration 2S
Maintien en condition opérationnelle des solutions d'automatisation et d'ordonnancement Définition et déploiement des standards d'utilisation Production d'automatisations complexes issues de besoins opérationnels/métiers Création de templates d'automatisation pour besoins récurrents Création et maintenance de dashboards end-users Automatisation des tâches d'administration et demandes de services ITSM Accompagnement et transfert de compétence aux équipes N1/N2 Création et maintenance de la documentation technique Participation à la roadmap des outils Évolution des automatisations selon les nouvelles exigences Veille technologique sur les pratiques et tendances en automatisation Collaboration avec les équipes infra pour les interconnexions outils
Notre client est une entreprise locale implantée à Colmar, historiquement spécialisée dans les services énergétiques et les télécommunications. Elle intervient notamment dans la distribution d'électricité et de gaz, ainsi que dans les télécommunications et les services numériques. Dans un contexte de renforcement de sa Direction Informatique et Transition Numérique, notre client recherche un Administrateur Systèmes & Réseaux expérimenté afin d'intervenir sur l'administration, l'exploitation, le maintien en conditions opérationnelles et l'évolution de ses infrastructures informatiques. L'intervenant intégrera directement l'équipe systèmes et réseaux en place et évoluera dans un environnement technique diversifié couvrant notamment les systèmes Microsoft, Microsoft 365, la virtualisation, le stockage, les réseaux, la sécurité, Linux, la sauvegarde et la supervision. À ce titre, ses principales missions seront de : Assurer l'administration et l'exploitation quotidienne des infrastructures systèmes et réseaux ; Participer au maintien en conditions opérationnelles (MCO) du système d'information ; Superviser les infrastructures, identifier les alertes et participer à leur résolution ; Prendre en charge les incidents de niveaux 2 et 3 ; Apporter un support de niveau 2 au HelpDesk ; Participer aux projets techniques et aux évolutions du SI ; Contribuer aux choix techniques et être force de proposition sur les améliorations à apporter aux infrastructures ; Intégrer les enjeux de cybersécurité dans l'ensemble des actions menées ; Documenter les interventions et maintenir à jour les procédures, dossiers d'exploitation, schémas d'architecture et autres éléments de documentation technique ; Participer au transfert de compétences auprès des équipes internes. Le poste nécessite une bonne polyvalence en administration d'infrastructures, avec des compétences attendues sur les principaux domaines suivants : Systèmes Microsoft : Active Directory, GPO, DNS, DHCP, environnements Windows Server, gestion des identités et des droits. Microsoft 365 : administration des environnements collaboratifs Microsoft 365 et des services associés. Virtualisation, serveurs et stockage : administration et exploitation d'environnements virtualisés et des infrastructures serveurs. Réseaux & sécurité : administration réseau, gestion des accès et des équipements de sécurité, avec une attention particulière portée aux principes de cybersécurité et de moindre privilège. Linux & exploitation : administration et exploitation de systèmes Linux. Sauvegarde & supervision : suivi des sauvegardes, supervision des infrastructures et traitement des alertes. Automatisation & outils : capacité à utiliser et à développer des outils permettant d'automatiser ou de fiabiliser les tâches d'administration.
Localisation : Strasbourg — Possibilité de télétravail selon les règles du projet Contrat : CDI Votre rôle chez HELPLINE Pour accompagner nos grands comptes et soutenir des systèmes d'information critiques du secteur public / protection sociale, nous renforçons nos équipes d'exploitation. Vous intégrez une équipe dédiée au Maintien en Condition Opérationnelle (MCO) pour garantir la continuité des services applicatifs et respecter des engagements de service exigents (7h – 18h30). Vos missions au quotidien Supervision & MCO : Surveiller et maintenir en condition opérationnelle l'ensemble des plateformes de préproduction (VIP) et de production. Pilotage de production : Préparer, planifier et contrôler la bonne exécution du plan de production au quotidien. Pré-production & Mises en production : Réaliser les travaux préparatoires en préproduction (traitements sensibles, validations d'intégration avant MEP applicatives). Support & Incidents : Prendre en charge et traiter les demandes d'évolution ainsi que les incidents d'exploitation (Niveaux 2/3). Évolution de la prestation : Possibilité d'évoluer progressivement vers des missions d'intégration technique sur le même périmètre. Astreintes et contraintes d'exploitation : Garantir la continuité de service peut impliquer des interventions ponctuelles planifiées en soirée, week-ends et jours fériés (notamment lors des ouvertures de service exceptionnelles ou des exercices de Plan de Secours Informatique - PSI). Votre profil Exploitant applicatif confirmé, vous justifiez d'une solide expérience sur des environnements complexes et critiques : Systèmes & Bases de données : Maîtrise des environnements Linux et AIX, ainsi que des bases de données PostgreSQL. Ordonnancement & Middleware : Pratique des principes d'ordonnancement (Automator, $Universe / $U) et des serveurs d'applications JBoss. Scripting : Solides compétences en Shell Scripting. Savoir-être : Rigueur méthodologique, sens du service, réactivité et esprit d'équipe.
Dans le cadre du renforcement d'une équipe en charge d'environnements Cloud critiques, nous recherchons un Expert AWS Production pour accompagner l'exploitation, la sécurisation et l'évolution des infrastructures hébergées sur AWS. Tu interviens sur des environnements à forts enjeux de disponibilité et de performance, avec une forte dimension RUN, automatisation, observabilité et résilience. Tes missions principales : Assurer le maintien en conditions opérationnelles des environnements AWS Superviser la disponibilité, les performances et la capacité des infrastructures Cloud Analyser et résoudre les incidents de production complexes Réaliser les analyses de causes racines et piloter les actions correctives associées Mettre en place et améliorer les dispositifs de monitoring, alerting et observabilité Sécuriser et fiabiliser les architectures AWS existantes Accompagner les mises en production et les déploiements Automatiser les tâches d'exploitation et d'administration récurrentes Industrialiser les environnements via l'Infrastructure as Code Optimiser les performances et les coûts des ressources Cloud Participer à l'amélioration des procédures et standards d'exploitation Apporter une expertise technique aux équipes Infrastructure, DevOps, Sécurité et Développement Contribuer aux problématiques de PRA/PCA, haute disponibilité et résilience
INGENIEUR SYSTEME - PRODUCTION - KUBERNETES Démarrage : ASAP Durée : 3 ans Localisation : Ile de France (Proche Paris) Télétravail : 50% Contexte : La mission s'inscrit au sein du département Application Production Support. Le prestataire participe à la continuité de service des applications de gestion du risque. Il s'agit d'une mission d'ingénierie de production sur une plateforme en forte croissance • Environnement : Linux Redhat • middleware : Kafka, Kubernetes, Consul,Apache,CFT,MQ Series • Bases de données :SQL server, Sybase IQ, Cassandra • Outils de déploiement : Jenkins/Ansible Les applicatio Mission : • Support technique – L1/L2 des applications : prise en charge des incidents, suivi des problèmes et garantie d'une transition fluide vers les équipes « Follow-the-Sun ». • Intégration technique : mise en œuvre d'upgrades majeurs, gestion de l'obsolescence, construction de road-maps, estimation de charge et suivi des jalons en tant que point de contact unique avec les équipes de développement et d'infrastructure. • Gestion et suivi des exigences de sécurité tout au long du cycle de vie des applications (Patching sécurité, renouvellement des certificats, chiffrement des fichiers, segregation des environnements, protection des données) • Capacité & performances : suivi de la capacité et optimisation des performances. • Gestion du changement : planification, programmation, implémentation, documentation et exécution des activités de changement, tout en respectant les processus globaux. • Installation & intégration des systèmes : déploiement, tests techniques, validation des dossiers d'exploitation/installation et rédaction de la documentation de RUN. • Contribution DevOps : Améliorer l'automatisation, le déploiement continu et la résilience de la plateforme existante. • Collaboration et autonomie : travail en autonomie tout en s'inscrivant dans le cadre d'une structure de support globale dans un environnement Anglophone. • Continuité de service : Participer au dispositif d'astreintes (24/7) garantissant le fonctionnement critique des applications. Participer aux tests de reprise d'activité.