Dans le cadre du renforcement de notre équipe, nous recherchons un Ingénieur Production IA spécialisé dans les usages IT for IT. L'objectif est d'intégrer l'IA directement dans les activités de production informatique afin d'améliorer le monitoring, la supervision, la gestion des incidents, l'automatisation et le traitement des tickets. Nous recherchons un profil ayant déjà mis en œuvre des solutions IA en environnement IT/Production, capable de faire le lien entre les problématiques de production informatique et les nouvelles possibilités offertes par l'IA. Missions principales: Assurer la production et la supervision des environnements IT. Mettre en place et améliorer les dispositifs de monitoring, alerting et supervision. Identifier les tâches de production pouvant être automatisées grâce à l'IA. Concevoir et mettre en œuvre des solutions d'IA appliquées aux opérations IT (IT for IT). Automatiser le traitement et la qualification des tickets. Développer des scripts et automatisations pour faciliter les activités d'exploitation. Participer aux phases de déploiement, intégration et mise en production des solutions. Mettre en place des mécanismes permettant d'exploiter les données issues des outils de supervision, incidents et bases de données. Participer à l'amélioration de la détection, analyse et résolution des incidents. Travailler sur l'automatisation des alertes et des actions de remédiation. Veiller à la disponibilité, la performance et la fiabilité des systèmes. Participer aux activités liées aux bases de données, sauvegardes et procédures d'exploitation. Appliquer les bonnes pratiques et processus ITIL. Contribuer à l'amélioration continue des processus de production.
Mission principale : Au sein du service Infrastructure, l'Administrateur Linux assure le déploiement, l'exploitation, le maintien en conditions opérationnelles et la sécurisation des systèmes Linux de l'entreprise. Il garantit la disponibilité, la performance et la supervision des serveurs et services hébergés sur les environnements Red Hat, CentOS et Debian, sur les sites centraux comme sur les plateformes logistiques. Activités principales : 1. Administration et exploitation des systèmes Linux : Installer, configurer et maintenir les serveurs Linux (Red Hat, CentOS, Debian). Assurer les mises à jour, les correctifs de sécurité et la gestion des paquets (yum/dnf, apt). Gérer les utilisateurs, les droits d'accès et les stratégies de sécurité système. Automatiser les tâches d'administration via scripts (Bash, Shell). Maintenir la documentation technique des environnements Linux. 2. Supervision et monitoring : Déployer et administrer les solutions de supervision ICINGA et ICINGA2. Configurer les sondes et les indicateurs de surveillance via SNMP. Assurer le suivi proactif de la disponibilité et des performances des serveurs. Définir les seuils d'alerte, les mécanismes de notification et anticiper les incidents de capacité. 3. Maintien en conditions opérationnelles et sécurité : Garantir la disponibilité et la résilience des services hébergés. Mettre en œuvre les stratégies de sauvegarde et de restauration. Appliquer les bonnes pratiques de durcissement (hardening) et de gestion des vulnérabilités. Contribuer aux plans de continuité et de reprise d'activité (PCA/PRA). 4. Analyse et résolution des incidents Analyser les dysfonctionnements affectant les systèmes et services Linux. Réaliser les diagnostics techniques et assurer le support de niveau expert. Suivre les incidents jusqu'à leur résolution complète. Produire les rapports d'analyse et les recommandations d'amélioration. Participer aux cellules de crise en cas d'incidents majeurs. Compétences techniques : Systèmes d'exploitation : Maîtrise des systèmes Red Hat Enterprise Linux (RHEL). Maîtrise des systèmes CentOS et Debian. Bonne connaissance de la gestion des paquets (yum/dnf, apt) et du scripting (Bash, Shell). Compétences en sécurisation et durcissement des systèmes Linux. Supervision et monitoring : Forte connaissance des solutions de monitoring ICINGA et ICINGA2. Maîtrise du protocole SNMP et de la configuration de sondes. Analyse des performances, diagnostic système et gestion des alertes. Mise en place de tableaux de bord et de rapports de supervision. Automatisation et déploiement : Maîtrise d'Ansible pour l'automatisation de l'administration et le déploiement des configurations. Déploiement automatisé et centralisé des packages sur l'ensemble du parc de serveurs Linux. Gestion de la télédistribution et de la mise à jour à grande échelle via playbooks et inventaires Ansible. Industrialisation des tâches récurrentes et gestion de configuration en approche Infrastructure as Code. Qualités requises Rigueur et sens de l'organisation. Esprit d'analyse et capacité de diagnostic. Réactivité face aux incidents. Autonomie et sens des responsabilités. Qualités relationnelles et sens du service. Capacité à travailler en équipe et avec des interlocuteurs variés. Environnement technique OS : Red Hat, CentOS, Debian Supervision : ICINGA / ICINGA2 : CONNAISSANCE INDISPENSABLE Protocole : SNMP Scripting & automatisation : Bash / Shell / Ansible