Contexte : Au sein de l'entité responsable de la production et l'exploitation réseau des Datacenters d'une grande banque internationale, vous rejoignez l'équipe en charge du développement, de la maintenance et de l'amélioration continue des outils de supervision, d'automatisation, de compliance et d'aide au troubleshooting. Le périmètre couvre le réseau, la sécurité, le load balancing, le DNS et les environnements Cloud. Le poste nécessite une forte expertise technique Zabbix, une culture DevOps affirmée et une capacité à travailler en autonomie, en agilité, tout en étant force de proposition.
Le contexte Dans le cadre d'un projet d'évolution et de migration d'une plateforme de supervision, nous recherchons un(e) Administrateur.trice Zabbix afin d'accompagner l'un de nos clients du secteur technologique sur des enjeux d'administration, d'automatisation et d'évolution de sa plateforme de monitoring. Quelques éléments pour mieux comprendre l'environnement : Secteur d'activité : 💻 Technologies / Services technologiques Organisation : Intégré(e) au sein du Pod Observabilité / Monitoring, rattaché à l'entité Global Tech / TechOps, en collaboration avec les équipes techniques (système, BDD, VMware, etc.). Enjeux : Assurer le maintien en conditions opérationnelles et l'évolution de la plateforme Zabbix dans un environnement cloud hybride, notamment avec une migration de la plateforme on-premise vers AWS et un upgrade de Zabbix 6.4 vers 7.x. Ce que tu feras concrètement Dans le cadre de cette mission, tu seras notamment amené(e) à : ➞ Assurer l'administration et le maintien en conditions opérationnelles de la plateforme Zabbix sous Linux ➞ Réaliser les upgrades des différentes briques : Zabbix Server, Zabbix Proxys, Zabbix Agent2, etc. ➞ Créer et mettre à jour les templates de supervision ainsi que les dashboards d'administration ➞ Utiliser les API Zabbix avec Python et automatiser des tâches via Ansible / AWX ➞ Participer à la migration de la plateforme on-premise vers AWS et à l'upgrade de Zabbix 6.4 vers 7.x ➞ Gérer les configurations via Git et assurer la mise à jour de la documentation technique ➞ Proposer et mettre en œuvre des améliorations techniques ➞ Assurer le suivi de la roadmap technique et le support N3 de la solution Ton environnement Technologies : Zabbix, Linux/Unix, Python, PostgreSQL, AWS Outils : Ansible, AWX, Git, VMware Méthodologies : Agile
Résumé Observabilité, Supervision et Évolution des Plateformes Zabbix CONTEXTE : Au sein du Pôle Tech Foundation, la mission s'inscrit dans le Domaine d'Expertise « Automatisation et Observabilité », afin d'accompagner les projets de transformation autour des enjeux d'observabilité, de supervision et de métrologie. Dans un contexte de transformation technologique et organisationnelle, les activités portent sur l'évolution, l'industrialisation et l'amélioration continue des solutions de supervision et d'observabilité déployées à grande échelle. DETAILS : Missions : - Accompagner les projets de transformation autour de l'Observabilité (BUILD). - Contribuer à la rationalisation des solutions et technologies de supervision des environnements Open, Réseau et Natif. - Garantir l'opérabilité de la plateforme Zabbix et des pratiques de Monitoring as Code. - Contribuer à la mise en œuvre de nouveaux composants techniques industrialisés, sécurisés, packagés et automatisés (DevOps). - Veiller aux optimisations liées à l'automatisation des actes d'administration nécessaires aux choix et modèles d'implémentation des composants. - Assurer le support d'expertise en relation avec l'éditeur et les équipes de support (RUN). - Assurer une veille technologique et contribuer à l'anticipation des évolutions produit. - Veiller au contrôle qualité et à l'amélioration continue des plateformes Zabbix. Environnement technique - Supervision Open Zabbix - Métrologie & Dashboarding : Grafana, InfluxDB - Hypervision Netcool Operation Insight (NOI) - Contexte de fabrication et de production industrialisé et automatisé - Environnement à forte exigence de performance, robustesse et scalabilité - Environnement sécurisé - Périmètre d'exploitation d'environ 50 000 serveurs Compétences attendues - Maîtrise du socle technique Zabbix (architecture, intégration, corrélation, administration) - Maîtrise des sujets de métrologie, supervision et qualité de service - Connaissance de Zabbix et/ou Grafana - Pratiques DevOps et automatisation - Connaissance des solutions de supervision déployées dans des environnements grands comptes - Capacité de scripting : Perl, Shell, Python ou Java - Démarche structurée adaptée aux exigences normatives et opérationnelles - Sens du service, capacité de proposition et collaboration transverse - Anglais professionnel écrit et oral
Contexte : Au sein du Pôle Tech Foundation, la mission s'inscrit dans le Domaine d'Expertise Automatisation et Observabilité, avec pour objectif d'accompagner les projets de transformation liés aux enjeux d'observabilité, de supervision et de métrologie. Dans un contexte de transformation technologique et organisationnelle, les activités portent sur l'évolution, l'industrialisation et l'amélioration continue des solutions de supervision et d'observabilité déployées à grande échelle. L'environnement est fortement industrialisé, automatisé, sécurisé, et opère à grande échelle (≈ 50 000 serveurs) avec des exigences élevées de performance, robustesse et scalabilité. Missions : Accompagner les projets de transformation autour de l'Observabilité (BUILD). Contribuer à la rationalisation des solutions et technologies de supervision des environnements Open, Réseau et Natif. Garantir l'opérabilité de la plateforme Zabbix et des pratiques de Monitoring as Code. Contribuer à la mise en œuvre de nouveaux composants techniques industrialisés, sécurisés, packagés et automatisés (approche DevOps). Optimiser et automatiser les actes d'administration liés aux choix et modèles d'implémentation des composants. Assurer le support d'expertise en lien avec l'éditeur et les équipes de support (RUN). Assurer une veille technologique et anticiper les évolutions produit. Veiller au contrôle qualité et à l'amélioration continue des plateformes Zabbix. Environnement technique : Supervision Open Zabbix Métrologie & Dashboarding : Grafana, InfluxDB Hypervision : Netcool Operation Insight (NOI) Contexte DevOps / automatisation / production industrialisée Environnement sécurisé et haute performance
Assurer l'administration de : parc de serveurs Redhat/Windows, plusieurs infrastructures Zabbix, plusieurs clusters Kubernetes K3S, plateforme d'automatisation AWX et de virtualisation KVM, bases de données Maria DB/PostgreSQL Assurer la création de pipeline CI/CD sous Gitlab afin de créer des paquets applicatifs de logiciels développés en interne Créer des images containers Podman Qualifier les équipements pour vérifier leur compatibilité avec OSURI/BOI Assurer les mises en production hebdomadaires des applicatifs OSURI/BOI Assurer le support utilisateur de niveau 3
Dans le cadre du renforcement d'une équipe en charge de la qualité et de l'amélioration continue du pilotage d'exploitation, nous recherchons un Ingénieur Exploitation & Amélioration Continue. Vous interviendrez sur un environnement de production informatique à grande échelle et contribuerez principalement à améliorer la qualité, la pertinence et le délai de traitement des consignes utilisées par les équipes de pilotage. Vos principales missions seront : Contrôler et valider les consignes d'exploitation en adoptant le point de vue des équipes de pilotage et analyser les causes de rejet ou de non-conformité. Suivre les consignes nécessitant une correction, identifier les sujets prioritaires et solliciter les équipes concernées afin de réduire les délais de traitement. Animer les échanges et points de suivi avec les différentes équipes, présenter les indicateurs et assurer le suivi des actions jusqu'à leur résolution. Analyser les événements et incidents issus de la production afin d'identifier les problèmes de qualité, les consignes manquantes ou les axes d'amélioration. Construire et faire évoluer des indicateurs et tableaux de bord sous Power BI afin de suivre la qualité des consignes, leur cycle de vie, les délais de correction et leur utilisation. Participer à la migration progressive des reportings existants sous Excel et PowerPoint vers Power BI. Contribuer au maintien et à l'amélioration du référentiel centralisant les consignes d'exploitation et accompagner ses utilisateurs. Participer aux projets d'amélioration continue, de standardisation et d'automatisation des processus et outils liés au pilotage d'exploitation. Prendre en charge différents sujets de la backlog, assurer leur avancement et rendre compte des difficultés rencontrées. Réaliser des présentations et démonstrations des outils et évolutions auprès des différentes parties prenantes.
Dans le cadre du maintien en conditions opérationnelles et de l'amélioration continue des infrastructures de production, nous recherchons un Ingénieur / Administrateur Systèmes N3 orienté Run et Supervision. Le consultant interviendra au sein des équipes d'exploitation et sera garant de la disponibilité, de la performance et de la fiabilité des environnements techniques. Il assurera le traitement des incidents complexes, l'analyse approfondie des logs, le suivi des plateformes de supervision et le support de niveau 3 sur les infrastructures et applications critiques. Missions principalesExploitation et Maintien en Conditions Opérationnelles (RUN)Assurer le support technique de niveau 3 sur les infrastructures de production. Garantir la disponibilité et les performances des environnements. Réaliser les analyses techniques et les diagnostics avancés. Participer à la gestion des incidents majeurs et à leur résolution. Assurer le suivi des changements et mises en production. Contribuer à l'amélioration continue des procédures d'exploitation. Supervision et MonitoringAdministrer et maintenir la plateforme de supervision Zabbix. Créer et optimiser les dashboards, templates et alertes. Assurer le suivi proactif des alertes d'exploitation. Identifier les dérives de performance et proposer des actions correctives. Mettre en place des indicateurs de disponibilité et de performance. Gestion des InfrastructuresAdministration et exploitation des serveurs : Windows Server Linux Red Hat Enterprise Linux (RHEL) Gestion des configurations et inventaires techniques via NetBox. Participation aux opérations de patching, maintenance et sécurisation des systèmes. Administration Bases de DonnéesExploitation et support de premier niveau avancé sur les bases PostgreSQL. Analyse des performances et incidents liés aux bases de données. Suivi et contrôle des sauvegardes. Analyse des IncidentsAnalyse approfondie des logs systèmes, applicatifs et bases de données. Identification des causes racines (Root Cause Analysis). Rédaction des rapports d'incidents et plans d'actions associés. Contribution aux cellules de crise lors d'incidents critiques. Support ApplicatifSupport et exploitation des applications métier spécifiques : Neo Sygma Environnements Mainframe Coordination avec les équipes études, développement et production. Environnement Technique : Supervision / ObservabilitéZabbix Monitoring et alerting Analyse de logs Gestion des InfrastructuresNetBox SystèmesWindows Server Red Hat Enterprise Linux (RHEL) Bases de donnéesPostgreSQL ApplicationsNeo Sygma Mainframe Outils & MéthodesITIL Gestion des incidents Gestion des changements Documentation d'exploitation
ContexteLe bénéficiaire souhaite une prestation d'accompagnement dans l'objectif d'assurer une mission de Architecture Browsing Cloud. MissionsCompréhension et assimilation des architectures de référence du service browsing internet et intranet. Contribution à la mise en œuvre des architectures et assurance de leur maintien en conditions opérationnelles. Contribution à l'intégration, l'implémentation et l'administration des solutions Sandboxing Web, HSM. Validation, dans les environnements de LAB, des nouvelles gammes HW et des nouvelles versions SW et contribution à leur intégration dans les outils d'exploitation. Rédaction de la documentation d'architecture, d'installation/migration, d'exploitation… (HLD, LLD, Admin Guide, consignes de résolution d'incidents, …). Préparation et mise en œuvre des prérequis et configurations requises permettant aux nouveaux métiers l'utilisation du service Browsing. Maintien du support N3 sur les incidents : investigation avancée, contact des éditeurs, documentation des solutions, implémenter les résolutions, … Contribution à l'optimisation et à la fiabilisation du monitoring du service de browsing.
Lieu : Nantes | Nord-est (44) TJM : 350 à 400 € / Jour Rythme : Temps partiel (2 à 3 jours par semaine) | 100% sur site Nous recherchons pour notre client industriel, dans le cadre d'un remplacement ponctuel, un Administrateur Systèmes à temps partiel à raison de 2 à 3 jours par semaine. Vous intervenez au sein de l'IT Groupe, dans un environnement international et multi-filiales, avec une forte dominante Windows / VMware / sécurité et une dimension projet autour de l'évolution de l'infrastructure vers le Cloud. VOS MISSIONS : Assurer l'administration et le maintien en conditions opérationnelles des infrastructures systèmes. Administrer principalement les environnements Windows Server et, ponctuellement, Linux. Assurer la gestion des environnements VMware et des serveurs. Intervenir auprès des filiales internationales, avec des échanges réguliers en anglais. Assurer le suivi et le renouvellement des certificats. Participer à la sécurisation des infrastructures et au suivi des mises à jour/correctifs. Maintenir et enrichir la documentation technique et les procédures. Développer et améliorer la supervision Zabbix, notamment sur Linux. La mission comporte également une dimension de réflexion et d'accompagnement sur les évolutions de l'infrastructure : Étude et chiffrage du renouvellement des serveurs et de l'infrastructure. Réflexion sur l'avenir de Citrix. Contribution à la trajectoire de migration vers une infrastructure Cloud. Identification de pistes d'amélioration et participation à différents projets d'infrastructure. ENVIRONNEMENT TECHNIQUE : Windows, Linux, VPN, O365, GLPI VMware, Zabbix et Citrix.
Au sein du Pôle Tech Foundation, vous intégrez le Domaine d'Expertise « Automatisation et Observabilité », pour accompagner l'ensemble des clients dans leurs projets de transformation. Avec environ 60 collaborateurs répartis sur 3 sites (Montpellier, Nantes et Saint-Quentin), l'équipe Observabilité recherche un Administrateur Expert Zabbix (H/F) ((Niveau 3 et Architecte Solution). Vous évoluerez dans un contexte de transformation technologique et organisationnelle. Rythme de travail : 3 jours sur site et 2 jours en TT (non négociable)
Nous recherchons un(e) Incident Manager expérimenté(e) pour piloter la gestion des incidents majeurs et coordonner la résolution des crises IT au sein de notre organisation. Ce poste, exposé et exigeant, requiert un sang-froid exemplaire, un excellent sens de la communication et une réelle capacité à fédérer des équipes techniques sous pression. Missions principales1. Gestion des incidents majeurs Coordonner la résolution rapide des incidents critiques (P1/P2), en mobilisant les équipes techniques et en assurant un retour à la normale dans les meilleurs délais. 2. Communication de crise Assurer une communication claire et régulière avec les parties prenantes (utilisateurs, direction, clients) pendant toute la durée de l'incident. 3. Analyse post-incident Conduire des analyses de causes profondes (RCA), rédiger des rapports post-mortem et proposer des actions correctives pour éviter la récurrence. 4. Suivi des indicateurs de performance Surveiller les SLA/KPI liés aux incidents, produire des tableaux de bord et participer aux comités de pilotage. 5. Amélioration continue et coordination Collaborer avec les équipes IT (support, infrastructure, développement, sécurité) pour améliorer les processus de gestion des incidents et renforcer la résilience du système.
Almatek recherche pour l'un de ses clients, un Architecte / Expert Dynatrace Managed sur Blois. Contexte de la mission Dans le cadre du renforcement d'une démarche stratégique d'Observabilité IT et SRE, l'équipe en charge de l'Observabilité recherche un expert Dynatrace & SRE afin d'accompagner la mise en œuvre, l'industrialisation et l'évolution des pratiques d'observabilité. L'intervention couvrira les environnements Production et Hors Production, avec un fort enjeu autour de l'analyse de bout en bout, du suivi de la performance, de la fiabilité des services et de la mise en œuvre des pratiques SRE. Description de la mission: Le consultant interviendra notamment sur les activités suivantes : Réaliser des analyses et formuler des préconisations en Production et Hors Production à l'aide de Dynatrace, sur les flux TP et batch. Assurer le suivi et l'analyse de la production via Dynatrace. Intervenir en tant que référent technique et Lead lors de situations de type Task Force. Concevoir et animer des workshops et sessions de formation autour de Dynatrace. Accompagner la montée en compétence des équipes sur Dynatrace Managed, Grail et leur infrastructure. Contribuer aux projets de migration de Dynatrace Managed vers Grail ou vers une solution d'observabilité alternative. Mettre en œuvre les principes et pratiques SRE : SLO, indicateurs de fiabilité, automatisation, etc. Concevoir des tableaux de bord métier et IT de bout en bout. Assurer un support technique de niveau N2/N3 sur Dynatrace. Contribuer à l'analyse de l'expérience utilisateur (UX) et à l'identification des axes d'amélioration. Livrables attendus: Rapports d'analyse à la demande sur les environnements Production et Hors Production. Tableaux de bord métier et IT dans Dynatrace. Définition et mise en œuvre de SLO sur les KPI métier et IT. Comptes rendus de réunions et d'ateliers. Supports de formation et de workshops. Suivi de l'activité et des actions dans Jira. Documentation technique et fonctionnelle interne.
Mission Ingénieur(e) Réseau & Système / SRE Freelance 📅 Démarrage : ASAP ⏳ Durée : 3 mois renouvelable 📍 Lieu : Paris (La Défense), avec déplacements réguliers à Montpellier (3 jours consécutifs toutes les 3 semaines) 🎯 Expérience : 6 à 10 ans 🏠 Télétravail : 2 jours/semaine (3 jours sur site / 2 jours télétravail) 💶 TJM : selon profil 🗣️ Anglais : Professionnel (échanges oraux réguliers avec des équipes anglophones) 🏢 Contexte de la mission Phase de réorganisation et de consolidation du pôle infrastructure : structurer la plateforme, fiabiliser le RUN actuel et participer à la convergence vers une cible groupe plus globale (on-premise managé, Proxmox, futurs environnements cloud/hybrides) Poste à fort impact au sein d'une équipe en croissance, modèle agile devops, large autonomie pour insuffler les bonnes pratiques Astreintes / HNO à prévoir ⚙️ Environnement technique Système : Linux (Debian), Apache, Docker Virtualisation : Proxmox (ouverture future vers Nutanix, VMware, Cloud) IaC & CI/CD : Terraform, Ansible, GitLab, Jenkins Observabilité : Zabbix, Dynatrace Sécurité : contraintes strictes ANSSI / eIDAS / PVID 🛠️ Missions principales 1. Court terme : Piloter le Run, Fiabiliser MCO & Exploitation : Assurer la stabilité des environnements de production (2 datacenters en Haute Disponibilité) et la gestion des Mises en Production. Gestion de crise & Backlog : Traiter les incidents avec pragmatisme, tout en assurant la gestion de la demande croissante. Analyser la root cause, préparer la communication Documentation & Passage de témoin : Travailler de concert avec l'équipe actuelle pour formaliser et mettre à jour la documentation critique. Astreintes : Participation aux rotations (après validation de la maîtrise de l'environnement). 2. Moyen terme : Automatisation, Build & Intégration Industrialisation & IaC : Faire évoluer l'Infrastructure as Code (Terraform, Ansible) et automatiser le provisioning des VM. Intégration Groupe : Participer au rattachement du périmètre vers la plus grande infrastructure globale du groupe. Vous participerez activement à la migration des datacenters vers la cible groupe Observabilité : Renforcer la supervision (Zabbix) puis converger vers Dynatrace (plateforme groupe) pour anticiper les incidents.
Dans le cadre du renforcement d'une équipe d'exploitation, nous recherchons un Ingénieur d'exploitation / SRE – SYSOPS chargé d'assurer la fiabilité, la performance et la disponibilité des applications et infrastructures en production. Vous intervenez notamment sur : Le maintien en conditions opérationnelles (MCO) des systèmes, applications et flux. La surveillance et l'observabilité des environnements afin d'anticiper et résoudre les incidents. La gestion des environnements de recette, préproduction et production. L'analyse des incidents, la recherche des causes racines et la mise en œuvre d'actions correctives. L'automatisation des opérations et des déploiements via CI/CD, GitOps et Infrastructure as Code. L'administration et la supervision d'environnements Kubernetes / Rancher. L'optimisation des performances, de la résilience et de la haute disponibilité. La gestion et la supervision d'infrastructures Cloud. La mise en place et le maintien de la documentation et des procédures d'exploitation. La collaboration avec les équipes développement, infrastructure et production dans une démarche SRE / DevOps.
Nous recherchons un Ingénieur Systèmes Linux Senior pour une mission longue au sein d'un acteur majeur du secteur télécom & infrastructures. Vous interviendrez en renfort d'ingénierie sur plusieurs chantiers stratégiques, dont un premier périmètre autour de la finalisation de l'intégration système d'un environnement Bastion (Wallix / PAM). Missions principales : Intégration et finalisation d'un bastion d'accès sécurisé (reverse proxy, certificats TLS, SFTP, gestion des flux). Montée de version RADIUS : analyse des prérequis, tests, intégration LDAP/AD, sécurisation des accès. Déploiement d'une nouvelle plateforme de supervision Zabbix : installation, configuration, templates, API. Troubleshooting Linux avancé sur des composants critiques (Nginx, HAProxy, DNS, HTTPS, SFTP). Automatisation via Bash, Python, Ansible. Intégration multi‑composants dans un environnement exigeant (réseau, sécurité, supervision). Compétences essentielles : Linux avancé (RedHat / Debian / CentOS) Nginx, HAProxy SFTP / SSH / TLS / certificats RADIUS / LDAP Bastion (Wallix / PAM). Zabbix (installation + templates + API) Bash / Python / Ansible Troubleshooting système avancé