ContexteDans le cadre du renforcement de son infrastructure, notre client souhaite mettre en place une solution centralisée de gestion et d'analyse des logs afin d'améliorer la détection, l'analyse et la résolution des incidents. La mission consiste à accompagner la DSI dans la conception, l'intégration, l'industrialisation et la mise en production d'une plateforme ELK, ainsi que dans son dimensionnement et son exploitation. Environnement techniqueElastic Stack : Elasticsearch, Logstash, Kibana Rétention : 90 jours Volumétrie estimée : 6 To / 3 mois Croissance annuelle : 20 % SLA plateforme : 99,7 % 15 utilisateurs ELK 5 administrateurs RBAC Environnements : Production / Préproduction Environ 500 VM Windows Environ 500 VM Linux Logs applicatifs : environ 50 applications critiques et pertinentes MissionsConcevoir l'architecture cible de la plateforme ELK. Dimensionner l'infrastructure : CPU, RAM, stockage et capacité d'évolution. Centraliser les logs techniques et applicatifs. Mettre en place la collecte, le parsing et la normalisation des logs selon ECS. Configurer Elasticsearch, Logstash et Kibana. Mettre en œuvre les mécanismes de recherche, corrélation et alerting. Configurer la gestion des rôles et des accès RBAC. Mettre en place la haute disponibilité et la sécurisation de la plateforme. Assurer la supervision de la solution ELK. Mettre en place les procédures de sauvegarde et de restauration. Gérer les certificats et les upgrades de la plateforme. Intégrer la solution à l'infrastructure existante. Industrialiser et automatiser le déploiement des agents. Utiliser GPO / PowerShell pour les environnements Windows. Utiliser Ansible pour les environnements Linux. Préparer et accompagner la mise en production. Assurer l'accompagnement au démarrage et le transfert de compétences. Produire la documentation technique et les procédures d'exploitation. Préparer les éléments nécessaires à la réversibilité de la solution. Expertise recherchéeExpertise confirmée sur ELK / Elastic Stack. Très bonne maîtrise d'Elasticsearch, Logstash et Kibana. Expérience en architecture et dimensionnement de plateformes ELK. Maîtrise de la collecte et du traitement des logs. Connaissance de la normalisation ECS. Expérience des environnements de production à forte volumétrie. Maîtrise des environnements Windows et Linux. Connaissances AIX appréciées. Maîtrise de PowerShell et/ou Ansible. Connaissances en sécurité, certificats, RBAC et haute disponibilité. Expérience en sauvegarde, restauration et gestion des upgrades. Connaissances des architectures techniques, de la virtualisation et de SQL Server. Capacité à produire des documents d'architecture et d'exploitation. Dimension projetLe profil devra également disposer d'une expérience en pilotage de projets techniques et être capable d'interagir avec les équipes DSI et les experts infrastructure. Participation aux : COPIL trimestriels ; réunions techniques hebdomadaires ; points quotidiens ; ateliers techniques et COTEC. LivrablesNote de cadrage. Architecture cible et schémas logique et physique. Matrice des flux et ports de communication. Dimensionnement CPU / RAM / stockage. Conception de la haute disponibilité. Cahiers de tests. DAT / procédures / modes opératoires / RACI. Documentation ELK. Rapports hebdomadaires d'activité. Documentation de réversibilité. Documentation des règles de parsing, dashboards, alertes, templates et policies. Documentation de mise en production et d'exploitation. ContraintesDémarrage : 01/09/2026 Fin de mission : au plus tard le 18/12/2026 Localisation : Corbeil / Villaroche Français courant obligatoire. Anglais lu, parlé et écrit requis pour les échanges avec les filiales et la documentation.
Le poste consiste à assurer le Maintien en Condition Opérationnelle (MCO) du Management System Télécom pour un acteur majeur du secteur de l'énergie. Intégré au sein de l'équipe Outillage du Pôle Télécom, le titulaire contribuera à la supervision, l'automatisation, la sécurisation et l'exploitation des solutions télécoms déployées, en interface avec les autres systèmes d'information de l'entreprise. Missions principales : Administration et exploitation des plateformes composant le Management System Télécom (Centreon, Grafana, ELK/Kibana, PostgreSQL/MySQL, etc.) pour garantir leur disponibilité, performance et sécurité. Conception, mise en place et évolution des tableaux de bord opérationnels et décisionnels (Dashboards Centreon, Grafana, Kibana) pour améliorer la visibilité opérationnelle et le pilotage. Automatisation des tâches récurrentes (scripts, playbooks Ansible/AWX, workflows) pour industrialiser les processus d'exploitation et réduire les interventions manuelles. Traitement des incidents et demandes de service : analyse des dysfonctionnements, proposition d'actions correctives, contrôle des traitements automatisés, et contribution aux revues de service. Documentation : rédaction de procédures, guides d'exploitation, supports de transfert de compétences, et mise à jour permanente des référentiels techniques. Reporting : production de comptes-rendus de réunion, de reportings hebdomadaires et mensuels (avancement, charges, alertes, indicateurs de performance), et animation des réunions dont il a la charge. Transfert de compétences : organisation d'ateliers et formation des équipes internes pour assurer la montée en compétence et la réversibilité des activités. Contexte et enjeux : Le Pôle Télécom est en pleine transformation avec : Une augmentation continue du nombre d'équipements raccordés. L'industrialisation des chantiers (HTA/BT smart, rénovation ACR & PS). La modernisation des centres de supervision et le déploiement des pratiques NetOps. Le renforcement des exigences en cybersécurité et résilience. L'automatisation des processus pour gagner en efficacité. Le titulaire devra s'adapter à cet environnement dynamique, en garantissant la cohérence, la disponibilité et l'évolutivité du Management System Télécom, tout en respectant les bonnes pratiques ITIL v4 et les règles de cybersécurité en vigueur.
Dans le cadre du renforcement des équipes Systèmes & Réseaux d'un grand acteur bancaire, nous recherchons un.e Ingénieur Systèmes SRE / DevOps pour intervenir sur des environnements Systèmes Monde Ouvert. La mission est fortement orientée performance, Kubernetes, automatisation et observabilité, avec une dimension importante autour de la conception et de l'optimisation de services IaaS / PaaS. Votre rôle En tant qu'Ingénieur SRE / DevOps, vous contribuerez à améliorer la fiabilité, la performance et l'industrialisation des infrastructures. Vous interviendrez aussi bien sur l'analyse de problématiques complexes que sur la mise en œuvre concrète de solutions d'automatisation, de supervision et d'optimisation. Vos missionsPerformance & optimisation Vous serez au cœur des problématiques de performance des infrastructures et applications : Diagnostiquer et analyser les problèmes de performance Identifier les causes de dégradation au niveau infrastructure ou applicatif Analyser la consommation des ressources Réaliser des opérations de right-sizing des environnements Kubernetes Identifier les points de saturation et proposer des actions d'optimisation Contribuer à l'amélioration continue de la performance et de la fiabilité Kubernetes & infrastructure Vous interviendrez sur des environnements conteneurisés et contribuerez à leur évolution : Exploiter et optimiser des environnements Kubernetes Participer à la conception de services IaaS / PaaS Analyser les besoins d'infrastructure et proposer des solutions adaptées Industrialiser les déploiements et les opérations Automatiser les tâches d'exploitation Contribuer à la standardisation des pratiques Observabilité & monitoring L'observabilité constituera une composante importante de votre activité : Exploiter et analyser les métriques Prometheus Concevoir et faire évoluer des dashboards Grafana Travailler sur Kibana pour l'analyse et la visualisation des données Identifier les indicateurs pertinents pour suivre la santé des infrastructures Améliorer la visibilité sur les performances et les incidents Contribuer à la mise en place de bonnes pratiques d'observabilité Automatisation & Infrastructure as Code Vous participerez activement à l'industrialisation des infrastructures : Développer des automatisations avec Terraform Automatiser les opérations systèmes avec Ansible Scripter et industrialiser les tâches d'exploitation Contribuer à la fiabilisation et à la reproductibilité des environnements Systèmes & scripting Selon votre spécialisation, vous interviendrez sur différents environnements : Administration et exploitation Linux Développement de scripts et outils avec Python ou : Administration d'environnements Windows Automatisation avec PowerShell Environnement techniqueInfrastructure & Cloud Kubernetes OpenShift IaaS / PaaS Terraform Ansible Observabilité Prometheus Grafana Kibana Zabbix Dynatrace Systèmes & développement Linux Python Windows PowerShell .NET Méthodologies SRE DevOps Observabilité Chaos Engineering
ous recherchons un Ingénieur Systèmes SRE / DevOps pour intervenir au sein des équipes Systèmes & Réseaux d'un grand acteur bancaire. La mission s'inscrit dans un environnement Systèmes Monde Ouvert et porte principalement sur des problématiques de performance, d'optimisation des infrastructures Kubernetes et de conception de services IaaS/PaaS. Le consultant interviendra notamment sur : Le diagnostic et l'analyse de problèmes de performance sur les infrastructures et applications. L'analyse de la consommation des ressources et le right-sizing des environnements Kubernetes. L'assistance à la conception de services IaaS / PaaS. L'exploitation et l'analyse des métriques Prometheus. La conception et l'amélioration de dashboards Grafana ou Kibana. L'automatisation et l'industrialisation des infrastructures via Terraform et Ansible. L'utilisation et l'administration d'environnements Linux avec Python ou Windows avec PowerShell. La contribution aux démarches SRE, DevOps et Observabilité des équipes.
ELK confirmé / expert (7 ans d'expérience minimum) : Keycloak,Python,ElasticSearch,ELKstack,DNS (Domain Name System),oAuth 2,Linux,TLS (Transport Layer Security),Kibana,Nginx,Rancher Labs Rancher,Longhorn, Compétences indispensables RKE2 : orchestration de conteneurs, socle de l'infrastructure Kubernetes. Elasticsearch : moteur de stockage, d'indexation et de recherche des logs. ECK (Elastic Cloud on Kubernetes) : opérateur permettant le déploiement et l'administration d'Elasticsearch sur Kubernetes. Kibana : interface de visualisation, d'analyse et d'exploration des données. Rancher : administration, supervision et gestion des clusters Kubernetes. Longhorn : solution de stockage persistant distribué pour les volumes Kubernetes. Keycloak : gestion des identités et authentification centralisée. OAuth2-Proxy : sécurisation de l'accès à Kibana via une authentification OAuth2/OIDC. NGINX Ingress Controller : point d'entrée réseau de la plateforme (migration vers Traefik Ingress prévue en 2027). Cert-manager / Let's Encrypt / TLS : gestion automatisée des certificats HTTPS. S3 / Stockage objet : source des données d'ingestion (PFC, FINESS, Observatoire...). Python : développement et maintenance des scripts d'ingestion et de traitement des données. Linux / Bash : administration système et automatisation des tâches. Réseaux : bonnes connaissances en proxy, firewall, DNS et protocoles réseau. Compétences appréciées : Git : gestion de versions du code, des manifests Kubernetes et des configurations. Apache Airflow : connaissances de l'environnement legacy Data Management (en cours de décommissionnement). Filebeat / Elastic Agent : collecte et expédition des logs. OpenTelemetry (OTLP) : instrumentation et standard de collecte des logs, métriques et traces. Keycloak,Python,ElasticSearch,ELKstack,DNS (Domain Name System),oAuth 2,Linux,TLS (Transport Layer Security),Kibana,Nginx,Rancher Labs Rancher,Longhorn,
Le profil recherché est un Ingénieur Qualification & Automatisation de Tests confirmé, avec une forte dominante API et automatisation. Vos responsabilités : • Définir les stratégies de qualification et les plans de tests. • Rédiger et exécuter les cas de tests fonctionnels. • Automatiser les tests via Postman et Playwright. • Participer à la migration des collections Postman vers Playwright. • Réaliser les campagnes de non-régression. • Analyser les anomalies et les logs via Kibana. • Participer aux cérémonies Agile (raffinement, grooming, PI Planning). • Assurer les validations préproduction et production. • Maintenir les environnements de qualification et les jeux de données. • Déployer les versions applicatives via Git. Référence de l'offre : j5ujm2ud6x
Contexte de la mission 🚩Administrateur de bases de données spécialisé sur la stack ELK Participation aux projets d'évolutions techniques et fonctionnelles : contribuer à l'amélioration et à l'évolution des systèmes. Collaboration avec les équipes de développement pour l'intégration des nouvelles fonctionnalités et la mise en production des applications Connaissance DAT/LLD Maitrise DEV ANSIBLE/AAP Compétences clés : ELK Stack : Elasticsearch, Logstash, Kibana, sécurité (TLS, x-pack, gestion des rôles), stratégie ILM, snapshots S3 • Bases de données : Oracle, SQL Server, PostgreSQL, MySQL, MongoDB, AWS RDS, modélisation NoSQL • Automatisation / DevOps : Terraform, Ansible, scripts Shell & Python • Performance & supervision : Grafana, Zabbix Localisation Mission basée à Rennes, France Modalité de réalisation à distance occasionnel ⚠️ 3 jours de présences requises sur Rennes par semaine
Vos missions : Intégré à nos équipes sur notre Factory ou chez nos clients, vous interviendrez en tant que Devops (H/F) et vous assurerez les missions suivantes - Savoir développer, configurer, déployer et tester les différents automatismes - Maitriser les principes de base d'intégration - Savoir développer du code informatique - Maitriser la mise en place de procédures et outils d'exploitabilité et d'observabilité permettant de garantir la disponibilité attendue des solutions/produits/services - Savoir évaluer les risques et impacts techniques lors d'une mise en production - Savoir gérer les mises en production des évolutions des solutions/produits/services - Savoir configurer et déployer des applications dans le Cloud -Identifier, dès la phase d'idéation, avec les concepteurs et les développeurs, les éléments permettant l'exploitabilité, la performance et la supervision sur tout le cycle de vie des produits - Automatiser et industrialiser dans une logique « DevOps » pour servir le déploiement continu - Contribuer à, et garantir, l'exploitabilité et l'observabilité des produits - Préconiser les éléments liés au Capacity planning - Contribuer à l'amélioration continue du produit La Stack Technique : - Déploiements Kubernetes - Industrialisation et automatisation CI/CD - Bases de données (Postgre) - Observabilité : Grafana, Prometheus, Alertmanager, Dynatrace, Kibana - CI/CD : Pulumi, Helm, Github, Ansible, Jenkins - Testing-Performance : Jmeter, Postman