Share this job
Analyse et interprétation des logs (~50 %) — priorité n°1
• Analyser et interpréter quotidiennement les logs applicatifs via la stack ELK.
• Identifier les erreurs récurrentes, corréler les signaux et détecter les signaux faibles.
• Rechercher les root causes et faire le lien entre les logs et le code applicatif (Java).
• Être un point d'entrée en amont des incidents : traiter les problématiques avant qu'elles ne deviennent des incidents majeurs.
• Travailler en lien étroit avec les Service Delivery Managers (SDM) sur le suivi et l'analyse des problématiques.
Administration de la stack ELK (~30 %)
• Administrer Elasticsearch, Kibana, Logstash et Filebeat.
• Gérer les index, les politiques ILM et les pipelines de collecte.
• Configurer et faire évoluer l'alerting.
• Contribuer à la dimension observabilité : APM / OpenTelemetry, dashboards, alerting préventif, SLI/SLO.
Montée en compétences des équipes N2 (~20 %)
• Accompagner et coacher les équipes support et développement dans une posture de pédagogue.
• Créer et maintenir des runbooks pour outiller le N2.
• Favoriser l'autonomie des équipes et réduire durablement les escalades vers le N3.
• Présenter analyses et recommandations aux équipes techniques et aux instances de pilotage (SAFe / PI Planning).
Candidate profile
Nous recherchons un(e) Expert ELK / DevOps orienté RUN pour intervenir en amont des incidents, réduire le recours au support N3 et accompagner la montée en compétences des équipes N2. Ce poste s'adresse à un profil hybride, à la fois technique sur la stack Elastic et proche du code applicatif, avec une vraie appétence pour l'analyse quotidienne et la prévention des incidents plutôt que la seule réaction en cas de crise.
• Formation Bac+5 / école d'ingénieur, profil senior avec une forte expérience en production et environnements critiques.
• Expertise indispensable sur la stack Elastic : Elasticsearch, Kibana, Logstash, Filebeat (administration, index/ILM, pipelines, alerting).
• Forte compétence en analyse de logs et diagnostic production (corrélation, patterns récurrents, signaux faibles, root cause).
• Bonne maîtrise du Java pour faire le lien entre logs et code applicatif — lecture de code Java : un gros plus.
• Connaissances complémentaires appréciées : Python, JMeter, Kubernetes, PostgreSQL, Cassandra, Jenkins, Sonar, Nexus, CI/CD.
• Véritable posture de coach/pédagogue, à l'aise pour accompagner des équipes et vulgariser des sujets techniques.
• Capacité à conjuguer RUN quotidien et démarche préventive, dans une logique de fiabilité et d'amélioration continue.
• Aisance relationnelle pour interagir avec les SDM et présenter ses travaux en instances de pilotage.
Working environment
Vous évoluerez dans un environnement de production critique, au sein d'une organisation structurée autour d'un support multi-niveaux (N2/N3) et de Service Delivery Managers (SDM). Vous serez en interaction directe et quotidienne avec :
• Les équipes support N2, que vous accompagnerez pour réduire leur dépendance au N3.
• Le support N3 et les équipes de développement, pour l'analyse des root causes et le lien logs / code.
• Les Service Delivery Managers (SDM), interlocuteurs privilégiés sur le suivi des problématiques applicatives.
• Les instances de pilotage type SAFe / PI Planning, pour la restitution de vos analyses et recommandations.
Stack technique
• Observabilité / logs : Elasticsearch, Kibana, Logstash, Filebeat, APM / OpenTelemetry.
• Applicatif : Java (lecture de code), Python, JMeter.
• Infrastructure & CI/CD : Kubernetes, Jenkins, Sonar, Nexus, CI/CD.
• Données : PostgreSQL, Cassandra.
Apply to this job!
Find your next career move from +8,000 jobs!
Manage your visibility
Salary, remote work... Define all the criteria that are important to you.
Get discovered
Recruiters come directly to look for their future hires in our CV library.
Join a community
Connect with like-minded tech and IT professionals on a daily basis through our forum.
Expert ELK / DevOps orienté RUN
DATACORP
