
Share this job
Notre client, acteur majeur des services numériques de confiance, recherche un Ingénieur Production & SRE pour renforcer son équipe d’ingénierie.
Vous évoluerez sur des plateformes numériques critiques, avec un objectif clair : améliorer la fiabilité, l’observabilité et la performance de la production tout en réduisant progressivement le RUN et les escalades vers le N3.
🎯 Votre missionVous serez au cœur des sujets Production, SRE et Observabilité, avec une forte dimension d’analyse et d’amélioration continue.
Vos principales responsabilités :
🔹 Administrer et maintenir la stack Elastic : Elasticsearch, Kibana, Logstash, Filebeat
🔹 Mettre en place et faire évoluer les dashboards, alertes et indicateurs de supervision
🔹 Développer l’observabilité applicative avec APM / OpenTelemetry
🔹 Définir et suivre les SLO / SLI
🔹 Analyser les logs, corréler les signaux et identifier les causes racines des incidents
🔹 Détecter les patterns récurrents, signaux faibles, problèmes de capacité et dérives de performance
🔹 Réaliser les post-mortems et piloter les plans d’actions associés
🔹 Construire des runbooks et accompagner les équipes Support N1/N2
🔹 Faire monter les équipes de développement en autonomie sur le diagnostic et l'analyse de production
🔹 Automatiser les tâches récurrentes avec Python
🔹 Réaliser des tests de performance avec JMeter
🔹 Contribuer à la roadmap technique et aux démarches d’amélioration de la fiabilité
🔹 Participer aux instances Agile / SAFe / PI Planning
👉 L'objectif n'est pas d'ajouter du RUN, mais bien de reprendre l'existant, le fiabiliser, l'industrialiser et progressivement le réduire.
🛠️ Environnement technique :Observabilité / Logs :
Elastic Stack, Elasticsearch, Kibana, Logstash, Filebeat, APM, OpenTelemetry
Développement & automatisation :
Java, Python
Infrastructure :
Kubernetes, environnements de production critiques
Bases de données :
PostgreSQL, Cassandra
DevOps / CI-CD :
Jenkins, SonarQube, Nexus
Performance :
JMeter
Méthodologie :
Agile / SAFe / PI Planning
Candidate profile
Vous êtes diplômé(e) d'une formation Bac+5 en informatique et disposez d'une expérience significative en Production, SRE, Observabilité ou DevOps.
Vous êtes particulièrement à l'aise pour :
✔️ Partir d'un log ou d'un symptôme et remonter jusqu'à la cause racine
✔️ Lire du code Java afin de comprendre l'origine d'un problème
✔️ Analyser des incidents complexes dans des environnements critiques
✔️ Identifier les problèmes avant qu'ils ne deviennent des incidents
✔️ Mettre en place des solutions durables plutôt que des contournements
✔️ Transmettre vos connaissances et rendre les équipes autonomes
✔️ Travailler avec des indicateurs : MTTR, SLA, taux d'escalade, couverture d'alerting, etc.
Au-delà des compétences techniques, nous recherchons une personne avec une véritable posture SRE :
🧠 Esprit d'analyse et capacité à prendre du recul
🎯 Culture de la fiabilité et de la performance
🤝 Pédagogie et esprit de coaching
📊 Goût pour la mesure et l'amélioration continue
📝 Rigueur dans la documentation
💬 Aisance pour présenter ses analyses aussi bien aux équipes techniques qu'au management
Working environment
Apply to this job!
Find your next career move from +8,000 jobs!
Manage your visibility
Salary, remote work... Define all the criteria that are important to you.
Get discovered
Recruiters come directly to look for their future hires in our CV library.
Join a community
Connect with like-minded tech and IT professionals on a daily basis through our forum.
INGÉNIEUR PRODUCTION & SRE
RIDCHA DATA
