
Partager cette offre
Notre client, acteur majeur des services numériques de confiance, recherche un Ingénieur Production & SRE pour renforcer son équipe d’ingénierie.
Vous évoluerez sur des plateformes numériques critiques, avec un objectif clair : améliorer la fiabilité, l’observabilité et la performance de la production tout en réduisant progressivement le RUN et les escalades vers le N3.
🎯 Votre missionVous serez au cœur des sujets Production, SRE et Observabilité, avec une forte dimension d’analyse et d’amélioration continue.
Vos principales responsabilités :
🔹 Administrer et maintenir la stack Elastic : Elasticsearch, Kibana, Logstash, Filebeat
🔹 Mettre en place et faire évoluer les dashboards, alertes et indicateurs de supervision
🔹 Développer l’observabilité applicative avec APM / OpenTelemetry
🔹 Définir et suivre les SLO / SLI
🔹 Analyser les logs, corréler les signaux et identifier les causes racines des incidents
🔹 Détecter les patterns récurrents, signaux faibles, problèmes de capacité et dérives de performance
🔹 Réaliser les post-mortems et piloter les plans d’actions associés
🔹 Construire des runbooks et accompagner les équipes Support N1/N2
🔹 Faire monter les équipes de développement en autonomie sur le diagnostic et l'analyse de production
🔹 Automatiser les tâches récurrentes avec Python
🔹 Réaliser des tests de performance avec JMeter
🔹 Contribuer à la roadmap technique et aux démarches d’amélioration de la fiabilité
🔹 Participer aux instances Agile / SAFe / PI Planning
👉 L'objectif n'est pas d'ajouter du RUN, mais bien de reprendre l'existant, le fiabiliser, l'industrialiser et progressivement le réduire.
🛠️ Environnement technique :Observabilité / Logs :
Elastic Stack, Elasticsearch, Kibana, Logstash, Filebeat, APM, OpenTelemetry
Développement & automatisation :
Java, Python
Infrastructure :
Kubernetes, environnements de production critiques
Bases de données :
PostgreSQL, Cassandra
DevOps / CI-CD :
Jenkins, SonarQube, Nexus
Performance :
JMeter
Méthodologie :
Agile / SAFe / PI Planning
Profil recherché
Vous êtes diplômé(e) d'une formation Bac+5 en informatique et disposez d'une expérience significative en Production, SRE, Observabilité ou DevOps.
Vous êtes particulièrement à l'aise pour :
✔️ Partir d'un log ou d'un symptôme et remonter jusqu'à la cause racine
✔️ Lire du code Java afin de comprendre l'origine d'un problème
✔️ Analyser des incidents complexes dans des environnements critiques
✔️ Identifier les problèmes avant qu'ils ne deviennent des incidents
✔️ Mettre en place des solutions durables plutôt que des contournements
✔️ Transmettre vos connaissances et rendre les équipes autonomes
✔️ Travailler avec des indicateurs : MTTR, SLA, taux d'escalade, couverture d'alerting, etc.
Au-delà des compétences techniques, nous recherchons une personne avec une véritable posture SRE :
🧠 Esprit d'analyse et capacité à prendre du recul
🎯 Culture de la fiabilité et de la performance
🤝 Pédagogie et esprit de coaching
📊 Goût pour la mesure et l'amélioration continue
📝 Rigueur dans la documentation
💬 Aisance pour présenter ses analyses aussi bien aux équipes techniques qu'au management
Environnement de travail
Postulez à cette offre !
Trouvez votre prochaine mission parmi +8 000 offres !
Fixez vos conditions
Rémunération, télétravail... Définissez tous les critères importants pour vous.
Faites-vous chasser
Les recruteurs viennent directement chercher leurs futurs talents dans notre CVthèque.
100% gratuit
Aucune commission prélevée sur votre mission freelance.
INGÉNIEUR PRODUCTION & SRE
RIDCHA DATA
