
Partager cette offre
Pour l'un de nos clients, nous recherchons un(e) Ingénieur(e) Production & SRE afin de reprendre en main la chaîne d'observabilité existante sur un périmètre applicatif critique, l'améliorer et réduire le RUN. L'objectif est de rendre les équipes dev et support autonomes et de faire baisser durablement les escalades N3.
Vos missionsMaintien en conditions opérationnelles de la stack Elastic (Elasticsearch, Kibana, Logstash, Filebeat) sur tous les environnements : utilisateurs et rôles, index et ILM, upgrades, pipelines d'ingestion, alerting
Observabilité applicative : APM / OpenTelemetry, dashboards et alerting préventifs par composant critique, définition et suivi des SLO / SLI, tests de performance JMeter
Analyse de production : lecture et corrélation des logs, détection des patterns récurrents et signaux faibles (saturation, dérives de performance, capacity) pour traiter les causes avant l'incident
Post-mortems et recherche de causes racines sur les incidents majeurs, plans d'action trackés, alimentation du Problem Management
Shift-left avec le support : runbooks avec le N2, dashboards exploitables par le N1 / N2
Montée en autonomie des développeurs : pairing (lecture de logs, diagnostic), kit d'autonomie dev
Pilotage par la mesure : baseline et indicateurs (heures de support N3, taux d'escalade, MTTR, SLA applicatives, couverture d'alerting)
Contribution à la roadmap technique fiabilité et observabilité, portée en PI Planning
Profil recherché
Bac+5 informatique, 5 ans minimum en production / SRE sur des environnements critiques
Maîtrise de la stack Elastic en administration (pas seulement en usage) : ILM, pipelines Logstash, upgrades, RBAC
APM / OpenTelemetry, conception de dashboards et d'alerting, SLO / SLI
Lecture de code Java indispensable pour relier un log à sa cause dans le code
Scripting Python pour l'automatisation d'exploitation
Connaissance de PostgreSQL, Cassandra, Kubernetes, Jenkins / Sonar / Nexus
Pratique de l'agile à l'échelle (SAFe) appréciée
Posture de coach et bon rédacteur : runbooks, synthèses, post-mortems lisibles par des non-experts
Français courant impératif
Environnement de travail
Stack technique : Java, Kubernetes, PostgreSQL, Cassandra, stack Elastic (Elasticsearch, Kibana, Logstash, Filebeat), APM / OpenTelemetry, JMeter, Jenkins, Sonar, Nexus, Python pour l'automatisation.
Organisation en agile à l'échelle (SAFe) avec participation aux PI Planning et aux revues avec la direction technique. Le rôle est positionné comme un relais entre le run, le support et la roadmap technique, avec une forte dimension de transfert de compétences vers les équipes.
Postulez à cette offre !
Trouvez votre prochaine mission parmi +8 000 offres !
Fixez vos conditions
Rémunération, télétravail... Définissez tous les critères importants pour vous.
Faites-vous chasser
Les recruteurs viennent directement chercher leurs futurs talents dans notre CVthèque.
100% gratuit
Aucune commission prélevée sur votre mission freelance.
Ingénieur(e) Production & SRE - Nice
VISIAN
