Partager cette offre
Mission
Garantir la stabilité, la performance et la disponibilité des services dans les environnements de production et hors production, tout en développant une culture orientée fiabilité au sein des équipes de delivery.
Dans ce cadre, le titulaire du poste agit comme le garant de la mise en production des évolutions produit, en veillant à ce que la qualité délivrée soit toujours conforme aux attentes des clients.
Collaborer avec les équipes Produit, Technique et Plateforme afin de maintenir un équilibre optimal entre innovation, rapidité d’exécution et robustesse opérationnelle.
Activités principales
Définir, surveiller et communiquer les objectifs de niveau de service (SLO), les indicateurs de niveau de service (SLI) et les budgets d’erreur (Error Budgets) sur l’ensemble des environnements afin de garantir une fiabilité mesurable pour chaque domaine applicatif.
Veiller à la mise en place et à l’amélioration continue des dispositifs d’observabilité, de supervision et d’alerting.
Superviser la préparation opérationnelle des mises en production afin de garantir la stabilité des environnements de production grâce à une coordination transverse avec les équipes Produit et Technique.
Disposer d’un droit de veto sur une mise en production lorsque le niveau de qualité observé ne répond pas aux attentes des clients.
Piloter la gestion des incidents, les analyses des causes racines (Root Cause Analysis) et les revues post-mortem afin d’assurer la responsabilisation des équipes et l’amélioration continue sur chaque domaine applicatif.
Collaborer avec les équipes Core Platform, Observability et FinOps afin d’améliorer la résilience des systèmes, optimiser les coûts et maintenir les performances de la plateforme.
Communiquer l’état de la fiabilité, les risques et les plans d’amélioration aux Agile Release Managers et aux responsables de domaine afin de garantir l’alignement entre les différents ART.
Participer activement à l’Agile Release Train en tant que représentant de la fiabilité et des opérations, en soutenant le rythme de livraison et la qualité des produits.
Profil recherché
Garantir la fiabilité des services, l’excellence opérationnelle et la conformité des performances sur l’ensemble des environnements, tout en intégrant les pratiques SRE (Site Reliability Engineering) au sein de l’Agile Release Train (ART) et du cycle de vie de livraison des produits.
Forte expertise en Site Reliability Engineering (SRE) dans des environnements SaaS ou cloud natifs.
Excellente maîtrise des concepts d’observabilité, d’automatisation et des outils de supervision.
Expérience dans la définition et le pilotage des SLO, SLI et Error Budgets en collaboration avec les équipes d’ingénierie.
Maîtrise des pratiques DevSecOps, des pipelines CI/CD et du monitoring continu.
Fonctionnelles
Solide expérience en gestion des incidents, analyses post-mortem et préparation opérationnelle des mises en production.
Capacité démontrée à coordonner des initiatives de fiabilité entre les équipes Produit, Technique et Plateforme.
Forte orientation vers les indicateurs de performance, la prévention des causes profondes et la gouvernance opérationnelle.
Soft Skills
Forte culture de la donnée et rigueur analytique dans le suivi de la fiabilité.
Excellentes compétences en communication et en coordination transverse.
Capacité à influencer les décisions et à promouvoir une culture d’amélioration continue.
Environnement de travail
Fonctionnelles
Solide expérience en gestion des incidents, analyses post-mortem et préparation opérationnelle des mises en production.
Capacité démontrée à coordonner des initiatives de fiabilité entre les équipes Produit, Technique et Plateforme.
Forte orientation vers les indicateurs de performance, la prévention des causes profondes et la gouvernance opérationnelle.
Forte expertise en Site Reliability Engineering (SRE) dans des environnements SaaS ou cloud natifs.
Excellente maîtrise des concepts d’observabilité, d’automatisation et des outils de supervision.
Expérience dans la définition et le pilotage des SLO, SLI et Error Budgets en collaboration avec les équipes d’ingénierie.
Maîtrise des pratiques DevSecOps, des pipelines CI/CD et du monitoring continu.
Postulez à cette offre !
Trouvez votre prochaine mission parmi +9 000 offres !
Fixez vos conditions
Rémunération, télétravail... Définissez tous les critères importants pour vous.
Faites-vous chasser
Les recruteurs viennent directement chercher leurs futurs talents dans notre CVthèque.
100% gratuit
Aucune commission prélevée sur votre mission freelance.
Domain Manager SRE Responsable de Domaine SRE
CAT-AMANIA
