
Mission freelance Site Reliability Engineer (SRE) / Ingénieur Production – Observabilité & Fiabilité (H/F)
Saint-Jean-de-Braye (45)
Octopus Group
Partager cette offre
Dans le cadre du renforcement de son pôle Observabilité & Fiabilité, un acteur majeur de la protection sociale recherche un Site Reliability Engineer (SRE) expérimenté.
Vous rejoindrez une équipe en charge de garantir la disponibilité, la performance, la résilience et l'observabilité d'un système d'information critique composé de plusieurs milliers de serveurs et de plus de 160 applications.
Vos missions :Assurer le maintien en conditions opérationnelles des plateformes et infrastructures.
Superviser les environnements de production et traiter les alertes et incidents.
Diagnostiquer les incidents complexes et coordonner leur résolution.
Réaliser les analyses post-incidents (RCA) et piloter les actions de fiabilisation.
Optimiser les tableaux de bord, métriques et règles d'alerting.
Réduire le bruit opérationnel et améliorer l'observabilité des services.
Participer aux cellules de crise et aux démarches d'amélioration continue.
Automatiser les tâches d'exploitation et contribuer aux pratiques DevOps.
Maintenir la documentation technique et les procédures d'exploitation.
Participer aux astreintes (1 semaine sur 5).
Environnement technique :Kubernetes
Docker
Prometheus
Grafana
Splunk
Tempo
Linux
Windows
PostgreSQL
MariaDB
Python
Shell Linux
Spring Boot
JBoss
VMware
DevOps
ITIL
SRE
Profil recherché
Vous justifiez d'une solide expérience en ingénierie de production ou Site Reliability Engineering.
Vous maîtrisez notamment :
les pratiques SRE et l'exploitation de plateformes critiques ;
les outils de supervision, monitoring, logs, métriques et alerting ;
Kubernetes et les environnements conteneurisés ;
les architectures distribuées et microservices ;
l'automatisation via Python ou Shell ;
la gestion des incidents majeurs et des analyses de causes racines.
Vous êtes reconnu pour votre autonomie, votre capacité d'analyse, votre sens du service et votre aptitude à travailler avec plusieurs équipes techniques.
Les + de la mission :Mission longue durée
Environnement de production critique à forte volumétrie
Technologies modernes d'observabilité
Nombreux sujets d'automatisation et d'amélioration continue
Équipe experte et environnement technique stimulant
Environnement de travail
Découvrir Octopus Group
Postulez à cette offre !
Trouvez votre prochaine mission parmi +9 000 offres !
Fixez vos conditions
Rémunération, télétravail... Définissez tous les critères importants pour vous.
Faites-vous chasser
Les recruteurs viennent directement chercher leurs futurs talents dans notre CVthèque.
100% gratuit
Aucune commission prélevée sur votre mission freelance.
Site Reliability Engineer (SRE) / Ingénieur Production – Observabilité & Fiabilité (H/F)
Octopus Group