Share this job
Dans le cadre de son ambitieux programme DRIVE 2030, AGL modernise en profondeur son système d'information afin d'accompagner la croissance du groupe MSC et de digitaliser ses activités logistiques.
Ce programme stratégique, lancé pour une durée de 5 ans, vise notamment à :
Remplacer les différents Transport Management Systems (TMS) par une plateforme unique.
Digitaliser et optimiser les processus métiers.
Standardiser les bonnes pratiques au sein des filiales.
Moderniser l'ensemble des échanges entre le TMS et le système d'information.
Vous rejoindrez une équipe internationale d'une quarantaine de collaborateurs basée au siège parisien et travaillerez en étroite collaboration avec les équipes Infrastructure, Applicatives, Run, Métiers et les filiales internationales.
En tant qu'Expert Monitoring & Observabilité, vous serez garant de la supervision des applications critiques et de la stratégie d'observabilité du programme.
Définition de la stratégie d'observabilitéDéfinir les standards de monitoring avant chaque mise en production.
Identifier les composants critiques et les parcours utilisateurs à superviser.
Définir les métriques, logs, traces et événements nécessaires au pilotage des applications.
Participer à la feuille de route Datadog & Splunk.
Structurer l'observabilité autour des notions de disponibilité, performance, capacité, erreurs et saturation.
Déployer et administrer les solutions Datadog.
Configurer les intégrations et la collecte des métriques.
Concevoir des dashboards adaptés aux équipes Run, Infrastructure, Applicatives et Management.
Superviser les API, services, URL, certificats, traitements batch et files d'attente.
Mettre en place les Service Maps afin de cartographier les dépendances applicatives.
Créer les monitors, alertes composites et mécanismes de détection d'anomalies.
Corréler métriques, traces et logs.
Automatiser le déploiement des dashboards et des configurations.Supervision Splunk
Déployer et administrer la collecte des logs.
Construire les dashboards et alertes.
Optimiser l'exploitation des données de supervision.
Définir des seuils d'alerte pertinents.
Réduire les faux positifs et limiter le bruit opérationnel.
Classifier les alertes selon leur criticité.
Définir les workflows d'escalade.
Documenter chaque alerte (diagnostic, actions, responsables, escalade).
Intégrer les alertes aux outils de communication et de gestion des incidents.
Participer à l'automatisation des incidents via ServiceNow.
Candidate profile
Vous justifiez d'au moins 7 ans d'expérience dans les domaines du monitoring, de l'observabilité ou de la production informatique.
Vous disposez d'une expérience opérationnelle significative sur Datadog et Splunk, avec une réelle capacité à configurer et administrer les plateformes (et pas uniquement à exploiter des tableaux de bord).
Vous possédez également :
Une solide expérience de la supervision d'applications critiques.
Une bonne maîtrise des architectures distribuées.
Des compétences en analyse de performances SQL.
Une bonne connaissance des processus ITIL.
Une connaissance de ServiceNow est appréciée.
Working environment
Apply to this job!
Find your next career move from +9,000 jobs!
Manage your visibility
Salary, remote work... Define all the criteria that are important to you.
Get discovered
Recruiters come directly to look for their future hires in our CV library.
Join a community
Connect with like-minded tech and IT professionals on a daily basis through our forum.
Expert Monitoring & Observabilité (Datadog / Splunk) H/F
ASAP TECHNOLOGIES
