Espritek

Job Vacancy DevOps et Site Reliability Engineering pour une infrastructure d’actifs numériques réglementée

Courbevoie (92)

Espritek

Published on 09/03/2026

Share this job

Contexte de la mission

Nous recherchons une expertise en DevOps et Site Reliability Engineering (SRE) afin de contribuer à la construction et à l’exploitation d’une plateforme sécurisée, réglementée et hautement disponible dédiée aux instruments financiers tokenisés.

L'entreprise développe une nouvelle capacité autour des Digital Assets, destinée à supporter la tokenisation, les technologies de registres distribués (DLT) et la prochaine génération d’infrastructures des marchés financiers.

Nous recherchons une expertise en Infrastructure as Code (IaC), Kubernetes, plateformes conteneurisées et pipelines CI/CD, afin de construire des fondations scalables et de permettre des déploiements contrôlés sans interruption de service (zero downtime).

Une observabilité complète est nécessaire afin d’assurer l’exploitation d’un service disponible 24h/24 et 7j/7 : métriques, logs, traces, alerting, Service Level Objectives (SLO) et error budgets. Nous recherchons également une expertise opérationnelle sur la gestion des astreintes, la réponse aux incidents, la création de runbooks opérationnels, les postmortems et le maintien de la stabilité de la plateforme lors d’évolutions rapides des produits et technologies.

La mission devra intégrer des pratiques d’infrastructure sécurisées et auditables, adaptées à des workloads réglementés, avec une collaboration étroite avec les équipes sécurité et des contrôles rigoureux concernant l’utilisation de l’IA dans les activités d’engineering.

Nous recherchons également une expertise dans l’utilisation de l’AIOps pour la détection d’anomalies, le triage des alertes, la synthèse des incidents ainsi que le monitoring, l’exploitation et le rollback des services IA/ML intégrés aux produits.

Objectifs et livrables

L’objectif est de mettre en place une fondation opérationnelle résiliente pour une plateforme réglementée d’actifs numériques et de garantir une exploitation fiable à grande échelle.

  • Concevoir et mettre en œuvre l’Infrastructure as Code, notamment avec Terraform, pour le provisioning et la gestion de configurations versionnées et maintenables

  • Construire et optimiser des pipelines CI/CD sécurisés, couvrant intégration continue, déploiement continu, validations automatisées, approbations, auditabilité et mises en production sans interruption

  • Architecturer et exploiter des workloads conteneurisés avec Kubernetes et les technologies d’orchestration associées

  • Mettre en place une solution d’observabilité de bout en bout couvrant métriques, centralisation des logs, distributed tracing, dashboards, alerting et indicateurs de santé opérationnelle

  • Définir et opérationnaliser les SLO, SLI et error budgets en cohérence avec les exigences de fiabilité de la plateforme

  • Mettre en place un modèle d’astreinte 24/7 efficace, incluant procédures d’escalade, workflows de gestion des incidents, responsabilités et continuité de service

  • Produire et maintenir des runbooks clairs et opérationnels pour les opérations récurrentes, incidents, déploiements, reprises et scénarios de panne

  • Renforcer la sécurité de l’infrastructure : hardening, principe du moindre privilège, gestion des secrets, correction des vulnérabilités, contrôles de conformité et gestion auditable des changements

  • Utiliser des outils d’IA pour assister l’engineering, notamment sur l’IaC et la création des pipelines, avec une revue humaine documentée et des contrôles d’approbation avant déploiement

  • Mettre en œuvre des capacités AIOps pour la détection d’anomalies, le triage des alertes, la synthèse des incidents et la rédaction des postmortems

  • Déployer, superviser, exploiter et effectuer des rollbacks sécurisés des services IA/ML, notamment sur les aspects performance, disponibilité et monitoring opérationnel des modèles

  • Produire la documentation technique : décisions d’architecture, procédures opérationnelles, métriques de fiabilité et recommandations d’amélioration continue

  • Garantir la stabilité et la disponibilité de la plateforme malgré des évolutions rapides du produit, tout en maintenant les standards imposés par un environnement réglementé et les objectifs de zero downtime

Candidate profile

  1. Kubernetes / Containerisation — expert
    Expérience solide de Kubernetes en production, orchestration de workloads conteneurisés et exploitation de plateformes critiques à forte disponibilité.

  2. Terraform / Infrastructure as Code
    Maîtrise de Terraform, provisioning automatisé, configuration versionnée et bonnes pratiques d’IaC dans des environnements sécurisés.

  3. CI/CD & Zero-Downtime Deployment
    Capacité à construire et maintenir des pipelines CI/CD sécurisés et auditables, avec validation automatisée, approbations, rollback et déploiements sans interruption.

  4. SRE / Observabilité / Production 24/7
    Expérience réelle sur metrics, logs, traces, alerting, SLI/SLO, error budgets, gestion d’incidents, astreintes 24/7, runbooks et postmortems.

  5. Sécurité & environnements réglementés
    Expérience sur des infrastructures critiques, sécurisées ou réglementées : least privilege, secrets management, hardening, vulnérabilités, auditabilité et change management. Une expérience finance / marchés financiers / Digital Assets serait particulièrement pertinente.

Bonus différenciant : expérience AIOps / exploitation de services AI/ML pour anomaly detection, alert triage, monitoring et rollback.

Working environment

Anglais obligatoire

Marseille, Provence-Alpes-Côte d'Azur
20 - 99 employees
IT services
Nos domaines d'actions concernent : - les déploiements informatiques : câblage, téléphonie sur IP(IPBX, 3CX), infrastructures Télécom (routeurs), pc, tablettes, serveurs, baies de stockage, TPV, terminaux bancaires, systèmes de comptage, de billetterie électronique, de gestion de parking, de contrôle d'accès, vidéo surveillance, objets connectés, étiquettes électroniques RFID, dotation de smartphones, déménagements de parc, gestion de data-center, effacement de données, bornes multimédia, Wifi, caméras, vidéoprojecteurs, murs d'images, systèmes de visioconférence, tableaux numériques, Smart TV, IO/T, remodeling de caisses, imprimantes, mfp, copieurs,.., - l'infogérance avec la délégation d’intervenants en mode planifié auprès de vos clients, - le ticketing avec des interventions à J+1 ou J+2

Apply to this job!

Find your next career move from +8,000 jobs!

  • Manage your visibility

    Salary, remote work... Define all the criteria that are important to you.

  • Get discovered

    Recruiters come directly to look for their future hires in our CV library.

  • Join a community

    Connect with like-minded tech and IT professionals on a daily basis through our forum.

DevOps et Site Reliability Engineering pour une infrastructure d’actifs numériques réglementée

Espritek

Connecting Tech-Talent

Free-Work, THE platform for all IT professionals.

Free-workers
Resources
About
Recruiters area
2026 © Free-Work / AGSI SAS
Follow us