Find your next tech and IT Job or contract Monitoring

Your search returns 44 results.
Contractor
Permanent

Job VacancyService Reliability Engineer (SRE)

INFOTEL CONSEIL
Published on
DevOps
Incident Management
Monitoring

3 months
Paris, France
Au sein d'une Direction IT et du département Production, le consultant intégrera une équipe transverse en charge de la fiabilité et de l'excellence opérationnelle des plateformes de production critiques. La mission s'inscrit dans une démarche de transformation des pratiques d'exploitation avec pour objectif de renforcer la disponibilité, la résilience, la performance et la sécurité des services, tout en améliorant leur exploitabilité et en réduisant les risques opérationnels. Positionné à l'interface entre les équipes Production, Développement, DevOps et Sécurité, le SRE intervient sur l'ensemble du cycle de vie des applications. Il accompagne les équipes dans l'anticipation des impacts des changements, la gestion et la prévention des incidents ainsi que dans la mise en œuvre des bonnes pratiques de production. Une part importante de la mission concerne également le pilotage des niveaux de service (SLO), la mise en place de dispositifs de supervision, d'alerting et de tableaux de bord, ainsi que l'analyse des métriques permettant d'identifier les risques et les axes d'amélioration. Le consultant contribuera à l'automatisation des activités de production, à la maîtrise de l'obsolescence et des risques IT/Cybersécurité ainsi qu'aux démarches d'amélioration continue. Il participera également aux analyses post-incidents, aux RETEX et à la diffusion des bonnes pratiques au sein de la communauté Production/SRE. L'environnement est international et transverse, avec de nombreux interlocuteurs techniques et métiers et une utilisation régulière de l'anglais.
View this job
Contractor

Contractor jobIngénieur IA / Intégrateur DevOps

Freelance.com
Published on
Azure
CI/CD
IAM

1 year
400-650 €
Levallois-Perret, Ile-de-France
Dans le cadre d'une équipe pluridisciplinaire dédiée à l'IA, le consultant contribuera à la construction et à l'industrialisation du socle technique. Il interviendra notamment sur : • La conception et la mise en œuvre de l'architecture technique des solutions IA. • Le déploiement et la configuration des environnements cloud, des services d'infrastructure et des composants nécessaires à l'exploitation des cas d'usage IA. • La mise en place des dispositifs de sécurité, de gestion des identités (IAM), de gestion des secrets et de conformité associés aux cas d'usage IA. • La construction et l'industrialisation des chaînes de déploiement CI/CD ainsi que des pratiques Infrastructure as Code (IaC). • L'intégration des briques IA : modèles, gateways LLM, orchestrateurs agentiques, APIs, connecteurs et bases documentaires. • La mise en œuvre des outils d'observabilité, de supervision, de monitoring, de logging et de suivi des performances. • La garantie de la robustesse, de la scalabilité, de la traçabilité, de la maîtrise des coûts et de la réversibilité de la plateforme. • La contribution aux choix d'architecture et aux recommandations permettant une exploitation industrielle durable. Livrables attendus : • Architecture technique détaillée de la plateforme. • Schémas d'intégration et d'urbanisation. • Socle technique déployé et opérationnel. • Pipelines CI/CD industrialisés. • Documentation d'exploitation et procédures opérationnelles. • Recommandations d'industrialisation, de sécurisation et de montée en charge. • Dossiers de supervision, d'observabilité et de maîtrise des coûts.
View this job
Contractor

Contractor jobOps Engineer Kubernetes & DataDog

HAYS France
Published on
Agile Method
Datadog
DevOps

1 year
Lille, Hauts-de-France
Dans le cadre du renforcement de ses équipes Infrastructure & Opérations, notre client recherche un Ingénieur Ops confirmé afin de garantir la disponibilité, la performance et la fiabilité de ses plateformes digitales. Au sein d'un environnement Cloud moderne et fortement orienté DevOps, vous intervenez sur l'exploitation, la supervision et l'amélioration continue des services. Véritable acteur de la fiabilité opérationnelle, vous assurez la gestion des incidents, l'analyse des causes racines et la mise en œuvre des actions correctives nécessaires au maintien d'un haut niveau de qualité de service. En collaboration avec les équipes produits, développement et exploitation, vos principales responsabilités seront : Assurer le maintien en conditions opérationnelles des plateformes. Superviser les environnements de production et piloter les incidents. Identifier et analyser les causes racines des dysfonctionnements. Mettre en place et améliorer les dispositifs de monitoring, d'observabilité et d'alerting. Exploiter les métriques, logs et indicateurs de performance afin d'optimiser la qualité de service. Participer à l'automatisation des opérations et à l'amélioration des pipelines de déploiement. Accompagner les équipes dans la définition et le suivi des SLA, SLO et KPI. Diffuser les bonnes pratiques DevOps et ITSM. Contribuer aux initiatives d'amélioration continue visant à renforcer la résilience et la performance des services. Cette mission s'inscrit dans un contexte international exigeant, avec de forts enjeux de disponibilité et de performance.
View this job

Connecting Tech-Talent

Free-Work, THE platform for all IT professionals.

Free-workers
Resources
About
Recruiters area
2026 © Free-Work / AGSI SAS
Follow us