Créer en 1998, Cheops Technology est le spécialiste français dans le Cloud et les infrastructure informatiques sécurisées.
Leader du Cloud Computing
Cheops c'est :
13 agences
Une offre variée :
- Cloud & Managed Services
- Infrastructure
- Cyberdéfense
- Modernisation technologique
Intégrateur de solutions.
Certification ISO 27001
Certification ISO 20000
Certification ISAE 3402 Type 2
Qualification SecNumCloud
Certification Hébergeur de données de santé
certification hébergeur d'infrastructure physique et hébergeur infogérant
Contexte Dans le cadre de la maintenance et de l'évolution d'une application critique temps réel dédiée au contrôle-commande nous recherchons un Expert en Analyse Système confirmé. Vous interviendrez sur des environnements à fortes contraintes de disponibilité, de sécurité et de continuité de service. Vous travaillerez en étroite collaboration avec les équipes de maintenance, d'exploitation et de développement afin de garantir le bon fonctionnement de la plateforme et d'assurer le traitement des incidents de production. Missions principalesSupport et exploitation Assurer le support de niveau expert auprès du mainteneur du système. Garantir la disponibilité et la stabilité des plateformes de production. Participer aux activités d'exploitation et d'administration des environnements techniques. Analyse des incidents Réaliser les analyses approfondies des incidents de production. Analyser les journaux systèmes (logs) afin d'identifier les causes racines des dysfonctionnements. Proposer et mettre en œuvre les actions correctives et préventives. Assurer le suivi des incidents jusqu'à leur résolution. Mises en service Préparer les mises en production. Réaliser les opérations de déploiement. Assurer le support post mise en service. Vérifier le bon fonctionnement des applications après les interventions. Maintenance technique Participer aux opérations de maintien en condition opérationnelle (MCO) et de maintien en condition de sécurité (MCS). Réaliser les migrations techniques : systèmes d'exploitation Linux ; infrastructures de virtualisation ; composants middleware. Assurer le traitement des vulnérabilités de sécurité (CVE). Participer à la gestion des correctifs et des mises à jour techniques. Administration de la plateforme Administrer les serveurs Linux. Gérer les postes de travail spécifiques liés à l'exploitation. Assurer le maintien de la plateforme interne. Participer aux évolutions de l'infrastructure.
À la suite d'un incident de production ayant mis en évidence des fragilités au niveau de l'architecture OpenShift et de son dispositif de supervision, notre client souhaite réaliser un audit de sa plateforme actuelle. L'environnement est aujourd'hui hébergé On-Premise, avec un cluster de management pilotant notamment des environnements de Production et de Hors Production. L'incident a mis en évidence la nécessité de revoir le niveau d'isolation entre les différents environnements et d'identifier plus globalement les éventuels points de défaillance de l'architecture. Périmètre envisagé de l'audit L'expert interviendra notamment sur les sujets suivants : Revue de l'architecture OpenShift existante Analyse de l'isolation entre Production, Hors Production et Management Identification des SPOF et des risques de propagation d'un incident entre environnements Analyse de la résilience et de la haute disponibilité de la plateforme Revue du monitoring, de l'observabilité et de l'alerting, notamment au regard de l'incident rencontré Revue des pratiques de patching et d'upgrade OpenShift Revue des principaux sujets de sécurité de la plateforme Préconisations d'optimisation et de sécurisation de l'architecture Analyse des prérequis permettant d'envisager une continuité de service entre l'environnement OpenShift On-Premise et Azure Red Hat OpenShift (ARO) Identification des éventuels prérequis ou adaptations nécessaires côté workloads/applications pour faciliter cette continuité Évaluation du niveau d'expertise actuel des équipes client Identification des besoins éventuels de formation et/ou de renfort de compétences
Exploitation des infrastructures • Exploitation quotidienne : traitements batch, contrôle des sauvegardes, supervision de l'environnement virtuel et des réplications NAS/SAN • Supervision temps réel du SI (matériel, systèmes, réseau, mobilité) et prise en charge des incidents (espace disque, indisponibilité de service, performance…) • Supervision des éléments de sécurité (antivirus, EDR/XDR, emails frauduleux) • Préparation et envoi du rapport d'exploitation quotidien • Déclenchement et suivi des interventions de maintenance matérielle • Déploiements et installations/désinstallations applicatives, suivi des livraisons • Prise en charge des incidents et demandes escaladés par le support niveau 1 (diagnostic, traitement ou nouvelle escalade) Administration des infrastructures • Administration des serveurs, de la virtualisation, du stockage NAS/SAN et des bases de données relationnelles • Administration des services d'infrastructure : annuaires techniques, gestion des identités, DNS, DHCP, impression • Administration des outils collaboratifs on-premise et cloud (messagerie, visioconférence, intranet/extranet) • Installation, mise à niveau et décommissionnement des serveurs physiques ou virtualisés • Gestion des tickets fournisseurs/éditeurs et escalade vers le GSI si nécessaire • Participation aux campagnes de mise à jour de sécurité • Administration des solutions de mobilité (profils, déploiement d'applications, conformité de sécurité, gestion des versions iOS/Android) • Prise en charge des incidents complexes sur les postes de travail, non résolus par le support niveau 1 Contribution transverse • Traçabilité et mise à jour de l'ensemble des incidents/demandes dans l'outil ITSM du GSI • Contribution au référentiel documentaire (procédures, dossiers d'exploitation, plans de reprise informatique) • Participation aux instances opérationnelles (Point Production quotidien, Comité technique hebdomadaire) • Respect des exigences de sécurité, de confidentialité et des chartes SDMIS (Charte Utilisateurs, Charte Administrateurs)
2. Missions et activités principalesExploitation quotidienne • Travaux en batch, contrôle des traitements par lots et des sauvegardes • Contrôle de la mise à jour des outils de sécurité et du fonctionnement de l'environnement virtuel (réplications NAS/SAN) • Visite hebdomadaire des locaux techniques ; vérification de la conformité des terminaux (alertes MDM) • Préparation et envoi du rapport d'exploitation quotidien Supervision et gestion des incidents • Supervision temps réel de l'ensemble du SI (matériel, systèmes, réseau, mobilité) • Prise en charge, diagnostic et traitement des incidents N2 escaladés par le support (niveau 1), sinon escalade vers le référent GSI compétent • Supervision des éléments de sécurité : alertes antivirus, remontées EDR/XDR, emails frauduleux • Déclenchement des interventions des sociétés de maintenance sur les solutions matérielles, puis prise en charge de l'intervention Livraisons et déploiements • Installation, mise à niveau et suppression des applications et composants associés (middleware, base de données, serveur Web…) selon procédures fournies • Déclenchement et suivi des installations/désinstallations automatisées et manuelles (outils de déploiement) • Participation aux instances hebdomadaires de planification des livraisons applicatives (correctifs, interfaces, nouvelles applications) Demandes et interventions terrain • Prise en charge et traitement des demandes de service avec procédure (cycle de vie utilisateur, habilitations fichiers/imprimantes, sauvegardes/restaurations, quotas…), sinon escalade • Interventions ponctuelles sur les sites du périmètre (3 sites principaux + environ 100 casernes) • Interventions sur site pour la mobilité et le réseau ; configuration simple avec procédure des équipements • Assistance et conseil aux utilisateurs sur l'usage des terminaux Documentation et pilotage opérationnel • Traçabilité systématique dans l'outil ITSM du GSI (saisie des actions, temps passé, acteurs, escalades) • Contribution à la mise à jour des référentiels documentaires (procédures d'exploitation, inventaire du parc systèmes) • Participation au Point Production quotidien et au Comité Technique hebdomadaire • Contribution au reporting d'activité et à la remontée des alertes ou risques identifiés vers le SDM
Politique de sécurité du système d'information (PSSI)
Cheops Technology
Dans le cadre du programme « Nouvelles usines », nous recherchons 2 Chefs de Projet Déploiement SI afin d'assurer le pilotage, la coordination et le suivi des projets informatiques liés à la conception, au déploiement et à la mise en service de nouvelles solutions et infrastructures. Les prestations s'inscrivent exclusivement dans un périmètre BUILD, couvrant l'ensemble des activités nécessaires à la conception, l'intégration, le déploiement et la mise en service des solutions. Les activités de RUN, de maintien en condition opérationnelle et de support utilisateurs sont exclues du périmètre. Les Chefs de Projet interviendront dans un environnement industriel exigeant, avec de fortes contraintes de coordination, de qualité, de sécurité et de pilotage. Missions Les Chefs de Projet Déploiement SI auront notamment pour responsabilités : Pilotage et gouvernance projet Piloter les projets de déploiement SI depuis le cadrage jusqu'à la mise en service. Définir et maintenir le Plan de Management de Projet (PMP). Construire, consolider et suivre les plannings détaillés. Coordonner les différents acteurs du projet : équipes métiers, équipes IT, architectes, intégrateurs, partenaires et responsables de lots. Organiser et animer les instances de gouvernance projet, notamment les COPROJ et COPIL. Préparer les supports de présentation et rédiger les comptes-rendus associés. Assurer le reporting régulier auprès des parties prenantes et de la direction de programme. Suivi opérationnel des déploiements Coordonner les activités de conception, d'intégration, de tests et de déploiement. Suivre l'avancement des différents lots et identifier les écarts par rapport aux objectifs. Participer à la préparation et à l'exécution des plans de mise en production. Coordonner les phases de tests et de validation avec les équipes concernées. Veiller à la bonne production des livrables et à la complétude de la documentation projet. Organiser et suivre le transfert de connaissances vers les équipes internes en charge du RUN. Gestion des risques, décisions et actions Identifier, analyser et suivre les risques projet. Maintenir à jour les registres des risques, décisions et actions. Mettre en place et suivre les plans d'actions nécessaires. Escalader les sujets critiques et proposer les arbitrages nécessaires. Garantir la visibilité des dépendances, points de blocage et impacts sur le planning, le budget ou les ressources. Pilotage planning, charge et budget Construire et maintenir les tableaux de bord de suivi portant notamment sur : les délais ; les jalons ; les charges ; le budget ; les risques et actions ; le reste à faire. Assurer la consolidation du planning projet et le suivi des jalons majeurs. Réaliser les réestimations nécessaires et assurer le suivi du RAF (Reste À Faire). Contribuer au pilotage budgétaire et à la consolidation des données du projet. Gestion et fiabilité des données dans Jira Le Chef de Projet est garant de la qualité et de la fiabilité des informations relatives à son périmètre dans Jira. À ce titre, il devra : S'assurer que l'ensemble des activités et tâches du périmètre sont créées, assignées, estimées et suivies dans Jira. Veiller à la mise à jour régulière du statut des tickets. Contrôler la présence et la mise à jour des dates prévisionnelles de livraison, des pourcentages d'avancement ainsi que des charges prévisionnelles et consommées. S'assurer que les commentaires d'avancement et les éventuels blocages sont correctement renseignés. Maintenir un planning détaillé et à jour, avec une mise à jour au minimum toutes les deux semaines. Coordonner les différents pilotes ou responsables de lots afin d'assurer la cohérence du planning consolidé. Garantir la fiabilité des données de pilotage et de reporting. Pilotage budgétaire dans Osmoz / Planisware Assurer la mise à jour régulière de l'outil Osmoz / Planisware, utilisé pour le pilotage du portefeuille et des projets. Participer à la consolidation du planning macro et des jalons majeurs du programme. Réaliser la mise à jour mensuelle obligatoire durant les périodes de revue de projet. Mettre à jour les éléments nécessaires au suivi budgétaire, notamment Garantir la cohérence entre les données de planning, de charge et de budget. Livrables attendus Les principaux livrables produits par les Chefs de Projet seront : Plan de Management de Projet (PMP) ; Plannings détaillés et planning consolidé ; Registre des risques ; Registre des décisions ; Registre des actions ; Supports et comptes-rendus des instances projet : COPROJ, COPIL et autres comités ; Tableaux de bord de suivi des délais, charges et budgets ; Reporting d'avancement ; Suivi des jalons et du RAF ; Documentation de pilotage et de déploiement ; Bilan de fin de projet incluant le RETEX.
Garantir une disponibilité supérieure à 99,9 % des services d'infrastructure Microsoft. Concevoir des architectures robustes, évolutives et sécurisées. Définir les standards d'administration et de sécurité. Superviser les opérations de maintenance, de mise à jour et de migration. Assurer le traitement des incidents critiques de niveau 3. Réaliser des audits de sécurité Active Directory et Microsoft 365. Mettre en œuvre les recommandations des référentiels CIS, ANSSI et Microsoft Security Baselines. Automatiser les tâches récurrentes afin de réduire les risques d'erreur et les délais d'exécution. Produire et maintenir la documentation technique, les procédures d'exploitation et les dossiers d'architecture. Participer aux comités d'architecture, de sécurité et de gestion des changements (CAB). Accompagner les équipes projets dans les choix techniques et assurer le transfert de compétences vers les équipes d'exploitation.
Contexte Dans le cadre du démarrage du RUN de notre client, celui-ci prévoit de nommer un Platform Lead interne pour la plateforme Europe. Ce Platform Lead disposera des compétences technologiques nécessaires, mais nous souhaitons l'accompagner sur une dimension qu'il considère comme un métier à part entière : le pilotage opérationnel d'équipes RUN distribuées, notamment entre la France et l'Inde, avec des contraintes de time zones. Le Senior Delivery Manager interviendra donc aux côtés du Platform Lead dans une logique d'accompagnement, de mentoring et de « sidecar », afin de lui transmettre les bonnes pratiques, méthodes et réflexes nécessaires au pilotage de ce type de dispositif. Rôle attendu Il s'agit d'un rôle résolument opérationnel. Le Senior Delivery Manager doit avoir une expérience concrète du pilotage d'équipes RUN / Production distribuées et savoir organiser et coordonner des équipes techniques réparties entre plusieurs localisations, idéalement avec une expérience d'équipes offshore en Inde. Il doit être capable d'accompagner le Platform Lead dans l'organisation du dispositif, la prise de décision et l'animation opérationnelle, avec un objectif de montée en compétence et d'autonomisation progressive du Platform Lead La gestion des incidents majeurs est un élément important du rôle: le Delivery Manager doit être capable de prendre immédiatement le leadership de la cellule, structurer les actions, prendre les décisions nécessaires et coordonner les équipes jusqu'au rétablissement du service.
Le Production Support Engineer (L1) assure les activités d'exploitation de premier niveau : supervision, prise en charge des alertes, exécution des runbooks, traitement des incidents de premier niveau, déploiements et escalade vers les équipes L2. Contexte de la mission Dans le cadre de la mise en place d'un dispositif d'exploitation d'une plateforme Cloud critique à dimension internationale, nous recherchons un Production Support Engineer afin d'assurer le support opérationnel de premier niveau des services Cloud. Au sein d'une organisation DevOps / SRE "Follow the Sun", ce profil contribue à la supervision de la plateforme, au traitement des alertes et incidents de premier niveau, ainsi qu'à l'application des procédures d'exploitation définies par les équipes SRE. Missions Le Production Support Engineer sera notamment chargé de : Assurer la supervision opérationnelle de la plateforme. Surveiller les alertes CloudWatch et Elastic. Prendre en charge les incidents de premier niveau. Réaliser le triage et la qualification des incidents. Exécuter les runbooks d'exploitation. Réaliser les déploiements opérationnels. Exécuter les procédures de rollback. Assurer le suivi des tickets et la communication opérationnelle. Escalader les incidents complexes vers les équipes L2. Contribuer à l'amélioration continue des procédures d'exploitation
Le Middleware & Storage SRE Engineer apporte l'expertise sur les composants les plus spécialisés de la plateforme (Kafka, SQS, EventBridge, Lambda, bases de données et services de stockage). Ces compétences sont essentielles pour garantir le bon fonctionnement des flux d'intégration, des plateformes de messaging et des services de données. son intervention prendrait tout son sens une fois les fondations du dispositif d'exploitation mises en place et lorsque la reprise opérationnelle de ces composants est engagée. Contexte de la mission Dans le cadre de la mise en place d'un dispositif d'exploitation d'une plateforme Cloud critique à dimension internationale, nous recherchons un Middleware & Storage SRE Engineer chargé d'assurer l'exploitation et le maintien en conditions opérationnelles des composants middleware, des plateformes d'intégration, des bases de données et des services de stockage. Au sein d'une organisation DevOps / SRE, ce profil contribue à garantir la disponibilité, la performance et la fiabilité des flux d'intégration et des services de données. Missions Le Middleware & Storage SRE Engineer sera notamment chargé de : · Administrer les plateformes d'intégration et de messaging. Exploiter les services AWS liés aux échanges et aux événements. Assurer l'administration des bases de données et des services de stockage. Réaliser les analyses de flux et diagnostiquer les incidents. Participer à la résolution des incidents de production. Assurer le suivi des sauvegardes et contribuer aux procédures de reprise d'activité. Garantir la disponibilité et les performances des composants middleware. Participer à l'amélioration continue des plateformes. Contribuer à la rédaction de la documentation d'exploitation et des runbooks. Participer au transfert de connaissances au sein de l'équipe.
Le client construit d'abord sa plateforme autour des équipes SRE/DevOps. C'est le cœur du modèle "One Team – Follow the Sun". Le L2 est le moteur de l'exploitation quotidienne. Le document précise que ces ingénieurs assurent : l'exploitation des clusters Amazon EKS ; l'administration Kubernetes ; Terraform ; le monitoring ; l'analyse des causes d'incidents ; le Disaster Recovery ; le lien entre le L1 et les Platform Leads. Contexte de la mission Dans le cadre de la mise en place d'un dispositif d'exploitation d'une plateforme Cloud critique à dimension internationale, nous recherchons un EKS DevOps / SRE Engineer pour assurer l'exploitation, l'administration et le maintien en conditions opérationnelles de la plateforme AWS. Au sein d'une organisation DevOps / SRE "One Team – Follow the Sun", ce profil constitue le lien entre les équipes de support L1 et les Platform Leads (L3), garantissant la disponibilité, la fiabilité et la performance des services. Missions L'EKS DevOps / SRE Engineer sera notamment chargé de : · Administrer et exploiter les clusters Amazon EKS. Assurer l'administration des environnements Kubernetes. Exploiter les infrastructures déployées avec Terraform. Gérer les déploiements GitOps. Assurer le monitoring et l'observabilité de la plateforme. Réaliser les analyses de causes racines (Root Cause Analysis). Participer à la gestion des incidents de niveau 2. Mettre en œuvre les procédures de reprise d'activité (Disaster Recovery). Assurer le lien entre le support L1 et les Platform Leads. Participer à l'amélioration continue des pratiques d'exploitation. Contribuer à la rédaction et à l'amélioration de la documentation d'exploitation et des runbooks. Participer au transfert de connaissances vers les équipes de support