Auditer l'architecture d'inférence existante et identifier les axes d'optimisation. Évaluer la scalabilité, les performances et la résilience de l'architecture cible. Optimiser le serving des modèles avec vLLM et Triton : cache KV, prefix caching, parallélisme, streaming, sorties JSON et tool calling. Intégrer et configurer une gateway LLM multi-tenant proposant une API homogène pour les modèles internes et externes. Définir les mécanismes de routage, d'authentification, de gestion des identités, de quotas, de traçabilité et de suivi des coûts. Organiser la ségrégation et la priorisation des charges entre usages batch et interactifs. Concevoir et exécuter des campagnes de tests de charge sur des workloads mixtes. Identifier les goulots d'étranglement et valider le comportement de la plateforme en cas de forte contention ou de bascule de modèles. Définir une stratégie de mutualisation GPU : MIG, time-slicing, scale-to-zero, préchargement des modèles et placement selon l'empreinte VRAM. Produire les livrables suivants : rapport d'audit de l'existant ; dossier d'architecture technique cible ; rapport de tests de charge et de résilience ; plan de capacité matériel et logiciel à 6–12 mois.
Expérience : 6ans+ d'expérience en tests back-end Soft skills Communication proactive, autonome et pushy (savoir aller chercher les réponses vers les sachants) Capacité à pré-analyser les problèmes (si erreur constatée sur un output, remonter autant que possible au composant source du problème pour accélérer la correction) Etre en capacité d'appréhender l'architecture microservices, les différents composants et les flux Agilité (a minima Scrum, SAFe est un +) Compétences fonctionnelles Capacité à valider de d'outputs impliquant des règles complexes et ensemblistes( ex : calcul des gains) Capacité à comprendre une orchestration de bout en bout Compétences techniques CSV JSON API REST Swagger et concepts de versionnement d'API DBeaver (ou equivalent SQLDeveloper par ex) SQL (a minima SELECT) JIRA + XRAY & Confluence Base de données capacité à comprendre un modèle physique de donnée et faire le lien avec le JSON échangé accéder aux bases en TTY et faire un select si DBeaver pas dispo Unix / Linux : savoir ouvrir un TTY, naviguer, regarder une log Java : Savoir lire et comprendre une stacktrace Microservices : comprendre ce qu'est une architecture microservices et les stratégies de test qui sont associées à ce type d'architecture de SI AWS : connaitre la console Kafka : via la console AWS, réalisation d'actions manuelles sur les topics (insertion / consommation de messages) IA : avoir le reflexe IA pour le testing
🏭 Secteurs stratégiques : Banque d'investissement 🗓 Démarrage : ASAP PAS DE FULL REMOTE NI SOUS TRAITANCE MERCI 💡 Contexte /Objectifs : Nous recherchons un développeur React senior passionné pour diriger l'évolution de notre plateforme d'interface utilisateur, en veillant à ce que nous développions des solutions front-end évolutives, hautement performantes, en temps réel et faciles à maintenir. Vous superviserez l'orientation du développement, collaborerez avec les équipes back-end pour valider les API et travaillerez en étroite collaboration avec les utilisateurs finaux afin d'offrir des expériences exceptionnelles. Ce poste est idéal pour une personne qui s'épanouit dans un environnement collaboratif et agile, qui apprécie le code propre et la refactorisation, et qui aime encadrer tout en restant impliqué dans les technologies front-end modernes. Stack technologique • Compétences techniques : JavaScript, TypeScript, React, Redux Toolkit, AgGrid, SignalR, HTML 5, CSS, Tailwind CSS, NodeJS, Vite, Vitest, SSO, JWT, AUTH, MSW, IIS • DevOps : GIT (Bitbucket), TeamCity, PowerShell