Trouvez votre prochaine mission ou futur job IT.

Votre recherche renvoie 110 résultats.
Freelance

Mission freelanceData Scientist spécialisé dans l’évaluation des LLMs

ISUPPLIER
Publiée le
Data science
IA Générative
MLOps

100 jours
400-550 €
Île-de-France, France
Description du poste Dans le cadre du développement et de l'encadrement des usages de l'intelligence artificielle générative au sein de la banque, le groupe souhaite renforcer ses capacités d'évaluation, de qualification et de sécurisation des LLM. Les LLM sont amenés à être utilisés dans différents cas d'usage métiers, que ce soit pour l'assistance aux collaborateurs, l'analyse documentaire, la génération de contenus, l'aide à la décision, l'automatisation de processus ou l'exploitation de bases de connaissances internes. Leur adoption nécessite toutefois un cadre rigoureux afin de garantir leur performance, leur robustesse, leur sécurité, leur conformité et leur adéquation aux exigences du secteur bancaire. La mission consiste à intervenir en tant que Data Scientist spécialisé dans l'évaluation des LLM, afin de définir et de mettre en œuvre des méthodologies d'évaluation, de benchmark et de red teaming des modèles d'IA générative utilisés, testés ou envisagés par le groupe. Cette mission s'inscrit dans une démarche de gouvernance des modèles d'IA, de maîtrise des risques liés à l'IA générative et d'industrialisation des pratiques d'évaluation avant mise en production. Principaux objectifs Définir et mettre en œuvre un cadre d'évaluation des LLM adapté aux enjeux de la banque. Évaluer les performances, limites, risques et comportements des modèles d'IA générative. Réaliser des benchmarks comparatifs entre différents LLM, qu'ils soient internes, open source ou fournis par des éditeurs. Concevoir et exécuter des campagnes de red teaming pour identifier les vulnérabilités, biais, hallucinations et comportements indésirables. Contribuer à la sélection, la validation et la qualification des modèles LLM avant usage ou mise en production. Produire des analyses objectives permettant d'éclairer les décisions métiers, techniques, risques et conformité. Participer à l'industrialisation des processus d'évaluation des LLM dans le cycle de vie des modèles d'IA. Contribuer à la constitution de jeux de tests, métriques, référentiels d'évaluation et outils de suivi. Activités principalesÉvaluation des LLM Définir les protocoles d'évaluation adaptés aux cas d'usage d'IA générative de la banque. Identifier les métriques pertinentes pour mesurer la qualité des réponses générées : exactitude, pertinence, cohérence, complétude, factualité, robustesse, sécurité, explicabilité et conformité. Évaluer les capacités des modèles sur différents types de tâches : résumé, extraction d'information, classification, question-réponse, génération de texte, analyse documentaire, raisonnement, traduction ou reformulation. Mettre en place des jeux de tests représentatifs des usages métiers bancaires. Analyser les performances des modèles selon différents contextes, langues, domaines métiers et niveaux de complexité. Identifier les limites fonctionnelles et techniques des modèles testés. Documenter les résultats d'évaluation et formuler des recommandations. Benchmark LLM Concevoir et conduire des benchmarks comparatifs entre plusieurs modèles LLM. Comparer les modèles selon des critères de performance, coût, latence, robustesse, sécurité, empreinte technique et conformité. Tester différents modèles propriétaires, open source ou internes selon les contraintes du groupe. Mettre en place des grilles d'analyse permettant d'aider au choix des modèles selon les cas d'usage. Évaluer l'impact de différents paramètres : prompt, température, taille de contexte, modèle d'embedding, architecture RAG, fine-tuning ou quantization. Produire des rapports de benchmark clairs, exploitables par les équipes métiers, data, IT, sécurité et conformité. Participer à la définition de standards internes pour la comparaison et la qualification des LLM. Red teaming et sécurité des LLM Définir et exécuter des scénarios de red teaming adaptés aux risques liés à l'IA générative. Tester la résistance des modèles face aux attaques de type prompt injection, jailbreak, data leakage, contournement de garde-fous, génération de contenu inapproprié ou non conforme. Identifier les risques d'hallucination, de biais, de toxicité, de désinformation ou de réponses dangereuses. Concevoir des corpus de prompts adversariaux adaptés aux contextes bancaires et réglementaires. Évaluer la capacité des modèles à respecter les politiques internes, les règles de conformité et les contraintes de sécurité. Analyser les vulnérabilités détectées et proposer des mesures de mitigation. Collaborer avec les équipes sécurité, conformité, risques et architecture pour renforcer le cadre d'usage des LLM. Méthodologie, outillage et industrialisation Mettre en place des outils, notebooks, scripts ou pipelines d'évaluation automatisée. Contribuer à l'industrialisation des campagnes d'évaluation dans le cycle de vie des modèles. Définir des référentiels de métriques et de seuils d'acceptabilité. Construire et maintenir des datasets d'évaluation internes, anonymisés et représentatifs. Participer à l'intégration des résultats d'évaluation dans les outils de gouvernance des modèles, notamment ModelHub v2. Assurer la traçabilité des campagnes d'évaluation, des versions de modèles et des résultats obtenus. Mettre en place des tableaux de bord ou rapports de suivi de la qualité des LLM. Contribuer à la veille technologique sur les méthodes d'évaluation, frameworks de benchmark et pratiques de red teaming LLM. Livrables attendus Cadre méthodologique d'évaluation des LLM adapté aux usages bancaires. Protocoles de test et grilles d'évaluation des modèles d'IA générative. Jeux de tests et datasets d'évaluation documentés. Corpus de prompts de benchmark et de red teaming. Rapports d'évaluation des LLM testés. Rapports de benchmark comparatif entre modèles. Analyses de risques liées aux comportements des LLM. Synthèses des vulnérabilités identifiées lors des campagnes de red teaming. Recommandations de mitigation et plans d'amélioration. Tableaux de bord ou indicateurs de suivi de performance et de sécurité. Scripts, notebooks ou pipelines d'évaluation automatisée. Documentation des métriques, seuils et critères de validation. Recommandations pour la sélection et la mise en production des modèles. Contributions à l'intégration des résultats d'évaluation dans ModelHub v2 ou tout autre outil de gouvernance IA. Supports de présentation à destination des équipes métiers, techniques,
Voir cette offre
Freelance

Mission freelanceData Architect Senior - IA/LLM - Freelance (H/F)

█ █ █ ██ █ █
Publiée le
Big Data

Paris, France

Offre importée

Offre issue du marché tech, identifiée automatiquement pour vous donner une vue complète des opportunités.

Accès restreint à la communauté

Rejoignez notre plateforme pour accéder aux détails de cette offre et obtenir un accès aux meilleures offres du marché.

Voir cette offre
Freelance
CDI
CDD

Offre d'emploiIngénieur IA

Freelance.com
Publiée le
Agent IA
Large Language Model (LLM)
MLOps

1 an
40k-50k €
400-470 €
Montrouge, Île-de-France
Niveau d'expérience : Junior (1 à 3 ans) Type de poste : Ingénieur IA / MLOps Junior (H/F) Localisation : Région parisienne (hybride possible) Démarrage : Dès que possible. Contexte Dans le cadre du développement de ses activités Data & Intelligence Artificielle, un grand groupe du secteur des services financiers recherche un(e) Ingénieur IA / MLOps Junior pour rejoindre son équipe dédiée à la conception, l'industrialisation et le déploiement de solutions d'Intelligence Artificielle. Vous interviendrez sur des projets innovants à fort impact, couvrant aussi bien l'IA générative que les modèles de Machine Learning traditionnels, dans un environnement cloud et DevOps moderne. Vos missions En tant qu'Ingénieur IA / MLOps, vous aurez pour responsabilités de : Agir comme référent technique IA auprès des différentes parties prenantes : équipes projets, développeurs, architectes et métiers. Concevoir, développer, industrialiser et déployer des solutions d'Intelligence Artificielle de bout en bout. Participer à l'intégration de solutions IA développées en interne ou proposées par des éditeurs externes. Contribuer à la mise en place et à l'évolution de la plateforme IA (MLOps, monitoring, gouvernance, catalogue de modèles). Industrialiser les modèles développés par les équipes Data Science afin de garantir leur passage en production. Assurer le respect des bonnes pratiques de développement, d'exploitation et de gouvernance IA. Participer à la mise en conformité des projets avec les exigences réglementaires et les standards de sécurité des données. Profil recherchéCompétences comportementales Nous recherchons une personne : Orientée résultats et capable de respecter les délais fixés. Dotée d'un fort esprit d'équipe et d'une bonne capacité de collaboration. Rigoureuse, organisée et autonome. Capable de communiquer efficacement à l'écrit comme à l'oral. Force de proposition avec une approche pragmatique des problématiques. Curieuse et en veille permanente sur les évolutions technologiques. Disposant d'un niveau d'anglais professionnel permettant d'évoluer dans un environnement technique international. Compétences techniquesExpérience Première expérience réussie (1 an minimum) en Intelligence Artificielle et/ou IA Générative. Participation à un projet de mise en production ou d'industrialisation de solutions IA. Une expérience dans un environnement réglementé constitue un atout. Langages et développement Excellente maîtrise de Python. Connaissances en SQL. La maîtrise des technologies JavaScript constitue un plus. Cloud & Infrastructure Expérience sur un environnement cloud de type AWS : S3 SageMaker Bedrock Lambda API Gateway ECS / EKS EC2 OpenSearch Aurora DevOps & MLOps Bonne connaissance des outils et pratiques : GitLab Docker Kubernetes Airflow MLflow Artifactory APIs REST Hugging Face Frameworks d'orchestration d'agents IA Outils de monitoring et de gouvernance des modèles Écosystème IA & Machine Learning Maîtrise des bibliothèques et frameworks : Scikit-learn Pandas TensorFlow PyTorch Transformers LangChain LangGraph Connaissances des concepts suivants : Machine Learning supervisé et non supervisé Deep Learning RAG (Retrieval Augmented Generation) Fine-tuning de modèles Agentic AI et systèmes multi-agents Human-In-The-Loop (HITL) Monitoring et observabilité des systèmes IA Data & Bases de données SQL et NoSQL Bases vectorielles (OpenSearch, Redis, PGVector ou équivalent) Notions de bases orientées graphe appréciées Méthodologies Bonne pratique des méthodes Agile (Scrum, Kanban ou équivalent).
Voir cette offre
Freelance
CDI

Offre d'emploiArchitecte IA / MLOps

CAT-AMANIA
Publiée le
Cloud
Large Language Model (LLM)
MLOps

6 mois
46k-55k €
400-590 €
Toulouse, Occitanie
Nous recherchons un Architecte IA/MLOps H/F qui conçoit, cadre et met en œuvre les architectures IA industrielles (ML classiques et IA générative), en garantissant leur cohérence avec le SI, leur industrialisation via le MLOps, et leur observabilité en production. Il/Elle intervient de la faisabilité technique au passage à l'échelle, en lien étroit avec la DSMC (valeur métier) et dans le respect des cadres Groupe (Design Authority IA, sécurité, conformité). Missions principales Cadrage technique & architecture IA Réaliser les études de faisabilité technique IA (données, intégration, sécurité, MLOps). Définir les architectures cibles IA (ML prédictif, RAG, GenAI), alignées avec : le SI existant, les standards Groupe, le socle technique commun (CI/CD, API, SCOM) Formaliser les choix dans des dossiers d'architecture. Prototypage & validation des cas d'usage Piloter ou réaliser des POC IA rapides (4–6 semaines) en lien avec la DSMC. Tester la viabilité des modèles, des données et des chaînes techniques. Documenter résultats, limites, risques techniques et conditions d'industrialisation MLOps & industrialisation Définir et mettre en œuvre les chaînes MLOps : Accompagner l'intégration des solutions IA dans le SI existant. Contribuer au catalogue de services IA de la DSI Observabilité IA & fiabilité Définir et déployer les principes de ML Observability : Mettre en place les alertes et indicateurs nécessaires au pilotage. Contribuer à la stratégie de run IA avec les équipes concernées Gouvernance des modèles IA Contribuer à la gouvernance IA DSI / DSMC : Participer aux comités IA et Architecture. Garantir la conformité des solutions avec les exigences RGPD / AI Act (en lien avec les instances dédiées) Référent IA & accompagnement des équipes Agir comme référent technique IA pour la DSI. Accompagner Data Engineers, équipes projets et prestataires. Diffuser les bonnes pratiques IA / MLOps (standards, patterns, retours d'expérience). Contribuer à la montée en compétence globale sur l'IA industrielle
Voir cette offre
Freelance

Mission freelanceDéveloppeur Python Senior (agents LLMs , culture IA générative) -(h/f)

emagine Consulting SARL
Publiée le

36 mois
450-580 €
92400, Courbevoie, Île-de-France
Merci de contacter Sumi Delplanque via LinkedIn directment/msg privé. Je vous répond immédiatement Nous recherchons un développeur Python expérimenté pour rejoindre une équipe dynamique dédiée au développement de solutions exploitant des LLM avec un fort accent sur l'IA générative. Le candidat idéal doit posséder une solide expérience dans le développement backend, ainsi qu'une compréhension approfondie des technologies d'IA générative, avec une expérience concrète dans le développement d'agents LLM. Responsabilités Principales :Développer et maintenir des solutions backend robustes en Python. Collaborer avec les équipes d'intégration et de développement pour mettre en œuvre de nouveaux cas d'usage LLM. Assurer la qualité du code et la conformité avec les meilleures pratiques. Intégrer des SDK et frameworks LLM dans les applications existantes. Participer à l'architecture et à la conception d'agents pour l'analyse de requêtes utilisateur. Exigences Clés :Maîtrise avancée de Python. Expérience significative en développement backend. Connaissance des LLM / IA générative. Compréhension des architectures agentiques. Expérience avec un ou plusieurs frameworks agentic tels que LangChain, LangGraph, CrewAI, AutoGen, ou Semantic Kernel. Capacité à intégrer des SDK et frameworks LLM. Sensibilité aux problématiques de qualité et de sécurité du code. Atouts Appréciés :Expérience avec des SDK ou des frameworks internes pour l'exposition de services LLM. Compétences en sécurité des applications Python. Compréhension des meilleures pratiques en matière de revue de code et de tests. Autres Informations :Ce poste se situe dans une organisation innovante avec une équipe engagée dans un environnement collaboratif. La mission inclut une forte interaction avec divers profils tels que des architectes et DevOps, avec des opportunités d'enrichissement continu de la plateforme. Une disponibilité immédiate est un avantage dans le processus de candidature. Lieu : La Défense Télétravail : 2,5 jours par semaine Mission longue
Voir cette offre
Offre premium
Freelance
CDI
CDD

Offre d'emploiDéveloppeur IA

FIRST CONSEIL
Publiée le
Agent IA
API REST
Docker

6 mois
40k-45k €
400-550 €
Île-de-France, France
Dans le cadre du programme de déploiement de l'intelligence artificielle, l'équipe IA conçoit, industrialise et exploite les cas d'usage IA au service des métiers (épargne, banque, retraite complémentaire) et des collaborateurs internes. Ces cas d'usage se situent à différents stades de maturité : sujets à cadrer, prototypes à industrialiser, solutions déjà en production à maintenir et faire évoluer. Ils portent notamment sur : l'exploitation documentaire et la recherche augmentée (RAG) sur des corpus métier : contrats, garanties, procédures, réglementaire l'assistance aux collaborateurs en gestion et en relation client : aide à la réponse, synthèse de dossier, qualification de demandes l'extraction et la structuration d'informations à partir de documents entrants (courriers, pièces justificatives, formulaires) : OCR, modèles vision la conception d'agents IA et de workflows d'automatisation multi-étapes intégrés au SI Nous recherchons un ingénieur IA senior, capable de concevoir et développer des solutions à base de LLM et d'agents, sur une architecture Python, avec un objectif de solutions robustes, réutilisables, sécurisées et optimisées en coût, performance et latence. L'intervenant travaillera en interaction directe avec les référents métier, les architectes, les équipes Data et les équipes de production.
Voir cette offre
CDI

Offre d'emploiAI Solution Developer 3 - 6 ans PARIS

Cogniwave dynamics
Publiée le
Large Language Model (LLM)
Python

Paris, France
Pour un poste en CDI sur PAris , nous recherchons un développeur de Solutions IA Conditions Rémunération fixe définie selon votre expérience et votre profil, complétée par une prime de performance. . Package d'avantages incluant mutuelle, prévoyance et chèques-repas. Le Développeur de Solutions IA sera responsable du développement de solutions basées sur l'intelligence artificielle afin de renforcer les solutions et processus de sécurité de la Production IT. Ce poste implique une collaboration étroite avec des experts métiers afin d'adapter les outils et de les améliorer en continu. Le développeur utilisera Python ainsi que les bibliothèques associées pour concevoir et déployer des modèles de machine learning et des interfaces utilisateurs. MissionsResponsabilités principales Développer et déployer des solutions basées sur l'IA en utilisant Python. Concevoir des interfaces utilisateurs avec Streamlit, Gradio, Flask et d'autres frameworks pertinents. Collaborer avec des experts métiers afin de comprendre les besoins et adapter les outils en conséquence. Mettre en œuvre des processus ETL (Extract, Transform, Load) pour gérer et transformer les données. Utiliser des bibliothèques telles que pandas et scikit-learn pour la manipulation de données et les tâches de machine learning. Améliorer continuellement les outils en fonction des retours utilisateurs et des analyses de données. Une bonne culture en cybersécurité est attendue. Comment se passe la suite Le processus tient en trois temps : un premier échange avec l'équipe recrutement pour faire connaissance, une mise en situation concrète sur des cas proches de votre futur quotidien ou des besoins de nos clients, et — en option, si l'exercice vous tente — un entretien vidéo à enregistrer quand cela vous arrange, guidé par un assistant IA.
Voir cette offre

Déposez votre CV

  • Fixez vos conditions

    Rémunération, télétravail... Définissez tous les critères importants pour vous.

  • Faites-vous chasser

    Les recruteurs viennent directement chercher leurs futurs talents dans notre CVthèque.

  • 100% gratuit

    Aucune commission prélevée sur votre mission freelance.

Voir tous les derniers posts

Au service des talents IT

Free-Work est une plateforme qui s'adresse à tous les professionnels des métiers de l'informatique.

Ses contenus et son jobboard IT sont mis à disposition 100% gratuitement pour les indépendants et les salariés du secteur.

Free-workers
Ressources
A propos
Espace recruteurs
2026 © Free-Work / AGSI SAS
Suivez-nous