Partager cette offre
Nous recherchons un Ingénieur IA pour intervenir sur l'intégration, l'optimisation et le déploiement opérationnel des systèmes IA au sein du système d'information.
Vos principales missions seront les suivantes :
Concevoir et optimiser des prompts avancés pour les usages d'IA générative.
Mettre en œuvre des architectures RAG et des mécanismes de contextualisation des modèles (Context Engineering).
Concevoir et déployer des chaînes d'ingestion documentaire, de vectorisation et de recherche sémantique.
Intégrer les modèles IA au sein des applications métiers via API, SDK ou frameworks spécialisés.
Développer et maintenir des pipelines IA dans des environnements Kubernetes on-premise.
Mettre en œuvre les pratiques MLOps et LLMOps pour industrialiser les solutions IA.
Déployer, superviser et optimiser les moteurs d'inférence.
Concevoir les dispositifs de monitoring, d'observabilité et de supervision des plateformes IA.
Mettre en place des mécanismes d'évaluation automatisée des modèles (factualité, robustesse, détection des hallucinations).
Optimiser les performances des traitements IA (CPU, GPU, quantization, caching).
Assurer la conformité des solutions vis-à-vis des exigences de sécurité, du RGPD et de l'AI Act.
Participer au traitement des incidents, à l'amélioration continue et au maintien en conditions opérationnelles des plateformes IA.
Profil recherché
De formation supérieure en informatique, Data ou Intelligence Artificielle, vous justifiez d'une expérience significative dans le développement et l'intégration de solutions IA en environnement de production.
Vous maîtrisez tout ou partie des compétences suivantes :
Prompt Engineering avancé.
Context Engineering et architectures RAG.
API OpenAI et intégration de modèles génératifs.
Développement Python.
LangChain, LangGraph, Haystack.
Hugging Face Transformers.
Bases vectorielles et recherche sémantique.
Kubernetes et environnements cloud-native.
Déploiement et exploitation de modèles IA.
Principes d'observabilité, monitoring et supervision.
Optimisation des performances des modèles d'IA générative.
Bonnes pratiques de développement logiciel et principes SOLID.
MLOps, LLMOps et industrialisation des modèles.
Sécurité, protection des données et conformité réglementaire (RGPD, AI Act).
Vous êtes reconnu(e) pour votre autonomie, votre capacité d'analyse, votre rigueur technique et votre aptitude à intervenir sur des problématiques mêlant développement, infrastructure et intelligence artificielle.
Environnement de travail
Vous évoluerez dans un environnement technologique moderne et orienté IA autour des technologies suivantes :
Python
Kubernetes
Rancher RKE2
NVIDIA GPU Operator
Stockage objet S3
Prometheus / Grafana
LiteLLM ou équivalent (AI Gateway)
vLLM, Ollama ou moteurs d'inférence similaires
LangChain
LangGraph
Haystack
OpenAI API
Hugging Face Transformers
MLflow
Kubeflow
Apache Airflow
Bases vectorielles
Solutions RAG et moteurs de recherche sémantique
Vous contribuerez à la mise en production de cas d'usage IA concrets et à forte valeur ajoutée, depuis l'intégration des modèles jusqu'à leur exploitation opérationnelle au sein des applications métiers.
Postulez à cette offre !
Trouvez votre prochaine mission parmi +9 000 offres !
Fixez vos conditions
Rémunération, télétravail... Définissez tous les critères importants pour vous.
Faites-vous chasser
Les recruteurs viennent directement chercher leurs futurs talents dans notre CVthèque.
100% gratuit
Aucune commission prélevée sur votre mission freelance.
Ingénieur(e) IA
CAT-AMANIA
