Share this job
Dans le cadre du développement des cas d'usage IA d'un grand compte, nous recherchons un Data Engineer pour construire et industrialiser les pipelines de données qui alimentent les modèles de machine learning et les applications d'IA générative.
Le consultant interviendra notamment sur :
▪ La conception et le développement de pipelines ETL/ELT depuis des sources hétérogènes (APIs, bases relationnelles, flux événementiels), en batch ou temps réel
▪ La préparation et la mise à disposition des données pour l'entraînement des modèles et les architectures RAG (ingestion documentaire, chunking, vectorisation)
▪ L'alimentation et l'administration des bases vectorielles
▪ L'industrialisation de la chaîne complète — collecte, stockage, diffusion — avec sécurité et disponibilité garanties
▪ L'optimisation des performances et des coûts des traitements
▪ La documentation des pipelines et la contribution aux standards de l'équipe
Candidate profile
Profil recherché :
▪ Bac+5 en informatique ou équivalent
▪ Expérience confirmée en data engineering en environnement cloud
▪ Première expérience sur des projets IA/ML ou GenAI appréciée (pipelines RAG, feature engineering)
▪ Maîtrise des bonnes pratiques de développement : Git, tests, code reproductible
▪ Rigueur sur la qualité, la sécurité et la traçabilité des données
▪ Capacité à collaborer avec les data scientists et les équipes plateformes
Technologies utilisées :
Python · SQL · Spark / PySpark · Databricks · Airflow · Kafka · Cloud (Azure, AWS, GCP) · Snowflake / BigQuery · Bases vectorielles · Delta Lake / Lakehouse · dbt · Git · CI/CD
Working environment
Discover STORM GROUP
Apply to this job!
Find your next career move from +8,000 jobs!
Manage your visibility
Salary, remote work... Define all the criteria that are important to you.
Get discovered
Recruiters come directly to look for their future hires in our CV library.
Join a community
Connect with like-minded tech and IT professionals on a daily basis through our forum.
Data Engineer IA (H/F)
STORM GROUP
