Trouvez votre prochaine offre d’emploi ou de mission freelance Apache Airflow

Votre recherche renvoie 75 résultats.
Freelance

Mission freelance
Data Engineer Senior — Industrialisation & Migration Airflow / Astronomer

LeHibou
Publiée le
Apache Airflow
CI/CD
Kubernetes

36 mois
675 €
Montreuil, Île-de-France
Notre client dans le secteur Banque et finance recherche un/une Data Engineer Senior — Industrialisation & Migration Airflow/Astronomer H/F Description de la mission : Contexte de la mission L'équipe data de l'organisation fonctionne actuellement sans outil d'orchestration ETL : l'ensemble des pipelines de données a été développé manuellement en Python, sans framework d'industrialisation. Dans une logique de scalabilité, de fiabilisation et de maintenabilité, la mission vise à migrer l'intégralité de l'existant vers Apache Airflow (Astronomer). Le Data Engineer recruté sera responsable de concevoir et d'industrialiser from scratch la nouvelle architecture d'orchestration, en reprenant les pipelines Python existants pour les transformer en DAGs robustes, monitorés et déployables en continu. Missions principales • Auditer l'existant : cartographier les scripts Python actuels, identifier les dépendances, les points de fragilité et les priorités de migration • Concevoir l'architecture cible Airflow / Astronomer : structure des DAGs, gestion des connexions, secrets et environnements • Migrer progressivement les pipelines existants vers des DAGs industrialisés, testés et documentés • Développer et maintenir des pipelines de données streaming avec Kafka ainsi que des pipelines batch / asynchrones classiques • Mettre en place les bonnes pratiques DataOps : CI/CD des DAGs, tests, monitoring, alerting et gestion des environnements dev / staging / prod • Travailler dans des environnements big data distribués et volumineux • Participer à terme à l'intégration de Starburst dans l'architecture data, dans une logique de fédération de requêtes / lakehouse • Être force de proposition sur les choix techniques et les standards de l'équipe Compétences / Qualités indispensables : Python avancé, Apache Airflow / Astronomer, Kafka, Kubernetes, DataOps (CI/CD, monitoring), Architecture data et industrialisation Compétences / Qualités qui seraient un + : Notions de bases de données graphe (type Neo4j)
Voir cette offre
Freelance

Mission freelance
Expert Data Engineer

LeHibou
Publiée le
Apache Airflow
Gitlab
Snowflake

12 mois
485 €
Roubaix, Hauts-de-France
Le contexte Nous accompagnons une grande organisation financière dans la structuration et la montée en compétence de sa filière Data autour d'une modern data stack. Dans ce cadre, nous recherchons un Analytics Engineer pour rejoindre une équipe de 3 personnes, avec une mission à double dimension : technique et pédagogique. La mission Au sein d'une équipe data structurée, vous jouez un rôle clé dans l'industrialisation des pratiques et la montée en compétence collective : Développer et maintenir des modèles dbt en suivant les standards de l'équipe Contribuer à la création de templates, conventions de nommage et bonnes pratiques de développement Participer à l'élaboration et à l'animation de parcours de formation à destination d'une centaine de collaborateurs internes (data analysts, métiers, équipes tech) Produire des supports pédagogiques clairs et accessibles (tutoriels, wiki, best practices) Travailler en lien avec les pipelines Airflow et les workflows GitLab CI Profil recherché Le profil recherché Maîtrise de dbt, idéalement en environnement professionnel ou sur projet personnel significatif Connaissance d'Airflow et d'un environnement data warehouse cloud (Snowflake, BigQuery, Redshift ou autre) Notions de GitLab et de bonnes pratiques de versioning Réelle appétence pour la transmission et la pédagogie : vous aimez expliquer, documenter et former À l'aise à l'oral, capable d'adapter votre discours selon le niveau technique de votre audience Les conditions Localisation : Roubaix — 3 jours sur site, 2 jours de télétravail par semaine Profil junior à confirmé accepté selon l'expérience sur dbt Début de mission en septembre 2026 Durée : 1 an
Voir cette offre
Freelance
CDI
CDD

Offre d'emploi
Data Ingénieur

Freelance.com
Publiée le
Apache Airflow
Docker
GitLab CI

6 mois
40k-65k €
400-600 €
Paris, France
Contexte de la mission Dans le cadre du renforcement d'une équipe Data intervenant sur un projet Agile, nous recherchons un Data Ingénieur confirmé (+8 ans d'expérience) pour intégrer une équipe composée de 2 Data Ingénieurs et d'un Chef de section en charge de l'orchestration (GitLab CI/CD, Docker, Airflow). La mission est prévue pour une durée initiale de 6 mois, renouvelable 6 mois, avec un démarrage idéal la dernière semaine d'août. Missions : Développer, maintenir et optimiser des pipelines ETL en Python / Pandas / SQL Participer aux cérémonies Agile (daily, sprint planning, review, rétrospective) Collaborer avec le chef de section sur les aspects d'orchestration et d'industrialisation Contribuer à la qualité du code, aux bonnes pratiques et à la documentation Assurer la fiabilité, la performance et la robustesse des traitements data Participer à l'amélioration continue de l'architecture data Travailler en coordination avec les équipes internes et les autres Data Ingénieurs Profil : 5 ans d'expérience minimum en tant que Data Ingénieur Maîtrise confirmée de Python / Pandas / SQL / ETL Capacité à intervenir dans un environnement Agile Autonomie, rigueur, sens du delivery Capacité à collaborer dans une équipe technique exigeante Intérêt pour l'orchestration (Airflow, Docker, CI/CD) Bon niveau de communication et de documentation Compétences obligatoiresPython + Pandas (confirmé) SQL (confirmé) ETL (confirmé) Pipelines de données : conception, optimisation, industrialisation Compétences appréciéesDocker Airflow CI/CD GitLab Connaissance des environnements d'orchestration
Voir cette offre
Freelance
CDI

Offre d'emploi
Data engineer

VISIAN
Publiée le
Apache Airflow

3 ans
40k-45k €
600-710 €
Paris, France
Dans le cadre du développement de ses systèmes d'information Épargne Salariale et Retraite, les Bénéficiaires doivent recourir à une prestation externe pour fournir assistance à la modernisation de la plateforme BI. 1. OBJET DE LA PRESTATION Dans le cadre du projet de modernisation de la plateforme BI, la prestation consistera à mettre en place des solutions répondant aux besoins couverts par l'existant et permettant de proposer de nouveaux services. Cette solution devra utiliser les outils validés et mis à disposition par le groupe. La mission sera pilotée par l'équipe Coeur-Data au sein de la R&D Epargne salariale et retraite. Le data engineer devra intervenir en collaboration avec l'équipe de 5 personnes ainsi qu'avec les clients et les équipes transverses du client. Exemple d'applications du domaine d'intervention : Architecture : Définition de l'organisation du Lakehouse dans le S3 Chargement : Utilisation de pipelines spark, pyspark et python Ordonnancement : Dagster Restitution : Mise à disposition de la donnée brut + création de rapports sur un outil de dataviz à définir sur la base du LakeHouse L'objectif principal de la prestation sera la mise à disposition de data structurées à destination de l'équipe marketing . Dans ce cadre, il conviendra de réaliser : - Le développement d'une solution de collecte de données - Le développement d'un système de stockage de la donnée - La documentation des développements - La réalisation de tests unitaires - La mise en place d'un suivi des traitements - L'assistance à la recette par la MOA / les utilisateurs - Des comptes rendus aux pilotes sur l'avancement du projet et les blocages rencontrés - Des études avec les équipes transverses du client 2. ENVIRONNEMENT FONCTIONNEL DE LA PRESTATION La prestation se déroulera au sein du service IT en charge de la Maintenance applicative 3. ENVIRONNEMENT TECHNIQUE DE LA PRESTATION - Langages de programmation : Python, Spark, Pyspark, SQL - Outil de gestion de version : Git - Intégration continue : JENKINS - Ticketing : JIRA - Documentation : Confluence - Poste de travail Windows 10 avec WSL (Windows Subsystem for Linux) - Outils de la plateforme actuelle : Informatica, DAC, OBIEE, Eclipse BIRT, Oracle 19 - Outils de la plateforme cible : Dagster, Trino, S3 4. RESULTATS ATTENDUS / LIVRABLES - Respect du planning détaillé validé - Estimation des charges MOE - Mise en œuvre des solutions développées - Programme testé et prêt à la recette par les utilisateurs / MOA - Tests unitaires des développements effectués - Suivi d'avancement des tâches du projet en cours - Documentation technique - Amélioration continue des processus de développements 5. PRE-REQUIS ET/OU ELEMENTS INDISPENSABLES - Python, Spark appliqué à la data - Machine learning appliqué à la donnée (scikit-learn, feature engineering) - Relationnel pour les échanges avec le métier - Outils Informatica - Outils LLM/GenAI pour l'accès et l'exploration de la donnée
Voir cette offre
CDI

Offre d'emploi
Data Engineer - Infrastructure (Remote)

█ █ █ ██ █ █
Publiée le
Apache Airflow
Apache Spark
Python

Royaume-Uni

Offre importée

Offre issue du marché tech, identifiée automatiquement pour vous donner une vue complète des opportunités.

Accès restreint à la communauté

Rejoignez notre plateforme pour accéder aux détails de cette offre et obtenir un accès aux meilleures offres du marché.

Voir cette offre
Offre premium
Freelance
CDI

Offre d'emploi
Senior Cloud Data Platform Engineer AWS H/F

ADONYS
Publiée le
Apache Airflow
AWS CloudFormation
AWS Glue

3 ans
40k-60k €
500-600 €
Paris, France
Contexte de la missionDans le cadre du développement et de l'évolution d'une plateforme Data Cloud basée sur AWS, nous recherchons un Senior Cloud Data Platform Engineer capable de concevoir, industrialiser et maintenir une infrastructure Data moderne, sécurisée et évolutive. Le consultant interviendra au sein d'équipes pluridisciplinaires composées d'Architectes Cloud, Data Engineers, DevOps Engineers et équipes Support afin de fournir une plateforme robuste permettant l'ingestion, le traitement, le stockage et l'exploitation de données à grande échelle. Missions principales1. Conception et industrialisation de l'infrastructure CloudConcevoir et développer des composants Infrastructure as Code (IaC) réutilisables. Créer et maintenir des templates avancés permettant le provisionnement automatisé des ressources AWS. Définir les standards techniques et les bonnes pratiques d'architecture Cloud. Garantir la conformité, la sécurité et la gouvernance des infrastructures déployées. Participer aux choix d'architecture et aux revues techniques. Livrables attendusTemplates AWS CDK et CloudFormation. Modules d'infrastructure réutilisables. Documentation d'architecture. Standards de développement et de déploiement. 2. Architecture et développement de la Data PlatformConcevoir des blueprints techniques destinés aux équipes Data Engineering. Mettre en œuvre des architectures Data Lake et Lakehouse sur AWS. Définir les modèles de stockage optimisés pour la performance et la scalabilité. Concevoir des pipelines de données performants et résilients. Accompagner les projets métier dans leur intégration à la plateforme. Livrables attendusArchitectures de référence. Blueprints applicatifs. Pipelines Data industrialisés. Guides d'intégration et d'exploitation. 3. Data Engineering & LakehouseParticiper à la conception et au déploiement des traitements de données. Optimiser les performances des pipelines de transformation. Mettre en œuvre des formats de stockage analytiques performants. Développer des solutions de gouvernance et de catalogage des données. Garantir la qualité et la disponibilité des données. Technologies associéesApache Iceberg Parquet AWS Glue AWS Athena AWS Lake Formation PySpark AWS EMR 4. Exploitation et amélioration continueAssurer le maintien en conditions opérationnelles des plateformes existantes. Superviser les composants de la plateforme Data. Participer à la résolution des incidents et problèmes. Optimiser les coûts et les performances des ressources AWS. Améliorer continuellement les processus d'industrialisation. Outils associésAWS CloudWatch Jenkins SonarQube Ruff 5. Support et accompagnement des équipesAccompagner les Data Engineers dans l'utilisation de la plateforme. Apporter une expertise technique sur les sujets Cloud et Data. Participer aux ateliers d'architecture. Réaliser des formations et transferts de compétences. Contribuer à la diffusion des bonnes pratiques au sein des équipes.
Voir cette offre
Freelance
CDI

Offre d'emploi
Data Engineer

CAT-AMANIA
Publiée le
Apache Airflow
PySpark

6 mois
40k-70k €
400-520 €
Levallois-Perret, Île-de-France
Rôle et responsabilités des Développeurs • Développement et expertise Réaliser des développements de complexité moyenne. Assurer la maintenance applicative (Gestion des obsolescence et vulnérabilités) • Contribution agile Participer aux rituels techniques (estimation de charge, engagement sur le sprint). • Architecture et standards Concevoir et mettre en oeuvre l'architecture applicative et technique. Veiller au respect des normes, bonnes pratiques et standards Groupe. • Qualité et documentation Garantir la qualité des livrables (revues de code, bonnes pratiques). Assurer la production et la maintenance de la documentation projet. • RUN Assurer le suivi d'exploitation des traitements PySpark en production : supervision, résolution des incidents, analyse des performances et amélioration continue des traitements - Maîtrise avancée des environnements de conteneurisation et d'orchestration, notamment Kubernetes et Docker, ainsi que de la gestion sécurisée des secrets avec HashiCorp Vault - Maîtrise avancée des traitements Big Data, incluant PySpark 3 ainsi que la manipulation de formats de données distribués (Parquet, gestion des buckets). - Maîtrise opérationnelle de l'orchestration de workflows de données à l'aide de l'outil Apache Airflow. - Maîtrise confirmée des bases de données relationnelles, particulièrement PostgreSQL. - Maîtrise des outils de gestion de code et de qualité logicielle, incluant GitLab, Fortify et SonarQube. - Maîtrise des outils de stockage objet, notamment via l'utilisation des commandes MinIO. - Maîtrise des outils de transfert de fichiers, en particulier CFT (Cross File Transfer). Pour l'ensemble du projet de titrisation Bail : • Dossiers d'architecture (schémas, principes techniques, choix structurants). • Backlog enrichi et priorisé en lien avec les parties prenantes. • Composants applicatifs développés, testés et documentés. • Comptes rendus des revues de code et plan d'amélioration continue. • Documentation projet à jour (Spécifications techniques, JIRA, Page Confluence, Runbook). • Reporting d'avancement sur le périmètre confié. • RUN : Reporting de type Morning check
Voir cette offre
CDI

Offre d'emploi
Data Engineer I (Remote)

█ █ █ ██ █ █
Publiée le
Apache Airflow
Apache Kafka
Apache Spark

Royaume-Uni

Offre importée

Offre issue du marché tech, identifiée automatiquement pour vous donner une vue complète des opportunités.

Accès restreint à la communauté

Rejoignez notre plateforme pour accéder aux détails de cette offre et obtenir un accès aux meilleures offres du marché.

Voir cette offre
Freelance
CDI

Offre d'emploi
Lead Data Engineer

CAT-AMANIA
Publiée le
Apache Airflow
PySpark

6 mois
40k-70k €
400-550 €
Levallois-Perret, Île-de-France
• Analyse et cadrage Recueillir et analyser les besoins métiers. Formaliser les US en spécifications techniques exploitables. • Pilotage technique Assurer un pilotage intermédiaire sur un périmètre projet (coordination technique, suivi d'avancement). Contribuer aux choix techniques structurants. • Développement et expertise Réaliser des développements complexes. Assurer la maintenance applicative (Gestion des obsolescence et vulnérabilités) Apporter un support technique aux équipes sur les composants critiques. • Contribution agile Participer à l'élaboration et à la priorisation du backlog avec les PO et BA. Animer et contribuer aux rituels techniques (code reviews, challenger les estimations de charge etc.) • Architecture et standards Concevoir et mettre en oeuvre l'architecture applicative et technique. Veiller au respect des normes, bonnes pratiques et standards Groupe. • Qualité et documentation Garantir la qualité des livrables (revues de code, bonnes pratiques). Assurer la production et la maintenance de la documentation projet. • RUN Planification des activités, gestion du calendrier de l'équipe et priorisation des actions Assurer le suivi d'exploitation des traitements PySpark en production : supervision, résolution des incidents, analyse des performances et amélioration continue des traitements Maîtrise avancée des environnements de conteneurisation et d'orchestration, notamment Kubernetes et Docker, ainsi que de la gestion sécurisée des secrets avec HashiCorp Vault Maîtrise avancée des traitements Big Data, incluant PySpark 3 ainsi que la manipulation de formats de données distribués (Parquet, gestion des buckets). Maîtrise opérationnelle de l'orchestration de workflows de données à l'aide de l'outil Apache Airflow. Maîtrise confirmée des bases de données relationnelles, particulièrement PostgreSQL. Maîtrise des outils de gestion de code et de qualité logicielle, incluant GitLab, Fortify et SonarQube. Maîtrise des outils de stockage objet, notamment via l'utilisation des commandes MinIO. Maîtrise des outils de transfert de fichiers, en particulier CFT (Cross File Transfer). Pour l'ensemble du projet de titrisation Bail : • Dossiers d'architecture (schémas, principes techniques, choix structurants). • Backlog enrichi et priorisé en lien avec les parties prenantes. • Composants applicatifs développés, testés et documentés. • Comptes rendus des revues de code et plan d'amélioration continue. • Documentation projet à jour (Spécifications techniques, JIRA, Page Confluence, Runbook). • Reporting d'avancement sur le périmètre confié. • RUN : Reporting de type Morning check
Voir cette offre
Freelance
CDI

Offre d'emploi
Data Analytics Ingénieur confirmé

CHARLI GROUP
Publiée le
Apache Airflow
DBT
Python

3 ans
Issy-les-Moulineaux, Île-de-France
Dans le cadre de l'optimisation et de l'unification de ses capacités analytiques transversales, notre client recherche un consultant Data Analytics Engineer autonome pour une mission d'intégration, de modélisation et de restitution des données Corporate stratégiques du groupe. Cette initiative vise à fournir une vision consolidée et exploitable des indicateurs clés provenant de diverses sources internes, essentielles à la prise de décision stratégique et opérationnelle. Objectifs de la mission Établir et sécuriser des connexions techniques robustes et évolutives avec les systèmes sources Corporate identifiés (ERP, Plateformes Financières, RH, ITSM etc.). Extraire et charger les données des domaines fonctionnels Corporate clés : finance, ressources humaines, référentiels, achats, etc. Concevoir et implémenter des pipelines d'ingestion automatisés fiables et performants, garantissant l'intégrité et la fraîcheur des données. Structurer et modéliser les données dans un entrepôt de données (Data Warehouse Snowflake) de manière logique, modulaire, réutilisable et optimisée pour l'analyse et la restitution. Mettre en place des mécanismes de gouvernance des données : gestion des métadonnées, logiques de rafraîchissement, suivi de la qualité des données et gestion des erreurs. Développer des vues et agrégats de données spécifiques aux besoins de restitution et d'analyse des différents départements Corporate. Documenter de manière exhaustive les pipelines d'ingestion, les modèles de données (logique et physique), les règles de transformation et les points de reprise pour assurer la maintenabilité et la transférabilité.
Voir cette offre

Au service des talents IT

Free-Work est une plateforme qui s'adresse à tous les professionnels des métiers de l'informatique.

Ses contenus et son jobboard IT sont mis à disposition 100% gratuitement pour les indépendants et les salariés du secteur.

Free-workers
Ressources
A propos
Espace recruteurs
2026 © Free-Work / AGSI SAS
Suivez-nous