> Markdown version of [/jobs/ext/3613604-data-engineer-core-data-stock-h-f](https://www.wearedevelopers.com/jobs/ext/3613604-data-engineer-core-data-stock-h-f). Every page supports `.md` or `Accept: text/markdown`. Links point to the HTML versions so they work for humans too. Agent guide: [/agents.md](https://www.wearedevelopers.com/agents.md). --- # Data Engineer Core Data Stock H/F - **Company:** Skiils - **Location:** Lille, France - **Contract:** Permanent contract - **Skills:** Agile Methodology, Airflow, Amazon Web Services, Big Data, Cloud Computing, Software Quality, Code Review, Continuous Delivery, Continuous Integration, Data Governance, Data Infrastructure, Github, Python (Programming Language), Performance Tuning, Scrum Methodology, SQL Databases, Data Build Tool (dbt), Git, Pyspark, Core Data, Data Management, Machine Learning Operations, Databricks - **Published:** October 8, 2026 - **Apply:** https://www.hellowork.com/fr-fr/emplois/84211524.html ## About the Role DBT : Avancé - SQL : Avancé - Databricks : Confirmé - Astronomer : Confirmé - PySpark : Avancé - AWS : Avancé - Apache Airflow : Avancé - Python : Confirmé Langues - Anglais : Courant - Français, Profil recherchéMaîtrise avancée et pratique de SQL pour la modélisation et l'interrogation des donnéesExpérience avec DBT (Data Build Tool) pour l'industrialisation, la documentation et le testing des modèles de donnéesConnaissance et pratique de PySpark pour la transformation et le traitement de donnéesUne connaissance en Scala sera appréciéeExpérience avec Airflow pour la création, le monitoring et l'optimisation des DAGs complexesExpertise sur DataBricks pour la gestion des clusters et l'optimisation des performances des workloads Big DataTravail en environnement agile (Scrum/Kanban)Pratique quotidienne de la revue de code et des principes de CI/CD via des outils comme GitHubMaîtrise de l'anglais indispensable pour interagir au quotidien avec une équipe internationaleProfil engagé, dynamique et proactif avec une forte appétence businessCapacité à jouer un rôle fort dans le collectif, avec des valeurs d'entraide, de co-construction et de curiosité, 1. Maîtrise avancée et pratique de SQL pour la modélisation et l'interrogation des données 2. Expérience avec DBT (Data Build Tool) pour l'industrialisation, la documentation et le testing des modèles de données 3. Connaissance et pratique de PySpark pour la transformation et le traitement de données 4. Une connaissance en Scala sera appréciée 5. Expérience avec Airflow pour la création, le monitoring et l'optimisation des DAGs complexes 6. Expertise sur DataBricks pour la gestion des clusters et l'optimisation des performances des workloads Big Data 7. Travail en environnement agile (Scrum/Kanban) 8. Pratique quotidienne de la revue de code et des principes de CI/CD via des outils comme GitHub 9. Maîtrise de l'anglais indispensable pour interagir au quotidien avec une équipe internationale 10. Profil engagé, dynamique et proactif avec une forte appétence business 11. Capacité à jouer un rôle fort dans le collectif, avec des valeurs d'entraide, de co-construction et de curiosité EUR Cluster Anglais Scala Kanban SQL AWS Gestion des données Git Pro-activité Big data Python Scrum Gouvernance des données ## Description Concevoir, construire et maintenir des infrastructures et des pipelines robustes et performants - Garantir une architecture et une modélisation des flux optimisés et évolutives - Apporter une expertise et aider l'équipe à prendre les meilleurs choix techniques - Transformer la stack legacy vers les nouveaux standards de la Data Platform - Assurer la qualité, la fiabilité et la gouvernance des données - Maîtriser la qualité du code et promouvoir les meilleures pratiques - Collaborer en environnement Agile au sein d'une équipe internationale (anglais) - Garantir un RUN de qualité (SLA) selon le principe "You build it, you run it" - Respecter les engagements de sprint et s'inscrire dans une démarche d'amélioration continue Outils & Environnement - Plateforme Data Core (Cloud & Gouvernance) - Expertise sur DataBricks pour la gestion des clusters, l'optimisation des performances des workloads Big Data et la mise en place d'une gouvernance solide Langages & Modélisation - Maîtrise avancée et pratique SQL pour la modélisation et l'interrogation des données - Expérience avec DBT (Data Build Tool) pour l'industrialisation, la documentation et le testing de nos modèles de données - Connaissance et pratique de PySpark pour la transformation et le traitement de données - Une connaissance en Scala sera aussi appréciée Orchestration & MLOps - Expérience avec Airflow pour la création, le monitoring et l'optimisation des DAGs complexes garantissant la fiabilité de notre chaîne de production Data Méthodologie & Qualité - Travail en environnement agile (Scrum/Kanban) - Pratique quotidienne de la revue de code et des principes de CI/CD (intégration et déploiement continus) via des outils comme GitHub Communication Internationale - Maîtrise de l'anglais indispensable pour interagir au quotidien avec notre équipe internationale et nos partenaires globaux