> Markdown version of [/jobs/ext/413638-data-engineer-confirme-cdi-h-f](https://www.wearedevelopers.com/jobs/ext/413638-data-engineer-confirme-cdi-h-f). Every page supports `.md` or `Accept: text/markdown`. Links point to the HTML versions so they work for humans too. Agent guide: [/agents.md](https://www.wearedevelopers.com/agents.md). --- # Data Engineer confirmé - CDI H/F - **Company:** Collective - **Location:** Montrouge, France - **Experience:** Experienced - **Contract:** Permanent contract - **Skills:** Application Programming Interfaces (APIs), Airflow, Software as a Service, Cloud Computing, Databases, Continuous Integration, Data Dictionary, Python (Programming Language), PostgreSQL, Open Source Technology, Oracle (Applications), Role-Based Access Control, Power BI, Salesforce.Com, SAP (Applications), SAP Business Suiteing, Data Server Interface, Snowflake, Git, Streamlit Framework, Workday, Servicenow - **Published:** June 3, 2026 - **Apply:** https://fr.indeed.com/viewjob?jk=452807c68206bf80 ## About the Role * 3 à 6 ans d'expérience minimum en Data Engineering sur des projets en production * Maîtrise de la stack technique retenue : Python et DBT au minimum, Dagster si possible * Connaissance minimale de Snowflake appréciée pour son administration courante * Expérience en conception et implémentation des modèles DBT en couches (staging, intermédiaire, datamarts), * Connaissance d'une solution similaire à Dagster (ex : Airflow) appréciée * Gestion des warehouses Snowflake : sizing, suspension automatique, allocation par type d'usage * Sécurité et gestion des accès : modèle RBAC, gestion des rôles et droits * Supervision des coûts et de la consommation (crédits Snowflake) * Profil rigoureux, autonome et pédagogue * Capacité à travailler en lien direct avec l'équipe interne et à documenter son travail de manière structurée ## Description Le présent cahier des charges fait état des attentes concernant une prestation de Data Engineering dans le cadre de la construction de sa plateforme data. On a engagé une transformation data en profondeur, avec pour objectif de disposer d'une plateforme data moderne, fiable et évolutive, capable de couvrir des besoins allant du reporting standard à l'exploration analytique avancée. L'architecture retenue est hybride, combinant une infrastructure on-premise et une plateforme cloud (Snowflake). Nous sommes en train de la mettre en place, en s'appuyant sur de l'expertise. La chaîne technique est basée sur des outils modernes et open source : DLT pour l'ingestion, DBT Core pour les transformations, Dagster pour l'orchestration, PostgreSQL comme destination on-premise et Snowflake pour le cloud. La restitution s'appuie sur Power BI. La plateforme est en cours de construction. Le prestataire vient renforcer la capacité de delivery technique. Afin de répondre aux enjeux dans des délais raisonnables, la DSI souhaite renforcer l'équipe data avec un Data Engineer confirmé, maîtrisant la stack technique retenue (Python et DBT au minimum, DBT et Dagster si possible). En complément, une connaissance minimale de Snowflake serait appréciée, pour contribuer à son administration courante., * Conception et implémentation des modèles DBT en couches : staging, intermédiaire, datamarts * Application des conventions de nommage et d'organisation des couches * Rédaction des tests de qualité, technique, et avancés fonctionnellement * Maintenance de la documentation DBT : descriptions, lineage, dictionnaire de données * Gestion des évolutions de schéma et compatibilité ascendante * Développement et maintenance des pipelines d'ingestion avec DLT * Connexion aux sources : APIs, bases de données on-prem (Oracle, PostgreSQL), fichiers * Sources principales : applications SaaS (Servicenow, Salesforce, Workday…) et SI internes (SI des ventes, Référentiel technique…) * Mise en place des mécanismes de chargement incrémental et de gestion des doublons * Gestion des schémas déclaratifs et des évolutions de schéma * Conception des assets et jobs Dagster pour orchestrer les pipelines de bout en bout * Mise en place du monitoring des exécutions : alertes, logs, stratégies de retry * Définition des dépendances entre assets et des stratégies de scheduling * Gestion des warehouses Snowflake : sizing, suspension automatique, allocation par type d'usage * Sécurité et gestion des accès : modèle RBAC, gestion des rôles et des droits * Supervision des coûts et de la consommation (crédits Snowflake), * Snowflake, dbt project, Streamlit * Starburst (Trino), PostgreSQL * Power BI, Git, CI/CD * Stockage S3, Apache Iceberg * Stack historique (SAP Business Object, SAP BODS), * Application des conventions de nommage et d'organisation des couches * Rédaction des tests de qualité, techniques et fonctionnels avancés * Maintenance de la documentation DBT : descriptions, lineage, dictionnaire de données * Gestion des évolutions de schéma et compatibilité ascendante * Développement et maintenance des pipelines d'ingestion avec DLT * Connexion aux sources : APIs, bases de données on-prem (Oracle, PostgreSQL), fichiers * Mise en place des mécanismes de chargement incrémental et gestion des doublons * Gestion des schémas déclaratifs et des évolutions de schéma * Maîtrise obligatoire de Python * Conception des assets et jobs Dagster pour orchestrer les pipelines * Mise en place du monitoring des exécutions : alertes, logs, stratégies de retry * Définition des dépendances entre assets et stratégies de scheduling ## Related Videos - [From Messy Queries to Scalable Systems - How Data Engineering actually works](https://www.wearedevelopers.com/videos/100203-from-messy-queries-to-scalable-systems-how-data-engineering-actually-works) - [Enjoying SQL data pipelines with dbt](https://www.wearedevelopers.com/videos/823-enjoying-sql-data-pipelines-with-dbt) - [Destigmatizing the Workplace: Building Real Inclusion](https://www.wearedevelopers.com/videos/1492-destigmatizing-the-workplace-building-real-inclusion) - [How a Small Team Shrank a Microsoft Monorepo by 94%](https://www.wearedevelopers.com/videos/1236-how-a-small-team-shrank-a-microsoft-monorepo-by-94) - [The Future of Employee Wellbeing: Benefits, Trust & Performance](https://www.wearedevelopers.com/videos/1808-the-future-of-employee-wellbeing-benefits-trust-performance) - [AI Model Management Life Circles: ML Ops For Generative AI Models From Research to Deployment](https://www.wearedevelopers.com/videos/1152-ai-model-management-life-circles-ml-ops-for-generative-ai-models-from-research-to-deployment) ## Related Articles - [Data Engineer Salary UK](https://www.wearedevelopers.com/magazine/253-data-engineer-salary-uk) - [Best Companies to Work For in Paris: Top 25 Companies in 2023 ](https://www.wearedevelopers.com/magazine/190-best-companies-to-work-for-in-paris-top-25-companies-in-2023) - [Highest Paying Tech Companies for Developers](https://www.wearedevelopers.com/magazine/220-highest-paying-tech-companies-for-developers) - [Making Data Warehouses Fast: A Developer’s Story](https://www.wearedevelopers.com/magazine/107-making-data-warehouses-fast-a-developer-s-story) - [Best Companies to Work For in France: Top 25 Companies in 2023 ](https://www.wearedevelopers.com/magazine/189-best-companies-to-work-for-in-france-top-25-companies-in-2023) - [Data Analyst Salary in the UK](https://www.wearedevelopers.com/magazine/278-data-analyst-salary-in-the-uk)