> Markdown version of [/jobs/ext/1961727-data-product-engineer-h-f](https://www.wearedevelopers.com/jobs/ext/1961727-data-product-engineer-h-f). Every page supports `.md` or `Accept: text/markdown`. Links point to the HTML versions so they work for humans too. Agent guide: [/agents.md](https://www.wearedevelopers.com/agents.md). --- # Data Product Engineer H/F - **Company:** Visian - **Location:** Paris, France - **Contract:** Permanent contract - **Skills:** Java (Programming Language), Application Programming Interfaces (APIs), Airflow, Amazon S3, Bash Shell, Big Data, Continuous Integration, Data Integration, Extract Transform Load (ETL), DevOps, Apache Hadoop, Apache Hive, Python (Programming Language), NoSQL, Role-Based Access Control, DataOps, Scala (Programming Language), SQL Databases, Data Streaming, Talend, Parquet, Grafana, Apache Spark, Analytic Functions, Caching, Pandas, Pyspark, Kubernetes, Apache Kafka, Apache Nifi, Terraform - **Published:** August 7, 2026 - **Apply:** https://www.hellowork.com/fr-fr/emplois/82100855.html ## About the Role Talend RealTime BigData : expérience avancée en développement de pipelines sur Talend Studio en mode batch ou route (runtime) - Starburst/Trino : expérience avancée en SQL sur Starburst/Trino (jointures, CTEs, fonctions analytiques) - Data Modeling - Pipelines : expérience avec Airflow/Astronomer, Spark, Talend Real Time Big Data / Talend Data intégration - Stockage : connaissance des formats Iceberg, Parquet, S3 - Gouvernance : familiarité avec les outils de sécurité (Ranger, RBAC) - DevOps/DataOps : pratiques CI/CD pour les pipelines, infrastructure-as-code (Terraform, Kubernetes) - Langages : SQL avancé (mandatory), Python (Pandas, PySpark), bash Compétences transverses (Data Mesh) - Compréhension des principes Data Mesh (domain-oriented ownership, self-serve platform, federated governance) - Capacité à travailler en mode produit (roadmap, priorisation, collaboration avec les métiers) - Sensibilité à la data quality (tests, monitoring, remédiation) et à la documentation (data contracts, métadonnées) Soft Skills - Esprit collaboratif : travail avec les équipes métiers, data scientists, et DevOps - Pédagogie : capacité à expliquer des concepts techniques à des non-experts - Autonomie : prise d'initiative dans un cadre agile Environnement technique - Expertise écosystème zoo Hadoop - Connaissance / maîtrise Data - Connaissance / maîtrise technique de l'environnement DevOps - Maîtrise technique de l'environnement Data - Expertise couche d'accès et déchange (Kafka, Nifi, ...) - Expertise Java, Scala, Python, Hive, Spark - Expertise ETL, Bash - Expertise SQL / NoSQL, Profil recherchéExpérience avancée en développement de pipelines sur Talend RealTime BigData (Talend Studio en mode batch ou route)Expérience avancée en SQL sur Starburst/Trino (jointures, CTEs, fonctions analytiques)Expérience avec Airflow/Astronomer, Spark, Talend Data intégrationConnaissance des formats de stockage Iceberg, Parquet, S3Familiarité avec les outils de sécurité et gouvernance (Ranger, RBAC)Pratiques CI/CD pour les pipelines, infrastructure-as-code (Terraform, Kubernetes)Maîtrise des langages : SQL avancé (obligatoire), Python (Pandas, PySpark), bashCompréhension des principes Data Mesh (domain-oriented ownership, self-serve platform, federated governance)Capacité à travailler en mode produit (roadmap, priorisation, collaboration avec les métiers)Sensibilité à la data quality (tests, monitoring, remédiation) et à la documentation (data contracts, métadonnées)Esprit collaboratif : travail avec les équipes métiers, data scientists, et DevOpsPédagogie : capacité à expliquer des concepts techniques à des non-expertsAutonomie : prise d'initiative dans un cadre agileExpertise dans l'écosystème HadoopMaîtrise technique de l'environnement Data et DevOpsExpertise sur les couches d'accès et d'échange (Kafka, Nifi)Expertise en langages Java, Scala, Python, Hive, SparkExpertise en ETL, BashExpertise en SQL / NO SQL, * Expérience avancée en développement de pipelines sur Talend RealTime BigData (Talend Studio en mode batch ou route) * Expérience avancée en SQL sur Starburst/Trino (jointures, CTEs, fonctions analytiques) * Expérience avec Airflow/Astronomer, Spark, Talend Data intégration * Connaissance des formats de stockage Iceberg, Parquet, S3 * Familiarité avec les outils de sécurité et gouvernance (Ranger, RBAC) * Pratiques CI/CD pour les pipelines, infrastructure-as-code (Terraform, Kubernetes) * Maîtrise des langages : SQL avancé (obligatoire), Python (Pandas, PySpark), bash * Compréhension des principes Data Mesh (domain-oriented ownership, self-serve platform, federated governance) * Capacité à travailler en mode produit (roadmap, priorisation, collaboration avec les métiers) * Sensibilité à la data quality (tests, monitoring, remédiation) et à la documentation (data contracts, métadonnées) * Esprit collaboratif : travail avec les équipes métiers, data scientists, et DevOps * Pédagogie : capacité à expliquer des concepts techniques à des non-experts * Autonomie : prise d'initiative dans un cadre agile * Expertise dans l'écosystème Hadoop * Maîtrise technique de l'environnement Data et DevOps * Expertise sur les couches d'accès et d'échange (Kafka, Nifi) * Expertise en langages Java, Scala, Python, Hive, Spark * Expertise en ETL, Bash * Expertise en SQL / NO SQL EUR Bash ETL Scala Pédagogie Hadoop SQL Hive Pro-activité Kubernetes Big data Python Autonomie KAFKA Java NoSQL ## Description Dans le cadre de la transition vers une architecture Data Mesh, nous recherchons un(e) Data Product Engineer spécialisé(e) dans le développement de pipelines sur la plateforme Talend Real Time BigData et de data products sur la plateforme Starburst (Trino). La mission consiste à concevoir, collecter, intégrer, construire et opérer des jeux de données fiables, auto-descriptifs et interopérables, en collaboration avec les domain teams et les data owners., Concevoir des flux de données et des Data Products - Développer des pipelines d'intégration de données optimisés via la Talend Data Fabric / Talend Real Time BigData - Développer des requêtes SQL optimisées pour Starburst/Trino (push-down predicates, partitionnement, formats de fichiers comme Iceberg/Parquet) - Automatiser les pipelines de données (ETL/ELT) avec des outils comme Airflow, dbt, ou Starburst Galaxy - Configurer des accès sécurisés (RBAC, row-level security) et des politiques de gouvernance (tagging, lineage) - Collaborer avec les domain teams pour identifier les sources de données et les cas d'usage - Documenter les data products (métadonnées, ownership, qualité) via des outils comme Amundsen, DataHub, ou Starburst Discover - Participer à la définition des standards d'interopérabilité (formats communs, APIs de données) - Monitorer la performance (latence, coût des requêtes) et la qualité des données (frais, complétude) - Mettre en place des alertes et des dashboards (Grafana, Metabase) pour le suivi des data products - Contribuer à l'amélioration continue de la plateforme Starburst (scaling, caching, federation) ## Related Videos - [Leveraging Real time data in FSIs](https://www.wearedevelopers.com/videos/806-leveraging-real-time-data-in-fsis) - [Advanced Typing in TypeScript](https://www.wearedevelopers.com/videos/496-advanced-typing-in-typescript) - [From Messy Queries to Scalable Systems - How Data Engineering actually works](https://www.wearedevelopers.com/videos/100203-from-messy-queries-to-scalable-systems-how-data-engineering-actually-works) - [Data Science on Software Data](https://www.wearedevelopers.com/videos/162-data-science-on-software-data) - [Tomorrow's cloud data platforms - fully managed database-as-a-service (DBaaS)](https://www.wearedevelopers.com/videos/254-tomorrow-s-cloud-data-platforms-fully-managed-database-as-a-service-dbaas) - [Enjoying SQL data pipelines with dbt](https://www.wearedevelopers.com/videos/823-enjoying-sql-data-pipelines-with-dbt) ## Related Articles - [Top Big Data Technologies That You Need to Know](https://www.wearedevelopers.com/magazine/108-top-big-data-technologies-that-you-need-to-know) - [Data Engineer Salary UK](https://www.wearedevelopers.com/magazine/253-data-engineer-salary-uk) - [Highest Paying Tech Companies for Developers](https://www.wearedevelopers.com/magazine/220-highest-paying-tech-companies-for-developers) - [Résumé-Driven Development: How IT trends affect the job market for software developers](https://www.wearedevelopers.com/magazine/59-resume-driven-development-how-it-trends-affect-the-job-market-for-software-developers) - [Best Coding Boot Camps in Germany](https://www.wearedevelopers.com/magazine/237-best-coding-boot-camps-in-germany) - [Making Data Warehouses Fast: A Developer’s Story](https://www.wearedevelopers.com/magazine/107-making-data-warehouses-fast-a-developer-s-story)