Data Engineer Senior H/F
- Discuss this with your agent
- Open in Claude
- Open in ChatGPT
Prepare application
- Draft this with your agent
- Open in Claude
- Open in ChatGPT
Role details
Tech stack
+18 more
Job description
Participer à la conception de l’architecture Data cible et à l’organisation d’un Lakehouse.
- Concevoir et développer des pipelines de collecte et de transformation de données.
- Développer les traitements en Python, Spark / PySpark et SQL.
- Mettre en place les mécanismes de stockage et d’exposition des données.
- Participer à l’intégration de données provenant de différentes sources.
- Concevoir des jeux de données structurés à destination des équipes métier et marketing.
- Participer à la mise à disposition de données pour les outils de reporting et de DataViz.
- Mettre en place l’ordonnancement et le suivi des traitements.
- Développer des tests unitaires afin de sécuriser les traitements.
- Mettre en place les contrôles nécessaires au suivi de la qualité et de la bonne exécution des pipelines.
- Participer à la maintenance corrective et évolutive des solutions développées.
- Documenter les développements, flux et architectures mis en place.
- Accompagner les équipes MOA et utilisateurs lors des phases de recette.
- Estimer les charges et assurer le suivi de l’avancement des développements.
- Collaborer avec les équipes transverses sur les problématiques d’architecture et d’intégration.
- Contribuer à l’amélioration continue des pratiques de développement et d’industrialisation.
Data Science & Intelligence Artificielle
Vous serez également amené(e) à intervenir ponctuellement sur des sujets de valorisation avancée de la donnée :
- Utilisation de Machine Learning appliqué aux données.
- Feature engineering et préparation des données.
- Utilisation de bibliothèques telles que scikit-learn.
- Contribution à l’intégration de solutions LLM / GenAI facilitant l’accès, l’exploration ou l’interrogation des données.
Requirements
Environnement existant
- Informatica
- Oracle
- OBIEE
- BIRT, Profil recherchéProfil recherchéVous disposez d’une expérience significative en Data Engineering, avec une forte maîtrise de :PythonSpark / PySparkSQLConception et développement de pipelines de donnéesETL / ELTModélisation et structuration de donnéesData Lake / LakehouseTests unitaires et qualité des traitementsUne expérience sur AWS S3, Dagster ou Trino sera particulièrement appréciée.La connaissance d’Informatica constitue également un atout important dans le cadre de la modernisation d’environnements Data existants.Vous disposez par ailleurs d’une première expérience ou d’une forte appétence pour les sujets Machine Learning et GenAI / LLM appliqués à la donnée.
Mais aussi…
Taux journalier :700.css-11k7fwb{display:inline-block;white-space:nowrap;vertical-align:middle;-webkit-padding-start:var(–chakra-space-1-5);padding-inline-start:var(–chakra-space-1-5);-webkit-padding-end:var(–chakra-space-1-5);padding-inline-end:var(–chakra-space-1-5);text-transform:none;font-size:var(–chakra-fontSizes-xs);border-radius:var(–chakra-radii-md);font-weight:var(–chakra-fontWeights-semibold);background:var(–chakra-colors-success-200);color:var(–chakra-colors-success-700);box-shadow:var(–badge-shadow);padding:4px 6px;–badge-bg:var(–chakra-colors-success-100);–badge-color:colors.success.800;}.chakra-ui-dark .css-11k7fwb:not([data-theme]),[data-theme=dark] .css-11k7fwb:not([data-theme]),.css-11k7fwb[data-theme=dark]{–badge-bg:rgba(226, 243, 232, 0.16);–badge-color:var(–chakra-colors-success-200);}Cette offre est à 0% de commission .css-74lrwu{width:1em;height:1em;line-height:1em;-webkit-flex-shrink:0;-ms-flex-negative:0;flex-shrink:0;color:currentColor;font-size:16px;display:-webkit-box;display:-webkit-flex;display:-ms-flexbox;display:flex;-webkit-transition:.1s ease-in-out color;transition:.1s ease-in-out color;}.css-74lrwu *{-webkit-transition:.1s ease-in-out fill;transition:.1s ease-in-out fill;fill:var(–chakra-colors-rythm-600);}, Vous disposez d’une expérience significative en Data Engineering, avec une forte maîtrise de :
- Python
- Spark / PySpark
- SQL
- Conception et développement de pipelines de données
- ETL / ELT
- Modélisation et structuration de données
- Data Lake / Lakehouse
- Tests unitaires et qualité des traitements
Une expérience sur AWS S3, Dagster ou Trino sera particulièrement appréciée.
La connaissance d’Informatica constitue également un atout important dans le cadre de la modernisation d’environnements Data existants.
Vous disposez par ailleurs d’une première expérience ou d’une forte appétence pour les sujets Machine Learning et GenAI / LLM appliqués à la donnée.
EUR
Machine learning ETL Intelligence artificielle Contrôle qualité Confluence SQL AWS Oracle Git Reporting Jenkins Python Jira Visualisation de données
Benefits & conditions
Environnement technique
Data Engineering
- Python
- Spark / PySpark
- SQL
- ETL / ELT
- Data Lake / Lakehouse
Plateforme cible
- AWS S3
- Dagster
- Trino
Industrialisation
- Git
- Jenkins
- CI/CD
- Jira
- Confluence
Machine Learning / IA
- scikit-learn
- Feature Engineering
- LLM / GenAI
About the company
Bonjour, Dans le cadre de ses projets clients, Visian est à la recherche d’un Data Engineer Senior afin de participer à la conception et au développement d’une nouvelle architecture orientée Lakehouse.
Vous interviendrez sur la collecte, la transformation, le stockage et la mise à disposition de données structurées à destination notamment d’équipes métier et analytiques.
Apply for this position
This job is hosted externally. Click below to view the full posting and apply.
Prepare application
- Draft this with your agent
- Open in Claude
- Open in ChatGPT
Good distractions
Talks and stories from around this role — technically off-topic, practically not.
Moments
Explore playlistsVideos
See allRelated articles
See all
The Most Popular IT Jobs on the Market
Best Companies to Work For in Paris: Top 25 Companies in 2023Â
Software Engineer Salary London
Top-Paying Tech Jobs (with Salaries)