Data Engineer Senior H/F

Visian
France
5 days ago
Apply on www.hellowork.com
Prepare application

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience level
Expert
Working hours
Regular working hours

Tech stack

Artificial Intelligence Airflow Amazon Web Services Amazon S3 Confluence JIRA Unit Testing Data Integration Extract Transform Load (ETL) Data Visualization Python (Programming Language) Machine Learning
+18 more
Oracle Business Intelligence Enterprise Edition Oracle (Applications) Standard Sql SQL Databases WebKit Data Processing Feature Engineering Informatica Powercenter Large Language Models Apache Spark Generative AI Git Data Lakes Pyspark Scikit Learn Tools for Reporting BIRT Reporting Jenkins

Job description

Participer à la conception de l’architecture Data cible et à l’organisation d’un Lakehouse.

  • Concevoir et développer des pipelines de collecte et de transformation de données.
  • Développer les traitements en Python, Spark / PySpark et SQL.
  • Mettre en place les mécanismes de stockage et d’exposition des données.
  • Participer à l’intégration de données provenant de différentes sources.
  • Concevoir des jeux de données structurés à destination des équipes métier et marketing.
  • Participer à la mise à disposition de données pour les outils de reporting et de DataViz.
  • Mettre en place l’ordonnancement et le suivi des traitements.
  • Développer des tests unitaires afin de sécuriser les traitements.
  • Mettre en place les contrôles nécessaires au suivi de la qualité et de la bonne exécution des pipelines.
  • Participer à la maintenance corrective et évolutive des solutions développées.
  • Documenter les développements, flux et architectures mis en place.
  • Accompagner les équipes MOA et utilisateurs lors des phases de recette.
  • Estimer les charges et assurer le suivi de l’avancement des développements.
  • Collaborer avec les équipes transverses sur les problématiques d’architecture et d’intégration.
  • Contribuer à l’amélioration continue des pratiques de développement et d’industrialisation.

Data Science & Intelligence Artificielle

Vous serez également amené(e) à intervenir ponctuellement sur des sujets de valorisation avancée de la donnée :

  • Utilisation de Machine Learning appliqué aux données.
  • Feature engineering et préparation des données.
  • Utilisation de bibliothèques telles que scikit-learn.
  • Contribution à l’intégration de solutions LLM / GenAI facilitant l’accès, l’exploration ou l’interrogation des données.

Requirements

Environnement existant

  • Informatica
  • Oracle
  • OBIEE
  • BIRT, Profil recherchéProfil recherchéVous disposez d’une expérience significative en Data Engineering, avec une forte maîtrise de :PythonSpark / PySparkSQLConception et développement de pipelines de donnéesETL / ELTModélisation et structuration de donnéesData Lake / LakehouseTests unitaires et qualité des traitementsUne expérience sur AWS S3, Dagster ou Trino sera particulièrement appréciée.La connaissance d’Informatica constitue également un atout important dans le cadre de la modernisation d’environnements Data existants.Vous disposez par ailleurs d’une première expérience ou d’une forte appétence pour les sujets Machine Learning et GenAI / LLM appliqués à la donnée.

Mais aussi…

Taux journalier :700.css-11k7fwb{display:inline-block;white-space:nowrap;vertical-align:middle;-webkit-padding-start:var(–chakra-space-1-5);padding-inline-start:var(–chakra-space-1-5);-webkit-padding-end:var(–chakra-space-1-5);padding-inline-end:var(–chakra-space-1-5);text-transform:none;font-size:var(–chakra-fontSizes-xs);border-radius:var(–chakra-radii-md);font-weight:var(–chakra-fontWeights-semibold);background:var(–chakra-colors-success-200);color:var(–chakra-colors-success-700);box-shadow:var(–badge-shadow);padding:4px 6px;–badge-bg:var(–chakra-colors-success-100);–badge-color:colors.success.800;}.chakra-ui-dark .css-11k7fwb:not([data-theme]),[data-theme=dark] .css-11k7fwb:not([data-theme]),.css-11k7fwb[data-theme=dark]{–badge-bg:rgba(226, 243, 232, 0.16);–badge-color:var(–chakra-colors-success-200);}Cette offre est à 0% de commission .css-74lrwu{width:1em;height:1em;line-height:1em;-webkit-flex-shrink:0;-ms-flex-negative:0;flex-shrink:0;color:currentColor;font-size:16px;display:-webkit-box;display:-webkit-flex;display:-ms-flexbox;display:flex;-webkit-transition:.1s ease-in-out color;transition:.1s ease-in-out color;}.css-74lrwu *{-webkit-transition:.1s ease-in-out fill;transition:.1s ease-in-out fill;fill:var(–chakra-colors-rythm-600);}, Vous disposez d’une expérience significative en Data Engineering, avec une forte maîtrise de :

  • Python
  • Spark / PySpark
  • SQL
  • Conception et développement de pipelines de données
  • ETL / ELT
  • Modélisation et structuration de données
  • Data Lake / Lakehouse
  • Tests unitaires et qualité des traitements

Une expérience sur AWS S3, Dagster ou Trino sera particulièrement appréciée.

La connaissance d’Informatica constitue également un atout important dans le cadre de la modernisation d’environnements Data existants.

Vous disposez par ailleurs d’une première expérience ou d’une forte appétence pour les sujets Machine Learning et GenAI / LLM appliqués à la donnée.

EUR

Machine learning ETL Intelligence artificielle Contrôle qualité Confluence SQL AWS Oracle Git Reporting Jenkins Python Jira Visualisation de données

Benefits & conditions

Environnement technique

Data Engineering

  • Python
  • Spark / PySpark
  • SQL
  • ETL / ELT
  • Data Lake / Lakehouse

Plateforme cible

  • AWS S3
  • Dagster
  • Trino

Industrialisation

  • Git
  • Jenkins
  • CI/CD
  • Jira
  • Confluence

Machine Learning / IA

  • scikit-learn
  • Feature Engineering
  • LLM / GenAI

About the company

Bonjour, Dans le cadre de ses projets clients, Visian est à la recherche d’un Data Engineer Senior afin de participer à la conception et au développement d’une nouvelle architecture orientée Lakehouse.

Vous interviendrez sur la collecte, la transformation, le stockage et la mise à disposition de données structurées à destination notamment d’équipes métier et analytiques.

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on www.hellowork.com
Prepare application

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

6:21 min

Investigating push inefficiencies with upstream Git experts

Jonathan Creamer · Coffee With Developers

3:05 min

Integrating an assistant application with Jira software

Felix Augenstein · LIVE

1:59 min

Configuring the browser speech recognition class and grammar

Tobias Münch Tobias Münch · World Congress 2024

3:09 min

Balancing data science skillings alongside systems engineering rigor

Nico Schmidt · LIVE

56 sec

Favorite git commands and the importance of patch commits

Eileen Uchitelle Eileen Uchitelle +1 · Coffee With Developers

1:34 min

Bringing diverse skills to industrial data science roles

Katja Träumner

Videos

See all

Related articles

See all