Administrateur Plateforme Data Cloudera & Open Source H/F

Visian
France
16 days ago

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience level
Expert
Working hours
Regular working hours

Tech stack

Application Programming Interfaces (APIs) Artificial Intelligence Bash Shell Big Data Databases Data Cleansing Data Governance Data Infrastructure Relational Databases Linux Gradle Apache Hadoop
+21 more
Apache HBase Apache Hive Python (Programming Language) Kerberos (Protocol) Lightweight Directory Access Protocols (LDAP) Machine Learning Apache Maven Open Source Technology OpenShift Red Hat Enterprise Linux Ansible Cloudera Apache Solr WebKit Apache Zookeeper Data Storage Technologies Data Ingestion Apache Spark Data Lakes Kubernetes Apache Kafka

Job description

Dans le cadre du développement d’une plateforme Data & IA au sein d’un grand groupe du secteur financier, nous recherchons un Data Platform Engineer / Administrateur Data pour assurer l’administration, l’évolution et la fiabilité des infrastructures Data.

Vous interviendrez sur des environnements Big Data basés sur l’écosystème Cloudera et Open Source, au sein d’équipes techniques et métiers.

Missions

Administration et exploitation des plateformes Data

  • Administrer et maintenir les plateformes Big Data en condition opérationnelle
  • Superviser les systèmes et assurer la maintenance corrective et évolutive
  • Intervenir sur la résolution d’incidents complexes sur les plateformes Data

Conception et gestion des flux de données

  • Identifier les besoins métiers en matière de collecte et stockage de données
  • Développer des solutions d’ingestion de données (API, pipelines)
  • Concevoir des architectures de stockage robustes (Data Lake / Big Data)
  • Automatiser les traitements via batchs et pipelines de données

Valorisation et gouvernance des données

  • Industrialiser les processus de transformation et de nettoyage des données
  • Gérer des bases de données hétérogènes et multi-sources
  • Garantir la conformité et la gouvernance des données

Industrialisation Data Science / IA

  • Industrialiser le déploiement de modèles statistiques et machine learning
  • Mettre en place des mécanismes de validation et monitoring des modèles
  • Assurer le suivi opérationnel des modèles intégrés aux applications

Contribution aux projets Data

  • Définir les spécifications techniques
  • Assurer le reporting d’avancement auprès du pilotage projet
  • Apporter un support technique aux équipes métiers et applicatives

Le poste peut inclure des astreintes par rotation et une participation à la continuité de service des plateformes Data., * Python

  • Bash
  • Ansible
  • Maven / Gradle

Infrastructure

  • Linux RedHat 8 / 9
  • Kubernetes / OpenShift
  • Environnements Data conteneurisés

Requirements

Profil recherchéEnvironnement techniqueBig Data / ClouderaCloudera CDP 7.xHBase, Hive, Kafka, SolrSpark, Ranger, KnoxZookeeper, Kerberos, LDAPÉcosystème Data / Open SourceHadoop, OzoneDruid, ClickhouseTrino / StarburstAirflow, FlinkDevOps & automatisationPythonBashAnsibleMaven / GradleInfrastructureLinux RedHat 8 / 9Kubernetes / OpenShiftEnvironnements Data conteneurisésCompétences requisesExpertise Cloudera CDP 7.xBonne maîtrise Linux RedHatCompétences Python / Bash / automatisationExpérience sur plateformes Big Data en productionBonne compréhension de l’écosystème Open Source DataProfil recherchéExpérience significative en administration de plateformes Big DataForte capacité d’analyse et de résolution d’incidentsCapacité à travailler avec des équipes techniques et métiersAutonomie, rigueur et sens du service

Mais aussi…

Taux journalier :470.css-11k7fwb{display:inline-block;white-space:nowrap;vertical-align:middle;-webkit-padding-start:var(–chakra-space-1-5);padding-inline-start:var(–chakra-space-1-5);-webkit-padding-end:var(–chakra-space-1-5);padding-inline-end:var(–chakra-space-1-5);text-transform:none;font-size:var(–chakra-fontSizes-xs);border-radius:var(–chakra-radii-md);font-weight:var(–chakra-fontWeights-semibold);background:var(–chakra-colors-success-200);color:var(–chakra-colors-success-700);box-shadow:var(–badge-shadow);padding:4px 6px;–badge-bg:var(–chakra-colors-success-100);–badge-color:colors.success.800;}.chakra-ui-dark .css-11k7fwb:not([data-theme]),[data-theme=dark] .css-11k7fwb:not([data-theme]),.css-11k7fwb[data-theme=dark]{–badge-bg:rgba(226, 243, 232, 0.16);–badge-color:var(–chakra-colors-success-200);}Cette offre est à 0% de commission .css-74lrwu{width:1em;height:1em;line-height:1em;-webkit-flex-shrink:0;-ms-flex-negative:0;flex-shrink:0;color:currentColor;font-size:16px;display:-webkit-box;display:-webkit-flex;display:-ms-flexbox;display:flex;-webkit-transition:.1s ease-in-out color;transition:.1s ease-in-out color;}.css-74lrwu *{-webkit-transition:.1s ease-in-out fill;transition:.1s ease-in-out fill;fill:var(–chakra-colors-rythm-600);}, * HBase, Hive, Kafka, Solr

  • Spark, Ranger, Knox
  • Zookeeper, Kerberos, LDAP, * Expertise Cloudera CDP 7.x
  • Bonne maîtrise Linux RedHat
  • Compétences Python / Bash / automatisation
  • Expérience sur plateformes Big Data en production
  • Bonne compréhension de l’écosystème Open Source Data, * Expérience significative en administration de plateformes Big Data
  • Forte capacité d’analyse et de résolution d’incidents
  • Capacité à travailler avec des équipes techniques et métiers
  • Autonomie, rigueur et sens du service

EUR

LDAP Maven Ansible Compétences ménagères Machine learning Bash Intelligence artificielle API SGBD Hadoop Assistance technique Linux Hive Batching Maintenance préventive et curative Kubernetes Big data Python Autonomie Gouvernance des données KAFKA Solr Monitoring Statistiques Esprit d’analyse

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on www.hellowork.com

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

52 sec

Running persistent Linux environments directly on Windows

Ben Breard Ben Breard · WWC 2025

1:59 min

Configuring the browser speech recognition class and grammar

Tobias Münch Tobias Münch · WWC 2024

5:51 min

Understanding build structure and core Gradle plugins

Amanda Martin · LIVE

1:34 min

Bringing diverse skills to industrial data science roles

Katja Träumner

2:39 min

Experiencing core Linux capabilities for DevOps administration

Michael Cade · LIVE

1:44 min

Career transition into cloud native and data management

Michael Cade · LIVE

Videos

See all

Related articles

See all