Administrateur Plateforme Data Cloudera & Open Source H/F

Visian
Canton de Torcy, France
2 days ago

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Working hours
Regular working hours
Languages
French
Experience level
Senior

Job location

Canton de Torcy, France

Tech stack

API
Artificial Intelligence
Bash
Big Data
Databases
Data Cleansing
Data Governance
Data Infrastructure
Relational Databases
Linux
Gradle
Hadoop
HBase
Hive
Python
Kerberos (Protocol)
Lightweight Directory Access Protocols (LDAP)
Machine Learning
Maven
Open Source Technology
Openshift
Red Hat Enterprise Linux - RHEL
Ansible
Cloudera
Solr
WebKit
Apache Zookeeper
Data Storage Technologies
Data Ingestion
Spark
Data Lake
Kubernetes
Kafka

Job description

Dans le cadre du développement d'une plateforme Data & IA au sein d'un grand groupe du secteur financier, nous recherchons un Data Platform Engineer / Administrateur Data pour assurer l'administration, l'évolution et la fiabilité des infrastructures Data.

Vous interviendrez sur des environnements Big Data basés sur l'écosystème Cloudera et Open Source, au sein d'équipes techniques et métiers.

Missions

Administration et exploitation des plateformes Data

  • Administrer et maintenir les plateformes Big Data en condition opérationnelle
  • Superviser les systèmes et assurer la maintenance corrective et évolutive
  • Intervenir sur la résolution d'incidents complexes sur les plateformes Data

Conception et gestion des flux de données

  • Identifier les besoins métiers en matière de collecte et stockage de données
  • Développer des solutions d'ingestion de données (API, pipelines)
  • Concevoir des architectures de stockage robustes (Data Lake / Big Data)
  • Automatiser les traitements via batchs et pipelines de données

Valorisation et gouvernance des données

  • Industrialiser les processus de transformation et de nettoyage des données
  • Gérer des bases de données hétérogènes et multi-sources
  • Garantir la conformité et la gouvernance des données

Industrialisation Data Science / IA

  • Industrialiser le déploiement de modèles statistiques et machine learning
  • Mettre en place des mécanismes de validation et monitoring des modèles
  • Assurer le suivi opérationnel des modèles intégrés aux applications

Contribution aux projets Data

  • Définir les spécifications techniques
  • Assurer le reporting d'avancement auprès du pilotage projet
  • Apporter un support technique aux équipes métiers et applicatives

Le poste peut inclure des astreintes par rotation et une participation à la continuité de service des plateformes Data., * Python

  • Bash
  • Ansible
  • Maven / Gradle

Infrastructure

  • Linux RedHat 8 / 9
  • Kubernetes / OpenShift
  • Environnements Data conteneurisés

Requirements

Profil recherchéEnvironnement techniqueBig Data / ClouderaCloudera CDP 7.xHBase, Hive, Kafka, SolrSpark, Ranger, KnoxZookeeper, Kerberos, LDAPÉcosystème Data / Open SourceHadoop, OzoneDruid, ClickhouseTrino / StarburstAirflow, FlinkDevOps & automatisationPythonBashAnsibleMaven / GradleInfrastructureLinux RedHat 8 / 9Kubernetes / OpenShiftEnvironnements Data conteneurisésCompétences requisesExpertise Cloudera CDP 7.xBonne maîtrise Linux RedHatCompétences Python / Bash / automatisationExpérience sur plateformes Big Data en productionBonne compréhension de l'écosystème Open Source DataProfil recherchéExpérience significative en administration de plateformes Big DataForte capacité d'analyse et de résolution d'incidentsCapacité à travailler avec des équipes techniques et métiersAutonomie, rigueur et sens du service

Mais aussi...

Taux journalier :470.css-11k7fwb{display:inline-block;white-space:nowrap;vertical-align:middle;-webkit-padding-start:var(--chakra-space-1-5);padding-inline-start:var(--chakra-space-1-5);-webkit-padding-end:var(--chakra-space-1-5);padding-inline-end:var(--chakra-space-1-5);text-transform:none;font-size:var(--chakra-fontSizes-xs);border-radius:var(--chakra-radii-md);font-weight:var(--chakra-fontWeights-semibold);background:var(--chakra-colors-success-200);color:var(--chakra-colors-success-700);box-shadow:var(--badge-shadow);padding:4px 6px;--badge-bg:var(--chakra-colors-success-100);--badge-color:colors.success.800;}.chakra-ui-dark .css-11k7fwb:not([data-theme]),[data-theme=dark] .css-11k7fwb:not([data-theme]),.css-11k7fwb[data-theme=dark]{--badge-bg:rgba(226, 243, 232, 0.16);--badge-color:var(--chakra-colors-success-200);}Cette offre est à 0% de commission .css-74lrwu{width:1em;height:1em;line-height:1em;-webkit-flex-shrink:0;-ms-flex-negative:0;flex-shrink:0;color:currentColor;font-size:16px;display:-webkit-box;display:-webkit-flex;display:-ms-flexbox;display:flex;-webkit-transition:.1s ease-in-out color;transition:.1s ease-in-out color;}.css-74lrwu *{-webkit-transition:.1s ease-in-out fill;transition:.1s ease-in-out fill;fill:var(--chakra-colors-rythm-600);}, * HBase, Hive, Kafka, Solr

  • Spark, Ranger, Knox
  • Zookeeper, Kerberos, LDAP, * Expertise Cloudera CDP 7.x
  • Bonne maîtrise Linux RedHat
  • Compétences Python / Bash / automatisation
  • Expérience sur plateformes Big Data en production
  • Bonne compréhension de l'écosystème Open Source Data, * Expérience significative en administration de plateformes Big Data
  • Forte capacité d'analyse et de résolution d'incidents
  • Capacité à travailler avec des équipes techniques et métiers
  • Autonomie, rigueur et sens du service

EUR

LDAP Maven Ansible Compétences ménagères Machine learning Bash Intelligence artificielle API SGBD Hadoop Assistance technique Linux Hive Batching Maintenance préventive et curative Kubernetes Big data Python Autonomie Gouvernance des données KAFKA Solr Monitoring Statistiques Esprit d'analyse

Apply for this position