Administrateur Cluster IA H/F
- Discuss this with your agent
- Open in Claude
- Open in ChatGPT
Prepare application
- Draft this with your agent
- Open in Claude
- Open in ChatGPT
Role details
Tech stack
Job description
Vous interviendrez sur le MCO du cluster IA, le support aux utilisateurs, la gestion des incidents et lâautomatisation des opĂ©rations dâexploitation., Assurer le MCO du cluster IA : GPU, CPU, stockage et rĂ©seau
- Administrer les environnements Linux et Kubernetes
- Assurer le support aux utilisateurs et le traitement des incidents
- Gérer les ressources, quotas, priorités et jobs sur la plateforme
- Participer Ă la gestion des GPU NVIDIA, drivers, CUDA et MIG
- Mettre en place et maintenir lâautomatisation des opĂ©rations dâexploitation
- Assurer la supervision et le monitoring de la plateforme
- Participer au suivi des incidents matériels et aux échanges avec les mainteneurs
- Contribuer Ă lâĂ©volution et Ă lâoptimisation de lâinfrastructure IA
- RĂ©diger et maintenir la documentation et les procĂ©dures dâexploitation
Environnement technique
SystĂšmes : Linux Ubuntu
Orchestration : Kubernetes, Docker
GPU : NVIDIA, CUDA, MIG
Automatisation : Ansible, Bash, Python
Supervision : Prometheus, Grafana
Infrastructure : stockage haute performance, stockage objet, réseaux de clusters
Méthodes : ITIL / ITSM, gestion des incidents et des changements
Requirements
Profil recherchĂ©Formation Bac +5 (Ăcole dâIngĂ©nieur, Master ou Ă©quivalent) ExpĂ©rience confirmĂ©e en administration systĂšmes et infrastructures Bonne maĂźtrise de Linux et Kubernetes ExpĂ©rience sur des infrastructures GPU / IA Connaissance de NVIDIA, CUDA et idĂ©alement MIG Bonne maĂźtrise dâAnsible et/ou du scripting Bash / Python ExpĂ©rience en supervision et gestion des incidents Une connaissance des environnements de stockage et rĂ©seaux HPC/IA est apprĂ©ciĂ©e QualitĂ©s attendues :Esprit dâanalyse et capacitĂ© de diagnostic Autonomie et rigueur Sens du service et orientation utilisateur RĂ©activitĂ© face aux incidents Aisance dans les environnements techniques complexes Force de proposition, * Formation Bac +5 (Ăcole dâIngĂ©nieur, Master ou Ă©quivalent)
- Expérience confirmée en administration systÚmes et infrastructures
- Bonne maĂźtrise de Linux et Kubernetes
- Expérience sur des infrastructures GPU / IA
- Connaissance de NVIDIA, CUDA et idéalement MIG
- Bonne maĂźtrise dâAnsible et/ou du scripting Bash / Python
- Expérience en supervision et gestion des incidents
- Une connaissance des environnements de stockage et réseaux HPC/IA est appréciée
Qualités attendues :
- Esprit dâanalyse et capacitĂ© de diagnostic
- Autonomie et rigueur
- Sens du service et orientation utilisateur
- Réactivité face aux incidents
- Aisance dans les environnements techniques complexes
- Force de proposition
EUR
Ansible Administration systĂšme et rĂ©seau Cluster Prometheus Bash Force de proposition Intelligence artificielle Linux Grafana RĂ©activitĂ© Kubernetes Python Autonomie ITIL Docker Esprit dâanalyse
About the company
Alliance Services Plus (AS+) est un acteur de rĂ©fĂ©rence du calcul haute performance (HPC) en France depuis plus de 15 ans. Filiale du groupe GECI, AS+ sâest imposĂ©e comme le spĂ©cialiste reconnu, au coeur des environnements HPC les plus critiques. ImplantĂ©e entre autres sur le campus Teratec, lâentreprise intervient directement au sein des plus grands centres de calcul français, lĂ oĂč se jouent les enjeux technologiques de demain.
En forte croissance, AS+ opĂšre principalement au forfait avec une exigence Ă©levĂ©e de performance et de rĂ©sultats. Ses consultants interviennent directement au coeur des infrastructures et clusters HPC de ses clients, sur des missions Ă forte valeur ajoutĂ©e en infrastructure, dĂ©veloppement et support applicatif. Rejoindre AS+, câest contribuer Ă des projets stratĂ©giques pour des acteurs majeurs de la recherche, de lâĂ©nergie et de lâindustrie, tels que le CEA, le CNRS, TotalEnergies ou Michelin, âŠ
Mais AS+, câest avant tout un collectif dâexperts HPC animĂ© par une culture claire et assumĂ©e : âaller plus vite, aller plus loinâ. Plus vite dans la comprĂ©hension des enjeux, la prise en main des environnements et lâexĂ©cution. Plus loin dans lâexpertise, lâinnovation et la qualitĂ© des solutions apportĂ©es. Cette philosophie se traduit au quotidien par une forte exigence technique, un haut niveau dâautonomie et une responsabilitĂ© rĂ©elle confiĂ©e Ă chaque consultant.
IntĂ©grer AS+, câest rejoindre une entreprise qui valorise lâexcellence, le partage dâexpertise et la progression continue. Un environnement oĂč lâon est challengĂ©, soutenu et reconnu, et oĂč chacun construit une carriĂšre HPC solide, ambitieuse et durable., Alliance Services Plus (AS+) recherche un(e) IngĂ©nieur(e) Administration Cluster IA Senior pour accompagner lâun de ses clients dans lâadministration et le maintien en conditions opĂ©rationnelles dâune plateforme dĂ©diĂ©e Ă lâIntelligence Artificielle.
Notre client est un acteur public majeur dans les domaines de la sĂ»retĂ© nuclĂ©aire, de la recherche et de lâexpertise scientifique. Ses activitĂ©s sâappuient notamment sur des infrastructures de calcul intensif et des plateformes dĂ©diĂ©es aux usages IA., Alliance Services Plus (AS+) est un acteur de rĂ©fĂ©rence du calcul haute performance (HPC) en France depuis plus de 15 ans. Filiale du groupe GECI, AS+ sâest imposĂ©e comme le spĂ©cialiste reconnu, au coeur des environnements HPC les plus critiques. ImplantĂ©e entre autres sur le campus Teratec, lâentreprise intervient directement au sein des plus grands centres de calcul français, lĂ oĂč se jouent les enjeux technologiques de demain. En forte croissance, AS+ opĂšre principalement au forfait avec une exigence Ă©levĂ©e de performance et de rĂ©sultats. Ses consultants interviennent directement au coeur des infrastructures et clusters HPC de ses clients, sur des missions Ă forte valeur ajoutĂ©e en infrastructure, dĂ©veloppement et support applicatif. Rejoindre AS+, câest contribuer Ă des projets stratĂ©giques pour des acteurs majeurs de la recherche, de lâĂ©nergie et de lâindustrie, tels que le CEA, le CNRS, TotalEnergies ou Michelin, ⊠Mais AS+, câest avant tout un collectif dâexperts HPC animĂ© par une culture claire et assumĂ©e : âaller plus vite, aller plus loinâ. Plus vite dans la comprĂ©hension des enjeux, la prise en main des environnements et lâexĂ©cution. Plus loin dans lâexpertise, lâinnovation et la qualitĂ© des solutions apportĂ©es. Cette philosophie se traduit au quotidien par une forte exigence technique, un haut niveau dâautonomie et une responsabilitĂ© rĂ©elle confiĂ©e Ă chaque consultant. IntĂ©grer AS+, câest rejoindre une entreprise qui valorise lâexcellence, le partage dâexpertise et la progression continue. Un environnement oĂč lâon est challengĂ©, soutenu et reconnu, et oĂč chacun construit une carriĂšre HPC solide, ambitieuse et durable.
Apply for this position
This job is hosted externally. Click below to view the full posting and apply.
Prepare application
- Draft this with your agent
- Open in Claude
- Open in ChatGPT
Good distractions
Talks and stories from around this role â technically off-topic, practically not.
Moments
Explore playlistsVideos
See allRelated articles
See all
Best Companies to Work For in France: Top 25 Companies in 2023Â
Top-Paying Tech Jobs (with Salaries)
7 Cloud Computing Trends Coming in 2025 for Developers
The Most Popular IT Jobs on the Market