Cloud - Sre - Compute - Specialisation Workload IA H/F

Cnd
Le Kremlin-Bicêtre, France
2 days ago
Apply on www.hellowork.com
Prepare application

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience level
Expert
Experience required
5 years minimum
Working hours
Regular working hours

Tech stack

Cloud Computing Open Source Technology Role-Based Access Control Kubernetes Bare Metal

Job description

Vous intégrerez une équipe d’experts encadrée par un Lead SRE Compute. Votre périmètre est la couche d’orchestration dans son intégralité : vous êtes propriétaire des clusters Kubernetes en production, de leur cycle de vie jusqu’aux workloads qui s’y exécutent. Vous vous concentrez sur l’orchestration et les workloads ; la couche hyperviseur bare-metal est portée par une équipe dédiée. Missions :

  • Cycle de vie des clusters : déploiement, mise à jour, passage à l’échelle et récupération après incident via outils déclaratifs ;
  • KubeVirt : exploitation et administration des VMs orchestrées via Kubernetes - provisionnement, cycle de vie, résilience, migration live ;
  • Scheduling avancé : affinités, optimisation du bin-packing et de la densité ;
  • GPU & accélérateurs pour l’inférence : déploiement, configuration et optimisation ;
  • Réseau & stockage : exploitation CNI (Cilium ou équivalent), politiques réseaux, volumes persistants ;
  • Isolation & sécurité : RBAC, OPA/Kyverno, isolation système et réseau, gestion des secrets (Vault ou équivalent).

Requirements

Nous cherchons un ingénieur Kubernetes (5-10 ans d’expérience en production, dont une partie significative sur Kubernetes), capable de concevoir et d’opérer une plateforme multi-tenant critique à grande échelle, avec une appétence pour les workloads spécialisés (VMs via KubeVirt, GPU) et une sensibilité sécurité prononcée.Vous possédez de l’expérience professionnelle :- Exploitation en production de clusters Kubernetes multi-tenants à grande échelle, en mode SRE : gestion d’incidents, astreintes, pilotage par SLO/SLI ;- Maîtrise du cycle de vie des clusters : upgrade, scaling, gestion des noeuds, récupération après incident ;- Expérience du scheduling avancé : politiques d’affinité, gestion de ressources hétérogènes, optimisation de la densité ;- Pratique de GitOps en production (Flux ou ArgoCD) ;- Culture SRE : automatisation, observabilité, RETEX et amélioration continue.Vous êtes :- Rigoureux : Capacité à concevoir et maintenir des infrastructures critiques avec une attention méticuleuse aux détails, particulièrement dans les aspects de sécurité et de reproductibilité.- Innovant : Capacité à proposer des solutions techniques avancées et à implémenter des bonnes pratiques- Ancré dans une culture d’analyse factuelle et d’amélioration continue ;Atouts appréciés :- Expérience d’environnements multi-sites / multi-régions ;- Expérience avec des environnements air-gapped ;- Connaissance de SecNumCloud et IGI 1300 ;- Contributions open source., Nous cherchons un ingénieur Kubernetes (5-10 ans d’expérience en production, dont une partie significative sur Kubernetes), capable de concevoir et d’opérer une plateforme multi-tenant critique à grande échelle, avec une appétence pour les workloads spécialisés (VMs via KubeVirt, GPU) et une sensibilité sécurité prononcée. Vous possédez de l’expérience professionnelle :

  • Exploitation en production de clusters Kubernetes multi-tenants à grande échelle, en mode SRE : gestion d’incidents, astreintes, pilotage par SLO/SLI ;
  • Maîtrise du cycle de vie des clusters : upgrade, scaling, gestion des noeuds, récupération après incident ;
  • Expérience du scheduling avancé : politiques d’affinité, gestion de ressources hétérogènes, optimisation de la densité ;
  • Pratique de GitOps en production (Flux ou ArgoCD) ;
  • Culture SRE : automatisation, observabilité, RETEX et amélioration continue. Vous êtes :

  • Rigoureux : Capacité à concevoir et maintenir des infrastructures critiques avec une attention méticuleuse aux détails, particulièrement dans les aspects de sécurité et de reproductibilité.
  • Innovant : Capacité à proposer des solutions techniques avancées et à implémenter des bonnes pratiques
  • Ancré dans une culture d’analyse factuelle et d’amélioration continue ;

Atouts appréciés :

  • Expérience d’environnements multi-sites / multi-régions ;
  • Expérience avec des environnements air-gapped ;
  • Connaissance de SecNumCloud et IGI 1300 ;
  • Contributions open source., Cluster Kubernetes Rigueur et méthode

About the company

Notre opérateur ambitionne de devenir un acteur clé du Cloud ministériel, avec pour objectif de construire une pile cloud sûre, performante et résiliente, opérée sur l’ensemble du territoire national. À terme, cette infrastructure constituera la fondation d’un véritable opérateur cloud ministériel à l’état de l’art, capable de servir l’ensemble du numérique de défense.

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on www.hellowork.com
Prepare application

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

2:28 min

Understanding Kubernetes architecture and core cluster components

Marc Nimmerrichter · World Congress 2022

1:11 min

Running high-performance edge computing on bare metal servers

Josip Stuhli Josip Stuhli · Coffee With Developers

2:27 min

Introduction to WebAssembly in a cloud computing context

Edo Edo · World Congress 2024

4:36 min

Hiring passionate software engineers to tackle unprecedented scaling challenges

Dana Lawson Dana Lawson +1 · World Congress 2026 Europe

4:24 min

Evaluating bare metal versus cloud computing costs

Jens Happe Jens Happe · LIVE

4:04 min

Overview of Kubernetes operators and custom resource definitions

Philipp Krenn · World Congress 2022

Videos

See all

Related articles

See all