·e Architecte réseau
- Discuss this with your agent
- Open in Claude
- Open in ChatGPT
Prepare application
- Draft this with your agent
- Open in Claude
- Open in ChatGPT
Role details
Tech stack
+5 more
Job description
Rattaché(e) au responsable de l’AI Factory, vous serez en charge de :
Pilotage opérationnel de la plateforme : suivi quotidien du run(disponibilité, incidents, changements, capacité GPU), animation des rituels d’exploitation, arbitrage des priorités entre équipes utilisatrices, suivi des SLO et des indicateurs de service, escalade et coordination lors des incidents majeurs.
Animation et encadrement de l’équipe : coordination d’une équipe pluridisciplinaire (réseau, DevOps, infrastructure, sécurité), organisation du travail et des astreintes, suivi des objectifs individuels, participation aux recrutements et à l’intégration des nouveaux arrivants, développement des compétences.
Feuille de route et gestion de projets : déclinaison de la stratégie de la plateforme en plans d’action, suivi des chantiers structurants (extension du parc, industrialisation des services, intégration AI Factory / IaaS), planification, suivi des jalons, des risques et des dépendances, reporting régulier au responsable et à la direction.
Relation avec les équipes utilisatrices et partenaires : point d’entrée des équipes produits et data science pour la prise en compte de leurs besoins, cadrage des demandes, communication sur les évolutions et les incidents ;
coordination avec les équipes infrastructure, sécurité et réseau du groupe et avec les fournisseurs (NVIDIA, constructeurs, intégrateurs).
Gouvernance, capacité et budget : suivi de l’utilisation et de l’allocation des ressources GPU, prévisions de capacité, contribution à la préparation et au suivi du budget (matériel, licences, maintenance), suivi des contrats et des supports constructeurs.
Processus et qualité : formalisation et amélioration continue des processus d’exploitation (gestion des incidents, des changements, des demandes), pilotage des post-mortems et du suivi des actions correctives, contribution aux exigences de conformité et de sécurité de la plateforme.
Suppléance du responsable : représentation de l’AI Factory dans les instances internes et auprès des partenaires, prise de décision opérationnelle et continuité du pilotage en l’absence du responsable.
Stack technique
- Matériel : racks NVIDIA GB200/300 NVL72, fabric haute performance, stockage
- partagé, périphérie réseau sécurisée
- Plateforme : Kubernetes, NVIDIA GPU Operator, ordonnanceur GPU, serveurs d’inférence LLM, frameworks d’entraînement (PyTorch)
- Outillage : GitOps et Infrastructure as Code, Prometheus/Grafana, outils de ticketing et de gestion de projet, Git
- Pratiques : gestion d’incidents et de changements, post-mortems, suivi de capacité, gestion de projet, astreinte possible selon organisation de l’équipe
Requirements
- Diplômé(e) d’une école d’ingénieurs ou équivalent, vous possédez une expérience professionelle post diplôme minimum de 1 an en ingénierie réseau datacenter ou en exploitation d’infrastructures de production à fort enjeu.
- Vous êtes expert en réseaux TCP/IP et en troubleshooting de niveau 3 : vous savez instrumenter, mesurer, isoler et résoudre un problème de performance complexe.
- Vous maitirisez les architectures de datacenter modernes : routage BGP, fabrics leaf-spine, et en particulier EVPN-VXLAN => c’est la compétence structurante du poste, qui vous permettra de porter le chantier d’intégration AI Factory / IaaS.
- Vous maitrisez l’automatisation (Python, Ansible) et appréciez de travailler dans un environnement Linux.
- Idéalement, vous avez déjà une expérience dans les fabrics haute performance (InfiniBand, RoCE, Ethernet 400G) ou des environnements HPC/GPU; A défaut, une solide expérience datacenter et une envie réelle et sérieuse de monter sur ces technologies.
- Une expérience opérationnelle des Fortinet (FortiGate, NSE4+) est un plus, pas un prérequis.
- Anglais courant à l’écrit (documentation constructeur, support NVIDIA/Fortinet).
Benefits & conditions
Environnement multiculturel
Cadre de travail convivial axé sur le bien-être et la santé
Engagement en faveur de la diversité et de l’inclusion
Politique dynamique de développement de carrière : plan de formation, mobilités internes, etc.
Déclaration de diversité
About the company
Nous recrutons un·e Architecte réseau afin de renforcer notre équipe AI Factory.
OUTSCALE, marque de Dassault Systèmes, est un opérateur souverain et durable de l’Expérience en tant que Service qui offre à ses clients des environnements technologiques de confiance.
Nous offrons des expériences uniques grâce au savoir-faire de nos équipes passionnées, qui se reflète notamment par la création de solutions de Business Expériences, le développement de notre propre orchestrateur Cloud, TINA OS, ou encore l’obtention de la qualification SecNumCloud.
L’AI Factory de Dassault Systèmes conçoit et opère la plateforme d’intelligence artificielle du groupe, de l’infrastructure matérielle jusqu’aux services PaaS exposés aux équipes produits. Notre salle héberge des racks NVIDIA GB200/300 NVL72, avec une périphérie réseau sécurisée par des firewalls Fortinet. À cette échelle, la performance des workloads IA (entraînement et inférence LLM) dépend directement de la qualité du réseau : débits est-ouest entre nœuds GPU, latence, dimensionnement de la périphérie de sécurité., * Intégrer une entreprise scientifique au cœur de l’innovation technologique, portée par une forte croissance depuis plus de 40 ans
- Vous souhaitez en savoir plus ? N’hésitez pas à nous suivre sur Linkedin et découvrez nos dernières offres et actus., Dassault Systèmes, avant-gardiste en matière de technologie et d’innovation durable, s’efforce de créer des équipes toujours plus inclusives et diverses à travers le monde. Nous avons la forte conviction que nos employés sont notre atout numéro 1 et nous voulons que tous, se sentent libres d’être pleinement qui ils sont vraiment. Notre objectif est qu’ils ressentent fierté et sentiment d’appartenance. En tant qu’entreprise à la pointe du changement, il nous incombe de favoriser l’inclusion de tous et participer à création du monde de demain.
Inclusion statement
As a game-changer in sustainable technology and innovation, Dassault Systèmes is striving to build more inclusive and diverse teams across the globe. We believe that our people are our number one asset and we want all employees to feel empowered to bring their whole selves to work every day. It is our goal that our people feel a sense of pride and a passion for belonging. As a company leading change, it’s our responsibility to foster opportunities for all people to participate in a harmonized Workforce of the Future. Apply
OUTSCALE offers virtual twins of organizations and trusted cloud environments that make innovation easier and grow competitiveness in a sustainable way.
Apply for this position
This job is hosted externally. Click below to view the full posting and apply.
Prepare application
- Draft this with your agent
- Open in Claude
- Open in ChatGPT
Good distractions
Loading talks and stories from around this role…