·e Architecte réseau

Dassault Systèmes
Inconnu, France
1 day ago
Apply on talentacquisition.3ds.com
Prepare application

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience required
1 year minimum
Working hours
Regular working hours
Languages
English

Tech stack

Artificial Intelligence Border Gateway Protocol Linux Ethernet Infrastructure as a Service (IaaS) InfiniBand Python (Programming Language) Ansible Prometheus TCP/IP Pytorch Large Language Models
+5 more
Grafana Git Usage Tracking Kubernetes Fortinet

Job description

Rattaché(e) au responsable de l’AI Factory, vous serez en charge de :

Pilotage opérationnel de la plateforme : suivi quotidien du run(disponibilité, incidents, changements, capacité GPU), animation des rituels d’exploitation, arbitrage des priorités entre équipes utilisatrices, suivi des SLO et des indicateurs de service, escalade et coordination lors des incidents majeurs.

Animation et encadrement de l’équipe : coordination d’une équipe pluridisciplinaire (réseau, DevOps, infrastructure, sécurité), organisation du travail et des astreintes, suivi des objectifs individuels, participation aux recrutements et à l’intégration des nouveaux arrivants, développement des compétences.

Feuille de route et gestion de projets : déclinaison de la stratégie de la plateforme en plans d’action, suivi des chantiers structurants (extension du parc, industrialisation des services, intégration AI Factory / IaaS), planification, suivi des jalons, des risques et des dépendances, reporting régulier au responsable et à la direction.

Relation avec les équipes utilisatrices et partenaires : point d’entrée des équipes produits et data science pour la prise en compte de leurs besoins, cadrage des demandes, communication sur les évolutions et les incidents ;

coordination avec les équipes infrastructure, sécurité et réseau du groupe et avec les fournisseurs (NVIDIA, constructeurs, intégrateurs).

Gouvernance, capacité et budget : suivi de l’utilisation et de l’allocation des ressources GPU, prévisions de capacité, contribution à la préparation et au suivi du budget (matériel, licences, maintenance), suivi des contrats et des supports constructeurs.

Processus et qualité : formalisation et amélioration continue des processus d’exploitation (gestion des incidents, des changements, des demandes), pilotage des post-mortems et du suivi des actions correctives, contribution aux exigences de conformité et de sécurité de la plateforme.

Suppléance du responsable : représentation de l’AI Factory dans les instances internes et auprès des partenaires, prise de décision opérationnelle et continuité du pilotage en l’absence du responsable.

Stack technique

  • Matériel : racks NVIDIA GB200/300 NVL72, fabric haute performance, stockage
  • partagé, périphérie réseau sécurisée
  • Plateforme : Kubernetes, NVIDIA GPU Operator, ordonnanceur GPU, serveurs d’inférence LLM, frameworks d’entraînement (PyTorch)
  • Outillage : GitOps et Infrastructure as Code, Prometheus/Grafana, outils de ticketing et de gestion de projet, Git
  • Pratiques : gestion d’incidents et de changements, post-mortems, suivi de capacité, gestion de projet, astreinte possible selon organisation de l’équipe

Requirements

  • Diplômé(e) d’une école d’ingénieurs ou équivalent, vous possédez une expérience professionelle post diplôme minimum de 1 an en ingénierie réseau datacenter ou en exploitation d’infrastructures de production à fort enjeu.
  • Vous êtes expert en réseaux TCP/IP et en troubleshooting de niveau 3 : vous savez instrumenter, mesurer, isoler et résoudre un problème de performance complexe.
  • Vous maitirisez les architectures de datacenter modernes : routage BGP, fabrics leaf-spine, et en particulier EVPN-VXLAN => c’est la compétence structurante du poste, qui vous permettra de porter le chantier d’intégration AI Factory / IaaS.
  • Vous maitrisez l’automatisation (Python, Ansible) et appréciez de travailler dans un environnement Linux.
  • Idéalement, vous avez déjà une expérience dans les fabrics haute performance (InfiniBand, RoCE, Ethernet 400G) ou des environnements HPC/GPU; A défaut, une solide expérience datacenter et une envie réelle et sérieuse de monter sur ces technologies.
  • Une expérience opérationnelle des Fortinet (FortiGate, NSE4+) est un plus, pas un prérequis.
  • Anglais courant à l’écrit (documentation constructeur, support NVIDIA/Fortinet).

Benefits & conditions

Environnement multiculturel

Cadre de travail convivial axé sur le bien-être et la santé

Engagement en faveur de la diversité et de l’inclusion

Politique dynamique de développement de carrière : plan de formation, mobilités internes, etc.

Déclaration de diversité

About the company

Nous recrutons un·e Architecte réseau afin de renforcer notre équipe AI Factory.

OUTSCALE, marque de Dassault Systèmes, est un opérateur souverain et durable de l’Expérience en tant que Service qui offre à ses clients des environnements technologiques de confiance.

Nous offrons des expériences uniques grâce au savoir-faire de nos équipes passionnées, qui se reflète notamment par la création de solutions de Business Expériences, le développement de notre propre orchestrateur Cloud, TINA OS, ou encore l’obtention de la qualification SecNumCloud.

L’AI Factory de Dassault Systèmes conçoit et opère la plateforme d’intelligence artificielle du groupe, de l’infrastructure matérielle jusqu’aux services PaaS exposés aux équipes produits. Notre salle héberge des racks NVIDIA GB200/300 NVL72, avec une périphérie réseau sécurisée par des firewalls Fortinet. À cette échelle, la performance des workloads IA (entraînement et inférence LLM) dépend directement de la qualité du réseau : débits est-ouest entre nœuds GPU, latence, dimensionnement de la périphérie de sécurité., * Intégrer une entreprise scientifique au cœur de l’innovation technologique, portée par une forte croissance depuis plus de 40 ans

  • Vous souhaitez en savoir plus ? N’hésitez pas à nous suivre sur Linkedin et découvrez nos dernières offres et actus., Dassault Systèmes, avant-gardiste en matière de technologie et d’innovation durable, s’efforce de créer des équipes toujours plus inclusives et diverses à travers le monde. Nous avons la forte conviction que nos employés sont notre atout numéro 1 et nous voulons que tous, se sentent libres d’être pleinement qui ils sont vraiment. Notre objectif est qu’ils ressentent fierté et sentiment d’appartenance. En tant qu’entreprise à la pointe du changement, il nous incombe de favoriser l’inclusion de tous et participer à création du monde de demain.

Inclusion statement

As a game-changer in sustainable technology and innovation, Dassault Systèmes is striving to build more inclusive and diverse teams across the globe. We believe that our people are our number one asset and we want all employees to feel empowered to bring their whole selves to work every day. It is our goal that our people feel a sense of pride and a passion for belonging. As a company leading change, it’s our responsibility to foster opportunities for all people to participate in a harmonized Workforce of the Future. Apply

OUTSCALE offers virtual twins of organizations and trusted cloud environments that make innovation easier and grow competitiveness in a sustainable way.

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on talentacquisition.3ds.com
Prepare application

Good distractions

Loading talks and stories from around this role…