Cloud - Nre Network Reliability Engineering H/F

Cnd
Le Kremlin-Bicêtre, France
3 days ago
Apply on www.hellowork.com
Prepare application

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience level
Expert
Experience required
5 years minimum
Working hours
Regular working hours

Tech stack

Border Gateway Protocol Cloud Computing Domain Name System (DNS) Python (Programming Language) Network Security Network Architecture Open Shortest Path First (OSPF) Reliability Engineering Service Discovery Load Balancing

Job description

Déployer et opérer le réseau datacenter (dont fabric programmable) propre à l’infrastructure cloud : architecture ToR/Spine, orchestration, automatisation ;

  • Implémenter et opérer de manière soutenable les mécanismes de sécurité réseau sous l’angle disponibilité et fiabilité : segmentation (VRF, isolation des tenants au niveau routage), filtrage (firewalls périphériques, etc.) ;
  • Mettre en oeuvre et maintenir les services réseau : routage BGP, load balancing (L4/L7), ingress, DNS interne, service discovery ;
  • Déployer et exploiter l’architecture réseau des clusters : CNI, overlay, network policies, segmentation ;
  • Contribuer à la stack d’observabilité réseau (e.g., latence, packet loss) ainsi qu’aux mécanismes de mesure associés ;
  • Participer au pilotage de l’exploitation par les SLO réseau, les error budgets et les RETEX ;
  • Participer à la gestion de crise (niveau N3/N4) et aux astreintes ;
  • Rédiger les procédures d’exploitation et la documentation technique.

Requirements

Nous cherchons un ingénieur réseau confirmé (5 à 10 ans d’expérience en production), capable d’implémenter et d’opérer les composantes réseau d’une plateforme critique à l’échelle nationale, avec une approche SRE.Vous possédez de l’expérience professionnelle :- Exploitation de réseau en datacenter : routage (BGP, OSPF), architecture ToR/Spine, VRF, segmentation, firewalling, load balancing L4/L7 ; - Participation à des projets d’orchestration et d’automatisation de fabric réseau ; - Pratique de l’observabilité réseau en production ; - Première expérience de la culture SRE (pilotage par SLO/SLI, automatisation, observabilité réseau, RETEX et amélioration continue).Vous disposez également des compétences techniques suivantes :- Bonne maîtrise de l’architecture réseau des clusters (conteneurs ou VM) : CNI, overlay, network policies, segmentation ; - Expérience d’une stack d’observabilité réseau et des outils/méthodes de métrologie réseau ; - Notions de programmation (Go ou Python) : capacité à lire, adapter ou écrire des routines d’orchestration ; - Très bonne connaissance des questions de sécurité, capacité à dialoguer avec une chaîne SSI.Vous êtes :- Vous ne fermez pas un ticket, vous fermez un incident - la distinction entre “c’est déployé” et “ça fonctionne en production” est non négociable pour vous ;- À l’aise dans un environnement en construction : les runbooks n’existent pas encore, les processus se forgent en marchant. Vous documentez ce que vous faites, vous remontez ce qui bloque, vous contribuez à structurer ce qui manque ;- Ancré dans une culture d’analyse factuelle et d’amélioration continue., Nous cherchons un ingénieur réseau confirmé (5 à 10 ans d’expérience en production), capable d’implémenter et d’opérer les composantes réseau d’une plateforme critique à l’échelle nationale, avec une approche SRE. Vous possédez de l’expérience professionnelle :

  • Exploitation de réseau en datacenter : routage (BGP, OSPF), architecture ToR/Spine, VRF, segmentation, firewalling, load balancing L4/L7 ;
  • Participation à des projets d’orchestration et d’automatisation de fabric réseau ;
  • Pratique de l’observabilité réseau en production ;
  • Première expérience de la culture SRE (pilotage par SLO/SLI, automatisation, observabilité réseau, RETEX et amélioration continue).

Vous disposez également des compétences techniques suivantes :

  • Bonne maîtrise de l’architecture réseau des clusters (conteneurs ou VM) : CNI, overlay, network policies, segmentation ;
  • Expérience d’une stack d’observabilité réseau et des outils/méthodes de métrologie réseau ;
  • Notions de programmation (Go ou Python) : capacité à lire, adapter ou écrire des routines d’orchestration ;
  • Très bonne connaissance des questions de sécurité, capacité à dialoguer avec une chaîne SSI. Vous êtes :

  • Vous ne fermez pas un ticket, vous fermez un incident - la distinction entre “c’est déployé” et “ça fonctionne en production” est non négociable pour vous ;
  • À l’aise dans un environnement en construction : les runbooks n’existent pas encore, les processus se forgent en marchant. Vous documentez ce que vous faites, vous remontez ce qui bloque, vous contribuez à structurer ce qui manque ;
  • Ancré dans une culture d’analyse factuelle et d’amélioration continue.

EUR

Routage SSI Gestion de crise Python OSPF Amélioration continue Pare-feu Programmation Isolation

About the company

Notre opérateur ambitionne de devenir un acteur clé du Cloud ministériel, avec pour objectif de construire une pile cloud sûre, performante et résiliente, opérée sur l’ensemble du territoire national. À terme, cette infrastructure constituera la fondation d’un véritable opérateur cloud ministériel à l’état de l’art, capable de servir l’ensemble du numérique de défense.

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on www.hellowork.com
Prepare application

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

3:52 min

Comparing French work-life balance principles with international engineering practices

Chris Heilmann +2 · LIVE

5:25 min

Implementing redundancy, failover, and architectural load balancing patterns

Mihaela-Roxana Ghidersa · LIVE

2:27 min

Introduction to WebAssembly in a cloud computing context

Edo Edo · World Congress 2024

1:16 min

Securing internal pod communication with network security policies

Marc Nimmerrichter · World Congress 2022

3:18 min

Scaling global network engineering through DevOps culture

Stuart Clark · LIVE

12:17 min

Managing edge cases and load balancing SSE

Rainer Stropek Rainer Stropek · LIVE

Videos

See all

Related articles

See all