Ingénieur IA - Machine Learning et Deep Learning pour la cyber (H/F)

FANTOM DETECTIVE
Poissy, France
5 days ago
Apply on candidat.francetravail.fr
Prepare application

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience level
Experienced
Experience required
3 years minimum
Compensation
€35,000.0 - €40,000.0
Working hours
Regular working hours
Languages
English, French

Tech stack

Python (Programming Language) Machine Learning Tensorflow SQL Databases Pytorch Large Language Models Deep Learning Splunk

Job description

Cimvex est un système de cybersécurité en cours de développement. Il vise à exploiter les logs, les configurations et les données des outils de sécurité pour détecter les attaques informatiques, identifier les vulnérabilités et proposer des remédiations adaptées au contexte de chaque entreprise. Votre responsabilité sera de construire les modèles et les traitements qui permettent de tirer des informations fiables de ces données. Vous collaborerez avec le fondateur, expert Splunk et SOC, et avec un ingénieur chargé des LLM et des agents intelligents. CE QUE VOUS PRENDREZ EN CHARGE Vous commencerez par explorer les données disponibles : événements de sécurité, inventaires, configurations et résultats de scanners de vulnérabilités. Vous développerez les traitements nécessaires à leur nettoyage, leur normalisation et leur exploitation. Cela comprend la reconnaissance des formats, le rapprochement des champs, le contrôle des horodatages et l’identification des informations manquantes. Vous constituerez également les jeux de données d’entraînement et de test, avec une attention particulière à la qualité des annotations et à leur représentativité. Développer les modèles de détection Vous sélectionnerez, entraînerez et évaluerez des modèles de classification, de regroupement et de détection d’anomalies. Selon les besoins, vous utiliserez des méthodes statistiques, des algorithmes de machine learning ou des réseaux de neurones adaptés aux données textuelles et séquentielles. Vous étudierez notamment les enchaînements d’événements afin d’identifier des comportements suspects et des scénarios d’attaque. Chaque approche sera comparée à une méthode de référence pour vérifier son apport réel. Contextualiser les vulnérabilités et les risques Vous développerez les rapprochements entre les actifs, leurs versions logicielles, leurs configurations et les vulnérabilités connues. L’objectif sera de faire ressortir les expositions pertinentes, tout en signalant les cas nécessitant une vérification complémentaire. Vous contribuerez au classement des risques en tenant compte de la criticité des systèmes, de leur exposition et des indices d’exploitation disponibles. Ces résultats alimenteront les recommandations de remédiation proposées par Cimvex. Mesurer la fiabilité des résultats Vous définirez les protocoles d’évaluation et analyserez les erreurs : faux positifs, attaques non détectées, biais des jeux de données et difficultés de généralisation. Vous devrez savoir traiter les classes déséquilibrées, éviter les fuites de données entre entraînement et test, calibrer les scores et définir les situations où un modèle doit signaler son incertitude. Les performances attendues devront être évaluées dans des conditions proches de l’utilisation réelle. Intégrer les modèles au produit Vous développerez des traitements reproductibles et des services d’inférence utilisables par les autres composants de Cimvex. Vous assurerez le versionnement des données et des modèles, la documentation et le suivi des performances après déploiement. Vous participerez également à l’optimisation des temps de traitement et des ressources nécessaires à l’analyse de volumes importants. LE BAGAGE TECHNIQUE ATTENDU Nous recherchons une personne capable de développer et d’évaluer des modèles de manière autonome, avec : - Une très bonne maîtrise de Python, SQL et des bibliothèques de traitement de données. - Une pratique solide du machine learning supervisé et non supervisé. - Une expérience concrète de l’entraînement et de l’adaptation de réseaux de neurones avec PyTorch ou TensorFlow. - Une compréhension des mécanismes d’apprentissage : fonctions de perte, rétropropagation, optimisation, régularisation et généralisation. - Une connaissance des Transformers, des embeddings et de l’analyse de séquences.

Requirements

  • Bac+5 et plus ou équivalents Cette formation est indispensable, * Connaissance approfondie en mathématiquesCette compétence est indispensable
  • Développement de produits basés sur l’IACette compétence est indispensable
  • Développer des algorithmes pour l’analyse de donnéesCette compétence est indispensable
  • Développer des modèles prédictifs pour l’analyse de donnéesCette compétence est indispensable
  • Optimiser les performances des systèmes d’IACette compétence est indispensable

Langues

  • Anglais
  • Français

Savoir-être professionnels

  • Faire preuve de leadership
  • Faire preuve de curiosité, d’ouverture d’esprit
  • Etre force de proposition

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on candidat.francetravail.fr
Prepare application

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

3:14 min

Structuring career paths and localized data architectures

Ulrich Wurstbauer +1 · LIVE

1:39 min

Fundamentals of tensors and the TensorFlow library

Håkan Silfvernagel · LIVE

2:38 min

Establishing comprehensive monitoring and log management

Michael Eder +1 · LIVE

2:35 min

Preventing remote code execution in PyTorch models

Balázs Kiss · World Congress 2023

3:55 min

Evaluating central server APIs against edge deployment models

Hauke Brammer · World Congress 2021

3:10 min

Correlating dispersed logs using structured request tracing

Michael Eder +1 · LIVE

Videos

See all

Related articles

See all