Expert(e) IA / Data Scientist - Sécurisation SOC via LLM

HEXAGONE GROUPE
Canton of Toulouse-5, France
14 days ago

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Working hours
Regular working hours
Languages
French
Experience level
Senior

Job location

Canton of Toulouse-5, France

Tech stack

Open Source Technology
Reinforcement Learning
Large Language Models

Job description

Le client intègre des technologies d'Intelligence Artificielle Générative au sein de son SOC afin d'automatiser l'analyse de menaces, de contextualiser les alertes de sécurité et d'assister les analystes.

L'objectif est de concevoir des modèles de langage (LLM/SLM) souverains et ultra-spécialisés en cybersécurité. Le/la consultant(e) travaillera en collaboration directe avec l'équipe R&D Cyber et l'équipe SOC, dans un environnement de recherche et développement agile.

Rôle et responsabilités principales

Fine-tuning de LLM open-source (Llama, Mistral, Qwen?) sur des données de cybersécurité (logs, rapports CTI, playbooks)

Mise en ?uvre de techniques d'apprentissage par renforcement pour limiter les hallucinations et sécuriser les réponses générées

Définition et application des formats de prompt et de conversation pour l'entraînement des modèles ? Structuration et formatage des datasets d'entraînement textuels

Mise en place de pipelines d'évaluation et de benchmarking pour mesurer la performance des modèles "Cyber" face aux standards du marché

Vulgarisation des concepts IA auprès de profils cybersécurité (analystes SOC, RSSI)

Collaboration directe avec l'équipe R&D Cyber et l'équipe SOC

Livrables attendus

Modèles LLM/SLM fine-tunés et spécialisés en cybersécurité

Datasets d'entraînement structurés et formatés (ChatML, Alpaca)

Pipelines d'évaluation et de benchmarking (interne et standards du marché)

Rapports de performance comparative des modèles

Requirements

Profil sénior (6 à 9 ans d'expérience), positionné auprès des Métiers, capable d'exploiter, analyser et évaluer des données structurées ou non pour établir des scénarios anticipant les leviers Métiers ou opérationnels. Autonomie attendue dans un environnement R&D agile.

Rigueur scientifique sur la qualité des données et la reproductibilité des benchmarks. Bonne capacité de communication et de vulgarisation auprès d'interlocuteurs non-IA.

Apply for this position