Expert(e) IA / Data Scientist - Sécurisation SOC via LLM
Role details
Job location
Tech stack
Job description
Le client intègre des technologies d'Intelligence Artificielle Générative au sein de son SOC afin d'automatiser l'analyse de menaces, de contextualiser les alertes de sécurité et d'assister les analystes.
L'objectif est de concevoir des modèles de langage (LLM/SLM) souverains et ultra-spécialisés en cybersécurité. Le/la consultant(e) travaillera en collaboration directe avec l'équipe R&D Cyber et l'équipe SOC, dans un environnement de recherche et développement agile.
Rôle et responsabilités principales
Fine-tuning de LLM open-source (Llama, Mistral, Qwen?) sur des données de cybersécurité (logs, rapports CTI, playbooks)
Mise en ?uvre de techniques d'apprentissage par renforcement pour limiter les hallucinations et sécuriser les réponses générées
Définition et application des formats de prompt et de conversation pour l'entraînement des modèles ? Structuration et formatage des datasets d'entraînement textuels
Mise en place de pipelines d'évaluation et de benchmarking pour mesurer la performance des modèles "Cyber" face aux standards du marché
Vulgarisation des concepts IA auprès de profils cybersécurité (analystes SOC, RSSI)
Collaboration directe avec l'équipe R&D Cyber et l'équipe SOC
Livrables attendus
Modèles LLM/SLM fine-tunés et spécialisés en cybersécurité
Datasets d'entraînement structurés et formatés (ChatML, Alpaca)
Pipelines d'évaluation et de benchmarking (interne et standards du marché)
Rapports de performance comparative des modèles
Requirements
Profil sénior (6 à 9 ans d'expérience), positionné auprès des Métiers, capable d'exploiter, analyser et évaluer des données structurées ou non pour établir des scénarios anticipant les leviers Métiers ou opérationnels. Autonomie attendue dans un environnement R&D agile.
Rigueur scientifique sur la qualité des données et la reproductibilité des benchmarks. Bonne capacité de communication et de vulgarisation auprès d'interlocuteurs non-IA.