EXPERTISE TECHNIQUE IA (H/F)

ABTEKA
Toulouse, France
about 1 month ago

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Working hours
Regular working hours
Job source

Tech stack

Python (Programming Language) Log Analysis Open Source Technology Reinforcement Learning Pytorch Large Language Models Mitre Att&ck HuggingFace

Job description

Vos missionsVotre travail consistera à concevoir, adapter et évaluer des modèles de langage spécialisés en cybersécurité afin d?automatiser l?analyse des menaces, contextualiser les alertes de sécurité et assister les analystes SOC.

Fine-tuning de modèlesAdapter et spécialiser des modèles de langage open-source (Llama, Mistral, Qwen) sur des données de cybersécurité (logs, rapports CTI, playbooks).

Mettre en ?uvre des techniques de fine-tuning (PEFT) afin d?optimiser les performances des modèles sur des cas d?usage spécifiques.

Alignement et limitation des hallucinationsMettre en place des techniques d?alignement pour garantir des réponses précises, sécurisées et sans hallucinations.

Utiliser des approches d?apprentissage par renforcement telles que DPO (Direct Preference Optimization), GRPO (Group Relative Policy Optimization) et PPO (Proximal Policy Optimization).

Travailler avec des frameworks d?alignement tels que TRL, verl ou OpenRLHF.

Formatage et structuration des donnéesDéfinir et structurer les jeux de données d?entraînement en utilisant des formats de conversation tels que ChatML et Alpaca.

Préparer et normaliser les données issues des environnements SOC (logs, rapports, playbooks) pour l?entraînement des modèles.

Évaluation et benchmarkingMettre en place des pipelines d?évaluation des modèles afin de mesurer leurs performances sur des cas d?usage cybersécurité.

Utiliser des benchmarks standards tels que MMLU et GSM8K.

Concevoir des méthodologies de comparaison et d?évaluation interne de type Evaluation Arena et LLM-as-a-judge.

Requirements

Expertise techniqueMaîtrise des techniques de fine-tuning de modèles de langage (PEFT), notamment LoRA et QLoRA.

Expérience avec des frameworks de fine-tuning tels que Unsloth, Axolotl ou TRL.

Bonne connaissance des modèles de langage open-source (Llama, Mistral, Qwen).

Maîtrise des approches d?alignement et de reinforcement learning appliquées aux LLM (DPO, GRPO, PPO).

Capacité à structurer des datasets d?entraînement avec ChatML et Alpaca.

Connaissance des méthodes d?évaluation et de benchmarking (MMLU, GSM8K, LLM-as-a-judge).

Compétences appréciéesSensibilité aux problématiques de cybersécurité en environnement SOC (analyse de logs, détection d?intrusions, MITRE ATT&CK).

Connaissance des outils de déploiement et d?inférence de modèles (Hugging Face Hub, vLLM, Ollama, Triton).

Excellente maîtrise de Python et de PyTorch.

Soft skillsRigueur scientifique et exigence sur la qualité des données et des évaluations.

Capacité à travailler de manière autonome dans un environnement R&D.

Capacité à vulgariser des concepts techniques avancés auprès d?équipes SOC et cybersécurité.

Esprit d?analyse et de synthèse.

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on fr.indeed.com

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

11:18 min

Addressing audience questions on security and microservice architectures

Reinhard Kugler · LIVE

2:35 min

Preventing remote code execution in PyTorch models

Balázs Kiss · World Congress 2023

2:37 min

Optimizing technical profiles for AI sourcing and recruitment

Mina Golesorkhi Mina Golesorkhi · World Congress 2026 Europe

3:48 min

Leveraging multi-agent systems for autonomous software testing

Ondřej Gróf Ondřej Gróf · World Congress 2026 Europe

1:06 min

Compiling PyTorch environments for advanced time forecasting

Christoph Lohrmann Christoph Lohrmann +1 · World Congress 2026 Europe

3:13 min

Leveraging domain knowledge and diverse team backgrounds

Katja Träumner

Videos

See all

Related articles

See all