Expert IA / LLM – Fine-Tuning & Alignement SOC – Toulouse (IT) / Freelance
BIFORA · Toulouse, FR
Job description
Nous recherchons pour le compte de notre client dans le domaine de la cybersécurité, un Expert IA spécialisé dans l'entraînement, l'alignement et l'évaluation de modèles de langage (LLM/SLM) appliqués au SOC.
L'environnement technique est le suivant : LLM (Llama, Mistral, Qwen), LoRA, QLoRA, Unsloth, Axolotl, TRL, DPO, GRPO, PPO, ChatML, Alpaca, MMLU, Python, PyTorch, Hugging Face, vLLM, Ollama.
Contexte :
Au sein d'un SOC intégrant des technologies d'IA générative, vous travaillez en collaboration directe avec l'équipe R&D Cyber pour concevoir des modèles souverains ultra-spécialisés en cybersécurité. L'objectif est d'automatiser l'analyse de menaces, de contextualiser les alertes de sécurité et d'assister les analystes SOC grâce à des LLM/SLM entraînés et alignés sur des données cyber.
Missions :
Adapter et spécialiser des LLM open-source (Llama, Mistral, Qwen) sur des données de cybersécurité (logs, rapports CTI, playbooks) via des techniques de fine-tuning PEFT (LoRA, QLoRA)
Mettre en ?uvre des techniques d'alignement et de Reinforcement Learning (DPO, GRPO, PPO) pour garantir des réponses précises, sécurisées et sans hallucinations
Définir et appliquer les meilleurs formats de prompt et de conversation pour l'entraînement (ChatML, Alpaca)
Concevoir et déployer des pipelines d'évaluation rigoureux pour mesurer la performance des modèles cyber (MMLU, GSM8K, LLM-as-a-judge, Evaluation Arena)
Collaborer étroitement avec les équipes SOC et R&D Cyber pour vulgariser les concepts IA auprès des analystes et RSSI
Profil candidat:
Nous recherchons pour le compte de notre client dans le domaine de la cybersécurité, un Expert IA spécialisé dans l'entraînement, l'alignement et l'évaluation de modèles de langage (LLM/SLM) appliqués au SOC.
L'environnement technique est le suivant : LLM (Llama, Mistral, Qwen), LoRA, QLoRA, Unsloth, Axolotl, TRL, DPO, GRPO, PPO, ChatML, Alpaca, MMLU, Python, PyTorch, Hugging Face, vLLM, Ollama.
Contexte :
Au sein d'un SOC intégrant des technologies d'IA générative, vous travaillez en collaboration directe avec l'équipe R&D Cyber pour concevoir des modèles souverains ultra-spécialisés en cybersécurité. L'objectif est d'automatiser l'analyse de menaces, de contextualiser les alertes de sécurité et d'assister les analystes SOC grâce à des LLM/SLM entraînés et alignés sur des données cyber.
Missions :
Adapter et spécialiser des LLM open-source (Llama, Mistral, Qwen) sur des données de cybersécurité (logs, rapports CTI, playbooks) via des techniques de fine-tuning PEFT (LoRA, QLoRA)
Mettre en ?uvre des techniques d'alignement et de Reinforcement Learning (DPO, GRPO, PPO) pour garantir des réponses précises, sécurisées et sans hallucinations
Définir et appliquer les meilleurs formats de prompt et de conversation pour l'entraînement (ChatML, Alpaca)
Concevoir et déployer des pipelines d'évaluation rigoureux pour mesurer la performance des modèles cyber (MMLU, GSM8K, LLM-as-a-judge, Evaluation Arena)
Collaborer étroitement avec les équipes SOC et R&D Cyber pour vulgariser les concepts IA auprès des analystes et RSSI
ML/AI Work links you to the employer's original posting — always verify the details there before applying.
More Machine Learning roles
View all →Senior Full Stack Software Engineer React | TypeScript | Node.js | AWS | AI
— · Atlanta, US
Chargée ou Chargé de projet IA & Transformation Digitale H/F
LISI GROUP · Paris, FR
Agentic AI Co-Founder / COO (100 % remote) (m/f/d)
EWOR GmbH · Remote · Paris
AI Co-Founder / CEO (100 % remote) (m/f/d)
EWOR GmbH · Remote · Paris
AI Business Analyst
Scotiabank · Mississauga, CA
AI & Automation Intern
Euronext · Paris, FR