OmDev Logo
GetYourJob
0
Publié aujourd'hui

Expert IA Générative & Llm Spécialisé Cybersécurité - Équipe Soc H/F

Entreprise
Localisation
Toulouse - 31
Sur site
Type de contrat
CDI
Niveau
Top profil
Rémunération
45–60 k€/an• Salaire annuel

Salaire du marché

Médiane du marché
55k€
Dans le marché
46k€fourchette habituelle56k€
Cette offre : 53k€

Basé sur 10 offres pour ce poste (Top profil, Toulouse, 3 dernières semaines). Fourchette habituelle 46k€–56k€, médiane 55k€. Cette offre (53k€) est dans la fourchette.

Salaire du marché pour Cybersécurité (Top profil) à Toulouse : médiane 55 000 €/an, P25–P75 : 46 000–56 000 €/an, n = 10 offres. Salaire Python à Toulouse

Baromètre TJM et salaires IT

Description du poste

Les missions du poste


Pourquoi rejoindre Agilia ?

- Des missions longues sur des projets structurants
- Un environnement international stimulant
- Un accompagnement de proximité et des opportunités d'évolution




Contexte de la mission

Au sein d'un acteur majeur du secteur financier, la Direction Cybersécurité renforce son équipe SOC avec l'intégration de technologies d'Intelligence Artificielle Générative.

L'objectif est d'automatiser l'analyse des menaces, de contextualiser les alertes de sécurité et d'assister les analystes SOC grâce à des modèles d'intelligence artificielle spécialisés.

Dans ce cadre, nous recherchons un(e) Expert(e) IA spécialisé(e) dans l'entraînement, l'alignement et l'évaluation de modèles de langage (LLM/SLM) afin de concevoir des modèles souverains et spécialisés sur les problématiques de cybersécurité.

Le consultant interviendra en collaboration avec les équipes R&D Cyber et SOC.

Missions principales

Fine-tuning de modèles IA

- Adapter et spécialiser des modèles de langage open-source tels que Llama, Mistral, Qwen ou équivalents sur des données de cybersécurité.
- Réaliser le fine-tuning de modèles sur différents types de données :
- Logs.
- Rapports CTI (Cyber Threat Intelligence).
- Playbooks.
- Mettre en oeuvre des techniques d'adaptation à faible rang (PEFT), notamment :
- LoRA.
- QLoRA.

Alignement des modèles et limitation des hallucinations

- Optimiser les réponses générées par les modèles afin d'obtenir des résultats précis et adaptés aux besoins cybersécurité.
- Mettre en oeuvre des techniques d'alignement et d'apprentissage par renforcement :
- DPO (Direct Preference Optimization).
- GRPO (Group Relative Policy Optimization).
- PPO (Proximal Policy Optimization).
- Utiliser des frameworks d'alignement tels que :
- TRL.
- verl.
- OpenRLHF.
- Travailler sur la réduction des hallucinations des modèles.

Structuration et formatage des données

- Définir les formats adaptés pour l'entraînement des modèles conversationnels.
- Structurer les datasets selon des formats de templates de discussion :
- ChatML.
- Alpaca.
- Définir les meilleures pratiques de formatage des prompts et conversations pour l'entraînement.

Évaluation et benchmarking des modèles

- Concevoir des protocoles d'évaluation permettant de mesurer les performances des modèles spécialisés cybersécurité.
- Mettre en place des pipelines de benchmark.
- Comparer les performances des modèles par rapport aux standards du marché.
- Utiliser des méthodologies et benchmarks tels que :
- MMLU.
- GSM8K.
- Evaluation Arena / LMSYS.
- LLM-as-a-Judge.

Le profil recherché

Profil recherché Nous recherchons un(e) expert(e) disposant d'une forte expertise technique en intelligence artificielle appliquée aux modèles de langage.Compétences indispensablesIntelligence Artificielle & Fine-tuningExpertise en entraînement et adaptation de modèles LLM/SLM.Maîtrise des techniques :LoRA.QLoRA.PEFT.Expérience avec au moins un framework de fine-tuning :Unsloth.Axolotl.TRL.Alignement des modèlesMaîtrise des méthodes :DPO.GRPO.PPO.Expérience avec les frameworks :TRL.verl.OpenRLHF.DéveloppementExcellente maîtrise de Python.Maîtrise de PyTorch.Compétences appréciéesSensibilité ou expérience en cybersécurité.Connaissance des environnements SOC.Compréhension des sujets :MITRE ATT&CK.Analyse de logs.Détection d'intrusions.Connaissance des outils :Hugging Face Hub.vLLM.Ollama.Triton.Qualités recherchéesRigueur scientifique : attention portée à la qualité des données et à la reproductibilité des benchmarks.Capacité de communication : aptitude à vulgariser des concepts IA complexes auprès de profils cybersécurité.Autonomie : capacité à évoluer dans un environnement R&D agile.

Bienvenue chez AGILIA Technology

Pourquoi rejoindre Agilia ?Des missions longues sur des projets structurantsUn environnement international stimulantUn accompagnement de proximité et des opportunités d'évolution

Mais aussi...

Informations mission📍 Localisation : Toulouse🏠 Télétravail : À distance ponctuellement possible📅 Démarrage : 17/08/2026🌍 Anglais : Couran

Exigences du poste

Compétences requises

  • Python
  • PyTorch
  • LoRA
  • QLoRA
  • PEFT
  • Unsloth
  • Axolotl
  • TRL
  • verl
  • OpenRLHF
  • DPO
  • GRPO
  • PPO
  • Llama
  • Mistral API
  • Qwen
  • Hugging Face Hub
  • vLLM
  • Ollama
  • Triton
  • ChatML
  • Alpaca
  • MMLU
  • GSM8K
  • LLM-as-a-Judge
  • MITRE ATT&CK

Un plus

  • Artificial Intelligence
  • Cybersecurity
  • Agile
  • Anglais
  • Data Quality
  • Fine-tuning
  • GenAI
  • Hugging Face
  • LLM

Toutes les offres Python à Toulouse

Plan d'action

Un plan personnalisé pour postuler intelligemment à cette offre.

Publié par

Recruteur
Recruteur

Intéressé par cette offre ?

Cliquez sur "Postuler" pour accéder à l'offre.