Cette offre n'affiche pas de salaire. D'après 23 offres pour ce poste (tous niveaux, Paris), le marché se situe autour de 550€/j (499€/j–615€/j).
Contexte
Dans le cadre du développement d'un produit IA interne, notre client — un grand groupe pharmaceutique international — industrialise des cas d'usage GenAI pour la validation automatique du contenu marketing. Nous cherchons un Data Scientist expérimenté, avec une forte culture LLMs et agents IA, pour concevoir les briques data-driven autour de l'extraction de règles MLR (Medical, Legal & Regulatory) et la mise en place d'un cadre d'évaluation robuste.
Missions principales
Extraction de règles MLR
Développer des pipelines pour extraire automatiquement les règles MLR depuis les documents des autorités de santé
Structurer ces règles sous forme exploitable : knowledge base, RAG, ou graphe de connaissances
Validation de contenu marketing via agents IA
Concevoir des agents capables de détecter les non-conformités et de proposer des corrections
Intégrer ces agents dans les workflows existants de revue MLR
Framework d'évaluation
Définir et construire un golden dataset ou équivalent de référence
Développer des méthodologies d'évaluation offline / online
Définir des métriques business-oriented : compliance, précision, recall, criticité des erreurs
Monitoring & amélioration continue
Détecter les dérives de performance (performance drift, data drift)
Mettre en place des boucles d'amélioration continue sur les modèles et les agents
Stack technique
LLMs : OpenAI, Anthropic, …
RAG & orchestration : LangChain, LlamaIndex, …
Cloud : AWS (services data + Bedrock)
Vector DB : Pinecone, …
Knowledge Graph : Neo4j, Neptune, …
Monitoring & évaluation : Weights & Biases, Weave
Conditions
Localisation : Paris – Île-de-France
Rythme : 3 jours sur site / 2 jours remote
Type : Freelance, mission longue durée
Démarrage : ASAP
Un plan personnalisé pour postuler intelligemment à cette offre.
Cliquez sur "Postuler" pour accéder à l'offre.