Basé sur 81 offres pour ce poste (tous niveaux, France, 3 dernières semaines). Fourchette habituelle 450€/j–583€/j, médiane 500€/j. Cette offre (490€/j) est dans la fourchette.
Au sein d’une équipe spécialisée en Agentic AI, vous intervenez sur une solution d’analyse conversationnelle de données basée sur les LLM, déployée en production sur Google Cloud.
L’objectif est d’assurer la robustesse, la maintenance et l’amélioration continue de la solution, notamment sur l’évaluation de la qualité des réponses LLM et l’analyse avancée du comportement des agents.
Concevoir et industrialiser des frameworks d’évaluation LLM-as-a-Judge.
Définir et suivre les métriques, jeux de tests et seuils de qualité.
Assurer la maintenance corrective et évolutive de la solution en production.
Réaliser des analyses LLM avancées et identifier les axes d’amélioration.
Concevoir des workflows multi-agents et intégrer les protocoles A2A / A2UI.
Intégrer des fonctionnalités de visualisation et d’exposition de graphiques dans l’interface de l’agent.
Parser et structurer des données non structurées : PDF, images, tableaux.
Un plan personnalisé pour postuler intelligemment à cette offre.
Cliquez sur "Postuler" pour accéder à l'offre.