Basé sur 23 offres pour ce poste (tous niveaux, Paris, 3 dernières semaines). Fourchette habituelle 499€/j–615€/j, médiane 550€/j. Cette offre (600€/j) est dans la fourchette.
Contexte :
L'intervention porte sur un agent conversationnel qui permet aux équipes métier d'analyser leurs données en langage naturel, directement depuis une interface de chat. L'agent tourne sur Google Agent Platform et est utilisé quotidiennement en environnement critique.
Mission :
Maintenir, évaluer et faire progresser cet agent en production. Pas un projet from scratch mais une solution vivante qu'il faut industrialiser et améliorer en continu.
Évaluer la qualité des réponses de l'agent : construire et maintenir un framework d'évaluation LLM-as-a-judge (métriques, jeux de test, seuils de qualité) pour mesurer objectivement ce que l'agent comprend et produit
Intégrer le protocole A2UI pour permettre à l'agent de générer et exposer des graphiques directement dans son interface (analyses visuelles poussées)
Mener des analyses LLM avancées : comprendre les dérives de l'agent, identifier les axes d'amélioration, documenter les recommandations
Maintenir la plateforme en production : correction d'anomalies, mises à jour des composants, fiabilisation des comportements
Un plan personnalisé pour postuler intelligemment à cette offre.
Cliquez sur "Postuler" pour accéder à l'offre.