Basé sur 10 offres pour ce poste (Senior, Paris, 3 dernières semaines). Fourchette habituelle 450€/j–615€/j, médiane 550€/j. Cette offre (600€/j) est dans la fourchette.
Type de mission : Freelance
Localisation : Montreuil
Télétravail : 50 %
Démarrage : Dès que possible
Durée : 3 ans
Secteur : Grand groupe bancaire
Dans le cadre de l’industrialisation de ses usages d’Intelligence Artificielle générative, notre client recherche un profil senior capable de concevoir, évaluer et sécuriser des solutions basées sur des LLM (Large Language Models).
La mission s’inscrit au sein d’une entité dédiée aux enjeux de sécurité et de services IT. Le profil interviendra sur des systèmes RAG (Retrieval-Augmented Generation), des agents IA et des bases documentaires internes utilisées par les équipes métiers et IT.
Concevoir et industrialiser des architectures RAG de bout en bout.
Traiter des documents hétérogènes : PDF, Word, e-mails, documents scannés et bases de connaissances.
Mettre en place des stratégies de recherche hybride : recherche lexicale, embeddings, reranking et éventuellement Graph RAG.
Garantir la traçabilité des sources et limiter les hallucinations des modèles.
Comparer différents modèles et configurations selon la qualité, la latence, le coût et la robustesse.
Mettre en place des dispositifs d’observabilité et d’évaluation des réponses générées.
Développer des agents IA capables d’interagir avec des outils et des systèmes métiers.
Participer à la sécurisation des solutions : guardrails, contrôle des entrées et sorties, protection des données et prévention des prompt injections.
Produire la documentation technique et présenter les résultats aux équipes IT, sécurité et métiers.
Python, LangChain, LlamaIndex, Haystack, Langfuse, Phoenix, vLLM, FastAPI, Docker, Kubernetes, AWS, Azure, GCP, vector stores, embeddings, BM25, reranking, Neo4j, Graph RAG, OCR, MLflow et CI/CD.
Un plan personnalisé pour postuler intelligemment à cette offre.
Cliquez sur "Postuler" pour accéder à l'offre.