Basé sur 18 offres pour ce poste (Top profil, Paris, 3 dernières semaines). Fourchette habituelle 60k€–70k€, médiane 63k€. Cette offre (78k€) est au-dessus de la fourchette.
Devenez l'architecte de "l'usine de plateformes" au sein d'un cabinet de conseil d'élite.
Nous recrutons un profil capable de concevoir, rationaliser et opérer les infrastructures qui font tourner l'IA de nos clients de manière industrielle et performante.
Vos Missions (Ratio 70% Build / 30% R&D-Conseil) :
GenAIOps & Machinerie Système :
Gestion et optimisation de serveurs MCP (Model Context Protocol), mise en place de la télémétrie complète, de l'observabilité et du tracing des architectures LLM.
Data Streaming & Vectorisation :
Conception de pipelines de vectorisation des flux de données à la volée (streaming vers le RAG).
FinOps & Efficience à l'échelle :
Gestion fine de la tokenisation, du caching, choix du découpage sémantique (chunking) et arbitrages budgétaires complexes (évaluer le coût d'un RAG vs un Fine-Tuning de modèle).
Scaling & Conteneurisation :
Déploiement et optimisation de modèles ouverts via des outils de pointe comme vLLM.
Un plan personnalisé pour postuler intelligemment à cette offre.
Cliquez sur "Postuler" pour accéder à l'offre.