Cette offre n'affiche pas de salaire. D'après 23 offres pour ce poste (tous niveaux, Paris), le marché se situe autour de 550€/j (499€/j–625€/j).
Dans le cadre du développement de solutions d’intelligence artificielle, l’équipe souhaite renforcer ses capacités sur des projets basés sur les LLM (Large Language Models).
Les travaux portent sur la mise en place d’applications exploitant des données internes, avec des enjeux de performance, de coût et de qualité des réponses.
L’environnement est orienté innovation avec :
intégration de modèles de type Transformer
mise en œuvre de solutions RAG
exploitation de bases vectorielles
développement d’API pour exposition des services IA
industrialisation et monitoring des usages
Le poste s’inscrit dans un contexte de production avec des contraintes fortes de scalabilité, latence et fiabilité.
Missions principales
Développer des applications IA basées sur Python
Concevoir des architectures utilisant des modèles de type Transformer
Implémenter des solutions RAG
Intégrer et exploiter des modèles pré-entraînés (fine-tuning)
Optimiser les performances (temps de réponse, mémoire)
Mettre en place des API (synchrones / asynchrones)
Assurer la qualité du code (tests, linting, bonnes pratiques)
Mettre en place l’observabilité des systèmes IA (LangSmith)
Gérer les données et pipelines ML (DVC, bases vectorielles
Un plan personnalisé pour postuler intelligemment à cette offre.
Cliquez sur "Postuler" pour accéder à l'offre.