Basé sur 11 offres pour ce poste (Top profil, France, 3 dernières semaines). Fourchette habituelle 500€/j–650€/j, médiane 583€/j. Cette offre (550€/j) est dans la fourchette.
Expert
Pour le compte d'un client dans les médias, concevoir, développer et industrialiser des applications web intégrant des modèles de langage (LLM) et des systèmes à base d’embeddings, dans un environnement cloud sécurisé, scalable et conforme aux bonnes pratiques de génie logiciel.
Intégration de LLM et embeddings dans des applications web
Conception de prompts, orchestration de modèles et workflows agentiques
Développement backend (Python, Node.js ou Go) et intégration frontend (React)
Conception d’API sécurisées et de systèmes temps réel (FastAPI, WebSockets, SSE)
Déploiement et mise à l’échelle sur cloud public (GCP et/ou Azure)
Mise en œuvre d’infrastructures conteneurisées (Docker, Kubernetes, Terraform)
Conception et exploitation de bases SQL, NoSQL, vectorielles et graphes
Optimisation, évaluation et observabilité des systèmes IA/LLM
Usage obligatoire d’agents de développement assistés par IA de nouvelle génération
LLM, embeddings, prompt engineering, systèmes agentiques
Frameworks d’orchestration IA (LangChain, LangGraph ou équivalents)
Backend : Python / Node.js / Go
Frontend : React
Cloud : GCP et/ou Azure
Infrastructure : Docker, Kubernetes, Terraform
Bases de données SQL, NoSQL, vectorielles, graphes
Fine-tuning et optimisation de modèles (LoRA/QLoRA, HuggingFace)
Excellentes capacités d’analyse et de communication
Rigueur, autonomie et esprit critique
Capacité à sécuriser et maîtriser les usages IA
Gestion efficace des priorités et des délais
Architectures techniques synthétiques
Composants applicatifs et API documentés
Documentation technique et rapports d’évaluation
Un plan personnalisé pour postuler intelligemment à cette offre.
Cliquez sur "Postuler" pour accéder à l'offre.