Basé sur 111 offres pour ce poste (Senior, France, 3 dernières semaines). Fourchette habituelle 425€/j–550€/j, médiane 475€/j. Cette offre (400€/j) est sous la fourchette.
Administration et exploitation de modèles LLM : Mistral AI, OpenAI, Meta Llama
o Déploiement et hébergement de modèles open source / propriétaires
o Gestion des APIs IA et intégration applicative
o Fine-tuning / quantization / optimisation des modèles
o Serving de modèles : vLLM, Ollama, TGI, TensorRT-LLM
o Gestion GPU / VRAM / performance inference
o Vectorisation / embeddings / bases vectorielles
o Administration de bases vectorielles : Pinecone, Weaviate, Milvus, Elasticsearch
o Mise en œuvre d’architectures RAG (Retrieval-Augmented Generation)
o Sécurisation des flux IA et gouvernance des prompts / données
o Monitoring des usages, coûts et performances des modèles
o Automatisation et orchestration MLOps / LLMOps
Un plan personnalisé pour postuler intelligemment à cette offre.
Créer en 1998, Cheops Technology est le spécialiste français dans le Cloud et les infrastructure informatiques sécurisées. Leader du Cloud Computing Cheops c'est : 13 agences Une offre variée : - Cloud & Managed Services - Infrastructure - Cyberdéfense - Modernisation technologique Intégrateur de solutions. Certification ISO 27001 Certification ISO 20000 Certification ISAE 3402 Type 2 Qualification SecNumCloud Certification Hébergeur de données de santé certification hébergeur d'infrastructure physique et hébergeur infogérant
Voir toutes les offres de Cheops TechnologyCliquez sur "Postuler" pour accéder à l'offre.