Basé sur 168 offres pour ce poste (Top profil, France, 3 dernières semaines). Fourchette habituelle 47k€–60k€, médiane 52k€. Cette offre (61k€) est au-dessus de la fourchette.
Au sein de votre équipe #OneTeam
- Être le référent technique de l'équipe AI Solutions. Vous définissez et faites évoluer nos produits IA afin de garantir des services performants, fiables et scalables, avec une attention particulière portée à l'infrastructure GPU, à l'optimisation des modèles et à l'excellence opérationnelle.
Vos principales responsabilités
- Porter les choix d'architecture en tant que référent technique de l'équipe
- Concevoir et faire évoluer l'infrastructure nécessaire au déploiement et à l'exploitation des modèles d'IA
- Optimiser les performances des modèles (quantization, batching, KV cache, tensor/pipeline parallelism, speculative decoding, etc.) et l'utilisation des ressources GPU (throughput, latency, memory footprint, cost efficiency)
- Garantir la fiabilité, la scalabilité et l'observabilité des services en production
- Contribuer à la roadmap technique et accompagner sa mise en oeuvre
- Promouvoir les bonnes pratiques d'ingénierie (revues de code, qualité, automatisation, CI/CD)
- Assurer une veille technologique active sur l'écosystème IA et partager les connaissances au sein de l'équipe
- Accompagner les membres de l'équipe dans leur montée en compétences
- Remettre en question les solutions existantes afin d'évoluer dans un contexte technologique en constante transformation
Votre futur impact
Dans 6 mois
- Vous aurez pris vos marques en tant que référent technique au sein de l'équipe AI Solutions et aurez commencé à porter les choix d'architecture clés.
- Vous aurez appréhendé notre infrastructure GPU et contribué activement à la feuille de route technique.
- Vous aurez collaboré à l'optimisation des premiers modèles en production, en améliorant la latence et l'efficacité des ressources.
- Vous aurez établi une relation de confiance avec l'équipe pour l'accompagner dans sa montée en compétences au quotidien.
- Vous aurez mis en application votre approche pragmatique en poussant de premières itérations rapides selon la culture "fail fast, learn fast" pour maximiser l'impact de nos produits d'intelligence artificielle.
Et dans 1 an
- Vous aurez consolidé l'infrastructure nécessaire au déploiement des modèles IA à grande échelle, garantissant une observabilité et une fiabilité irréprochables de nos services en production.
- Vous aurez pleinement diffusé les bonnes pratiques d'ingénierie et automatisé les workflows via une démarche DevOps et Kubernetes. L'équipe aura gagné en maturité et en vélocité sous votre impulsion technique.
- Vous aurez pérennisé notre stack en intégrant les outils les plus performants du marché (vLLM, SGLang, TensorRT) grâce à votre veille active, maintenant OVHcloud à la pointe de l'écosystème de l'IA.
C
Un plan personnalisé pour postuler intelligemment à cette offre.
Cliquez sur "Postuler" pour accéder à l'offre.