OmDev Logo
GetYourJob
0
Publié il y a 67 jours

Tech Lead ai - N H/F

Entreprise
OVHCloudRecrute en direct
Localisation
Cesson - 77
Hybride
Type de contrat
CDI
Niveau
Top profil
Rémunération
46 200 - 74 800€• Salaire annuel

Salaire du marché

Médiane du marché
52k€
Au-dessus du marché
47k€fourchette habituelle60k€
Cette offre : 61k€

Basé sur 166 offres pour ce poste (Top profil, France, 3 dernières semaines). Fourchette habituelle 47k€–60k€, médiane 52k€. Cette offre (61k€) est au-dessus de la fourchette.

0vues
0clics

Description du poste

Au sein de votre équipe #OneTeam

- Être le référent technique de l'équipe AI Solutions. Vous définissez et faites évoluer nos produits IA afin de garantir des services performants, fiables et scalables, avec une attention particulière portée à l'infrastructure GPU, à l'optimisation des modèles et à l'excellence opérationnelle.

Vos principales responsabilités

- Porter les choix d'architecture en tant que référent technique de l'équipe
- Concevoir et faire évoluer l'infrastructure nécessaire au déploiement et à l'exploitation des modèles d'IA
- Optimiser les performances des modèles (quantization, batching, KV cache, tensor/pipeline parallelism, speculative decoding, etc.) et l'utilisation des ressources GPU (throughput, latency, memory footprint, cost efficiency)
- Garantir la fiabilité, la scalabilité et l'observabilité des services en production
- Contribuer à la roadmap technique et accompagner sa mise en oeuvre
- Promouvoir les bonnes pratiques d'ingénierie (revues de code, qualité, automatisation, CI/CD)
- Assurer une veille technologique active sur l'écosystème IA et partager les connaissances au sein de l'équipe
- Accompagner les membres de l'équipe dans leur montée en compétences
- Remettre en question les solutions existantes afin d'évoluer dans un contexte technologique en constante transformation

Votre futur impact

Dans 6 mois

- Vous aurez pris vos marques en tant que référent technique au sein de l'équipe AI Solutions et aurez commencé à porter les choix d'architecture clés.
- Vous aurez appréhendé notre infrastructure GPU et contribué activement à la feuille de route technique.
- Vous aurez collaboré à l'optimisation des premiers modèles en production, en améliorant la latence et l'efficacité des ressources.
- Vous aurez établi une relation de confiance avec l'équipe pour l'accompagner dans sa montée en compétences au quotidien.
- Vous aurez mis en application votre approche pragmatique en poussant de premières itérations rapides selon la culture "fail fast, learn fast" pour maximiser l'impact de nos produits d'intelligence artificielle.

Et dans 1 an

- Vous aurez consolidé l'infrastructure nécessaire au déploiement des modèles IA à grande échelle, garantissant une observabilité et une fiabilité irréprochables de nos services en production.
- Vous aurez pleinement diffusé les bonnes pratiques d'ingénierie et automatisé les workflows via une démarche DevOps et Kubernetes. L'équipe aura gagné en maturité et en vélocité sous votre impulsion technique.
- Vous aurez pérennisé notre stack en intégrant les outils les plus performants du marché (vLLM, SGLang, TensorRT) grâce à votre veille active, maintenant OVHcloud à la pointe de l'écosystème de l'IA.

C

Exigences du poste

Stack technique :

PythonKubernetesGPUvLLMSGLangTensorRTCI/CDDevOpsQuantizationBatchingKV CacheTensor ParallelismPipeline ParallelismSpeculative Decoding

Plan d'action

Un plan personnalisé pour postuler intelligemment à cette offre.

À propos de l'entreprise

OVHCloudRecrute en direct
Voir toutes les offres de OVHCloud

Publié par

Recruteur
Recruteur
Voir sur LinkedIn

Intéressé par cette offre ?

Cliquez sur "Postuler" pour accéder à l'offre.