Votre rôle au sein d'Exaion :
Rattaché(e) à l'équipe IA, Votre mission principale est de transformer les prototypes techniques en applications robustes, performantes et conformes aux exigences réglementaires d’Exaion. Vous collaborez transversalement avec les équipes Développement, Delivery et Infrastructure pour assurer une intégration fluide et productive.
Vos missions sont les suivantes :
- Conception & Déploiement de Modèles Génératifs
- Déploiement LLM : Vous déployez les grands modèles de langage (LLaMA, Mistral, etc.) sur des clusters HPC ou environnements Cloud.
- Architectures RAG : Vous mettez en œuvre des pipelines Retrieval-Augmented Generation pour créer des applications contextuelles fiables.
- Multimodalité : Vous assurez le déploiement de modèles multimodaux pour supporter des usages avancés combinant différents types de données.
- Optimisation & Performance
- Optimisation des Ressources : Vous réduisez la latence, la consommation GPU et les coûts grâce à la réduction de taille, la quantification, la distillation et l’accélération GPU.
- Performance Globale : Vous améliorez l’efficacité énergétique et les temps de réponse des modèles.
- Gestion HPC : Vous supervisez l’allocation et la gestion optimale des ressources de calcul haute performance.
- Sécurité & Gouvernance des Modèles
- Security by Design : Vous protégez les systèmes contre les attaques adversariales (prompt injection, data leakage) dès la conception.
- Contrôles Opérationnels : Vous mettez en place des filtres de contenu, des validations d’entrées et des contrôles de fuite de données.
- Conformité : Vous assurez le respect des normes RGPD, ISO 27001, NIS2 et des bonnes pratiques de gouvernance des modèles.
- MLOps & Industrialisation
- Pipelines CI/CD IA : Vous déployez des chaînes de production automatisées pour les modèles génératifs (versioning, tests, rollback).
- GitOps & Qualité : Vous appliquez le GitOps pour la gestion des déploiements et intégrez des normes de vérification qualité à chaque étape.
- Monitoring Avancé : Vous surveillez en continu les performances, la latence, le drift conceptuel et les anomalies des modèles en production.
- Innovation & Collaboration Transversale
-Expérimentation : Vous testez de nouvelles architectures (LLM, RAG, etc.) pour enrichir l’expertise technique d’Exaion.
-Collaboration Inter-équipes : Vous travaillez en étroite collaboration avec les autres équipes techniques (Dev, Delivery, Infra) pour aligner les développements IA avec les objectifs globaux.
- Recherche Appliquée : Vous contribuez aux travaux internes sur la fiabilité, la traçabilité et la responsabilité des modèles génératifs.