Contexte
Vous concevez et déployez la plateforme stratégique d'IA qui alimente l'ensemble des produits du groupe utilisés quotidiennement par les professionnels. Votre rôle ne consiste pas à rédiger des scripts ou des démonstrateurs isolés, mais à concevoir, industrialiser et scaler des architectures d'APIs résilientes : orchestration d'appels LLM, pipelines RAG haute performance, traitement massif de données éditoriales et moteurs de recherche vectoriels. Vous intervenez sur une solution multi-tenant à l'échelle européenne, intégrant de fortes exigences de souveraineté des données, d'isolation sécurisée et de très faible latence (streaming temps réel).
Missions
Architecture & Ingénierie des Services IA
- Définir l'architecture des APIs et des workers asynchrones : mise en place de stratégies de cache avancées, circuit breakers, politiques de retries et bascules (fallbacks) multi-modèles.
- Concevoir et industrialiser les chaînes d’inférence LLM (RAG avancé, embeddings, function calling, agents autonomes).
- Piloter la performance et l'efficience : optimiser en continu le compromis débit / latence / coût d'inférence sous fortes charges de production.
- Réaliser des benchmarks comparatifs et challenger les choix technologiques et modèles (propriétaires et open-source).
Développement Backend & Performance Web
- Développer et maintenir des APIs haute performance via FastAPI et Pydantic (contrats stricts, validation, typage, gestion des contextes pays et multi-tenant).
- Exploiter la programmation asynchrone (asyncio, httpx, multiprocessing/threading) pour maximiser le débit et la réactivité des services.
- Implémenter le streaming fluide des réponses LLM (Server-Sent Events / WebSockets), la gestion du backpressure, des timeouts et de l'annulation de requêtes.
- Intégrer nativement la sécurité et l'observabilité (OpenTelemetry, traçabilité des inférences, isolation des tokens, approche Zero Trust).
Leadership Technique & Rayonnement
- Animer la gouvernance technique et promouvoir une culture Inner-Source (composants réutilisables, bibliothèques partagées inter-équipes).
- Accompagner les différentes squads produits (Search, Assistant IA, Édition) pour faciliter l'adoption et l'intégration des briques d'IA.
- Inculquer les standards de Craftsmanship (Clean Code, architecture hexagonale / SOLID, revues de code exigeantes, couverture de tests automatisés).
- Maintenir une veille constante sur l'écosystème IA et porter le rayonnement technique de l'organisation.
Outils & Environnement
- Backend Python : Python 3.11+, FastAPI, Starlette, Uvicorn, Pydantic
- Programmation asynchrone : asyncio, httpx, multiprocessing/threading
- Streaming : Server-Sent Events, WebSockets
- Observabilité et sécurité : OpenTelemetry, Zero Trust
- Bases de données et moteurs de recherche : OpenSearch / Elasticsearch, bases vectorielles (Weaviate, Qdrant ou équivalent), PostgreSQL, Redis
- Cloud & Conteneurisation : Docker, CI/CD, déploiement sur clouds publics (AWS ou Azure / Azure OpenAI)
- Tests : pytest, pytest-asyncio
Conditions de travail
- Localisation : Île-de-France (télétravail partiel / hybride)
- Contexte linguistique : Anglais professionnel quotidien (équipe et périmètre européens)
- Niveau d'études : Bac+5 (Diplôme d'ingénieur, Master informatique ou Ph.D)
- Expérience : 7 ans et plus en ingénierie logicielle backend, avec expérience avérée en Lead technique et intégration GenAI en production
Pourquoi rejoindre ce projet ?
- Un défi d'ingénierie rare : réconcilier la complexité des modèles de langage de pointe avec les contraintes strictes de fiabilité, de latence et de souveraineté d'un grand groupe.
- Une vision long terme : poser les fondations du socle technique européen pour les années à venir.