Cette offre n'affiche pas de TJM. D'après 12 offres pour ce poste (Top profil, Paris), le marché se situe autour de 600€/j (500€/j–600€/j).
TJM du marché pour Tech Lead (Top profil) à Paris : médiane 600 €/jour, P25–P75 : 500–600 €/jour, n = 12 offres. TJM Python à Paris
Baromètre TJM et salaires IT
Le besoin
Contexte
Vous concevez et déployez la plateforme stratégique d'IA qui alimente l'ensemble des produits du groupe utilisés quotidiennement par les professionnels. Votre rôle ne consiste pas à rédiger des scripts ou des démonstrateurs isolés, mais à concevoir, industrialiser et scaler des architectures d'APIs résilientes : orchestration d'appels LLM, pipelines RAG haute performance, traitement massif de données éditoriales et moteurs de recherche vectoriels. Vous intervenez sur une solution multi-tenant à l'échelle européenne, intégrant de fortes exigences de souveraineté des données, d'isolation sécurisée et de très faible latence (streaming temps réel).
Missions
- Architecture & Ingénierie des Services IA
- Définir l'architecture des APIs et des workers asynchrones : mise en place de stratégies de cache avancées, circuit breakers, politiques de retries et bascules (fallbacks) multi-modèles.
- Concevoir et industrialiser les chaînes d'inférence LLM (RAG avancé, embeddings, function calling, agents autonomes).
- Piloter la performance et l'efficience : optimiser en continu le compromis débit / latence / coût d'inférence sous fortes charges de production.
- Réaliser des benchmarks comparatifs et challenger les choix technologiques et modèles (propriétaires et open-source).
- Développement Backend & Performance Web
- Développer et maintenir des APIs haute performance via FastAPI et Pydantic (contrats stricts, validation, typage, gestion des contextes pays et multi-tenant).
- Exploiter la programmation asynchrone (asyncio, httpx, multiprocessing/threading) pour maximiser le débit et la réactivité des services.
- Implémenter le streaming fluide des réponses LLM (Server-Sent Events / WebSockets), la gestion du backpressure, des timeouts et de l'annulation de requêtes.
- Intégrer nativement la sécurité et l'observabilité (OpenTelemetry, traçabilité des inférences, isolation des tokens, approche Zero Trust).
- Leadership Technique & Rayonnement
- Animer la gouvernance technique et promouvoir une culture Inner-Source (composants réutilisables, bibliothèques partagées inter-équipes).
- Accompagner les différentes squads produits (Search, Assistant IA, Édition) pour faciliter l'adoption et l'intégration des briques d'IA.
- Inculquer les standards de Craftsmanship (Clean Code, architecture hexagonale / SOLID, revues de code exigeantes, couverture de tests automatisés).
- Maintenir une veille constante sur l'écosystème IA et porter le rayonnement technique de l'organisation.
Outils & Environnement
- Backend Python : Python 3.11+, FastAPI, Starlette, Uvicorn, Pydantic
- Programmation asynchrone : asyncio, httpx, multiprocessing/threading
- Streaming : Server-Sent Events, WebSockets
- Observabilité et sécurité : OpenTelemetry, Zero Trust
- Bases de données et moteurs de recherche : OpenSearch / Elasticsearch, bases vectorielles (Weaviate, Qdrant ou équivalent), PostgreSQL, Redis
- Cloud & Conteneurisation : Docker, CI/CD, déploiement sur clouds publics (AWS ou Azure / Azure OpenAI)
- Tests : pytest, pytest-asyncio
Conditions de travail
- Localisation : Île-de-France (télétravail partiel / hybride)
- Contexte linguistique : Anglais professionnel quotidien (équipe et périmètre européens)
- Niveau d'études : Bac +5 (Diplôme d'ingénieur, Master informatique ou Ph.D)
- Expérience : 7 ans et plus en ingénierie logicielle backend, avec expérience avérée en Lead technique et intégration GenAI en production
Pourquoi rejoindre ce projet ?
- Un défi d'ingénierie rare : réconcilier la complexité des modèles de langage de pointe avec les contraintes strictes de fiabilité, de latence et de souveraineté d'un grand groupe.
- Une vision long terme : poser les fondations du socle technique européen pour les années à venir.
Profil recherchéBac +5 (Diplôme d'ingénieur, Master informatique ou Ph.D)7 ans et plus d'expérience en ingénierie logicielle backend, avec expérience avérée en Lead technique et intégration GenAI en productionMaîtrise experte de Python (3.11+) et de son écosystème web moderne (FastAPI, Starlette, Uvicorn, Pydantic)Connaissance approfondie d'asyncio, de la concurrence, des files de messages et des flux streamingExpérience concrète de mise en production d'architectures RAG, d'orchestrateurs IA et de moteurs vectorielsPratique d'OpenSearch / Elasticsearch, de bases vectorielles (ex. Weaviate, Qdrant ou équivalent), de PostgreSQL et de RedisSolides bases en Docker, CI/CD, et déploiement sur les clouds publics (AWS ou Azure / Azure OpenAI)Maîtrise des tests unitaires et d'intégration asynchrones (pytest, pytest-asyncio)Anglais courant (environnement de travail international au quotidien)Connaissance opérationnelle d'un autre langage backend (Go ou Java / Spring Boot) appréciéeExpérience sur des problématiques d'IA souveraine (modèles hébergés, vLLM, Ollama, respect strict RGPD / AI Act) appréciéeExpérience de mise à l'échelle de plateformes multi-tenant à fort volume appréciéeVision Produit & Client interne : considérer les APIs comme des produits et les ingénieurs des squads produits comme utilisateursCapacité à fédérer, transmettre, vulgariser et guider les développeurs juniors comme seniorsSensibilité aiguë aux enjeux de criticité et d'intégrité de la donnée juridique
Taux journalier :Salaire selon profil
Un plan personnalisé pour postuler intelligemment à cette offre.
Cliquez sur "Postuler" pour accéder à l'offre.