OmDev Logo
GetYourJob
0
Publié aujourd'hui

Tech Lead Backend Python - IA H/F

Entreprise
MeetshakeCabinet de recrutement
Localisation
Paris - 75
Hybride
Type de contrat
Freelance
Niveau
Top profil
Rémunération
Pas de salaire renseigné

Salaire du marché

Médiane du marché
600€/j
Estimation
500€/jfourchette habituelle600€/j

Cette offre n'affiche pas de TJM. D'après 12 offres pour ce poste (Top profil, Paris), le marché se situe autour de 600€/j (500€/j–600€/j).

TJM du marché pour Tech Lead (Top profil) à Paris : médiane 600 €/jour, P25–P75 : 500–600 €/jour, n = 12 offres. TJM Python à Paris

Baromètre TJM et salaires IT

Description du poste

Détail du poste


Le besoin

Contexte

Vous concevez et déployez la plateforme stratégique d'IA qui alimente l'ensemble des produits du groupe utilisés quotidiennement par les professionnels. Votre rôle ne consiste pas à rédiger des scripts ou des démonstrateurs isolés, mais à concevoir, industrialiser et scaler des architectures d'APIs résilientes : orchestration d'appels LLM, pipelines RAG haute performance, traitement massif de données éditoriales et moteurs de recherche vectoriels. Vous intervenez sur une solution multi-tenant à l'échelle européenne, intégrant de fortes exigences de souveraineté des données, d'isolation sécurisée et de très faible latence (streaming temps réel).

Missions
- Architecture & Ingénierie des Services IA

- Définir l'architecture des APIs et des workers asynchrones : mise en place de stratégies de cache avancées, circuit breakers, politiques de retries et bascules (fallbacks) multi-modèles.
- Concevoir et industrialiser les chaînes d'inférence LLM (RAG avancé, embeddings, function calling, agents autonomes).
- Piloter la performance et l'efficience : optimiser en continu le compromis débit / latence / coût d'inférence sous fortes charges de production.
- Réaliser des benchmarks comparatifs et challenger les choix technologiques et modèles (propriétaires et open-source).
- Développement Backend & Performance Web

- Développer et maintenir des APIs haute performance via FastAPI et Pydantic (contrats stricts, validation, typage, gestion des contextes pays et multi-tenant).
- Exploiter la programmation asynchrone (asyncio, httpx, multiprocessing/threading) pour maximiser le débit et la réactivité des services.
- Implémenter le streaming fluide des réponses LLM (Server-Sent Events / WebSockets), la gestion du backpressure, des timeouts et de l'annulation de requêtes.
- Intégrer nativement la sécurité et l'observabilité (OpenTelemetry, traçabilité des inférences, isolation des tokens, approche Zero Trust).
- Leadership Technique & Rayonnement

- Animer la gouvernance technique et promouvoir une culture Inner-Source (composants réutilisables, bibliothèques partagées inter-équipes).
- Accompagner les différentes squads produits (Search, Assistant IA, Édition) pour faciliter l'adoption et l'intégration des briques d'IA.
- Inculquer les standards de Craftsmanship (Clean Code, architecture hexagonale / SOLID, revues de code exigeantes, couverture de tests automatisés).
- Maintenir une veille constante sur l'écosystème IA et porter le rayonnement technique de l'organisation.

Outils & Environnement

- Backend Python : Python 3.11+, FastAPI, Starlette, Uvicorn, Pydantic
- Programmation asynchrone : asyncio, httpx, multiprocessing/threading
- Streaming : Server-Sent Events, WebSockets
- Observabilité et sécurité : OpenTelemetry, Zero Trust
- Bases de données et moteurs de recherche : OpenSearch / Elasticsearch, bases vectorielles (Weaviate, Qdrant ou équivalent), PostgreSQL, Redis
- Cloud & Conteneurisation : Docker, CI/CD, déploiement sur clouds publics (AWS ou Azure / Azure OpenAI)
- Tests : pytest, pytest-asyncio

Conditions de travail

- Localisation : Île-de-France (télétravail partiel / hybride)
- Contexte linguistique : Anglais professionnel quotidien (équipe et périmètre européens)
- Niveau d'études : Bac +5 (Diplôme d'ingénieur, Master informatique ou Ph.D)
- Expérience : 7 ans et plus en ingénierie logicielle backend, avec expérience avérée en Lead technique et intégration GenAI en production

Pourquoi rejoindre ce projet ?

- Un défi d'ingénierie rare : réconcilier la complexité des modèles de langage de pointe avec les contraintes strictes de fiabilité, de latence et de souveraineté d'un grand groupe.
- Une vision long terme : poser les fondations du socle technique européen pour les années à venir.

Le profil recherché

Profil recherchéBac +5 (Diplôme d'ingénieur, Master informatique ou Ph.D)7 ans et plus d'expérience en ingénierie logicielle backend, avec expérience avérée en Lead technique et intégration GenAI en productionMaîtrise experte de Python (3.11+) et de son écosystème web moderne (FastAPI, Starlette, Uvicorn, Pydantic)Connaissance approfondie d'asyncio, de la concurrence, des files de messages et des flux streamingExpérience concrète de mise en production d'architectures RAG, d'orchestrateurs IA et de moteurs vectorielsPratique d'OpenSearch / Elasticsearch, de bases vectorielles (ex. Weaviate, Qdrant ou équivalent), de PostgreSQL et de RedisSolides bases en Docker, CI/CD, et déploiement sur les clouds publics (AWS ou Azure / Azure OpenAI)Maîtrise des tests unitaires et d'intégration asynchrones (pytest, pytest-asyncio)Anglais courant (environnement de travail international au quotidien)Connaissance opérationnelle d'un autre langage backend (Go ou Java / Spring Boot) appréciéeExpérience sur des problématiques d'IA souveraine (modèles hébergés, vLLM, Ollama, respect strict RGPD / AI Act) appréciéeExpérience de mise à l'échelle de plateformes multi-tenant à fort volume appréciéeVision Produit & Client interne : considérer les APIs comme des produits et les ingénieurs des squads produits comme utilisateursCapacité à fédérer, transmettre, vulgariser et guider les développeurs juniors comme seniorsSensibilité aiguë aux enjeux de criticité et d'intégrité de la donnée juridique

Mais aussi...

Taux journalier :Salaire selon profil

Exigences du poste

Compétences requises

  • Python
  • FastAPI
  • Starlette
  • Uvicorn
  • Pydantic
  • asyncio
  • httpx
  • multiprocessing
  • threading
  • Server-Sent Events
  • WebSocket
  • OpenTelemetry
  • Zero Trust
  • OpenSearch
  • Elasticsearch
  • Weaviate
  • Qdrant
  • PostgreSQL
  • Redis
  • Docker
  • CI/CD
  • AWS
  • Azure
  • Azure OpenAI
  • Pytest
  • pytest-asyncio
  • Go
  • Java
  • Spring Boot
  • vLLM

Un plus

  • Artificial Intelligence
  • API Development
  • LLM
  • Agentic AI / Agents IA
  • Cybersecurity
  • Monitoring / Observability
  • Clean Code
  • Software Architecture
  • Solid.js
  • Cloud
  • OpenAI API
  • Anglais

Toutes les offres Python à Paris

Plan d'action

Un plan personnalisé pour postuler intelligemment à cette offre.

À propos de l'entreprise

MeetshakeCabinet de recrutement
Voir toutes les offres de Meetshake

Publié par

Recruteur
Recruteur

Intéressé par cette offre ?

Cliquez sur "Postuler" pour accéder à l'offre.