OmDev Logo
GetYourJob
0
Publié il y a 79 jours

Tech Lead LLM Web - Freelance

Entreprise
Localisation
92400 Courbevoie, France
Hybride
Type de contrat
Freelance
Niveau
Top profil

Salaire du marché

Médiane du marché
583€/j
Estimation
500€/jfourchette habituelle650€/j

Cette offre n'affiche pas de salaire. D'après 11 offres pour ce poste (Top profil, France), le marché se situe autour de 583€/j (500€/j–650€/j).

0vues
0clics

Description du poste

Contexte

Vous rejoignez le groupe au sein de l’équipe AI Service en charge de l’une des briques technologiques stratégiques de la plateforme du Groupe. Aux côtés d’une équipe d’experts passionnés, vous relèverez les plus hauts défis techniques de la société, et vous travaillerez sur les sujets les plus innovants. Dans un contexte international, votre mission consiste à mettre en place et à fournir des capabilities IA aux produits du groupe utilisés au quotidien par les professionnels du droit.

En tant que Techlead, vous serez au cœur de nos services IA : la brique technique qui connecte nos modèles de langage, nos moteurs de recherche et nos produits juridiques. Votre terrain de jeu : transformer la manière dont tout un secteur, le droit, travaille au quotidien.

Votre mission n'est pas d'écrire un simple script, mais de concevoir des APIs robustes capables d'orchestrer des appels LLM, des pipelines RAG et des traitements massifs au service de plusieurs équipes à travers l'Europe. Vous garantirez des temps de réponse maîtrisés (streaming, faible latence) tout en gérant une complexité technique de haut vol (concurrence, parallélisme, montée en charge, fiabilité des intégrations IA…). Il est également question de mettre en place une solution multi-tenant (plusieurs pays impliqués) et pouvant être proposée à nos clients en mode souverain.

Missions

  • Concevoir et développer les services de consommation d’indexation et de restitution de données éditoriales

    • Définir l'architecture des APIs et des workers, la stratégie de cache et les mécanismes de résilience (retries, circuit breakers, fallback modèles)
    • Concevoir les chaînes d'inférence (prompting, function calling, RAG, embeddings, agents) et industrialiser leur mise en production, en challengeant les choix via des POCs et des Benchmarks
    • Définir comment concilier débit, latence et coût (synchrone et asynchrone) pour servir les charges de production
  • Définir et développer des APIs Web robustes et performantes (synchrone / asynchrone)

    • Créer des APIs (FastAPI) documentées avec contrats clairs, validation (Pydantic), authentification unifiée et propagation du contexte pays
    • Maîtriser asyncio, la concurrence et le parallélisme pour optimiser le débit, en arbitrant entre traitements synchrones et asynchrones
    • Implémenter le streaming des réponses LLM et gérer finement les timeouts, le backpressure et l'annulation des requêtes
    • Intégrer nativement la télémétrie (logs, métriques, traces) et les guardrails de sécurité (gestion des secrets, Zero Trust, isolation des tokens)
  • Assurer le leadership technique et la gouvernance

    • Être un membre influent de la communauté technique pour assurer la cohérence et la réutilisabilité des composants partagés (gouvernance Inner Source)
    • Accompagner les Value stream teams (IA assistant, Search, Edition…) pour intégrer les capabilities fournies par l’équipe avec un minimum de friction
    • Promouvoir les pratiques de Clean Code, SOLID, et tests automatisés
    • Assurer une veille constante et contribuer au rayonnement technique du groupe (articles, meetups, open-source)

Stack technique

  • Langages : Python 3.11+ (maîtrise requise), Go, Java / Spring Boot
  • Web / APIs : FastAPI, Starlette, Pydantic, Uvicorn (ASGI)
  • Asynchrone : asyncio, httpx, concurrence et parallélisme (threads, process, workers)
  • LLM : OpenAI / Azure OpenAI, LangChain, Mistral, Bedrock, etc.
  • Cloud : AWS, Azure
  • Données & infra : OpenSearch, Weaviate, PostgreSQL, Redis, Celery, Kafka, Docker, CI/CD
  • Tests : Pytest, pytest-asyncio

Conditions de travail

  • Mission 6 Pré Embauche
  • Contexte international avec plusieurs pays impliqués
  • Collaboration avec plusieurs équipes à travers l'Europe
  • Environnement technique exigeant avec forte contrainte de performance
  • Poste à pourvoir dans un groupe structurant du secteur Legaltech

Objectifs et livrables

  • Bâtir, outiller et transmettre les bonnes pratiques et solutions techniques
  • Concevoir des APIs robustes et performantes pour des services IA critiques
  • Industrialiser les chaînes d'inférence LLM et garantir leur scalabilité
  • Assurer la qualité, la sécurité et la fiabilité des services dans un contexte multi-tenant
  • Promouvoir la culture technique et le rayonnement du groupe dans l’écosystème IA et Python

Pourquoi ce poste est unique ?

  • Complexité métier stimulante : industrialiser des flux d'IA générative sous fortes contraintes de performance, sur des volumes juridiques massifs, est un défi technique rare
  • Vision long terme : créer le standard industriel du groupe pour les prochaines années, au-delà d’une simple feature
  • Aventure humaine : rejoindre une équipe d’experts soudée et bienveillante, avec une préembauche pensée pour une intégration durable dans la société

Exigences du poste

Stack technique :

AWSPythonFastAPILLM integrationRAGAsynchronous programming

Plan d'action

Un plan personnalisé pour postuler intelligemment à cette offre.

À propos de l'entreprise

Voir toutes les offres de Salutech

Publié par

Recruteur
Recruteur

Intéressé par cette offre ?

Cliquez sur "Postuler" pour accéder à l'offre.