Basé sur 396 offres pour ce poste (tous niveaux, France, 3 dernières semaines). Fourchette habituelle 43k€–55k€, médiane 50k€. Cette offre (51k€) est dans la fourchette.
Au sein d'une équipe pluridisciplinaire (Data Engineers, Data Scientists, Product, experts métier, Architectes), vous concevez et développez des composants d'IA générative qui s'intègrent nativement dans les solutions Septeo.
À ce titre, vous serez amené à :
- Développer des chaînes RAG (Retrieval-Augmented Generation) sur des corpus métiers complexes (actes notariés, contrats, assignations, pièces de dossiers, factures, jurisprudence...) : ingestion, parsing, chunking, embeddings, indexation vectorielle, retrieval, reranking.
- Intégrer et consommer des LLM dans les applications, qu'ils soient exposés en API cloud (Mistral, OpenAI, Claude, Azure OpenAI) ou déployés en local / self-hosted (modèles open-weights via Ollama, vLLM, LM Studio ou équivalent), en arbitrant coût, latence, qualité et souveraineté, sans gestion de l'entraînement ni de l'infrastructure GPU sous-jacente.
- Développer des agents et workflows (tool use, function calling, MCP) pour des cas d'usage métier : extraction d'entités, analyse de risques contractuels, résumé automatique, rédaction assistée, agents conversationnels intégrés à Outlook / Word / Teams.
- Concevoir et développer les APIs et services backend exposant ces capacités aux Business Units, en C# / .NET (services existants Septeo) et Python / FastAPI (briques GenAI).
- Concevoir et faire évoluer les modèles de données : schémas relationnels (SQL Server, PostgreSQL), indexation vectorielle sur Elasticsearch, requêtes optimisées, migrations.
- Conteneuriser les services avec Docker et participer à leur déploiement et exploitation sur Kubernetes (Helm, manifests, configuration, secrets, scaling, observabilité).
- Construire, versionner et évaluer les prompts et templates (zero-shot, few-shot, structured output).
- Garantir la sécurité des traitements (hébergement, gestion des secrets, prompt injection).
- Participer aux revues de code, à la documentation et au partage des bonnes pratiques GenAI au sein du groupe.
- Assurer une veille active sur l'écosystème (modèles, frameworks, patterns agentiques) et prototyper rapidement.
Stack Technique :
Un plan personnalisé pour postuler intelligemment à cette offre.
Cliquez sur "Postuler" pour accéder à l'offre.