OmDev Logo
GetYourJob
0
Publié il y a 8 jours

Développeur Back End IA (H/F)

Entreprise
Localisation
Saint-Paul
Sur site
Type de contrat
CDI
Niveau
Senior

Salaire du marché

Médiane du marché
54k€
Estimation
48k€fourchette habituelle58k€

Cette offre n'affiche pas de salaire. D'après 85 offres pour ce poste (Senior, France), le marché se situe autour de 54k€ (48k€–58k€).

0vues
0clics

Description du poste

O2MAX est une ESN en croissance : 40 collaborateurs, +10 ans d'expérience, et une expertise reconnue en Java, Angular, Cloud, Data et Modern Work.
Historiquement implantés à Lyon, nous accompagnons aujourd'hui nos clients multi-sites à Paris, Rennes et Aix-en-Provence pour renforcer proximité et réactivité.
Notre taille humaine favorise la convivialité, l'agilité et des parcours de carrière sur-mesure : formations, certifications, mobilité entre agences, perspectives de management.
Nos valeurs : convivialité & esprit d'équipe / exigence & bienveillance / engagement & persévérance.
Avec O2MAX, chaque mission est une aventure collective où consultants et clients grandissent ensemble.
Le poste :
Pour le compte d'un grand groupe du secteur des transports et des infrastructures, nous recherchons un(e) Ingénieur(e) IA Générative & Back-End afin de concevoir et industrialiser une plateforme souveraine d'IA générative dédiée à l'analyse documentaire, contractuelle et juridique.
Contexte & Objectifs :
Intégré(e) au pôle innovation et digital, votre rôle consistera à bâtir un socle technique IA local robuste, sécurisé et performant, basé sur des modèles Open Source, des architectures RAG avancées et des systèmes multi-agents.
Missions principales :

  • Concevoir, développer et sécuriser les API REST et microservices (Python / FastAPI) soutenant la plateforme.
  • Déployer et optimiser des modèles LLM Open Source en environnement local/on-premise (vLLM, Llama.cpp) et orchestrer les flux (LangChain, LangGraph).
  • Mettre en œuvre les pipelines d'ingestion, OCR, indexation sémantique, bases vectorielles et stratégies de prompt engineering pour le traitement de documents complexes (PDF, Office, images).
  • Structurer les flux ETL de préparation et d'enrichissement de données, intégrer les bases SQL/NoSQL.
  • Optimiser la latence, l'usage des ressources GPU/CPU, la mémoire et le cache ; mettre en place le monitoring, les logs et la CI/CD.
  • Garantir la sécurisation des flux, le respect des normes cyber internes et la conformité RGPD liée aux données sensibles.
  • Collaborer avec les équipes métiers pour traduire leurs besoins en spécifications techniques et animer les ateliers projet.
Profil recherché :
Profil recherché
Compétences techniques clés :
Langages & Frameworks : excellente maîtrise de Python et FastAPI.
IA Générative & LLM : solides acquis sur les modèles Open Source (Mistral, Llama, Qwen'), RAG avancé, embeddings, vector stores, fine-tuning et architectures multi-agents.
Moteurs d'inférence & Déploiement : vLLM, Llama.cpp, gestion des environnements GPU, Docker, Linux (Kubernetes apprécié).
Data & Systèmes : modélisation SQL et NoSQL, pipelines ETL, files de messages/traitements asynchrones.
DevOps & Outils : GitLab CI, tests automatisés, Jira, méthodologies Agile (Scrum/Kanban).
Qualités relationnelles :
  • Capacité à vulgariser et faire le pont entre enjeux métiers et contraintes techniques.
  • Rigueur d'ingénierie logicielle et sens aigu de l'organisation.
  • Esprit d'équipe, aisance rédactionnelle et esprit de synthèse.

Exigences du poste

Stack technique :

PythonJavaAngularFastAPIDockerKubernetesGitLab CILLMLangChainRAGPrompt EngineeringFine-tuningGitLabMicroservicesJiraScrumKanbanAgileC++Artificial IntelligenceGenAIMistral AI

Plan d'action

Un plan personnalisé pour postuler intelligemment à cette offre.

À propos de l'entreprise

Voir toutes les offres de O2MAX

Publié par

Recruteur
Recruteur

Intéressé par cette offre ?

Cliquez sur "Postuler" pour accéder à l'offre.