OmDev Logo
GetYourJob
0
Publié hier

Consultant Technique Confirmé AI (H/F)

Entreprise
Localisation
Saint-Ouen, Centre-Val de Loire
Hybride
Type de contrat
CDI
Niveau
Confirmé

Salaire du marché

Médiane du marché
45k€
Estimation
41k€fourchette habituelle53k€

Cette offre n'affiche pas de salaire. D'après 69 offres pour ce poste (Confirmé, France), le marché se situe autour de 45k€ (41k€–53k€).

Salaire du marché pour Consultant (Confirmé) en France : médiane 45 000 €/an, P25–P75 : 40 500–52 500 €/an, n = 69 offres. Salaire Python à Paris

Baromètre TJM et salaires IT

Description du poste

  • Concevoir, entraîner, optimiser et déployer des modèles de Machine Learning et Deep Learning (NLP, LLM, embeddings).
  • Développer et maintenir des pipelines ML robustes (entraînement, évaluation, monitoring, CI/CD).
  • Construire des architectures RAG incluant : ingestion de documents, stratégie de chunking, embeddings, vector stores, pipelines de retrieval & génération.
  • Implémenter des applications LLM avec LangChain / LangGraph (agents, tools, retrievers, flows).
  • Déployer des microservices IA (API FastAPI / Flask) et gérer leur scalabilité en production.
  • Optimiser l'inférence et les performances : latence, consommation GPU, parallélisation, batching.
  • Collaborer avec les équipes Data Engineering, Produit et Dev pour industrialiser les solutions.
  • Surveiller les modèles en production (drift, performance, dérive des données).
  • Excellente maîtrise de Python (structuration du code, tests unitaires, design patterns).
  • Expertise en NLP / Deep Learning : PyTorch, TensorFlow, Transformers (HuggingFace).
  • Expérience concrète sur des projets LLM, fine‑tuning, prompt engineering.
  • Maîtrise des architectures RAG : embeddings, vector stores (FAISS, Chroma, Milvus…), retrieval.
  • Expérience sur LangChain / LangGraph / LlamaIndex.
  • Solide niveau en API engineering : FastAPI, Flask.
  • Connaissances MLOps :
  • Docker, CI/CD (GitLab, GitHub Actions, Azure DevOps…)
  • MLflow, Weights & Biases, DVC
  • Kubernetes (souhaité), orchestration (Airflow / Prefect)
  • Maîtrise d’un cloud : AWS, GCP ou Azure (un plus si Azure OpenAI, Bedrock, Vertex AI).
Compétences appréciées :
  • Connaissance des bases vectorielles avancées (SHARED / HNSW / IVF).
  • Optimisation GPU, quantization (GPTQ, GGUF, vLLM).
  • Expérience en ingestion de documents (OCR, parsing PDF/HTML).
  • Expérience LLMOps (observabilité, monitoring, guardrails).
Profil attendu :
  • Autonomie & pragmatisme : capable de poser un diagnostic, proposer une solution et la livrer.
  • Culture GenAI & LLM : curiosité forte, veille active, envie d’expérimenter et d’améliorer en continu.
  • Collaboration fluide : bon communicant, à l’aise avec les équipes Produit, Data et Software.
  • Orientation impact : focus sur le concret, la performance et la valeur métier plutôt que l’expérimentation théorique.

Exigences du poste

Compétences requises

  • Google Cloud Platform
  • LlamaIndex
  • Airflow
  • Weights & Biases
  • Flask
  • LLM
  • Artificial Intelligence
  • Monitoring / Observability
  • MLOps
  • Microservices
  • Data Engineering
  • Design Patterns
  • Python
  • FastAPI
  • Machine Learning
  • Deep Learning
  • TensorFlow
  • PyTorch
  • Docker
  • Kubernetes
  • AWS
  • Azure
  • CI/CD
  • LangChain
  • Hugging Face
  • GitHub Actions
  • GitLab CI
  • Azure DevOps
  • Fine-tuning
  • Vertex AI
  • Prompt Engineering
  • RAG
  • OpenAI API
  • Tests unitaires
  • DevOps
  • MLflow
  • Milvus
  • Transformers
  • Prefect
  • FAISS
  • HTML
  • NLP

Un plus

  • LangGraph
  • Agentic AI / Agents IA
  • API Development
  • QA Testing
  • Chroma
  • GitLab
  • GitHub
  • Cloud
  • vLLM
  • LLMOps
  • GenAI

Toutes les offres Python à Paris

Plan d'action

Un plan personnalisé pour postuler intelligemment à cette offre.

À propos de l'entreprise

Voir toutes les offres de Inetum

Publié par

Recruteur
Recruteur

Intéressé par cette offre ?

Cliquez sur "Postuler" pour accéder à l'offre.