Dans le cadre de la finalisation d'un outil interne de prévision de trafic, nous recherchons un Data Scientist Fonctionnel / Développeur Python Senior afin de reprendre un développement existant, compléter les fonctionnalités restantes et assurer son intégration dans un environnement Data moderne.
L'outil, déjà développé à environ 80 %, permet d'estimer le potentiel de nouvelles lignes grâce à des modèles statistiques, des algorithmes de simulation et des analyses de données. La mission consiste à finaliser les développements, optimiser les performances de la solution et garantir son déploiement dans l'environnement Data de l'entreprise.
En tant que Data Scientist Fonctionnel / Développeur Python, vous interviendrez sur l'ensemble du cycle de finalisation de la solution.
Vos principales missions seront les suivantes :
Finaliser le développement des modules de calcul liés à la modélisation du Quality of Service Index (QSI), notamment sur les scénarios de correspondance.
Concevoir et améliorer les modèles de simulation et les algorithmes de prévision.
Développer et optimiser les pipelines de données afin d'automatiser l'alimentation de l'application.
Lire, comprendre, maintenir et améliorer le code existant (Python et VBA).
Corriger les anomalies et optimiser les performances globales de l'application.
Développer de nouvelles fonctionnalités (historisation, sauvegarde/chargement, synthèse des résultats, gestion des hypothèses, séparation des résultats par saison, etc.).
Intégrer la solution dans l'environnement Data de l'entreprise.
Participer aux phases de tests, validation, industrialisation et déploiement.
Collaborer avec les équipes métier et les équipes Data afin de garantir la bonne adéquation entre les besoins fonctionnels et les développements techniques.
Identifier des pistes d'amélioration des modèles analytiques et des processus existants.
Produire la documentation technique et fonctionnelle ainsi que le guide utilisateur.
Finaliser les 20 % restants de l'outil de prévision.
Industrialiser les traitements et automatiser les flux de données.
Optimiser les modèles statistiques et les performances de calcul.
Garantir un déploiement robuste dans l'environnement Cloud Data.
Fournir un outil fiable, maintenable et facilement exploitable par les utilisateurs métiers.
Améliorer l'expérience utilisateur grâce à de nouvelles fonctionnalités et une meilleure ergonomie.
Python 3.11
Scikit-Learn
Statsmodels
Pandas
NumPy
Matplotlib
Streamlit
Streamlit-AgGrid
MLflow
Modélisation statistique
Régression
Corrélation
Optimisation de modèles analytiques
SQL
Spark SQL
PySpark
Databricks
Azure Cloud
Docker
CI/CD
Automatisation des pipelines de données
Streamlit
OpenPyXL
PyArrow
FastParquet
TimezoneFinder
Selenium
Spyder
MATLAB
Web Scraping
Lecture et maintenance de code VBA
Power BI
Matplotlib
Seaborn
Agile
Analyse fonctionnelle
Documentation technique
Qualification des besoins métiers
Anglais courant.
Formation Bac+5 (École d'ingénieur, Université ou équivalent).
Solide expérience en Data Science, Développement Python et Data Engineering.
Excellente maîtrise de Python et de son écosystème Data.
Expérience sur des environnements Azure Cloud et Databricks.
Bonne connaissance des pipelines de données, de l'automatisation et des pratiques CI/CD.
Capacité à reprendre un projet existant, comprendre rapidement un code complexe et le faire évoluer.
Esprit analytique, autonomie et capacité à être force de proposition.
Aisance dans les échanges avec les équipes métiers afin de traduire les besoins fonctionnels en solutions analytiques.
Une expérience dans le secteur du transport, de la mobilité ou de l'aérien constitue un véritable atout.
Un plan personnalisé pour postuler intelligemment à cette offre.
Cliquez sur "Postuler" pour accéder à l'offre.