Basé sur 26 offres pour ce poste (Mid, Île-de-France, 3 dernières semaines). Fourchette habituelle 425€/j–540€/j, médiane 460€/j. Cette offre (550€/j) est au-dessus de la fourchette.
Description du besoin :
Data Engineer – Plateforme Data AWS / Snowflake
Client : Grand Groupe Industriel International
Localisation : Magny-les-Hameaux (78) + déplacements ponctuels Malakoff (92)
Télétravail partiel : 2 jours / semaine
Démarrage idéal : ASAP
Contexte
Dans le cadre de la transformation digitale d’un grand groupe industriel international, les équipes Data renforcent leur plateforme de valorisation des données afin d’améliorer l’exploitation des données internes et externes du groupe.
Cette plateforme permet notamment d’ingérer, traiter et mettre à disposition de larges volumes de données provenant de multiples fournisseurs et systèmes métiers afin d’alimenter différents cas d’usage : connaissance des marchés, analyse des usages produits et maintenance prédictive.
Dans ce contexte, une refonte et une migration de la plateforme Data vers une nouvelle architecture cloud sont engagées afin de simplifier l’architecture existante, améliorer la performance et réduire les coûts d’exploitation.
Le consultant intégrera une équipe Data organisée en mode Agile composée de Data Engineers, Data Scientists, Data Analysts et Product Owners, et interviendra sur la conception, l’industrialisation et l’optimisation des pipelines de traitement de données.
Environnement technique :
AWS (S3, Lambda, API Gateway)
Snowflake
Airflow
Terraform
Gitlab CI/CD
Formats Iceberg / Parquet
Architecture Data Lake / Data Platform
Traitement de données volumineuses
Objectif de la mission
Le client recherche un Data Engineer confirmé capable de concevoir et d’industrialiser des pipelines de traitement de données dans un environnement cloud.
Le consultant interviendra sur les projets nécessitant l’ingestion, la transformation et la mise à disposition de volumes importants de données au sein de la plateforme Data du groupe.
Ses missions principales seront :
-concevoir et maintenir les pipelines de traitement de données
-structurer les modèles et formats de données
-garantir la qualité et la cohérence des données intégrées dans la plateforme
-automatiser les chaînes de traitement et les déploiements
-accompagner les équipes Data dans l’exploitation et l’industrialisation des solutions
Le consultant participera également aux rituels Agile et contribuera à l’évolution de l’architecture et des bonnes pratiques de la plateforme Data.
Prestations attendues
Data Engineering & Architecture Data
Cartographie et documentation des sources de données
Conception et optimisation des pipelines de traitement de données
Structuration des bases de données et des modèles de données
Conception d’architectures de traitement de données à grande échelle
Optimisation des flux et des performances de traitement
Intégration & Qualité des données
Ingestion et stockage sécurisé de données externes
Supervision des flux de données multi-sources
Contrôle et amélioration de la qualité des données
Nettoyage, transformation et validation des datasets
Gestion des référentiels de données
Industrialisation & Automatisation
Automatisation des pipelines de traitement de données
Industrialisation des déploiements via CI/CD
Orchestration des traitements avec Airflow
Contribution à l’industrialisation des modèles et algorithmes ML
Gouvernance & Delivery
Participation aux rituels Agile (daily, sprint planning, rétrospectives)
Collaboration avec Data Scientists et Data Analysts
Contribution aux standards et bonnes pratiques Data
Suivi et reporting des activités
Livrables attendus
Dossiers d’architecture Data
Pipelines et services de traitement de données industrialisés
Cartographie des sources et flux de données
Documentation technique des pipelines et architectures
Dispositifs de contrôle et de qualité des données
Rapports d’activité et suivi des développements
Un plan personnalisé pour postuler intelligemment à cette offre.
Cliquez sur "Postuler" pour accéder à l'offre.