Basé sur 40 offres pour ce poste (Senior, Île-de-France, 3 dernières semaines). Fourchette habituelle 445€/j–550€/j, médiane 480€/j. Cette offre (640€/j) est au-dessus de la fourchette.
Descriptif
La prestation de « Data Engineer senior» consiste à développer des ETL/ELT sous GCP et Cloudera onPrem, maintenir en condition opérationnelle un socle Spark Hadoop développé en Java, tout en participant à un chantier de réécriture en Scala ou PySpark.
Missions :
Concevoir, développer et mettre en œuvre des pipelines ETL/ELT robustes et performants pour ingérer, transformer et charger des données structurées et non structurées.
Développer des solutions de traitement de données à grande échelle en utilisant Scala et PySpark sur les environnements GCP (CF, Cloud run, Dataproc, BigQuery, Cloud Storage) et/ou Cloudera (HDFS, Spark, Hive, Ranger, kerberos).
Participer à la conception et à l'évolution de l'architecture de données, en assurant la cohérence, la performance et la sécurité.
Optimiser les requêtes et les performances des jobs de traitement de données.
Mettre en place et maintenir des processus de qualité des données et de monitoring.
Collaborer étroitement avec les architectes, le Techlead, les Analystes de données et les autres parties prenantes pour comprendre leurs besoins et y répondre efficacement.
Écrire du code propre, maintenable et bien documenté.
Participer aux revues de code et aux bonnes pratiques de développement.
Assurer le déploiement, la configuration et la maintenance des outils et plateformes de données.
Résoudre les problèmes techniques liés aux flux de données et aux plateformes.
Un plan personnalisé pour postuler intelligemment à cette offre.
Cliquez sur "Postuler" pour accéder à l'offre.