Cette offre n'affiche pas de salaire. D'après 39 offres pour ce poste (Senior, Île-de-France), le marché se situe autour de 480€/j (445€/j–550€/j).
Concevoir et développer des pipelines de données sur Databricks (PySpark, Spark SQL, Delta Live Tables).
Mettre en place des architectures Lakehouse basées sur Delta Lake.
Industrialiser les workflows ETL/ELT avec Databricks Workflows.
Administrer les environnements Databricks (workspaces, clusters, permissions).
Optimiser les coûts via la configuration, l'autoscaling et le monitoring des clusters.
Mettre en œuvre les bonnes pratiques de sécurité (Unity Catalog, gestion des accès, lineage).
Déployer des mécanismes de contrôle qualité et de validation des données (expectations, tests).
Documenter les modèles de données et les flux.
Garantir la fiabilité, la disponibilité et la fraîcheur des données.
Collaborer avec les équipes Data, Analytics, IA et les métiers.
Accompagner les utilisateurs dans l'adoption de la plateforme Databricks.
Participer aux revues de code, à la standardisation des développements et au partage des bonnes pratiques.
Excellente maîtrise de PySpark et/ou Spark SQL.
Expérience significative sur Databricks (pipelines, notebooks, clusters, Unity Catalog).
Bonne connaissance des architectures Lakehouse.
Solides compétences en ETL/ELT, modélisation de données et ingestion batch/streaming.
Expérience sur un environnement Cloud (Azure, AWS ou GCP).
Maîtrise de Git et des outils de CI/CD (Azure DevOps, GitHub Actions ou équivalent).
Connaissances de MLflow et des pratiques MLOps.
Sensibilité aux approches DataOps, à l'optimisation des coûts et au monitoring.
Expérience avec les APIs et les flux temps réel (Kafka ou technologies similaires).
Bac+5 en informatique, data ou équivalent.
2 à 5 ans d'expérience en Data Engineering, avec une expertise sur Databricks.
Esprit d'équipe, autonomie, rigueur, bonnes capacités de communication et goût pour la documentation.
Un plan personnalisé pour postuler intelligemment à cette offre.
Réinventer l’avenir : l’innovation humaine au cœur de la technologie 🚀 Quelques chiffres clés 30+ clients accompagnés 25+ experts data & IA 2.6 M€ de chiffre d’affaires 2 centres d’expertise 100+ formations par an 15% du CA investi en R&D 🧠 Notre mission Placer l’humain au cœur de la donnée pour créer des solutions intelligentes, responsables et à impact, en alliant expertise technologique, innovation et agilité. 🧩 Nos domaines d'expertise Stratégie data & gouvernance Transformation & qualité de la donnée Ingénierie Big Data Science des données & IA DevOps & automatisation Formation & acculturation data 💡 Nos services Diagnostic de maturité Roadmap IA & data IA générative & éthique Automatisation intelligente Analyse prédictive Data visualisation & UX Gouvernance & qualité des données Architecture cloud & CI/CD 👥 Notre équipe 25+ experts data 10+ spécialistes en stratégie data 5 PhD R&D 5 formateurs certifiés 🧬 Notre méthodologie Customer-centric : solutions co-construites avec nos clients Approche Agile & itérative Expertise sur toute la chaîne de valeur data Autonomisation des équipes métiers 🔁 Cycle de vie de la donnée Collecte multi-source Qualité & préparation Visualisation & dataviz Analyse prédictive & IA Déploiement automatisé (CI/CD) 🎓 Craftmandata Académie Formations inter/intra-entreprise Distanciel ou présentiel Modules sur l’IA, Cloud, DataViz... Formation de "champions métiers" 🧪 Craftmandata Lab – L’innovation concrète 15% du CA dédié à la R&D Projets internes : IA de qualité de données Détection de fraude Classification automatique NLP sur verbatims clients Suivi de la mixité & égalité Calcul de bilan carbone numérique 🛠 Notre écosystème technologique Cloud & microservices Big Data & NoSQL Machine Learning & Deep Learning VueJS, Redis, API, ELT/ETL Outils low/no-code Datalake, Data Catalog, DataViz 🌍 Nos clients & secteurs Banque | Assurance | Industrie | Énergie | Retail | Télécom | Transport
Voir toutes les offres de CraftmanDataCliquez sur "Postuler" pour accéder à l'offre.