OmDev Logo
GetYourJob
0
Publié il y a 107 jours

Alternant.e Data Engineer H/F

Entreprise
Groupe VYVRecrute en direct
Localisation
Paris, Ile-de-France, France
Sur site
Type de contrat
Alternance
Niveau
Junior

Salaire du marché

Médiane du marché
56k€
Estimation
53k€fourchette habituelle68k€

Cette offre n'affiche pas de salaire. D'après 13 offres pour ce poste (Junior, Paris), le marché se situe autour de 56k€ (53k€–68k€).

0vues
0clics

Description du poste

Description du poste et Missions

1. Mise en place d’une documentation automatique des données

  • Extraire les métadonnées depuis Greenplum (tables, colonnes, volumétrie)
  • Concevoir un générateur de documentation (Markdown / HTML)
  • Produire un dictionnaire de données lisible et maintenable
  • Mettre à jour automatiquement la documentation


2. Documentation des pipelines data (XDI)

  • Analyser les flux développés dans Semarchy xDI
  • Extraire les informations clés des pipelines (sources, cibles, transformations)
  • Reconstituer un lineage simplifié des données : source → staging → datamart
  • Générer une documentation standardisée des flux


3. Enrichissement automatisé (IA encadrée)

  • Générer des descriptions automatiques de tables et pipelines
  • Résumer des transformations SQL en langage compréhensible
  • Améliorer la lisibilité de la documentation (validation humaine requise)


4. Mise en place de contrôles qualité (option selon avancement)

  • Définir des règles de qualité des données :
    complétude, cohérence, unicité
  • Implémenter des tests automatisés sur les pipelines
  • Produire un reporting des anomalies


5. Optimisation des performances

  • Analyser les requêtes SQL dans Greenplum
  • Optimiser : indexation, partitionnement, distribution des données
  • Mesurer les gains de performance et formaliser les bonnes pratiques


6. Contribution au Data Catalog

  • Alimenter OpenMetadata : descriptions de tables documentation des flux, liens entre données et pipelines
  • Participer à la structuration de la gouvernance data


Livrables attendus

  • Scripts d’extraction des métadonnées (BDD & pipelines)
  • Générateur de documentation automatique
  • Documentation des données et des flux
  • Optimisations SQL documentées
  • Guide d’utilisation et bonnes pratiques

Profil recherché

 

Vous préparez une formation de niveau Bac+3 à Bac+5 en Informatique, Data, Statistiques ou dans un domaine équivalent.

Vous êtes reconnu(e) pour :

  • Votre rigueur et votre sens du détail,
  • Votre esprit d’analyse et votre capacité à résoudre des problématiques complexes,
  • Votre capacité à structurer, documenter et fiabiliser vos travaux,
  • Votre curiosité pour les sujets liés à la data et à l’intelligence artificielle,
  • Votre capacité à travailler en équipe et à collaborer avec différents interlocuteurs.
  • Vous disposez de bonnes bases en SQL et possédez idéalement des connaissances en data engineering (ETL, pipelines de données).

Des notions en Python ou dans un langage de scripting constitueraient un atout supplémentaire.

Si vous souhaitez développer vos compétences dans les domaines de la data, de l’automatisation et de l’exploitation des données, alors cette alternance est faite pour vous !

Le groupe MGEN s’engage pour la Diversité et le Handicap et garantit l’égalité des chances. Nos postes sont ouverts à toutes et tous.
 

Exigences du poste

Stack technique :

SQLPython

Plan d'action

Un plan personnalisé pour postuler intelligemment à cette offre.

À propos de l'entreprise

Groupe VYVRecrute en direct
Voir toutes les offres de Groupe VYV

Publié par

Recruteur
Recruteur

Intéressé par cette offre ?

Cliquez sur "Postuler" pour accéder à l'offre.