L’objectif du stage est de développer un assistant intelligent capable d’automatiser l’organisation et l’exploration d’une bibliothèque scientifique.
Les fonctionnalités visées incluent notamment :
• l’import automatique de documents scientifiques (PDF, BibTeX, Zotero, etc.) ;
• l’extraction par mots-clefs et résumés ;
• la classification automatique des articles par thématique ;
• la génération dynamique d’une arborescence documentaire ;
• la recherche basée sur le contenu des publications.
Le(la) stagiaire sera amené(e) à étudier l’état de l’art des méthodes existantes de classification documentaire et de recherche sémantique afin de mettre en place une structuration des données bibliographiques.
Le développement des algorithmes pourra se faire à partir des outils Python afin de catégoriser automatiquement les publications.
La conception d'une interface intuitive sera également visée durant ce stage afin d'assurer la navigation et la recherche par mot-clefs dans la bibliothèque.
Conformément aux engagements pris par le CEA en faveur de l'intégration des personnes handicapées, cet emploi est ouvert à toutes et à tous. Le CEA propose des aménagements et/ou des possibilités d'organisation pour l’inclusion des travailleurs handicapés.
Participant à la protection nationale, une enquête administrative est réalisée pour tous les collaborateurs du CEA afin d'assurer l'intégrité et la sécurité de la nation.
Python, manipulation de base de données, notion de développement logiciel, curiosité pour l'IA et le traitement du langage. Des connaissances préalables en intelligence artificielle et en traitement automatique du langage constituent un atout. Autonomie, sens de l'organisation, curiosité, sens pratique, esprit d’équipe, bonne communication orale et écrite (français/anglais).
Programmation Python
Bac+4/+5
Un plan personnalisé pour postuler intelligemment à cette offre.
Cliquez sur "Postuler" pour accéder à l'offre.