Extraction automatique des mots-clés à partir de publications scientifiques pour l’indexation et l’ouverture des données en agronomie - LIRMM - Laboratoire d’Informatique, de Robotique et de Microélectronique de Montpellier
Journal Articles Cahiers Agricultures Year : 2015

Automatic extraction of keywords from scientific publications for indexing and open data in agronomy

Extraction automatique des mots-clés à partir de publications scientifiques pour l’indexation et l’ouverture des données en agronomie

Abstract

With the large amounts of textual data related to agriculture now available, indexing becomes a crucial issue for research organizations. One way to index documents consists in extracting terminology. This paper investigates the use and combination of text mining methodologies to highlight and publish the most appropriate terms from documents in open data systems. Experiments conducted on CIRAD data, show the validity of the approach used to extract new and relevant terms.
Dans le contexte des masses de données textuelles liées à l’agriculture aujourd’hui disponibles, leur indexation devient un enjeu crucial pour les organismes de recherche. Une manière d’indexer au mieux les documents consiste à en extraire la terminologie. Cet article explore l’utilisation et la combinaison de méthodologies de fouille de textes afin de mettre en exergue, puis de publier dans des systèmes d’open data, les termes les plus adaptés issus de documents. Des expérimentations menées sur des données du CIRAD (Centre de coopération internationale en recherche agronomique pour le développement), montrent le bien-fondé de la démarche qui a permis d’extraire des termes à la fois nouveaux et pertinents.
Fichier principal
Vignette du fichier
Roche_CA_2015.pdf (469.42 Ko) Télécharger le fichier
Origin Publisher files allowed on an open archive
Loading...

Dates and versions

lirmm-01228700 , version 1 (13-11-2015)

Identifiers

Cite

Mathieu Roche, Sophie Fortuno, Juan Antonio Lossio-Ventura, Amira Akli, Salim Belkebir, et al.. Extraction automatique des mots-clés à partir de publications scientifiques pour l’indexation et l’ouverture des données en agronomie. Cahiers Agricultures, 2015, 24 (5), pp.313-320. ⟨10.1684/agr.2015.0773⟩. ⟨lirmm-01228700⟩
396 View
366 Download

Altmetric

Share

More