Agritrop
Accueil

Extraction automatique de termes combinant différentes informations

Lossio Ventura Juan Antonio, Jonquet Clément, Roche Mathieu, Teisseire Maguelonne. 2014. Extraction automatique de termes combinant différentes informations. In : Actes de la 21ème Conférence sur le Traitement automatique des langues naturelles (TALN'2014), 1-4 juillet 2014, Marseille, France. Brigitte Bigi (ed.). s.l. : s.n., 407-412. ISBN 978-2-9518233-6-5 Conférence sur le Traitement automatique des langues naturellles. 21, Marseille, France, 1 Juillet 2014/4 Juillet 2014.

Communication avec actes
[img]
Prévisualisation
Version publiée - Français
Utilisation soumise à autorisation de l'auteur ou du Cirad.
document_574178.pdf

Télécharger (328kB) | Prévisualisation

Résumé : Pour une communauté, la terminologie est essentielle car elle permet de décrire, échanger et récupérer les données. Dans de nombreux domaines, l'explosion du volume des données textuelles nécessite de recourir à une automatisation du processus d'extraction de la terminologie, voire son enrichissement. L'extraction automatique de termes peut s'appuyer sur des approches de traitement du langage naturel. Des méthodes prenant en compte les aspects linguistiques et statistiques proposées dans la littérature, résolvent quelques problèmes liés à l'extraction de termes tels que la faible fréquence, la complexité d'extraction de termes de plusieurs mots, ou l'effort humain pour valider les termes candidats. Dans ce contexte, nous proposons deux nouvelles mesures pour l'extraction et le "ranking" des termes formés de plusieurs mots à partir des corpus spécifiques d'un domaine. En outre, nous montrons comment l'utilisation du Web pour évaluer l'importance d'un terme candidat permet d'améliorer les résultats en terme de précision. Ces expérimentations sont réalisées sur le corpus biomédical GENIA en utilisant des mesures de la littérature telles que C-value.

Classification Agris : C30 - Documentation et information
000 - Autres thèmes

Auteurs et affiliations

  • Lossio Ventura Juan Antonio, LIRMM (FRA)
  • Jonquet Clément, LIRMM (FRA)
  • Roche Mathieu, CIRAD-ES-UMR TETIS (FRA) ORCID: 0000-0003-3272-8568
  • Teisseire Maguelonne, LIRMM (FRA)

Source : Cirad - Agritrop (https://agritrop.cirad.fr/574178/)

Voir la notice (accès réservé à la Dist) Voir la notice (accès réservé à la Dist)

[ Page générée et mise en cache le 2022-04-19 ]