Part of speech n-grams and Information Retrieval
RésuméLes tentatives d’utilisation de connaissances linguistiques en recherche d’information (RI) ont commencé dans les années 1980 et se sont développées dans les années 1990, en mettant en évidence des améliorations de performance (voir les synthèses de Smeaton 1986 et 1999, Karlgren 1993, et Tait...
Gespeichert in:
Veröffentlicht in: | Revue française de linguistique appliquée 2008-06, Vol.XIII (1), p.9-22 |
---|---|
Hauptverfasser: | , |
Format: | Artikel |
Sprache: | eng |
Online-Zugang: | Volltext |
Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Zusammenfassung: | RésuméLes tentatives d’utilisation de connaissances linguistiques en recherche d’information (RI) ont commencé dans les années 1980 et se sont développées dans les années 1990, en mettant en évidence des améliorations de performance (voir les synthèses de Smeaton 1986 et 1999, Karlgren 1993, et Tait 2005). Depuis lors, ces tentatives sont allées décroissant : les performances des systèmes basiques se sont améliorées et le coût du traitement linguistique ne justifiait pas le petit bénéfice obtenu (Tait 2005). La plupart des recherches en linguistique pour la RI ont aujourd’hui tendance à se tourner vers les applications de domaines spécifiques, qui semblent mieux bénéficier de ces connaissances, comme les systèmes de question-réponse (Tait & Oakes 2006). Bien que ces applications soient importantes, elles ne couvrent pas toute la recherche en linguistique pour la RI. Dans cet article, nous présentons une autre utilisation de la linguistique, plus précisément des informations sur les catégories grammaticales, pour pondérer le contenu informatif de séquences de texte. Cette pondération est une nouvelle application de la linguistique en RI et peut améliorer la performance des systèmes en général. |
---|---|
ISSN: | 1386-1204 1875-368X |
DOI: | 10.3917/rfla.131.0009 |