Les syntagmes définis dans le TLFi : Normalisation et classification pour le traitement automatique des langues

Les recherches linguistiques ou de type TAL autour de la question de la phraséologie connaissent un renouveau accru depuis une dizaine d'années. Dans un contexte TAL, une ressource sur la phraséologie du français aurait de nombreux avantages utilisée en prétraitement pour améliorer le traitement des textes : étiquetage morphosyntaxique (TreeTagger), analyse syntaxique en constituants ou plus élaborée, annotation sémantique et profilage thématique, détection de candidats termes en texte intégral, etc. Du point de vue de la segmentation par exemple, une ressource en phraséologie du français enrichirait le lexique des expressions complexes. Dans cette proposition, nous décrirons comment nous avons construit la ressource TLFPHRASEO1 à partir de la ressource des syntagmes définis du TLFi, son état actuel ainsi que sa mise en oeuvre pour la reconnaissance de ces syntagmes en texte intégral.

Data and Resources

Additional Info

Field Value
Source https://shs.hal.science/halshs-00905422
Author Jacquey, Evelyne, Humbert, Jean-Marc, Heckler, Line
Maintainer CCSD
Last Updated May 8, 2026, 05:19 (UTC)
Created May 8, 2026, 05:19 (UTC)
Identifier halshs-00905422
Language fr
Rights https://about.hal.science/hal-authorisation-v1/
contributor Analyse et Traitement Informatique de la Langue Française (ATILF) ; Université de Lorraine (UL)-Centre National de la Recherche Scientifique (CNRS)
creator Jacquey, Evelyne
date 2013-11-29T00:00:00
harvest_object_id d8b6e8fa-4b87-49d0-ab5f-a1da6b27f9b2
harvest_source_id 3374d638-d20b-4672-ba96-a23232d55657
harvest_source_title test moissonnage SELUNE
metadata_modified 2025-11-04T00:00:00
set_spec type:UNDEFINED