Identification des motifs textuels. Entre statistique et deep learning

(2025) Corpus — n° 27, p. 1-22 (2025)

Files

corpus-10326.pdf
  • Open Access
  • Adobe PDF
  • 1.21 MB

Details

Authors
Abstract
A partir d’un exemple précis, à savoir le De Bello Gallico de César, le présent article vise à faire le point, sans prétendre à l’exhaustivité, sur les différentes techniques de détection des “motifs textuels” existant aujourd’hui. Le corpus latin utilisé sera celui des fichiers du Laboratoire d’Analyse Statistique des Langues Anciennes (LASLA) de l’Université de Liège qui offrent une lemmatisation et une analyse morphosyntaxique vérifiées de chaque forme des textes. L’étude confrontera principalement les possibilités que le Logiciel Hyperbase Web Edition (Vanni 2024) offre en matière des motifs à celles d’autres logiciels en libre accès. Elle explorera diverses méthodes de fouilles de données ou d’analyses statistiques et s’intéressera également à l’apport que l’intelligence artificielle peut avoir en la matière.
Affiliations

Citations

Longrée, D., & et al. (2025). Identification des motifs textuels. Entre statistique et deep learning. Corpus, 27, 1-22. https://doi.org/10.4000/13woj (Original work published 2025)