Cette étude envisage l’emploi des unités polylexicales (UPs) comme prédicteurs dans une formule de lisibilité pour le français langue étrangère. À l’aide d’un extracteur d’UPs combinant une approche statistique à un filtre linguistique, nous définissons six variables qui prennent en compte la densité et la probabilité des UPs nominales, mais aussi leur structure interne. Nos expérimentations concluent à un faible pouvoir prédictif de ces six variables et révèlent qu’une simple approche basée sur la probabilité moyenne des n-grammes des textes est plus efficace.
François, T., & Watrin, P. (2011). Quel apport des unités polylexicales dans une formule de lisibilité pour le français langue étrangère ? In Lafourcade, M. et Prince, V. (ed.), Actes de la 18e Conférence sur le Traitement automatique des Langues Naturelles (TALN 2011) (pp. 15-20). https://hdl.handle.net/2078.5/268522