Résumé: Les corpus connaissent aujourd’hui un succès grandissant, et ne sont plus l’apanage des linguistes de corpus. Ils nous renvoient l’image de la langue telle que la décrivait John Sinclair (1991): une bonne moitié de tous les textes est sans doute constituée d’unités phraséologiques au sens le plus large. Vouloir enseigner les langues étrangères sans tenir compte de cette composante majeure du langage est donc une gageure. Le recours aux corpus pour la didactique de la phraséologie est toutefois semé d’embûches : la fréquence des unités phraséologiques est faible, et il faut manipuler de très vastes corpus dans l’espoir de découvrir des exemples pertinents. Les simples concordances d’unités phraséologiques sont parfois contradictoires ou difficiles à interpréter ; enfin, les outils nécessaires à la manipulation d’aussi vastes collections de textes pêchent souvent par un manque de convivialité. Nous proposons de revenir à une notion déjà proposée par Michael Lewis en 1993 : la prise de conscience phraséologique, par le biais de confrontations nombreuses à des extraits de corpus, mais en mettant à profit de nouveaux outils qui doivent encore être perfectionnés. Nous proposons un tel outil expérimental, l’application IdiomSearch (J.-P. Colson 2016), qui offre aux apprenants un retour immédiat sur la présence d’unités phraséologiques dans un texte source, ainsi qu’une classification par fréquence et par figement. Abstract: Corpora are now having an ever increasing success, and are no longer the privilege of the only corpus linguists. They provide us with a picture of language as described by John Sinclair: around half of any text probably consists of phraseological units in the broadest sense. It would therefore be unrealistic to teach foreign languages without taking this aspect into account. However, the recourse to corpora for the didactics of phraseology is full of obstacles: the frequency of phraseological units is low, and huge corpora are necessary in the hope of finding relevant examples. Simple concordances of phraseological units are sometimes contradictory or hard to interpret; finally, the available tools for manipulating such vast collections of texts are not always user-friendly, and require that learners should have some gift for computing or statistics. In this paper we propose to build with new techniques on a notion introduced by Michael Lewis in 1993: phraseological awareness raising, based on a recurrent confrontation with corpus fragments. We also present such an experimental tool, the IdiomSearch application (J.-P. Colson 2016), that provides learners with an immediate feedback on the presence of phraseological units in an input text, as well a ranking on the basis of frequency and fixedness.
Colson, J.-P. (2017). A la croisée des corpus et de la phraséologie : une proposition d’outil informatique. Studii de Lingvistica, 7, 13-26. https://hdl.handle.net/2078.5/177375 (Original work published 2017)