Abstract
Cet article plaide en faveur de la compilation de petits corpus, rassemblés manuellement, riches en données contextuelles pour la recherche, l’enseignement et l’apprentissage en anglais de spécialité (ASP) et en anglais universitaire. Les grands corpus, comme le British National Corpus, des corpus plus récents tirés de la Toile et la Toile elle-même constituent des sources d’information essentielles sur le lexique et la grammaire de l’anglais général. Il est possible de recueillir sur la Toile des documents sur des sujets spécifiques, relevant de domaines précis et comportant des traits linguistiques associés à des genres spécifiques. Cependant, de nombreux textes intéressant les praticiens de l’ASP ou de l’anglais universitaire ne figurent pas dans les grands corpus ou bien sont sous-représentés, compilés sans prendre en compte les informations contextuelles dont les praticiens de l’ASP ou de l’anglais universitaire ont besoin pour comprendre les choix linguistiques des locuteurs et des rédacteurs. Cet article suggère qu’il convient de s’inspirer de l’analyse des besoins pour construire des corpus adaptés : à travers plusieurs exemples, il montre la façon dont des informations contextuelles peuvent être ajoutées aux corpus sous la forme d’annotations textuelles ou d’annexes.This paper presents the case for compiling small, manually-sampled corpora, rich in contextual information, for research, teaching and learning in English for Specific Purposes (ESP) and English for Academic Purposes (EAP). Large datasets such as the British National Corpus, more recent web-derived corpora, and the web itself are major sources of information about the lexis and grammar of general English, and progress has been made in automatic corpus compilation methods; it is possible to mine the internet for documents on specified topics, within specified domains, and with the linguistic features associated with particular genres. Many types of text which are of interest to ESP and EAP practitioners are absent from these general corpora, however, or are under-represented. Their compilation methods do not capture all the background information ESP and EAP practitioners need in order to understand the linguistic choices speakers and writers make. This paper suggests that the process of designing a good corpus for ESP or EAP is similar to the process of needs analysis, and illustrates this process with examples from various corpus projects, showing how contextual information can be added to corpora in the form of textual annotations or as supplementary material.
Cite
CITATION STYLE
Nesi, H. (2015). ESP corpus construction: a plea for a needs-driven approach. ASp, 68, 7–24. https://doi.org/10.4000/asp.4682
Register to see more suggestions
Mendeley helps you to discover research relevant for your work.