Full text
Simões, Barreiro, Santos, Sousa-Silva & Tagnin (eds.) Linguística, Informática e Tradução : Mundos que se Cruzam, Oslo Studies in Language 7(1), 2015. 21–37. (ISSN 1890-9639 / ISBN 978-8291398-12-9) http://www.journals.uio.no/osla corpógrafo, terminologie, phraséologie FRANÇOISE BACQUELAINE abstract The Corpógrafo results from interdisciplinary collaboration between linguists and computer engineers under Belinda Maia’s direction. This userfriendly tool for building and using tailor-made corpora allows not only for terminology extraction and management, but also for any research based on monolingual, comparable or parallel corpora. This paper presents the Corpógrafo’s evolution from the first to the fourth version, and two experiences of its use in three languages (English, French and Portuguese). The first experience is in the field of Bluetooth technology terminology extraction and management. The second deals with four Portuguese structures containing the universal quantifier cada and expressing progression, «dropper», proportion between two sets of events or entities and proportion between a set and a subset of events or entities. These experiences show the strengths, weaknesses and limits of the Corpógrafo. [1] introduction Le Corpógrafo, la Terminologie et la Phraséologie marquent les trois étapes d’un parcours sous la direction de Belinda Maia. Le Corpógrafo nous a été présenté en première année de master (Mestrado em Terminologia e Tradução) et a été utilisé dans le cadre d’un travail de groupe en Terminologie au deuxième semestre2005–2006pourproduireunebasede données terminologiques (BDT) dans le domaine des télécommunications sans fil. Cette initiation au Corpógrafo a déterminé la suite : mémoire de master en Terminologie (2006–2008, soutenance en janvier 2009) et découverte en 2009–2010, grâce au Corpógrafo, de l’objet linguistique de notre thèse de doctorat actuellement en cours. Le choix du Corpógrafo pour contribuer à cet hommage rendu à celle qui dirige nos recherches depuis bientôt dix ans s’est donc imposé. Dans un premier temps, nous nous inspirons d’un rapport de la Linguateca (Santos 2005) et de publications des membres de l’équipe de Porto pour retracer l’évolution du Corpógrafo depuis le Gestor de Corpora en 2003 (Sarmento & Maia 2003;Maia & Sarmento 2003), jusqu’à la quatrième et dernière version présentée en 2008 (Maia & Matos 2008)1. Une fois dressé le portrait du Corpógrafo, deux expériences de recherche sur corpus en contexte de formation sont présen1. D’autres sources consultées mais non citées figurent dans la bibliographie d’autres articles de cet ouvrage, dont la plupart sont disponible sur le site de la Linguateca à http://www.linguateca.pt/.
[22] françoise bacquelaine tées. L’une concerne l’élaboration d’une BDT trilingue (anglais, français, portugais) dans le domaine de la technologie de télécommunication sans fil Bluetooth. L’autre a révélé la prédominance du quantificateur universel portugais cada sur le quantificateur universel pluriel todos (os) dans certains corpus de spécialité, alors que each et chaque sont moins fréquents que all ou tous (les) en anglais et en français, quels que soient les corpus. Ces deux exemples illustrent bien deux des principales applications pédagogiques et scientifiques du Corpógrafo dans la perspective de l’utilisateur. [2] corpógrafo La genèse du Corpógrafo remonte à l’aube du XXIesiècle, sous l’impulsion de Belinda Maia, dans le cadre du jeune projet de la Linguateca, dont l’objectif principal est la mobilisation de ressources linguistiques et la conception d’outils de traitement automatique de la langue portugaise pour assurer sa pérennité parmi les langues informatisées et numérisées2. Le poloCLUP (pôle de Porto de la Linguateca) a entamé ses travaux en octobre 2002. L’équipe responsable de la conception etde l’adaptation duCorpógrafo aux besoinsde ses usagersdepuis 2002 estdirigée par Belinda Maia et Diana Santos, qui symbolisent la collaboration entre experts en Linguistique et en Génie informatique nécessaire à la création et au développementderessourcespourletraitement automatiquedes langues(TAL). L’évolution du Corpógrafo de 2003 à nos jours se divise en trois phases. La première, que l’on pourrait caractériser de préparatoire, correspond au Gestor de Corpora. Naît ensuite le Corpógrafo qui va évoluer de la version 1 à la version 3 de 2004 à 2007 essentiellement grâce aux efforts de Luís Sarmento, Luís Miguel Cabral, Ana Sofia Pinto et Débora Oliveira. La troisième phase correspond à la version 4 que l’on doit à Sérgio Matos sous la direction de Belinda Maia et Luís Costa. Le poloCLUP s’est éteint en 2008 et le bon fonctionnement du Corpógrafo dépend désormais de la bonne volonté de l’équipe composée de Belinda Maia, Diana Santos, Sérgio Matos et Luís Miguel Cabral. Le Gestor de Corpora (GC) a été présenté à Lancaster en mars 2003 (Maia & Sarmento 2003) et à Braga en juin 2003 (Sarmento & Maia 2003), soit à peine quelques mois après le lancement du projet. La volonté de créer un outil répondant aux besoins d’enseignants et d’étudiants de trois domaines principaux (linguistique, traduction et TAL) et d’impliquer les utilisateurs dans l’évolution du Corpógrafo a déterminé le choix d’une architecture modulaire extensible et adaptable aux besoins formulés par les utilisateurs. Le GC permettait à l’utilisateur de créer un compte privé sur le Web où il pouvait stocker des fichiers PDF, PS, HTML, RTF ou MsWord convertis en texte grâce au module Perl EXTEX, révolutionnaire à l’époque. D’autres modules lui permettaient d’effectuer d’autres opérations : (1) 2. Le pari semble gagné : «De acordo com estimativas recentes, o português é a quinta língua mais usada na internet, sendo ultraprassada apenas pelo inglês, chinês, espanhol e japonês» (Branco et al. 2012, pg. 14). OSLa volume 7(1), 2015
corpógrafo, terminologie, phraséologie [23] éditer le texte pour le «nettoyer» et le diviser de façon semi-automatique en segments, conformément aux besoins de l’utilisateur; (2) constituer un ou plusieurs corpus à partir de sélections de fichiers; (3) réaliser des études de fréquence et des recherches de collocations (Sarmento & Maia 2003, pg. 27). En 2004, grâce à son architecture modulaire, des outils d’extraction et de gestion terminologique ont pu être ajoutés aux fonctions du GC pour faciliter le travail du terminographe : le Corpógrafo était né (Sarmento et al. 2004). La structure actuelle du Corpógrafo se mettait en place. Le menu principal (figure 1) offre aujourd’hui quatre options, dont les deux premières sont héritées du GC : (1) «Gestor» (Gestionnaire) pour la création et la gestion de corpus ; (2) «Pesquisa» (Recherche) pour l’analyse de corpus selon divers types de requêtes; (3) «Centro de Conhecimento» (Centre de connaissance) pour la création et la gestion de bases de données et de relations sémantiques; (4) «Centro de comunicação» (Centre de communication) où l’utilisateur peut trouver des informations sur le Corpógrafo. Outre ces quatre options du menu principal donnant accès à diverses fonctions, l’utilisateur dispose de quatre boutons (figure 2) lui permettant (1) d’accéder à la corbeille de fichiers supprimés; (2) d’obtenir de l’aide sur la fonction qu’il est en train d’utiliser; (3) d’envoyer des commentaires; (4) d’éditer son profil. figure 1 : Menu principal (Version 4). figure 2 : Boutons (Version 4). Par rapport au GC, les fonctions de gestion de fichiers et de corpus de la première version du Corpógrafo ont été améliorées. L’utilisateur dispose d’un espace privé de 10 MB sur le serveur, non seulement pour stocker des fichiers et créer des corpus en recourant aux fonctions héritées du GC, mais aussi pour télécharger des sites à partir d’une adresse URL ou les explorer avant de sélectionner et de télécharger uniquement ce qui l’intéresse. Chaque fichier peut désormais être accompagné de métadonnées (titre, auteur, date, domaine de spécialité, type de texte, etc.). Certaines de ces métadonnées apparaissent automatiquement lors de certaines opérations d’analyse de corpus ou de constitution de base de données et elles permettent de classer les fichiers pour des recherches ultérieures. Chaque corpus est composé d’une sélection de fichiers qui peut être altérée à tout moment et le même fichier peut être intégré à plusieurs corpus. La figure 3illustre les différentes options du gestionnaire. OSLa volume 7(1), 2015
[24] françoise bacquelaine figure 3 : Options du gestionnaire (Version 4) L’option de recherche permet deux types de requête : l’une sur les n-grammes (co-occurrences d’un nombre paramétrable ‘n’ d’atomes), l’autre sur un mot, tel qu’un terme simple comme piconet, ou sur une séquence plus ou moins figée, telle qu’un terme complexe comme access request address. Dans le premier cas, l’utilisateur peut déterminer la longueur des n-grammes de 1 à 6 atomes (mots et signes de ponctuation). L’analyse de n-grammes permet d’obtenir des résultats absolus et relatifs sur la distribution des n-grammes dans le corpus analysé. Par exemple, une requête sur les 4-grammes du corpus Bluetooth en français (composé de 18 fichiers) nous apprend que le terme technologie sans fil Bluetooth y est attesté 40 fois, ce qui représente une fréquence de 0,026% 3de l’ensemble des 4-grammes attestés dan ce corpus (figure 4). En cliquant sur ce 4-grammes, on apprend qu’il n’est utilisé que dans 4 des 18 fichiers, ce qui implique qu’il existe des variantes de ce terme central (à savoir technologie Bluetooth ou, tout simplement, Bluetooth). Les résultats peuvent être exportés vers un fichier CVS qui peut être lu par un tableur du type Excel. Les résultats des requêtes sur des expressions simples ou complexes peuvent être obtenus sous différentes formes selon qu’on veuille les analyser en contexte («Concordância Frase») ou découvrir des collocations ou toute autre forme de co-occurrence («Concordância Janela» (Concordance Fenêtre) et «Concordância KWIC») (Sarmento et al. 2004, pg. 451). Les options «Concordância Frase» et «Concordância KWIC4» (figures 5et 6) donnent des résultats absolus et relatifs sur la distribution de l’expression de requête dans les divers fichiers du corpus et permettent d’accéder aux métadonnées du fichier de chaque occurrence (bouton «info»). 3. D’après nos calculs, cette fréquence est même plus élevée : 4000/110.961 = 0,36%. 4. Key Word In Context. OSLa volume 7(1), 2015
corpógrafo, terminologie, phraséologie [25] figure 4 : Requête sur n-grammes (Version 4) figure 5 : «Concordância Frase» (Version 4) Quant à l’option «Concordância Janela» (figure 7), elle permet de classer les résultats par ordre alphabétique d’après les atomes qui précèdent ou qui suivent l’expression de requête. La version 4 comporte une cinquième fonction permettant d’explorer des corpus parallèles, mais nous ne l’avons jamais utilisée. Mais ce qui a valu le changement de nom du GC, c’est bien la possibilité de créer et de gérer des BDT. L’extraction terminologique se fonde sur l’analyse de ngrammes et un ensemble de restrictions lexicales à partir d’un dictionnaire électronique. L’utilisateur peut créer des BDT dont le modèle se base sur la norme ISO 12620.Chaque«terme vedette»ou «entrée»delaBDTcorrespond àunefichecomportant divers champs pouvant être complétés ou non (langue, données morphologiques, source, définition, exemples en contexte, relations sémantiques avec OSLa volume 7(1), 2015
[26] françoise bacquelaine figure 6 : «Concordância Frase» (Version 4) figure 7 : «Concordância Frase» (Version 4) d’autres termes, équivalent(s) dans une ou plusieurs autres langues, etc.). À partir de ces données, le Corpógrafo crée automatiquement des glossaires au format HTML. Il peut aussi produire des thesauri au format HTML, en se fondant sur les relations sémantiques entre termes, et exporter ces informations vers un fichier dont le format permet de visualiser le réseau sémantique ainsi produit (ibidem). La version 2 est présentée l’année suivante à l’Université de Leeds (Maia & Sarmento 2005). De la mi-mai 2004 à la mi-mai 2005 (Santos 2005, pgs. 19–20), les efforts de Luís Sarmento se sont concentrés sur l’amélioration de la gestion terminologique (extraction semi-automatique de termes et de relations sémantiques, production de cartes conceptuelles à partir des relations sémantiques) et ceux de Luís Cabral sur l’interface SAGI, d’après une enquête auprès des utilisateurs, tandis que Débora Oliveira s’est chargée de l’adaptation de la documentation aux nouvelles fonctions du Corpógrafo. La division du menu principal en quatre options est présentée pour la première fois en 2006, alors que le Corpógrafo en est déjà à sa troisième version (Maia & Sarmento 2006, pg. 55). Si les fonctions de gestion et de recherche ont légèrement évolué lors de cette deuxième phase, les efforts se sont toutefois concentrés sur la semi-automatisation de l’extraction terminologique, de l’extraction de définitions et de l’identification de relations sémantiques (Sarmento et al. 2006, pgs. 1503–1504). OSLa volume 7(1), 2015
corpógrafo, terminologie, phraséologie [27] La fonction d’extraction semi-automatique des termes existait déjà dans la première version et a été décrite ci-dessus. Son avantage, c’est que le corpus n’a pas besoin d’être annoté. Cette fonction est plus performante sur de petits corpus hautement terminogènes que sur de grands corpus en raison du bruit important que ceux-ci produisent malgré les filtres mis en place en anglais et en portugais. Mais les progrès de la première à la troisième version sont plus sensibles au niveau de l’extraction semi-automatique de définitions et de l’identification semiautomatique de relations sémantiques qui étaient absentes de la version 1. Ces deux modules fonctionnent sur des stocks de structures5propres à introduire une définition ou une relation sémantique. Les stocks de structures «définitionnelles» sont assez importants pour l’anglais et le portugais (plus de 120 structures dans chaque langue). Cette fonction est plus efficace lorsque le corpus est composé de textes didactiques généralement riches en définitions. L’identification des relations sémantiques est plus complexe, non seulement parce qu’elles sont nombreuses et variées, mais aussi parce qu’elles sont souvent implicites (idem, pg. 1504). Les relations sémantiques peuvent également être établies manuellement et l’utilisateur peut créer d’autres relations que celles qui sont pré-définies selon ses besoins. La volonté de produire des ontologies et des thesauri de domaine de spécialité à partir de ces relations sémantiques était louable mais les résultats obtenus se sont révélés peu probants et la recherche sur ces fonctions ont été abandonnées. Laquatrième versiondu Corpógrafo secaractérise surtoutparl’intégration du moteur Nooj à plusieurs fonctions de recherche du Corpógrafo pour repérer des unités phraséologiques en anglais, en français et en portugais, et par l’insertion de fonctions permettant d’aligner des corpus parallèles et des segments de corpus comparables, de lancer des recherches sur ces corpus alignés et de créer des bases de données phraséologiques ou lexicales (Maia & Matos 2008, pgs. 80–81). La longueur des n-grammes peut désormais aller jusqu’à 15-grammes, la possibilité d’exporter les bases de données a été optimisée et il est possible d’obtenir des statistiques sur la fréquence des termes ou des éléments lexicaux à partir des bases de données ou de visualiser les relations sémantiques à partir de la fiche d’un terme (figure 8). Le Corpógrafo a ainsi évolué selon les objectifs de ses concepteurs et les besoins de ses utilisateurs. Aujourd’hui, il remplit la mission qui lui a été assignée : c’est un outil conçu prioritairement pour le traitement automatique du portugais accessible gratuitement à tout chercheur dont le travail comporte des recherches sur corpus, quel que soit son domaine et quelles que soient ses compétences informatiques. Les deux expériences décrites ci-dessous font apparaître certaines de ses failles et certains de ses atouts dans la perspective de l’utilisateur. 5. Des exemples de ces deux types de structures sont fournis par Sarmento et al. (2006, pg. 1503). OSLa volume 7(1), 2015
[28] françoise bacquelaine figure 8 : Relations sémantiques (Version 4) [3] terminologie Pour réaliser l’étude de néonymie comparée de la terminologie Bluetooth en anglais, en français et en portugais (Bacquelaine 2009)6, nous avons utilisé plusieurs fonctions des options «Gestor», «Pesquisa» et «Centro de Conhecimento» pour constituer une BDT à partir de corpus comparables sur mesure, pour obtenir des statistiques sur les termes et pour exporter la BDT vers un fichier consultable en dehors de l’outil7. Touterecherchecommenceévidemmentparlacréationd’unouplusieurs corpus à partir de fichiers8téléchargés au moyen des fonctions du «Gestor». La plupart des formats des fichiers récoltés étaient convertibles par EXTEX. Seules la présentation PPT de Schiller (2008)9et la leçon du professeur Nuno Almeida Almeida (2007) filmée le 29 mai 2007 ont été exploitées manuellement. La préparation des fichiers s’est limitée au strict minimum. Le Corpógrafo se fonde sur le point final pour segmenter le texte en phrases. Ainsi, les termes IEEE 802.15 et IEEE 802.15.1 ont été séparés automatiquement en deux ou trois segments qui ont dû être réunis. Nous avons également décidé de rassembler plusieurs phrases en un seul segment pour obtenir des définitions et des contextes comportant tous les 6. Une version mise à jour est actuellement en cours de publication (Bacquelaine 2015). 7. Ce fichier «BDT Bluetooth» peut être consulté à http://web.letras.up.pt/franba/ BDT-Bluetooth/CGshirleyBluetooth.html 8. Les corpus comparables sont décrits dans notre mémoire (idem, pgs. 66–71). 9. Cette version consultée le 15/09/2008 n’est plus disponible. Dans les références, nous indiquons donc l’adresse url de la nouvelle version non datée (Schiller (s/d)). OSLa volume 7(1), 2015
corpógrafo, terminologie, phraséologie [29] éléments nécessaires à leur compréhension, notamment les antécédents des pronoms. Le nettoyage n’a pas besoin d’être parfait car on peut corriger les extraits dans la fonction BDT. Il faut toutefois veiller à ce que les termes soient orthographiés correctement pour être reconnus par les différentes fonctions. Quatre corpus comparables (anglais, français, portugais européen et portugais du Brésil) ont été constitués à partir des fichiers contenant les documents «nettoyés». Ces corpus ont ensuite été exploités grâce aux fonctions des options «Pesquisa» et «Centro de Conhecimento». Lesdifférentesfonctions de recherche permettent de limiter la recherche à un corpus sélectionné dans un menu déroulant. Elles fonctionnent très bien quelle quesoitlalangue.Nousavonsutilisétroisdescinqfonctionsderecherche:«ConcordânciaFrase»,«ConcordânciaJanela» et«ConcordânciaKWIC».Lapremièreapermis de trouver des définitions et des contextes pour les sigles de moins de quatre lettres qui ne sont pas reconnus par les fonctions de l’outil BDT. En effet, cela en ralentirait les performances, ce qui est contraire à l’intérêt de la majorité des utilisateurs. Ces trois fonctions ont été très utiles pour repérer les variantes à partir du co-texte et les termes composés à partir de noyaux terminologiques tels que protocol,layer,link,channel ou logical transport. L’outil BDT permet d’extraire des candidats terminologiques à partir d’un corpus sélectionné. Au cours de la deuxième phase de développement du Corpógrafo, des filtres ont été mis en place en anglais et en portugais pour diminuer le bruit causé par la ponctuation, les pronoms, les prépositions, les auxiliaires, les déterminants, etc. Une option permet à l’usager d’accéder d’un simple clic au contexte et aux références du fichier d’origine avant de sélectionner le candidat. Cette sélectionentraîne automatiquementla créationde lafichecorrespondante comportant plusieurs données insérées automatiquement : la langue et les références du fichier d’origine du terme. L’extraction terminologique semi-automatique fonctionne mieux en anglais et en portugais qu’en français, mais le bruit reste important étant donné le volume des corpus. Toutefois, la liste des termes anglais à inclure dans l’échantillon a été établie en concertation avec le professeur Almeida à partir de sa leçon filmée, du manuel de Schiller (2003) et de sa présentation PPT en ligne (2008). En tout, 35 termes EN sur 122, 47 termes PT sur 146 et 5 termes FR sur 205, soit un peu plus de 18% des termes, ont été insérés semi-automatiquement. Les autres fiches ont été créées au fur et à mesure des besoins. La fiche terminologique du Corpógrafo propose dix champs principaux : «Dados Gerais» (Données générales), «Pesquisadores» (Chercheurs), «Autores», «Fontes» (Sources), «Morfologia», «Definições», «Contextos», «Relações Semânticas», «Termos Relacionados» et «Equivalentes de Tradução». Nous les avons complétés tous sauf le champ «Pesquisadores» puisqu’il n’est nécessaire que lorsque plusieurs chercheurs travaillent sur la même BDT. OSLa volume 7(1), 2015
[36] françoise bacquelaine langue courante ou langue de spécialité, types de textes, etc.), quel que soit le domaine de recherche (Terminologie, Traduction, Linguistique, TAL, Sociologie, etc.). Depuis que le projet n’est plus financé, ce qui est regrettable, le Corpógrafo n’a plus fait l’objet que d’aménagements ponctuels et son bon fonctionnement dépend désormais de la bonne volonté de quelques-uns. Qu’ils en soient remerciés. références Almeida, Nuno. 2007. A tecnologia Bluetooth. Bacquelaine, Françoise. 1980. Deutsch-französische Terminologie des Strickens und Häkelns. Université de Liège, non publié. Bacquelaine, Françoise. 2006. L’euphémisme, un obstacle à la traduction. Revista da Faculdade de Letras : Línguas e Literaturas XXIII. 463–487. Bacquelaine, Françoise. 2009. La terminologie Bluetooth en anglais, en français et en portugais. Étude de néonymie comparée. Porto : Faculdade de Letras da Universidade do Porto. MA thesis. Version de septembre 2008 revue après soutenance. Bacquelaine, Françoise. 2015. La terminologie Bluetooth en anglais, en français et en portugais –– Étude de néonymie comparée. Presses académiques francophones. Branco, António, Amália Mendes, Sílvia Pereira, Paulo Henriques, Thomas Pellegrini, Hugo Meinedo, Isabel Trancoso, Paulo Quaresma, Vera Lúcia Strube de Lima & Fernanda Bacelar. 2012. A língua portuguesa na era digital – The Portuguese Language in the Digital Age. Springer. Gouadec, Daniel. 2003. Terminologie et traduction. Document audio, communication et discussion : 1’05’’- 32’30’’. http://archives.diffusion.ens.fr/ diffusion/audio/2003_10_17_terminologie_02.mp3. Maia, Belinda & Sérgio Matos. 2008. Corpógrafo V4 - Tools for Researchers and Teachers using Comparable Corpora. In Pierre Zweigenbaum, Éric Gaussier & Pascale Fung (eds.), LREC 2008 Workshop on Comparable Corpora (LREC 2008), 79–82. ELRA. Maia, Belinda & Luís Sarmento. 2003. GC - Integrated Web Environment for Corpus Linguistics. Présentation à la Corpus Linguistics 2003 (CL2003).http: //www.linguateca.pt/documentos/cl2003.pdf. Maia, Belinda & Luís Sarmento. 2005. The Corpógrafo - an Experiment in Designing a Research and Study Environment for Comparable Corpora Compilation and Terminology Extraction. In Proceedings of eCoLoRe / MeLLANGE Workshop, Resources and Tools for e-Learning in Translation and Localisation, 45–48. OSLa volume 7(1), 2015
corpógrafo, terminologie, phraséologie [37] Maia, Belinda & Luís Sarmento. 2006. Corpógrafo - Applications. In Third International Workshop on Language Resources for Translation Work Research & Training, Satellite event of LREC 2006 (LR4Trans-III), 55–58. Sablayrolles, Jean-François. 2000. La néologie en français contemporain. examen du concept et analyse de productions néologiques récentes (Lexica. Mots et Dictionnaire 4). Champion. Santos, Diana. 2005. Relatório da Linguateca de 15 de Maio de 2004 a 14 de Maio de 2005. Tech. rep. Linguateca. http://www.linguateca.pt/documentos/ RelatorioLinguatecaMaio2005.pdf. Sarmento, Luís & Belinda Maia. 2003. Gestor de Corpora – Um ambiente Web integrado para Linguística baseada em Corpora. In José João Almeida (ed.), Corpora Paralelos, Aplicações e Algoritmos Associados (CP3A), 25–30. Sarmento, Luís, Belinda Maia & Diana Santos. 2004. The Corpógrafo - a Web-based environment for corpora research. In Maria Teresa Lino, Maria Francisca Xavier, Fátima Ferreira, Rute Costa & Raquel Silva (eds.), Proceedings of the 4th International Conference on Language Resources and Evaluation (LREC’2004), 449–452. Sarmento, Luís, Belinda Maia, Diana Santos, Ana Pinto & Luís Cabral. 2006. Corpógrafo V3 : From Terminological Aid to Semi-automatic Knowledge Engine. In Nicoletta Calzolari, Khalid Choukri, Aldo Gangemi, Bente Maegaard, Joseph Mariani, Jan Odjik & Daniel Tapias (eds.), Proceedings of the 5th International Conference on Language Resources and Evaluation (LREC’2006), 1502–1505. Schiller, Jochen. 2003. Mobile Communications. Harlow (GB) : Pearson Education Limited 2nd edn. Schiller, Jochen. 2008. Wireless LANs. Cette version consultée le 15/09/2008 n’est plus disponible; une version remaniée non datée est disponible à https:// www.iith.ac.in/~tbr/teaching/docs/wireless_lans.pdf. contacts Françoise Bacquelaine Faculdade de Letras, Universidade do Porto [email protected] OSLa volume 7(1), 2015