scieee AI-readable full text Open interactive document viewer

Evaluación de la competencia léxica bilingüe en estudiantes del Máster Universitario en Profesorado

Santos-Díaz, Inmaculada Clotilde

Abstract

Esta tesis doctoral focaliza su atención en los factores que condicionan un mayor vocabulario virtual en español y en lengua extranjera de los estudiantes que cursan el Máster Universitario en Profesorado. Interesa conocer el perfil a nivel lingüístico y sociológico de los futuros docentes para indagar en las relaciones que se producen enntre las variables sociolingüísticas y los resultados de las pruebas léxicas. De forma complementaria, trata de establecer unas bases comunes para la recopilación y clasificación del léxico según niveles que permita su aplicación directa en el ámbito de la lingüística aplicada a la enseñanza de idiomas. La búsqueda de la selección del léxico en la enseñanza de lenguas y la evaluación de la competencia léxica del futuro profesorado hacen necesaria la puesta en práctica de una disciplina ya consolidada que responda a las necesidades de esta investigación. En este contexto, se enmarca la elección de la disponibilidad léxica como herramienta necesaria para recabar datos, analizarlos y llegar a conclusiones que se fundamenten en bases teóricas sólidas. Grosso modo, en este estudio se ha seguido la metodología planteada en el Proyecto Panhispánico de Disponibilidad Léxica con algunas salvedades. Se ha utilizado el sistema de listas abiertas en el que los informantes tienen que escribir las palabras que se le vengan a la mente en un tiempo límite de dos minutos por cada centro de interés o estímulo. En cambio, en lugar de utilizar los dieciséis centros de interés clásicos propuestos por Gougenheim et al. (1964) se han reducido a nueve para adaptarlos al objetivo de investigación: ocho corresponden a los tradicionales, para poder hacer comparaciones intermuestrales; y uno se incorpora por primera vez en este ámbito por su relación con las nuevas tecnologías. La población objeto de estudio está formada por 181 estudiantes de postgrado, en lugar de estudiantes preuniversitarios, lo que permite analizar la evolución del léxico disponible según el nivel de instrucción al cotejarlo con estudios previos. Asimismo, los informantes han completado un cuestionario con variables socioculturales y una prueba de léxico especializado en español, inglés y francés. Ello ha permitido que se aborde el estudio del léxico disponible desde las tres perspectivas que establece Azurmendi Ayerbe (1983: 187-195): creación de léxicos básicos, estudios de carácter teórico y trabajos de comparación inter e intralingüística. Entre las variables con mayor relevancia en el índice que mide la capacidad léxica en lengua extranjera, destacan el tipo de estudios que el informante ha realizado, el caudal léxico en la lengua materna, el uso de la lengua en diferentes contextos, la motivación para impartir clases bilingües y la realización de una estancia en el extranjero. En lengua española, el factor con mayor peso es el nivel de instrucción alcanzado por los hablantes que está condicionado de forma secundaria por otras variables. Las dos variables con mayor influencia coinciden con las mencionadas en el modelo en lengua extranjera: el caudal léxico en lengua extranjera y la especialidad del máster. De esta forma, se constata que los sujetos que han cursado estudios universitarios de áreas lingüísticas tienen un mayor léxico disponible en una lengua lo transmiten a la otra lengua gracias a la flexibilidad cognitiva que presentan los hablantes bilingües. Con respecto a las variables que inciden en la identificación del léxico especializado (ICIT) en lengua extranjera y en español coinciden dos: el uso de la lengua en diferentes contextos y el tipo de prueba. Ello conlleva que los informantes con un mayor dominio de las palabras técnicas en lengua española también sean capaces de identificar el léxico especializado en lengua extranjera más fácilmente. Además, el ICIT guarda una relación significativa con el caudal léxico y con la lengua de la prueba. En lengua inglesa, los informantes han bajado la media de los resultados, mientras que en francés aumenta ligeramente. Por tanto, la lengua elegida tiene cierta repercusión en los resultados finales de la prueba. Las variables referidas a los hábitos de lectura y la exposición a los programas culturales presentan una influencia indirecta a través de la clase social y directa sobre el léxico disponible. Este resultado conlleva una gran repercusión en el ámbito de la didáctica puesto que sugiere, por un lado, que la lectura no ha calado de igual forma en todas las clases sociales y, por otro lado, que ayuda a mejorar la competencia léxica de los estudiantes. En cuanto a la recopilación del léxico disponible, se propone seleccionar las nociones específicas del Plan Curricular del Instituto Cervantes como centros de interés y recabar los datos mediante el sistema de listas cerradas de una duración de dos minutos. Para la clasificación del vocabulario, se recomienda la aplicación de la teoría de los conjuntos difusos que permite extraer un vocabulario equivalente a los niveles A1 y A2 del MCERL. Asimismo, distingue entre seis seis niveles que conforman el vocabulario nuclear o prototípico, de tal forma que se indica que agua, que pertenece al nivel 1 del centro de interés de Comidas y bebidas, es más elemental que yogur, que se corresponde al nivel 2.

Full text

U NIVE RSI DAD DE M ÁLAGA F ACULTAD DE C IENCIAS DE LA E DUCACIÓN T ESIS DOCTORA L Evaluación de la competencia léxica bilingüe en estudiantes del Máster Universitario en Profesorado Análi si s de pruebas de disponi bili dad léxi ca y de ide ntifi cación de tecnicism os en esp añol, in glés y fran cés Doctora nd a: Inmaculada Clotilde Santos Díaz Direct ores: Juan Andrés Vill ena Pon soda y Antoni o Manue l Ávil a Muñoz P rograma Oficial de Postgrado en Políticas Educativas Málaga, 2015 AUTOR: Inmaculada Clotilde San tos Díaz EDITA: Publicaciones y Divulg ación Científi ca. Universid ad de Málag a Esta obra está sujeta a un a licencia Cr eative Commo ns: Reconoc imiento - No comercial - SinObr aDerivada ( cc - by - nc - nd): Http://creati vecommons.o rg/li cences/by - nc - nd/3.0/es Cualquie r parte de est a obra s e puede r eproducir s in autor izac ión pero con e l reconoc imie nto y atribuc ión de los a utores. No se puede h acer uso comerci al de la ob ra y no se pu ede alterar, tran sformar o hacer obras deri vadas. Esta Tesis Do ctoral está dep ositada en el Repositor io Institu cional de la Uni versidad de Málaga (RIU MA): riuma.u ma.es A mis padre s, que con su amor me dieron la vida A mi marido, que con su amor me alegra l a vida A las personas a las que dedico los agradecimientos Agradecimientos El interés por la lingüística unida a mi vocación docente, me llevaron a delimitar el tema de esta tesis doctoral en el curso 2010/2011. Durante estos años, numerosas personas han contribui do de diversa forma en la re alización de este trabajo. En primer lugar, cabe mencionar el asesora miento de mis dos directores de tesis, Juan Andrés Villena Ponsoda y Antonio Áv ila Muñoz. Ambos m e han orientado con sabiduría y han desempeñado un papel relevante en el presente estudio . Por un lad o, Juan me ha guiado por el a pasionante y complejo mundo d e la estadística donde he ido aprendido los conceptos y operaciones principales. Por otro lado, An tonio me abrió el camino en este campo de investigación hace casi 10 años cuando estudiaba la licenciatura en Traducción e Interpretación. Al igual que la d isponib ilidad léxica, esta tesis ha viajado a los dos lados del Atlántico . En Holanda , me acogió el profesor Frans Hinkens durante una estancia en la que tuve la oportu nidad de conocer el centro de inv estigación, M eertens Instituut. En Chile, la profesora Natalia Castillo Fad i ć me brindó su inestimabl e ayuda y cariño y me dio un gran impuls o para acabar la tesis. Además, tuve la suerte de conocer a Alejandro Troncoso y a Roberto Ferreira y de poder realizarles consultas académicas. Los datos del estudio ha n sido recabado gracias a la coordinación del profesorado del Máster Universita rio en Profesor ado y de la disponibilidad d e su alumnado. Espero poder con los resultados de este estudio apli car e l princip io de gratitud de Wolfram (1993) y devolver ese favor lingüístico. Asimismo, quisiera expresar mi gratitud a todas las personas presentes en la bibliografía porque han aportado su granito de arena en la confección de esta tesis. En este sentido , agradezco el trabajo de los usuarios que cuelgan de forma anó nima y desinteresada vídeos tutoriales y que tanto m e han enseñado de estadística. Por último , y no por ello menos importante, quisiera dar las gracias a mi familia ( Santos Díaz y Conejo Sobrino), amigos y compañeros de trabajo que me han apoyado durante to do este tiempo y me han alentado en los momentos más difíciles. M i mayor fortuna es pod er contar con cada uno de ellos. Gracias a todos por h acer posible que esta ilusión se haga realidad. Índice 1 RÉSUMÉ ............................................................................................................ 5 ! Chapitre 1. Introduction ............................................................................................ 7 ! Chapitre 2. Cadre théorique ...................................................................................... 9 ! Chapitre 3. Cadre méthodologique ......................................................................... 11 ! Chapitre 4. Analyse générale ................................................................................... 13 ! Chapitre 5. Analyse sociolinguistique ..................................................................... 17 ! Chapitre 6. Proposition didactique ......................................................................... 20 ! Chapitre 7. Conclusions .......................................................................................... 22 ! CAPÍTULO 1. ! INTRODUCCIÓN ............................................................... 27 ! CAPÍTULO 2. ! MARCO TEÓRICO ............................................................. 43 ! 2.1. ! Introducción ................................................................................................... 47 ! 2.2. ! Orígenes de la disponibilidad léxica ............................................................. 47 ! 2.3. ! Principios epistemológicos y conceptuales de la disponibilidad léxica ....... 57 ! 2.4. ! Investigaciones relacionadas con el léxico disponible .................................. 76 ! 2.4.1. ! En español como lengua materna ........................................................................... 77 ! 2.4.2. ! En inglés como lengua extranjera ............................................................................ 97 ! 2.5. ! Revisión del modelo matemático ................................................................ 101 ! 2.5.1. ! Cálculo del índice de disponibilidad léxica ........................................................... 101 ! 2.5.2. ! Índice de compatibilidad léxica y selección del léxico nuclear .......................... 111 ! 2.5.3. ! Índice corregido de amplitud léxica ...................................................................... 116 ! 2.5.4. ! Índice corregido de descentralización léxica ........................................................ 118 ! 2.5.5. ! Índice corregido de identificación de tecnicismos ................................ .............. 119 ! 2.6. ! Aplicaciones de la disponibilidad léxica ..................................................... 123 ! 2.7. ! Variables que inciden en el léxico disponible ............................................. 129 ! 2.7.1. ! Sexo ............................................................................................................................ 132 ! 2.7.2. ! Estancias en el extranjero ....................................................................................... 133 ! 2.7.3. ! Conocimiento de idiomas ....................................................................................... 137 ! 2.7.4. ! Corrección orto gráfica ............................................................................................ 143 ! 2.7.5. ! Clase social ................................................................................................ ................ 145 ! 2.7.6. ! Hábitos de lectura y exposición a los medios de comunicación ....................... 146 ! 2.7.7. ! Contacto y uso de la lengua extranjera en diferentes contextos ....................... 147 ! 2.8. ! Conclusiones parciales ................................................................................. 150 ! CAPÍTULO 3. ! MARCO METODOLÓGICO ............................................. 153 ! 3.1. ! Introducción ................................................................................................ . 157 ! 3.2. ! Naturaleza y método de la investigación .................................................... 158 ! 3.3. ! Selección de la muestra ................................................................................ 162 ! 3.3.1. ! Tamaño de la muestra ............................................................................................. 163 ! 3.3.2. ! Acceso a los informantes ................................................................ ........................ 166 ! 3.3.3. ! Requisitos de acceso al Máster Universitario en Profesorado .......................... 168 ! 3.3.4. ! Programa de estudios .............................................................................................. 170 ! 3.4. ! Sistema de recogida de los datos ................................................................ . 173 ! 3.4.1. ! Encuesta sociológica ................................................................ ................................ 174 ! 3.4.2. ! Prueba de disponibilidad ......................................................................................... 177 ! 3.4.3. ! Prueba del léxico especializado .............................................................................. 180 ! 3.5. ! Edición y codificación de los datos ............................................................. 181 ! 3.5.1. ! Encuesta sociológica ................................................................ ................................ 182 ! 3.5.2. ! Prueba de disponibilidad ......................................................................................... 184 ! ÍNDICE Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 2 3.5.3. ! Prueba del léxico especializado .............................................................................. 204 ! 3.6. ! Conclusiones parciales ................................................................................. 205 ! CAPÍTULO 4. ! ANÁLISIS GENERAL ........................................................ 209 ! 4.1. ! Introducción ................................................................ ................................ . 213 ! 4.2. ! Análisis cuantitativo de palabras y vocablos ................................................ 214 ! 4.2.1. ! Palabras y vocablos en español .............................................................................. 214 ! 4.2.2. ! Palabras y vocablos en lengua extranjera ............................................................. 217 ! 4.2.3. ! Palabras y vocablos en lengua inglesa ................................................................... 219 ! 4.2.4. ! Palabras y vocablos en lengua francesa ................................................................ 221 ! 4.3. ! Índice de densidad léxica e índice de cohesión .......................................... 223 ! 4.3.1. ! Índice de densidad léxica e índice de cohesión en español ............................... 224 ! 4.3.2. ! Índice de densidad léxica e índice de cohesión en inglés .................................. 226 ! 4.3.3. ! Índice de densidad léxica e índice de cohesión en francés ................................ 227 ! 4.4. ! Promedio de palabras ................................................................................... 227 ! 4.4.1. ! Comparación intramuestral .................................................................................... 228 ! 4.4.2. ! Comparación intermuestral .................................................................................... 233 ! 4.5. ! Análisis de los vocablos con mayor índice de disponibilidad ..................... 237 ! 4.5.1. ! Comparación intramuestral .................................................................................... 238 ! 4.5.2. ! Comparación intermuestral .................................................................................... 242 ! 4.6. ! La situación ortográfica ............................................................................... 253 ! 4.6.1. ! Resultados del estudio actual ................................................................................. 253 ! 4.6.2. ! Resultados comparativos intermuestrales ............................................................ 261 ! 4.7. ! Incidencia de la variable ‘sexo’ en el léxico disponible ............................... 264 ! 4.7.1. ! Centro 2: La ropa ...................................................................................................... 269 ! 4.7.2. ! Centro 3: Comidas y bebidas ...................................................................................... 270 ! 4.7.3. ! Centro 4: La escuela: muebles y materiales ................................................................ .. 272 ! 4.8. ! Conclusiones parciales ................................................................................. 274 ! CAPÍTULO 5. ! ANÁLISIS S OCIOLINGÜÍSTICO ..................................... 279 ! 5.1. ! Introducción ................................................................ ................................ . 283 ! 5.2. ! Hipótesis ...................................................................................................... 284 ! 5.3. ! Análisis descriptivo univariante y presentación de las variables ................. 287 ! 5.3.1. ! Variables lingüísticas ............................................................................................... 292 ! 5.3.2. ! Variables sociodemográficas y reticulares ............................................................ 295 ! 5.3.3. ! Variables relacionadas con el dominio de una lengua ....................................... 301 ! 5.3.4. ! Resumen de las variables ........................................................................................ 309 ! 5.4. ! Análisis bivariante ........................................................................................ 311 ! 5.4.1. ! Relaciones entre variables lingüísticas .................................................................. 312 ! 5.4.2. ! Efecto de las variables socioculturales ................................................................ . 320 ! 5.4.3. ! Efecto de las variables relacionadas con el dominio de una lengua ................. 324 ! 5.5. ! Análisis multivariante .................................................................................. 346 ! 5.5.1. ! Análisis de componentes principales (ACP). Reducción de dimensiones ..... 347 ! 5.5.2. ! Análisis de regresión lineal ..................................................................................... 356 ! 5.5.3. ! Análisis causales ...................................................................................................... 379 ! 5.6. ! Conclusiones parciales ................................................................................. 393 ! CAPÍTULO 6. ! SELECCIÓN DEL LÉXICO Y PROPUE STA METODOLÓGICA ........................................................................................ 397 ! 6.1. ! Introducción ................................................................ ................................ . 401 ! 6.2. ! Organización de la memoria semá ntica ...................................................... 402 ! Índice 3 6.3. ! La teoría de los prototipos en los estudios de disponibilidad léxica ........... 406 ! 6.4. ! Procesos de reentrada del léxico .................................................................. 412 ! 6.4.1. ! Modelos de reentrada según la ontogenia de los centros de interés ................ 417 ! 6.4.2. ! Modelo de reentrada de los centros de interés prototípicos ............................. 427 ! 6.4.3. ! Modelo de reentrada de los centros de interés relacionales .............................. 440 ! ! 6.4. 4 . ! Ejemplo de clasificación del centro de interés Ordenadores e internet según los procesos de reentrada ............................................................................................................ 446 ! 6.5. ! Análisis de las relaciones semánticas a través del DispoGrafo ................... 452 ! 6.5.1. ! Análisis de las relaciones semánticas según el centro de interés ....................... 453 ! 6.5.2. ! Organización del léxico según el idioma .............................................................. 458 ! 6.6. ! Hacia una propuesta didáctica .................................................................... 471 ! 6.6.1. ! Selección léxica según diferentes criterios de corte ............................................ 473 ! 6.6.2. ! Los aspectos socioculturales en el léxico disponible .......................................... 480 ! 6.6.3. ! El léxico nuclear y el nivel según el Marco Común Europeo de Referencia para las Lenguas .............................................................................................................................. 483 ! 6.6.4. ! Léxico nuclear en el Plan Curricular del Instituto Cervantes ............................ 494 ! 6.6.5. ! Propuesta didáctica .................................................................................................. 498 ! 6.7. ! Conclusiones parciales ................................................................................. 501 ! CAPÍTULO 7. ! CONCLUSIONES .............................................................. 509 ! 7.1. ! Conclusiones ................................................................................................ 513 ! 7.1.1. ! Ámbito de la sociolingüística ................................................................................. 513 ! 7.1.2. ! Ámbito de la psicolingüística ................................................................................. 523 ! 7.1.3. ! Ámbito de la lingüística aplicada a la enseñanza de idiomas ............................. 529 ! 7.1.4. ! Propuestas y líneas de investigación futuras ........................................................ 531 ! 7.2. ! Conclusions .................................................................................................. 537 ! 7.2.1. ! Cadre de la sociolinguistique ................................................................ .................. 537 ! 7.2.2. ! Cadre de la pycholinguistique ................................ ................................................ 547 ! 7.2.3. ! Domaine de la linguistique appliquée à l'enseignement des langues ................ 552 ! 7.2.4. ! Propositions et lignes de recherche futures ......................................................... 554 ! BIBLIOGRAFÍA ............................................................................................. 561 ! ANEXOS ......................................................................................................... 613 ! Anexo I. Cuadro resumen de los objetivos, hipótesis y resultados de la tesis doctoral .................................................................................................................. 615 ! Anexo II. Índice de gráficos, grafos y tablas ........................................................ 619 ! Anexo III. Documento de negociación ................................................................ 629 ! Anexo IV. Cuestionario sociológico y reticular .................................................... 633 ! Anexo V. Pruebas de identificación de léxico especializado: español, ing lés y francés .................................................................................................................... 641 ! Anexo VI. Índice de siglas y abreviaturas ........................................................... 645 ! Anexo VI I . Clasificación de errores ortográficos en español, inglés y francés ...... 647 ! Anexo VIII. Selección de vocablos nucleares en español, inglés y francés .......... 653 ! Anexo IX. Diccionarios de disponibilidad léxica en español, inglés y francés .... 663 ! Tesis doctoral Evaluac ión d e la compet enci a léxica bilingüe e n estudian tes del Má ster Univ ersitario en Profesor ado 10 espagnole afin de ré aliser des comparaisons dialectique s, sociolinguistiques, ethnolinguistiques, entre autres. L’édition des données des é preuves de disponibilité lexicale est cruciale pour les an alyses menées , surtout si l’intérêt réside dans la comparaison avec d ’au tres listes de mots. Samper Padilla (1998) établi la série de règles et de critères communs qui seront secondés par de nombreuses études, en pa rticulier celles qui font p artie du Pan hispánico. Néanmoins, il y a des cher cheurs qui plaident l’inclusion de tous les mots écrits par les locuteurs afin de co nn aître réellement le lexique disp onible ( Benítez Pérez, 1992b ; Mateo García, 1998 ; G alloso Camacho, 2002; Hernández Muñoz, 2004 ; Ávila Muñoz, 2006 ; Ávila Muño z et Villena Ponsoda , 2010, 2011 ; etc.). Dans ce sens, il est essentiel de connaître les r echerches préalable s sur le lexique disponible : plus particu lièrement des recherches sur le lexique en esp agnol comme langue maternelle et anglais et fra nçais comme langue étrangère. Dans le domaine hispa n ique, les enquêtes naissent du travail con stant de López M orales qui publie en 1999 le lex iq ue disponible de Porto Rico. E n suite, les études commencent à apparaître en Amérique Hispani que co mme en Espagne sur le lexique espagnol comme langue maternelle. R écemment, les études d’espagnol comme la ngue étrangère ou seconde langue , dans des pays hispanophones ou non , ont pris de l’importance : Carcedo Gon zález (2000 c ) en Finlande ; M o reno Fernández (2003) aux Etats - Unis ; González Fernández (2013) en Turquie, L ópez González (2009) en Pologne, B ianca Sandu (2014) en Roumanie ; entre autres. Le traitement mathématique des donné e s fera l’ objet de révision s où l’ on exposera les principaux indices et les facteurs qu i interviennent dans leu r calcul. Il existe un con sensus quasi généralisé pour calculer l’in dice de disponibilité à travers de la formule de Strassbu rger et Chávez (1987) et l’indice de cohésion par le biais de l’équation proposée par Echeverría (1991). En outr e, d’autr es chercheurs, comm e Ávila Muñoz et Villena Ponsoda (2010) complètent leurs analyses avec l’uti lisa tion d’autres ind ices, tel que l’indice de compatibilité ou l’indice de décentralisation qui marquent le degré de res semblance du lexique écrit par u n informate ur par rapport au reste des sujet s. C ependant, García García (2014) réalise une r évision mathématique Résumé 11 où il modifie l’ind ice de disponibilité, l’indice de comp atibilité et l’indice de décentralisation . Il facilite aussi le calcul de ces indices à travers du programme SPSS. Avant, l e calcul de l’indice de dispo nibilité et l’obtention des listes du lexique disponible se réalisait seulement avec un programme spécifique. Les applications les p lus utilisées sont Lexidisp ( Moreno Fernánd ez, Moreno Fernández et García de las Heras, 199 5), Dispol ex (Bartol Herná ndez et Hernández M uñoz, 2004) et Dispogen (Echeverría Weasson, Urzúa Carmona, Figueroa, 2005) . Une fois abordés les aspects théoriques et méth odologiques, on a inclus les applications de la disponibilité dans plusieurs disciplines en mettant l’accent sur la linguistique appliq uée à l’enseignem ent des lan gues. Le lexiq ue qui en résulte fait l’ objet de nombreuses analyses d e différents domaines. Du point de vu e de l’ethn olinguistique, la d isponibilité permet de connaîtr e la situa tion concrète d’une société à un momen t précis ; d’après la sociolinguistique il est possible d’analyser l’incidence de s facteurs sociaux dans le lexiqu e à travers de variables so ciales ; d’après la dialectologie on peut comp arer les différentes syntopies d’une langu e ; d ’après la linguistique appliquée à l’enseignement des langues , il suppose être un outil très efficace po ur la sélection du lexique ; et la psycho linguistique offre l’op portunité de connaître l’organisation d es m ots dans l’esprit. Pour compléter ce chapitre, en suivent des rech erches qui mettent l’accent sur les facteurs qui incident sur le lexique disponible en langue maternelle et en langue étrangère et qui seront analysés dans les chapitres suivants. Parmi ces variables, il faut souligner celles présentes dans la plupart des études, le sexe et la classe social ; d’autres rélévantes dans le lexique disponible en langue étrangère, la connaissance de langues et le niveau de compétence linguistique ; variables p eu étudiée s, le nombre de livres et l’exposé aux moyens de communication et les fautes d’ortographe; et d’autres nouvelles dans ce do maine, les séjours à l’étranger. Chapitre 3. Cadr e métho dologique Le but de ce chapitre est d e présenter et de délimiter les fondements et méthode s suivis pour mener à bien cette étude . Une des premières décisions d ans toutes les recherches est la délimitation de la population : universitaires de troisième Tesis doctoral Evaluac ión d e la compet enci a léxica bilingüe e n estudian tes del Má ster Univ ersitario en Profesor ado 12 cycle qui étudient le Master en Professor at. De cette façon, il est possible de réaliser une évaluation lexicale des futurs profe sseurs. L’accès aux personnes sondées s’est réalisé par le biais d’un do cument de négociation qui a été préalablement distribu é aux ag en ts im pliqués. O n leur a communiq ué l es objectifs de la recherche et ses caractéristiques. E n outre, on a r emarqué la confidentialité des don nées et on a facilité les coordonnées de la candidate au doctorat aux professeurs et a ux élèves dans le cas où ils solicitent des référence s complémenta ire s . L ’échantillon de l’étude se repla ce dan s son co ntexte puisqu’il est détermina nt dans une recherche qui, entre autres , vise à servir d’analyse du lexique disponible du futur professorat. Pour ce faire, on montre le cadre normatif où se s itue la formation initiale des professeurs et les conditions requises à l ’accès au Master en Professorat. Co m me couronneme nt, on spécifie le plan d’ét udes que suivent les son dés qui font partie de l’univers d’étude à l’Université de Malaga. Le travail de s enseignants dans l’implantation du plan du plurilinguisme est crucial ainsi que leur form ation initiale 2 . Le professorat de l’école primaire doit avoir obtenu le diplôme professionnel de professeur des écoles (DPPE). Cependan t, les professeurs d’enseigne ment secondaire et de form ation professionnelle doivent certi fier la r éalisation d’une maîtrise et le Master Universitaire en Professorat de l'Enseignement Second aire Obligatoire, Bacca lauréat, Formation Professionnelle et Enseignemen t des Lang ues 3 . Ce m a s ter substitue le Certificat d’Ap titude P édago gique en vigueur jusqu’en 2008/2009 et où il n’était pas nécessaire l’accréditation d’un niveau B1 en lan gue étrangère. Ensuite, on détai lle l’élaboration des documents pour obtenir l’information. Les données e xtralinguistiques se sont recueilli e s à travers d’un questionn aire avec des questions sociolog iques, réticulaires et liées aux procédés d’a cquisition et apprentissage de la langue étrangère du sujet. L’information linguistique provient des é preuves de disponibilité lexicale et d ’un test d’identification de m ots techniques. Les centres d’in térêt en espagnol et en langue étran gère (anglais ou français) sont n euf : 2 Il faut signaler que dans le s années 2013/2014 et 2014/2015 les bo urses d ’accès au travail d’enseignants biling ues se sont ouvertes au per sonnel intérim aire puisqu’il n’y avait pa s assez de professeurs avec l’accréd itation d’u n nive au B2 e n angla is, frança is et a l lem and. 3 Traduct ion d e la dénomi nation donnée au ma st er à l’ Univ ers it é de Mala ga. Résumé 13 huit correspondent aux centres traditionnels 4 présents dans l’étude de Gougenheim et al. (1964) et un centre de nouvelle incorporation, Ordinateurs et internet . Une fois les données compilées , on a réalisé un plan de codification po ur le questionnaire sociologique où on attribue une valeur numérique à chaque réponse qui s’incorpore à une base de données. Pour l’édition du lexique disponible, on a suivi les recommandations d e Samper Padilla (1998) soutenues pa r la plupart des travaux héritiers du Panhispánico. En plus, on a introduit de s cr itères pr opres , tels que l’incorporation aux listes des nom bres propres et les associat ion s indiv iduelle s qui permettent de réaliser des analyses sur la relation entre les mots plus fidèles . Les particularités de l’édition se so nt présentées en détail selon la langue et le centre d’intérêt en question pour justifi er les critères établis et orienter les futur s chercheurs. Quant à l’épreuve d’identification du lexique sp écialisé, les réponses se sont classifiées e n correctes, incorrectes et non répond ues 5 . En synthèse, cette étude se sert de la méthodologie de bas e des recherch es de disponibilité qui tournent autour du Panhispánico (épreuve de deux minute s sur un centre d’intér êt, système de listes ouvertes, etc.) m ais elle incorpore aussi des progrès méthodologi ques, tel que l’épreuve d’identificat ion du lexiqu e s pécialisé créée par Ávila Muñoz y Villena Ponsoda (2010) ou l’utilisati on du programme Di spoGrafo (Echeverría, Urzúa et Ferreira , 2008). En plus, on incorpore un échantillon original sur lequel on évalue le lexique en langue matern elle et en lan gue étrangè re. Comme signale Moreno Fer nández (1990: 38) 6 , la seule fa çon de faire des progrès est à travers l’union de la tradition et or iginalité. Chapitre 4. Anal yse généra le Les analyses suivant e s montrent les donn ées générales liées à l’ épreuve de disponibilité lexicale : nombre total de mots par épreuve et par centre d’intérêt, 4 1) Les parti es du corps humain ; 2) Les vêteme nts ; 3) La nourrit ure et les bois sons ; 4) L’école (meub les et matérie l) ; 5) La ville ; 6) Moyen s de t ran sp ort ; 7) Jeux et loisirs ; 8) P rofessions et métiers . 5 Le procédé mat héma ti que de ce tes t ainsi que l’épreuve du lexique disponible trouvent leurs fondements dan s la section 2.5 et se metten t en pratique sous la forme d’analyses dans le s chapitr es 4, 5, et 6. 6 «S ólo así la comparación es posible, sólo así los pasos de una persona pueden ser de plena utilidad para otra, porque los avances se consigue n a mitad de camino entre la tradició n y la origin alidad» (Mor eno Ferná ndez, 1990 : 38). Tesis doctoral Evaluac ión d e la compet enci a léxica bilingüe e n estudian tes del Má ster Univ ersitario en Profesor ado 14 nombre de vocable s , indice de cohésion et densité lexique. D’une part, on ana lyse le lexique en langue espagnole et en langue étrangère des futur s professeur s et, d’autre pa rt, on compare le lexique en langue espagnole de l’étude actuelle avec de recherches préalables. D’abord, on présente l’analyse du nombre de mots et vocable s qui se complète à traver s la comparaison de la moyenne des unités lexicale s de cette étude par r apport à des recherches antérieures. La la ngue m aternelle des sondés résulte être la p lus pro ductive q uant a u no mbre de mots et vocable s . En espag nol, les sujets ont écrit un e mo yenne de 191,91 mots, en anglais 131,79 et en français 147,71. En ce qui conce rne les vocable s , en espagnol o n r egistre une mo yenne de 20,93, en anglais de 13,77 et en français de 5,82. Ces données si différentes s’expliquent par ce que le nombre de vocable s est influencé p ar le nombre d’ informateurs : 17 1 en espagnol, 150 en anglais y 21 en français. La comparaison des résultats avec d’autres études réalisées à Malaga, particulièrement sur un échantillon d ’étudiants de baccalauréat (Ávila Muño z, 2006) et de population adulte (Ávila Muñoz et Villena Ponsoda, 2010), m ontre la plus gr ande productivité des universitaires de troisième cycle. La moyenne des mots par centre d’intérêt calculée sur les huit cen tres en comm un, est de 19,69 ch ez les étudiants de baccalauréat, 20,50 de la population adulte stratifiée et 21,59 des étudiants universitaires de tro isième cycle. A priori , le niveau de formation paraît avoir une certaine influence sur le lexique disponible. Dans les études de disponibilité lexicale en la ngue étrangère, on corrobore aussi l’hypothèse que la capacité lexica le en langue maternelle est supérieur e à la langue étrangère. En second lieu, on présente les résultat s de l’indice de densité lexicale et l’indice de cohésion. Dans ce cas, on ne réalise pas de comparaison avec d ’autres études parce qu’il s’agit d e deux indices directement liés a u nombre de sujets. On constate l’existence d’une tend ance commun e dans les trois langues de façon qu’il y a it des centres dont le s rangs se répètent selon leur indic e d e cohésion et densité lexicale . Le centre le plus adhér é est le premier, Parties du corps humain , dans les trois langues tandis que les plus hétérogènes sont Jeux et loisirs et Ordinateu rs et internet . Si l’on comp are le classement d’autres étu des, comme celle d’Ávila Muñoz et Villena Résumé 15 Ponsoda (2010), o n observe que le centre le plus homogène est le premier. C’est pourquoi dans le chapitre 6, on présent en p rofondeur la structure interne d es centres d’intérêt se basant sur le fait que le type de centre cond itionne les réponses d es sujets. En troisième lieu, on centre l’attention sur les vocabl es les plus disponibles afin d’ana lyser la différence entre différents échantillons et entre le lexique a pporté en langue matern elle et en langue étran gère des infor mateurs. On a consta té l’hypothèse qui présuppose une majeur e similitude dans les études d’une langue étrangère par rapport aux études en langue m aternelle. D ’une part, l’usage et le contexte d’apprentissage influencent directement sur le lexique disponible. De cette façon, parm i les vo cable s les plus disponibles en langue maternelle en on trouve quatre liés aux sous - vêtements tandis qu’en langue étrangère , ceux - ci ont été écr it seulemen t une ou deux fois. Ce type de vêtemen ts est utilisé to us les jours mais n’apparaît pas si fré quemment dans les m anuels d’anglais, français ou d’ espagnol comme langue étrangère. D’autre par t , l’espace temporel de récolte des données montre la diachronie de la langue et conditionne le vocabulaire plus disponible. Pour cette raison, dans l’étude pion nière de Gougenheim et al. (1964) apparaissent des vocable s te l s que combina ison qui ne seraient pas disponibles de nos jours parce que l’on a changé notre façon de s’habiller . Dans la section suivante, on présen te les fautes d ’orthographe des enquêtes 7 e n espagnol, en anglais et en français . D’abord , on compare les résultats d es trois langues de cette étude et ensuite on réali se la comparaison avec de s recherches préalables (García Paredes, 1999 ; Ávila Muñoz, 2007 ; Saura Rami, 2 008 ; Blanco Domínguez, 2 011 ; García Casero, 201 3). En espagnol, dans chaque groupe de 100 mots écrits par sujet , 1,32 con tient une erreur tandis qu’en langue étrangère 4,90. Le 66,16 % des fautes d’orthographe sont dues à une inadéquate accentuation et le 3,95 % à la confusion des lettres b et v . Quant à la distribution des vocable s avec des erreurs au respect du total des mots écrits, sauf exceptions, ils se corresp ondent aux centr es avec un i ndice d’erreurs d’orthographe élevé, tel que le centre sept et neuf p our se trouver avec un nombre considérable de mots fam iliers et d’origine étrangère écrits de façon in correcte. 7 Pour accé de r aux faut es d’ort hographe, voi r l’Annexe VI. Tesis doctoral Evaluac ión d e la compet enci a léxica bilingüe e n estudian tes del Má ster Univ ersitario en Profesor ado 16 Les universitair es de tro isième cycle o btiennent des résultats consid érablement meilleurs que les étudiants universitaires m alaguènes, les élèv es de lycée aragonais, galiciens et madrilènes. Parmi les étudiants de baccalauréat, les galiciens occupent le premier poste en correction orthographique (4,59 % des fautes), suivis des aragonais (7,72 %) et des madrilènes (11,34 %). En langue étrangère , l es sujets d e cette étud e ont comm is un 4,9 % de fautes et se situent seulement après les galiciens. Pour cette raison, on peut conclure qu’il a un certain progrès dans la correction orthographique des étudiants acquise tout au lo ng des études universitaire s. Du point de vue de la sociolinguist ique, on étudie l’effet du sociolecte féminin et masculin dans le nombre de mots et de vocable s apportés par les sondés . Pour ce faire, on a réalisé un e analyse de corrélation bivariée et on a mis le point sur les ce ntres qui présen tent une différence statistiquement significative. Le second centre, Les vêtement s , présen te une corrélation significative bilatéra le à niveau 0 ,01 et le troisième et quatrième centre, La nourriture et les boissons et L’école : meubles et m atériel scolaire à niveau 0,05. De façon plus détaillé e , on a com ptabilisé et commenté le lexique en comm un présent dans les listes qui contienn ent les 20 vocable s plus d isponibles des femm es et des hommes pour analyser d’un point de vue qualitatif les d ifférences. Dans ce sens, on a distingué les vocable s apportés de manière exclusive par les hommes et les femmes et on a constaté qu’il ex istent certaines différences. Par exemple, d ans le centre dénommé La nourritur e et les boissons les homm es ont l’hab it ude d’écrire plus de noms liés aux boissons alcooliques tandis que les femmes on t mentionné plus de vocable s en relation aux desserts et alim ents sucrés. En ce qui concerne le nombre de vocable s par sujet et centre d’intérêt, la moyenne par centre d’inté rêt des femmes est supérieure dans tous les centres à l’exception du cinq uième et neuvième, La ville et Ordinateurs et Int ernet en langue espagnole et le sixième et neuvième en langue étr angère Moyens de transport et Ordinateurs et Internet . Cette analyse corrobore l’hypot hèse de Bellón Fernández ( 2011 : 119 ) qui affirme que le centre d’intér êt marque la différence entre un sex e et l’autre puisqu’il y a certains centres où le sexe féminin est plus enclin à écrire plus de mots et vice versa. Résumé 17 Les c onclusions de cette sectio n coïncident avec les études préalables où les différences entre le sociolecte f émin in et masculin sont très fa ib les (Gou genheim et al . 1956 ; Dimitrijev i ć , 1969 ; Echeverría, He rrera, Moreno et Pradenas, 1987; Alba , 1995a ; Mateo, 1998 ; Valencia et Echeverría , 1991 ; Carcedo, 2001). Cependant, de même que dans l’étude de Valenci a et Echeverría (1999 : 257), on consta te q ue d ans la plupart des centres d’intérêt, le sex e féminin est plus productif. Chapitre 5. Anal yse sociolinguis tique Tout au long de ce chapitre on essaiera de connaître quels sont les facteurs qui ont une incidence sur le lex ique disponible et sur la cap acité d’identification des m ots techniques en espagnol et en langue étrang ère. Le premier pas pou r réaliser un e estimation optimale des résultats passe par une étude de ses variables de manière individuelle. À travers de l’analyse univ arié e , on préten d savoir la distributio n et dispersi on de chaque variable isoléé . Cette phase est indispensable comme approximation aux analyses bivarié e s et multivarié e s présenté e s ultérieurement. Cha cune de ces variables est une variable éch elle ou univariée et l’ensemble des variables font partie d’une variable vectorielle ou multivariée. Les variables les plus significatives de l’étude sont divisées en trois types : variables sociodémographiques et réticulaires, variables liées à l’apprentissage d’une langue étrangère et variables lingu istiques. Les deux premières font référence aux variables indépendantes qui aident à expliquer le com portem ent des troisièmes, c’est - à- dire, des variables dépendantes. Il faut souligner que la base des données primitive est composée de plus de 500 variables comme résultat de la codifica tion du questionnaire sociologique et des épreuves linguistiques mais on a choisi seulement les variables les plus significatives. Parmi le s variables so ciodémographiques et réticulaires, on a inclus l’âge de la personne sondée, les études et le travail des parents et les revenus familiaux . Qu ant aux variables liées à l’apprentissage d’une langue étrangère, on expose les données exploratoires plus r emarquables : spécia lité du master, utilisation de la langu e étrangère dans son environnem ent, expositio n aux moyens de communication et la motivation pour donner des cours en langue étrangère. Par rapport aux variables Tesis doctoral Evaluac ión d e la compet enci a léxica bilingüe e n estudian tes del Má ster Univ ersitario en Profesor ado 18 linguistiques, on présente celles qui seron t utilisées comme variables dépendantes dans les analyses bivarié e s et multivarié es : l’indice cor r igé de décentralisatio n lexicale (ICoDD) 8 et l’indice cor rigé d’identification d e mots techniques ICIMT) 9 en espagn ol et en langue étrangère. L’indice corrigé de décentralisation lexicale mesu re la ca pacité lexicale des sondés à partir des résultats de l’ épreuve de disponibilité lexicale . Pour son calcul, on a considéré les mots moins compatib les ou mentionn és seulement par une minorité de sujets et la relation avec le centre d’intérêt. De cette façon, on ob tient un indice qui fait référence au nombre de mots par locuteur et aussi a u degré de décentralisati on par rapport au centre d’intérêt. En langue étrangè re les facteur s qui gardent une plus grande relation avec l’ICoDD so nt liés en grand e partie à l’apprentissage d’une langue étrangère et au propre ICoDD en langue espagnole. Dans le modèle de régression linéale et le modèle causale on a remarqué la motivation pour donner des cours en enseignement bilingue, l’usage de la langue étran gère dans son contexte na turel et la spécialité du master qui l’étudient les sondé s. Ils existent d’autres variables, telles que la connaissance d’autres langues étrangères , qui présentent une relation significative ave c l’ICo DD mais qui sont redondante s dans l es modèles m ultivariés parce qu’elles sont liées surtout à la spécialité du master. En espagnol les analyses bivariées ainsi que les multivariées montrent une relation moins significative entre les variables linguistiq ues et extralingu istiques avec l’ICoDD. En outr e, l’analyse d e régression linéale et l’analyse causa le expliquent avec un degré d’adéquation plus petit qu’en langue étrangère le com portement de la capacité lexicale en espagnol. La principale cause de cet effet est due au rôle principal 8 Cette varia ble permet de connaî tre le degré de spécifi cit é des mots apportés par un infor mateur par rappor t aux unités lexicales de l’ensemble de l’échantillon. L’indice de décentralisati on comptabilise tous les mots avec la valeu r 1 sans tenir co mpte de la pe rtinenc e plus o u mo ins dire cte du v ocable avec le centre d’intér êt. Cependa nt, Ávila Muñoz et Vill ena Ponsoda (2 010 : 1 85) proposent de corriger cet indice et appliquent des valeurs diff érentes sel on le type de rel ation des vocables par rapport au centr e d’intérêt ou noyau prototypique : mots nucl éa ire s (N 1 = 1), a ssociations collectives (N5 = 0,5), dérivati ons (N25 = 0,25) et associations individ uelles (N0 = 0). La somm e des mots préalablement pondérée sel on ce clas sement donne lie u à l’i ndice corrigé de décentralisation lexicale. 9 Dans l’étu de d’Áv il a Muñoz et Vi ll ena Ponsod a (2010 : 2 17) les résulta ts de l’épreu ve de lexiqu e spé cialisé s e sont mo ntrés à travers le Pid ent, défini comme la cap acité individuelle d’identification de pièces lexicales spécialisées. Cet indice s’obtient de la somm e de toutes les réponses correctes des locuteurs sans tenir compte le h asard dans ce test. P our corrige r l’in dice d’identifica tion de mots techniques, on a soustrait les réponses incorr ectes ave c une v aleur statis tiquem ent po ndérée . Résumé 19 que joue le degr é de formation des locute urs dan s leurs com pétences lexicales . Étant donné que tous les étudiants sont universitaires de troisième cycle, il existe une marge plus petite d’incidence dans la capacité lexicale qui vient marqué e par d’autres variables linguis tiques, l’ICoDD en langue étrangère et l’ICIMT en espagnol, ou directement liés à celles - ci, la sp écialité du master et les habitudes de lecture. En ce qu i concerne l’indice corrigé d’i dentification de mots techniques (ICIMT) mesure la capacité d e l’info rmateur de reconnaître des mots techniques et en relation avec le centr e d’intérêt do nné. Il s’obtien t à par tir d’une for mule ma thématique qui tient en com pte d es rép onses correctes et incorrectes qui en résultent de l’épreuve du lexi que spécialisé. Cette épreuve est centrée sur le vocabulaire passif du locuteur puisqu’elle vérifie si le sujet est capable de reco n naître certaines unités lexica les mais cela n ’implique pas n écessairement que le sujet puisse utiliser le mot en contexte et qui fasse partie du vocabulaire actif. Les analyses de régression linéal e multiples et causales qui mesurent les f acteurs qui influencent la capacité d’identifica tion de mo ts sp écialisés, p résentent un modèle d’adéquatio n assez faible en langue étrangère et, surtout, en espagnol. Cependant, il est intéressant de soulign er les variables avec une plus grande influence s ur l’ICIMT en langue maternelle et étrangère pou r les prendre en com pte dans le domaine de la linguistiqu e appliquée à l’enseignement des lan gues. En langue étrangère les variables avec une incidenc e positive sur l’ICIMT sont l’usage de la langue dans de différents contextes, l’ICIMT en espagnol, l’él ection du français dans l’épreuve, l’IC oDD en langue étrangèr e et la classe social e . De m ême que dans les modèles mu ltivariés de la capacité lexicale, l es variables telles que la connaissance d’a utres langues gar dent une r elation significative bilatérale a vec l’ICIMT sont présents dans de s modè les multivariés de façon ind irecte, par exemple à travers l’utilisation de la langue et la spécialité du m aster. En langue espagnole il se produit une relation d’infl uence réciproque avec l’ICIMT en langue étrangèr e. Le reste d e variables remarquables sont les habitudes de lecture, l’expo sé aux programmes culturaux, la spécialité du master et la classe sociale. C’est pourquoi une des conclusions possibles du point de vue pragmatique et 27 CAPÍTULO 1. INTRODUCCIÓN Capítul o 1 Introducción 29 A m odo de pro legómenos, este capítulo pretende establecer los fundamentos generales que llevaron al plan teamiento y realización del estudio actual y q ue serán tratados con mayor profundidad en lo s siguientes capítulos. E n primer lugar, se introduce y limita el tem a planteando el problema de investiga ción 12 . A con tinuación, se presentan los objetivos que persigue la investigación desde enfo ques diversos p ara conocer la respuesta a los interroga ntes del estudio. Posterio rmente, se intenta dar una respuesta tentat iva al problema de investigación mediante las hipótesis. Por último, se incluye la macroestructura de la tesis que se divide en siete capítulos. L os cam bios en las estructuras sociales, en la producción y distribución de conocimiento cien tífico, en los procesos económicos y cambios a nivel tecnológico y de desplazamientos humanos en busca de una mayor calidad de vida y un mayor bienestar en los últi mos tiempos, están generando una sociedad más multicultu ral. La necesidad de comunicación en una lengua extranjera se ha convertido en un requisito sine qua non en el ámbito profesional, cultural, de ocio y de intercambio de información (Commission Europée nne, 1995 13 ; Guillén Díaz, 2000; C onsejo de Europa, 2001; Consejería de Educació n de la Junt a de Andalucí a, 2005). En la perspectiva de una enseñanza globalizadora, las lenguas extranjeras pueden contribuir de manera muy activa a desarrollar las capacidades cognitivas, afectivas, psicomotrices, de creatividad, de relación personal y de inserción social de los jóvenes. La lengua viva ofrece, en relación con otras asignaturas escolares, la ventaja de poder, sin perder su especificidad, actuar al mis mo tiempo ( por mimetismo, simpatía o empatía) sob re otros saberes y otros domin ios de formación. El Consejo de Europa insiste en la necesidad de desarrollar competencias que promuevan la comunicación de los individuos con sus vecinos europeos. Para hacer efectivo tal cometido, el Consejo publica en el año 2001 el Marco Común Eu ropeo 12 « Def ini r el probl ema de la inv estigación equivale a seleccionar una dirección concreta (…) o seleccionar un evento, un a situación, un hecho, un comportam iento y delimitar el tiempo , el espacio, las personas, el contexto en donde uno se decide a investigar» ( Ruiz Ola bué nag a 2003: 54) . 13 Vid. versión electrónica en el siguiente enlace: http://e uropa.eu/doc uments/comm/white_paper s/pdf/com95_590_f r.pdf [Fecha de última con sulta el 8 de febrero de 2015]. L a pá g ina web oficial http://ec. europa.eu/whi te - paper s/index_es .htm recoge los Libros Blancos publi cados desde el año 1993. En esta ocasi ón el Libro blanco está dispo nible en ingl és, francés y alemán, de ahí que se haya citado en francés. [Fecha de última c onsulta el 8 de mayo de 2015]. Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 30 de Referencia para las Lenguas (MCERL). En general, las leyes educativas de los diferentes países europeos establecen, de acuerdo con las exigencias del Consejo de Europa, la enseñanza de dos lenguas extranjeras habladas en Europa durante la etapa de educación secundaria. Cabe destacar, que en la enseñanza primaria e incluso ya en la enseñanza infantil, se ha in cluido la impartición d e una lengua extranjer a, preferentemente la lengua ing lesa (excepto en los países anglófonos) considerada primera lengua extranjera mientras que la se gunda lengua extranjera (que se empieza a enseñar a posteriori ) varía según los acuerdos entre países, los intereses eco nómicos y las necesidades sociales. Así, el papel de la lengua se ve r eforzado a medida que aumenta el interés o necesidad de los individuos para com unicarse en inglés. Con el objetivo de adaptar la sociedad andaluza a los nuevos retos que plantea el fenómeno d e la globalización , el Gobierno Andaluz publicó el documento titulado Estrategias y propuestas para la segunda modernización de Andalucía . Uno de los principales objetivos consiste en fomentar el estudio d e lenguas extr anjeras para preparar preparar a la pobla ción ante los desafíos de la sociedad a ctual 14 . El Plan de Fomento de Plurilingüismo, aprobado en el año 2005 por la Junta de Andalucía, fue diseñado para promover el aprendizaje de idiomas y la diversidad lingüística en esta región. La búsqueda de un en foque globalizado en la en señanza (incluyendo el uso de las tecnologías d e la información y de la comu nicación, el trabajo cooperativo y las lenguas extranjeras) conlle va la actualización de la formación del profesorado en el plano metodológico - curricula r y lingüístico . En este marco se ubica el Máster Universitario en Profesorado en Educación Secundaria Obligatoria y Bachillerato , Formación Profesional y En señanza de Id iomas . El Pla n de Fomento d e Plu rilingüis mo pone énfa sis e n la formación del profesorado tanto de áreas lingüísticas como no lingüí sticas 15 . También repercute en 14 « Debe mos plan tea rno s de maner a rotun da el reto educ ati vo del conoc imi ent o de otr as leng uas en el marco de un mundo global, como instrumento fundamental, para asegura r las posibilid ades d e éxito y de com partir un futuro mejor » (Consejo Asesor para la Se gunda Mode rnización de An dalucía, 2 003: 46). 15 « Espec ial mención merec e la formació n inicia l del profe sora do de áreas no lingüís ti cas, en la que habrá que tener en cuenta el nuevo perfil de profesor o profesora que se va a necesitar. En este sentido, es necesaria la inclusió n en el plan de e studios de la p ráctica de la s leng uas extranje ras, q ue p odrá consid erarse com o u n impo rtante c omp lemen to a la form ación de aq uel p ro fesorado que de see impa rtir docencia en los C entros Bili ngües. Si además, se le permite desarrol lar su perío do de práctica s docentes en el extranjer o (como lo hacen Aleman ia y Franci a), habre mos logrado una formac ión inici al total ment e acor de con este Plan de Fomento del Pluril ingüis mo » (C onsejer ía de Ed ucación , Junta de Andalu cía, 2005: 4 9). Capítul o 1 Introducción 31 la formación permanente del profesorado, ya que se tendría que invertir menos esfuerzo, por p arte del docente, y menos recursos económicos, por parte de la administración, cuanto mejor sea la formación inicial del profesorado. Algunas de las opciones para la formación permanente son las siguientes: estudios en Escuela Oficial de Idiomas (cursos of iciales presenciales, cursos de actualiz ación lingüística del profesorado y cursos a distancia a través del That’s English), cursos de inmersión en verano, licencias de estudio modalidad C, programa s de aprendizaje permanente, profesorado acompañante del p rograma Idiomas y Juventud y ayudas individuales a la formación. En cambio, algunas de esas medidas 16 que se pusieron en marcha , como las licen cias por estudio o los cursos de idiomas, se ha n su primido por motivos económicos. El aprendizaje del léxico es fundamental en la enseñanz a de idiom as y en los programas de bilingüismo, por lo que se debe fomentar sistemáticamente y desde el nivel más elemental para permitir el intercambio de mensajes cortos desde los primeros días de clase. En los m omentos inicial es, de nada sirve la corrección gramatical si el aprendiente n o posee los elementos léxicos suficientes para entender los mensajes y para formularlos él mismo, puesto que la información referencial de un texto está contenida en los lexemas. Se podría decir que el léxico transmite el grueso de la información con un esfuerzo relativamente pequeño. Por ejem plo, si un alumno se dirige al profesor diciendo «baño, por favor», o incluso «baño» claramente le estará pidiendo salir para ir al cuarto de ba ño sin que i mplique necesidad alguna de formular la pregunta . Gracias al aprendizaje sistemático del léxico, el estudiante logrará resultados espectaculares referidos con su capa cidad d e comunica ción. E n este sentido, numerosos autores abogan por otorgar un papel pr incipal al léxico. Como es el caso de K rashen (1987, apud Priyono 2009: 1): «Wh en students travel, they don't carry grammar books, they carry dictionaries» y David Wilkins: 16 « Acción 48 : Gra tui dad de los c urso s par a el pr ofe sora do inv olu crado en el Plan de Fomen to de l Pluril ingüis mo en Escuela s Oficiales de Idiomas y otras Institucion es Colaboradora s). […] Acción 50: Conces ión de lic enci as de est udio e spec ífi cas ( curs os de idi omas en el e xtra njer o, i nterc ambios pues to a p uest o, estancias en centros educativos extranjeros, etc. ) para la formac ión en lenguas en el extranjero » (P lan de Fo ment o de l Pl uri li ngü is mo, Cons ej erí a de Educ aci ón, J unt a d e An dal ucí a, 20 05: 4 9). Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 32 Para que la enseñanza del léxico sea significativa, es necesario llevar a cabo una recopilación previa de las unidades léxicas que se pretenden enseñar de acuerdo a las car acterísticas d el alumn ado. P recisamente, el MCERL (2001: 149) de staca la importancia de la selección léxica para la ela boración de materiales de exá menes y manuales. Pero, ¿cómo se realiza esa selección léxica? ¿cuen ta el profesorado con un léxico disp onible en lengua esp añola sim ilar en lengua ex tranjera? ¿qué factores incide n en un mayor o menor caudal léxi co? La búsqueda de la selección del léxico en la enseñanza de idiomas y la evaluación de la com petencia léxica del futuro profesorado que va a enseñar esa lengua hacen necesaria la pu esta en práctica de una disciplina ya c onsolidada que responda a las necesidades de esta investigación. En este contexto, se enmarca la elección de la d isponibilidad léxica como herramienta necesaria para recabar d atos, analizarlos y llegar a conclusiones que se fundamenten en bases teóricas só lidas. Esta disciplina surge en Francia bajo la demanda del Ministerio de Educación N acional en 1951 de crear un vocabulario de base. Tras la publicación de varios volúmenes, en 1964 aparece una versión mejorada de la obra de Gougenheim, R ivenc, Michéa y S auvageot, titulada L’élaboration du françai s fundamental (1 er degré ). Esta investigación servirá, no solo para enseñar ese vocabulario de base, sino también para conformar en sí misma la base de un nuevo campo de estudio que cuenta en nuestros día s con una vasta literatura. La mayoría de las investigaciones se han realizado en español como lengu a materna y tienen como máximo exponente a López M orales quien realiza en 1973 una de las primeras investigaciones sobre el léxico d e San Juan de Puerto Rico 17 . A demás, promueve y dirige el Proyecto Panhispánico de Disponibilidad Léxica (PPHDL) que sup one la puesta en común de los aspectos metodológicos en estudios de zonas de habla hispana para la creación de diccionarios que muestren las diferentes sintopías y pe rmitan su contra ste. 17 El primer estu dio en español lo real iza Victe ry (1971) sobre una muestra de estu dian tes de 16 a 18 años: 33 monol ing ües d e Mon ter re y ( Méxi co) , 33 mono li ngüe s y 3 3 b il ing ües d e Ho ust on (Te xas ). Wit hout gr amma r li tt le ca n be con ve ye d; wi th ou t voc ab ul ar y noth i ng can be co nv ey e d. If you spen d m ost of your time studying grammar, yo ur En glish will not improve m uch. Yo u wil l see m ost improvement if you lear n more words and expres si ons. You can say very lit tl e with gr ammar, but yo u c an s ay almos t anyt hing wi th words ! ( Davi d Wil ki ns, 1 972: 111): Capítul o 1 Introducción 33 Grosso modo , este estudio ha seguido la metodología planteada en el Panhispánico con algunas salvedades. Se ha utilizado el sistema de listas abiertas en el que los informantes tienen que escribir toda s las palabras que se le vengan a la mente en un tiemp o límite de dos minuto s por cada centro de interés o estímulo. En cambio, en luga r de utilizar los dieciséis centros de interés clásicos propuestos por Gougenheim et al. (1964) se han reducido a nueve para adaptarlos al objetivo de in vestigación: ocho corresponden a los tradicionales, para poder hacer comparaciones intermuestra les; y uno se incorpora por pr imera vez en este ám bito por su relación con las nuevas tecn ologías 18 . La población objeto de estudio está formada por estudiantes de postgrado, en lugar de estu diantes preuniversitar ios, lo que permite analizar la evolución del léxico disponible según el nivel de instrucción al cotejarlo con estudios previos. Asimismo, por primera vez se realiza en España la prueba en español y en l engua extran jera a un grupo de estudiantes que han debido acreditar previamente un nivel B1 según el MCERL. Por ello, se ha ofrecido la posibilidad de realizar la p rueba de disponibilidad en el idioma que los hablan tes conociesen dando lugar a un léxico di sponible en inglés y otro en francés. Asimism o, lo s info rmantes han com pletado un cuestiona rio con variables socioculturales y una prueba de léx ico especializado. De esta forma, se pretende abordar el estudio del léxico disponible desde las tres perspectiv as que establece Azurmendi Ayerbe (1983: 187 - 195): creación de léxicos básicos, estudios de carácter teórico y trabajos d e comparación inter e intralin güística. Esta tesis doctora l focaliza su atenci ón en los factores que condic ionan un mayor vocabulario virtual en español y en lengua extranjera de los estudiantes que cursan el Máster Universitario en Profesorado. Interesa conocer el perfil a nivel lingüístico y sociológico de los futuros docentes para ind agar en las rela ciones que se producen en variables relacionadas con sendos ámbitos. A su vez, trata de evaluar el léxico disponible d e uno de los pilares básicos en la implantación del Pla n de Fomento de Plurilingüismo: l a form ación inicial en lengua española y en lengua extranjera del futuro profeso rado. Teniendo en cuenta los numerosos aspectos que se 18 Los centros de interés son: 1) Partes del cuerpo ; 2) La ropa ; 3) Comidas y bebidas ; 4) La escu ela : muebles y materi ale s ; 5) La ciud ad ; 6) Med ios de t ra ns por te ; 7) Juegos y distracciones ; 8) Profesi ones y o fici os ; 9) Orde nado res e in ter net . Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 34 pueden abarcar y evaluar en una investigación sobre la formación lingüística del profesorado, en este estudio se fijan los sig uientes objetivos específicos: a) Ámbito de la sociolingü ística: • Comparar el léxic o disponible con otros estudios para detectar semejanzas y diferencias por razones de lugar, tiempo, nivel de instruc ción de los informantes, situación de la lengua (materna, extranjera o segunda lengua), entre otros factores. • Analizar las variables que c ondicionan el léxico disponible en español y en lengua extranjera del futuro profesorado p ara extraer datos que sea n de interés en la enseñanza de idiom as. • Conocer la capacidad de identifica ción del léxico especializ ado en espa ñol y en lengua extranjera relacionado con los nueve centros d e interés del diccionario de disponibilidad léxica y averiguar cuáles son los factores que inciden en un mayor o me nor conocimiento del vocabulario especializad o. b) Ámbito de la psico lingüísti ca: • Evaluar las conexiones de palabras que se producen en el lexicón mental del informante a través del p rograma DispoGra fo 19 . • Realizar un análisis de los procesos de reentrada del léxico al núcleo o prototipo de c ada centro de interés mediante el índ ice de compatibilidad. • Esbozar una t axonomía de los centros de interés atendiendo a di ferentes parámetros. • Cotejar los análisis anteriores en lengua española y en lengua extranjera para extraer conclusiones sobre el com portamiento del léxico dispo nible a nivel cuantitativo y cualitativo que comprenda la organización de las palabras. c) Ámbito de la lingüí stica apl icada a la enseñan za de le nguas: • Elaborar un diccionario de disponibilidad léxica en lengua español a y en lengua extra njera (francés e inglés) sobre nueve centr os de interés de gran re levancia en el ámbito educativ o. 19 Programa pre sentado por Echeverría, Urzúa y Ferr eir a ( 2008 ) que sirve par a realizar las relaciones semánticas de corte psicolingü ístico. Capítul o 1 Introducción 35 • Evaluar la corre cción ortográ fica de los lis tados de léxic o disponible y co nocer cuáles son los errores más comunes en los estudiantes para proponer medida s correctoras. • Seleccionar las unidades léxicas que formarán parte de un vocabulario básico a partir de los listados del léxico d isponible. • Llevar a cabo una propuesta didáctica que se sirva de los resultados de los análisis realizados, sobre todo relacionados con la organización de las palabras en la mente. Con objeto d e dar respuesta a los interrogantes del estud io, se plantean las hipótesis como elemento de conexión entre la teoría y la observación. Asimismo, las hipótesis han guiado la generación de las preguntas del cuestion ario sociológico, de la prueba de disponibi lidad léxica y de identificación del léxico especializado. D e esta forma, es posible corrob orar o refutar las mism as por medio de análisis cua litativos y cuantitativos. No se preten de llegar a una constatación uná nime y precisa de cada una de las hipótesis ya que la natura leza de la investigación aporta d atos más descriptivos y complejo s que un simple sí o no . En sintonía con los objetivos, las hipótesis se dividen en tres bloques: a) Ámbito de la sociolingü ística: • El promedio de palabras de los preuniversita rios malagueños será inferior al aportado por los estudiantes de postgrado debido a la influencia del niv el de instrucción. • El caudal léxico en leng ua extranjera es infe rior en lengua materna ( con independencia de la lengua d e que se trate , inglés o francé s) . • Las estancias en el extranjero, el contacto con los medios de comunicación, la motivación por aprender lenguas y el mayor conocimien to de idiomas inciden positivamente en el caudal léxico. • Las diferente s variables tendrán una mayor influencia sobre el léxico disponible y la capacidad de identificación de tecnicismos en lengua extranjera que en lengua materna. 43 CAPÍTULO 2. MARCO TEÓRICO Capítul o 2 Marc o t eór ico 45 2.1. Introducción 2 .2 . Orígenes de la disponibilidad léxica 2 .3 . Principios epistemológicos y conceptuales de la disponibilidad léxica 2 .4. Investigaciones relacionadas con el léxico disponible 2 .4.1. En español como lengua materna 2 .4.2. En inglés como lengua extranjera 2 .5. Revisión del modelo matemático 2. 5.1. Cá lculo del índice de disponibilidad léxica 2 .5.2. Índice de compatibilidad léxica y selección del léxico nuclear 2 .5.3. Índice corregido de amplitud léxica 2 .5.4. Índice corregido de descentralización léxica 2 .5.5. Índice corregido de identificación de tecnicismos 2 .6. Aplicaciones de la disponibilidad léxica 2.7. Variables que inciden en el léxico disponible 2.7.1. Sexo 2.7.2. Estancias en el extranjero 2.7.3. Conocimiento de idiomas 2.7.4. Correcci ón ortográfica 2.7.5. Clase social 2.7.6. Hábitos de lectura y exposición a los medios de comunicación 2.7.7. Contacto y uso de la lengua extranjera en diferentes contextos 2 .8 . Conclusiones parciales Capítul o 2 Marc o t eór ico 47 2.1. Introducción A lo largo de este capítulo se analiza el estado de la cuestión partiendo de lo general a lo concreto. En primer lugar, se expone la literatura relacionada con la disponibilidad léxica que comienza con un recorrido por las obras pioneras en este ámbito 21 . A continuación, se expone la evolución de la metodología de análisis y de codificación de los d atos desde la obra primigenia (G ougenheim et al. , 1964) h asta el afianzamiento de las pruebas de listas cerradas con una duración de dos minutos marcado por la pr oliferación de estudios com unes al Proyecto Panhispánico. En este sentido, es crucial conoce r las investigaciones que se han realizado previamente sobre léxico dispo nible y, más concretam ente, sobre el léxico en español como len gua matern a y en inglés y francés como lengua extranjera por tratarse de los idiomas a nalizados en este estudio. Asim ismo, se incluye una revisión d el trat amiento matemático de los datos y se definen cuáles son los principales índices utilizados en este estudio y los factores que intervienen en su cálculo . Una vez comenta dos los aspectos teóricos y metodoló gicos, se describen las principales utilidades de los estudios de disponibilidad léxica en diferentes disciplina s haciendo hincapié en la lingüística aplicada en la enseñanza de idiomas. Para terminar, se presentan las variables sociológicas y relacionadas con el aprendizaje y adquisición de una lengua que han sido objeto de estudio con anterioridad: el sexo, las estancias en el extranjero, el conocimiento de idiomas, la clase social, los hábitos de lectura, la exposició n a los medios de comunicación y el contacto y el uso de la lengua en diferentes contextos. 2.2. Orígenes de la disponi bilidad l éxica En 1947 Aurélien Sauvageot , en tonces pro fesor d e l'École Nation ale des Langues Orie ntales V ivantes, acude en representación de Francia a un Comité de lingüistas auspiciado por la U nesco. El ob jeto de la r eunión era pr omover la 21 Como reflej a Luque Toro ( 2006) en el Léxico español ac tual , e l c amp o de estudio del léxico es muy amp lio e integra estud ios que abarca n n eolog ismos , co loquialis mos, léxico a rcaico tradicio nal, léxico inno vado r, presposic iones, entre otros a spectos. Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 48 enseñanza de len guas para luchar contra el analfabetismo y con seguir difundir una educación de base. En camb io, en aquel contexto la enseñanza d e idiomas tradicion al en el país ga lo no establecía discriminación algun a en la selección del vocabulario. Por tanto, a menudo el alumnado se veía exp uesto a una cantidad ingente de palabras que no pasaban a formar parte de su repertorio lingüístico . Con objeto de elaborar un vocabulario de base el Ministeri o de Educación Nacional cre a en 1951 una c omisión y un centro de estudios en l'École Normale de Saint - Cloud, denominado Centre d'Études et de Recherche pour la Diffus ion du Français. A la cabeza del centro estaba Gougen heim, profeso r de Historia de la Lengua en la Universidad de Estrasburgo quien traba jaba de forma conjunta con Rivenc, entonces profesor d'École N ormale . Como f ruto de los trabajos científicos de este pro yecto e l In stitut Pédagogiq ue Nation al publica en 19 54 un fascículo opúsculo basado en la frecuencia de las palabr as ( apud Gougenheim et al ., 1956). A pesar de que en un primer momento se pensó llamar Français de base , las incómodas comparaciones con el Basic English 22 hace n que se llame Le français élementaire . Cabe mencionar que ya en 1949, M ichéa reflexiona sobre la denominación y el contenido de un vocabulario esencial y aboga por sustituir el concepto de vocabulario de base por vocabulario de estruct ura 23 . Aún así, críticas a la obra inglesa, como por e jemplo la realizada por Bongers (1947: 119 - 134) obligaron a los autores en 1956 a precisar la distinción entre sendos vocabularios y a dedicar un capítulo sobre los orígenes filosóficos del Basic English 24 . 22 El Basic English , elabora do po r Ogd en y R ichard s en 19 28 era un co nocido voca bulario que cu enta co n un total de 19 93 voca blos, de e ntre los cu ales se des taca una lista de vo cablo de b ase con 850 entr adas : 600 cosas (sustantiv os), 15 0 cualidades (adjetivos ) y 150 operaci ones (una mezcla de categor ías g ramatical es) . Basi c proviene del acrónimo British American Scienti fic Internat ional Commercial . Ambos autores cuen tan con una vasta obra en la selección del léxico: Ogden, 1930, 1931, 19 33, 1935, 1968; Richards, 1935, 1943, 1945, entre o tras. Una de las di fer enci as del Basic Engli sh con el Français élémentai re residía en la metodo logía d e selección d el vocabulario: las palabras m ás com unes en las definiciones de los diccionarios en lugar de las palabras más frecuentes. 23 «Nous croyons q ue les élém ents d’un vo abulaire essentil doiven t être choisis, no n seulemen t pour la part de signification qu’apporte chacun d’eux, mais encore et surtour en considération du soutien qu’ils s’accordent l’un à l’autre dans l’expression coherente d’un tout physique. C ’est pourquoi nous proposerions volontiers de remplacer ‘vocabulaire de base’ par ‘vocab ulaire de structure’» (Michéa, 1949: 173). 24 « Une langue semi - art ificiell e conçue par C.K. O gden et I.R. Richards dans les années vingt . Il s’ag it, en s’appuyant sur les réseaux synonym iques de la langue anglaise, de la réd uire aux terme s minimau x (premiers) permettant de définir (et donc de comprendre et de s’expr imer dans une certaine mesure) tous les autre s termes de la langue , un peu comme dan s un dictionnaire . Le Basic est donc un vocabula ire minima l à p ortée théoriqu e m aximale form ant u n tou t, c’est une ‘la ngue universe lle à base d ’anglais […] pouv ant se suffire à elle - même » ( Gou gen hei m et al. , 1956 : 28 ). Capítul o 2 Marc o t eór ico 49 E n 1958 se p ublica un segundo volumen y en 1959 se reedita Le français élementaire bajo el nombre de Français Fondamental (1er degrée) , desligándo se así de las críticas que lo ta chaban de rudimentario, escolar e incluso de peyorativo (Gougenheim et al. , 1964: 13). Por último, en 1964 se publica una versión más amplia y mejorada bajo el mism o nombre con algunas var iaciones sustanciales. En el pe riodo ac aecido e ntre la primera y última obra (1954 y 1964) se trascendieron cambios so ciales y p olíticos que marcaron los objetivos de los vocabularios y las gram áticas de base. En un primer momento, se pretende enseñar francés a los h abitantes que forman la Unió n Francesa, a lo s extranjero s y a los inmigrantes que llegaban a Fran cia. Esa finalidad inicial es tá vin culada co n la creación de la Unión Francesa que nace con la Constitución del 27 de octubre de 1946 . E l capítulo V III establece que la Unió n Francesa está formada por la Francia metropolit ana, los departamentos y territ orios de ultramar y los territor ios y estados asociados . Conflictos internos provocaron la separación de algunos de los territorios que formaban parte de la entid ad política en vigor: Camboya en septiembre de 1955, Vietnam del Sur en diciembre de 1955, Marruecos en marzo de 1956, Túnez en marzo de 1956 y Laos en mayo de 1957. Además, las guerras de Indochina y Argelia causaron tales estragos que propiciaron la caída de la IV República y el fin de la Unión Francesa en 1958. Por tanto, en la última obra se comenta que a pesar de que uno d e los objetivos prelimin ares era la difusión de la len gua en los países miembr os de la Unión Francesa, los propósitos de esa selección del vocabulario pasan a ser los tres que siguen (Gougenh eim et al. , 1964: 21 - 22): • Ense ñanza escolar: práctica y cultural. • Di fusión, en los jóvenes estados independientes, de una lengua dada elegida como lengua nacional o len gua extranjera en situación privilegiad a. • Necesidad es del viajero, del turista, de la persona que hace prácticas en el extranjero, del extranjero que viene a trabajar a otro país. En cuanto al método aplicado, el Français fondamental reflexiona sobre la metodologí a estadística llevada a cabo en los dos diccionari os de fr ecuencia d el francés p ublicados h asta ese entonc es en Estados Unidos: A French Word Book Based Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 50 on a Count of 400.000 runnin g Words de Henmon (1924) y el French Word Book 25 de Vander Beke (1929) . Asimismo, se inclu ye la referenc ia a obras derivadas del French Word Book , tales como The French Vocabulary de Tharp (1939), el Centrala ordförrädet i franskan de Schlyter (1951) y el Basis - Woordenboek voor de Franse de V erlée (1954). Los diccionarios de Ogden y Richards (1928) y West (1953), combin an las siguientes técnicas (Gougenheim et al. , 1964: 13): • La frecu encia de las palabras en la lengua ha blada. • La búsqueda de las pala bras disponibles más útiles. • El empiris mo racional . El primer aspecto supone un avance metodológico ya que hasta la época todos los vocabularios bá sicos se basaban en la lengua escrita , en su gran mayo ría d e carácter literario. En esa misma línea, los autor es franceses deciden incluir el r egistro oral provocando diferencias con otras listas, tales como la lista de Vander Beke 26 . Para ello, utilizan registros so noros ya existentes provenien tes del Musée de la Parole, Musée des Arts populares, Archives de la Radiodifussion y el Musée des A rts et Traditions Populaires. Además, realizan grabaciones directas sobre temas variados que completaron con anotaciones sobre variables sociolingüísticas d e los informantes, tales como la profesión, el origen y el nivel educativo . Las grabaciones dieron lugar a 163 textos con un total de 312 135 palabras diferentes y 7995 vocablos. Previamente, los investigadores contabilizaron las apariciones de lo s vocab l os para in cluir en las listas solo aquello s que se hubiesen repetido al menos 20 veces. Una lista se organizó por orden de frecuencia y la otra por orden alfabético incluyendo en ambas la frecuencia y la repartición, es decir, el número de textos en el que el vocablo está presente. Asim ismo, las palabras que no aparecen en las listas del Français élément aire por razones justificadas y que cuentan con una frecuencia de al menos 29 apariciones se encuentran marcadas con una cruz. A 25 Di sp onib le en http://hdl.handle .net/2027/mdp.39015034357353 [Fecha d e ú ltima consulta el 19 de abril de 2015]. 26 Go uge nhei m et al . (1964) analizan las palabras más frecuentes y peculiaridades como las apariciones de palabras sinónimas ( méde cin y docteur ), de verbos que exp resan a cciones banales de la vid a y pala bras gr amatica les de carácter literario , entre otras. De forma general, las pa labras más cultas tienen una frecuencia superior en la lista ela borad a po r V ander Bek e que en el Françai s Fonda mental puesto que el vocabulari o ha sido solo extraído de textos escrit os. Capítul o 2 Marc o t eór ico 51 continuación, se incluyeron dos tablas (Gougenheim et al. , 1 964 : 113 y 115): la primera muestra la relación entre la categoría gramatical y su distribución tanto numérica como porcentual y la segunda analiza la frecuencia de las palabras distribuidas en rangos 27 . Las palabras gramat icales aparecen en un mayor porcentaje confor me aumenta la frecuencia mientras que los sustantivos y adjetivos predominan en los vocablos con po cas ap ariciones. Así, las unidades léxicas con una frecuencia entre 14 000 y 1000 son en su gran mayoría palabra s gramatica les: determinan tes, pronombres, adverbios, conjunciones y preposiciones que decrecen de 90,9 % en el primer rango hasta 5,7 % en el último. En cambio, más del 50 % de las palabras comprendidas entre 1000 y 20 apariciones son sustantivos. Los adjetivos abu ndan en el tramo de frecuen cia entre 1000 y 60 rep eticiones y los verbo s presentan una distribución más irregular, según se trate de verbos auxiliares muy usados o verbos más concreto s. De hecho, los estudiosos consideran los verbos auxiliares av oir y être como com o palabras gramaticales lo que pr ovoca que no exista n ingún verbo que sobrepase las 5001 ocurrencias. Del análisis de los resultados se constata que los sustantivos tienen una frecuencia baja e inestable mientras que las palabras gramaticales y los verbos tienen una frecuencia fuerte y estable. Por tanto, los autores franceses recomiendan incluir en el cálculo d e la frecuencia el criterio de la estabilidad de la frecuencia aparte del criterio d e la frecuencia absoluta. Asimismo, se cuest ionan la metod ología de las listas de frecuencias donde la mayor parte de las unidades léxicas corresponden a palabras gramaticales, seguida de verbos, adjetivos y algunos sustantivos de carácter general 28 . El hecho que los sustantivos aparezcan de forma reducida en las listas, provoca que palabras que sup uestamente son frecuentes presen ten un número bajo de apariciones o ni siquiera aparezcan. Para ejemplificar la cuestión, utilizan nombres comunes como fourchette , coude , dent , métro y jupe cuyo uso está supeditado a una 27 Por ejemplo, el primer rango contabiliza las palabras de más de 5001 apariciones. E n ese rango, solo existen 11 palabras , 10 de la s cu ales son palabras gramaticales m ás el verbo avoir . No aparece n ingún a djetivo ni nombre hasta el r ango cuar to que comprende l os vocabl os cuyas apari ciones oscila n entre 1000 y 500 . 28 « D'u ne f açon géné ra le, le s li st es de fr équ enc es ne donn ent pas ou ne donnent guère les mots concrets. Ceux - ci n'apparaissent qu'avec une fabile frecuence. Il y a dan s ce fait q uelque cho se qui, au p remier a bord, semb le surprenant» (Gou genheim et al. , 1964: 140). Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 58 Hernández (2010: 91 ) 40 incluye el concepto de lexicón mental entendido, grosso modo , como el lugar don de se alm acenan las palabras. M ás allá d e la crea ción de un diccionario de léxico disponible, el análisis de la s asociaciones entre el estím ulo y las palab ras producidas por los informantes es de gran relevancia para conocer la estructura del léxico mental. Para activar ese léxico disponible en situaciones concretas, tanto los autores franceses como sus suced áneos se basan en los d enominados centros de i nterés. La bibliografía de referencia en torno a los centros de interés puede consultarse desde la perspectiva lex icográfica y pedagógica. Desde el punto de vista de la lexicografía, existen obras medievales que recogen la organiza ción de los vocablos en b loques temáticos denominad os Vocabularia . El o bjetivo era facilitar la adquisición d el latín en un momento donde la gramática y el léxico jugaban un p apel predominante en la enseñanza de idiomas. En el ámbito educativo, su precursor es Decroly (1871 - 1932) quien organiza los diferentes contenidos curricu lares en torno a esos centros o tem as concretos según la edad del alumno. Ejem plo de esa metodología, se en cuentra en el libro de la pedagoga argentina Guillén de Re zzano (1958) donde desarrolla los c entro s de interés correspondientes a los grados infantiles super iores haciendo referencia al nivel académico del alumnado «niños que ya saben leer y escribir y de una edad que oscila entre los siete y ocho años» (Guillén de R ezzano, 1958: 12). Para el primer gr ado (siete a ños) d esarrolla aspectos relaciona dos co n la alim entación de forma elemental: la granja ; el establo , la vaca , la leche ; la conejera ; el chiquero ; la colmena ; el ga llinero ; la huerta ; el granero , el tr igo , el pa n ; la p rimavera 41 . Para el segundo grado, incluye los centros que se relacionan con la vivienda incluyendo la geografía: la vivienda ; la m ontaña ; el río ; la llanura ; el mar ; la selva , el árbol ; calefacción y alumbrado ; viajes: medios de transporte . Ambas disciplinas seleccionan y delimitan determinados aspectos de la realidad con fines pedagógicos encaminados al dise ño curric ular en general o a la 40 « El léxico disponib le supone un nuevo enfoq ue sobre el léxi co. No se trata de las palabr as uti liz adas al producir determinad os textos; sino de las palabras que, organizadas, están en nues tro lexicón mental y están ‘dispo nibles’ para ser utilizadas cuando las circuns tancia s comunicativas lo requieran; cuando un estímulo active e l nodo cer ebral ad ecuado » (Barto l Herná ndez , 2010: 91) . 41 En este estud io se ha optado por incl uir los nombres d e los centros de interés en cursiva siguiendo el estilo marc ado por l a o bra pi one ra Goug enh eim et al. ( 1964 ) secundad a por López M orales (1995), entre otros. Capítul o 2 Marc o t eór ico 59 selección del vocabulario pa ra el aprendizaje de un a lengua. En el caso de la disponibilidad léxica, Mic héa incorpora la definición del concepto de centro de interés haciendo alusión a la pedagogía tradicional. De hecho, se observa cierta similitud entr e algunos de los centros p resentes en obras co mo la de G uillén de Rezzano (1958) y los centros propuestos p or el profesor francés: la viviend a , la huerta , calefacción y alumbra do , medios de transporte y el pan , entre otro s. Si bien es cierto que el concepto pod ría hacer referencia a obras lexicográfica s, el cará cter ideológico del Français Fondamental, que con lleva la alfabetización y aculturación a través de la enseñanza del francés, toma como punto de pa rtida estudios pedagógicos (Michéa, 1953: 39) 42 . Los centros de la obra de M i chéa (1953 ) tomado s como referencia para lo s estudios d el Français Fondamental son dieciséis. Sin embargo, cada investigador mantiene, disminuye o aumenta el número y tipo de centros en función de lo s objetivos de los estudios. La primera investigación que incluye la metodología francesa es lleva da a cabo en 1964 por Pfeffer , espec ialista en lexicom etría alemana . El estudio tiene un objetivo merament e didáctic o: aprendizaj e del alemán hablado contemporáneo. No obstante, la disponibilidad léxica se con stituye como uno de los cuatro criterios de selección del vocabulario gracia s al aporte de nomb res concretos útiles para el aprendizaje y la enseñanza de idiomas. La encuesta se realiza en la principal zona germanófona de Europa Central y comprende 82 escuelas en 48 ciudades diferentes de A lemania, Austria y Suiza . La edad de l os alumnos oscila entre los quince y dieciséis años y la proporción por sexos es similar, elevándose a casi 2000 participa ntes. Para la recogida del léx ico disponible, se solicita a los informantes que escriban en d os pruebas de diez minutos una lista de v einte sustantivos y una lista de doce verb os y ocho adjetivos r elacionados con cada centro de interés. E sos cuestiona rios recogen en total 833 000 palabras y 34 000 42 « L’expl orati on statis tique des centres d’int érêt est devenue une nécessi té. À la vérité, l’expr ession ‘centre d’intérê t’ dési gne, dans la pédagogie traditi onnelle, des groupements de forme variée. T antôt il s’agit d’une même class e d’ obj ets (pa rt ie s du corps, vê teme nts , animaux , pl ant e s), tantôt plus prop rement d e ‘milieux’ (la ville, le village). C es ensembles offrent un choix plus ou m oins large ; ils perm ettent à la pensée de s’engager dans un plus ou m oins grand nom bre de directions. E n un m ot, ils peuvent avoir une ‘cohérence sémantique’ différent e. Il est donc norm al que les probabili tés de rap pel ne se hiérar chisent pas exactement de la même façon dan s les différents centres» (M ichéa , 1953: 39). Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 60 vocablos, entre los que se ex cluyen los no mbres propios, topónimos y adjetivos derivados de nombres de lugares. El vocabulario básico alemán está organizado por orden alfabético, según partes del discurso, frecu encia y origen. Los materiales usados han sido 400 grabaciones de entrevistas y 5400 encuestas escritas de asociación espontánea. Las palabras de la prueba de disponibilidad léxica han sido seleccionadas según su amplitud de repartición y su índice de disponibilidad (superior a 100 menciones) sumando un total de 347 de las 1269 p alabras que conforman ese voca bulario básico. Ese carác ter complementario que ap ortan las pruebas de disponibilidad léxica, se ve reflejado en investigaciones posterior es como la irlandesa, Buntus Gaeilge , publicada en 1966 43 . La obra está escrita en irlandés y su título hace referencia a la base y principio de l ese idioma «a nucleus of Ir ish» (Ó Huallacháin, 197 8: 509). El director del trabajo, Ó Huallacháin (1978: 502), afirma que en el régimen británico la enseñanza del irlandés en las escuelas ha sido autorizad a en 1878 y la enseñan za en lengua irlandesa en 1904, de ahí la necesidad de recopilar material necesario dirigido a profesores y organizado res de cursos. El trabajo se divide en tres partes: el estudio de las estruct uras sintáctica s, el vocabulario y morfología y las pa labras d isponibles. S e centra en el irlandés ha blado por lo que para la recopilación de las palabras y la grabación de las conversaciones se basa en las técnicas empleada s en el Français Fondamental . Concretamente, la prueba de léxico disponible la realizan 260 irlandeses y 260 ingleses de Irlanda sob re 20 centros de in terés 45 que an otaron más de 200 000 43 Los datos del estudio se han recabado a partir de la investig ación de Njoc k (1978) y las publicadas por Ó Hual la chá in en 1970 y 1 978. 44 El número de página corresponde a una anotación manuscrita. E l documento ha sido extraído de la base de datos especializada en educación del Educat ion Resou rce s Inform anti on Cente r : http:// eric.e d.gov/?i d=ED041256 [Última consulta el 1 0 de abril d e 2015]. 45 1) The body and its parts ; 2 ) p hysic exercises, athletics, sp orts ; 3) recreation hobb ies, indoor pastimes ; 4) illn esses (kinds o f sicknesses), inju ries, cures ; 5) religion, the church ; 6) cloth es of all kinds (m en, women, boy s, girls) ; 7) food and drin k ; 8) meals , utensils for each m eal and for preparing meals ; 9) the home or house: furnitur e, fittings, hea t, light ; 10) business: buying, selling ; Hund red s of t hou sa nds o f wor ds of r ec or ded c onv er sa ti ons f rom I ri sh - speaking are as pro vided the basis for the study of vocabulary, verb - mor pho log y and sy nt ax whi ch was designed to show the ki nd of Irish which shoul d be taught in orde r that an ini tial measure of performance would be attai ned as soon as possible. The techniques employed are an elaboration of those pioneered by the CR EDIF team which produced Le França is Fondame ntal (Ó Hu allacháin , 1978: 9 - 10) 44 . Capítul o 2 Marc o t eór ico 61 palabras. Cada sujeto tenía que escribir las 20 palabras que considerara más útiles (nombres, v erbos o adjetivos) p ara cada uno de los centros de interés. Los informantes fueron seleccionados tenien do en cu enta seis fa ctores: la edad, el sexo, la residencia (zona rural o urbana), la ocupación y la distribución geográfica. La distribución de los hablantes por niveles educativos es la siguiente: 100 provienen de educación primaria, 60 de escuelas comerciales ( trade schools ), 50 de enseña nza secundaria y 50 a dultos de los cua les 25 son estudian tes. El factor d el reparto geográfico encuentra su importancia en la distribución equilibrada de los sujetos irlandeses según su dialecto. Por ejemplo , para los irlandeses que hablan irlandés gaélico no tenía sentido tener en cuenta el factor urbano/rural puesto que la casi totalidad de las personas fo rman parte de comuna s rurales. En 1969 el yugoslavo Dimitrijevi ć publica la primera obra de referencia sobre disponibilidad léxica en inglés bajo el nombre de Lexical Availability. A New Aspect of the Lexical Availability of Secondary School Children . La muestra del estudio estaba formada por 185 alumnos de 14 años 46 (8 9 chicos y 96 chicas) de Junior Secondary Schools (125, de lo s cu ales 5 9 chicos y 66 chicas) y Senior Secondary Shcools (30 chicos y 30 ch icas) de zonas rurales y urbanas de Edimburgo. El número de centros se redujo a once, siendo los que siguen: 1) Animals . 2) Countryside. 3) Town. 4) Entertainme nt. 5) Jobs and professions. 6) Science. 7) Means of transport. 8) Politics. 9) Parts of the house. 11) life in to wn a nd cit y ; 12) life a nd w ork in the c ountry and the landscape ; 1 3) animals, birds, fish, insects ; 14) trees, pla nts, flowers, weeds, crops ; 1 5) trades and kinds of occu pation o r work ; 1 6) travel, means of tran sport an d things connected with them ; 17) the family, relatives and peop le's feelings about them se lves a nd others ; 1 8) school life, activities, furniture ; 19) the ruling of the country, governm ent, politics ; 20) the w eather, the time of da m, seasons . 46 Tod os los niños tie nen 14 años a excepció n de 3 chicas y 2 chicos que tienen 15, de ahí la generalización por parte d el aut or. Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 62 10) Food and drink. 11) Clothes. La elección de cada centro de interés atiende a criterios debidamente justificados por el investigador en cad a caso haciendo hincapié en la familiaridad del tema y su representativida d 47 . Se han m antenido 10 centros de interés tradicionales , es decir, que aparecen en la o bra pionera y se ha añ adido un nuevo centro, correspondiente al número ocho, Politics . El moti vo de la eliminación de ciertos centros de interés atiende a cambios introducidos en la metodología y al límite temporal permitido p ara hacer las prueb as, concretamente dos cla ses o sesiones. Una de las variaciones consiste en establecer un tiempo límite e n cada centro de interés para que el hablante pueda escribir todas las palabras que conozca de forma que el total de unidad es léxicas pudiera servir de indicad or de la fluidez verbal ( cf. Dimitrijevi ć , 1969: 5 ) 48 . El autor marca la diferencia entre las palabras disponibles y las parcialmente disponibles según su grado de disponibilidad ( cf. Dimitr ijevi ć , 1969: 4) 49 . Por un lado, las palabras disponibles son más familiares y no req uieren trabajo localizarlas bien porque el hablante no tenga que pensar en b uscar la palabra cuando la quiere utilizar en el discurso o porque no sien te el esfuerzo producido al buscar la. Por otro lado , las palabras parcialmente disponibles son aquellas el individuo conoce y utiliza pero no siempre están disponibles. No son fá cilm ente recordables y requieren un esfuerzo consciente encontrarlas por lo que no todos los informantes de las pruebas las incluyen entre sus respuestas. Para determinar el tiempo necesario, Dimitrijevi ć realiza un estudio piloto en Queensfer ry donde asig na cuatro minutos a cada centro de interés. Comprueba que 47 «The centre of interest h ad to deal with those words that are fam iliar to children, that can be a rranged witho ut much overl appin g between the centre s and which together represe nt a conside rabl e part of children’ s vocabulary» (Di mi tr ij evi ć , 1969: 16) . 48 « The test had a time limit, each centre of interest being all otted the same lengt h of time. The informants were asked to give « al the w ords t hey knew, as fast as they could» . T his means, in other word s, th at the t otal output of le xical item s in on e centre, b y one pupil, co uld be c onside red as a k ind of in dicator o f his/h er verb al fluency » (Dimitr ijevi ć , 1969 : 5). 49 « This di sti ncti on betwee n avail able a nd unavai labl e words bri ngs us to the not ion of the degr ee of av aila bili ty. A word has 100 % deg ree avai la bi li ty if it is avail ab le to all inf orma nt s who take part in a test. The fewer the number of informants who give a word the smaller degree of availabilit y of that word for that population, or the easier a lexical item is recall ed by a person, a group of people, the more available this lexical item is (the higher degree of avai labil ity i t has ) and v . v .» ( Dimitrije vi ć , 1969: 4). Capítul o 2 Marc o t eór ico 63 solo algunos alum nos agotaban el tiempo permitido sin d ificultad mientras que la mayoría terminaba antes o retomaba la tarea tras una pausa. Como la población de estudio pertenecía a un medio rural y, según el autor, su nivel a cadémico era más bajo que el de los alumnos de Edimburgo, decide aumentar en un minuto la prueba. De esta form a, no solo se conseguir ía obtener realmente el léxico dispo nible del alumnado sino también la capacidad de producir las palabras 50 . Del primer ensayo se desprende la importanci a conferida a los factores que influyen en la disponibilidad léxica. La s variables incorp oradas son el sexo, el medio (rural y urban o), el tipo de cen tro educativo (disting uiendo entre Junior Se condary Schools y Senior Secondary Shcools ), el estrato social (dividido en cinco grupos aunque ningún informante perteneciese al primero) 51 y los resultados C. Q. (que combina el cociente de inteligencia IQ que realizan los estudiantes antes de empezar la secundaria junto con la evaluació n de lo s docentes). No obsta nte, el an álisis cualitativo y cuantitativo del a rtículo solo recoge el sexo y el estrato social de los alumnos. Para el recuento de las palabras, Dimitrijevi ć introd uce el concepto de «lexic al item», término que precisa de la distinción entr e vocablo y palabra . En el lengua je no especializado existe la tendencia a usar ambo s términ os como sinónim os. Buen ejemplo de ello se encuentra en la primera acepción de voca blo en el Diccionario de la le ngua española puesto que aparece el término palabra en forma de hiperenlace 52 . Por tanto, no solo se ind ica que son sinónimo s sino que además r edirige al significado de palabra para definir vocablo. Aunque etimológicament e estos términos provienen de voces diferentes, ambas se usan como equivalentes desde el origen de la lengua, como muestra el Dicciona rio crítico etimológico de Corom inas. 50 « The ai m of thi s inve stig ati on was to find out what words were most availa ble t o boys and girl s, and how many such words . If we want ed to eli ci t such words , i.e. not those words whic h the pupils knew and did not use, but only those words that were always available to them, under any circumstances, the test had to be limited in time » (Dim itrijevi ć , 1969: 14). 51 La obra de refer encia es la catego rizaci ón se ti tula Clas sif ica tio n of occupati ons , 1960 , Ge neral Register Off ice, London, Her Majest y’s Stati onery Off ice. 52 La consult a se ha realizado en línea el 20 de abril d e 2015 en la versión electrónica del Dicci ona ri o de l a lengu a e spañola . Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 64 Por su parte, la entrada de vocab lo se inserta como un derivado culto de v ŏ c ā re ‘llamar’, que proviene d e la raíz latina v ō x . En el ámbito de la lingüística estadística, en el que se inserta la presente investigación, se incluye la distinción entre vocablo y palabra . Según Müller (1969: 31), resulta muy complejo delimitar el segmento del discurso y máxime cuando se trata de los tér minos vocablo , palabra y uni dad léxica 53 . Consciente de que cada autor establece unas normas similares para diferenciar las unidades léxicas, M üller ( cf. 1969: 32) 54 aboga por la existencia de una norma convencional como la del sistema métrico 53 « Inutile d'insister sur les incertitudes de la lingu istique en ce qu i conce rne ce ‘ segment de discou rs ’ que le sens comm un identifie co mme étant ‘un mot’ . Dire d'un e ph rase qu'elle est form ée d e 10 mo ts, o u dir e que le texte d u Cid , par exemp le, en comp te 16 690, c ela sup pose soit un e défin ition a ssurée du m ot co mme unité de texte, te lle que jam ais ce lui qu i com pte ne p uisse h ésiter ou n e do ive ar bitrer de fa çon subjective , soit une norme conventionnelle prévoyant to us les cas do uteux. […] Les difficultés ne font que croître quand o n passe de la dé limitati on du mot à c elle d u vocable, unité de lexique» ( Mül le r , 1969: 31). 54 « On ne saura it épuis er cett e ques ti on 1. Dison s seul eme nt qu' à l'h eur e actu el le , en fran çai s comme dans d'autres idiomes, chaque auteur de dépouillements lexicaux est contraint de se poser la question et, finalement, de construire sa propre norme. [.. .] On ne peut que souhaiter, au moins pour le français moderne, l' adoption d'une norme convention nel le, même discut able aux yeux du linguiste, mais acceptée comm e le fut le système métr iq ue. En att end ant , il est néc ess ai re qu e cha que cher che ur i ndiq ue, au moi ns s ommai reme nt, sur quel le s bases i l a trava illé» ( Mül le r , 1969: 32) . PALABRA, del anti guo parabla y éste del lat. parab ŏ la ‘co mp arac ión, sím il’, que a s u vez v ino del gr. Π a ρ a β o λń ‘com pa ració n, a legor ía’ (d e π a ρ a δ á λλειν ‘po ner al lad o, comp arar’; β á λλειν ‘echa r’); en r oma nce se pasó de ‘comp arac ión’ a ‘fr ase’ y lueg o ‘vocab lo’. 1.ª do c.: orígene s del i dioma (Cid, etc .). De uso gener al en tod as las época s y común a todos los roma nces de O ccident e. La for ma arcaica paravla o parabla se lee todavía en A lex. El sen tido etimo lógico se nota tod avía en textos arcaico s: e n Berceo Mil, 16b es ‘frase’ o ‘co mp aración ’, en A lex., 401 será ‘refrán’ o ‘sente ncia’; lo m ás co mún es halla r d esde el principio (p. Ej. E n el Cid) usos sem ánticos que no difi eren esencialment e de l os modernos, aunque también en el los se podría tr aducir palabra por ‘ frase ’ ( estas pala bras f abló) (Corominas, 1974 [1954] , t omo IV, p. 616). VOZ, del la t. v ō x , v ō cis , ‘sonid o prod ucid o por el aire expe lido por lo s p ulm ones a l h acer vibrar l as cuerdas vocables’. 1.ª do c: C id. Vocal [le tr a vocal , hac ia 1250, Set ena ri o, 4. 20; A. DE PAL. 535B: «voca les se dize n las letras que de po r sí fazen boz» ; Neb r.; oració n vocal, Sta. Ter esa, los voca les del Con cilio, fin S. XVI, Aut. ], tomado de v ō c ā lis ‘hecho co n la voz ’, ‘sono r o’, ‘vocal’; vocá lic o, vocalismo; vocalista ‘el cantor, músic o vocal’ [1834]; vocalizar; vocalizac ión; vocal izador.[…] Deri vados cul to s de v ŏ c ā re ‘llam ar’ (d e la mis ma r aíz que v ō x): Vocablo [APal. 9d, 141d, 535b; Nbr.; en escrituras en bajo latín encon tra mos v ocabu lo (o vog abulo 1 081, Oe lsch.) con el sentido ‘por nomb re, llamado’], de v ocabul ŭ m ‘d eno min aci ón’, ‘no mbr e’ , ‘pal ab ra ’, ‘térm ino’; v ocab ulari o [« v. Vocabularium» Nebr.] ( Coromi nas , 1974 [1 954] , tomo V, p. 845) . Capítul o 2 Marc o t eór ico 65 sobre la cual pudiesen basarse los estudiosos. Mientras tanto, propone al investigador la elección de unos determina dos criterios debidamente argu mentados sobre los que fundamentar su estudio . Müller (1963: 31 - 32) va más allá y distingue entre dos acep cio nes del término genérico palabra . Por una parte, hace mención a la un idad que constituye el texto y, por otra parte , a la unidad de léxico. A la primera acepción corresponde literalm ente al término palabra y, a la segunda se ajusta voca blo, entendido co mo los términos que aparecen en la nomenclatura de un diccionario y que forman el vocabulario de una lengua. Trasladando ese enfoque al estud io de disponibilida d léxica, los vocablos se refieren al número de palabras diferentes y las palabras a las unidade s de texto producidas por los informantes, es decir, al número de ocurrencias de los vocablos. En la mayoría de las investigaciones de disponibilidad léxica se añade esta distinción, de manera más o m enos explícita, coincidiendo con las sig uientes definici ones: A pesar del consenso a la hora de utilizar vocablo y pa labra en los estudios de disponibilidad léxica, en algunas investigaciones se realizan puntualizaciones sobre su uso y que se completa con el término unidad léxica . Según Dimitrijevi ć (1969: 4 - 5) 55 , en ocasiones las palabras co ntabilizadas en los estudios de disponibilidad léxica y entendidas como unidad de texto, comprend ían más de una palabra. Por tanto, el término más adecuado ser ía el d e unidad léxica , como unidad d e sig nificado que puede estar formada por más de una palabra. Ejemplo de ello, son las ent radas léxicas formadas por más de una palabra, tales como, intestino grueso , disco duro , ama de casa , etc. 55 « We have jus t said that there was no restriction in the test, as to what word s ha d to b e given , as far as they were availabl e to the informant s. This had led to the eli cita tio n of one, two or more words which had to be taken as one sing le ‘unit’ or response, such as ‘ra ilway station ’ , ‘fresh a ir’, etc. Beca use of such ‘multi wo rd responses’ we have a dopted the term ‘lexical item’ denoting all kinds of responses - thos e resp onses consis ting of one, two or more w ords. O ther alter native terms could be ‘lexica l ph rase’ , ‘lex i cal term’ o ‘lexica l u nit’» (Dimitr ijevi ć , 1969: 4 - 5). Palabra [...] cada una de las uni dades léxi cas empleadas, t anto a isl adas c omo unidad es complejas o combinación d e lexemas p ara designar u n referente, repetidas o no, q ue integr an un texto (Ayo ra E steba n, 200 6: 87). Vocab lo[ .. . ] cada una de las unidades léxicas distintas que registra un diccionario de frecuenc ias. Pro porcion a info rmac ión sobre las cate gorías gramaticales co n q ue se reflejan en el acto discursivo (Ayora Esteban, 2006: 87). Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 66 En esta misma línea, Gómez Devís (2004: 43), analiza el significado de unidad léxica recogiendo la perspectiva de diferentes investigadores y concluy e que en el ám bito de la estadística léxica el vocablo se entien de como unidad léxica. Una vez e sbozados estos conceptos clave , a modo de inciso, a continuación se reanuda la presentación por orden cronológico de las investigaciones que marcan de una for ma u otra la metodología de la disponibilidad léxica actual. Este es el caso del trabajo publicado en dos tomos por Mackey ( 1971 a) : el primero titulado L e vocabulaire disponible du français. Le vocabulaire concret usuel des français et acadiens: étude témo in y, el segundo, Le Vocabulaire disponible des enfants acadiens . Se podría considerar como la primera investigación basada en la obra pionera puesto que las indagaciones inicial es remontan a los años 1958 - 1959 56 . El estudio se inicia a través de un proy ecto en las regio nes de Que bec y Manitoba respaldado po r el Centre International de Recherches sur le Bilinguisme de la Universit é Laval situado en Que bec con objeto de comparar las variedades léxicas de diversas regiones francesas y canadienses. En alguna s regiones bilingües, los hablantes realizan la prueba con cinco centros de interés complementarios en inglés . Debido a la falta de consenso metodológico entre las universidades implicadas, se crea un comité interuniversitario que en 1963 m arca las pautas de recogida, procesamiento y análisis de datos y consensúa las divergencias. Por ejemplo, los centros de interés seleccionad os en Montreal y en Laval eran diferentes ya que en algunos casos se unificaban algunos centros tradicionales y en otros se añadían nuevos. Para permitir el parangón con los datos recopilados en Le Français Fondamental y a su vez dar respuesta a los objetivos del proyecto canadiense, se mantienen lo s dieciséis cen tros tradiciona les y se añaden los siguientes: 17) l’église et la vie paroissiale , 18) les sports et l’équipement , 19) les outils , 20) l’automobile et ses parties , 21) actions courantes y 22) les affaires . Es precisamente la fidelidad a la metodología aplicada en la investigación francesa la que marca el inicio de las com paraciones interm uestrales en el campo d e 56 El proyecto de inves tig aci ón de Dimi tri je vi ć (1969) fue in iciado con p osterioridad , en 1963 , aunq ue la publicac ión fue anteri or a la de Mackey (19 71). Capítul o 2 Marc o t eór ico 67 la disponibilidad léxica a través d el léx ico disponible de F rancia y de Can adá 57 . Sin embargo, en el prefacio el autor expone que más que presentar una comparación entre dos vocab ularios en sí m isma, la obra intenta ex plicar la forma de llevarla cab o para proporcionar las he rramientas adecuadas a futuros inves tigadores 58 . Por una parte, se compara el grado de disponibilidad de las palabras en las dos listas y, por otra parte , se analiza n las palabras que solo están presentes en u no de los vocabularios. Para acom eter tal ob jetivo, asistentes de lingü ística y estudiantes corrigieron a mano las listas im presas por or den alfabético tanto del vocabulario de Francia como de Acadia para evitar fundamentalmente tres tip os de situaciones: • Una palabra se presenta en singular en un a lista y en otra en plural. • Una palabra aparece en género masculi no y en otra lista en femenino. • Una palabra compuesta, una locución o un grupo de palabras pueden ser clasificadas como palabras única s en una lista y en la otra n o. E sas palabras compuestas pueden aparecer con o sin guión, por ejemplo el caso de pois y petit pois , football o foot - ball . Surgen así las primeras reglas o pautas de lematización para permitir que dos vocablos iguales, como pied y pieds no fuesen considerado s como lexía s difer e ntes. Se fija la h omogeneización de las palabras en númer o singular y género masculino pero en el caso de las palabras com puestas no se establece una regla fija. Las encuestas fueron realizadas mediante listas cerradas de 20 palabras a niños de entre 9 y 12 años (la misma edad de los estudios franceses) de 20 clases diferentes en 12 escuelas. C abe destacar que en un primer momento se recopilar on datos de 1745 alumnos de 9 a 18 años, repartidos en 47 clases y 19 escuelas en las diversas regiones francófona s del Nouveau - Brunswick pero se eliminaron los resultados de los niños de 13 a 18 años para facilitar la comparación con el vocabulario de Francia. Asimismo, en algunas regiones bilingües, los sujetos realizaron la prueba de léxico 57 « Il a pour but non seulemen t de fourn ir la documentation pour une comparaison du vocabulaire commun de deux régions francophones, mais également de servir d'étude témoin à d'autres étud es analogues » (Mack ey, 1971a: 13) . 58 « L'ét ude ne va pas assez loin pour établir les comparaisons entre les deux vo ca bularies. Elle se borne à fournir les outils à c eux qui entreprenn ent une telle co mparaiso n. Elle n'ex ploi te pas la docume ntat ion; elle explique simplement comm ent cette documentation a été obtenue » (M ackey, 1 971a: 11). Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 74 basaa y el francés de Camerún que entre el francés de Francia y el francés de Camerún. La investigación concluye que el bilingüismo supone un factor de enriquecimiento en los hablante s bilingües ya que describen mejor la realidad que los monolingües y, por tanto, son capaces de comprender mejor el medio sociocult ural en el que viven. En cuanto al francés de Francia , con sidera que es inadecuado para describir la realidad sociocultura l africana. Sin embargo , resalta la tendencia de las lenguas africanas a utilizar préstamos de otra s lenguas en lugar de potenciar la creación léxica co n términos nuevos lo cales para describir la África moderna y sus realidades. La primera investigación en inclu ir la disponibilidad léxica en lengua esp añola , además de en inglés, corresponde a la obra de Vict ery (1971). A cont inuación, le siguen investigaciones realizada s en Puerto Rico (López M orales, 1973, 1978, 1979; Román, 19 85), en Méxic o (Justo Hernández, 1986 68 ; Cañizal Arévalo, 1987, 1991; Ruiz Basto, 1987); en España (Azurmendi Ayerbe, 1983; Benítez Pérez, 1992) y en Chile ( Echeverría, Herrera, More no y Pradenas, 1987; Men a Osorio, 1986), entre otros. No obstante , la metodología segui da por los estudios hispanos difería de un investigador a otro lo que dificultaba la comparación intermuestral (centros de interés, tiempo de la prueba, lematiza ción de las palabr as, etc.) . Por ello, durante el XI Congreso Internacional de la Asociación de Lingüística y Filología de la A mérica Latina (ALFAL) que tuvo lugar en Las Palmas de Gran Canaria, expertos en el ámbito de la disponibilidad léxica decidiero n consensuar algunas pautas generales procesuales y analíticas. No será hasta 1999 cuando tenga l ugar en la Universidad del País Vasco la reun ión científica que establecerá los objetivos y la metodología del Proyecto Panhispánico de Disponibilidad Léxica. El objetivo del Panhispánic o, c oordinado por López Morales, es conocer el léxico disponible de lo s diferentes países hispanohablantes a través de diccionarios de disponibilidad creados bajo los 68 A difere ncia de la tendenc ia de otra s inves ti gaci ones , el invest iga dor mexic ano trab aja con list as cerr adas de diez palabr as por cent ro. Capítul o 2 Marc o t eór ico 75 mismos principios. De forma general, las bases sobre las que se asientan son las siguientes: • La recogida de datos se realiza mediante una encuesta de léxico di sponible que utiliza los dieciséis centros de interés tradicionales: 1) El cuerpo humano ; 2) La ropa ; 3) Partes de la casa (sin los muebles) ; 4) Los muebles de la casa ; 5) Alimentos ; 6) Objetos colocados en la mesa para la comida ; 7) La cocina y sus utensi lios ; 8 ) La escuela: muebles y materiales ; 9) Calefacción, iluminación y medios de airear un recinto ; 10) La ciudad ; 11) El campo ; 12) Medios de transporte ; 13) Trabajos del campo y del jardín ; 14) Los animale s ; 15) Juegos y distracciones ; 16) Profesiones y oficios . • El tiempo de la pru eba está limitado a dos minut os por ce ntros de interés. • Las listas son abiertas donde el sujeto puede escribir todas las palabras que le vengan a la mente. • La población objeto de estudio está formada por estudiantes de nivel p reuniversitario (concretamente en el curso anterior que da acceso a la universidad). De esta forma, se pretende h omogeneizar la edad, el nivel de instrucción de lo s hablantes e in cluso el léxico ya que se consider a que esos estudiantes no han adquirido los términos técnicos con estudios superio res. • La edición de los datos atiende a un protocolo previamente acordado donde se incluyen directrices para la transcripción de los ma teriales, lematización de sus palabras y eliminación d e ciertos vocablos 69 . • La fórmu la m atemática recomendada para calcular la disponibilidad léxica es la elaborada por López Chávez y Stras sburger Frías (1991). • Las variables utilizadas corresponden al sexo, nivel sociocultural, zona geográfica (urbana o rural) y tipo de centro (público o privado). • Los listados se publican en forma de diccionarios, usualmente ordenados por orden alfabét ico y por orden decreciente de disponibilidad, pero también puede estar organizado según variables determinadas, como el sex o o el estatus social, entre otra s. Con objeto de coordina r el trabajo de los diversos estudios disponibles, se celebraron otros tres en cuentros: el II y III Encuentro Internacional de 69 Un a d e l as ob ras de referencia en este sentido es Samper Padilla (1998) y Sam per et al. (2003: 95 - 101). Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 76 Disponibil idad Léxica se realizaron en el año 2003 y 2005 en San Millán de la Cogolla (La Rioja) y el I V Encuentro de Disponibi lidad Léxic a tuvo lugar en Salam anca 70 en 2011 . A lo largo de estos añ os, se han llevado a cabo n umerosos trabajos aplicando esta metodología no solo en estudios de d isponibilidad léxica en español a hablantes de lengua materna sino también a estudia ntes de español como lengua ex tranjera y hablantes y estudiantes de otras len guas 71 . 2.4. Investigaciones relacionadas con el léxico disponible No cabe duda que aunque el francés diera vida al campo de la disponibilidad léxica, el español es la lengua en la que se han desa rrollado la mayoría de los estudios sobre todo gracias a l empuje recibido por el Proyecto Panhisp ánico de Disponibilidad Léxica. En los apartados anteriores se ha realizado un recorrido por las primera s investigaciones y se h an abordado los principales cambios metodológi cos desde sus orígenes hasta la actualidad. El objetivo de este apartado es encuadrar el actual estudio en las investigaciones de español como lengua materna y en inglés o francés como lengua ex tranjera. En prim er lugar, se m encionan las principales investigaciones en lengua española p artiendo de Puerto R ico, país donde Lóp ez Morales comienza realiza su primera investigación sobre disponibilidad léxica, pasando por otros países hispanoamericano s hasta llegar a Es paña, donde los estudios se dividen por comunidades autóno mas. En cuanto al esp añol como lengua extranjera o segunda lengua, cabe mencionar el florecimiento de las investigaciones en este ám bito en los últimos años. El precursor, Carcedo González (2000c), analiza el léxico disponible de españ ol como lengua extranjera de estudiantes fin eses. Por las características del presente estudio, se han recopila do las principales investigaciones en inglés como lengua extranjera. 70 Ag rade zco tanto a los organizad ores d el men cionado e nc uentro como a los directores del presente trabajo que permitier an mi asist encia. 71 E l equipo de Dis polex recoge las referencias bibliográficas de más de 350 estudi os public ado s sobre la disponibili dad léx ica y el directorio con los investigadores principales en este ámbito. [Consultado en www.dis pole x.com el 19 de agos to de 2 014] . Capítul o 2 Marc o t eór ico 77 En cambio, en francé s como lengua ext ranjera no se ha dedicado ningún apartado específico debido al escaso número de investigaciones. Aparte de los estudios de Mackey en Canadá (1971 a, 1971b ), se han localizado investiga ciones en la provincia canadiense de Manitoba, zona donde el inglés es el idioma oficial de facto y el francés es el idioma oficial de eure . Las prin cipales indagaciones han sido llevadas a cabo po r la investigadora Rodri guez , especializada en los estudios de variación geolingüística en Canadá (Rodriguez , 1993, 2004, 2006, 2007 , 2009, 2010). Asim ismo, Dupré (2007) realiza un estudio comparativo sobre estudiante s bilingües en la región de Manitoba (Saint - Lazare) y Ontario (Otawa) y analiza más en detalle la disponibilidad léxica de los alumnos en Otawa en su tesis de doctorado (2 002) bajo la dirección de Bougy y Rodri guez. En cuanto a las antiguas colonias francesas, destacan los estudios de F all (1976) y Gontier (1986) en Senegal y Njock (1978 ) en Camerún. 2.4.1. En español como leng ua matern a 2.4.1.1. En Hispanoamé rica A pesar de que la primera investigación en lengua española la llevase a cabo Victery (1971), por la envergadur a de los trabajos de López Morales se le considera el precursor de la disponibilidad l éxica en español. Asimismo, Victery (1971) trabaj a con una muestra variada (alumnos monolingües en Méx ico, alumnos bilingües y monolingües de Estados Unidos) y analiza la disponibil idad léxica en español y en inglés mientra s que López Mora les ( 1973 ) realiza un estudio sociolingüístico sobre una muestra de 63 escola res de dos sociolectos de San Juan (Puerto Rico). Los centros de interés seleccionados son los siguiente: 1) Alimentos ; 2) Animales ; 3) La casa ; 4) La cocina ; 5) El cuerpo humano ; 6) Materiales de construcc ión ; 7) Muebles ; 8) La ropa ; 10) Transportes . Lóp ez Morales (1978) utiliza ese léxico de los escolares de la región metropolitana de San Juan de Puerto Rico recogido en el estudio de 1973 para compararlo con el léxico frecuente de preescolar es puertorriqueñ os llevado a cabo por Rodríguez Bou en 195 2. Tras cotejar la s dos obras (López Morales, 1973 y Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 78 Rodríguez Bou, 1952), López Morales (1978) manifiesta la gran diferencia encontrada en ambos listados no solo por la diferencia de edad de los informantes estudios y su consiguiente tiemp o de aprendizaje si no también por la metodología empleada para crear el léxico frecuente y el léxico dispon ible. En esa misma lí nea, López Morales continua con el estudio de la disponibilidad des de dos vertientes: la sociolingüís tica y la lingüística aplicada a la enseñanz a de lenguas. Por un lado, en 1979 se sirve del índice de disponibilidad para analizar y comparar cualitativa y cuantitativamente el léxico disponible de tres estratos sociales (bajo, obrero y medio) de la muestr a d el estudio Sa n J uan d e Puerto Rico de 197 3. Por otro lado, en 1986 destaca la importancia del léxico disponible en la selecció n del voca bulario. Su propuesta pasa por incorporar a los listados de léxico frecuente los resultados del léxico d isponible. Ya en 1991 72 , Ló pez Morales destaca la import ancia que había cobrado la disponibilidad léxica en los años precedentes. C on objeto de seguir impulsando los estudios en este ámbito, López Morales y García Marcos (1995) coordinan el proyecto de investigación de disponibilidad léxica en Andalucía del que surgieron trabajos en Almería (Mateo García, 1996, 1998) y en C ádiz (González Martínez , 2002), entre otros. Un año más tarde, López Morales (1996) hace una revisión de los primeros trabajos en este ámbito, de la forma de calcular la disponibilidad léxica y de las principales aplicaciones de la d isponibilidad léxica en otras discip linas tales como, la d ialectología, la so ciolingüística, la psicolingüística, la etnolingüística y la lingüística aplicada a la enseñanza de la lengua. En 1999, López Morales es tudia el léxico d isponible de P uerto Rico a partir de una muestra de 558 estudiantes universitarios de primer año. La prueba incluye los 16 centros del Français Fondamental aunque con ligeras modificaciones para adaptarlos al clima del país y a la muestra de estudio: chauffage se sustituye p or aire acondicionado y école por universidad . C on ob jeto de realizar un estudio socio lingüístico, la prueba 72 «Lo relativo a la dispo nibilidad léxica ha experi mentado un auge sin precedente s desde la presentaci ón de López Morale s en 1978. En aquel momento, l a disponi bili dad sólo se tra bajaba a b ase de f recuenc ias, s iguie ndo el patrón d e análisis establecido por los iniciadores fran ceses (Michéa 195 7, G ougenh eim 1967); así había sido elaborado el Proyecto de disponibilidad léxica en escolares de San Juan (López Morales 1973) del qu e sólo un par ll egaron a la letra impresa (López Moral es 1978, 1979) » (López M orale s: 1991: 12). Capítul o 2 Marc o t eór ico 79 incorpora va riables sociológicas referidas a l sexo, nivel sociocultural, zona geográ fica y tipo de escuela donde los inform antes estudiaron antes de ir a la univer sidad. Tomando como base los datos recopilados en ese estudio, en 1999b el investigador abor da más específicam ente los anglicismos presentes en esos listados. Asimismo, otros autores comparan los listad os puertorriqueños con distintas variedades del español: López Chávez (1992, 1995) realiza el cotejo con el inventario de Madrid, Las Palmas, República D ominicana y Puerto Rico; Alba (1998) lleva a cabo una compa ración dialectal que incluye los listados de República Dominicana, Madrid, México, Concepción (Chile) y Puert o Rico; González Martínez (2000 - 2001) compara el léxico puertorriqueño con el léxico gaditano; Carcedo Gonz ález (2003) añade a los listados de Puer to Rico y Cádiz el de Asturias, etc. Tras l a merecida introducción de los trabajos de López M orales y siguiendo la demarcación geográfica, se comentan algunos de los principales trabajos llevados a cabo en América, por países y siguiendo el orden de publicación del primer trabajo en el ámbito . En E spaña, debido a la vasta literatura en este campo, los estudios se presentan según comunidade s autónomas. En Puerto Rico, Belén Román (1985) reali za su tesina sobre una muestra de 293 estudiantes de primer, tercer y quinto grado del Distrito Escolar de Do rado utilizando los 10 centros de interés presentes en López Morales (1973). Entre las conclusiones del trabajo , cabe destacar la relación que guardan los resultados de disponi bilidad léxica con las variables sociológicas del estudio: grado escolar, sexo, zona de procedencia y niv el socioeconómico. En 1987 , Butrón hace una revisión de la fórmula matemática de la disponibilidad en un estudio en el que analiza el léxico de alumnos d e escuela elemental. P osteriormente , Butrón (1989) analiza algunos aspectos sociolingüísticos que influ yen en el léxico disponible p resentado en 1987. Asimism o, en 1991 incorpora nuevos índices representativos de la disponibilidad léxica: disponibilidad de centros para un grupo, disponibilid ad de léxica d e un informante y disponib ilidad léxica de un grupo. En 2013, Fuster Pérez examina el léxico de una muestra de 60 estudiantes de primer año de la Universidad de Puerto Rico estratificada según sexo (30 hombr es y Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 80 30 mujeres) y según el tipo de centro educativo (30 provienen de la escuela pública y 30 de la escuela privada). El estudio recoge tan solo cuatro cen tros de interés, de los cuales realiza un análisis cuantitativo : 1) Comidas y bebidas ; 2) La ciudad ; 3) Ju egos y distracciones ; 4) Profesione s y oficios . El análisis cualitativo lo realiza solamente sobre el centro de interés Juegos y distr acciones el cual compara con el léxico recogido por López Morales 23 años antes, es decir, en 1990 73 . Cabe mencio nar que p ara la comparación solo se tuvieron en cuenta l as 100 unidades léxicas más disponibles ya que el límite de tiempo en López Morales era de cinco minutos y el de Fuster Pér ez (2013) dos minutos. En Chile , el estudio pionero en disponibilida d léx ica corresponde a la tesis de maestría real izada por Mena Osorio (1986) a un grupo de 300 escolares de 4 . º, 6 . º y 8. º grado de educación básica bajo la dirección de Echeverría , considerad o el impulsor de la dispon ibilidad léxica en ese país. Se trata de la prim era investigación que establece como límite temporal dos minutos por cada centr o d e interés y que se ha convertido en la pauta seguid a por la mayoría de investigad ores. Echeverría (1987) dirige el equipo de investigación compuesto por Herrera, Moreno y Pradenas que se encarga de realizar la disponibilidad léxica de 200 estudiantes de primer curso y 200 de tercer curso de E duc ación Media de Concepción . El estudio incluye el cálculo del índice de co hesión , ta n ex tendido en numerosas investigaciones, y divide los centros de interés según ese grado de cohesión semántica, distinguiendo entre centros de alto grado: 1) Cuerpo humano , 2) Medios de transporte , 3) L a ropa , 4) Muebles , 5) Herramientas y materiale s de construcc ión , 6) Alimentos , 7 ) Animales ; y centros de bajo grado 8) Naturaleza , 9) La casa y 10) La coc ina . En 1991, Echeverría realiza un estudio comparativo del léxico de estudiantes de nivel básico y nivel medio recogidos en los estudios anteriormente mencionados (Mena Osorio, 1986 y Echeverría et al. , 1987 ). En el análisis destaca que adem ás d el nivel d e escolaridad, la variable que m ás influye en el léxico dispon ible es la procedencia sociocultural. Ese mismo año, V argas Sandoval (1991) pretende conocer el léxico hablado por la clase m edia de los adultos de la Región de Valparaíso. La muestra de estudio 73 Los datos del est udio de López Morales (1999) fueron r ecopilados e n 1990. Capítul o 2 Marc o t eór ico 81 está formada por 500 informantes entre 20 y 50 años de las doce ciudades más pobladas de esa región (San Antonio, La Ligua, Quillota, La Calera, Limache, Llay - Llay, Quilpué, Villa Alemana, San Felipe, Los Andes , Valparaíso y Villa del Ma r). Los centros de in terés an alizados son nuevos: 1) Arte ; 2) D erecho ; 3) Economía ; 4) Política ; 5) Sentimiento ; 6) Teología . En 1997 comienza un proyecto de investigación de tres años de duración bajo la dirección de Echeverría destinado a la creación de tres p rogramas infor máticos para la enseñanza del español. Concretamente el programa denominado Vocabulario disponible trata de b uscar una aplicación práctica al léxico disponible dentro de la lingüística aplicada a la enseñan za de una lengua. El léxico incorporado forma parte del estudio de Valencia Espinoza y Echeverría (1999) que analiza el léxico disponible de los estudi antes chilenos de todas las regiones del país. El número de informantes asciende a un total de 2052 escolares de 4 . º año de educación media que aportan información sobre el sexo, nivel sociocultura l, régimen educativo, región y procedencia poblacional. Trabajan con 18 centros de interés, en su mayoría diferente s a los tradicionales, lo que dificulta la comparación con otros estudios del Proyecto P anhispánico 74 . A partir de los listados del léxico disponible de Chile, Arancibia Manhey (2006) analiza las unidades léxicas procedentes de lenguas indíge nas, concretamente del mapudungu n, el quechua, el n áhuatl, el caribe , el arah uaco, el kunza, el kuna, el taíno y el gu araní. La investigador a extrae 301 vocablos provenientes de algu na de las 10 familias aborígenes de América y los presenta ordenados alfabéticamente según el centro de interés y con indicación de la lengua de origen y la frecuencia abso luta . Las lenguas más productivas son el quechua y el mapudungun y las menos el aymara, el kuna y el kunza. La influencia de diferentes culturas queda patente en las unidades léxicas aportadas por los informantes chilenos ya que , por ejemplo , en el centro d e interés denom inado Mundo espiritual aparecen vocablos provenientes de la 74 1 ) Partes del cuerp o ; 2) Ropa y calzad o ; 3) La casa ; 4) Muebl es , 5) Alime nto s ; 6) La coci na ; 7) Medi os de trans po rte ; 8) Trabaj o de l campo y del jar dín ; 9) Plantas y ani males ; 10) Juegos y entretenim iento ; 11 ) Profesi ones y of icio s ; 12) La po lít ica ; 13) La ac tiv idad e conó mica ; 14 ) Las art es ; 15) Cie ncia y tecnol ogí a ; 16) Mundo espi ri tua l ; 17) Proce sos mentales ; 18 ) Proble mas de l ambi ente . Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 82 mitología de la Isla de Chiloé ( caicai - viú , caleuche , pincoya ) y de la zona a ndina ( Viracocha y Mamacocha ). Según Aranci bia Manhe y ( cf. 2006: 71) en los primeros tiempos de la Conq uista y la C olonia l a lengua española introdujo los vocablos de los productos autóctonos. Por esta razón, la mayoría de las entradas léxicas procedentes de lenguas indígenas q ue forma n parte del acerbo lingüístico esp añol se localizan en el cen tro de inter és Plantas y animales , seguido de Alimentos y Trabajos del campo y del jardí n . Por ejemplo, en el centro d e Alimentos aparecen vocablos como maíz, cacao, mate, chocolate, papa, tomate ; en el centro de Plantas y animales se registran las palabras coca, y erb a mate, chirimoya, puma ; en la Ropa y calzado se encuentra alpaca , etc. Echeverría, Urzúa e Figueroa (2005) presentan una nueva aplicación informática para calcula r el índice de disponibilidad denominada «Dispogen II». Un año más tarde, Urzúa, Sáez y Echeverría (2006) estudian la disponibilid ad léxica de estudiantes y profesores de la carrera de Ingeniería Civil Ma temática en la Universid ad de Co ncepción . La muestra está compuesta por 85 informantes, 71 estudiantes (dividid os en tres nive les según el curso en el que estaban m atriculados) y 14 profesores. Los seis centros de interés se adaptan a la muestra de estudio: 1) Cálculo ; 2) Álg ebra ; 3) Estadística ; 4) Física ; 5) Educaci ón ; 6) Geometría . El objetivo es conocer cómo evoluciona la adq uisición de ese vocabulario específico en función de los años d e estudio en ese ámb ito y reflexionar sobre los errores y lagunas léx icas de los estudiantes para intentar tomar medidas al respecto. Ferreira (2006) presenta su tesis de m agíster sobre la disponibi lidad léxica en inglés como lengua materna y como lengua extranjera sobre la que más tar de, en el año 2010, publica un artículo junto con Echeverría. En su trabajo destaca la aplicación de la psicolingüísti ca a los estudios de disponibilidad léxica a través del análisis de las relaciones de palabras con el programa DispoGrafo, aplicación presentada años más tarde en un artículo por Echeverría, Vargas, Urzúa y Ferreira (2008) 75 . Se trata de la primer a herramienta informática que contabiliza el número de 75 El so ftwa re fue cre ado por Ec heve rrí a y Varg as Opit z en 2006. Capítul o 2 Marc o t eór ico 83 relaciones entre dos palabras, los clusters y que, además, es capaz de representar de forma gráfica esa organ ización de palabras en cada centro de interés 76 . Fasce, Echeverría, Matus, Ortiz, Palacios y Soto (2009) publican un artículo interdisciplinar en la Revista médica de Chile . El fin del estudio es conocer los atributos o cualidades que estudiantes de medicina y médicos en ejercicio identifican como recomendables para el ejer cicio de la profesión a través de la disponib ilidad léxica . Las investigaci ones en México comienzan en 1986 con la tesina de licenciatura de Justo Hernández, Disponi bilidad léx ica en colores . La muestra está formada por 56 informantes adultos (2 6 mujeres y 3 0 hombr es) y las varia bles sociocultura les incluidas en el estudio son el sexo, el tipo de enseña nza y la ubicación escolar. El principal objetivo consiste en conocer los nombres de los colores más dispon ibles relacionados con diez centros de interés mediante el sistema de listas cerradas en los que los informantes so lo tenían que escribir diez nombres de colores en cada centro 77 . Cañizal Arévalo (19 87) analiza la influencia de ciert os factores sociológ icos como el sexo, el tip o de escuela (pública y privada) y las horas de exposición a la televisión en seis centros de interés en una muestra de 68 escolares de primar ia. Al igual que Justo Hernández (1986) la autora pretende recoger ad jetivos dispon ibles de forma inclu ye el centr o de interés Defectos físicos y morales para obtener mayores resultados. Los otros cinco centros de in terés forman parte del listado tradicion al: 1) Partes del cuerpo ; 2) Objetos que hay en el inte rior de la cas a ; 3) Alimentos y bebidas ; 4) Medios de transporte ; 5) Profesiones y oficios . En 1991 , estudia la organización de las palabras de un centro de inte rés destacando la existencia de un núcleo en torno al c ual se organizan el resto de pala bras en forma de redes o con stelaciones. Las contribuciones mexicanas más importantes vienen de la mano de López Chávez y Strassburger Frías (1987, 1991) gracias a l a revisión de la fórmula matemática que permite calcular el índice de disponi bilidad léxica 78 que es empleada 76 En el a part ado 6.5 se explica el funcionam iento del programa co n detalle y se presentan los análisis realizados con el p rograma en este estudio. Agradecemo s la colaboración de Roberto F erreira quien nos facilit ó el DispoGrafo y el Dispogen. 77 1) La ropa ; 2) Zapato s ; 3) Cosmé tic os ; 4) Automóv il es ; 5) Anunc io s comer ci al es ; 6) Moch il as, bol sas y malet as ; 7) Muebl es ; 8) Tapi ces y alfo mbras ; 9) Pintura de c asa ; 10) Vest i do . 78 Vi d. apartado 2.5 par a una r evisión de la fórmula matemátic a. Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 90 disponibilidad y el contenido de manuales de español como segunda lengua o lengua extranjera utilizados en España y en el extranjer o y destaca que en ellos se encuentran palabras con un alto índice de disponibilidad junto con otras con una disponibilidad muy baja ( Benítez Pérez, 19 94b). Una vez comentados los trabajos pioneros en España, se mencionan las principales investigaciones en las diecisiete comunidades autónom as y las dos ciudades autónomas por orden alfabético. En Andalucía, el proyecto de disponibilidad léxica está dirigido por López Morales y García Marcos (1995). Actualment e se han recopilado los léxicos disponible s de todas las provincia s : en Almería realizado por M ateo García (1998), en Cádiz por González Martínez (2 002), en Córdoba por Bellón Fernández (2003 ) 84 , en Huelva por Prado Aragonés y Galloso Camacho (2005), en Mál aga por Ávil a Muñoz (20 06), en Jaén por Ahumada Lara (2006), en G ranada por Pastor Millán y Sánchez García (2 008) y en Sevilla por Trigo Ibáñ ez (201 1). E xisten numerosos estudios que complemen tan a los anteriores y que en algunos casos incorporan otros centros de interés o se basan en una muestr a de estudio diferente . M ateo García (1994) co mpara el léx ico d el centr o d e inter és Alimentac ión de una m uestra de Motril con el léxico disponible de Madrid recopilado por Benítez Pérez (1992); Cruzado Romero (2003) ha realizado el estudio sobre los preuniversitarios de Moguer y Ortolano Ríos (2005) sobre Ayamonte; G arcía Megía (2003) estudia el léxico dispon ible de niños almerien ses entre 9 y 12 años ; Padro Aragonés y Galloso Camacho analizan el léxico de los esco lares de sexto de Primaria de Huelva; Ávila Muñoz y Villena Ponsoda (2010, 2011) analizan el léxico disponible de Málaga sobre una muestra preest rat ificada de adultos, etc. Asimismo, habr ía que incl uir la inve stigación realizada en Gibralt ar, terri torio de ultramar de Reino Unido ubicado en la región andaluz a , donde Escoriza Morera (2003, 2007) analiza el léxico disponible español en contacto con el inglés. E n español como lengua extra njera destaca la tesis doctoral de Sá nchez - Saus Laserna 84 En el año 2003 reali zó su tesi s docto ral. No obstante , se ha con sult ado la o bra publicada como fruto de la tesis en el a ño 2011 , Léxi co dis poni ble de la pr ovi ncia de Cór doba . Capítul o 2 Marc o t eór ico 91 (2011) sobre el léxico disponible de estudiantes extranjeros que realizan una estan cia en Andalucía. En Aragón, el equipo de investigación formado por Castañer Mar tín, Enguita Utrilla , Lagüéns Gracia , Beatriz Moliné y coordinado por Arnal Purroy publica en el año 2004 el léxico disponible de esa comunidad. La muestra está formada por informantes preuniversitarios de las provincias de Huesca, Teruel y Zaragoz a. En el año 2008, el grupo de investigadore s presen ta un estudio desde diferentes disciplinas (sociolingüística, p sico lingüística , lingüística aplicada a la enseñ anza de lenguas, etc.) a partir de los datos recopilados anteriormente. Paralelamente, Arnal Purroy ( 2008 b) analiza la incidencia de los niveles socioculturales en el léxico disp onible de Aragón y en el año 2009 estudia los dialectalism os presentes en los listados . En Asturi as, se publica en el año 2001 el léxico disponible de esa com unidad gracias a la labor de Carcedo González. Además d e las variables sociológicas más frecuentes com o son el sexo, el centro escolar, el tipo de com unicad y el nivel sociocultural evalúa la zona geográfica desde un punto de vista lingüístico. Para ello, Carcedo G onzález divide la comunidad en cuatro zonas se gún la variante lingüística: zona gallego asturiano, zona bable 85 central, zona bable occidental y zona bable oriental. Interesado en las variantes lingüísticas, el propio autor lleva a cabo con posterioridad estudios com parativos con otras sintopías pen ins ulares e hispanoamericanas (C arcedo González, 2003 y 2004). En Cantabria, Fernández Juncal (2013) recopila el léxico disponible proveniente de once municipios de las localidades de Santander, Torrelavega, Catro - Urdiales, Mueridas, Santoña, Reinosa, San Vi cente, Ampuero, Ca stañeda, Meruelo y Potes. Con anterioridad, Carrera de la Red y Bradley (2004 a y 2004b ) presentan los estudios de disponibilidad en Cantabr ia, llevan a cab o un análisis d e los extranjerismos e inician la recopilación de datos que Fernánde z Juncal continúa y edita. Borrego Nieto y Fernández J uncal (2002) analizan el léxico de los habitantes de zonas rurales y se centran en el estudio de los dialectalismos . Ga rcía C asero (2013) ha estudiado el léxico disponible en Santander de estudiantes de último curso de la Enseñanza Secundaria Obligatoria. 85 El ba ble hace re fer enci a a la le ngua tra dici onal de la mayor pa rte del Pr inci pado de Astur ias . Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 92 En Castilla la Mancha, Hernández Muñoz (2006) presenta el léxico disponible de la comunidad. La m uestra está formada por informantes de las cinco provincias castellano - manchegas : Ciudad Real con 220 s ujetos, Toledo co n 180, Albacete con 120, Guadalajara con 80 y C uenca con 80. Cabe destacar que anteriormente Hernández Muñoz (2004) había estudiado el léxico disponible de Cuencia sobre una muestra de 117 informantes. En Castilla y León, los resultados d el léxico disponible no est án disponibles en todas las provincias. Galloso Camacho (2002a, 200 2b y 2003) recoge los datos de Salamanca, Ávila y Zamora; Bartol Hernández (2004) de Soria; Fernández Juncal (2008) de Burgos y d e Santia go Guervó s (2008) de Sego via. Además, esta comunidad destaca por coordinar el programa Dispolex y por publicar una gran variedad de artículos: sobre lo s dialectalismos y el nivel de instrucción ( Fernández Juncal y Borrego Nieto, 2002, 2003 ); el concepto de dispo nibilidad (Borrego N ieto, 2004); los extranjerismos (Bartol Hernández, 2005); los r egionalismos de Ávila ( Llorente Pinto , 2005); sobre el léxico disponible de inmigrantes en la comunidad ( Fernán dez - Merino Gutiérrez , 2015 ), etc. Actualmente, González está r ealizando el léx ico disponible de Palencia y Valladolid con lo que solo faltaría la provincia de León para completar los estudios de disponibilidad en esa comunidad. En Cataluña, Serrano Zapata (2003) r ealiza un estudio explorato rio sobre el léxico dispo nible de Lérida con una muestra de 48 estudiantes preuniversitarios de tres centros educativos de la cap ital. A continuación, estudia m ás en profundidad la influencia de factores sociales (2004) y de transferencias léxica s (2006). En el año 2014 , presenta su tesis doctoral sobre el léxico disponible de Lérida sobre una muestra de 240 sujetos preuniversit arios. Los informantes realizan las encuestas en español y catalá n sobre 17 centros de interés (16 centros tradiciona les y Los colores ) contribuyendo así a los estudios realiz ados en comunidades bilingües como el País Vasco (Azurme ndi Ayerbe , 1983). Blasco, Torres, Pérez Edo y Forment han recogido los datos de Barcelona y presentan los a spectos metodológicos del estudio en el XXXIII Simposio de la Sociedad de Lingüística celebrado en Geron a en diciembre de 2003. Asimism o, Forment y Pérez Capítul o 2 Marc o t eór ico 93 han recopilado los datos de Tarragona y Gerona durante el año 2 005 y 2006 pero no todavía no han publicado los listados del léx ico disponible. En Ceuta, la investigado ra Ayora Esteban ( 2006 ) analiza el léxico disponible de Ceuta con una muestra de informantes de los cinco centros educativos de la ciudad. Entre las variables socioculturales se incluyen el lugar de na cimiento del informante y de los padres y la lengua materna ya que algunos estudiantes son de procedencia marroquí (en la e tapa postobligatoria la presencia es menor que las etapas ob ligatorias). Este estudio forma parte d el grupo de in vestigación Sem aínein que pretende desarrolla r el léxico disponible de Ceuta, Melilla y Gibraltar y que analiza el co ntacto de lenguas. Anterio rmente, Ayor a Estaban estudia centra dos de sus publicaciones en ese aspecto, «La disponibilidad léxica en una situación de contacto de lenguas» en 2002 y «De ficiencias en la adquisición del léxico como problema específico de las lenguas en contacto» en 2004. En obras posteriores, la autora destaca los objetivos y aplicabilidad de los estudios de disponibilidad léxica (Ayora Esteban, 200 5 y 2007). En Extremadura, el léxico disponible está en fase de elaboraci ón. Prado Aragonés y Galloso Camacho se han ocupado de la recogida de datos de 700 estudiantes de las provincias de Cá ceres y Bad ajoz. Asimismo, las autoras recopilaron el l éxico disponible de H uelva de estudiantes preuniversitarios (2005) y de 6.º de Educación Primaria (2008). E n el año 2009 junto con Conceição presentaron el léxico disponible de zonas limítrofes de Andalucía y Extrem adura y de Algarve y Alentejo. Las provincias seleccionadas po r el estudio fueron: O l iva d e la Frontera, Alconchel, Olivenza, Alburquerque y San Vicente de Alcántara en Badajoz; Valencia de Alcántara, Alcántara y Moraleja en Cáceres; Ayamonte, Puebla de Guzman y Cortegana en Huelva; Vila Real en Algarve; Mér tola, Serpa, Moura, Vila Viçosa, Reguengos d e Monsaraz, Elvas y Portalegr e en la Región de Alentejo ( Portugal ) . La metodologí a de investigac ión sigue las recomendaciones del Panhi sp ánico y la encuesta se realizó a una muestra de 240 est udiantes preuniv ersitarios españoles y 160 portugueses. El promedio de respuestas de los informantes españoles es superior al de los estudiantes portugu eses pero el porcentaje de vocablos es in ferior. Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 94 En la Comunidad Valenciana, se ha elaborado el léxico de Valencia (Góm ez Molina y Gómez Devís, 2004) y Alicante (Martín ez Olmos, 2008 86 ) mien tras q ue el léxico de Castellón se encuentra en fase de ela boración po r parte de Blas y Casa nova Ávalos. Esta última investigadora, presenta los primeros resultados de su estudio en 2006 y analiza los anglicismos que aparecen en el listado del léxico de Castellón en el año 2008. Asimismo, Llopis Rodrigo y Gómez Devís (2010a, 2010b ) siguen las recomendaciones del Panhispánico para estudiar la disponibilidad léxica del catalán en Valencia. En Galicia, López Meirama (2008 ) presenta el léxico dispon ible de la comunidad sobre una muestra de 800 informantes . Para la recogida de datos no estableció la distinció n según la dem arcación provincial por con siderar la comun idad como un conjunto . Para e llo, modifica la variable rel ativa al tipo de población y distingue entre urbana, periurbana, villa y rural. A demás de los centros tradicionales incluye Los colores y El mar . Esta investigación se inscribe dent ro del proyecto Disponibilid ad léxica en Gal icia cuyo objetivo prin cipal es la rea lización de diccion arios de léxico disp onible en español y en gallego, a demás de crear una herramienta inform ática para su consulta. Los miembros que forman parte del proyecto son López Meirama, Álvarez de la Granja, B lanco y García Gondar. En el año 2011 publican una obra conjunta , en la que participa Bartol Hernández, donde se abordan las diferencias dialectales del español y del gallego, la or tografía, la incidencia d el tipo de p oblación, entre otros aspectos desde u na p erspectiva multidisciplinar . En las Islas Canarias , se ha recopilad o el léxico disponible de Las Palmas de Gran Canaria y Tenerife. García Domínguez, Marrero Pulido, Pérez Martín y Piñero Piñero (1994) estudia n el léxico disponib le de Gran Ca naria y a nalizan la inciden cia de la situación geográfica y el tipo de edu cación. Previamente, Sa mper Padilla y Hernández Cabrera (1997) presentan los datos iniciales de l estudio de disponibilid ad léxica en Gran Cana ria y dan comienzo a una serie de in vestigaciones en las islas. En 1998 , Samper Padilla publica un artícul o sobre los criterios de edició n del material que serán tenidos en cuent a en la mayoría de investi gaciones posteriores en 86 Te sis doctor al present ada en 2007 . Capítul o 2 Marc o t eór ico 95 este ámbito . Hernández Cabrera, Samper Padilla y Bellón Fernández (2003) analizan los canarismos en los listad os de disponibilidad léxica y Hernández Cabrera y Samper Padilla (2006) abordan los dialectalismos . A simismo, el léxico gran canario ha formado parte de co mparaciones co n otros léxico, tales co mo el de Puerto Rico (Samper Padilla, 1999), Córdoba (Samp er Padilla, Hernández Cabrera y Bellón Fernández, 2003) y Aragón (Samper Hernández, 2008), entre otros. En Tenerife, Torres González y García Falero muestran algunos datos sobre el léxico de la isla en el III Congreso Interna cional sobre L engua y Sociedad celeb rado en Castellón en el año 2006 . E n el resto de islas, Samper Hern ández se encarga de la recopilación de datos. Para su tesis doctoral, la investigadora realiza un estudio comparativo entr e los escolares gra ncanarios de primaria y secundaria para analizar su evolución ( Samper H ernández, 2009) y sobre el que previamente había aportado datos metodoló gicos (Samper Hernández, 2004) y analizado los d ialectalismos (Samper Hernández, 2005). En Madrid, nace el primer estudio que sigue los criterios del Panh ispánico a cargo de Benítez Pérez (1992) 87 . En Alcalá de He nares , Paredes García, Álvaro García, Pérez, Rebollo y Ruiz (2002) estudian el léxico disponible de los estudiantes del segundo ciclo de Educación S ecundaria Obligatoria (3 . º y 4 . º) y Bachillerato y lo comparan con el obtenido por Benítez Pérez (1992). Además, Par edes García analiza aspectos concretos del léxico como los colores (2006), los errores ortográficos (2011) y los avances teóricos y metodoló gicos en el ám bito de la disponibilidad léxica (2012). El léxico de la comunidad madrileña está en fase de elaboració n por el equipo de inves tigación compuesto por Paredes García (Universidad de Alcalá) y Goméz Sánchez y Guerras Salas (Universidad Europea de Madrid). En la comunidad, e xisten estudios que analizan el español en info rmantes extra njeros como el de G uerra Salas y Gómez Sánchez (2003 , 20 05a, 2005b) con una m uestra de estudiantes extranjeros de Comunicación de la Universidad Europea de Madrid y la tesis inédita de D iego Gallego Gallego (2014) sobre estudiantes de español como lengua extranjera en Madrid, entre otros. 87 Gu err a Sal as, P are des Ga rcí a, y Gómez Sá nch ez pre sen tan l a c omun ica ci ón t it ul ada «Di sp oni bil id ad léx ic a e n la C omun idad de M adrid» en el «X XXIV Simposio de la Sociedad Española de Lingüística » celebrado en Madr id d el 1 3 al 16 de d ic ie mbr e de 20 04 . Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 96 En Melilla, el léxico disponible forma parte del proyecto de estudio del léxico en Ceuta, Melilla y Gibraltar llevado a cabo por el grupo Semaín ein. Fernández Smith, Rico Martín, Molina García y Jiménez Jiménez presentaron el proyecto en el año 2006 y dos a ños más tarde, en 2008, publicaron el léxico disponible de M elilla. Al igual que en Ceuta, utilizar on la variable lengua ma tern a pero en este caso diferenciaron entre españo l, bereber y otras. En Navarra , el léxico disponible no h a sido publicado todavía pero el equip o formado por Tabernero Sala 88 , Saralegui, Martínez, Ar eta Lara, Man gado y Sanvicens de la Universidad de Navarra h an recopilado los datos. En el año 2007, Saralegui y Tabernero Sala (2008 89 ) participaron en el XXXVII Simposio Internacional de la Sociedad Española de Lingüística (SEL) con la comun icación relativa a la aportación al Panhispánico del léxico disponible de Navarra. Ese mismo año, Sanvicens Gila (2007) rea liza su traba jo de investiga ción de Tercer Ciclo donde analiza los aspectos teóricos del léxico disponible en comunidades bilingües y presenta el caso de Navarra. U n año más tarde, Areta Lara (2008 90 ) prese nta su tesis doctoral sobre el léxico disponible de estudiantes preuniversitarios navarros y realiza un análisis sociolingüístico porm enorizado. En el ámbito del español para extranjeros, Jiménez Berrio (2013) analiza la competencia léxi ca de inmigrantes e n Secundaria, relaciona la disponibilidad léxica con el aprendizaje integrado de contenidos y lenguas (Jiménez Berrio, 2012a) y los programas de inmer sión lingüística ( Jiménez Berrio, 2012 b), entre otros. El País Vasco es la primera comunidad en presentar un estudio relacionado con el léxico disponib le gracias a la tesis docto ral de Azurmendi Ayerbe (1983). En el año 1996, Etxebarria Arostegui realiza un estudio sobre el léxico de los estudiantes preuniversitarios de Bilbao del que m ás tarde, en 1999, anal iza la enseñanza de la lengua m aterna. La investigación se complementa con los estud ios que comienzan en 2005 en las provincias de Álaba, Vizcaya y Guipúzcoa y que están todavía en curso. 88 Es e mismo año la auto ra publi ca un artíc ulo rela ci onad o con los regi onal is mos (Taber ner o Sala , 2008a) y el contacto de lenguas (Tabernero Sala, 2008b). 89 Las act as del congre so se publi can un año más t arde. 90 Ma nga do y Aret a Lara (200 8) publi can en las act as d el «XXX VII Sim posio Interna cional de la S ociedad Español a d e Li ngüí sti ca (SEL) » un artícul o relacionado con el procesamiento informático de los datos. Capítul o 2 Marc o t eór ico 97 2.4.2. En inglés como lengua extra njera En el ámbito del inglés como len gua extranjera las investigaciones son menos numerosas. El yugo slavo Dim itrijevi ć realiza el primer estudio en inglés en 1969. Parte de hipótesis que el léxico disponible puede verse influido por variables como la edad, el sexo, el estatus social y el país (Dimitrijevi ć , 1969: 5). Para corroborar esa teoría, recopila datos en dos países: Escocia y Y ugoslavia. En el prim er caso, selecciona a niños que viven en zonas r urales y urba nas de Esco cia de difer entes edades m ientras que, en el segundo, selecci ona una muestra de escolares de diferente edad (11 y 14 a ños) monolingües serbo - croatas y bilingües húngaro s co n el ser bo - croata como segunda lengua. Sin embargo, en la obra publicada en 1969 solo compara los resultados d e los escolares escoceses. No es h asta el año 2000 , cuando se p ublican los resultados de una investigación realizada por Germany y Cartes Enríquez sobre el léxico disp onible en inglés como lengua extranjera en la enseñan za formal de la Octava Región de C hile. La encuesta la realizan 100 es colares de primer año de enseñanza media sobre tres centros de interés: 1) Human body ; 2) Food ; 3) House . El objetivo consiste en determinar el léxico de los estudiantes según la variable tipo de centro educativo: 28 informantes estudian u n establecimiento escolar bilingüe, 38 en un establecim iento escolar particular y 40 en un liceo m unicipalizado. Tras realizar el análisis de los resultados, Germany y Cartes Enríquez (2000: 49) constatan que los escolares del colegio bilingüe aportan un mayor número de p alabras y de vocablos que sus compañeros en los otros dos tipos de centros. A continuación, le siguen por poca diferencia los resultados d el colegio pa rticular y, p or último, los del liceo municipalizado donde se encuentran con encuestas sin ninguna respue sta. Según las autoras, los r esultados de los dos prim eros centros educativos se justifica n por la metodología aplicada en la enseñanza del inglés: mediante semi - inmersión en el colegio bilingüe y siguiendo un método comunicativo en el colegio particular. En cambio, en el liceo municipal izado la enseñanza del inglés se lleva a cabo durante solo tres h oras semanales basando la metodología en el aprendiza je gramatical. Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 98 En el año 2006, dos estudi antes de la Universid ad de Concepc ión, Ferreira y Zubanov, prese ntan sus tesis del Magíster en Lingüística relacionadas con la disponibilidad léxica en le ngua extranjera. El trabajo de Ferreira (2006) analiza las diferencias entre el léxico disponible en in glés como lengua ma terna y como lengua extranjera a través de u n análisis cuantitativo y psicolingüístico. Los datos d e la s pruebas provienen de 50 hablantes nativos de entre 16 y 18 años del sur de Inglaterra inscritos en The Royal School y 50 alumnos chilenos de cuarto curso de las carreras de Pedagogía en Inglés y de Traducción en Idiomas Extranjeros de entre 21 y 22 años. Entre los centros seleccionados, los cuatro primeros centros corresponden a los centros trad icionales y los seis restantes son específicos del estu dio: 1) Body parts ; 2) Food and drink ; 3 ) Entert ainment ; 4) Clothe s ; 5) Holidays ; 6) Economy and finances ; 7) Terrorism and crime ; 8) Politics ; 9) Pollution and the environment ; 10) Health and medi cine . Los resultados presentados muestran que el número de palabras y vocablos en todos los centros es supe rior en los hablantes de inglés como lengua materna. Además, el vocabulario proporcionado por los escolares ingleses es más especializado y específico mientras que el léx ico de los estudiantes chilenos es más homogéneo, debido a que la exposición a la leng ua ex tranjera se produce en un ambiente muy similar, el escolar. A través de un análisis realizado con el programa DispoGrafo, el investigador presenta la organización de los vocablos en los dos listados . De esta forma, se observa que los hablantes nativo s organiz an la s pala bras en el lexicón menta l a través de subnúcleos en cada centro de interés que revelan la relación semántica de las palabras. En cambio, esa relación en subcategorías no es tan evidente en el caso de los estudiantes chilenos ya que las palabras se integran en un centro sin una clara organización dejando patente que su dominio léxico es solo pa rcial. El estudio de Zubanov (2006) se basa en el progres o léxico de estudiantes durante sus estudios universitarios en inglés y en alemán. En ing lés com o lengua extranjera, se llevan a cabo encuestas a 80 alumnos divididos en cuatro grupos de diferentes cursos de la carrera de Traducción en Idiomas Extranjeros de la Universid ad de Concepción. Para poder comparar el léxico disponible cuanti tativa y Capítul o 2 Marc o t eór ico 99 cualitativamente con ha blantes de lengua mater na, la encuesta la realiz a del mismo modo a un grupo de 20 estudiantes norteamericanos. Como era de esperar, los hablantes nativos muestran un vocabulario más amplio y rico que los estudiantes de inglés como l engua extran jera. La autora destaca algunas diferencias culturales, tales como, la m ayor asociación de palabras positivas en el centro de los estados de ánimo en lo s estudiantes chilenos y un mayor númer o de palabras afectivas en el centro de los animales. En cuanto a la evolución del léxico en los estud iantes chilenos, destaca que se produce de forma progresiva a med ia que los estudiantes adquieren la len gua extranjera. El es tudio exploratorio llevado a cabo por Gallardo del Pue rto y Martínez Adrián (2014 ) tiene por o bjeto conocer la influencia del con tacto de una lengua extranjera en el léxico disponible de estudiantes de la tercera ed ad. Lo s datos provienen de 18 informantes de edad avanzada que estudian inglés como lengua extranjera en las Aulas de E xpe riencia de la Universidad del País Vasco durante tres horas semanales. Los encuestados se dividen, según su experiencia previa con el inglés como lengua extranjera, en dos gru pos: uno formado por estudiantes principiantes que parten de cero denominados Tru e Beginner s (TBs) y otro grupo compuesto por los falsos principiantes 91 o False Beginners (FBs) que so n estudiantes que comienzan a estudiar una lengua desde cero pero tienen un ligero conocimiento de la misma. La prueba léxica se realiza a partir de quinc e centros de interés relacion ados con la vid a d iaria: 1) Parts of the body ; 2) Clothes ; (3) House ; (4) Furniture ; (5) Food and drink ; 6) Table ; 7) Kitchen ; 8) School ; 9) Town ; 10) Countryside ; 11) Means of transport ; 12) Animals ; 13) Hobbies ; 14) Professio ns ; 15) Colours . Los tres factores objeto de análisis son: el número de pa labras en general, la determ inación de los centros m ás productivos en ambos grupos y los vocablos aportados en cada centro de interé s. El número de palabras corrobora la hipótesis de los investigadores ya que muestran que 91 La definici ón de este conce pto puede consult arse en la vers ión electrónica del Diccio nar io de tér mino s clave de ELE del Institut o Cervantes. Disponible en: http://c vc.cerva ntes.es /ensenanza/bi bliote ca_ele/d iccio_el e/dicc ionario/f alsopri ncipiant e.ht m [Consultado e l 9 de marzo de 2015]. Tesis doctoral Evaluac ión d e la compet enci a lé xic a bili ngüe en estudiantes del Máster Universitario en Profesorado 106 Tabla 2. 3. Li stado de pala bras c on un mis mo índi ce de disponi bilida d pero difer ente r ango as ociati vo. Ce ntro d e interés 01. Pa rties du co rps humai n . Extraído d e Njock ( 1978: 203 ) Rang associatif pour des concepts de même indice de disponibilité Rang Basaa Disp oni bil it é Rang Assoc iat if Rang Français Disp oni bil it é Rang Assoc iat if Rang Basaa et Français Disp oni bil it é Rang Assoc iat if 18 hyonx (chev eu) 43,6 23,6 2 oeil 87,2 57,2 35 ko xox (peau) 17,2 8,6 18 jas (me nton) 43,6 22,2 2 tête 87,2 67,2 35 crâne 17,2 8,6 26 bxep (l èvre) 22,2 10,9 11 dent 66,8 37,7 14 tol (poitrin e) 58,1 32,7 26 nla (i ntesti n) 22,2 12,7 11 pied 66,8 36,3 14 genou 58,1 29,5 28 nxexm (coeur ) 21,8 10,4 17 main 51,8 30,9 15 liman x (joue) 51,8 29,5 28 hes (os ) 21,8 12,2 17 joue 51,8 29,5 17 joue 51,8 29,5 30 tindi (talon ) 21,3 11,8 27 orteil 32,2 17,7 17 main 51,8 30,9 30 lbxee (m ame lle) 21,3 11,3 27 tronc 32,2 19,5 33 sourcil 18,1 7,2 40 su (figure) 11,3 7,2 35 cœur 17,2 8,6 34 tuu (épa ule) 18,1 10,4 40 yiijis ( sourcil) 11,3 4,5 35 crâne 17,2 8,6 38 libxit (go rge) 11,8 7,2 42 foie 11,8 5,4 Capítul o 2 Marc o t eór ico 107 En esta misma línea , se desarrollan otr as fórmulas que in corporan la posición que ocupan las palabras en los listados. Lo s trabajos de Lorán Santos (1983) y Lo rán Santos y López Morales (1983) ponderan la frecuencia de las palabras según su orden de mención. Según Lorán (1987) , l a fórmula inicial se basa en la t eoría de las decisiones y consiste, grosso modo , en multiplicar un coeficiente con v alor infer ior a la unidad ( λ ) por la frecuencia de la unidad. Ese cálculo no era efectivo en algunos casos. P or ejemplo, cuando las palabras aparecían en primer lugar el co eficiente no actuaba y, por tanto, la frecuencia era la misma. Tras varios intentos de m ejorar el cálculo de la disponibilidad de una pa labra, lo s investiga dores pro pusieron un a fórmula para los listados de palabras con un tamaño homogéneo que alteraba la tasa de sustitución si el tamaño de lo s listados era diferente. Por un lado: 𝑑 𝑝 = 𝑥 !" ! ! ! ! si 𝑥 !" = ! !" ! ! Por otro: 𝑑 ! 𝑝 = 𝜆 ! ! ! ! ! ! ! ! !" ! ! donde n = máxima posición alcanzada por las palabras en la encuesta i = número de posición 𝑥 !" ! = frecuencia rel ativa de la palabra p en la posición i 𝑓 !" ! = frecuencia absoluta de la palabra p en la posición i 𝑁 ! ! = número de informantes cuyas listas contenía n la posición i La disponibilidad se calcula sumando el número de veces que la palabra ocupa cada posición pondera do por una potencia del co eficiente ( λ ) . El valor de ( λ ) es 0,90 y desciende su potencia con forme disminuye la posició n de la palabra en cuestión. Así, el valor del sumando cuando la palabra con la mi sma frecuenci a ocupa la posic ión 1 será mayor que el del sumando cuando aparezca en cualquier otra posición. El análisis del índice de disponibilidad léxica a partir de la fórmula reseñada está presente en diversos estudios, tales com o, Román (1985), Mena O sorio (1986), Justo H ernánde z (1987), Cañizal Arévalo (1987) y Echeverría et al . (1987). Sin embargo, se constata que si la potencia de ( λ ) es super ior a 23, es decir, cua ndo la palabra se encuentra en la posición 23 o en alguna superior, el sumando deja de ser Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 108 significativo. La pote ncia de ( λ ) se hace tan pequeña que se produce una curva cercana al eje de abscisas. Posteriormente, los trabajos presentados p or Butrón (1987, 1991) consiguen corregir ese error de for ma parcial. La fórmula revisada sustituye el valor ( λ ) por un número E elevad o a un exponente que pondera la po sición de la palabra. La investigadora aplica la fórmula en un trabajo realizado en Puerto Rico sobre una muestra de 154 estudiant es de quinto grado donde analiza la influencia de diversas variables, como el sex o, e l nivel económico y la procedencia geográfica en la disponibilidad léxica. A pesar de que la fórmula no consigue eliminar por completo el desajuste, el estudio m uestra la efectividad de ponderación del número de palab ras y la posición de las misma s a travé s de un número E elevado a un exponente complejo. En esa misma línea, los profesores de la Universi dad Nacional Autónoma de México, López Chávez y Strassburger 99 consiguen mejorar ese artificio matemático aplicando el número E , conocido como número d e Eu le r o cons tante de N apier, con un valor 2, 718281828459045. La matriz p resentada por los estudiosos mexicanos tiene en cuenta los siguientes factores (López Chávez y Strassburger , 1987): • La frecuencia absoluta con que fue mencionada cada palabra en cada posic ión. • La frecuencia absoluta de la palabra, es decir, la suma de las diferentes frecuencias alcanzadas por la palabra en cada posición. • El número d e hablante s que re alizan la prueba de disponibi lidad lé xica. • El número d e posicio nes alcan zadas en e l centro d e interés en cuestión. • Las posiciones en las que fue m encionada la palabra. 𝐷 𝑃𝑗 = + 𝑒 − 𝐶 𝑖 − 1 𝑛 − 1 𝑓𝑗𝑖 𝐼 1 ! ! ! ! donde D hace referencia a la disponibilida d de Pj de una palabra p concreta j 99 Lópe z Chávez y St rassbur ger ( 1987, 1991) . Capítul o 2 Marc o t eór ico 109 n indica la máxima po sición alcanza en el centro de interés fpi es la frecuencia absoluta de la pa labra en la posición i I1 es el número de informan tes que realizaron la prueba e es el n úmero natural con un valor de 2, 718281828459045 La fórmula mexi cana es contrastada empíricamente en estudios ulteriores, tales como los realizados en México (López Chávez, 1995), Puerto Rico (L ópez Morales, 1995a y 1995 b), M adrid (Benítez Pérez, 1992, 1994a, 1994b ), Las Palmas de Gran Canaria (Samper y Hernández , 1994, l995) y República Dominicana (Alba Ovalle , 199 5a y 199 5b). En cuanto al tratamiento de los datos, cabe destacar que los propios autores de la fórmula, López Chávez y Strassburger Frías, desarrollaron el programa informátic o DISPLEX. Esta aplicación permitía no solo calcul ar el índice de disponibilidad léxica si no también la frecuencia de aparición de las palabras, la frecuencia acumulad a, la frecuencia abso luta y la posición que ocupa cada vocablo en un centro de interés con la posibilidad de realizar estratificaciones. Debido a la compl ejidad del uso del prog rama creado en la Universidad Nacional Autónoma de Méx ico y su difícil acce sibilidad , en 1995 el Grupo de Sociolingüística Teórica y Aplicada de la Universidad de Almería desarrolla el programa ESDIS (Estadística de disponibilidad). En 1998, Mateo Ga rcía p ublica su tesis doctoral sobre el léxico de lo s estudiantes preuniversitarios alm erienses en la que procesa los datos mediante este programa. Para facilitar la ap licación de la fórmula en otros estudios, en 1996 el enton ces presidente de la Asociación de Lingüística y Filología de la América Latina (ALFAL), López Morales, encarga a la Universidad de Alcalá la crea ción de un program a informático: Lexidisp. El programa permite la creación de diccionarios de disponibilidad léxica y el cálculo del índice de d isponibilidad, la frecuencia relativa y la frecuen cia absolu ta. No obstante, el número de variables está restringido a cinco y solo está disponible para el sistem a operativo Microsoft Win dows. En el año 2000, se consolid a el proyecto salmantino Dispolex que permite trabajar con una mayor cantidad de datos y variable s (Bartol Hernández y Hernández Muñoz, 2004). La principal diferencia en el cálculo de los datos que ofrece Lexidisp y Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 110 Di spolex reside en que el primero es un programa que analiza los datos a p artir de ficheros organizados según unas características específicas 100 , mientr as que el segundo es una base de da tos en la que hay que ir in troduciendo las referencias manualmente . Además, se podría decir que Dispolex es un gran banco de datos científico que permite que los investigadores interesados ingresen sus datos, los calculen y los contr asten con los dato s de otras investigacion es a las que tengan acceso 101 . Echeverría et al. (2005) crean una aplicación en MatLab (programa especializado en análisis estadísticos multivariantes) denominada Dispogen 102 . Este programa realiza cálculos muy similares a los de Dispolex (número de vocablos por centro, promedios de respuestas, frecuencia absoluta y relativa, porcentaje de aparición y listado de vocablos por cen tro), permite conocer los datos de una gran variedad de variables y obtener gráficos con los análisis reali zados. Al igual que Lexidisp, se trata de un programa que puede descarg arse en cualquier ordenador pero su última actualización es más r eciente, conc retamente en el año 2008. En esta misma línea, Frey Pereyra crea un programa denominado Ledical que puede ser utilizado en cualqui er sistema operativo compatible con Java. La aplicaci ón informática se encuentr a disponible en línea y se puede descar gar gra tuitamen te 103 . Este programa es utilizado para procesar los datos de la tesis doctoral de Frey Pereyra (2008), El léxico disponible en los escritos de alumnos de español como ELE , así como en otras investigaciones fruto del proyecto de investigación Estudios de Léxico Disponible de la Universidad Nacional Autónoma de México a cargo de M arisela Colín Rodea 104 . 100 Vid . a partado 3.5.2 referente a la metodología. 101 El acces o a cada investi gac ión es restri ngid o para pres erva r la priv acid ad de los datos . No obstant e, el investig ador res ponsa ble de u na inve stigación podr á perm itir el acce so a otro u otro s investig adores . 102 La i nformación sobre el proyecto que financi a la creación del programa se encuentra disponi ble en http://ds pace2.coni cyt.c l/bits tream/handle /10533/16599/105 0598 - IF .pdf?seq uence =2 [Fec ha de última consulta el 5 de marzo de 2015] . 103 Aunqu e Frey Perey ra indica que el programa está alojado en la página web www.ledi cal. org act ualmente ese enlace no está disponible. En camb io, se puede acceder al programa previa autentificación en la página http://c ele.unam. mx/ledical / [Fecha de última con sulta el 9 de febrero d e 2015]. 104 Para más inform ación so bre el p royecto , c onsúlte se la pá gina http://dl a.cel e.unam.mx/ter minologia /inreri ores/proye ctos.ht ml [Fecha de última consulta el 9 de feb rero de 2015]. Capítul o 2 Marc o t eór ico 111 A través del proyecto Disponibili dad Léxica en Galicia , financiado por el Programa de Promoción Xeral de Investigación de la Consellería de In novación e Industria de la Xunta de G alicia, se elaboran dos diccionarios del léxico disponible de los estudiantes preuniversitarios gallegos: uno en español y otro en gallego. Para facilitar la consulta de los d atos de las investigaciones inscritas en este proyect o, Guillermo Rojo crea una apl icación infor mática, Dispogal (López Meirama, 2011: 13). Cabe mencionar que en la propia p ágina del proyecto se indica que los datos han sido procesados con Lexidisp por lo que el programa se utiliza solo como base de consulta 105 . No ob stante, Dispoga l requiere darse de alta como usuario pa ra poder acceder a la información 106 . En el año 2014, Gallego Gallego propone el tratamien to de los datos informáticos a través del programa SP SS. Entre las ventajas de utilizar este programa e stadístico para procesar los d atos d el léxico disponible, Gallego Gallego (2014) destaca la flexibilidad en el uso de diferentes tipos de archivos y en la incorporación de todas las variables que el investigador desee explorar. Asimismo, propone una revisi ón de la fórmula tradicional propuesta por López Chávez y Strassburger Frías (1987) en la que se aconseja que la constante C tome el va lor de 2,3. 2.5.2. Índice de compatibilidad léxica y selección del léxico nuclear El índic e de compatibilidad léxica nace a pa rtir de los estudios realizados por Ávila Muñoz y V illena Ponsoda (2010, 2011) y Ávila Muñoz y Sánchez Sáez (2011). Los autores parten de la hip ótesis de que el índice de disponibilidad léxica perm ite conocer y acceder al vocabulario del grupo con creto que ha realizado el estudio y, por ende, al prototipo léxico comunitario creado par a cada centro de interés. E ste hecho se observa al contrastar los índices de disponibilidad de una misma palabra en estudios diferentes ya que se ven alterados, como se expuso en la fórmula López y Strassburger (1987), por el número de informantes, número de menciones y posiciones de la palabra. 105 http:// gramatica .usc.e s/proxectos /dispogal /?lang=es &id=descri pcion [Fecha de última consulta el 9 d e abril de 2015]. 106 A través de esta página se puede soli cit ar el alta de usuar io en Dispoga l: http://gramati ca.us c.es/di spogal/ [Fecha d e última co nsulta el 9 d e abril de 2 015]. Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 112 Vocablo Disp oni bil ida d Frecuenci a Frecuenci a acumulada % Apari ción Rango Mál aga 2 010 hígado 0,24165 1,87 36,364 49,534 14 Estud io actual hígado 0,09071 0,824 73,948 21,637 39 Tabla 2.4 . Ejemplo de los resu ltados del v ocablo hígado en la investigación de Ávila Muñoz y Villena Ponsoda (2010) y el presente estudio En la Tabla 2.4, se observa que la palabra hígado tiene una disponibilidad de 0,24165 en el estudio realizado en Málaga sobre una p oblación estratificada (Ávila Muñoz y Vill ena Ponsoda , 2010) mientras que esa misma palabra en el presente estudio tiene una dispo nibilidad de 0,09071. Se podría d ecir que ese vocablo es más disponible en el primer estudio por que su accesibilidad es mayor y, por tanto, ha venido a la mente del hab lante en más ocasiones y en posiciones más ad elantadas. Asimismo, en el primer caso, hígad o se encuentra más cer cana al n úcleo del prototipo. Ocupa el rango 14 en el listado de palabras ordenada s según el índice de disponibilidad mientras que, en el segund o caso, ocupa el puesto 39. La diferencia en el po rcentaje d e apar ición d e amb os térm inos es igualmente significativa: en el primer estudio el vocablo ha sid o mencionado casi po r la mitad de los ha blantes mientras que en el segundo no llega a una cuarta pa rte. La estructura del léxico en cada centro de interés vendrá determinada por la asociación entre las diferentes unidades lé xicas y su grado de accesibilidad. Según Ávila Muñoz y Sánchez Sáez ( 2011: 257 ) «es necesario establecer un grado de ‘compatibilid ad’ entre, por un lado, cada uno de los vocablos aportados por los hablantes y, por otro, el concepto que para la comunidad estudiada representa cada uno de los centros de interés propuestos» . Par a establecer diferentes grados de compatibilidad o accesibil idad entre un elemen to y su con junto se basa n en el concepto matemático de ‘co njunto difuso’ . El primer paso para calcul ar el índice de compati bilidad consiste en determinar el espectro de un centro de interés mediante un conjunto difuso a través de un modelo cuantitativo similar al de la ley de Z ipf. En este caso, ( t ) hace referencia a la valoración de cada término obtenida a partir de la división del número que ocupa en la lista un vocab lo ( n ) y u na constante para ca da caso ( k ) que representa el tamaño relativo de los conjuntos de tér minos que superan un niv el de compatibilidad. Capítul o 2 Marc o t eór ico 113 𝑡 = 𝑘 𝑛 A conti nuación, construyen el modelo colect ivo basado en el valor de nula disponibilidad para to dos los términos a partir de la siguiente ley probabilística: 𝑎 + 𝑏 − 𝑎 ∙ 𝑏 d onde a se refiere a la disponibilidad d e un término b indica la disponibilidad p ersonal de ese término El índi ce de compatibilidad muestra la accesibilidad de los voca blos en un rango que oscila entre 1 y 0. En el Gráfic o 2.1 , las diferentes palabras están representadas en un continuo en el que se destacan los primeros puestos del rango por contar con un índice de compatibilidad cerca no a 1. Se constata que a partir de un cierto punto las unidades léxicas pierden com patibilidad y apenas son accesibles a los hablantes. Gráfi co 2.2 . Número de vo cablos ord enados seg ún el índic e de comp atibilidad en españo l. Centro d e interés 09. Ordena dore s e int erne t El índice obtenido sirve de base para dos análisis posteriores que permitirán seleccionar el léxico más compatible y conocer la compatibilidad de cada vocablo de la secu encia léxica apor tada por u n infor mante. Por u n lado , el planteamien to 0" 0,1" 0,2" 0,3" 0,4" 0,5" 0,6" 0,7" 0,8" 0,9" 1" 1" 18" 35" 52" 69" 86" 103" 120" 137" 154" 171" 188" 205" 222" 239" 256" 273" 290" 307" 324" 341" 358" 375" 392" 409" 426" 443" 460" 477" 494" 511" 528" 545" Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 114 expuesto permite aplicar la herramienta FEV (Fuzzy Expected Value) para determinar el léxico relevante. Esa se lección del vocabulario vendrá marc ada por criterios de corte que establecerán, por niveles, la mayor o menor p ertenencia de los vocablos al núcleo, es decir, su nivel de prototipicidad 107 . La Tabla 2.1 muestra cómo se ha organiza do el vocabulario del continuo anterior en seis niveles según la compatibilidad de los voca blos. En total se han destacado 69 vocablos que suponen un 12,32 % de todos los vocablos aportados por los informantes. Por debajo del índice d e comp atibilidad de 0,13 se sitúan los vocablos que so lo han aportado algunos informantes y, por tanto, que no son r eprese ntativos del léxico disponible de una comunidad de hablantes. Nive l de compatibilidad Proporció n Nº d e vocablos Vocabl os 0,85 0,54 3 ratón, pantalla, teclado 0,75 0,89 5 portáti l, pá gina web 0,6 1,61 9 ordenador, monitor, Facebook, correo (elect rónico) 0,41 2,68 15 torre, im presora, r ed social, d isco dur o, progra ma, arch ivo 0,24 5,89 33 Tuenti , in ternet , s oftwar e, c able, web, hardware, pe ndrive , Googl e, blog, chat ear , busca dor , Windows , escán er, USB, chat, PC, red, wifi 0,13 12,32 69 router, altavoz , mó dem, CD( - ROM ), memori a, desca rgar, virus, placa base, tecla, d escarga, conexión, ordenador de sobremesa, campus virtual, carpeta, navegar, TIC, pc, (Micro soft) W ord, sistema opera tivo, do cume nto, T witter, procesador de textos, contraseña , DV D, foro, e - mai l, videojuego, ordenador personal, informaci ón, ventana, CPU, antivirus, bater ía, netbook, Wikipedia, s ervidor Tabla 2.5 . Niveles de comp atibilidad d e los vocab los en españ ol. Centro 09. Or denadores e i nternet Por otra parte, este índice de compatibilidad es empleado para conocer cuáles son los procesos de reentrada en el núcleo cuando un hablante realiza la prueba de disponibilidad. El núcleo es considerado el nombre del centro de inter és, es decir, la palabra a partir de la cual se activa un vocabulario determinado en la mente del hablante. El orden de producción de las palabras de cada lista puede estar más o menos asoci ado al vocabula rio colect ivo. De esta forma, cuando el hablante escri be una palabra co n un alto índice de compatibilidad se acerca al núcleo del centro de interés. En cam bio, cua ndo r ealiza una asocia ción de tipo personal y, p or tan to, no compartida por la m ayoría de los hablantes, se aleja d e ese núcleo. 107 Cf. Ávil a Muñ oz y Sá nchez Sá ez ( 2010 , 2011a , 2011b , 2014) p ara una revisión más pormenorizada del tema. Capítul o 2 Marc o t eór ico 115 Tras analizar dif erentes sujetos, Ávila Muñoz y Sánchez Sáez (2011 : 274 - 277 ) distinguen cuatro tipos de patrones do minantes d e reentr ada al núc leo: a) Patrón centralizado. Se produce cuando los informantes solo escriben palabras muy compa tibles, es decir, muy cercanas a l núcl eo. Gráfi co 2.3 . Muestra de com patibilidad de vocab los. Patrón de centraliza do. Inform ante 145. C entro de in terés 04. The sc hool : fu rnitur e and sch ool materi al b) Patrón de reentrada. Es el patrón más frecue nte observado y se denomina de ‘reentrada’ porque una vez que los informantes han aportado una serie de palabras centralizadas, tienden a alejarse del núcleo. A continuación, vuelven a escribir palabras más centralizadas que lo llevan a sumergirse de nuevo en el núcleo. Gráfi co 2.4 . Muestra de com patibilidad de vocab los. Patrón de centraliza do. Inform ante 170. C entro de in terés 04. L’éco le: meubl es e t mát eri el s col aire c) Patrón de desplazamiento y desviación. Este modelo se observa cuando un hablante, a partir de un determinado m omento, comienza a producir palabras que se alejan del núcleo (palabras técnicas o especializadas, asociaciones individuales, etc.). 0 0,2 0,4 0,6 0,8 1 desk book pencil pen table computer 0 0,2 0,4 0,6 0,8 1 chaise fenêtre tableau cahier g omme stylo cray on table Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 122 En el caso de la esperanza matemática para toda la prueba, el resultado sería el siguiente: 𝐸 ! 𝑁𝑂𝑇𝐴 = 𝐸 ! 𝑛 ! ! ! ! ! = 𝑁𝐸 ! 𝑛 ! = 𝑃 𝑀 1 − 𝑋 𝑀 − 1 Por último, se calcula el valor de X para saber qué valor hay que restar a cada respuesta incorrecta. La fórmula comienza con el objetivo primero de la creación del ICIT: si un informante responde a todas las preguntas al azar su puntuación será de 0. 𝐸 𝑁𝑂𝑇𝐴 = ! 0 ⟶ 0 = 𝑃 𝑀 1 − 𝑋 𝑀 − 1 ⟶ 1 = 𝑋 𝑀 − 1 ⟶ 𝑋 = 1 𝑀 − 1 𝐸 𝑁𝑂𝑇𝐴 = ! 0 ⟶ 0 = 10 9 0 , 56 − 0 , 07 9 − 1 ⟶ 0 , 56 = 0 , 07 9 − 1 ⟶ 0 , 07 = 0 , 56 9 − 1 Una vez realizados los cálculos estadísti cos oportunos, se concluye que para obtener unos resultados ponderados de la variable ICIT, es necesario asignar los valores expuestos al p rincipio. Es decir, sumar 0,56 puntos por cada re spuesta correcta y restar 0,07 por cada respuesta incorrecta. En la Tabla 2. 7 se ha n incluido las respuestas de cuatr o informantes para comparar los resultados según el Pident y el ICIT. Lo s informan tes 137 y 59 han aso ciado todas las palabras de forma correcta exceptuando una. En el primer caso, el informante ha dejado la respuesta en blanco y en el segundo la ha contes tado de forma errónea. El Pident de a mbos sujetos es igual porque no da cuenta de la respuesta incorrecta o no contestada pero el ICIT es diferente: 9,52 frente a 9,45. En cuanto a los informante s 100 y 169, han asociado corre ctamente la mitad de las palabras. El informante 100 ha dejado 8 respuestas en blanco y ha realizado una relación incorrecta mientras que el informante 169 ha contestado la otra mitad de forma incorrecta. A priori , par ece q ue el in formante 100 ha realiza do solo la parte de la prueba que cono cía mientras que el sujeto 169 ha contestado a todo, con independencia de si había identificado el vocablo o no, razón por la cual es posible Capítul o 2 Marc o t eór ico 123 que haya acertado algunas resp uestas al azar. Este hecho se refleja en los resultados ya que el ICIT del informante 100 es 4,97 y d el informante 169 es de 4,41. Informante Respue sta correcta Respue sta en blanco Respue sta incorrec ta Pident ICIT 137 17 1 0 9,44 9,52 59 17 0 1 9,44 9,45 100 9 8 1 5 4,97 169 9 0 9 5 4,41 Tabla 2.7 . Ejemplos de resp uestas en la p rueba de l léxico espec ializado en español y re sultados de l Pident e IC IT 2.6. Aplicaci ones de la di sponibil idad léx ica Los es tudios en este ámbito surgen de la búsqueda de una aplicación práctica co ncreta: la selección del léxico para la enseñanza del francés (Gougenheim et al. , 1964). Asimismo, los precursores franceses realizan co mparaciones y análisis en los que se tienen en cuenta variables sociales, co mo el sexo o la procedencia, ligados a la in corporación de nuevas disciplinas, como la dialectología o la sociolingüística. Numerosos autores , como López M orales (199 5- 1996: 249 - 254; 1999a: 19 - 26); Carcedo González (1998 b : 53 - 63), Samper Padilla (2003: 213 - 219), Samper Padilla, Bellón Fernández y Sa mper Hernández (2003: 105 - 119) y Ayora Esteban (2007: 2367 - 2378 ), destacan el carácter multidisplicinar del léxico disponible y las oportunidades que ofrece. En los párrafos sucesivos se abordan algunas de las principales aplicaciones de la disponibilidad léxica en el ámbito de la dia lectología, la etnolingüística, la sociolingüística y la lingüística a plicada a la enseñanza de lengua s. Desde la perspectiva etnolingüística 109 , la dispo nibilidad puede ayudar a describir las características de una cultura o sociedad y época histórica. Las palabras más disponibles de los hablantes dan cuen ta de sus hábit os alimenticios , de la forma de divertirse, de las profesi ones y problemas de la zona y demás componentes cultur ales en el momento preciso de la encuesta. E n algunos estudios se han adaptado los centros de interés introduciendo el m ar (Ávila Muñoz, 2006; Ayora Esteban, 2006; etc.), el olivo y el aceite (Ahumada, 2006) o cambiando calefacción por aire acondicionado como realiza López Morales (1999) en Puerto Rico. Asimismo, se ha criticado que algunos centro s de interés tales como, Trabajos del campo y del jardín, 109 Vid . a partado 6.6.2 para una reflexión más profunda. Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 124 tendrían que ser actualizados y reemplazados por otro s que definan mejor las costumbres actuales y que presenten una mayor producción léxica. En cuanto a la dialect ología, Gougenheim et al. (1964) ya encontraron diferencias en los listados del léxico disponible en los listados de los diferentes departamentos franceses analizados. No obstante, M ackey (1971 a ) es el primer investigador que describe y a naliza las sem ejanzas y diferen cias entre dos sintopías: el léxico de Francia y de Acadi a (Canadá). A partir de ahí, son considerables los estudios que com paran, tanto desde el punto de vista cualitativo como cua ntitativo, los léxico s disponibles de diferentes zonas. E n el ámbito hispano, López Chávez (1992) contrasta, por primera vez, el léxico de diferentes lugares: Madrid, Gra n Ca naria, Repú blica Dominicana y Puerto Rico . En el ámbito de la psicolingüísti ca, d estacan algunas investigacion es que trata n de conocer cómo se organizan las palabras en la mente y cómo se activa el vocabulario disponible. Cañizal Arévalo (1991) analiza las relaciones en tre las palabras del centro de interés Partes del cuerpo y concluye que las palabras se organizan en torno a un núcleo formando redes o constelaciones con un índice de disponibilidad similar. López Chávez (1993) intenta conocer cómo se organiza el lexicón mental a través del análisis de siete mu estras de escolares de dife rentes edades. E cheverría (1991) se inter esa en las relacio nes entre las pala bras y desarrolla el índice de cohesión y contribuye a la creación del DispoGr afo, una herramienta computacional para contabilizar las relaciones más frecuentes entre la s palabras y conocer cómo se o rganizan ( Echeverría et al. , 2008) . Hernández Muñoz (2006) su describe los fundamentos teóricos que describen la producción del léxico disponible y se centra en los procesos cognitivos. En esta misma línea, podrían enmarcarse dentro d e la psicolingüística no solo las p ruebas que siguen la metodología de la disponibilidad léxica del Proyecto Panhispánico sino todas aquellas basadas en la fluencia verbal y que se ponen en práctica en diversos ámbitos. A modo de ejemplo, cabe comentar que en la descripción de afasia en una enciclo pedia médico - quirúrgica (Viader, Lambert , de la Sayette , Eustache , Morin , Morin y Lechevalier , 2002), se menciona la aplicación de algunas pruebas típicas como la disponibilidad léxica o la fluencia verbal. En general, Capítul o 2 Marc o t eór ico 125 el ejercicio consiste en mencio nar durante un tiempo determinado (frecuentemen te se elige un minuto y medio) palabras de form a oral relacionada s con un campo léx ico (nombres de animales) o nom brar p alabras que empiecen por una letra determin ada. Los Animales , precisamente , forman parte de un centro de interés tradicional y es el ejemplo dado en este artículo de la enciclopedia. Por tan to, este hecho da cuenta de lo s numerosos estudios que incorporan las pruebas de disponibilidad léxica o fluencia verbal y que pueden encontrarse no solo en las investigaciones sobre la afasia sino también en otros camp os, como puede ser el alzheimer ( Eustache, 1993: 205 - 227). La sociolingüística está presente de una forma u otra en todos los estud ios d e disponibilidad léxica. En Gougenheim et al. (1964) se introdujeron dos variable s sociales: el sexo y la procedencia (rural o urbana). A partir de ahí, cada estudio ha incluido unas variables u otras según su s objetivos específicos. Los análisis pasa n de cuantificar el número de palabras aportadas por una parte de la muestra, com o puede ser el léxico del socio lecto femenino y masculino 110 , hasta realizar análisis estadísticos más complejos que miden la incidenc ia directa o indirecta de determinadas vari ables 111 . En el campo de la lingüística aplica da a la enseñanza de lenguas se sitúan la mayoría de investigacio nes sobre disponibilida d léxica. No obstante , con frecuencia los estud ios com enta n la importancia de la disponibili dad en la enseñanza de idiomas pero se limitan a aportar los inventarios del léxico disponible a modo de léxico básico y, so lo en alguna s oca siones, incluyen criterios de corte para establecer una selección . En ca mbio, otros est udios cotejan el léxic o re sultante de las pruebas del lé xi co disponible con el léxico presente en algunos manuales, como ocurre en Benítez Pérez y Zebrowski, 1993; Benítez Pér ez, 1994 , 1997; Rueda Ber nao, 1994; García Ma rcos y Mateo García, 2000; entre otros. A través de un Proyecto Fondecyt 112 denominado Metacog nición en lengua materna. Software multime dial para su des arrollo se crean tres pr ogramas informáticos destinados a la enseñanza del español como lengua materna. El objetivo es hacer una 110 La mayor ía de estudi os su elen i nclui r est a dis tinci ón. 111 Entr e las investi gac iones con mayor profundi zac ión estadí st ica dest acan los estudi os de Ávila Muñoz y Vill ena Pons oda (20 10, 201 1). 112 Fondo Naciona l de De sa rro ll o Ci ent íf ic o y Te cno lóg ico de Chile. Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 126 reflexión sobre los modelos psicolingüísticos del lexicón m ental par a crear herramientas de aprendizaje que permitan un aprendizaje signi ficativo . Aunque en el « Taller Internacional de Software Educativo TISE’99 » celebrado en San tiago de Chile en diciembre de 1999 se pr esenta ra una versión preliminar, en 2001 Echeverría dedica un artículo a exponer las características de uno de los programas, Vocabulari o disponible y menciona la creación de los otros do s: Actos de Habla y Lectura Crítica (Echeverría, 2001a). Un año más tarde, Echev erría presenta de nuevo el Vocabulario disponible junto con o tros programas que comparten características comunes como el hecho de ser aplicaciones de Windows multimediales e interactivas y estar centrada s en el objetivo didá ctico de la enseñanz a del español com o lengua materna : Variación Diale ctal del Español , Tiempo de Lectura , Lector , Act os de Habl a y Antex’ 98 . Vocabulari o disponible incluye una breve reflexión Echeverría (2001, 2002) sobr e las bases neur ales d el léx ico q ue fin aliza con los principios generales planteados por Caramazza (199 9: 470). A continuación, reflexiona sobre la búsqueda del modelo psicolingüístico del lexicón m ental y se cen tra en el modelo conexionista. Esta teoría parte de la idea de que la mente está organizada en forma de redes neurales cuya información (no dos) se encuentra co nectada con otr os nodos media nte uniones nerviosas. El signific ado de cada nodo viene determinado por las relac iones con o tros nodos o palabras dentro de un complejo sistema. Una vez esbozados los fundamentos teóricos que intervienen en el diseño del programa, se to ma como referencia el léxico disp onible de una muestra de más de 2000 estudiantes chilenos de educación m edia (Valencia Espinoza y Echeverría, 1999) sobre 18 centros de interés 113 . Por tanto, la prueba de disponibilidad léxica supon e la h erramienta de selección del voca bulario en este progr ama de enseñ anza del vocabulario del español de Chile 114 . La aplicación se divide en tres módulos: Introducción , Diagnóstico y Tareas . En la Introducción se presenta el programa y sus principales ca racterísticas y tareas. Asimismo, se aborda n lo s aspecto s teór icos r elacionados con la disponibilidad 113 1) Las parte s del cuerp o ; 2) Ropa y calza do ; 3) La casa ; 4) Muebl es ; 5 ) Alimen tos ; 6) La coci na ; 7) Medi os de tran sp ort e ; 8) Trabajo de camp o y jar dín ; 9 ) Plantas y animal es ; 10) Juegos y entretenimientos ; 1 1 ) Profesion es y ofi cios ; 12 ) La polít ica ; 13) La ac tiv idad e conó mica ; 14 ) Las art es ; 15) Cie ncia y tecnol ogí a ; 16) Mundo espi ri tua l ; 17) Proce sos mentales ; 18 ) Proble mas de l ambi ente . 114 Se sel eccionó el vocabulario que se enseña en el colegi o privilegiando , por tanto, la norm a culta . Capítul o 2 Marc o t eór ico 127 léxica y co n la form a de or ganizar las unidades léxica s. Este apa rtado es d e gran utilidad tanto para el estudiante, para fomentar el apren dizaje autóno mo, como para el docente, que puede con ocer las orientaciones metodológicas en las que se basa el programa. En e l Diagnóstico , el estudiante se somete a una evaluación inicial sobre los centros de interés que desee . Ese examen toma como referencia la p rueba de disponibilidad léxica: los informantes escribirán todas las palabras que se le vengan a la mente en los centr os marcados en un tiempo determinado. Una vez finalizada la prueba, los datos se presentan en un diagrama que incluye la media de palabras aportadas por los estudiantes chilenos en esos centros de interés. Además, se m uestra la diferencia entre la situación d e partida del individu o con respecto al promedio de la muestra analizada. Asimismo, se marcan los vocablos que no aparecen en los lista dos del estudiante y que cuentan con un alto índice de disponibilidad en la muestra del léxico disponible recogida. Gráfi co 2.7 . Es tadí stic o de res ultad os c omparad os . Fuente: Eche verrí a (2001: 94) Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 128 En las T areas , el estud iante puede elegir entr e nueve tipos de ejercicio s diferentes 115 y, a continuación, el centro d e interés sobr e el que quiere realizar la actividad. Además, este programa es editable gracias a la estructura de sistema de autor ( authorin g system ) de forma que tanto el do cente com o el estudiante pueden incorporar nuevos vocablos, activida des, imágenes y vídeos en cualquiera de las nueve tareas. Aparte de los módulos de aprendizaje, el programa incluye otros dos apartados denominados Glo sario y Nota s al profesor . El primero consiste en un buscador de palabras que dirige al diccionario del léxico disponible. El segundo es una inter faz d e comunicación que facilita la comunicación entre el alumno y el p rofesor: permite plantear dudas, coment arios a las actividades realizadas, re forzar algún conocimiento, etc . Hernández Solís (2006) realiza una propuesta didáctica donde pone en práctica los resultados de las pruebas del léxico disponible realizadas en Zacateca. E ntre los objetivos de su tesis doctoral destaca la búsqueda de una aplicación práctica de la disponibilidad léxica (Hernández Solís, 2006: 2 ). Para ello, realiza una microplani ficación la realiza a partir de una fundamentada sele cción del vocabulario que, en general, proviene de los listados del léxico disponible de los estudiantes universitarios, por considerar que esta muestra de estudio cuen ta con el léxico indispensable que deben conocer los estudiantes pr euniversitarios. No obsta nte, al igual que otros autores ; reconoce lagunas e n el léxico obtenido mediante los centros de interés que completa con v ocablos del Diccio nario del Español de Méx ico (DEM). La propia autora critica que en otros estudios, como por ejemplo en López Morales (1986), no se realice un a propuesta sobre la sel ección del vocabulario (Hernández Solís, 2006 : 6) aunque ella misma admite qu e presenta un m odelo pero no una propuesta acabada (Hernández Solís, 2006: 190). Básicamente, el patrón consta de doce pa sos en los que se presentan ejemplos de ejercicios basados en el centro de interés décimo, La ciudad . Los p asos so n: eva luación de diagn óstico, selección del vocabulario, lectura, ilustra ción, definición, ilustración, construcción , 115 Asoc iar una imagen a una de varia s pala bras , a so ciar un a palab ra a una d e varias imágenes , m ím ica , p arear un vocablo con su definici ón, g eneración de un lexe ma seg ún sus rasgo s semánti co s, clas if ic aci ón de tér min os, vocablo d iscordan te, explo ración en lám ina y c oncentración y memoria . Capítul o 2 Marc o t eór ico 129 lectura y co rrección, agrupamiento, combina ción (las ora ciones d e base para reda ct ar cada uno de los núcleos), comb inación (todas las oraciones de b ase para redactar el discurso completo) y evalua ción final. El léxico seleccionado corresponde a los 99 vocablos más disponibles de ese centro que se corresponden con el 75 % de la frecuen cia acumulada del índice de disponibilidad léxica. Como la mayoría de unidades léxicas son sustantivos, incorpora verbos del DEM , que n o aparecen en los listados de la disponibilidad léxica de los estudiantes de p rimaria ni de la universida d, y otro tipo de palab ras que incluye en forma de anexo. 2.7. Variables que inciden en e l léxico di sponible Desde los inicios de los estudios de disponibilida d léxica los resultados han sido objeto de aná lisis desde persp ectivas diversas, ta les como la sociolingüística y la psicolingüística. Los investigadores franceses G ougenheim et al. (1964) realizaron una comparación geográfica tomando como referencia cuatro departamentos administrativos del país galo, Dordogne, Eure, M arne y Vendée (Gougenheim et al. 1964: 163 - 164) y un a comparación sociológica (Gougenheim et al. , 1964: 165 - 182) basada en dos factores, el m edio (rural y urbano) y el sexo. Las variables sociológicas fueron empleadas por estudios posteriores hasta consolidarse en el programa de referencia en la d isponibi lidad léxica en la década de los noventa, Lexidisp. Esta aplicación informática permite filtrar vocablos y realizar análisis matemáticos según cinc o variables 116 . Las v ariables más utilizadas en las investigaciones que se in scriben dentro del Proyecto Pan his pánico de Disponibilidad Léxica corresponden al sexo, nivel sociocultural, zona geográfica (urbana o rural) y tipo de centro (público o pr ivado). En este estudi o se analizan las variables sexo, estancias en el extranjer o, conocimiento de más de un idiom a, hábitos de lectura, ortografía (si lo comparo con el número de p alabras), clase social, uso de la lengua en diferentes contextos, exposición a los medios de comunicación, motivación del futuro profesorado y tipo 116 Las variables de refere ncia son el sexo, el centro escola r (públi co o privado), la comunidad (urbano o rural), el n ivel sociocultural (alto, m edio, bajo) y la edad (distinguiendo diferentes generaciones). Vi d. apartado 3.3.1 para una revisi ón del funciona miento del progra ma. Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 130 de estudios universitarios. Ciertas variabl es h an sido analizadas en el ámbito de la disponibilidad léxica m ientras que otras suponen una nueva incorporación a estos estudios. Su selección se fundamenta en el ámbito de la lin güística aplica da a la enseñanza de idiomas. Larsen - Freeman y Lon g (1991 ) afirma n que existen más de cuarenta teorías diferentes sobre los diferentes factores que inciden en el aprendizaje de una lengua. La mayoría de ellas tienen en cuenta no solo la situación física de aprendizaje, sino también otros facto res socia les y reti culares como la edad. A lgunos a utores como Colletine (2009: 128) se atreven a afirmar que el contexto es una de las variables más importantes 117 . El contexto, en sentido amplio, puede abarcar desde la diferente exposición a la lengua (medio endolingüe y ex olingüe), hasta las características socioculturales y reticulares del hablante. Existen diferen tes clasificaciones al respecto en las que se suelen incluir los siguientes cuatro fa ctores principales que influyen en el proceso de adquisición y aprendizaje d e segundas lenguas y lenguas extranjeras: la edad, el método, la aptitud y la actitud (Spolsky, 1969: 272 - 274). En determinados casos la nomenclatura difiere pero los aspectos considerados suelen ser muy similares. Así, Cenoz Iragui (1993: 29) distingue cu atro tipo de variables clave: individuales, socioesctructurales, psicosociales y socieducativa s. La edad es un factor ampliamente estudiado por ser considerado un factor relevante en la adquisición de un idioma (Johnson y Newport, 1989; Long 1990; Newport , 1990; Spad aro, 1998; Scovel, 2000; D eKeyser, 2000; Singleto n, 2001; entre otros). Se ha estimado que los niños adquieren con más facilidad un idioma extranjero que los adultos debid o a la mayor plasticidad del cer ebro. 117 «One of the m ost im portant variables that affects the nature and the exten t to w hich learners acquire an L2 is the co ntext of learning » (Colle ntine, 20 09: 12 8). There is a ti me i n human development when the bra in is predispos ed for success in langu age lea rning . Deve lopm enta l chang es in the b rain, aff ect the n ature o f langu age acquisition, and language learning that occurs after the end of the critical period m ay n ot be based on the innate biol ogical struct ures believed to contribute to first language acquisit ion (Lightb own y Spad a, 2006: 68 ). Capítul o 2 Marc o t eór ico 131 Determinar el momento exacto y el tipo de rel ación entre adquisición y edad es una cuestión inconclusa y que genera gran controversia (Birdsong, 200 5). No obstante, algunos investigadores como Klein (Klein, 19 86: 9) 118 aseguran que esa facilidad pa ra el aprendizaje de u na lengua se extiende hasta la pubertad. La edad adulta conlleva otros beneficios lingüísticos ligados a la abstracción de los términos, la comprensión de estructuras complejas y la memor ización de reglas. En general, el adulto adquiere de forma más rápida el vocabulario y es capaz de producir estructuras más complejas que los niños. Según (Lightbown y Spada, 2006: 72), los adultos muestra n u n desarrollo mayor en las primeras etapas de aprendizaje aunque le s resulte muy difícil aprender u n idioma con un domin io casi nativo. El factor educativo, mediante algún método de aprendi zaje o clase de aprendizaje, supone en algunos casos la única ex posición del hablante a la lengua extranjera. A pesar d e que autores como Krashen ( cf. 1987 : 59 ) 119 consideran que no es suficiente para adquirir una lengua, reco nocen su importa ncia com o pun to de partida para que los estudiantes usen la lengua en el mundo e xterior. En este sentido, l a mayoría de las investigaciones realizadas en centros educativos con programas bilingües (Gajo y Serra 2002; Braun, 2007) muestran los efectos positivos, no solo en áreas lingüísticas, sino también en el resto de materias. Lyster (Lyster , 2007: 14) 120 afirma que los programas de inmersión lingüística, con independencia de la modalidad del programa, ayudan a desarroll ar la competencia en una se gunda lengua. La aptitud y la actitud hacen referencia a procesos diferentes. Por aptitud se entiende la cualidad o capacidad de un hablante para aprender un idioma. En cambio, la actitud está relacionada con la motivación y su influencia ha sido am pliamente estudiada (Gadner y Lambert, 1972; Gardner, 1982, Castro Calvín, 1991; Dör nyei, 1994a y 1994b). La clasificación tr adicional (Baker, 1992, 2001; Finegan, 1994; entre otros) distingue dos tipos de motivación: instrumental, para conseguir un determinado objetivo; e i ntegradora, como medio de formar parte de una sociedad. 118 « In general, it i s reasonable to assume that little progress is made after the age of puberty» (Klein, 1986: 9). 119 « The classroom will probably never be able to complete ly overcome its limit ation s, not does it have to. Its goal is no t to substitute for the out side world, but to bring studen ts to the point w here they can begin to use the outsid e world for furth er acquis ition » (K rashen, 1 987: 59). 120 « Researc h has clearl y demonst rate d that immersi on students , regardles s of program type, develop much higher levels of second language proficiency than do non - imm ersion studen ts study ing the secon d langu age as a regular subject (i. e. for one period per sc hool day) » (Lys ter, 2007: 14 ). Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 138 transferirlas a la nueva lengua, lo ha rá de manera más o menos ráp ida. Mientras que un estudiante que no ha desarrollado dichas habi lidades con anterioridad tendrá dificultades en el aprendizaje de una segunda lengua. Por ello, es más conveniente que las habilidades lingüísticas se desarrollen primero en la lengua materna para poder tener mejor disposición para el aprendizaje de la segunda lengua. Además, Cummins reco ge informació n de investigaciones realizadas en d iferentes partes del mundo donde se ratifica su hipótesis (Cummins, 1991: 70 - 89): « When children begin the acquisitio n of a second language (L2), whether in the home or at school, their cognitive resources clearly play a central r ole in the rapidity and ultimate success with wh ich that language is acquired». En este senti do, gran parte de los estudi os neuroling üísticos y psicolingüísticos que dan prueb a de los beneficios cognitivos del bilingüismo, extienden esas ventajas al aprendizaje de una tercera lengua (Jacobsen e I mhoof, 1974; Albert, Obler y Obler, 1978). En 1961, Lerea y Kohut realizan un estud io con 30 hablantes monolingües y 30 bilingües en el que durante 70 m inutos realizan cuatro pruebas 131 : dos lingüísticas, una de in teligencia y una de persona lidad. Los resultados muestran que los estudiante s bilingüe s aprendieron más rápidamente a asociar palabras del test lingüístico que los monolingües hech o que, a su vez, está correlacionado con una mayor inteligencia. En cuanto a los estudios con una te rcera lengua propiamente dichos, cabe destacar el artículo de Mägiste (1984) donde extrae conclusiones de tres investigaciones que evalúan la adquisición de una tercera le ngua en estudiantes inmigrantes. La primera, iniciada por el National Swedish Board of Educatio n, compara los resulta dos en inglés de estudiantes suecos m onolingües y de estudiantes que usan el sueco en casa pero tienen un conocimiento pasivo de su lengua materna (no hay homogeneidad en esta variable ya que depende del país de origen del estudiante). Tra s pasar una serie de p ruebas estandar izadas en inglés divid as en cuatro partes, se constata que los estudiantes bilingües con un conocimiento pasivo de su l engua materna presentan mejores resultados en inglés que los estud iantes 131 Cuest iona rio bili ngüe , Columbia Me ntal Maturity Scale , Rogers ’ Test of Personal ity Adjustment y Micro Utte ran ce - As soci ati on Test (MU - A). Capítul o 2 Marc o t eór ico 139 monolingües . En cambio, los res ultados de los hablantes que usan diariamente su lengua materna, en lugar del sueco, son ligeramente más ba jos. Swain , Lapkin, Rowen y Hart (1990) dem uestra n que es errónea la tenden cia popular a pensar que los niños no deberían recibir instrucc ión en una L2 o L3 hasta que no muestren un elevado nivel de conocimientos en la lengua mayoritaria. Asegura n que muchos padres inmigrantes en Canadá son reacios a enseñar la lengua materna a sus hijos porque creen que su nivel en inglés se verá afectado. En cambio, apoyándose en la hipótesis de la interdependencia de Cumm ins y en sus propios resultados, explican que la tercera lengua favorece a los estudiantes de un programa bilingüe inglés y francés en Toronto. Ese mismo año, Nayak, Hansen, Kruege r y Mclaughlin (1990) señalan que los h ablantes multilingües muestran un mejor rendimiento a la hora de adquirir ciertos contenidos gramaticales que los monolingües . En 1992, Thomas compara el rendimiento de hablantes bilingües (inglés y español) y mon olingües (inglés) que estudian una segunda o tercera lengua. Además, clasifica a los ha blantes bilingües en do s grupos diferenciando a los estudiantes que han recibido una instrucción formal en una lengua semánticamente r elacionada con la lengua meta de aquellos que lo adquirieron en otro co ntexto. En general, los resultados m uestran que la conciencia metalingüística de los estudiantes bilingües puede aumentar si aprenden un a tercera lengua. Así, cuando los anglófonos con conocimiento de español realizan actividades para aprender francés, suelen tener m ás facilidades que los monolingües. En cuanto a los ha blantes bilingües q ue han recibid o clases formales en español, se demue str a que han desar rollado una concien cia lingüística que les ayuda a aprender francés más fácilmente que a los bilingües que han aprendido español en un medi o informal. Keshavarz y Astaneh (2004) realizan una p rueba de vocabulario en inglés a una p oblació n de estudio formada por hablantes monolingües persas y hablantes bilingües de turco y persa o armenio y persa. Las pruebas muestran que los hablantes nativos de turco y armenio que hablan persa como segunda lengua obtuvieron mejor puntuación en inglés que los habla ntes monolingües. Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 140 El armenio, el persa y el inglés fueron también las lenguas objeto de estudio de Kassaian y Esmae’li en 2011. Concretamente, realizan un análisis del rendimiento en una p rueba de vocabulario y comprensión lectora de 30 hablantes bilingües armenios y persas y 30 monolingües persas. Los informantes, niñas iraníes de 17 a 18 años, cuentan con un nivel intermedio de inglés. Cabe mencionar que Irán posee un sistema educativo centralizado por lo que las pautas meto dológicas y los man uales utilizados para el aprendizaje de inglés como lengu a extranjera fueron los mismos. Los resultados estadísticos muestran que el bilingüismo está altamente correlacionado de manera positiva con el dominio de vocabulario y la destreza lectora. Aunque e stas investigaciones com parten características con estudios cen trados en una segunda lengua, autores como Cenoz (2000: 39 - 53) considera que se debe hacer una clara distinción entre la adquisición de una segunda lengua y la adquisición multiling üe. Según Cl yne (1997: 113) el motivo radicaría en que los procesos de adquisición de una tercera lengua son mucho más complejos, en parte debido a los diferentes contextos de aprendizaje no solo del individuo sino del individuo con cada lengua. De hecho , investigacio nes como la de Hsu (2013) muestra n diferentes resultados no solo entre hablantes monolingües y bilingües, sino también entre hablantes bilingües y trilingües. En el ámbito de la disponibilida d léxica, los estudios que incluyen la variable referida al cono cimiento de otras lenguas lo hacen para valorar su incidencia en el léxico disponible en español como lengua extranjera. Carcedo González (2000c) analiza la influencia del conocimiento de otras lenguas románicas de los estudiantes finlandeses de español co mo le ngua extranjera. Prueba que aquellos informantes habl an otras lenguas romances presentan una productividad léxic a mayor que el resto. Samper Hernández (2002) enriquece el análisis de esta variable en estudiantes de español como lengua extranj era que realizan una estancia en España. No solo pregunta al informante si conoce otr a lengua, sino también con qué nivel (inicial, intermedio, a vanzado y superior) y cuál es su lengua materna (inglés, italiano, japonés y otros). Destaca que el factor más influen te en el cau dal léxico es el nivel alcanzado en lengua espa ñola. Sin em bargo, la var iable referida al conocimiento de otras lengua s Capítul o 2 Marc o t eór ico 141 no p resenta resulta dos significativo s y los estudiantes japoneses so n los que escriben más palabras por encima de los italia nos, ingleses y el grupo denominado «otros». No obstante, la autora advierte que se trata de un estudio exploratorio que cuenta con una muestra reducida y cuyos datos pueden servir de base para investigaciones futuras. Hugo (2003) tam bién realiza una inv estigación exploratoria donde analiza una muestra de 84 estudiantes alemanes de la región de Sarre que estudian español en el instituto. El estudio concluye qu e la variable con mayor incidencia en la productividad léxica es el nivel alcanzado en lengua esp añola, con independencia del número de lenguas que conozca el informante. Sánchez - Saus Laserna (2008) analiza varias variables relacionadas con el aprendizaje de una lengua sobre una mestra de 81 estudiantes extranjeros de español de la Universidad de Cádi z: nivel de español (A, B y C, como reducción de los seis del MCER), lengua materna (inglés, francés, alemán, italiano, finés y polaco), conocim iento de otras lenguas (románica o no románica) y uso del español (alto o bajo). Entre las conclusiones, cabe de stacar que lo s informantes qu e conocen otra lengua rom ánica tienen m ayor producción léxica que el resto. En su tesis doctoral, Sánchez - Saus Laserna (2011) estudia el léxico disponible de 322 estudiantes extranjeros de español en las ocho universidades andaluzas. Las variables seleccionadas son similares: el sex o, el nivel de español (A, B y C, a partir de los niveles del MCER ), las lenguas maternas (alemán, finés, francés, inglés, italiano y polaco), la frecuencia con que hacen uso del español (alta, me dia y baja) y el conocimiento que tienen de otr as lenguas ex tranjeras románicas (solo en el caso de informantes que no tengan ya una lengua rom ánica como lengua materna y qe contempla tres posibilidades: que no conozcan ninguna otra lengua extranjera; que conozcan otra u otras, pero ninguna sea románica, y que cono zcan otras len guas románicas). L os r esultados muestr an que aquellos estudiantes que conocen otra lengua extranjera producen la misma cantidad de palabras que aquellos estudiantes que hablan otra lengua románica co mo lengua materna o incl uso producen más palabras. Sánchez - Saus Laserna (2011) matiza los result ados indicand o que esa variable está Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 142 relacionada directamente con la lengua materna y con el nivel de español y, como no existe el mismo núme ro de informantes en cada variable, los dat os pueden verse influenciados. Frey Perey ra (2008) analiza variables similares en una muestra de 31 estudiantes de esp añol como lengua extranjera: lengua materna (sueco, portugués, noruego, mandarín, japonés, in glés, francés, danés, coreano y alemán), sexo, edad, nacionalidad, nivel de estudios de español, conocimiento de otras lenguas extranjeras y tiemp o de residencia en España. En el análisis cualitativo y cuantita tivo, el con ocimiento de otras lenguas juega un papel secundario ya que la variable con mayor incidencia es el tiempo de residencia en España. En un trabajo prel iminar, López Rivero (2008) analiza el léxico dispon ible de 43 estudiantes adultos de español como lengua extranjera. Las variables ob jeto de estudio son el sexo, ed ad, nivel sociocultural, conocimiento de otr as lengua s, lengua materna, años de estudio del español y método de enseñanza del español seguido. La incidencia del conocimiento de otras lenguas sobre el v ocabulario d isponible se hace patente en el número de palabras aportadas por cada informante, de forma que cuantas más lenguas con oce un informante ma yor será su caudal léxico. E ste factor se acentúa en los hablantes que cono cen tres o más lenguas. Magnúsdóttir (2012) realiza un estu dio con una muestra de 288 escolares de Islandia que estudian español como tercera lengua extranjera en Secundaria. Las variables analizadas son el sexo, la ubicación del centro, tipo de centro, modalidad de estudio y conocimiento de otras lenguas. E n cam bio, para poder realizar los análisis con Dispolex , Magnúsdóttir (2012: 71) reduce y simplifica las variables lo que conlleva que no se analice el conocim iento de otras lenguas extranjeras. García García (2014) estudia las variables sexo, edad, lengua ma ter na, nivel de español, m otivación p ara apren der españo l, conocimiento de otras lenguas, n ivel sociocultural y tipo d e estudia nte sob re una m uestra d e 300 estudiantes de español en la comunidad de Madr id. El investigador concluye que la var iable relativa al conocimiento de otras lenguas no incid e en el caudal léxico de los estudiantes ya que se el promed io de vocablos aportado s por los informa ntes que no conocen otra Capítul o 2 Marc o t eór ico 143 lengua extr anjera es superior a aquello s que conocen otra lengua y el promedio de palabras es similar en ambos grupos. En el « XI Congreso Internacional de Lingüística General » , San tos Díaz (2014a) presenta algu nos análisis descriptivos de la relación de la varia ble del conocimiento de otras lenguas co n el número d e palabra s y vocablos sobre l a muestra del presente estudio. En general, el promedio de palabras y vocablos aportados por los informantes aumenta a la par del número de idiomas que conoce un hablante . No obstante, aquello s infor mante s que tienen un nivel avanz ado en dos idiomas presen tan un m ayor ca udal léxico que los sujetos que cono cen dos lenguas con un n ivel inicial o medio. Por tanto, de los resultados se desprende que la productividad léxica se ve influida no solo por el número de lenguas que conoce un informante sino también por el n ivel de competencia lingüística alcanzado en las lenguas que conoce. 2.7.4. Corrección ortográfica Las directrices dadas en las pruebas de disponibilidad léxica muestran el carácter secundario otorgado a la corrección ortográfica. Com o no rma general, en l os estudios her ederos del Panhispánico, al informante se le pide que escriba todas las palabras que conozca relacionadas con un centro de interés dado. Por ello, a menudo los hablantes escrib en todo lo qu e se les viene a la mente descuidando la forma e incluso el contenido, ya que el ob jetivo es conseguir la máxima p roducción léxica. Según Paredes García (1999: 76) 132 el hecho de que los inform antes no puedan reflexionar sobre la forma correcta de cada palabra, como podría hacerse si no existiese la limitación temporal o esta fuese superior, ayuda a conocer la forma original de la palabra en la mente del individuo. Precisamente por esta razón, es tan relevante desde el punto de vista de la didáctica de la ortografía puesto que permite detectar los errores más frecuentes en una población de estudio y diseñar materiales que hagan hincapié en determin adas reglas orto gráficas, excepciones a la norma o 132 « Podemos decir que lo que las encuestas nos ofrecen es el estado primari o de la situación ortográfica de cada sujeto, la forma básica con la que la palabra aparece representa da en la mente del individuo. Esto parece constatarse en el hecho de q ue proporcionalmente so n muy escasas las autocorrecciones o las grafías híbridas (tipo b/v aca), índice s de dud as s obre el uso corr ecto del idi oma» (Paredes Garc ía , 1999: 76). Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 144 palabras específicas. A continuación, se presentan estudios de disponibilidad léxica que han analizado en detalle los errores ortográ ficos presentes en lo s listados y que, en general, coinciden en la predominancia de los errores de a centuación sobre el resto. Paredes García (1999) analiza los errores ortográficos presentes en una prueba de disponibilidad léxica reali zada a 484 informantes de segundo ciclo de Educación Secundaria Obligatoria y Bachillerato de Alcalá de Henares. Dadas las características de la prueba de disponibilidad léxica, donde los informantes aportan unidades léxicas simples o complejas, Paredes Ga rcía (1995: 76) afirma que tan solo es posible conocer los erro res más frecuentes en el pla no fonético y léxico. En su estudio (Paredes García, 1999: 81), los errores de acentuación ocupan el primer lugar (10 625 palabras) frente a los errores de letra (46 19 palabras), los errores léxicos (3477 palabras) y los errores de ca rácter morfosintáctico (320). Ávila Muñoz (2007) realiza un estudio exploratorio con estudiantes de 2.º de Traducción de la Universidad de Málaga. Destaca la proliferación de las faltas de ortografía en los estudiantes universitarios puesto que de los 50 informantes encuestados, tan solo 3 no cometieron ninguna falta de ortografía, 14 escribieron menos de 10 palabras incorrect as, 19 entre 10 y 20 faltas y 1 4 cometieron más de 20 faltas. A demás, c lasifica las diferentes disortografías en errores de acentuación y ortografía general pero n o los cuantifica. A continuación, analiza la incidencia de determinadas variables (sexo, número de horas semanales navegando por Internet, clase social, li bros que el estudiante lee al año, entre otras) con objeto de conocer cuáles son los principales condicionantes de las faltas de ortografía. Á vila Muñoz (2007 : 45) concluye que las varia bles que guardan una mayor correlación son la clase social y los hábit os de lectura. Muestra que cuanto m ayor es la clase social del informante y más libros lee al año, meno s faltas de o rtografía comete en la prueba de disponibilidad léxica. En cuanto al r esto de variables, muestra que las mujer es tienden a cometer más falta s de or tografía que los hombres (sin tener en cuenta los errores de acentuación) y que las horas de navegación en Internet no tienen una incidencia negativa en la correcció n ortográfica. Capítul o 2 Marc o t eór ico 145 El estudio de Saura Rami (2008) seleccion a informantes de la muestra aragonesa realizada durante los cursos 1998/99 y 1999/00 formada por 417 estudiantes d e 2.º de Bachillerato o CO U. Aunque los estudios se realizan en 28 centros de enseñanza , el análisis sobre la ortografía de las encuestas recoge tan solo los datos de 45 alumnos de los IES Lucas Mallada (Huesca), Luis Buñuel (Zaragoza) y Francés de Arand a (Teruel). De las 1394 disorto grafías detectadas, 940 corresponden a error es de acentuación y 454 a errores gráficos, es decir, que los informantes co menten el d oble de f altas de ortografías debido a una inadecuada acentuación Blanco Domínguez (2011) analiza los errores ortográficos de aquellas palabras con un índice de fr ecuencia acumulado del 80 % de los estudiantes preuniversitarios gallegos de la obra colectiva edita da por López Meirama (2008). Del total de 11 152 errores ortogr áficos, 5756 corr esponden a una inadecuada acentuación, lo que equivale al 51,57 %. Se trata hasta el momento del estudio que analiza de forma más pormenorizada las formas erróneas, distinguiendo entre errores ortográficos, errores fonéticos y lapsus. Por ejemplo, cuando el error se debe a la ausencia de tilde distingue entre palabras: agudas (29,22 %), llanas (15,28 %), esdrújulas (37,80 %), con diptongo (6, 02 %), con hiat o ( 11,30 %) y monosí l abas (0,38 %) . En cuanto a l a colocación de la tilde en la sílaba incorrecta, un 68,30 % se debe a palabras agudas, llanas y esdrújulas y, el resto (31,7 0 %), se local iza en palabras con dipton go o hiat o. Para completar el análisis cuan titativo, Blanco Dom ínguez (2011) añade las palabras que presentan con más frecuencia disortografías y, en determinados casos, su forma incorrecta ( autóbus ). 2.7.5. Clase social El estrat o sociocul tural forma parte de la mayoría de las investigac iones de disponibilidad léxica. Los precursores de esta disciplina, Gougenheim et al. (1964), incluyeron esta varia ble en las encuestas pero no la tuvieron en cuenta a la hor a de realizar análisis. López Morales (1979) toma como referenci a los niveles soc ioeconómicos de la teoría del d éficit de Bernstein (1961) para analizar cualitativa y cuantitativamente su incidencia en el léxico disp onible. A pesar de que revela Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 146 diferencias en el número y el tip o de pa labras aportadas por los diferentes estratos, López M orales (1979: 181) considera que esta teoría no es suficiente para afirmar que los estratos inferiores tengan una m enor capacidad cognitiva. Años más tarde, L ópez Morales (1996) refuta la hipótesis de que el diferen te caudal léxico de los estratos sociales implique dificultades cognitivas en el estr ato con menor léxico. En general, en los estudios de léxico disponible el nivel sociocultura l está conformado por los d atos relativos a l nivel de estudios y la ocupación profesional de los pad res del informante (E cheverría, 1991; Alba Ovalle , 1995a; Samper y Hernández, 1997; Mateo, 1998; Echeverría y V alencia, 1999a; Carced o 2001; Gómez Devís, 2004; entre otros). En cambio, al igual que en este estud io, algunos autores han incluido los ingresos famili ares para mejorar la d escripción de esta variable ( López Morales, 1999a; Carcedo, 2001; Ávil a Muñoz y Villena Ponsoda, 2010, 2011). Ávila Muñoz y Villena Ponsoda (2010) realizan un completo aná li sis multifact orial donde evalúan la incidencia de la posición social sobre el léxico disponible y la capacidad de identificación de tecnicismos (Pident). Destacan la relación entre la posición social y el léxico especializado de forma que aquellos informantes provenientes de clase alta son capaces de reconocer y asociar correctamente una ma yor can tidad d e palab ras técnica s con los centros de interés. No obstante, concluyen que la productivid ad léxica está más asociada a la exposición con los medios de comunicación y al conocimiento del vocabular io especializado. Por tanto, la clase social influye de manera indirecta, a través de la variable Pident, en el léxico disponible. 2.7.6. Hábitos de lectura y exposición a los medios de comunicación A través de la lectu ra, el estudiante es capaz de aprender numerosas unidades léxicas de manera incidental (Elley y Mangub hai, 1983; Coady, 2000). En este sentido , existen num erosos estudios prueban el papel fundamental que juega la lectura en el proceso d e adquisición y aprendiza je de una segunda lengua y una lengua extranjera (Zahar y Cobb y Spada, 2001; W aring y Takaki, 2003; Horst, 2005; Pigada y Schmitt, 2006; Brown, Waring y Donkaewbua, 2008; entre otros). No obstante, el efecto de Capítul o 2 Marc o t eór ico 147 los hábitos de lect ura y la exposición a los medios de com unicación n o son variables comunes en los estudios de dispon ibilidad léxica. El primer estudio de léxico disponible que incorpora una variable relativa a la lectura es llevado a cabo por Mackey (19 71a) quien se cent ra en analizar el tipo de lecturas que realizan los in formantes. En el año 20 07, Ávila Muñoz r elaciona el número de libros que los informantes leen al año con los errores ortográficos que comenten en lengua m aterna. Demuestra que se prod uce una correlación significativa entre am bas variables de forma que cuanto más errores com ete un informante menos libros lee al año. Ávila Muñoz y Villena Ponsoda (2010) incorporan una variable que recoge el número de libros que el informante lee al año y que divide los res ultados en tres grupos: entre 0 y 10, entre 10 y 20 y más de 20. En esta ocasión, la incidencia de esta variable no r esulta significativa en el caudal léxico en la primera lengua d e los informantes. En cambio, incor poran una variable que hace refer encia a la exp osición a los medios de comunicación, divida según el tipo de programas y el número de horas de exposición, que revela d iferencias significativas entre los diferentes grupos. Á vila Muñoz y Villena Ponsoda (2010: 264) afirman que el efecto de la expo sició n a programas televisivos de consumo (no ticias del cora zón, telerrealidad, etc.) es curvilíneo: quienes siguen estos p rogramas una vez a la semana presentan puntuaciones m ás bajas en el continuo de desplazamiento (el cual m uestra los hablantes con mayor o menor vocabulario descentralizado) que aquellos con nunca ven este tipo de programas o lo h acen asiduamente. Esa exposición a los medios de comunicación no resulta significativa en el n úmero de faltas d e ortografía (Ávila Muñoz, 20 07). 2.7.7. Contacto y uso de la lengua extranjera en diferentes contextos Esta variable se refiere al contacto y al uso de la lengua extranjera por parte del informante: para comunicarse con amigos y familiares, para escuchar música, ver programas de televisión, entre otros aspec tos. Es de gr an relevancia desde el punto de vista de la lingüística aplicada a la enseñanza de una lengua, ya que es necesario marcar la diferencia entre una situación de enseñanza - aprendizaje endolingüe y Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Univ ersi tar io e n Pr ofes orado 250 seguida por ty pist por tratarse de profesiones relacionadas con el sexo femenino. En cambio, los listados entre ch icos y chicas p resentan una mayor coincidencia, concretamente un 10 % ya que existen ciertas palab ras relacio nadas con los jóvenes, como scooter , y otras que apar ecen en los tres listad os pero en posiciones más adelantadas en el caso de los jóvenes ingleses, como bus y s chool en el centro denominado The city . CI Tres lis tados Actual /boys Actual /gir ls Boys/g irl s Vocabl o % Vocabl o % Vocabl o % Vocabl o % 2 12 60 % 2 10 % 1 5 % 5 25 % 3 8 40 % 2 10 % 1 5 % 7 35 % 4 13 65 % 0 0 % 0 0 % 3 15 % 5 12 60 % 0 0 % 1 5 % 3 15 % 6 6 30 % 0 0 % 1 5 % 6 30 % 7 6 30 % 1 5 % 1 5 % 6 30 % Medi a 9,50 37,5 % 0,83 2,5 % 0,83 3,33 % 5 10 % Tabla 4. 22 . Datos com parativos d e la investiga ción de D imitrijevi ć (1969) y de l estudio actual A co ntinuación se presenta la co mparación con los cen tros coincidentes de la investigación llevada a cabo por Ferreira (2006). La segunda colum na m uestra los resultados extraídos de hablantes nativos y la tercera de estudiantes universitarios chilenos. Centr o Estud io act ual Ferrei ra (2 006): hablant es nativos Ferrei ra (2 006): estudiantes chilenos 01. Human body part s head , eye , leg , arm , nose , finger , hand , mouth , ear , hair , sh oulder , foo t , teeth , neck , nail , feet , toe , knee , lip , heart leg , arm , head , eye , finger , hand , nose , toe , ear , mouth , feet , knee , heart , neck , shoulder , lun g, hair , stomach, ankle, elbow head , arm , le g , hand , eye , nose , mouth , finger , ear , hair , nail , neck , foo t , teeth , ton gue, knee , feet , lip , shoulder , f ace 02. Clothes trouser , T - shirt , skirt , shoe , jeans , shirt , sock , jack et , hat , dress, scarf , coat , pullover , boot , glove , shorts , bra , sweater , tie , underwear skirt , shoe , trousers , jean s , t- shirt , shirt , top , fashio n, sock , sh orts , ha t , tig hts, shopping, money, bra , to psho p, sho p, colo ur pan ts, des igner, jacket pants, shoe , t- shirt , jacket , trousers , sw eater , scarf , skirt , jeans , soc k , shirt , hat , coat , underwear , dress , blouse, glove , boot , shorts , tie 03. Food and drink water , meat , fish , to mato , potato , wine , milk , Coke , orange , ju ice , beer , bread , chip , coffee , apple , vegetable , h amb urger, banana , chicken , pizza water , apple , orange , coke , chip , c hocola te, pasta, banana , car rot, wine , chicken , fruit , bre ad , orange - juice, fat, lemo nade, mil k , pork, rice , vegetable meat , tom ato , apple , potato , bread , milk , chicken , lettuc e, juice , orange , coffee , beer , vegetable , fish , tea, water , wine , soda, rice , fruit 07. Games and entertainme nt football, basketb all, cinema , tennis, videog ame, musi c , television , sport , chess, theatre , card , dance , Pla y Station, reading, swimming, volleyball , running, jogging, baseball , bal l tv , film , radio , th eatre , musi c , cinem a , magaz ine, medi a, movie , f un, show , television , friend , com edy, play , book , part y , m oney, sport , new spape r cinema , movie , music, theatre , tv , friend , party , television , gam e, fun , radio , book , spo rt, concert, park, dancing , play , show , disc o, shopping Tabla 4. 23 . Compara ción de los veinte prim eros vocab los en inglés d e las investigac ión de Ferreira (2006) y del estudio actual Capítul o 4 Anális is gener al 251 En este caso, la coincidenc ia de palabras en las tres investigacione s no llega al 50 %. Los resultados más similares son los correspondiente s a estudiantes chilenos y españoles co n un 25 % de compatibilidad aparte del 47,5 % común a los tres listados. Sin embargo, el porcentaje de coi ncidencia con estudiantes nativos desciende a la mitad: 12,5 % de los vocablos aportados por estudiantes chilenos y a 7,5 % por los españoles. El hecho de que la nomenclatura fuese diversa en el centro referido a las distracciones en español se hace patente en los resultados. El número de coincidencias entre lo s hablantes n ativos y los estudia ntes chilenos es d el 40 % mientras que entre los hablantes nativos y los estudiantes españoles del 0 % y solo de un 5 % entre los estudiantes chilen os y españoles. CI Tres investiga ciones Estud io act ual y Habl ant es nativos Estud io act ual y estudiantes chilenos Habl ant es na ti vos y estudiantes chilenos Vocabl o % Vocabl o % Vocabl o % Vocabl o % 1 14 70 % 2 10% 4 20 % 0 0 % 2 10 50 % 1 5 % 8 40 % 0 0 % 3 9 45 % 3 15 % 7 35 % 2 10 % 7 5 25 % 0 0 % 1 5 % 8 40 % Medi a 9,5 47,50 % 1,5 7,50 % 5 25 % 2,5 12,50 % Tabla 4. 24 . Datos comparativos de la investigación de Ferreira (2006) y del estudio actual En el estudio de Gougenheim et al. (1964) solo se comparan los veinte primeros vocablos por no contar con el total de palabras por centros de interés. Los datos fueron recogidos en diferentes zonas de Francia. En el Département de la Dordogne se recogieron 500 encuestas. Las fichas se dist ribuyeron en cuatro grupos: 120 niños de zon a urbana, 120 niñas de zona urbana, 130 niñas de zona rural y 130 niñas de zona rural. En el Département de la Marne 173 escolares realizaron la prueba: dos grupos de 75 niños y 98 niñas, de los cuales provenían 133 de ciudad y 40 de l campo. En el D épartement de l’ Eure la muestra contó 85 informantes, formados por 73 n iños y 12 niñas, to dos (salvo 5) de la ciudad. Por último, en el Départment de la Vendée se pasaron 146 cuestionarios realizados a 90 niños y 56 niñ as, 130 correspondientes a la ciudad y 16 al campo. Centr o Estud io act ual Dépar tme nts de l a Dord ogne , Marn e, Eu re , Ven dée Dépar tme nt de la Dord ogne 01. Le corps huma in tête , mai n , bras , pied , bouche , oreille , jam be , doigt , nez , œil , yeux , cheveu , cou , ongle, dent , ventre , do s, ép aule, genou , langu e oeil ( yeux) , oreille , nez , bras , jamb es , pied , main , bouche , tête , co eur, doigts , cou , fo ie, estomac, dents , po umo ns, langu e , cheveux , genoux , ventre Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Univ ersi tar io e n Pr ofes orado 252 02. Les vêtements pantalon , cha ussure , jupe , chemise , t(ee ) - shirt, robe , chaussette , veste , mant eau , jean, gant , chapeau , pull ( - over) , écharpe, cravate , culotte , blouse , foular d, co llant, botte chemise , ch aussettes , culotte , mant eau , robe , veste , pull - over , jupe , blouse , gilet , ta blier , pantalon , cravate , cache - nez, combinaison , béret , chapeau , caleçon, bas , corsage chemise , veste , tablier , mant eau , gilet , culotte , robe , chaussette , jupe , combinaison , pantalon , cravate , bas , gants , béret , impe rméab le, blo use, chapeau , corsage , pull - over 06. Moye ns de transpo rt voiture, vélo , avion , train , bus , mé tro, bat eau , tram(w ay) , cheval, moto , TGV, taxi, à pied, RER, TER, camion , tr icycle, navette, parachu te, mi nibús camion , train , avion , bateau , moto , auto , charrette, car, bicyclette, mich eli ne , autobus , tramw ay , vélo , vélom oteur, camionnette, brouelle, tracteur, dilige nc, r emorq ue, paquebot Tabla 4. 25 . Compara ción de los veinte prim eros vocab los en inglés de las investig ación de G ougenh eim et al. (1964) y de l estudio actual Esta invest igación solo permite hacer varias comparaciones ya que no recoge el listado de palabr as ordenadas según el ín dice de disponibilidad léxica. No obstante, se pueden observar a lgunos datos llamativos. Po r una parte, se reitera el carácter compacto del primer centro puesto que el vocabulario presente en varios departamentos en Francia y en la m uestra actual coincide en un 85 %. A continuación, se comprueba que en el centro referido a la vestim enta, coinciden los tres listados en un 55 % pero el resto de palabras escritas por franceses y españoles solo sumaría un 5 %. Sin embargo, las dos últimas columnas añaden un 30 % al porcentaje de coincidencia donde se incluyen términos como combinaison y coursage , que quizás hoy en día no serían tan disponibles. CI Tres inves tiga cione s Estud io act ual y v arios departamento s Estud io act ual y Dord ogne Varios departamento s y Dord ogne Vocabl o % Vocabl o % Vocabl o % Vocabl o % 1 - - 17 85 % - - - 2 11 55 % 0 1 5 % 6 30 % 6 - - - - 8 40 % - - Tabla 4. 26 . Datos com parativos d e la investiga ción de G ougenhe im et al. (1964) y del estudio a ctual En líneas generales, se ha comprobado que los list ados se asemejan más o menos según se trate de la lengua materna o la lengua extranjera de los informantes. Este análisis inicial podría dar lugar a un estudio más pormenorizado de la organización del lexicón mental como se realiza en el Capítulo 6. Además, es posible conocer más allá d e las palabras localizad as, como puede ser que cier tas profesiones estén más relaciona das con un sexo u otro, razón por la cual se dedica el últim o Capítul o 4 Anális is gener al 253 apartado de este capítulo a presentar los listados de palabras según el sociolecto. Además, en lengua extranjera es posible conocer la presencia del léxico en los manuales o la facilidad d e adquirir ciertos términos. 4.6. La sit uación or tográfi ca En el presente estudio, la recogida de errores ortotipográficos de cada informante se realizó mediante una matriz diseñada ad hoc . El fo rmat o seguido para la confección del listado fue el mismo que pa ra la lematización de las p alabras, por lo que se creó una hoja de cálculo por centro de inter és donde a cada informante le correspondía una fila que incluía diferentes tipos de anotacion es. Los errores detectados han sido re gistrados en su forma original , es decir, sin aplicar las normas de edición. Por tanto, se recogen palabras en género femenino, arquitecta tecnica , y número plural, arboles 217 . A continuación, se presenta la distribución de disorto grafías por idioma y por centros de interés. El objetiv o es recoger qué tipo de faltas de ortografía son las más acuciadas para reflexionar sobre las posibles causas y buscar estrategias de enseñanza y aprendizaje adecuadas que ayuden a soslayar ese obstá culo. Además, se realiza una comparación interm uestral c on resultados de otros estudios que recogen los errores ortográficos de sus listados desde el punto de vista descriptivo (Paredes García , 1999; Saura Rami, 2008; Blanco Domínguez, 2011) y s ociolingüístico (Ávila Muñoz, 2007). 4.6.1. Resultados del estudio actual La presentación de las palabras concretas con distortografías se ha incluido en forma de a péndice separados según el idioma: espa ñol, inglés y fra ncés. En español se presenta según el m o delo recogido en el denominado «Apéndice ortográfico» del estudio rea lizado en Málaga por Ávila Muñoz y V illena Ponsoda (20 10: 317 - 319) : • Acentuaci ón 217 La conservaci ón de las form as orig inales perm ite la re alizació n de estudio s ulterio res en espa ñol y en le ngua extranjera centrados en la didáctica de la lengua. E n este sentido, cabe m encionar el análisis de los errores léxicos en esp añol co mo le ngua e xtranjer a de los estudi antes finlandeses realizado por Carcedo González (1999c). Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Univ ersi tar io e n Pr ofes orado 254 • Grafía c, z + e, i • j-g • s-x-c-k- qu • h • b-v • ll -y-ñ • Otras E n cambio, el formato de presentación d el anexo en l as lenguas extranjeras difiere de l españ ol debido a la dificultad de lem atizar algunos vocablo s que se alejan de la forma correcta. Ejem plo de ello, es el informante 25, cua ndo trata de escribir caracol en inglés, snail , p ero lo hace en fr ancés, scargot . Por ello, los errores ortográfico s y calcos de otros idiomas van p recedidos de la forma correcta en la que se han lematizado los vocablo s. Del total de vocablos con faltas de ortografía, es decir 328, más de la mitad corresponden a erro res de acentuación, concreta mente 217 vocablos . El resto de disortografías son meno res , c on lo que desde el punto de vista pedagógico parece necesario insistir en la aplicación de las reglas de acentu ación. Cabe destacar que en algunas programaciones de centros educativos las faltas de ort ografía penalizan la calificación del a lumnado. Por tan to, el pr ofesor ha de ser capaz de correg ir adecuadamente las producciones escritas del alumnado y conver tirse en un referente para el mismo. CI Acentua ción c, z + e, i j-g s-x-c-k- qu h b-v ll -y- ñ O tras Total C1 35 0 1 0 0 3 2 5 46 C2 13 0 1 1 0 3 1 9 28 C3 28 1 2 0 2 3 0 15 51 C4 22 0 2 1 0 1 0 8 34 C5 29 1 1 1 0 0 0 5 37 C6 19 1 0 2 0 0 0 8 30 C7 24 0 0 0 0 0 1 15 40 C8 29 0 0 2 0 1 0 5 37 C9 18 0 0 0 0 2 0 5 25 Total 217 3 7 7 2 13 4 75 328 Tabla 4. 27 . Clasificación de errores or tográficos en lengua esp añola Capítul o 4 Anális is gener al 255 La Tabla 4. 27 co rrobora la hipótesis de estudios anterio res y muestra una gran escala entre las falta s de ortografía deb idas a la acentuación gráfica, un 66,1 6 %, respecto al resto de errores , 33,84 % . El apartado «Otras» recoge todas aquellas disortografías que no han sido incluidas en el resto de secciones, entre las que destacan las faltas relacionadas con palab ras extranjeras como leggins y paddle . La distinción entre pares de letras que designan un mismo fonema, tales como b y v que corresponden al fonema /b/ y la s letras j y g en los caso s que se refieren al fonema /x/, presentan igu almente ciertas dificultades en los hablantes. Un 3,95 % de los e rrores se derivan del uso de b y v que corresponden a trece vocablos ( bello , púvis , vazo , baquero , verenj ena , vikini , a luvia , cerbeza , vicarbona to , bate , avogado , grava dor , gravadora ) y un 2,13 % al uso de la j y g relativo a siete vocablos ( vajina , trage , berengena , potage , conserge , jugete , agetreo ). Gráfi co 4. 12 . Dist rib ució n por cent ual del ti po d e er ror es e n l engua es pañol a En el Gráfico 4. 13 se muestra la distribución porcentual de lo s err ores ortotipográficos y de las palabras en cada centro de interés . En gen eral la diferencia entre las palabras y err ores no supera el 1 % por ámbito, es decir, que coincide el porcentaje de palabras en un centro de interés con respecto al total . Por ejemplo, el primer centro, Partes del cue rpo hum ano , cuenta con un 13,69 % de palabras y un 13,39 % de los errores totales. No obstante, el séptimo centro , Juegos y distracciones , presenta una diferencia de al go más de cuatro puntos deb ido quizás a que e n ese apartado se han incluido una gran can tidad de nombres comu nes y propios de juegos , que a menudo están presen tes en el lenguaje oral pero no son tan f recuentes en un texto escrito. Además , ese centro de interés contiene un 13,39 % de errores al igual que el primer cen tro y se encuentra por deb ajo del tercer centro, Comidas y bebidas . Sin 66,16% 0,91% 2,13% 2,13% 0,61% 3,96% 1,22% 22,87% Tipo de er r or es Acentuación c , z + e,i j-g s-x-c-k-qu h b-v Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Univ ersi tar io e n Pr ofes orado 256 embargo , estos dos últimos centros son considerablemente má s productivos, 13,6 9 % y 14,32 % frente a 9,26 % del séptimo centro , de ahí que el porcen taje de faltas de o rtografía se corresponda con el número de p alabras producidas. En el lado opues to se sitúan el segundo centro, La ropa , y el noveno, Ordenadores e internet , en cuyos casos el porcentaje de errores es considerab lemente inferior al de palabras, 11,45 % del total de palabras en comparación con 9,47 % del total de er rores en el prim er ca so y 10,03 % frente a l 7,62 % en el segundo. Tanto en el segundo como en el noveno centr o , ex iste una cantidad consid erable de extranjerismos que han sido acuñados y forman parte de nuestr o repertorio lingüístico , tale s como, anorak , pashmina , hardware y softwa re , entre otras. Gráfi co 4. 13 . Distribución porcentu al de errores y palabras por centros d e interés en español La Tabla 4. 28 recoge el número de palabras total aportadas por centro de interés, el n úmero de palabras con errores y la relación porcentual entr e ambas. El porcentaje de lexí as incorrecta s os cila entre el 1 % del c entro 9, Ordenadores e i nternet , hasta el 1,91 % del centro 7, Juegos y distracciones . A unque a priori el número parezca muy reducido, el profesor es el modelo de escrit ura del alumnado y cometería un error por cad a 100 palabras, por ejemplo, el equivalente a una falta en cada seis o siete líneas de este trabajo. De igual modo se ha presentado la relación de vocablos con errores respecto a su número total . En este caso las diferencias entre los distintos centros de interés se acentúa . El primer centro de in terés, Partes del cuerpo humano , m uestra el mayor índice de vocablos con errores con un 18,85 % ya que de 244 lexías diferentes 46 han sido escrita s d e form a inco rrecta. Sin embargo, el centro con más faltas de ortografía es el C1 C2 C3 C4 C5 C6 C7 C8 C9 P alabras 13,69 11,45 14,32 9,93 11,31 8,05 9,26 10,97 10,03 Er rores 13,39 9,47 13,91 11,33 10,16 10,85 13,39 10,85 7,62 0 2 4 6 8 10 12 14 16 Distribución porcentual de palabras y er ror es Capítul o 4 Anális is gener al 257 tercero, Comidas y bebidas , con un total de 51 pero debido a su gran product ividad s olo presenta un 9,62 % de sus vocablos incorrectos. Ello se debe a que el centro 1 muestra un vocabulario más hom ogéneo que el resto 218 con un índice de cohesión de 0,108 m ientras que el índ ice del centro 3 desciende hasta 0,050 y, p or tanto, en el primer caso la propo rción es mayor que en el segundo. CI Total pal abras Palabras incor recta s % Total vocablos Vocablo s incorrec tos % C1 4493 58 1,29 244 46 18,85 C2 3759 41 1,09 238 28 11,76 C3 4565 62 1,36 530 51 9,62 C4 3718 43 1,16 392 34 8,67 C5 3711 44 1,19 483 37 7,66 C6 2641 47 1,78 190 30 15,79 C7 3040 58 1,91 469 40 8,53 C8 3600 47 1,31 478 37 7,74 C9 3290 33 1,00 555 25 4,50 Total 32817 433 1,32 3579 328 9,16 Tabla 4. 28 . Palabras y vo cablos inc orrectos con respecto al to tal en españ ol En lengua extranjera la distribución porcentual de palabras por centros de interés es similar al espa ñol, a excepción del centro 9, Ordenadore s e internet , donde aumenta el porcentaje de palabras y vocablos aportados en lengua extranjera con respecto al español. L os errores ortográficos se concentran en mayor med ida en el centro de interés 8, Profesiones y oficios , con un 19,29 % del t otal de disortografías aunque paradójicamente es el penúltimo centro en porcentaje de palabras con un 9,58 %. Existen palabra s como engineer cuya s disortografías han adoptado hasta diez formas diferentes y otras mu y frecuentes como , professor , que presenta n un gran número de error es repetidos en tres variantes: profesor , proffessor y pro f fesor . En porcentaje de faltas de ortografía le sigue el centro 3, Comidas y bebidas , con un 17,95 %, lo cua l está justificado por su peso en el porcentaje de palabras aportadas, el mayor con un 14,63 %. El centro con mejores datos ortotipográficos es el cuarto, La escuela: muebles y materiales , debido a que suele ser el tema más recurrido en clase al apren der un idioma extranjero. Este h echo puede considerar se positivo ya que el futuro profesorado que pretenda impartir clases bilingü es deb erá conocer y escribir adecuadamente tod o el vocabulario relacionado co n su entorno escolar. 218 La in formación detal lada sobre e l í ndice de cohes ión de cada centro se e ncuentr a en e l apar tado 4 .3. Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Univ ersi tar io e n Pr ofes orado 258 Gráfi co 4. 14 . Distribución porcentu al de errores y palabras por centros de inter és en lengua extranjera A co ntinuación, se presenta la relación entre las palabras y vocablos con errores o rtográficos con respecto al to tal aporta do por los hablantes en inglés y en francés. Mientras que de cada 10 0 palabras en español lo s habla ntes escriben un a media de 1,32 palabras incorrecta s, en inglés es de 4,46 y en francés asciende a 7,67. Al igual que en español, la mayoría de los errore s en francés se deben a la acentuación incorr ecta de las palabras. Adem ás, en francés el acento ortográfico adopta tres formas diferen tes: acento circu nflejo, acento grave y acento agud o. Esta dificultad añadida provoca en cierta medida que el número de palabras incorrectas sea mayor que en inglés. El cent ro con mayor porcen taje de errores es el octavo, Profesione s y oficios , donde 9,04 palabras de cada 100 están escritas de forma incorrecta. El centro que le sigue, Comidas y bebidas , presenta una mejora considerable ya que desciende a un 5,37 % de palabras incorrectas. El ce ntro con meno r porcentaje de errores es el noveno, Ordenadores e internet , debido en gran parte al uso del vocabulario relacionado con las nuevas tecno logías en forma d e préstamo en espa ñol, lo que muestra una gran familiarización co n la escritura de las p alabras. CI Total palabras Palabras incorrec tas % Total vocablos Vocablo s incorrec tos % C1 2571 88 3,42 115 35 30,43 C2 2076 88 4,24 151 35 23,18 C3 2894 167 5,77 287 69 24,04 C4 2120 50 2,36 244 35 14,34 C5 2344 85 3,63 343 53 15,45 C6 1675 90 5,37 165 31 18,79 C7 1909 90 4,71 310 48 15,48 C8 1928 174 9,02 280 77 27,5 C1 C2 C3 C4 C5 C6 C7 C8 C9 P alabras 13,11 10,67 14,63 10,68 11,95 8,41 9,58 9,77 11,22 Er rores 9,82 8,93 17,95 6,61 10,80 9,73 10,00 19,29 6,88 0,00 5,00 10,00 15,00 20,00 25,00 Distribución porcentual entre palabras y er r ores Capítul o 4 Anális is gener al 259 C9 2251 50 2,22 460 41 8,91 Total 19768 882 4,46 2355 424 18 Tabla 4. 29 . Palabras y vo cablos inc orrectos con respecto al to tal en inglés Como ocurr e en lengua española, el primer centro, Partes del cuerpo humano , es el má s compa cto y, por tanto, los vo cablos so n poco numeroso s en c omparación con otros centros. Por tanto, e l por centaje de vocablos con errores es superior al del resto de centros de interés ya que han sido mencionados de forma más frecuente. En el caso opuesto se sitúa el centro de interés relaciona do con las nuevas tecnologías que presenta un total de 460 vocablos y tan solo 41 con errores, por lo que el porcentaje des ciende al mínimo 8,91 %. Respecto a la lengua francesa, el porcentaje por errores en cada centro supera los registr ados en esp añol y en inglés. Por un lado, e l centro que ocupa el primer rango coincide con el inglés, siendo el octa vo , Profesiones y oficio s , con un 14,05 %. No obstante, en este caso el centro con menor número de palabras incorrectas con resp ecto a su total es el segundo, La ropa , con 3,29 pa labras de cada 100 palabras aportadas . Por o tro lado, e l centro con menor proporción y númer o de vocablos incorrectos es el cua rto referido a la escuela, con ocho vocablos y un 7,08 % . En cambio, el sexto centro p resenta mayor porcentaje, un 20,75 %, ya que los informantes tan solo aportaron 53 vocablos diferente s y se presentan con 11 disortografías. En cuanto al noveno centro, Ordenadores e internet , la proporción de vocablos co n faltas de ortografía se sitúa en torno a la media con un 14,17 %, puesto que el in glés es el idioma de referencia en el campo de las nuevas tecn o logías e n detrimento del fra ncés y otras lenguas que han incorporado las voces inglesas a ese dominio léxico. CI Total pal abras Palabras incor recta s % Total voca blos Vocablo s inc orrec tos % C1 427 22 5,15 78 16 20,51 C2 365 12 3,29 80 14 17,50 C3 452 34 7,52 166 22 13,25 C4 323 24 7,43 113 8 7,08 C5 389 36 9,25 135 23 17,04 C6 249 19 7,63 53 11 20,75 C7 282 22 7,80 125 14 11,20 C8 299 42 14,05 119 21 17,65 C9 316 27 8,54 127 18 14,17 Total 3102 238 7,67 996 147 14,76 Tabla 4. 30 . Palabras y vo cablos inc orrectos con respecto al to tal en francé s Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Univ ersi tar io e n Pr ofes orado 266 sitúa e n un extremo el prim er centro, Human body parts , co n un 39,13 % de palabras diferentes y el último , Computer and internet , con un 66,30 %. Dife re nci a entre los 20 primeros Total voca blos Vocablo s dif erent es Vocablo s comunes CI H ombres M ujere s Ambos H ombre s M ujere s A mbos C1 1 81 105 115 11 34 45 39,13 % C2 4 98 130 151 21 54 75 49,67 % C3 4 194 227 287 60 93 153 53,31 % C4 4 144 203 244 41 100 141 57,79 % C5 6 198 277 343 66 145 211 61,52 % C6 1 104 123 165 42 61 103 62,42 % C7 6 186 251 310 59 124 183 59,03 % C8 5 166 229 280 51 114 165 58,93 % C9 5 269 346 460 114 191 305 66,30 % Medi a 4 160 210,11 261,67 51,67 101,78 153,45 56,46 % Tabla 4. 36 . Cuadro res umen co mparativ o del núm ero de voc ablos aportados por hombres y mujeres en inglés En francés , los datos difieren con respecto al español e inglés. La muestra está compuesta por un número inferior, 21 informantes, de a hí que en la prim era columna los resultados sean superio res a los otros dos idiomas. En este caso, los informantes han tenido menos oportunidades para homogeneizar el vocabulario y, por tanto, la disponibilidad léxica de los vocablos solo se ha calculado a partir de una veintena de respuestas. Asimismo, algunas de las palabras aportadas por un solo grupo podrían encuadrarse en el otro grupo si contasen con un núm ero superior de sujetos. El centro con menor porcentaje de diferenc ia entre los vocablos aportados por hombres y mu jeres es el séptimo, Jeux et loisirs, con un 18,40 %, seguido del quinto, La ville , con un 20,74 % . En los centr os más produc tivos como es el caso del te rcer y cu arto centro, la diferencia es considerablem ente mayor, 62,65 % y 68,14 %, en consonancia con el elevado número de voca blos 166 y 113. Dife re nci a entre los 20 primeros Total voca blos Vocablo s dif erent es Vocablo s coincidentes CI H ombres M ujeres A mbos H ombres M ujeres A mbos C1 2 49 71 78 7 29 36 46,15 % C2 8 52 65 80 15 28 43 53,75 % C3 7 94 134 166 32 72 104 62,65 % C4 7 49 100 113 13 64 77 68,14 % C5 10 81 28 135 28 54 82 20,74 % C6 5 40 15 53 15 13 28 28,30 % C7 10 64 23 125 23 62 85 18,40 % C8 8 70 29 119 30 49 79 25,21 % C9 11 75 33 127 33 52 85 25,98 % Medi a 7,56 63,78 53,33 110,67 55,56 47 102,56 38,81 % Tabla 4. 37 . Cuadro res umen co mparativ o del núm ero de voc ablos apo rtados por h ombres y mujeres en francés Capítul o 4 Anális is gener al 267 En cuanto al promedio de vocablos aportados por hombres y mujeres, en todos los casos el sociolecto femenino presenta un mayor caudal léx ico debido a que el númer o de informantes hombres es inferior al de mujeres, por lo que esos dato s no se han considerados representativos de la muestra. En cambio, es posible realizar la co mparación de la media de palabras aportadas según sexo . En este caso, la media masculina en español solo supera a la femenina en el noveno centro, Ordenadores e i nternet . El número de informantes hombres de la especialidad de Tecnología, Informática y Procesos Industriales es superior al de las mujeres, por lo que m uestran mayor dominio del ca udal léxico en el centro referido a lo s ordenadores. Tabla 4. 38 . Media de v ocablos en los diferente s idiomas se gún sexo Aunque las divergencias en lengua extranjera no son estadístic amente significativas, se presentan a modo de ejemplo la media de palabras por informantes en lengua extranjera para comprob ar si se repite el mismo modelo que en españ ol. En este caso, también los ho mbres superan la media de las mujeres en d os centros de interés: en el de Ordenadores e i nternet , com o ocurre en los resultados en español, y en Medios de transport e . Al realizar un análisis de correlaciones bi variadas con el número de lexí as aportadas por informante en cada centro y la variable sexo en el programa SPSS, se constata que las diferencias solo so n significativas en tres centros de interés. L a correlación es significativa a l nivel 0,01 (bilateral) en el caso de La ropa y al nivel 0,05 en los centros Comidas y bebidas , La escuela: mueble s y materiales . En el diagram a de cajas se muestra la diferencia entre las medias de ambos subgrupos en el centro 2, La ropa , siendo superior la aportada po r las mujeres (M). Se observan dos casos extremo s de las encuestadas identificadas como 21 y 34 con un número de palabras muy por Medi a de vocabl os diferent es en español Medi a de palab ras e n inglés Medi a de vocabl os e n francés CI Hombre s Mujeres Ambos Hombre s Mujeres Ambos Hombre s Mujeres Ambos C1 24,93 26,9 26,28 16,13 17,51 17,14 17,38 22,77 20,33 C2 19,91 22,96 21,98 12,89 14,21 13,84 15,75 18,77 17,38 C3 25,02 27,47 26,7 18,3 19,68 19,29 20,25 22,69 21,52 C4 20,56 22,3 21,74 13,98 14,15 14,13 13,25 17,08 15,38 C5 20,89 22,08 21,7 15,09 15,76 15,63 17,5 20 18,52 C6 15,22 15,55 15,44 11,35 11,05 11,17 12,25 11,92 11,86 C7 17,19 18,05 17,78 12 12,99 12,73 12,5 14,46 13,43 C8 20,26 21,42 21,05 12,76 12,84 12,85 13,5 15,15 14,24 C9 20,06 18,86 19,24 15,54 14,68 15,01 14,25 16,23 15,05 Medi a 20,45 21,73 191,91 128,04 132,87 131,79 136,63 159,08 147,71 Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Univ ersi tar io e n Pr ofes orado 268 encima del promedio. L a muestra de los informantes masculinos es más homogénea y, por tanto, la distancia entr e los valores mínimos y máxim os es más acortada. Gráfi co 4. 15 . Diagram a de cajas q ue recoge la d istribución por sexos d el númer o de palab ras del centr o denominado La r opa Dada la rele vancia de la variable sexo en tres ce ntros de interés, se presentan los veinte vo c ablos más frecuentes aportados por los hombres y mujeres de la población de estudio para comprobar el grado de coinciden cia. Asimismo, se analiza n las unidades léxicas que h an sido ap ortada s so lo po r el subgrupo femenino o masculino. Para el resto de centr os de interés, la información se encuentra disponible en el Anexo I X. Gómez M olina (2006 : 64) concluye que la difer encia entre vocab los y palabras aportados por el sociolecto femenino y masculino viene marcada biológica y culturalmente. En este sentido Bel lón Fernández (2011: 119) destaca la idiosincrasia de los centros de interés y de su relació n con el sexo de los informantes: Por tant o, te ndremos que conclui r que l os re sulta dos obteni dos en nuestro estudi o del léxi co disponibl e de la provincia de Córdoba no son fortuitos y que efe ctiva mente nos halla mos ante un hecho general: algunos centros de interés son más favorables para unos hablantes que para otros, dependie ndo de su sexo. Aún m ás, esas áreas temáticas - maneja da s en lo s estudios de disponibilidad léxica - más propi ci as para las m ujeres suelen ser ‘La ropa’, ‘Los mueb le s de la casa ’ , ‘Al iment os y beb ida s’ , ‘ Obje to s col o cados en la m esa para la com ida’, ‘La coc ina y sus usten silios ’ y ‘L os colo res’; m ientra s que los cam po s léxicos habitu alme nte má s ac cesibles a los ho mbres son ‘ Calef acci ón, ilu minac ió n y medios de airear un recinto’ , ‘El ca mp o’, ‘ Medi os de t ra ns po rte’ y ‘ T rabajos del campo y del jardín’ . Capítul o 4 Anális is gener al 269 4.7.1. Centro 2: La ropa Las 20 palabras más disponibles proporcionadas por hombres y mujeres coinciden en má s de un 75 %, concretamente en 16 vocablos. Las lexías diferentes en el grupo m asculino son som brero , cinturón , gor ra y corbata que se asocian a prendas de vestir tradicionalm ente más usuales entre los hombres que entre la s mujeres. Del mismo modo, el grupo femenino aporta los vocablos vestido , guante , rebeca y bota . Los sustantivos referidos a la ropa interior, braga y calzoncillo , corresponde n a un par de palabras que los informantes escriben en uno u otro orden hasta en 51 ocasiones, de ahí que aunque se trate de prendas de mujer y hombre aparezcan como vocablos disponibles en los dos listados. Del mismo modo , se observa que algunos vocablos compartidos por ambos grupo s cuentan con un porcen taje d e apa rición mayor o menor según el sexo. Por ejemplo, falda ha sido escrita por el 61,11 % de los hombres y por el 85,47 % de las muje res. Hombr es Muje re s Vocabl os ID % Apa ri ci ón Vocabl os ID % Apa ri ci ón pantalón 0,81101 92,593 pantalón 0,79874 96,581 camiseta 0,67209 85,185 falda 0,65699 85,47 camisa 0,626 75,926 camisa 0,61125 81,197 calcetín 0,54719 81,481 jersey 0,59933 77,778 chaqueta 0,53423 72,222 camiseta 0,5914 76,923 zapato 0,50085 74,074 zapato 0,5223 82,051 jersey 0,4829 62,963 vestido 0,51243 73,504 falda 0,41389 61,111 chaqueta 0,47651 70,94 calzoncillo 0,36523 57,407 bufanda 0,44305 69,231 braga 0,3177 51,852 calcetín 0,43887 76,923 abrigo 0,27886 42,593 abrigo 0,39764 64,103 bufanda 0,26667 46,296 medi a 0,31582 56,41 sombrero 0,25353 37,037 guante 0,28677 49,573 cinturón 0,24557 40,741 rebeca 0,26422 41,026 gorra 0,24167 38,889 braga 0,26202 49,573 medi a 0,23859 40,741 gorro 0,24553 43,59 sujetador 0,22879 37,037 sujetador 0,24098 43,59 (pantaló n) vaquero 0,2284 33,333 (pantaló n) vaquero 0,23829 37,607 gorro 0,21637 33,333 bota 0,23604 47,009 corbata 0,20402 37,037 calzoncillo 0,21359 43,59 Tabla 4. 39 . Veinte prim eros vocab los del centro 2, La rop a , según la va riable sexo En cuanto a los vocablos aportados exclusivamente por hombres o mujeres, se destacan los siguientes aspectos: - Los hombres incluyen prendas de vestir femeninas tales como body , burkini , sostén , trik ini y Wonderbra . Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Univ ersi tar io e n Pr ofes orado 270 - Las mujeres aportan vocablos más concretos sobre el tipo d e ro pa: bota alta , bota de media caña , bot a de montaña , falda de tubo , falda de vuelo , falda pantalón , traje de baño , traje de noche , tra je de vestir , vestido de flamenca , vestido de noche , vestid o de novia , vestido de tirantes , pañue lo palestino , pashmina . - Los vocablos referidos a complementos se encuent ran más presentes en el léxico del sociolecto femenino: accesorio , alianza , antifaz , bisutería , brazalete , broche , felpa , gargantilla , joya , muñe quera . En el sociolecto masculino: anteojo , complemento , peluca , reloj de pulsera . Hombr e Muje r anteojo, arreglarse, babucha, body, burkini, camisol a, capucha, cham arra, complemento, con junto, estilo casual, formal, inform al, jeans, le ncería, manga a la s isa , mi tón, moda, pantalón de pana, pantufla, peluca, probador, reloj de pulsera, ropa blanca, ropa de color, sobrecamisa, sombrero chambergo, sostén, tienda, triquini, turban te, Wond er bra , z anc o (pantaló n) pirata, a balorio, a ccesorio , alianza, a ntifaz, baila rina, bas tón, bata de cola, bisutería, blazer, bolsa, bolsillo, Borsalino, bota alta, bota de media caña, bota de m ontaña, braga (del cuello), brazalete, broche, calza, calzado , camiseta de tirantes, casaca, chamarreta, chaqué, colgante, colorido, combinación, corsé, cremallera, d elantal, deportivo, d iminuto, disfraz, ejecutivo, equipación, estola , faja, fajín , fa lda de tubo , fald a de vuelo , fald a pantalón, f elpa, forro, gargantil la, gomilla, hebilla, jersey de cuello alto, joya, lan a, mang a, man tilla, man tón, me dia tupid a, mon o, muñ equera , niqui, orejera, palabra de honor, pana, pantalón de pinzas , pañ uelo palesti no, pashmina, percha, picar día, pichi, ropa, ropa deport iva, sombrero de copa, talla grande, talla pequ eña, tejano, tirante, toalla, tocado, torera, traje de baño, traje de noch e, traje de vestir, túnica, uniform e, vestido camisero, vestid o de flamenca, vestido de noche, vestido de novia, vestido de t irantes, zapatilla de casa, zueco Tabla 4. 40 . Vocablos ap ortados so lo por hom bres y m ujeres en el ce ntro 2, La ropa 4.7.2. Centro 3: Comidas y bebidas E ste centro de interés presenta un repertorio lingüístico más variad o que el anterior ya que el índice de cohesión es de 0,050 mientras que en La ropa es de 0,092. El grado de coincidencia entre los veinte primeros vocabl os de los dos listados es el que pre senta la mayor diferencia de todos los centros con 5 palabras, lo que corresponde a un 25 %. Sin embargo , esas lexías no podrían considerar se características de un sociolecto u otro ya que aparecen en posiciones más avanzadas y con un alto índice de dispon ibilidad. Cabe destacar la alta disponibilidad del vocablo café en las mujeres (0,237) con respecto a los hombres (0,127) q uizás por referirse, más que a la bebida , a l a costumbre de reunirse con otra s personas en la sobremesa. Hombr es Muje re s Vocabl os ID % Apa ri ci ón Vocabl os ID % Apa ri ci ón cerveza 0,33273 48,148 agua 0,497 66,667 agua 0,32011 46,296 tomate 0,375 64,103 pescado 0,31738 51,852 zumo 0,366 53,846 Capítul o 4 Anális is gener al 271 carne 0,30879 46,296 vino 0,332 48,718 tomate 0,28071 53,704 carne 0,332 46,154 vino 0,27126 42,593 pan 0,321 49,573 patata 0,26556 46,296 patata 0,313 52,137 arroz 0,25628 44,444 pescado 0,313 48,718 Coca - Col a 0,24428 33,333 cerveza 0,311 45,299 lechug a 0,23401 40,741 leche 0,309 47,009 ensalada 0,22796 37,037 lechug a 0,294 52,137 zumo 0,22585 33,333 café 0,237 35,043 leche 0,22201 29,63 arroz 0,235 39,316 pan 0,22095 37,037 verdura 0,231 37,607 fruta 0,18611 33,333 naranja 0,217 39,316 pollo 0,18089 29,63 fruta 0,208 29,915 manza na 0,1678 29,63 refresco 0,204 29,915 tortilla 0,15807 22,222 pasta 0,201 31,624 pizza 0,15728 27,778 Coca - Cola 0,196 25,641 huevo 0,15596 22,222 manza na 0,188 34,188 Tabla 4. 41 . Veinte prime ros vocablo s del centro 3, Comidas y bebidas , según la variable sex o Este centro cuenta con 530 lexías diferentes y se sitúa en el segundo rango tras el centro 9, Ordenadores e i nternet , con 555 vocablos. Dada la heter ogen eidad del léxico, la diferencia de las palab ras apo rtadas solo por informantes masculinos y femeninos se acentúa, 2 80 vocablos . Los hombres aportaron 99 lexías que no aparecen en los listados de las m ujeres y ellas a su vez apo rtaron 181 unidades léxicas diferentes. Tras analizar l os vocablos en send os sociolectos, se pued e n destacar las siguientes singularidades: - Los hombres tienden a escribir más palabras relaci onadas con bebidas alcohólicas: absenta , aguardiente , albariño , Bacardi , Cacique , Chardonnay , cubalibre , Dyc , ginebra , JB , Ma rtini , pacharán , ponche , Ribera del Due ro , sake , sauvignon , Sex on the Beach , vin o blan co y vino rosa do . En cambio, las mujeres solo recogen en exclusividad los vocablos genéricos : alcohol , brandy y sidra . - Las mujeres han aportado más vocabulario relacionado con postres y alimentos dulces: arro z con leche , cara melo , chuchería , chupachús , cuajada , flan , fla n de huevo , gofre , golosin a , gominola , granizada , horchata , leche merengad a , muffin , napolitana , natilla , pionono , tocin o de cielo , tofu y vain illa . Los hombres s olamente incluyen : churro , re postería , sirope , tarta de chocolate y tarta de fru ta . Hombre Muje r absenta, agu ardiente, ajenjo, aceituna rellena, agua con gas, agua mineral, alcohol, alioli, alita Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Univ ersi tar io e n Pr ofes orado 272 albariño, anguila, aperitivo, azúcar more no, Bacard i, bebid a, bist ec, boca de mar, bom bón, boquerón en vinag re, Cacique, canapé, cangrejo, caña, cardo, carne de cerdo, cav iar, cazuela de fideos, chacina, Chardonnay, chipirón, choco, chop o, churro, ciervo, cigala, conserva animal, co nserva vegetal, coquina, criadilla, cubalibre, Danon e, Dorit os, Dyc, espeto , fiambre, filete tártaro, fu silli, gallina, gallo , ga mba reb ozad a, ginebr a, guarnición, gula, hojaldre, jamón cocido, JB, kiko, L a Casera, láudan o, lechal, m anita de cer do, Mart i ni, mate, mero, mij o, mojit o, mozza rel la , nabo, nar anj ada , nugget, pacharán, palmera, papaya, pero, pimiento morrón, pinchito, piquito, ponche, porra, potaje de acelgas, potaje de lentejas, quesadilla , queso manchego, repostería, revuelto de espárragos, Riber a de l Duero, rioja, ro lli to de primavera, rol lo, sacarina, sake , sauvignon, secreto ibérico, seso asado, Sex on the Beach, s iro pe, sofrito, tarta de ch ocolate, tarta de fruta, tintorera , v ino blan co, vino rosado, zumo de aránd ano, zumo de melocotón, zumo de piña de po llo, almuerzo, anacardo, Aquarius, arándano , arroz con leche, asa do, avella na, bagu ette, ban ana, barr a de pan, b ebida alcohólica, bebida isotónica, beicon, berberecho, berenjena con miel , bol lo , bra ndy, bréc ol, brot e de soj a, buey , bur rit o, cabal la , cacahuete, cacao, calamarito, caldo A vecrem, cald o gallego, calzone, camarón, canela, caramelo, carne a la plancha, carne mecha da, carp acc io, cazu el a, ce bol let a, cena , chi cl e, chu che rí a, chupachús, chu pito, cochinillo, cocinar, coco , comida basura, concha fina, condimento, conejo a la cazadora, costilla, crema pastele ra, cuaj ada, cucha ra, cuchi llo, cus cús, des ayuno, dorada , empanada, ensalada de arroz, entrante, escaro la, Fan ta Limón, Fanta Naranja, fideuá, flan, flan de huevo, fréjol, fruto rojo, gazpachuelo, gelatina, gofre, golosina, go minola, granizad a, hambre, hielo, hierbabuena, hígado, horchata, huevo cocido, huevo de codorniz, ingre diente, jabalí, jengibre, jibia, kebab, leche mere nga da, lomo en mant eca , mace doni a, mantec a, mantec ado , mant el, maracu yá, McDonal d’s , meloc otó n en almíba r, merl uza , mig as, mitad, m ollete, mora, muffin, muslo, napolitana, n atilla, nube, ñoqui, ostra, palmito, palomita, pan cateto, pan de ajo, pan de mo lde, panceta, papilla, pasa, patata a lo pobre, pechuga, pepinil lo, Peps i, pi cadill o, pimentón, piñón, pionono, pipa de ca labaza , pip a de gira sol, pisto, pitufo , po llo al c urry, pollo asad o, producto biológico, Puleva, puré, queso blanco, queso brie, queso de untar, rábano, rabo de toro, rebanada, rebujito, receta, Red Bul l, rest aura nte, rev uelt o, r evuel to de ver dura, ri ñón a l jerez, ruca, salami, salmonete, salsa bo loñesa, salsa de yogu r, salsa ro sa, salteado, shawarm a, sidra, sobrasa da, so da, so lomillo a la pimienta, sopa de m arisco, sopa de picadillo, Sprite, tapa, té verde, tenedor, tocino, tocino de cielo, tofu, tomate ch erry, tomillo, tortellini, tortilla frances a, tostada, vaca, vainilla, valeriana, wrap, zurrapa Tabla 4. 42 . Vocablos ap ortados so lo por hom bres y m ujeres en el ce ntro 3, Comidas y beb idas 4.7.3. Centro 4: La escuela: muebles y materiales La media de palabras aportadas por los hombres en este centro es de 20,56 lexías mientras que el promedio de las mu jeres es de 22,30. El númer o de vocablos aportados por amb os grupos se sitúa en torno a la m edia (397,67) con 392 vocab los. Solo se destacan dos lexías diferentes en los listados que inclu yen los 20 primeros vocablos: puerta y alumno en el caso de los hombres ; rotula do r y carpeta en el listado de las mujeres. Al igual que en los centros anterio res, ese voca bulari o está presente en los dos listados pero con un índice de disponibilidad inferior . Hombr es Muje re s Vocabl os ID % Apa ri ci ón Vocabl os ID % Apa ri ci ón pizarra 0,78054 90,741 pizarra 0,73421 87,179 mesa 0,70113 83,333 silla 0,6945 82,906 silla 0,65629 81,481 lápiz 0,63974 91,453 boli(gr afo) 0,58154 81,481 mesa 0,63962 71,795 lápiz 0,56808 77,778 boli(gr afo) 0,57956 84,615 tiza 0,53632 72,222 libro 0,471 75,214 libro 0,42431 72,222 goma (de borrar) 0,44064 68,376 Capítul o 4 Anális is gener al 273 pupitre 0,39129 46,296 pupitre 0,41867 48,718 goma (de borrar) 0,34779 53,704 tiza 0,41593 55,556 regla 0,27677 44,444 ordenador 0,41377 66,667 profesor 0,26359 37,037 libreta 0,32291 51,282 cuaderno 0,23179 37,037 estuche 0,28855 52,137 estuche 0,22473 38,889 borrador 0,27566 39,316 borrador 0,2223 31,481 rotulador 0,27243 46,154 libreta 0,21876 37,037 regla 0,26967 45,299 ordenador 0,21639 33,333 cuaderno 0,23811 40,171 puerta 0,20883 29,63 mochi la 0,22625 41,88 alumno 0,20247 29,63 profesor 0,20467 27,35 mochi la 0,19944 40,741 proyector 0,19224 29,915 proyector 0,19619 31,481 carpeta 0,17137 33,333 Tabla 4. 43 . Veinte prim eros vocab los del centro 4, La es cuela : mue bles y ma teri ales , según la varia ble sexo Las columnas de la Tabla 4. 44 recogen un total de 237 palabras diferentes: 67 corresponden a l grupo ma sculino y 170 al gr upo femenino. En tre los vocablo s aportados se observa la segregación de sexos en la enseñanza en centros religiosos ya que los hombres han escrito cura , los cuales suelen enseñar en colegios pa ra chicos, mientras que las mujeres han escrito monja , quienes están más presentes en colegios para chicas. E n cu anto al vocabulario específico, el subgrupo masculino ha escrito más nombres de asignaturas: ciencias natura les , educación física , educación plástica y visual , filosofía , francés , geografía , geología , griego , inglés , latín , lengua castellana y literatur a , lenguaje y tecnología mientras que las mujeres no han mencion ado ninguna asignatura, solo el sustantivo genérico: materia . Por su parte, en el listado femenino se localizan los nomb res de las diferentes partes de un centro educativo y los tipos de centro: aula de convivencia , campus , cen tro bilingüe , centro TIC , colegio , edificio , escuela , escuela concertada , escuela priva da , escuela pública , guardería , hall , institución , instituto , jefatura de estudios , polideporti vo , sala de informática , sala de música , seminario y universidad ; en cambio, los hom bres solo han escrito cantina . Hombr e Muje r alfombra, alumnado, ascensor, auricular, baldosa, Biblia, bigotera , biología , boca de incend io eq uipada , bom billa, butaca, cajonera, c ampana, cantina, celof án, chándal, ciencias naturales, cuadrícula, cura, curso académ ico, diario, dintel, educación físi ca, educación plástica y visual, esquema, estante, filosofía, forro, francés, fútbo l, geografía, geología, globo (rotulad or) flu orescen te, abr igo, ad ministr ativo, a filador, agua, a ire acondicionado, am igo, AM PA, aprender, aprendizaje, ap robado, aprobar, archivado r, aro, atlas, atril, aula de convivencia, babero, barro, bloc, bloc de dibujo, bloc de notas, bola del mundo, bolso, cable , caja, caligrafía, cam a, campus, canasta, cancha de baloncesto, capilla, cartilla, cartuchera, CD( - ROM), ce lo, ce ntro b iling üe, cen tro TIC , chin cheta, colegio, col umpio, comportamiento, concurso, conocimiento, consejo escolar, copistería, cortina, cuadro, cuerda, desayuno, dirección, diversión, dossier, edificio, enemigo, enseñar, escalímetr o, escáner, escuela, escuela concertada, escuela privada, escuela pública, espejo, estudiante, estudio, ética, excursión, fax , Fixo, fotocopia, fuente, funda, grande, grapa, grupo, guardería, guitarra, hall, iluminación, imagen , impre sora, institució n, in stituto, jardín , jefatu ra d e estu dios, juego, Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Univ ersi tar io e n Pr ofes orado 274 terráqu eo, griego, im borna l, inglés, latín , l engua castellana y literatura , lengua je, ma nualida d, mapamu ndi , marcad or, matr íc ula , panel , panta ll a digital , papel cebolla, papel vegetal, parte, pendrive, pizarra blanca, potro, producto químico, profesorado, rampa para m inusvál idos, religión, reloj, rop ero, tarea, tecnología, teléfono , tenis , test, trab ajo, transpo rtador, transp orte escolar, tubo fluorescente, urinario juguete , lám ina, láp iz d e m adera, lavab o, lec tura, lib rería, libro de lectura, libro de texto , libro d el p rofesor , líqu ido corre ctor, madr ugar, man ual, mate ri a, mesa de dibuj o, méto do, mina, monj a, muñeco, mural , netb ook, niño, ordenad or personal, orientad or, página , pandereta , papel de seda, papel milimetrado, papel pinocho, paragüero, parte de faltas, pegatina, películ a, personal de limpieza, pica, Pilot, pincel, pizarra tradicional , plumier, polidepor tivo, porta - ángulos, portafolio, portería , porter o, probeta, programación, pupilo, quitagrapas, radio, raqueta, ratón, redacción, repaso , reproductor, rep roductor de DVD, repro ductor de vídeo, respaldo, resumen, reunión, revista, sala de informática, sala de músi ca, sanci ón, secret ar io, semicí rc u lo grad uado, semin ario, Sénec a, separador, servicio, suspend er, suspenso , tablón de corch o, taller, tambo r, teclad o, televis or, tem ario, tr anspor tador de áng ulos, tr imestre, tutor, un idad didá ctica, unifo rme, un iversidad , váter, víde o Tabla 4. 44 .Vocablos ap ortados so lo por hom bres y m ujeres en el ce ntro 4, La escu ela: muebl es y mat eria les Debido a la disparidad entre el número de informantes de sexo masculino y femenino, resulta evidente qu e las mujer es hayan aportado más vocablos que los hombres. No obstante, el promedio de palabras por centro de interés sitúa al sociolecto femenino casi siempre por encima del m asculino. Aunque se rea lizase un estudio sobre qué factores inciden en el sexo y viceversa, es deci r, si resulta que las mujeres tienden a escoger carreras universit arias del área lingüística mientras que los hombres del área científi ca y que esa variable a su vez índice en el léxico disponible, el sexo no deja constancia de diferencias estadísticamente significativas en la mayoría de los centros 219 . 4.8. Conclusi ones parcia les La lengua materna de los informantes resulta ser la más productiva en cuanto a número de palabras y vocablos. En español, los informantes han escrito un promedio de 191,91 palabras, en inglés 131,79 y en francés 147,71. En cuanto a los vocablos, en españo l se registra una media de 20,93, en inglés de 13,77 y en francés de 5,82. Estos datos tan diferenciados se debe a que los vocablos se ven influenciados por el número de informantes: 171 en español, 150 en inglés y 21 en francés. Al comparar los resultad os con otros estudios realizados en M álaga, concretamente sobre una muestra de estudiantes preuniversitarios (Ávila Muñoz , 219 En el capí tul o sigu ient e no se incl uye la varia ble «sexo» porque en los análi sis estad íst icos no mostró una influen cia signific ativa sob re las va riables a nalizada s. Capítul o 4 Anális is gener al 275 2006) y de población adulta (Ávila Muñoz y Villena Ponsoda, 2010) se destaca la mayor productividad de los estudiantes de postgrado. La media de palabras por centro de interés calculada sobr e los ocho cen tros comunes, es de 19,69 en los estudiantes preuniversitarios, 20,50 en la población a dulta estratificada y 21,59 en los estudiantes de postgrado. Ello ind ica que a priori , el nivel de estudios parece tener cierta influencia en el léxico disponible que se an alizará con más d etenimiento en el capítulo siguiente. En los estudios de español como lengua extranjera se ha comparado la media de esta investigación en lengua extranjera ya que com o es obvio los resultados en español eran considerab lemente super iores. Los estudiantes fin landeses (Ca rcedo González, 2000c) han aportado una media de 13,68 palabras por centro de interés, los extranjeros qu e r ealizan una estancia en Salamanca (Samper Hernández, 2002) superan esa media con un promedio 15,63 palabras y los españoles del estudio actual, 17,24. Por tanto, el nivel alcanzado en lengua extranjera p or los estudiantes españoles es considerablemente más a lto que en el resto de casos. En inglés , la media de palabras es inferior a los estudios con hablantes na tivos. Para los cen tros presentes en la investigación de Ferreira (2006) se h a recalculado la media de este estudio, 23,19 palabras, mientras que los nativos encuestados por el investigador ch ileno han escrito 27,28. Del mismo modo, los escolares de la investigación de D imitrijevi ć (1969) aportan una media de 20,04 palabras en inglés y, en cambio, la media de los estudiantes de postgrado en ese idioma es de 17,69 palabras. No obstante, cabe r esaltar que el promedio de respuestas de los estudiantes de postgrado españoles es superior al de los estudiantes universitarios chilenos, con un promedio de 23,19 frente a 20,33 p alabras por info rmante y centro de interés. Aunque los informantes en el est udio de Chile n o han acabado la carrera universitaria, todo s cursan estudios relacionado s con el aprendizaje del inglés como lengua extranjera por lo que quizás los resultados deber ían ser más altos. En los casos anteriores, se ha analizado la amplitud lé xica. En cambio, la propuesta de este estudio radica en comparar la media de palabras según el índice corregido de amplitud léxica (ICoAL) ya que tiene en cuenta no solo el númer o d e palabras aportadas por un informante, sino también la relación con el cen tro de Tesis doctoral Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado 282 5.4.3.4 . H ábitos de lectu ra y exposició n a los medios de comunicación en español 5.4.3.5. Motiva ción pa ra impartir clases en ens eñanza bilingüe 5.5. Análisis multivariante 5.5.1 . Análisis de componentes principales (ACP). Reducción de dimensiones 5.5.1.1 . Clase social 5.5.1.2. Motivación para impartir clases bilingües 5.5.1.3. Uso de la lengua en diferentes ámbito s 5.5.2. Análisis de regre sión line al 5.5.2.1. Análisis de regresión lineal del ca udal léxico en lengua extranjera 5.5.2.2. A nálisis de regresión lineal del caudal léxico en español 5.5.2.3. Análisis de regresión lineal del léxico especializado en len gua extranjera 5.5.2.4. Análisis de regresión lineal del léxico especializado en lengua española 5.5.3. Análisis causales 5.5.3.1. Modelo causal de los efectos del hablante sobre el caudal léxico en lengua extranjera 5.5.3.2. Modelo causal de los efectos del hablante sobre el caudal léxico en lengua española 5.5.3.3. Modelo causal de los efectos del h ablante sob re el léxico especializado en lengua extran jera 5.5.3.4. Modelo causal de los efectos del h ablante so bre el léxico especializado en lengua españo la 5.6. Conclusiones parciales Capítul o 5 Anális is socio lingü íst ico 283 5.1. Introducción Según Fernández Fer nández, Cordero Sánchez y Córdoba Largo (2002: 15 - 16) la estadística ha evolucionado desde las primeras civilizaciones, d onde se recogían datos sobre todo con fi nes recaudatorios , hasta nuestros días por medio de las ciencias básicas. Los orígenes de esta disciplina están r elacionados con dos necesidades: reg istrar inform ación y conocer la p robabilidad de éxito en los juegos de azar. Ambos menesteres serán el punto de partida de las dos grandes ramas de la estadística: la descr iptiva y la inferencial. Grosso modo , la estadística descriptiva se encarga de orden ar, presentar y reducir los datos recopilados de una población o muestra. En cambio, la estadística inferencial , también conocida como estadística inductiva o deductiva, se ba sa en la teoría de probabilid ades para hacer predicciones sobre los datos. A lo largo de este capítulo se lleva rán a ca bo indagaciones sobre todo de tipo descriptivo completadas con estudios inferenciales como el Análisis de Anova imprescindibles par a conocer el co mportamiento de distintas variables. De esta forma , se pretende orde nar la información relativa a las variables extralingüísticas y lingüísticas generadas a partir de la s respuestas proporcionadas en las encuestas de disponibilidad léxica, el cuestionario sociológico y la prueba de léxico especializado. Cabe destacar que l a base de datos está formada por m ás de 500 variables que permiten un profundo conocimiento de la muestra de estudio y, por ende, de sus características sociocultur ales, reticulares y académicas, entre otras. Por ello, se han seleccionado aquellos factores que contribuyen a refutar o corrobo rar las hipótesis de la investigación. Antes de inicia r los análisis, se det allan las hipóte sis que marcan la líne a de trabajo y que intentan dar respuesta a los interrogantes del estudio. En un primer estadio, se presen tan las variables a tra vés de análisis univa riantes haciendo referencia al proceso de recogida y codificación de los datos. A continuación, los análisis bivariantes muestran la relación entre dos características de la muestra y ayudan a definir los análisi s po steriores. Por último, lo s análisis multivariantes presentan una Tesis doctoral Evaluac ión de l a competencia léxica bi lingüe en estudiantes del Máster Universitar io en Profe sorado 284 visión multidimensional para explicar la contribución de factores sociales, lingüísticos y relacionados con el aprendizaje de una lengua extranjera sobre el índice corregido de descentral ización léxica (ICoDD) y el índ ice corregido de identificación de tecnicismos (ICIT). 5.2. Hipót esis Se parte de la hipótesis que el comportamiento sociolingüístico y los antecedentes relacionados con el aprendizaje de una lengua inciden en el vocabulario de los informantes. El tipo d e estudios previos, la clase social, los h ábitos de lectura y el uso de la lengua extranjera ayudan a predecir los resultados del léxico d isponible y la capacidad de identificación de tecnicism os. Por una parte, el caudal léxico e s medido a trav és de las pruebas de disponibilidad lé xica en español y en lengua extranjera (inglés o francés), las cuales a portan inf ormación sobre el número de palabras que ha actualizado un hablante en un tiempo determinado y sobre la relación que estab lecen con el centro de interés. Por otra parte, el léxico especializa do se obtiene mediante un ejer cicio que consiste en identificar y relacionar a qué campo léxico correspond en palabras especializadas o técnicas. El objetivo es analizar de forma global el vocab ulario activo y el vocabulario pasivo de un informante sobre nueve centros de interés. La probabilidad de que la influencia de ciertos factores releven mejores resultados en el léxico viene supeditada por la lengua de estudio. Así, se presupone que no tendrá igual relevancia la realización de una estancia en el extranjero en lengua extranjera que en la lengua materna. En español , Ávila Muñoz y Villena Ponsoda (2010) destacaron el papel de las redes sociales y la posición social sobre la capacidad léxica. En cambio, en lengua extran jera los estudios existentes no realizan una profundización tan precisa del conjunto multifactorial que det ermina el léxico disponible y la capacidad d e identificación del léxico especializado. En lengua materna , las hipóte sis apuntan a que el vo cabulario activo y , sobre todo , el vocab ulario pasivo están condicionado s por el nivel de instrucció n. E n este estudio , todo s los informantes son al menos diplomados, licencia dos o ingenieros ya que es uno de los requisitos previos d e acceso al má ster. A pesar de esta aparente Capítul o 5 Anális is socio lingü íst ico 285 homogeneización en el grado de formación de los informantes, esta variable adquiere matices a través de otros factores como la carrera universitaria, la especi alidad del máster y otros estudios com plementarios. Entre las variables con mayor incidencia en el léxico , cabe destacar el conocimiento de idiomas extranjeros . Como se abordó en los fundamentos teóricos , el dominio de más de una lengua aporta agilidad mental y permite establecer conexiones entre una mayor cantidad de unidades léxicas que presum iblemente influye en el mayor ca udal léxico 221 . Por consiguiente, el léxico disponible en esp añol y en len gua extranjera puede m antener una relación d irecta de forma que los informantes que aporten más p alabras en espa ñol reproduzcan ese modelo en lengua extranjera. La lectura contribuye a mejorar el conocimiento receptivo del léxico y , a su vez , ese vocabulario pasivo ayuda al desarrollo de la compren sión lectora. Se da por sentado que los informan tes que leen más tendrán menos dificultades en reconocer las palabr as especializadas y asociarlas co n el centro de interés adecuado. En ca mbio, en el léxico activo esa implicación no será tan plausible ya que la lectur a si bien contribuye a incluir n uevas palabr as en el re pertorio léxico del individuo no conlleva necesariamente al uso de la pa labra ni a incorporarlo al vocabulario activo. La clase social puede influir de forma indirecta en el léxico a través de otras variables como pueden ser el conocimiento de otros idio mas, la re alización de viajes y los háb itos de lectura, entre otros facto res. No obstante, no se con sidera un factor relevante ya que la educación ha servido para superar las barreras soci ales que llevan a estudiantes a presentar un mayor o menor dominio léxico. En este sentido, Bernstein (1971 - 1975) analiza el comportamiento lingüístico de las clases sociales y propone la teoría de los códigos lingüísticos (restringid o y elab orado). El código restringido es utilizado por la clase trabajadora y depende del contex to. En cambio, el código elaborado es universalista y es emp leado por la clase dir igente. E n el ámbito educativo , los modelos tienden a reproducirse de forma que provoca el fracaso escolar de los estudiantes de estratos socioeco nómicos bajo s. De su teoría se deduce 221 P ara una revisión teórica de los fact ores que influyen en el ap rendizaje de u na lengua puede consul tarse el a partado 2. 7. Tesis doctoral Evaluac ión de l a competencia léxica bi lingüe en estudiantes del Máster Universitar io en Profe sorado 286 que la mayoría de estudiantes de clase baja no llegan a finalizar los estudios de postgraduado provocando que la clase social no sea tan relevante en hablantes con un alto nivel de instrucción. En lengua extranjera , la incidencia de los fa ctores puede verse multiplicada debido a que el grado de formación específica en inglés o francés difiere considerablemente de un estudiante a otro. Mientras que todos los informantes han realizado sus estudios universitarios en su totalidad o en parte en lengua española, solo unos cuantos lo han hecho en lengua extranjer a. El nivel exigido en el máster es un B1 del Marco Común Europeo de Referencia para las Lenguas que equivale al nivel que adquieren los estudiantes al finalizar la etapa de Bachillerato. S e produce un agravio comparativo entre los sujetos que prácticamente no ha n co ntinuado con estudios en lengua extranjera desde la etapa preuniversitaria y los informantes que han cursado estudios especial izados en lengua extranjera, han realizado estanci as en el extranjero, están motivados pa ra a prender otras lenguas y, en definitiva, han continuado con su formación lingüística. En este sentido, la especialida d del máster agrupa a los informantes según los estudios previos ya que el sistema de matriculac ión establece cuáles son los títulos universitarios desde los cuales se puede acceder a cada especialidad. En el capítulo anterior , se h a realizado un estudio comparativo general que incluye algunas variables de corte sociolingüístico en com paraciones intram uestrales , como el género . o inter muestrales en las que se se analiza el nivel de instrucción o el lugar de residencia de los informantes. Asimismo, se han analizado los vocablos aportados por cada sociolecto para extraer conclusiones sobre la mayor o meno r importancia de ciertas unidades léxicas en los ho mbres o en las mujeres. Desde el punto de vista de la estadística , el sexo no se ha considerado significa tivo por lo que no forma parte de las hipótesis que se pretenden corroborar ni de los objetivos que se pretenden alcanzar. En cuanto al léxico pasivo, se presupone que la incidencia de las vari ables será menor ya que en es a prueba el informante no tiene que producir ninguna palabra técnica sino simplemente identificarla. Se pod ría decir incluso que alg unas de las unidades léxicas que los informantes son capaces de asociar adecuadamente con el Capítul o 5 Anális is socio lingü íst ico 287 centro de in terés n o for man parte de su léxico activo. Terrel l (1986) distingue dos procesos de transferencia del léxico pasivo al léxico activo: el de ligazón ( bi nding ) y el de acceso a la palabra ( accessing ). Cuando un hablante comienza con el aprendizaj e de una palabra es capaz de comp renderla pero difícilmente puede escribirla o decirla o lo hace tras una reflexión previa. En cambio, a medida que entra en contacto con ese vocablo se vuelve más accesible de manera que pasa a formar parte del vocabulario activo. En este sentido , se puede afirmar que el léxico disponible forma parte del vocabulario activo mientras que el léxico especializado del vocabulario pasivo y , solo en ocasiones , ta mbién del vocabulario activo. De acuerdo con es a hipótesis , las variables sociolingüísticas predisponen en mayor medid a los resultados de la prueba de léxico disponible que los del ejercicio de identificación de tecnicism os. 5.3. Análisis descriptivo univariante y presentaci ón de las variables Según la hipótesis de estudio , se h an llevado a cabo diferentes tipos de análisis que requieren variables exp erimentales de diversa índole: independientes, dependientes e intervinien tes. Las variables ind ependientes representan fa ctores, cualidades o características aptas p ara influir en mayor o m enor medida en otras variables. En cambio, las variables dependientes se ven alteradas p or los valores de otras variables y, por tanto, su presencia en la realidad de un estudio está condicionada por otras variables. Las variables independiente s se representan en el eje de abscisas (X) y las variables depen dientes en el eje de coordinadas (Y). En los análisis de correlaciones influyen tanto en las variables dependientes como independien tes algunas variables denominadas extrañas o interviniente s. Estas variables pueden ser ajenas al objeto de estudio y se simbolizan con la letra Z . El atributo o cualidad al que represent an estas variables suele se r complejo de delimitar y cuantificar pero su pr esencia afecta en mayor o menor grado a otras variab les. At first , a new form is recog niz ed as «something fam iliar» , bu t t he meanin g (or m ore accurately, meanings) may not be recalled. L ater m eaning is slowly recogn ized. Eventually the form is recog nized an d inter prete d within the phonological stream. Binding is complete when the form evoke s the meaning withou t delay and the form final ly « so unds like what is mean s» (Terrell, 198 6: 214). Tesis doctoral Evaluac ión de l a competencia léxica bi lingüe en estudiantes del Máster Universitar io en Profe sorado 288 Siguiendo el ejemplo anterior, la especialidad no es el único factor que influye en el léxico virtual y especia lizado sino que ta mbién intervienen otros como el cansancio y el interés de los alumnos al realizar la prueba. E sos factores, de dificultosa medición , se consideran variables intervinientes en la hipó tesis trazada y, consecuentemente, influyentes en las variables expu estas. El primer paso para realizar una estimación óptima de los resultados pasa por un estudio de sus variables de forma ind ividual que comienza con u na presentación de las variables lingüísticas o dependientes por un lado, y de las variables independientes relacio nadas con a spectos socioculturales y con el ap rendizaje de u na lengua extr anjera , por otro lado. A tra vés del análi sis univariante , se pretende conocer la distribució n y dispersión d e cada variable de forma aislada . Esta fase es indispensable como a proximación a los a nálisis bivariantes y multiv ariantes pre sentados ulteriormente. Cada uno de estos factor es se denomina variable escalar o univariante y el conjunto de las variables dan lugar a una variable vectorial o multivaria nte. Para ello, se codificaron todas las variables de forma numérica y se categorizaron según su na turaleza (ordinales, nom inales y de escala). A continuación, se realizaron análisis descrip tivos que se p resentan de dos formas diferentes: mediante diagramas de sect ores y barras y a través de tablas con datos explorat orios representados en diagramas de cajas que permiten observar de forma gráfica el análisis de las propiedades d e las variables 222 . Por un lado, el diagrama de sectores se ha utilizado p ara comparar las diversas características que presenta una variable m ediante sectores. Por ejemplo, en el caso de la prueba en lengua extranjera, el círculo se h a dividido en do s porciones: una que hace referencia a la lengua inglesa y otra a la lengua francesa. El ángulo central de cada sector es proporcional a la frecuencia absoluta de la lengua y se calcula mediante una regla de tres. Si la m uestra es igua l a 360 º, la frecu encia de esa cualidad será igual a x . 𝑥 = 360 ! ° ⋅ 𝑓𝑖 𝑁 222 Se han faci litado las descripcion es precisas de c ada uno de los de scriptor es p ara ayudar en la com pren sión del capít ulo a l ectores profanos. Capítul o 5 Anális is socio lingü íst ico 289 El diagrama de barra o bastones ha sido empleado en los supuestos en que la cualidad observa da presenta numerosas opcio nes, como es el caso de la ocup ación del padre y de la mad re. Cada barra colocada en el eje de abscisas (X) representa una característica de la variable que muestr a su cuantificación en el eje de orden adas (Y). De esta forma, los valores referent es a la frecuencia absoluta o relativa de cada barra corresponden a la medida expresada en el eje de ordenad as. Por otro lado, los análisis exploratorios permiten dispon er de herramientas de medición más precisas donde los resultados se represen tan mediante los siguient es parámetros: − Medidas de tenden cia central que mu estran mediante d iferentes fórmulas la localización de los datos. C oncretamente se analizará la media, la med iana y la media reco rtada al 5 %. La m edia , también con ocida como media aritm ética o promedio es tándar de los resultad os de una m uestra ( 𝑥 ), se ca lcula sumando todos los va lores de un conjunto ( ∑ x) y dividiéndolo por el número de casos o, en este caso, informantes ( 𝑥 = ! ! ) . − La m ediana calcula el valor central de la variable dejando el mismo número de casos por encima y por d ebajo . En el caso de las lenguas qu e habla un inform ante, si las posibilidades son 1, 2, 3, 4 y 5, la mediana será el número 3. En cambio, si el número de posibilidades fuese par, 1, 2, 3 y 4 la mediana será igual a l valor situado entre 2 y 3, es decir, 2,5. L a fórmula para calcular la mediana o K , entendido como el valor de la po sición de la p untuación en la distribución es la siguiente: 𝐾 = ! ! ! ! En cambio, la expresió n matemática es diferente en los casos en que las distribuciones se e ncuentran agrupadas en i ntervalos, siendo la que sigue 223 : 𝑀𝑑 = 𝐿𝑚𝑑 + 1 2 𝑁 − 𝑎𝑐𝑢𝑚 ! 𝑓𝑚𝑑 𝑓𝑚𝑑 . 𝑊 223 Fórmula extraí da de García Ferrando (1989: 90). L md se refiere al límite inferior del intervalo; N al número total de la m ue stra, acum f md es la frecuencia acumulada por debajo de la frecuencia del intervalo que presenta la medi a y W es l a distancia de la categoría que contiene l a mediana. Tesis doctoral Evaluac ión de l a competencia léxica bi lingüe en estudiantes del Máster Universitar io en Profe sorado 290 − La media recortada al 5 % es un tipo de promedio aritmético que se calcula eliminando el 5 % de los datos más bajos y más altos y, posteriorme nte, calculando la media con lo s valore s restantes. a) Medidas de dispersión que presentan el grado de variabilidad de los valores con respecto a la media por medio de la varianza, la desviación típica, los errores típicos, el mínimo, el m áximo, el rango y el rango in tercuartílico. − La varianza ( 𝜎 ! ) de una variable mu estra la esperanza del cu adrado de la desviación de esa variabl e en torno a su promedio. 𝜎 ! = ( 𝑥 ! ! 𝑥 ) ! ! ! ! ! 𝑛 − 1 − La desviació n típica o desviación estándar ( 𝜎 o s) es una medida de dispersión alternativa y corresponde a la raíz cuadrada positiva de la varianza y muestra la variación esperada respecto a la media. 𝜎 = ( 𝑥 ! − 𝑥 ! ! ! ! ) ! 𝑛 − 1 − El rango o recorrido interarticular (R) es la diferencia entre el valor máximo y mínimo de la muestra , es decir, entre el mayor y menor d ato de la variable. − La amplitud intercuartil o rango intercuartílico representa la diferencia entre el primer y tercer cuartil de una media. En general, cuanto menores sean los datos resultantes de las medidas de dispersión mayor será la homogeneidad de la muestra. b) Las medidas de la forma de la distribuci ón muestran si los valores se separan o aglomeran según su representación gráfica. Estas medidas describen la manera en que lo s d atos tienden a r eunirse de acuerdo con la frecuen cia con que se hallen dentro de la in formación. A través de la asimetría, la cur tosis y sus errores típicos es posible conocer las características de la distribución sin tener que recurrir a su gráfico. − La asimetría refleja si los datos se distribuyen de forma uniforme alrededor del punto central, es decir, de la media. La asimetría presenta tres estados Capítul o 5 Anális is socio lingü íst ico 291 diferentes según la distribución de los datos con respecto al eje de asimetría: positiva si la mayoría de los valores superan la media aritmética, negativa si esos datos son in feriores a la media y simétrica si los datos se aglomera n de la misma forma por encima y por de bajo de la media. − La curtosis describe el grado en que las proporciones observadas difieren con respecto a la distribución norm al representada a través de la conocida campana de Gauss. Al igual que la asimetría, se distinguen tres tipos de curtosis: m esocúrtica, cua ndo p resenta una distribució n norm al que se considera que oscila entre más y meno s 0,5; leptocúrtica , cuando la mayoría de los valo res se concentran en la región cen tral de la distribuc ión dando lugar a una curtosis postivia ; y platicúrtica en el caso contrar io, es decir, cuand o la curtosis es negativa y los valores presenta n una baja concentración . c) El intervalo de confianza estima la probabilidad de que un número apa rezca en un rango d e valores. El nivel d e confianza muestra la probabilidad que el valor se encuentre en el parámetro fijado mientras que el nivel de significación o error aleatorio muestra la posibilidad de fallar en el cálculo estimatorio. El intervalo u tilizado en los análisis ha sido del 95 % y, por ende, el ni vel de significación es del 5 %. Cuanto mayor sea el rango o intervalo de confianza más preciso es el resultado y viceversa, es decir, cuanto menor sea el intervalo de confianza y mayor la significación mayores son las posibilidades d e error. Los resultados exploratorios se presentan de forma gráfica mediante un diagrama de cajas que , median te rectángulos , aglomeran los datos entre los cuartiles primero y tercero, es decir entre el 25 % y e l 75 % de los datos. El cuadro se encuentra dividido por la mediana que muestra la simetría de lo s datos ya que cuanto más centrada se encuen tre en la caja más simétrica será la variable. Las líneas verticales que sobresalen por los laterales superior e in ferior de la caja, conocidas como bigotes, muestran los valores máximos y mínimos de la muestra. Los outliers o valores atípicos son identificados fuera de la caja co n referencia al número de informante para po der extraer las conclusiones pertin entes. Tesis doctoral Evaluac ión de l a competencia léxica bi lingüe en estudiantes del Máster Universitar io en Profe sorado 298 análisis estadístico es el nivel de estudios alcanzado ya que a su vez da cuenta de los años académicos cursados por los padres del inform ante. Los estudios de los padres es un componente que forma pa rte de la variable del nivel sociocultural incluida en la mayoría las investi gaciones herederas del Proyecto Panhispáni co ya que la repercusión sobre el léxico disp onible s uele ser significativa: El Gráfico 5.3 muestra el nivel de estudios alcanzados por el padre y la madre. Como se observa, el sexo masculino ha logr ado un nivel de estudios superior que el femenino en líneas generales. Los padres con máster o doctorado alcanzan un 2,35 % y con una licenciatura 18,82 % mientras que las madres con doctorado apenas llegan al 0,59 % y al 12,35 % con licenciatura. Gráfi co 5.3 . Diagrama de b arras de los estudios de lo s padres 5.3.2.3. Ocupación de los padres e ingresos La codificación de las profesiones se realizó siguiendo las pautas marcadas en el Real Decreto 1591/2010, de 26 de noviembre, por el que se aprueba la Clasificac ión Nacional de Ocupaciones 2011. Esta supone la última revisión en el Los listados de léxico disponi ble aportan también interes antes dato s sobre la influ encia de las va riable s soc iales en el d om inio lé xico de lo s inf orm antes. En gene ral, p odem os decir que la variab le que más influ encia parece tene r s obre el domini o léxico es el niv el cultur al de la familia, m ás qu e la variable sexo, o la pertenen cia a un am biente urban o o ru ral. La comparación entre las disti ntas variantes de una v ariable n os informa de la diferente integr ación de alg unas palab ras en la socied ad (B artol H ern ánd ez, 201 0: 103 ). [Document text truncated for crawler view.]