Full text
U NIVE RSI DAD DE M ÁLAGA
F ACULTAD DE C IENCIAS DE LA E DUCACIÓN
T ESIS DOCTORA L
Evaluación de la competencia léxica bilingüe en
estudiantes del Máster Universitario en Profesorado
Análi si s de pruebas de disponi bili dad léxi ca y de ide ntifi cación de
tecnicism os en esp añol, in glés y fran cés
Doctora nd a: Inmaculada Clotilde Santos Díaz
Direct ores: Juan Andrés Vill ena Pon soda y Antoni o Manue l Ávil a Muñoz
P rograma Oficial de Postgrado en Políticas Educativas
Málaga, 2015
AUTOR: Inmaculada Clotilde San tos Díaz
EDITA: Publicaciones y Divulg ación Científi ca. Universid ad de Málag a
Esta obra está sujeta a un a licencia Cr eative Commo ns:
Reconoc imiento - No comercial - SinObr aDerivada ( cc - by - nc - nd):
Http://creati vecommons.o rg/li cences/by - nc - nd/3.0/es
Cualquie r parte de est a obra s e puede r eproducir s in autor izac ión
pero con e l reconoc imie nto y atribuc ión de los a utores.
No se puede h acer uso comerci al de la ob ra y no se pu ede alterar, tran sformar o hacer
obras deri vadas.
Esta Tesis Do ctoral está dep ositada en el Repositor io Institu cional de la Uni versidad de
Málaga (RIU MA): riuma.u ma.es
A mis padre s, que con su amor me dieron la vida
A mi marido, que con su amor me alegra l a vida
A las personas a las que dedico los agradecimientos
Agradecimientos
El interés por la lingüística unida a mi vocación docente, me llevaron a
delimitar el tema de esta tesis doctoral en el curso 2010/2011. Durante estos años,
numerosas personas han contribui do de diversa forma en la re alización de este
trabajo. En primer lugar, cabe mencionar el asesora miento de mis dos directores de
tesis, Juan Andrés Villena Ponsoda y Antonio Áv ila Muñoz. Ambos m e han
orientado con sabiduría y han desempeñado un papel relevante en el presente
estudio . Por un lad o, Juan me ha guiado por el a pasionante y complejo mundo d e la
estadística donde he ido aprendido los conceptos y operaciones principales. Por otro
lado, An tonio me abrió el camino en este campo de investigación hace casi 10 años
cuando estudiaba la licenciatura en Traducción e Interpretación.
Al igual que la d isponib ilidad léxica, esta tesis ha viajado a los dos lados del
Atlántico . En Holanda , me acogió el profesor Frans Hinkens durante una estancia en
la que tuve la oportu nidad de conocer el centro de inv estigación, M eertens Instituut.
En Chile, la profesora Natalia Castillo Fad i ć me brindó su inestimabl e ayuda y cariño
y me dio un gran impuls o para acabar la tesis. Además, tuve la suerte de conocer a
Alejandro Troncoso y a Roberto Ferreira y de poder realizarles consultas académicas.
Los datos del estudio ha n sido recabado gracias a la coordinación del
profesorado del Máster Universita rio en Profesor ado y de la disponibilidad d e su
alumnado. Espero poder con los resultados de este estudio apli car e l princip io de
gratitud de Wolfram (1993) y devolver ese favor lingüístico.
Asimismo, quisiera expresar mi gratitud a todas las personas presentes en la
bibliografía porque han aportado su granito de arena en la confección de esta tesis.
En este sentido , agradezco el trabajo de los usuarios que cuelgan de forma anó nima y
desinteresada vídeos tutoriales y que tanto m e han enseñado de estadística.
Por último , y no por ello menos importante, quisiera dar las gracias a mi
familia ( Santos Díaz y Conejo Sobrino), amigos y compañeros de trabajo que me han
apoyado durante to do este tiempo y me han alentado en los momentos más difíciles.
M i mayor fortuna es pod er contar con cada uno de ellos.
Gracias a todos por h acer posible que esta ilusión se haga realidad.
Índice
1
RÉSUMÉ ............................................................................................................ 5 !
Chapitre 1. Introduction ............................................................................................ 7 !
Chapitre 2. Cadre théorique ...................................................................................... 9 !
Chapitre 3. Cadre méthodologique ......................................................................... 11 !
Chapitre 4. Analyse générale ................................................................................... 13 !
Chapitre 5. Analyse sociolinguistique ..................................................................... 17 !
Chapitre 6. Proposition didactique ......................................................................... 20 !
Chapitre 7. Conclusions .......................................................................................... 22 !
CAPÍTULO 1. ! INTRODUCCIÓN ............................................................... 27 !
CAPÍTULO 2. ! MARCO TEÓRICO ............................................................. 43 !
2.1. ! Introducción ................................................................................................... 47 !
2.2. ! Orígenes de la disponibilidad léxica ............................................................. 47 !
2.3. ! Principios epistemológicos y conceptuales de la disponibilidad léxica ....... 57 !
2.4. ! Investigaciones relacionadas con el léxico disponible .................................. 76 !
2.4.1. ! En español como lengua materna ........................................................................... 77 !
2.4.2. ! En inglés como lengua extranjera ............................................................................ 97 !
2.5. ! Revisión del modelo matemático ................................................................ 101 !
2.5.1. ! Cálculo del índice de disponibilidad léxica ........................................................... 101 !
2.5.2. ! Índice de compatibilidad léxica y selección del léxico nuclear .......................... 111 !
2.5.3. ! Índice corregido de amplitud léxica ...................................................................... 116 !
2.5.4. ! Índice corregido de descentralización léxica ........................................................ 118 !
2.5.5. ! Índice corregido de identificación de tecnicismos ................................ .............. 119 !
2.6. ! Aplicaciones de la disponibilidad léxica ..................................................... 123 !
2.7. ! Variables que inciden en el léxico disponible ............................................. 129 !
2.7.1. ! Sexo ............................................................................................................................ 132 !
2.7.2. ! Estancias en el extranjero ....................................................................................... 133 !
2.7.3. ! Conocimiento de idiomas ....................................................................................... 137 !
2.7.4. ! Corrección orto gráfica ............................................................................................ 143 !
2.7.5. ! Clase social ................................................................................................ ................ 145 !
2.7.6. ! Hábitos de lectura y exposición a los medios de comunicación ....................... 146 !
2.7.7. ! Contacto y uso de la lengua extranjera en diferentes contextos ....................... 147 !
2.8. ! Conclusiones parciales ................................................................................. 150 !
CAPÍTULO 3. ! MARCO METODOLÓGICO ............................................. 153 !
3.1. ! Introducción ................................................................................................ . 157 !
3.2. ! Naturaleza y método de la investigación .................................................... 158 !
3.3. ! Selección de la muestra ................................................................................ 162 !
3.3.1. ! Tamaño de la muestra ............................................................................................. 163 !
3.3.2. ! Acceso a los informantes ................................................................ ........................ 166 !
3.3.3. ! Requisitos de acceso al Máster Universitario en Profesorado .......................... 168 !
3.3.4. ! Programa de estudios .............................................................................................. 170 !
3.4. ! Sistema de recogida de los datos ................................................................ . 173 !
3.4.1. ! Encuesta sociológica ................................................................ ................................ 174 !
3.4.2. ! Prueba de disponibilidad ......................................................................................... 177 !
3.4.3. ! Prueba del léxico especializado .............................................................................. 180 !
3.5. ! Edición y codificación de los datos ............................................................. 181 !
3.5.1. ! Encuesta sociológica ................................................................ ................................ 182 !
3.5.2. ! Prueba de disponibilidad ......................................................................................... 184 !
ÍNDICE
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
2
3.5.3. ! Prueba del léxico especializado .............................................................................. 204 !
3.6. ! Conclusiones parciales ................................................................................. 205 !
CAPÍTULO 4. ! ANÁLISIS GENERAL ........................................................ 209 !
4.1. ! Introducción ................................................................ ................................ . 213 !
4.2. ! Análisis cuantitativo de palabras y vocablos ................................................ 214 !
4.2.1. ! Palabras y vocablos en español .............................................................................. 214 !
4.2.2. ! Palabras y vocablos en lengua extranjera ............................................................. 217 !
4.2.3. ! Palabras y vocablos en lengua inglesa ................................................................... 219 !
4.2.4. ! Palabras y vocablos en lengua francesa ................................................................ 221 !
4.3. ! Índice de densidad léxica e índice de cohesión .......................................... 223 !
4.3.1. ! Índice de densidad léxica e índice de cohesión en español ............................... 224 !
4.3.2. ! Índice de densidad léxica e índice de cohesión en inglés .................................. 226 !
4.3.3. ! Índice de densidad léxica e índice de cohesión en francés ................................ 227 !
4.4. ! Promedio de palabras ................................................................................... 227 !
4.4.1. ! Comparación intramuestral .................................................................................... 228 !
4.4.2. ! Comparación intermuestral .................................................................................... 233 !
4.5. ! Análisis de los vocablos con mayor índice de disponibilidad ..................... 237 !
4.5.1. ! Comparación intramuestral .................................................................................... 238 !
4.5.2. ! Comparación intermuestral .................................................................................... 242 !
4.6. ! La situación ortográfica ............................................................................... 253 !
4.6.1. ! Resultados del estudio actual ................................................................................. 253 !
4.6.2. ! Resultados comparativos intermuestrales ............................................................ 261 !
4.7. ! Incidencia de la variable ‘sexo’ en el léxico disponible ............................... 264 !
4.7.1. ! Centro 2: La ropa ...................................................................................................... 269 !
4.7.2. ! Centro 3: Comidas y bebidas ...................................................................................... 270 !
4.7.3. ! Centro 4: La escuela: muebles y materiales ................................................................ .. 272 !
4.8. ! Conclusiones parciales ................................................................................. 274 !
CAPÍTULO 5. ! ANÁLISIS S OCIOLINGÜÍSTICO ..................................... 279 !
5.1. ! Introducción ................................................................ ................................ . 283 !
5.2. ! Hipótesis ...................................................................................................... 284 !
5.3. ! Análisis descriptivo univariante y presentación de las variables ................. 287 !
5.3.1. ! Variables lingüísticas ............................................................................................... 292 !
5.3.2. ! Variables sociodemográficas y reticulares ............................................................ 295 !
5.3.3. ! Variables relacionadas con el dominio de una lengua ....................................... 301 !
5.3.4. ! Resumen de las variables ........................................................................................ 309 !
5.4. ! Análisis bivariante ........................................................................................ 311 !
5.4.1. ! Relaciones entre variables lingüísticas .................................................................. 312 !
5.4.2. ! Efecto de las variables socioculturales ................................................................ . 320 !
5.4.3. ! Efecto de las variables relacionadas con el dominio de una lengua ................. 324 !
5.5. ! Análisis multivariante .................................................................................. 346 !
5.5.1. ! Análisis de componentes principales (ACP). Reducción de dimensiones ..... 347 !
5.5.2. ! Análisis de regresión lineal ..................................................................................... 356 !
5.5.3. ! Análisis causales ...................................................................................................... 379 !
5.6. ! Conclusiones parciales ................................................................................. 393 !
CAPÍTULO 6. ! SELECCIÓN DEL LÉXICO Y PROPUE STA
METODOLÓGICA ........................................................................................ 397 !
6.1. ! Introducción ................................................................ ................................ . 401 !
6.2. ! Organización de la memoria semá ntica ...................................................... 402 !
Índice
3
6.3. ! La teoría de los prototipos en los estudios de disponibilidad léxica ........... 406 !
6.4. ! Procesos de reentrada del léxico .................................................................. 412 !
6.4.1. ! Modelos de reentrada según la ontogenia de los centros de interés ................ 417 !
6.4.2. ! Modelo de reentrada de los centros de interés prototípicos ............................. 427 !
6.4.3. ! Modelo de reentrada de los centros de interés relacionales .............................. 440 !
!
6.4. 4 . ! Ejemplo de clasificación del centro de interés Ordenadores e internet según los
procesos de reentrada ............................................................................................................ 446 !
6.5. ! Análisis de las relaciones semánticas a través del DispoGrafo ................... 452 !
6.5.1. ! Análisis de las relaciones semánticas según el centro de interés ....................... 453 !
6.5.2. ! Organización del léxico según el idioma .............................................................. 458 !
6.6. ! Hacia una propuesta didáctica .................................................................... 471 !
6.6.1. ! Selección léxica según diferentes criterios de corte ............................................ 473 !
6.6.2. ! Los aspectos socioculturales en el léxico disponible .......................................... 480 !
6.6.3. ! El léxico nuclear y el nivel según el Marco Común Europeo de Referencia para
las Lenguas .............................................................................................................................. 483 !
6.6.4. ! Léxico nuclear en el Plan Curricular del Instituto Cervantes ............................ 494 !
6.6.5. ! Propuesta didáctica .................................................................................................. 498 !
6.7. ! Conclusiones parciales ................................................................................. 501 !
CAPÍTULO 7. ! CONCLUSIONES .............................................................. 509 !
7.1. ! Conclusiones ................................................................................................ 513 !
7.1.1. ! Ámbito de la sociolingüística ................................................................................. 513 !
7.1.2. ! Ámbito de la psicolingüística ................................................................................. 523 !
7.1.3. ! Ámbito de la lingüística aplicada a la enseñanza de idiomas ............................. 529 !
7.1.4. ! Propuestas y líneas de investigación futuras ........................................................ 531 !
7.2. ! Conclusions .................................................................................................. 537 !
7.2.1. ! Cadre de la sociolinguistique ................................................................ .................. 537 !
7.2.2. ! Cadre de la pycholinguistique ................................ ................................................ 547 !
7.2.3. ! Domaine de la linguistique appliquée à l'enseignement des langues ................ 552 !
7.2.4. ! Propositions et lignes de recherche futures ......................................................... 554 !
BIBLIOGRAFÍA ............................................................................................. 561 !
ANEXOS ......................................................................................................... 613 !
Anexo I. Cuadro resumen de los objetivos, hipótesis y resultados de la tesis
doctoral .................................................................................................................. 615 !
Anexo II. Índice de gráficos, grafos y tablas ........................................................ 619 !
Anexo III. Documento de negociación ................................................................ 629 !
Anexo IV. Cuestionario sociológico y reticular .................................................... 633 !
Anexo V. Pruebas de identificación de léxico especializado: español, ing lés y
francés .................................................................................................................... 641 !
Anexo VI. Índice de siglas y abreviaturas ........................................................... 645 !
Anexo VI I . Clasificación de errores ortográficos en español, inglés y francés ...... 647 !
Anexo VIII. Selección de vocablos nucleares en español, inglés y francés .......... 653 !
Anexo IX. Diccionarios de disponibilidad léxica en español, inglés y francés .... 663 !
Tesis doctoral
Evaluac ión d e la compet enci a léxica bilingüe e n estudian tes del Má ster Univ ersitario en Profesor ado
10
espagnole afin de ré aliser des comparaisons dialectique s, sociolinguistiques,
ethnolinguistiques, entre autres.
L’édition des données des é preuves de disponibilité lexicale est cruciale pour
les an alyses menées , surtout si l’intérêt réside dans la comparaison avec d ’au tres listes
de mots. Samper Padilla (1998) établi la série de règles et de critères communs qui
seront secondés par de nombreuses études, en pa rticulier celles qui font p artie du
Pan hispánico. Néanmoins, il y a des cher cheurs qui plaident l’inclusion de tous les
mots écrits par les locuteurs afin de co nn aître réellement le lexique disp onible
( Benítez Pérez, 1992b ; Mateo García, 1998 ; G alloso Camacho, 2002; Hernández
Muñoz, 2004 ; Ávila Muñoz, 2006 ; Ávila Muño z et Villena Ponsoda , 2010, 2011 ;
etc.).
Dans ce sens, il est essentiel de connaître les r echerches préalable s sur le
lexique disponible : plus particu lièrement des recherches sur le lexique en esp agnol
comme langue maternelle et anglais et fra nçais comme langue étrangère. Dans le
domaine hispa n ique, les enquêtes naissent du travail con stant de López M orales qui
publie en 1999 le lex iq ue disponible de Porto Rico. E n suite, les études commencent à
apparaître en Amérique Hispani que co mme en Espagne sur le lexique espagnol
comme langue maternelle. R écemment, les études d’espagnol comme la ngue
étrangère ou seconde langue , dans des pays hispanophones ou non , ont pris de
l’importance : Carcedo Gon zález (2000 c ) en Finlande ; M o reno Fernández (2003)
aux Etats - Unis ; González Fernández (2013) en Turquie, L ópez González (2009) en
Pologne, B ianca Sandu (2014) en Roumanie ; entre autres.
Le traitement mathématique des donné e s fera l’ objet de révision s où l’ on
exposera les principaux indices et les facteurs qu i interviennent dans leu r calcul. Il
existe un con sensus quasi généralisé pour calculer l’in dice de disponibilité à travers de
la formule de Strassbu rger et Chávez (1987) et l’indice de cohésion par le biais de
l’équation proposée par Echeverría (1991). En outr e, d’autr es chercheurs, comm e
Ávila Muñoz et Villena Ponsoda (2010) complètent leurs analyses avec l’uti lisa tion
d’autres ind ices, tel que l’indice de compatibilité ou l’indice de décentralisation qui
marquent le degré de res semblance du lexique écrit par u n informate ur par rapport au
reste des sujet s. C ependant, García García (2014) réalise une r évision mathématique
Résumé
11
où il modifie l’ind ice de disponibilité, l’indice de comp atibilité et l’indice de
décentralisation . Il facilite aussi le calcul de ces indices à travers du programme SPSS.
Avant, l e calcul de l’indice de dispo nibilité et l’obtention des listes du lexique
disponible se réalisait seulement avec un programme spécifique. Les applications les
p lus utilisées sont Lexidisp ( Moreno Fernánd ez, Moreno Fernández et García de las
Heras, 199 5), Dispol ex (Bartol Herná ndez et Hernández M uñoz, 2004) et Dispogen
(Echeverría Weasson, Urzúa Carmona, Figueroa, 2005) .
Une fois abordés les aspects théoriques et méth odologiques, on a inclus les
applications de la disponibilité dans plusieurs disciplines en mettant l’accent sur la
linguistique appliq uée à l’enseignem ent des lan gues. Le lexiq ue qui en résulte fait
l’ objet de nombreuses analyses d e différents domaines. Du point de vu e de
l’ethn olinguistique, la d isponibilité permet de connaîtr e la situa tion concrète d’une
société à un momen t précis ; d’après la sociolinguistique il est possible d’analyser
l’incidence de s facteurs sociaux dans le lexiqu e à travers de variables so ciales ; d’après
la dialectologie on peut comp arer les différentes syntopies d’une langu e ; d ’après la
linguistique appliquée à l’enseignement des langues , il suppose être un outil très
efficace po ur la sélection du lexique ; et la psycho linguistique offre l’op portunité de
connaître l’organisation d es m ots dans l’esprit.
Pour compléter ce chapitre, en suivent des rech erches qui mettent l’accent sur
les facteurs qui incident sur le lexique disponible en langue maternelle et en langue
étrangère et qui seront analysés dans les chapitres suivants. Parmi ces variables, il faut
souligner celles présentes dans la plupart des études, le sexe et la classe social ;
d’autres rélévantes dans le lexique disponible en langue étrangère, la connaissance de
langues et le niveau de compétence linguistique ; variables p eu étudiée s, le nombre de
livres et l’exposé aux moyens de communication et les fautes d’ortographe; et
d’autres nouvelles dans ce do maine, les séjours à l’étranger.
Chapitre 3. Cadr e métho dologique
Le but de ce chapitre est d e présenter et de délimiter les fondements et
méthode s suivis pour mener à bien cette étude . Une des premières décisions d ans
toutes les recherches est la délimitation de la population : universitaires de troisième
Tesis doctoral
Evaluac ión d e la compet enci a léxica bilingüe e n estudian tes del Má ster Univ ersitario en Profesor ado
12
cycle qui étudient le Master en Professor at. De cette façon, il est possible de réaliser
une évaluation lexicale des futurs profe sseurs. L’accès aux personnes sondées s’est
réalisé par le biais d’un do cument de négociation qui a été préalablement distribu é
aux ag en ts im pliqués. O n leur a communiq ué l es objectifs de la recherche et ses
caractéristiques. E n outre, on a r emarqué la confidentialité des don nées et on a
facilité les coordonnées de la candidate au doctorat aux professeurs et a ux élèves
dans le cas où ils solicitent des référence s complémenta ire s .
L ’échantillon de l’étude se repla ce dan s son co ntexte puisqu’il est détermina nt
dans une recherche qui, entre autres , vise à servir d’analyse du lexique disponible du
futur professorat. Pour ce faire, on montre le cadre normatif où se s itue la formation
initiale des professeurs et les conditions requises à l ’accès au Master en Professorat.
Co m me couronneme nt, on spécifie le plan d’ét udes que suivent les son dés qui font
partie de l’univers d’étude à l’Université de Malaga.
Le travail de s enseignants dans l’implantation du plan du plurilinguisme est
crucial ainsi que leur form ation initiale 2 . Le professorat de l’école primaire doit avoir
obtenu le diplôme professionnel de professeur des écoles (DPPE). Cependan t, les
professeurs d’enseigne ment secondaire et de form ation professionnelle doivent
certi fier la r éalisation d’une maîtrise et le Master Universitaire en Professorat de
l'Enseignement Second aire Obligatoire, Bacca lauréat, Formation Professionnelle et
Enseignemen t des Lang ues 3 . Ce m a s ter substitue le Certificat d’Ap titude
P édago gique en vigueur jusqu’en 2008/2009 et où il n’était pas nécessaire
l’accréditation d’un niveau B1 en lan gue étrangère.
Ensuite, on détai lle l’élaboration des documents pour obtenir l’information.
Les données e xtralinguistiques se sont recueilli e s à travers d’un questionn aire avec
des questions sociolog iques, réticulaires et liées aux procédés d’a cquisition et
apprentissage de la langue étrangère du sujet. L’information linguistique provient des
é preuves de disponibilité lexicale et d ’un test d’identification de m ots techniques. Les
centres d’in térêt en espagnol et en langue étran gère (anglais ou français) sont n euf :
2 Il faut signaler que dans le s années 2013/2014 et 2014/2015 les bo urses d ’accès au travail d’enseignants
biling ues se sont ouvertes au per sonnel intérim aire puisqu’il n’y avait pa s assez de professeurs avec
l’accréd itation d’u n nive au B2 e n angla is, frança is et a l lem and.
3 Traduct ion d e la dénomi nation donnée au ma st er à l’ Univ ers it é de Mala ga.
Résumé
13
huit correspondent aux centres traditionnels 4 présents dans l’étude de Gougenheim et
al. (1964) et un centre de nouvelle incorporation, Ordinateurs et internet .
Une fois les données compilées , on a réalisé un plan de codification po ur le
questionnaire sociologique où on attribue une valeur numérique à chaque réponse qui
s’incorpore à une base de données. Pour l’édition du lexique disponible, on a suivi les
recommandations d e Samper Padilla (1998) soutenues pa r la plupart des travaux
héritiers du Panhispánico. En plus, on a introduit de s cr itères pr opres , tels que
l’incorporation aux listes des nom bres propres et les associat ion s indiv iduelle s qui
permettent de réaliser des analyses sur la relation entre les mots plus fidèles . Les
particularités de l’édition se so nt présentées en détail selon la langue et le centre
d’intérêt en question pour justifi er les critères établis et orienter les futur s chercheurs.
Quant à l’épreuve d’identification du lexique sp écialisé, les réponses se sont classifiées
e n correctes, incorrectes et non répond ues 5 .
En synthèse, cette étude se sert de la méthodologie de bas e des recherch es de
disponibilité qui tournent autour du Panhispánico (épreuve de deux minute s sur un
centre d’intér êt, système de listes ouvertes, etc.) m ais elle incorpore aussi des progrès
méthodologi ques, tel que l’épreuve d’identificat ion du lexiqu e s pécialisé créée par
Ávila Muñoz y Villena Ponsoda (2010) ou l’utilisati on du programme Di spoGrafo
(Echeverría, Urzúa et Ferreira , 2008). En plus, on incorpore un échantillon original
sur lequel on évalue le lexique en langue matern elle et en lan gue étrangè re. Comme
signale Moreno Fer nández (1990: 38) 6 , la seule fa çon de faire des progrès est à travers
l’union de la tradition et or iginalité.
Chapitre 4. Anal yse généra le
Les analyses suivant e s montrent les donn ées générales liées à l’ épreuve de
disponibilité lexicale : nombre total de mots par épreuve et par centre d’intérêt,
4 1) Les parti es du corps humain ; 2) Les vêteme nts ; 3) La nourrit ure et les bois sons ; 4) L’école (meub les et matérie l) ; 5) La
ville ; 6) Moyen s de t ran sp ort ; 7) Jeux et loisirs ; 8) P rofessions et métiers .
5 Le procédé mat héma ti que de ce tes t ainsi que l’épreuve du lexique disponible trouvent leurs fondements dan s
la section 2.5 et se metten t en pratique sous la forme d’analyses dans le s chapitr es 4, 5, et 6.
6 «S ólo así la comparación es posible, sólo así los pasos de una persona pueden ser de plena utilidad para otra,
porque los avances se consigue n a mitad de camino entre la tradició n y la origin alidad» (Mor eno Ferná ndez,
1990 : 38).
Tesis doctoral
Evaluac ión d e la compet enci a léxica bilingüe e n estudian tes del Má ster Univ ersitario en Profesor ado
14
nombre de vocable s , indice de cohésion et densité lexique. D’une part, on ana lyse le
lexique en langue espagnole et en langue étrangère des futur s professeur s et, d’autre
pa rt, on compare le lexique en langue espagnole de l’étude actuelle avec de
recherches préalables.
D’abord, on présente l’analyse du nombre de mots et vocable s qui se
complète à traver s la comparaison de la moyenne des unités lexicale s de cette étude
par r apport à des recherches antérieures. La la ngue m aternelle des sondés résulte être
la p lus pro ductive q uant a u no mbre de mots et vocable s . En espag nol, les sujets ont
écrit un e mo yenne de 191,91 mots, en anglais 131,79 et en français 147,71. En ce qui
conce rne les vocable s , en espagnol o n r egistre une mo yenne de 20,93, en anglais de
13,77 et en français de 5,82. Ces données si différentes s’expliquent par ce que le
nombre de vocable s est influencé p ar le nombre d’ informateurs : 17 1 en espagnol,
150 en anglais y 21 en français.
La comparaison des résultats avec d’autres études réalisées à Malaga,
particulièrement sur un échantillon d ’étudiants de baccalauréat (Ávila Muño z, 2006)
et de population adulte (Ávila Muñoz et Villena Ponsoda, 2010), m ontre la plus
gr ande productivité des universitaires de troisième cycle. La moyenne des mots par
centre d’intérêt calculée sur les huit cen tres en comm un, est de 19,69 ch ez les
étudiants de baccalauréat, 20,50 de la population adulte stratifiée et 21,59 des
étudiants universitaires de tro isième cycle. A priori , le niveau de formation paraît avoir
une certaine influence sur le lexique disponible. Dans les études de disponibilité
lexicale en la ngue étrangère, on corrobore aussi l’hypothèse que la capacité lexica le en
langue maternelle est supérieur e à la langue étrangère.
En second lieu, on présente les résultat s de l’indice de densité lexicale et
l’indice de cohésion. Dans ce cas, on ne réalise pas de comparaison avec d ’autres
études parce qu’il s’agit d e deux indices directement liés a u nombre de sujets. On
constate l’existence d’une tend ance commun e dans les trois langues de façon qu’il y
a it des centres dont le s rangs se répètent selon leur indic e d e cohésion et densité
lexicale . Le centre le plus adhér é est le premier, Parties du corps humain , dans les trois
langues tandis que les plus hétérogènes sont Jeux et loisirs et Ordinateu rs et internet . Si
l’on comp are le classement d’autres étu des, comme celle d’Ávila Muñoz et Villena
Résumé
15
Ponsoda (2010), o n observe que le centre le plus homogène est le premier. C’est
pourquoi dans le chapitre 6, on présent en p rofondeur la structure interne d es centres
d’intérêt se basant sur le fait que le type de centre cond itionne les réponses d es sujets.
En troisième lieu, on centre l’attention sur les vocabl es les plus disponibles
afin d’ana lyser la différence entre différents échantillons et entre le lexique a pporté en
langue matern elle et en langue étran gère des infor mateurs. On a consta té l’hypothèse
qui présuppose une majeur e similitude dans les études d’une langue étrangère par
rapport aux études en langue m aternelle. D ’une part, l’usage et le contexte
d’apprentissage influencent directement sur le lexique disponible. De cette façon,
parm i les vo cable s les plus disponibles en langue maternelle en on trouve quatre liés
aux sous - vêtements tandis qu’en langue étrangère , ceux - ci ont été écr it seulemen t une
ou deux fois. Ce type de vêtemen ts est utilisé to us les jours mais n’apparaît pas si
fré quemment dans les m anuels d’anglais, français ou d’ espagnol comme langue
étrangère. D’autre par t , l’espace temporel de récolte des données montre la
diachronie de la langue et conditionne le vocabulaire plus disponible. Pour cette
raison, dans l’étude pion nière de Gougenheim et al. (1964) apparaissent des vocable s
te l s que combina ison qui ne seraient pas disponibles de nos jours parce que l’on a
changé notre façon de s’habiller .
Dans la section suivante, on présen te les fautes d ’orthographe des enquêtes 7
e n espagnol, en anglais et en français . D’abord , on compare les résultats d es trois
langues de cette étude et ensuite on réali se la comparaison avec de s recherches
préalables (García Paredes, 1999 ; Ávila Muñoz, 2007 ; Saura Rami, 2 008 ; Blanco
Domínguez, 2 011 ; García Casero, 201 3).
En espagnol, dans chaque groupe de 100 mots écrits par sujet , 1,32 con tient
une erreur tandis qu’en langue étrangère 4,90. Le 66,16 % des fautes d’orthographe
sont dues à une inadéquate accentuation et le 3,95 % à la confusion des lettres b et v .
Quant à la distribution des vocable s avec des erreurs au respect du total des mots
écrits, sauf exceptions, ils se corresp ondent aux centr es avec un i ndice d’erreurs
d’orthographe élevé, tel que le centre sept et neuf p our se trouver avec un nombre
considérable de mots fam iliers et d’origine étrangère écrits de façon in correcte.
7 Pour accé de r aux faut es d’ort hographe, voi r l’Annexe VI.
Tesis doctoral
Evaluac ión d e la compet enci a léxica bilingüe e n estudian tes del Má ster Univ ersitario en Profesor ado
16
Les universitair es de tro isième cycle o btiennent des résultats consid érablement
meilleurs que les étudiants universitaires m alaguènes, les élèv es de lycée aragonais,
galiciens et madrilènes. Parmi les étudiants de baccalauréat, les galiciens occupent le
premier poste en correction orthographique (4,59 % des fautes), suivis des aragonais
(7,72 %) et des madrilènes (11,34 %). En langue étrangère , l es sujets d e cette étud e
ont comm is un 4,9 % de fautes et se situent seulement après les galiciens. Pour cette
raison, on peut conclure qu’il a un certain progrès dans la correction orthographique
des étudiants acquise tout au lo ng des études universitaire s.
Du point de vue de la sociolinguist ique, on étudie l’effet du sociolecte féminin
et masculin dans le nombre de mots et de vocable s apportés par les sondés . Pour ce
faire, on a réalisé un e analyse de corrélation bivariée et on a mis le point sur les
ce ntres qui présen tent une différence statistiquement significative. Le second centre,
Les vêtement s , présen te une corrélation significative bilatéra le à niveau 0 ,01 et le
troisième et quatrième centre, La nourriture et les boissons et L’école : meubles et m atériel
scolaire à niveau 0,05.
De façon plus détaillé e , on a com ptabilisé et commenté le lexique en comm un
présent dans les listes qui contienn ent les 20 vocable s plus d isponibles des femm es et
des hommes pour analyser d’un point de vue qualitatif les d ifférences. Dans ce sens,
on a distingué les vocable s apportés de manière exclusive par les hommes et les
femmes et on a constaté qu’il ex istent certaines différences. Par exemple, d ans le
centre dénommé La nourritur e et les boissons les homm es ont l’hab it ude d’écrire plus de
noms liés aux boissons alcooliques tandis que les femmes on t mentionné plus de
vocable s en relation aux desserts et alim ents sucrés.
En ce qui concerne le nombre de vocable s par sujet et centre d’intérêt, la
moyenne par centre d’inté rêt des femmes est supérieure dans tous les centres à
l’exception du cinq uième et neuvième, La ville et Ordinateurs et Int ernet en langue
espagnole et le sixième et neuvième en langue étr angère Moyens de transport et
Ordinateurs et Internet . Cette analyse corrobore l’hypot hèse de Bellón Fernández ( 2011 :
119 ) qui affirme que le centre d’intér êt marque la différence entre un sex e et l’autre
puisqu’il y a certains centres où le sexe féminin est plus enclin à écrire plus de mots et
vice versa.
Résumé
17
Les c onclusions de cette sectio n coïncident avec les études préalables où les
différences entre le sociolecte f émin in et masculin sont très fa ib les (Gou genheim et al .
1956 ; Dimitrijev i ć , 1969 ; Echeverría, He rrera, Moreno et Pradenas, 1987; Alba ,
1995a ; Mateo, 1998 ; Valencia et Echeverría , 1991 ; Carcedo, 2001). Cependant, de
même que dans l’étude de Valenci a et Echeverría (1999 : 257), on consta te q ue d ans
la plupart des centres d’intérêt, le sex e féminin est plus productif.
Chapitre 5. Anal yse sociolinguis tique
Tout au long de ce chapitre on essaiera de connaître quels sont les facteurs qui
ont une incidence sur le lex ique disponible et sur la cap acité d’identification des m ots
techniques en espagnol et en langue étrang ère. Le premier pas pou r réaliser un e
estimation optimale des résultats passe par une étude de ses variables de manière
individuelle. À travers de l’analyse univ arié e , on préten d savoir la distributio n et
dispersi on de chaque variable isoléé . Cette phase est indispensable comme
approximation aux analyses bivarié e s et multivarié e s présenté e s ultérieurement.
Cha cune de ces variables est une variable éch elle ou univariée et l’ensemble des
variables font partie d’une variable vectorielle ou multivariée.
Les variables les plus significatives de l’étude sont divisées en trois types :
variables sociodémographiques et réticulaires, variables liées à l’apprentissage d’une
langue étrangère et variables lingu istiques. Les deux premières font référence aux
variables indépendantes qui aident à expliquer le com portem ent des troisièmes, c’est -
à- dire, des variables dépendantes. Il faut souligner que la base des données primitive
est composée de plus de 500 variables comme résultat de la codifica tion du
questionnaire sociologique et des épreuves linguistiques mais on a choisi seulement
les variables les plus significatives.
Parmi le s variables so ciodémographiques et réticulaires, on a inclus l’âge de la
personne sondée, les études et le travail des parents et les revenus familiaux . Qu ant
aux variables liées à l’apprentissage d’une langue étrangère, on expose les données
exploratoires plus r emarquables : spécia lité du master, utilisation de la langu e
étrangère dans son environnem ent, expositio n aux moyens de communication et la
motivation pour donner des cours en langue étrangère. Par rapport aux variables
Tesis doctoral
Evaluac ión d e la compet enci a léxica bilingüe e n estudian tes del Má ster Univ ersitario en Profesor ado
18
linguistiques, on présente celles qui seron t utilisées comme variables dépendantes
dans les analyses bivarié e s et multivarié es : l’indice cor r igé de décentralisatio n lexicale
(ICoDD) 8 et l’indice cor rigé d’identification d e mots techniques ICIMT) 9 en espagn ol
et en langue étrangère.
L’indice corrigé de décentralisation lexicale mesu re la ca pacité lexicale des
sondés à partir des résultats de l’ épreuve de disponibilité lexicale . Pour son calcul, on
a considéré les mots moins compatib les ou mentionn és seulement par une minorité
de sujets et la relation avec le centre d’intérêt. De cette façon, on ob tient un indice
qui fait référence au nombre de mots par locuteur et aussi a u degré de
décentralisati on par rapport au centre d’intérêt.
En langue étrangè re les facteur s qui gardent une plus grande relation avec
l’ICoDD so nt liés en grand e partie à l’apprentissage d’une langue étrangère et au
propre ICoDD en langue espagnole. Dans le modèle de régression linéale et le
modèle causale on a remarqué la motivation pour donner des cours en enseignement
bilingue, l’usage de la langue étran gère dans son contexte na turel et la spécialité du
master qui l’étudient les sondé s. Ils existent d’autres variables, telles que la
connaissance d’autres langues étrangères , qui présentent une relation significative
ave c l’ICo DD mais qui sont redondante s dans l es modèles m ultivariés parce qu’elles
sont liées surtout à la spécialité du master.
En espagnol les analyses bivariées ainsi que les multivariées montrent une
relation moins significative entre les variables linguistiq ues et extralingu istiques avec
l’ICoDD. En outr e, l’analyse d e régression linéale et l’analyse causa le expliquent avec
un degré d’adéquation plus petit qu’en langue étrangère le com portement de la
capacité lexicale en espagnol. La principale cause de cet effet est due au rôle principal
8 Cette varia ble permet de connaî tre le degré de spécifi cit é des mots apportés par un infor mateur par rappor t
aux unités lexicales de l’ensemble de l’échantillon. L’indice de décentralisati on comptabilise tous les mots avec
la valeu r 1 sans tenir co mpte de la pe rtinenc e plus o u mo ins dire cte du v ocable avec le centre d’intér êt.
Cependa nt, Ávila Muñoz et Vill ena Ponsoda (2 010 : 1 85) proposent de corriger cet indice et appliquent des
valeurs diff érentes sel on le type de rel ation des vocables par rapport au centr e d’intérêt ou noyau prototypique :
mots nucl éa ire s (N 1 = 1), a ssociations collectives (N5 = 0,5), dérivati ons (N25 = 0,25) et associations
individ uelles (N0 = 0). La somm e des mots préalablement pondérée sel on ce clas sement donne lie u à l’i ndice
corrigé de décentralisation lexicale.
9 Dans l’étu de d’Áv il a Muñoz et Vi ll ena Ponsod a (2010 : 2 17) les résulta ts de l’épreu ve de lexiqu e spé cialisé s e
sont mo ntrés à travers le Pid ent, défini comme la cap acité individuelle d’identification de pièces lexicales
spécialisées. Cet indice s’obtient de la somm e de toutes les réponses correctes des locuteurs sans tenir compte
le h asard dans ce test. P our corrige r l’in dice d’identifica tion de mots techniques, on a soustrait les réponses
incorr ectes ave c une v aleur statis tiquem ent po ndérée .
Résumé
19
que joue le degr é de formation des locute urs dan s leurs com pétences lexicales . Étant
donné que tous les étudiants sont universitaires de troisième cycle, il existe une marge
plus petite d’incidence dans la capacité lexicale qui vient marqué e par d’autres
variables linguis tiques, l’ICoDD en langue étrangère et l’ICIMT en espagnol, ou
directement liés à celles - ci, la sp écialité du master et les habitudes de lecture.
En ce qu i concerne l’indice corrigé d’i dentification de mots techniques
(ICIMT) mesure la capacité d e l’info rmateur de reconnaître des mots techniques et
en relation avec le centr e d’intérêt do nné. Il s’obtien t à par tir d’une for mule
ma thématique qui tient en com pte d es rép onses correctes et incorrectes qui en
résultent de l’épreuve du lexi que spécialisé. Cette épreuve est centrée sur le
vocabulaire passif du locuteur puisqu’elle vérifie si le sujet est capable de reco n naître
certaines unités lexica les mais cela n ’implique pas n écessairement que le sujet puisse
utiliser le mot en contexte et qui fasse partie du vocabulaire actif.
Les analyses de régression linéal e multiples et causales qui mesurent les
f acteurs qui influencent la capacité d’identifica tion de mo ts sp écialisés, p résentent un
modèle d’adéquatio n assez faible en langue étrangère et, surtout, en espagnol.
Cependant, il est intéressant de soulign er les variables avec une plus grande influence
s ur l’ICIMT en langue maternelle et étrangère pou r les prendre en com pte dans le
domaine de la linguistiqu e appliquée à l’enseignement des lan gues.
En langue étrangère les variables avec une incidenc e positive sur l’ICIMT sont
l’usage de la langue dans de différents contextes, l’ICIMT en espagnol, l’él ection du
français dans l’épreuve, l’IC oDD en langue étrangèr e et la classe social e . De m ême
que dans les modèles mu ltivariés de la capacité lexicale, l es variables telles que la
connaissance d’a utres langues gar dent une r elation significative bilatérale a vec
l’ICIMT sont présents dans de s modè les multivariés de façon ind irecte, par exemple
à travers l’utilisation de la langue et la spécialité du m aster.
En langue espagnole il se produit une relation d’infl uence réciproque avec
l’ICIMT en langue étrangèr e. Le reste d e variables remarquables sont les habitudes de
lecture, l’expo sé aux programmes culturaux, la spécialité du master et la classe sociale.
C’est pourquoi une des conclusions possibles du point de vue pragmatique et
27
CAPÍTULO 1. INTRODUCCIÓN
Capítul o 1
Introducción
29
A m odo de pro legómenos, este capítulo pretende establecer los fundamentos
generales que llevaron al plan teamiento y realización del estudio actual y q ue serán
tratados con mayor profundidad en lo s siguientes capítulos. E n primer lugar, se
introduce y limita el tem a planteando el problema de investiga ción 12 . A con tinuación,
se presentan los objetivos que persigue la investigación desde enfo ques diversos p ara
conocer la respuesta a los interroga ntes del estudio. Posterio rmente, se intenta dar
una respuesta tentat iva al problema de investigación mediante las hipótesis. Por
último, se incluye la macroestructura de la tesis que se divide en siete capítulos.
L os cam bios en las estructuras sociales, en la producción y distribución de
conocimiento cien tífico, en los procesos económicos y cambios a nivel tecnológico y
de desplazamientos humanos en busca de una mayor calidad de vida y un mayor
bienestar en los últi mos tiempos, están generando una sociedad más multicultu ral. La
necesidad de comunicación en una lengua extranjera se ha convertido en un requisito
sine qua non en el ámbito profesional, cultural, de ocio y de intercambio de
información (Commission Europée nne, 1995 13 ; Guillén Díaz, 2000; C onsejo de
Europa, 2001; Consejería de Educació n de la Junt a de Andalucí a, 2005). En la
perspectiva de una enseñanza globalizadora, las lenguas extranjeras pueden contribuir
de manera muy activa a desarrollar las capacidades cognitivas, afectivas,
psicomotrices, de creatividad, de relación personal y de inserción social de los
jóvenes. La lengua viva ofrece, en relación con otras asignaturas escolares, la ventaja
de poder, sin perder su especificidad, actuar al mis mo tiempo ( por mimetismo,
simpatía o empatía) sob re otros saberes y otros domin ios de formación.
El Consejo de Europa insiste en la necesidad de desarrollar competencias que
promuevan la comunicación de los individuos con sus vecinos europeos. Para hacer
efectivo tal cometido, el Consejo publica en el año 2001 el Marco Común Eu ropeo
12 « Def ini r el probl ema de la inv estigación equivale a seleccionar una dirección concreta (…) o seleccionar un
evento, un a situación, un hecho, un comportam iento y delimitar el tiempo , el espacio, las personas, el contexto
en donde uno se decide a investigar» ( Ruiz Ola bué nag a 2003: 54) .
13 Vid. versión electrónica en el siguiente enlace:
http://e uropa.eu/doc uments/comm/white_paper s/pdf/com95_590_f r.pdf [Fecha de última con sulta el 8 de
febrero de 2015]. L a pá g ina web oficial http://ec. europa.eu/whi te - paper s/index_es .htm recoge los Libros
Blancos publi cados desde el año 1993. En esta ocasi ón el Libro blanco está dispo nible en ingl és, francés y
alemán, de ahí que se haya citado en francés. [Fecha de última c onsulta el 8 de mayo de 2015].
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
30
de Referencia para las Lenguas (MCERL). En general, las leyes educativas de los
diferentes países europeos establecen, de acuerdo con las exigencias del Consejo de
Europa, la enseñanza de dos lenguas extranjeras habladas en Europa durante la etapa
de educación secundaria. Cabe destacar, que en la enseñanza primaria e incluso ya en
la enseñanza infantil, se ha in cluido la impartición d e una lengua extranjer a,
preferentemente la lengua ing lesa (excepto en los países anglófonos) considerada
primera lengua extranjera mientras que la se gunda lengua extranjera (que se empieza
a enseñar a posteriori ) varía según los acuerdos entre países, los intereses eco nómicos y
las necesidades sociales. Así, el papel de la lengua se ve r eforzado a medida que
aumenta el interés o necesidad de los individuos para com unicarse en inglés.
Con el objetivo de adaptar la sociedad andaluza a los nuevos retos que plantea
el fenómeno d e la globalización , el Gobierno Andaluz publicó el documento titulado
Estrategias y propuestas para la segunda modernización de Andalucía . Uno de los principales
objetivos consiste en fomentar el estudio d e lenguas extr anjeras para preparar
preparar a la pobla ción ante los desafíos de la sociedad a ctual 14 .
El Plan de Fomento de Plurilingüismo, aprobado en el año 2005 por la Junta
de Andalucía, fue diseñado para promover el aprendizaje de idiomas y la diversidad
lingüística en esta región. La búsqueda de un en foque globalizado en la en señanza
(incluyendo el uso de las tecnologías d e la información y de la comu nicación, el
trabajo cooperativo y las lenguas extranjeras) conlle va la actualización de la
formación del profesorado en el plano metodológico - curricula r y lingüístico . En este
marco se ubica el Máster Universitario en Profesorado en Educación Secundaria
Obligatoria y Bachillerato , Formación Profesional y En señanza de Id iomas .
El Pla n de Fomento d e Plu rilingüis mo pone énfa sis e n la formación del
profesorado tanto de áreas lingüísticas como no lingüí sticas 15 . También repercute en
14 « Debe mos plan tea rno s de maner a rotun da el reto educ ati vo del conoc imi ent o de otr as leng uas en el marco
de un mundo global, como instrumento fundamental, para asegura r las posibilid ades d e éxito y de com partir
un futuro mejor » (Consejo Asesor para la Se gunda Mode rnización de An dalucía, 2 003: 46).
15 « Espec ial mención merec e la formació n inicia l del profe sora do de áreas no lingüís ti cas, en la que habrá que
tener en cuenta el nuevo perfil de profesor o profesora que se va a necesitar. En este sentido, es necesaria la
inclusió n en el plan de e studios de la p ráctica de la s leng uas extranje ras, q ue p odrá consid erarse com o u n
impo rtante c omp lemen to a la form ación de aq uel p ro fesorado que de see impa rtir docencia en los C entros
Bili ngües. Si además, se le permite desarrol lar su perío do de práctica s docentes en el extranjer o (como lo hacen
Aleman ia y Franci a), habre mos logrado una formac ión inici al total ment e acor de con este Plan de Fomento del
Pluril ingüis mo » (C onsejer ía de Ed ucación , Junta de Andalu cía, 2005: 4 9).
Capítul o 1
Introducción
31
la formación permanente del profesorado, ya que se tendría que invertir menos
esfuerzo, por p arte del docente, y menos recursos económicos, por parte de la
administración, cuanto mejor sea la formación inicial del profesorado. Algunas de las
opciones para la formación permanente son las siguientes: estudios en Escuela
Oficial de Idiomas (cursos of iciales presenciales, cursos de actualiz ación lingüística
del profesorado y cursos a distancia a través del That’s English), cursos de inmersión
en verano, licencias de estudio modalidad C, programa s de aprendizaje permanente,
profesorado acompañante del p rograma Idiomas y Juventud y ayudas individuales a
la formación. En cambio, algunas de esas medidas 16 que se pusieron en marcha ,
como las licen cias por estudio o los cursos de idiomas, se ha n su primido por motivos
económicos.
El aprendizaje del léxico es fundamental en la enseñanz a de idiom as y en los
programas de bilingüismo, por lo que se debe fomentar sistemáticamente y desde el
nivel más elemental para permitir el intercambio de mensajes cortos desde los
primeros días de clase. En los m omentos inicial es, de nada sirve la corrección
gramatical si el aprendiente n o posee los elementos léxicos suficientes para entender
los mensajes y para formularlos él mismo, puesto que la información referencial de
un texto está contenida en los lexemas. Se podría decir que el léxico transmite el
grueso de la información con un esfuerzo relativamente pequeño. Por ejem plo, si un
alumno se dirige al profesor diciendo «baño, por favor», o incluso «baño» claramente
le estará pidiendo salir para ir al cuarto de ba ño sin que i mplique necesidad alguna de
formular la pregunta .
Gracias al aprendizaje sistemático del léxico, el estudiante logrará resultados
espectaculares referidos con su capa cidad d e comunica ción. E n este sentido,
numerosos autores abogan por otorgar un papel pr incipal al léxico. Como es el caso
de K rashen (1987, apud Priyono 2009: 1): «Wh en students travel, they don't carry
grammar books, they carry dictionaries» y David Wilkins:
16 « Acción 48 : Gra tui dad de los c urso s par a el pr ofe sora do inv olu crado en el Plan de Fomen to de l
Pluril ingüis mo en Escuela s Oficiales de Idiomas y otras Institucion es Colaboradora s). […] Acción 50:
Conces ión de lic enci as de est udio e spec ífi cas ( curs os de idi omas en el e xtra njer o, i nterc ambios pues to a p uest o,
estancias en centros educativos extranjeros, etc. ) para la formac ión en lenguas en el extranjero » (P lan de
Fo ment o de l Pl uri li ngü is mo, Cons ej erí a de Educ aci ón, J unt a d e An dal ucí a, 20 05: 4 9).
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
32
Para que la enseñanza del léxico sea significativa, es necesario llevar a cabo
una recopilación previa de las unidades léxicas que se pretenden enseñar de acuerdo a
las car acterísticas d el alumn ado. P recisamente, el MCERL (2001: 149) de staca la
importancia de la selección léxica para la ela boración de materiales de exá menes y
manuales. Pero, ¿cómo se realiza esa selección léxica? ¿cuen ta el profesorado con un
léxico disp onible en lengua esp añola sim ilar en lengua ex tranjera? ¿qué factores
incide n en un mayor o menor caudal léxi co?
La búsqueda de la selección del léxico en la enseñanza de idiomas y la
evaluación de la com petencia léxica del futuro profesorado que va a enseñar esa
lengua hacen necesaria la pu esta en práctica de una disciplina ya c onsolidada que
responda a las necesidades de esta investigación. En este contexto, se enmarca la
elección de la d isponibilidad léxica como herramienta necesaria para recabar d atos,
analizarlos y llegar a conclusiones que se fundamenten en bases teóricas só lidas. Esta
disciplina surge en Francia bajo la demanda del Ministerio de Educación N acional en
1951 de crear un vocabulario de base. Tras la publicación de varios volúmenes, en
1964 aparece una versión mejorada de la obra de Gougenheim, R ivenc, Michéa y
S auvageot, titulada L’élaboration du françai s fundamental (1 er degré ).
Esta investigación servirá, no solo para enseñar ese vocabulario de base, sino
también para conformar en sí misma la base de un nuevo campo de estudio que
cuenta en nuestros día s con una vasta literatura. La mayoría de las investigaciones se
han realizado en español como lengu a materna y tienen como máximo exponente a
López M orales quien realiza en 1973 una de las primeras investigaciones sobre el
léxico d e San Juan de Puerto Rico 17 . A demás, promueve y dirige el Proyecto
Panhispánico de Disponibilidad Léxica (PPHDL) que sup one la puesta en común de
los aspectos metodológicos en estudios de zonas de habla hispana para la creación de
diccionarios que muestren las diferentes sintopías y pe rmitan su contra ste.
17 El primer estu dio en español lo real iza Victe ry (1971) sobre una muestra de estu dian tes de 16 a 18 años: 33
monol ing ües d e Mon ter re y ( Méxi co) , 33 mono li ngüe s y 3 3 b il ing ües d e Ho ust on (Te xas ).
Wit hout gr amma r li tt le ca n be con ve ye d; wi th ou t voc ab ul ar y noth i ng can be co nv ey e d. If
you spen d m ost of your time studying grammar, yo ur En glish will not improve m uch. Yo u
wil l see m ost improvement if you lear n more words and expres si ons. You can say very lit tl e
with gr ammar, but yo u c an s ay almos t anyt hing wi th words ! ( Davi d Wil ki ns, 1 972: 111):
Capítul o 1
Introducción
33
Grosso modo , este estudio ha seguido la metodología planteada en el
Panhispánico con algunas salvedades. Se ha utilizado el sistema de listas abiertas en el
que los informantes tienen que escribir toda s las palabras que se le vengan a la mente
en un tiemp o límite de dos minuto s por cada centro de interés o estímulo. En
cambio, en luga r de utilizar los dieciséis centros de interés clásicos propuestos por
Gougenheim et al. (1964) se han reducido a nueve para adaptarlos al objetivo de
in vestigación: ocho corresponden a los tradicionales, para poder hacer
comparaciones intermuestra les; y uno se incorpora por pr imera vez en este ám bito
por su relación con las nuevas tecn ologías 18 .
La población objeto de estudio está formada por estudiantes de postgrado, en
lugar de estu diantes preuniversitar ios, lo que permite analizar la evolución del léxico
disponible según el nivel de instrucción al cotejarlo con estudios previos. Asimismo,
por primera vez se realiza en España la prueba en español y en l engua extran jera a un
grupo de estudiantes que han debido acreditar previamente un nivel B1 según el
MCERL. Por ello, se ha ofrecido la posibilidad de realizar la p rueba de disponibilidad
en el idioma que los hablan tes conociesen dando lugar a un léxico di sponible en
inglés y otro en francés. Asimism o, lo s info rmantes han com pletado un cuestiona rio
con variables socioculturales y una prueba de léx ico especializado. De esta forma, se
pretende abordar el estudio del léxico disponible desde las tres perspectiv as que
establece Azurmendi Ayerbe (1983: 187 - 195): creación de léxicos básicos, estudios de
carácter teórico y trabajos d e comparación inter e intralin güística.
Esta tesis doctora l focaliza su atenci ón en los factores que condic ionan un
mayor vocabulario virtual en español y en lengua extranjera de los estudiantes que
cursan el Máster Universitario en Profesorado. Interesa conocer el perfil a nivel
lingüístico y sociológico de los futuros docentes para ind agar en las rela ciones que se
producen en variables relacionadas con sendos ámbitos. A su vez, trata de evaluar el
léxico disponible d e uno de los pilares básicos en la implantación del Pla n de
Fomento de Plurilingüismo: l a form ación inicial en lengua española y en lengua
extranjera del futuro profeso rado. Teniendo en cuenta los numerosos aspectos que se
18 Los centros de interés son: 1) Partes del cuerpo ; 2) La ropa ; 3) Comidas y bebidas ; 4) La escu ela : muebles y materi ale s ;
5) La ciud ad ; 6) Med ios de t ra ns por te ; 7) Juegos y distracciones ; 8) Profesi ones y o fici os ; 9) Orde nado res e in ter net .
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
34
pueden abarcar y evaluar en una investigación sobre la formación lingüística del
profesorado, en este estudio se fijan los sig uientes objetivos específicos:
a) Ámbito de la sociolingü ística:
• Comparar el léxic o disponible con otros estudios para detectar semejanzas y
diferencias por razones de lugar, tiempo, nivel de instruc ción de los
informantes, situación de la lengua (materna, extranjera o segunda lengua),
entre otros factores.
• Analizar las variables que c ondicionan el léxico disponible en español y en
lengua extranjera del futuro profesorado p ara extraer datos que sea n de interés
en la enseñanza de idiom as.
• Conocer la capacidad de identifica ción del léxico especializ ado en espa ñol y en
lengua extranjera relacionado con los nueve centros d e interés del diccionario
de disponibilidad léxica y averiguar cuáles son los factores que inciden en un
mayor o me nor conocimiento del vocabulario especializad o.
b) Ámbito de la psico lingüísti ca:
• Evaluar las conexiones de palabras que se producen en el lexicón mental del
informante a través del p rograma DispoGra fo 19 .
• Realizar un análisis de los procesos de reentrada del léxico al núcleo o
prototipo de c ada centro de interés mediante el índ ice de compatibilidad.
• Esbozar una t axonomía de los centros de interés atendiendo a di ferentes
parámetros.
• Cotejar los análisis anteriores en lengua española y en lengua extranjera para
extraer conclusiones sobre el com portamiento del léxico dispo nible a nivel
cuantitativo y cualitativo que comprenda la organización de las palabras.
c) Ámbito de la lingüí stica apl icada a la enseñan za de le nguas:
• Elaborar un diccionario de disponibilidad léxica en lengua español a y en
lengua extra njera (francés e inglés) sobre nueve centr os de interés de gran
re levancia en el ámbito educativ o.
19 Programa pre sentado por Echeverría, Urzúa y Ferr eir a ( 2008 ) que sirve par a realizar las relaciones
semánticas de corte psicolingü ístico.
Capítul o 1
Introducción
35
• Evaluar la corre cción ortográ fica de los lis tados de léxic o disponible y co nocer
cuáles son los errores más comunes en los estudiantes para proponer medida s
correctoras.
• Seleccionar las unidades léxicas que formarán parte de un vocabulario básico a
partir de los listados del léxico d isponible.
• Llevar a cabo una propuesta didáctica que se sirva de los resultados de los
análisis realizados, sobre todo relacionados con la organización de las palabras
en la mente.
Con objeto d e dar respuesta a los interrogantes del estud io, se plantean las
hipótesis como elemento de conexión entre la teoría y la observación. Asimismo, las
hipótesis han guiado la generación de las preguntas del cuestion ario sociológico, de la
prueba de disponibi lidad léxica y de identificación del léxico especializado. D e esta
forma, es posible corrob orar o refutar las mism as por medio de análisis cua litativos y
cuantitativos. No se preten de llegar a una constatación uná nime y precisa de cada una
de las hipótesis ya que la natura leza de la investigación aporta d atos más descriptivos
y complejo s que un simple sí o no . En sintonía con los objetivos, las hipótesis se
dividen en tres bloques:
a) Ámbito de la sociolingü ística:
• El promedio de palabras de los preuniversita rios malagueños será inferior al
aportado por los estudiantes de postgrado debido a la influencia del niv el de
instrucción.
• El caudal léxico en leng ua extranjera es infe rior en lengua materna ( con
independencia de la lengua d e que se trate , inglés o francé s) .
• Las estancias en el extranjero, el contacto con los medios de comunicación, la
motivación por aprender lenguas y el mayor conocimien to de idiomas inciden
positivamente en el caudal léxico.
• Las diferente s variables tendrán una mayor influencia sobre el léxico
disponible y la capacidad de identificación de tecnicismos en lengua extranjera
que en lengua materna.
43
CAPÍTULO 2. MARCO TEÓRICO
Capítul o 2
Marc o t eór ico
45
2.1. Introducción
2 .2 . Orígenes de la disponibilidad léxica
2 .3 . Principios epistemológicos y conceptuales de la disponibilidad léxica
2 .4. Investigaciones relacionadas con el léxico disponible
2 .4.1. En español como lengua materna
2 .4.2. En inglés como lengua extranjera
2 .5. Revisión del modelo matemático
2. 5.1. Cá lculo del índice de disponibilidad léxica
2 .5.2. Índice de compatibilidad léxica y selección del léxico nuclear
2 .5.3. Índice corregido de amplitud léxica
2 .5.4. Índice corregido de descentralización léxica
2 .5.5. Índice corregido de identificación de tecnicismos
2 .6. Aplicaciones de la disponibilidad léxica
2.7. Variables que inciden en el léxico disponible
2.7.1. Sexo
2.7.2. Estancias en el extranjero
2.7.3. Conocimiento de idiomas
2.7.4. Correcci ón ortográfica
2.7.5. Clase social
2.7.6. Hábitos de lectura y exposición a los medios de comunicación
2.7.7. Contacto y uso de la lengua extranjera en diferentes contextos
2 .8 . Conclusiones parciales
Capítul o 2
Marc o t eór ico
47
2.1. Introducción
A lo largo de este capítulo se analiza el estado de la cuestión partiendo de lo
general a lo concreto. En primer lugar, se expone la literatura relacionada con la
disponibilidad léxica que comienza con un recorrido por las obras pioneras en este
ámbito 21 . A continuación, se expone la evolución de la metodología de análisis y de
codificación de los d atos desde la obra primigenia (G ougenheim et al. , 1964) h asta el
afianzamiento de las pruebas de listas cerradas con una duración de dos minutos
marcado por la pr oliferación de estudios com unes al Proyecto Panhispánico.
En este sentido, es crucial conoce r las investigaciones que se han realizado
previamente sobre léxico dispo nible y, más concretam ente, sobre el léxico en español
como len gua matern a y en inglés y francés como lengua extranjera por tratarse de los
idiomas a nalizados en este estudio. Asim ismo, se incluye una revisión d el trat amiento
matemático de los datos y se definen cuáles son los principales índices utilizados en
este estudio y los factores que intervienen en su cálculo .
Una vez comenta dos los aspectos teóricos y metodoló gicos, se describen las
principales utilidades de los estudios de disponibilidad léxica en diferentes disciplina s
haciendo hincapié en la lingüística aplicada en la enseñanza de idiomas. Para
terminar, se presentan las variables sociológicas y relacionadas con el aprendizaje y
adquisición de una lengua que han sido objeto de estudio con anterioridad: el sexo,
las estancias en el extranjero, el conocimiento de idiomas, la clase social, los hábitos
de lectura, la exposició n a los medios de comunicación y el contacto y el uso de la
lengua en diferentes contextos.
2.2. Orígenes de la disponi bilidad l éxica
En 1947 Aurélien Sauvageot , en tonces pro fesor d e l'École Nation ale des
Langues Orie ntales V ivantes, acude en representación de Francia a un Comité de
lingüistas auspiciado por la U nesco. El ob jeto de la r eunión era pr omover la
21 Como reflej a Luque Toro ( 2006) en el Léxico español ac tual , e l c amp o de estudio del léxico es muy amp lio e
integra estud ios que abarca n n eolog ismos , co loquialis mos, léxico a rcaico tradicio nal, léxico inno vado r,
presposic iones, entre otros a spectos.
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
48
enseñanza de len guas para luchar contra el analfabetismo y con seguir difundir una
educación de base. En camb io, en aquel contexto la enseñanza d e idiomas tradicion al
en el país ga lo no establecía discriminación algun a en la selección del vocabulario.
Por tanto, a menudo el alumnado se veía exp uesto a una cantidad ingente de palabras
que no pasaban a formar parte de su repertorio lingüístico .
Con objeto de elaborar un vocabulario de base el Ministeri o de Educación
Nacional cre a en 1951 una c omisión y un centro de estudios en l'École Normale de
Saint - Cloud, denominado Centre d'Études et de Recherche pour la Diffus ion du
Français. A la cabeza del centro estaba Gougen heim, profeso r de Historia de la
Lengua en la Universidad de Estrasburgo quien traba jaba de forma conjunta con
Rivenc, entonces profesor d'École N ormale . Como f ruto de los trabajos científicos
de este pro yecto e l In stitut Pédagogiq ue Nation al publica en 19 54 un fascículo
opúsculo basado en la frecuencia de las palabr as ( apud Gougenheim et al ., 1956).
A pesar de que en un primer momento se pensó llamar Français de base , las
incómodas comparaciones con el Basic English 22 hace n que se llame Le français
élementaire . Cabe mencionar que ya en 1949, M ichéa reflexiona sobre la denominación
y el contenido de un vocabulario esencial y aboga por sustituir el concepto de
vocabulario de base por vocabulario de estruct ura 23 . Aún así, críticas a la obra inglesa,
como por e jemplo la realizada por Bongers (1947: 119 - 134) obligaron a los autores
en 1956 a precisar la distinción entre sendos vocabularios y a dedicar un capítulo
sobre los orígenes filosóficos del Basic English 24 .
22 El Basic English , elabora do po r Ogd en y R ichard s en 19 28 era un co nocido voca bulario que cu enta co n un
total de 19 93 voca blos, de e ntre los cu ales se des taca una lista de vo cablo de b ase con 850 entr adas : 600 cosas
(sustantiv os), 15 0 cualidades (adjetivos ) y 150 operaci ones (una mezcla de categor ías g ramatical es) . Basi c
proviene del acrónimo British American Scienti fic Internat ional Commercial . Ambos autores cuen tan con una vasta
obra en la selección del léxico: Ogden, 1930, 1931, 19 33, 1935, 1968; Richards, 1935, 1943, 1945, entre o tras.
Una de las di fer enci as del Basic Engli sh con el Français élémentai re residía en la metodo logía d e selección d el
vocabulario: las palabras m ás com unes en las definiciones de los diccionarios en lugar de las palabras más
frecuentes.
23 «Nous croyons q ue les élém ents d’un vo abulaire essentil doiven t être choisis, no n seulemen t pour la part de
signification qu’apporte chacun d’eux, mais encore et surtour en considération du soutien qu’ils s’accordent
l’un à l’autre dans l’expression coherente d’un tout physique. C ’est pourquoi nous proposerions volontiers de
remplacer ‘vocabulaire de base’ par ‘vocab ulaire de structure’» (Michéa, 1949: 173).
24 « Une langue semi - art ificiell e conçue par C.K. O gden et I.R. Richards dans les années vingt . Il s’ag it, en
s’appuyant sur les réseaux synonym iques de la langue anglaise, de la réd uire aux terme s minimau x (premiers)
permettant de définir (et donc de comprendre et de s’expr imer dans une certaine mesure) tous les autre s
termes de la langue , un peu comme dan s un dictionnaire . Le Basic est donc un vocabula ire minima l à p ortée
théoriqu e m aximale form ant u n tou t, c’est une ‘la ngue universe lle à base d ’anglais […] pouv ant se suffire à elle -
même » ( Gou gen hei m et al. , 1956 : 28 ).
Capítul o 2
Marc o t eór ico
49
E n 1958 se p ublica un segundo volumen y en 1959 se reedita Le français
élementaire bajo el nombre de Français Fondamental (1er degrée) , desligándo se así de las
críticas que lo ta chaban de rudimentario, escolar e incluso de peyorativo
(Gougenheim et al. , 1964: 13). Por último, en 1964 se publica una versión más amplia
y mejorada bajo el mism o nombre con algunas var iaciones sustanciales.
En el pe riodo ac aecido e ntre la primera y última obra (1954 y 1964) se
trascendieron cambios so ciales y p olíticos que marcaron los objetivos de los
vocabularios y las gram áticas de base. En un primer momento, se pretende enseñar
francés a los h abitantes que forman la Unió n Francesa, a lo s extranjero s y a los
inmigrantes que llegaban a Fran cia. Esa finalidad inicial es tá vin culada co n la creación
de la Unión Francesa que nace con la Constitución del 27 de octubre de 1946 . E l
capítulo V III establece que la Unió n Francesa está formada por la Francia
metropolit ana, los departamentos y territ orios de ultramar y los territor ios y estados
asociados .
Conflictos internos provocaron la separación de algunos de los territorios que
formaban parte de la entid ad política en vigor: Camboya en septiembre de 1955,
Vietnam del Sur en diciembre de 1955, Marruecos en marzo de 1956, Túnez en
marzo de 1956 y Laos en mayo de 1957. Además, las guerras de Indochina y Argelia
causaron tales estragos que propiciaron la caída de la IV República y el fin de la
Unión Francesa en 1958. Por tanto, en la última obra se comenta que a pesar de que
uno d e los objetivos prelimin ares era la difusión de la len gua en los países miembr os
de la Unión Francesa, los propósitos de esa selección del vocabulario pasan a ser los
tres que siguen (Gougenh eim et al. , 1964: 21 - 22):
• Ense ñanza escolar: práctica y cultural.
• Di fusión, en los jóvenes estados independientes, de una lengua dada elegida
como lengua nacional o len gua extranjera en situación privilegiad a.
• Necesidad es del viajero, del turista, de la persona que hace prácticas en el
extranjero, del extranjero que viene a trabajar a otro país.
En cuanto al método aplicado, el Français fondamental reflexiona sobre la
metodologí a estadística llevada a cabo en los dos diccionari os de fr ecuencia d el
francés p ublicados h asta ese entonc es en Estados Unidos: A French Word Book Based
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
50
on a Count of 400.000 runnin g Words de Henmon (1924) y el French Word Book 25 de
Vander Beke (1929) . Asimismo, se inclu ye la referenc ia a obras derivadas del French
Word Book , tales como The French Vocabulary de Tharp (1939), el Centrala ordförrädet i
franskan de Schlyter (1951) y el Basis - Woordenboek voor de Franse de V erlée (1954). Los
diccionarios de Ogden y Richards (1928) y West (1953), combin an las siguientes
técnicas (Gougenheim et al. , 1964: 13):
• La frecu encia de las palabras en la lengua ha blada.
• La búsqueda de las pala bras disponibles más útiles.
• El empiris mo racional .
El primer aspecto supone un avance metodológico ya que hasta la época
todos los vocabularios bá sicos se basaban en la lengua escrita , en su gran mayo ría d e
carácter literario. En esa misma línea, los autor es franceses deciden incluir el r egistro
oral provocando diferencias con otras listas, tales como la lista de Vander Beke 26 .
Para ello, utilizan registros so noros ya existentes provenien tes del Musée de la Parole,
Musée des Arts populares, Archives de la Radiodifussion y el Musée des A rts et
Traditions Populaires. Además, realizan grabaciones directas sobre temas variados
que completaron con anotaciones sobre variables sociolingüísticas d e los
informantes, tales como la profesión, el origen y el nivel educativo .
Las grabaciones dieron lugar a 163 textos con un total de 312 135 palabras
diferentes y 7995 vocablos. Previamente, los investigadores contabilizaron las
apariciones de lo s vocab l os para in cluir en las listas solo aquello s que se hubiesen
repetido al menos 20 veces. Una lista se organizó por orden de frecuencia y la otra
por orden alfabético incluyendo en ambas la frecuencia y la repartición, es decir, el
número de textos en el que el vocablo está presente. Asim ismo, las palabras que no
aparecen en las listas del Français élément aire por razones justificadas y que cuentan con
una frecuencia de al menos 29 apariciones se encuentran marcadas con una cruz. A
25 Di sp onib le en http://hdl.handle .net/2027/mdp.39015034357353 [Fecha d e ú ltima consulta el 19 de abril de
2015].
26 Go uge nhei m et al . (1964) analizan las palabras más frecuentes y peculiaridades como las apariciones de
palabras sinónimas ( méde cin y docteur ), de verbos que exp resan a cciones banales de la vid a y pala bras gr amatica les
de carácter literario , entre otras. De forma general, las pa labras más cultas tienen una frecuencia superior en la
lista ela borad a po r V ander Bek e que en el Françai s Fonda mental puesto que el vocabulari o ha sido solo extraído
de textos escrit os.
Capítul o 2
Marc o t eór ico
51
continuación, se incluyeron dos tablas (Gougenheim et al. , 1 964 : 113 y 115): la
primera muestra la relación entre la categoría gramatical y su distribución tanto
numérica como porcentual y la segunda analiza la frecuencia de las palabras
distribuidas en rangos 27 .
Las palabras gramat icales aparecen en un mayor porcentaje confor me
aumenta la frecuencia mientras que los sustantivos y adjetivos predominan en los
vocablos con po cas ap ariciones. Así, las unidades léxicas con una frecuencia entre
14 000 y 1000 son en su gran mayoría palabra s gramatica les: determinan tes,
pronombres, adverbios, conjunciones y preposiciones que decrecen de 90,9 % en el
primer rango hasta 5,7 % en el último. En cambio, más del 50 % de las palabras
comprendidas entre 1000 y 20 apariciones son sustantivos. Los adjetivos abu ndan en
el tramo de frecuen cia entre 1000 y 60 rep eticiones y los verbo s presentan una
distribución más irregular, según se trate de verbos auxiliares muy usados o verbos
más concreto s. De hecho, los estudiosos consideran los verbos auxiliares av oir y être
como com o palabras gramaticales lo que pr ovoca que no exista n ingún verbo que
sobrepase las 5001 ocurrencias.
Del análisis de los resultados se constata que los sustantivos tienen una
frecuencia baja e inestable mientras que las palabras gramaticales y los verbos tienen
una frecuencia fuerte y estable. Por tanto, los autores franceses recomiendan incluir
en el cálculo d e la frecuencia el criterio de la estabilidad de la frecuencia aparte del
criterio d e la frecuencia absoluta. Asimismo, se cuest ionan la metod ología de las listas
de frecuencias donde la mayor parte de las unidades léxicas corresponden a palabras
gramaticales, seguida de verbos, adjetivos y algunos sustantivos de carácter general 28 .
El hecho que los sustantivos aparezcan de forma reducida en las listas,
provoca que palabras que sup uestamente son frecuentes presen ten un número bajo
de apariciones o ni siquiera aparezcan. Para ejemplificar la cuestión, utilizan nombres
comunes como fourchette , coude , dent , métro y jupe cuyo uso está supeditado a una
27 Por ejemplo, el primer rango contabiliza las palabras de más de 5001 apariciones. E n ese rango, solo existen
11 palabras , 10 de la s cu ales son palabras gramaticales m ás el verbo avoir . No aparece n ingún a djetivo ni
nombre hasta el r ango cuar to que comprende l os vocabl os cuyas apari ciones oscila n entre 1000 y 500 .
28 « D'u ne f açon géné ra le, le s li st es de fr équ enc es ne donn ent pas ou ne donnent guère les mots concrets. Ceux -
ci n'apparaissent qu'avec une fabile frecuence. Il y a dan s ce fait q uelque cho se qui, au p remier a bord, semb le
surprenant» (Gou genheim et al. , 1964: 140).
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
58
Hernández (2010: 91 ) 40 incluye el concepto de lexicón mental entendido, grosso modo ,
como el lugar don de se alm acenan las palabras. M ás allá d e la crea ción de un
diccionario de léxico disponible, el análisis de la s asociaciones entre el estím ulo y las
palab ras producidas por los informantes es de gran relevancia para conocer la
estructura del léxico mental.
Para activar ese léxico disponible en situaciones concretas, tanto los autores
franceses como sus suced áneos se basan en los d enominados centros de i nterés. La
bibliografía de referencia en torno a los centros de interés puede consultarse desde la
perspectiva lex icográfica y pedagógica. Desde el punto de vista de la lexicografía,
existen obras medievales que recogen la organiza ción de los vocablos en b loques
temáticos denominad os Vocabularia . El o bjetivo era facilitar la adquisición d el latín en
un momento donde la gramática y el léxico jugaban un p apel predominante en la
enseñanza de idiomas.
En el ámbito educativo, su precursor es Decroly (1871 - 1932) quien organiza
los diferentes contenidos curricu lares en torno a esos centros o tem as concretos
según la edad del alumno. Ejem plo de esa metodología, se en cuentra en el libro de la
pedagoga argentina Guillén de Re zzano (1958) donde desarrolla los c entro s de interés
correspondientes a los grados infantiles super iores haciendo referencia al nivel
académico del alumnado «niños que ya saben leer y escribir y de una edad que oscila
entre los siete y ocho años» (Guillén de R ezzano, 1958: 12). Para el primer gr ado
(siete a ños) d esarrolla aspectos relaciona dos co n la alim entación de forma elemental:
la granja ; el establo , la vaca , la leche ; la conejera ; el chiquero ; la colmena ; el ga llinero ; la huerta ; el
granero , el tr igo , el pa n ; la p rimavera 41 . Para el segundo grado, incluye los centros que se
relacionan con la vivienda incluyendo la geografía: la vivienda ; la m ontaña ; el río ; la
llanura ; el mar ; la selva , el árbol ; calefacción y alumbrado ; viajes: medios de transporte .
Ambas disciplinas seleccionan y delimitan determinados aspectos de la
realidad con fines pedagógicos encaminados al dise ño curric ular en general o a la
40 « El léxico disponib le supone un nuevo enfoq ue sobre el léxi co. No se trata de las palabr as uti liz adas al
producir determinad os textos; sino de las palabras que, organizadas, están en nues tro lexicón mental y están
‘dispo nibles’ para ser utilizadas cuando las circuns tancia s comunicativas lo requieran; cuando un estímulo
active e l nodo cer ebral ad ecuado » (Barto l Herná ndez , 2010: 91) .
41 En este estud io se ha optado por incl uir los nombres d e los centros de interés en cursiva siguiendo el estilo
marc ado por l a o bra pi one ra Goug enh eim et al. ( 1964 ) secundad a por López M orales (1995), entre otros.
Capítul o 2
Marc o t eór ico
59
selección del vocabulario pa ra el aprendizaje de un a lengua. En el caso de la
disponibilidad léxica, Mic héa incorpora la definición del concepto de centro de
interés haciendo alusión a la pedagogía tradicional. De hecho, se observa cierta
similitud entr e algunos de los centros p resentes en obras co mo la de G uillén de
Rezzano (1958) y los centros propuestos p or el profesor francés: la viviend a , la huerta ,
calefacción y alumbra do , medios de transporte y el pan , entre otro s. Si bien es cierto que el
concepto pod ría hacer referencia a obras lexicográfica s, el cará cter ideológico del
Français Fondamental, que con lleva la alfabetización y aculturación a través de la
enseñanza del francés, toma como punto de pa rtida estudios pedagógicos (Michéa,
1953: 39) 42 .
Los centros de la obra de M i chéa (1953 ) tomado s como referencia para lo s
estudios d el Français Fondamental son dieciséis. Sin embargo, cada investigador
mantiene, disminuye o aumenta el número y tipo de centros en función de lo s
objetivos de los estudios. La primera investigación que incluye la metodología
francesa es lleva da a cabo en 1964 por Pfeffer , espec ialista en lexicom etría alemana .
El estudio tiene un objetivo merament e didáctic o: aprendizaj e del alemán hablado
contemporáneo. No obstante, la disponibilidad léxica se con stituye como uno de los
cuatro criterios de selección del vocabulario gracia s al aporte de nomb res concretos
útiles para el aprendizaje y la enseñanza de idiomas.
La encuesta se realiza en la principal zona germanófona de Europa Central y
comprende 82 escuelas en 48 ciudades diferentes de A lemania, Austria y Suiza . La
edad de l os alumnos oscila entre los quince y dieciséis años y la proporción por sexos
es similar, elevándose a casi 2000 participa ntes. Para la recogida del léx ico disponible,
se solicita a los informantes que escriban en d os pruebas de diez minutos una lista de
v einte sustantivos y una lista de doce verb os y ocho adjetivos r elacionados con cada
centro de interés. E sos cuestiona rios recogen en total 833 000 palabras y 34 000
42 « L’expl orati on statis tique des centres d’int érêt est devenue une nécessi té. À la vérité, l’expr ession ‘centre
d’intérê t’ dési gne, dans la pédagogie traditi onnelle, des groupements de forme variée. T antôt il s’agit d’une
même class e d’ obj ets (pa rt ie s du corps, vê teme nts , animaux , pl ant e s), tantôt plus prop rement d e ‘milieux’ (la
ville, le village). C es ensembles offrent un choix plus ou m oins large ; ils perm ettent à la pensée de s’engager
dans un plus ou m oins grand nom bre de directions. E n un m ot, ils peuvent avoir une ‘cohérence sémantique’
différent e. Il est donc norm al que les probabili tés de rap pel ne se hiérar chisent pas exactement de la même
façon dan s les différents centres» (M ichéa , 1953: 39).
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
60
vocablos, entre los que se ex cluyen los no mbres propios, topónimos y adjetivos
derivados de nombres de lugares.
El vocabulario básico alemán está organizado por orden alfabético, según
partes del discurso, frecu encia y origen. Los materiales usados han sido 400
grabaciones de entrevistas y 5400 encuestas escritas de asociación espontánea. Las
palabras de la prueba de disponibilidad léxica han sido seleccionadas según su
amplitud de repartición y su índice de disponibilidad (superior a 100 menciones)
sumando un total de 347 de las 1269 p alabras que conforman ese voca bulario básico.
Ese carác ter complementario que ap ortan las pruebas de disponibilidad léxica,
se ve reflejado en investigaciones posterior es como la irlandesa, Buntus Gaeilge ,
publicada en 1966 43 . La obra está escrita en irlandés y su título hace referencia a la
base y principio de l ese idioma «a nucleus of Ir ish» (Ó Huallacháin, 197 8: 509). El
director del trabajo, Ó Huallacháin (1978: 502), afirma que en el régimen británico la
enseñanza del irlandés en las escuelas ha sido autorizad a en 1878 y la enseñan za en
lengua irlandesa en 1904, de ahí la necesidad de recopilar material necesario dirigido a
profesores y organizado res de cursos.
El trabajo se divide en tres partes: el estudio de las estruct uras sintáctica s, el
vocabulario y morfología y las pa labras d isponibles. S e centra en el irlandés ha blado
por lo que para la recopilación de las palabras y la grabación de las conversaciones se
basa en las técnicas empleada s en el Français Fondamental .
Concretamente, la prueba de léxico disponible la realizan 260 irlandeses y 260
ingleses de Irlanda sob re 20 centros de in terés 45 que an otaron más de 200 000
43 Los datos del estudio se han recabado a partir de la investig ación de Njoc k (1978) y las publicadas por Ó
Hual la chá in en 1970 y 1 978.
44 El número de página corresponde a una anotación manuscrita. E l documento ha sido extraído de la base de
datos especializada en educación del Educat ion Resou rce s Inform anti on Cente r : http:// eric.e d.gov/?i d=ED041256
[Última consulta el 1 0 de abril d e 2015].
45 1) The body and its parts ; 2 ) p hysic exercises, athletics, sp orts ; 3) recreation hobb ies, indoor pastimes ; 4) illn esses (kinds o f
sicknesses), inju ries, cures ; 5) religion, the church ; 6) cloth es of all kinds (m en, women, boy s, girls) ; 7) food and drin k ; 8) meals ,
utensils for each m eal and for preparing meals ; 9) the home or house: furnitur e, fittings, hea t, light ; 10) business: buying, selling ;
Hund red s of t hou sa nds o f wor ds of r ec or ded c onv er sa ti ons f rom I ri sh - speaking are as
pro vided the basis for the study of vocabulary, verb - mor pho log y and sy nt ax whi ch was
designed to show the ki nd of Irish which shoul d be taught in orde r that an ini tial measure of
performance would be attai ned as soon as possible. The techniques employed are an
elaboration of those pioneered by the CR EDIF team which produced Le França is
Fondame ntal (Ó Hu allacháin , 1978: 9 - 10) 44 .
Capítul o 2
Marc o t eór ico
61
palabras. Cada sujeto tenía que escribir las 20 palabras que considerara más útiles
(nombres, v erbos o adjetivos) p ara cada uno de los centros de interés. Los
informantes fueron seleccionados tenien do en cu enta seis fa ctores: la edad, el sexo, la
residencia (zona rural o urbana), la ocupación y la distribución geográfica. La
distribución de los hablantes por niveles educativos es la siguiente: 100 provienen de
educación primaria, 60 de escuelas comerciales ( trade schools ), 50 de enseña nza
secundaria y 50 a dultos de los cua les 25 son estudian tes. El factor d el reparto
geográfico encuentra su importancia en la distribución equilibrada de los sujetos
irlandeses según su dialecto. Por ejemplo , para los irlandeses que hablan irlandés
gaélico no tenía sentido tener en cuenta el factor urbano/rural puesto que la casi
totalidad de las personas fo rman parte de comuna s rurales.
En 1969 el yugoslavo Dimitrijevi ć publica la primera obra de referencia sobre
disponibilidad léxica en inglés bajo el nombre de Lexical Availability. A New Aspect of
the Lexical Availability of Secondary School Children . La muestra del estudio estaba
formada por 185 alumnos de 14 años 46 (8 9 chicos y 96 chicas) de Junior Secondary
Schools (125, de lo s cu ales 5 9 chicos y 66 chicas) y Senior Secondary Shcools (30 chicos y
30 ch icas) de zonas rurales y urbanas de Edimburgo. El número de centros se redujo
a once, siendo los que siguen:
1) Animals .
2) Countryside.
3) Town.
4) Entertainme nt.
5) Jobs and professions.
6) Science.
7) Means of transport.
8) Politics.
9) Parts of the house.
11) life in to wn a nd cit y ; 12) life a nd w ork in the c ountry and the landscape ; 1 3) animals, birds, fish, insects ; 14) trees, pla nts,
flowers, weeds, crops ; 1 5) trades and kinds of occu pation o r work ; 1 6) travel, means of tran sport an d things connected with them ;
17) the family, relatives and peop le's feelings about them se lves a nd others ; 1 8) school life, activities, furniture ; 19) the ruling of the
country, governm ent, politics ; 20) the w eather, the time of da m, seasons .
46 Tod os los niños tie nen 14 años a excepció n de 3 chicas y 2 chicos que tienen 15, de ahí la generalización por
parte d el aut or.
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
62
10) Food and drink.
11) Clothes.
La elección de cada centro de interés atiende a criterios debidamente
justificados por el investigador en cad a caso haciendo hincapié en la familiaridad del
tema y su representativida d 47 . Se han m antenido 10 centros de interés tradicionales ,
es decir, que aparecen en la o bra pionera y se ha añ adido un nuevo centro,
correspondiente al número ocho, Politics . El moti vo de la eliminación de ciertos
centros de interés atiende a cambios introducidos en la metodología y al límite
temporal permitido p ara hacer las prueb as, concretamente dos cla ses o sesiones. Una
de las variaciones consiste en establecer un tiempo límite e n cada centro de interés
para que el hablante pueda escribir todas las palabras que conozca de forma que el
total de unidad es léxicas pudiera servir de indicad or de la fluidez verbal ( cf.
Dimitrijevi ć , 1969: 5 ) 48 .
El autor marca la diferencia entre las palabras disponibles y las parcialmente
disponibles según su grado de disponibilidad ( cf. Dimitr ijevi ć , 1969: 4) 49 . Por un lado,
las palabras disponibles son más familiares y no req uieren trabajo localizarlas bien
porque el hablante no tenga que pensar en b uscar la palabra cuando la quiere utilizar
en el discurso o porque no sien te el esfuerzo producido al buscar la. Por otro lado , las
palabras parcialmente disponibles son aquellas el individuo conoce y utiliza pero no
siempre están disponibles. No son fá cilm ente recordables y requieren un esfuerzo
consciente encontrarlas por lo que no todos los informantes de las pruebas las
incluyen entre sus respuestas.
Para determinar el tiempo necesario, Dimitrijevi ć realiza un estudio piloto en
Queensfer ry donde asig na cuatro minutos a cada centro de interés. Comprueba que
47 «The centre of interest h ad to deal with those words that are fam iliar to children, that can be a rranged
witho ut much overl appin g between the centre s and which together represe nt a conside rabl e part of children’ s
vocabulary» (Di mi tr ij evi ć , 1969: 16) .
48 « The test had a time limit, each centre of interest being all otted the same lengt h of time. The informants
were asked to give « al the w ords t hey knew, as fast as they could» . T his means, in other word s, th at the t otal
output of le xical item s in on e centre, b y one pupil, co uld be c onside red as a k ind of in dicator o f his/h er verb al
fluency » (Dimitr ijevi ć , 1969 : 5).
49 « This di sti ncti on betwee n avail able a nd unavai labl e words bri ngs us to the not ion of the degr ee of av aila bili ty.
A word has 100 % deg ree avai la bi li ty if it is avail ab le to all inf orma nt s who take part in a test. The fewer the
number of informants who give a word the smaller degree of availabilit y of that word for that population, or
the easier a lexical item is recall ed by a person, a group of people, the more available this lexical item is (the
higher degree of avai labil ity i t has ) and v . v .» ( Dimitrije vi ć , 1969: 4).
Capítul o 2
Marc o t eór ico
63
solo algunos alum nos agotaban el tiempo permitido sin d ificultad mientras que la
mayoría terminaba antes o retomaba la tarea tras una pausa. Como la población de
estudio pertenecía a un medio rural y, según el autor, su nivel a cadémico era más bajo
que el de los alumnos de Edimburgo, decide aumentar en un minuto la prueba. De
esta form a, no solo se conseguir ía obtener realmente el léxico dispo nible del
alumnado sino también la capacidad de producir las palabras 50 .
Del primer ensayo se desprende la importanci a conferida a los factores que
influyen en la disponibilidad léxica. La s variables incorp oradas son el sexo, el medio
(rural y urban o), el tipo de cen tro educativo (disting uiendo entre Junior Se condary
Schools y Senior Secondary Shcools ), el estrato social (dividido en cinco grupos aunque
ningún informante perteneciese al primero) 51 y los resultados C. Q. (que combina el
cociente de inteligencia IQ que realizan los estudiantes antes de empezar la
secundaria junto con la evaluació n de lo s docentes). No obsta nte, el an álisis
cualitativo y cuantitativo del a rtículo solo recoge el sexo y el estrato social de los
alumnos.
Para el recuento de las palabras, Dimitrijevi ć introd uce el concepto de «lexic al
item», término que precisa de la distinción entr e vocablo y palabra . En el lengua je no
especializado existe la tendencia a usar ambo s términ os como sinónim os. Buen
ejemplo de ello se encuentra en la primera acepción de voca blo en el Diccionario de la
le ngua española puesto que aparece el término palabra en forma de hiperenlace 52 . Por
tanto, no solo se ind ica que son sinónimo s sino que además r edirige al significado de
palabra para definir vocablo. Aunque etimológicament e estos términos provienen de
voces diferentes, ambas se usan como equivalentes desde el origen de la lengua,
como muestra el Dicciona rio crítico etimológico de Corom inas.
50 « The ai m of thi s inve stig ati on was to find out what words were most availa ble t o boys and girl s, and how
many such words . If we want ed to eli ci t such words , i.e. not those words whic h the pupils knew and did not
use, but only those words that were always available to them, under any circumstances, the test had to be
limited in time » (Dim itrijevi ć , 1969: 14).
51 La obra de refer encia es la catego rizaci ón se ti tula Clas sif ica tio n of occupati ons , 1960 , Ge neral Register Off ice,
London, Her Majest y’s Stati onery Off ice.
52 La consult a se ha realizado en línea el 20 de abril d e 2015 en la versión electrónica del Dicci ona ri o de l a lengu a
e spañola .
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
64
Por su parte, la entrada de vocab lo se inserta como un derivado culto de
v ŏ c ā re ‘llamar’, que proviene d e la raíz latina v ō x .
En el ámbito de la lingüística estadística, en el que se inserta la presente
investigación, se incluye la distinción entre vocablo y palabra . Según Müller (1969: 31),
resulta muy complejo delimitar el segmento del discurso y máxime cuando se trata de
los tér minos vocablo , palabra y uni dad léxica 53 . Consciente de que cada autor establece
unas normas similares para diferenciar las unidades léxicas, M üller ( cf. 1969: 32) 54
aboga por la existencia de una norma convencional como la del sistema métrico
53 « Inutile d'insister sur les incertitudes de la lingu istique en ce qu i conce rne ce ‘ segment de discou rs ’ que le
sens comm un identifie co mme étant ‘un mot’ . Dire d'un e ph rase qu'elle est form ée d e 10 mo ts, o u dir e que le
texte d u Cid , par exemp le, en comp te 16 690, c ela sup pose soit un e défin ition a ssurée du m ot co mme unité de
texte, te lle que jam ais ce lui qu i com pte ne p uisse h ésiter ou n e do ive ar bitrer de fa çon subjective , soit une
norme conventionnelle prévoyant to us les cas do uteux. […] Les difficultés ne font que croître quand o n passe
de la dé limitati on du mot à c elle d u vocable, unité de lexique» ( Mül le r , 1969: 31).
54 « On ne saura it épuis er cett e ques ti on 1. Dison s seul eme nt qu' à l'h eur e actu el le , en fran çai s comme dans
d'autres idiomes, chaque auteur de dépouillements lexicaux est contraint de se poser la question et, finalement,
de construire sa propre norme. [.. .] On ne peut que souhaiter, au moins pour le français moderne, l' adoption
d'une norme convention nel le, même discut able aux yeux du linguiste, mais acceptée comm e le fut le système
métr iq ue. En att end ant , il est néc ess ai re qu e cha que cher che ur i ndiq ue, au moi ns s ommai reme nt, sur quel le s
bases i l a trava illé» ( Mül le r , 1969: 32) .
PALABRA, del anti guo parabla y éste del lat. parab ŏ la ‘co mp arac ión, sím il’, que a s u vez v ino
del gr. Π a ρ a β o λń ‘com pa ració n, a legor ía’ (d e π a ρ a δ á λλειν ‘po ner al lad o, comp arar’; β á λλειν
‘echa r’); en r oma nce se pasó de ‘comp arac ión’ a ‘fr ase’ y lueg o ‘vocab lo’. 1.ª do c.: orígene s
del i dioma (Cid, etc .).
De uso gener al en tod as las época s y común a todos los roma nces de O ccident e. La for ma
arcaica paravla o parabla se lee todavía en A lex. El sen tido etimo lógico se nota tod avía en
textos arcaico s: e n Berceo Mil, 16b es ‘frase’ o ‘co mp aración ’, en A lex., 401 será ‘refrán’ o
‘sente ncia’; lo m ás co mún es halla r d esde el principio (p. Ej. E n el Cid) usos sem ánticos que
no difi eren esencialment e de l os modernos, aunque también en el los se podría tr aducir
palabra por ‘ frase ’ ( estas pala bras f abló) (Corominas, 1974 [1954] , t omo IV, p. 616).
VOZ, del la t. v ō x , v ō cis , ‘sonid o prod ucid o por el aire expe lido por lo s p ulm ones a l h acer
vibrar l as cuerdas vocables’. 1.ª do c: C id.
Vocal [le tr a vocal , hac ia 1250, Set ena ri o, 4. 20; A. DE PAL. 535B: «voca les se dize n las letras
que de po r sí fazen boz» ; Neb r.; oració n vocal, Sta. Ter esa, los voca les del Con cilio, fin S.
XVI, Aut. ], tomado de v ō c ā lis ‘hecho co n la voz ’, ‘sono r o’, ‘vocal’; vocá lic o, vocalismo;
vocalista ‘el cantor, músic o vocal’ [1834]; vocalizar; vocalizac ión; vocal izador.[…]
Deri vados cul to s de v ŏ c ā re ‘llam ar’ (d e la mis ma r aíz que v ō x): Vocablo [APal. 9d, 141d,
535b; Nbr.; en escrituras en bajo latín encon tra mos v ocabu lo (o vog abulo 1 081, Oe lsch.)
con el sentido ‘por nomb re, llamado’], de v ocabul ŭ m ‘d eno min aci ón’, ‘no mbr e’ , ‘pal ab ra ’,
‘térm ino’; v ocab ulari o [« v. Vocabularium» Nebr.] ( Coromi nas , 1974 [1 954] , tomo V, p. 845) .
Capítul o 2
Marc o t eór ico
65
sobre la cual pudiesen basarse los estudiosos. Mientras tanto, propone al investigador
la elección de unos determina dos criterios debidamente argu mentados sobre los que
fundamentar su estudio .
Müller (1963: 31 - 32) va más allá y distingue entre dos acep cio nes del término
genérico palabra . Por una parte, hace mención a la un idad que constituye el texto y,
por otra parte , a la unidad de léxico. A la primera acepción corresponde literalm ente
al término palabra y, a la segunda se ajusta voca blo, entendido co mo los términos que
aparecen en la nomenclatura de un diccionario y que forman el vocabulario de una
lengua. Trasladando ese enfoque al estud io de disponibilida d léxica, los vocablos se
refieren al número de palabras diferentes y las palabras a las unidade s de texto
producidas por los informantes, es decir, al número de ocurrencias de los vocablos.
En la mayoría de las investigaciones de disponibilidad léxica se añade esta distinción,
de manera más o m enos explícita, coincidiendo con las sig uientes definici ones:
A pesar del consenso a la hora de utilizar vocablo y pa labra en los estudios de
disponibilidad léxica, en algunas investigaciones se realizan puntualizaciones sobre su
uso y que se completa con el término unidad léxica . Según Dimitrijevi ć (1969: 4 - 5) 55 ,
en ocasiones las palabras co ntabilizadas en los estudios de disponibilidad léxica y
entendidas como unidad de texto, comprend ían más de una palabra. Por tanto, el
término más adecuado ser ía el d e unidad léxica , como unidad d e sig nificado que puede
estar formada por más de una palabra. Ejemplo de ello, son las ent radas léxicas
formadas por más de una palabra, tales como, intestino grueso , disco duro , ama de casa , etc.
55 « We have jus t said that there was no restriction in the test, as to what word s ha d to b e given , as far as they
were availabl e to the informant s. This had led to the eli cita tio n of one, two or more words which had to be
taken as one sing le ‘unit’ or response, such as ‘ra ilway station ’ , ‘fresh a ir’, etc. Beca use of such ‘multi wo rd
responses’ we have a dopted the term ‘lexical item’ denoting all kinds of responses - thos e resp onses consis ting
of one, two or more w ords. O ther alter native terms could be ‘lexica l ph rase’ , ‘lex i cal term’ o ‘lexica l u nit’»
(Dimitr ijevi ć , 1969: 4 - 5).
Palabra [...] cada una de las uni dades léxi cas empleadas, t anto a isl adas c omo unidad es
complejas o combinación d e lexemas p ara designar u n referente, repetidas o no, q ue
integr an un texto (Ayo ra E steba n, 200 6: 87).
Vocab lo[ .. . ] cada una de las unidades léxicas distintas que registra un diccionario de
frecuenc ias. Pro porcion a info rmac ión sobre las cate gorías gramaticales co n q ue se reflejan
en el acto discursivo (Ayora Esteban, 2006: 87).
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
66
En esta misma línea, Gómez Devís (2004: 43), analiza el significado de unidad léxica
recogiendo la perspectiva de diferentes investigadores y concluy e que en el ám bito de
la estadística léxica el vocablo se entien de como unidad léxica.
Una vez e sbozados estos conceptos clave , a modo de inciso, a continuación se
reanuda la presentación por orden cronológico de las investigaciones que marcan de
una for ma u otra la metodología de la disponibilidad léxica actual. Este es el caso del
trabajo publicado en dos tomos por Mackey ( 1971 a) : el primero titulado L e vocabulaire
disponible du français. Le vocabulaire concret usuel des français et acadiens: étude témo in y, el
segundo, Le Vocabulaire disponible des enfants acadiens . Se podría considerar como la
primera investigación basada en la obra pionera puesto que las indagaciones inicial es
remontan a los años 1958 - 1959 56 .
El estudio se inicia a través de un proy ecto en las regio nes de Que bec y
Manitoba respaldado po r el Centre International de Recherches sur le Bilinguisme de
la Universit é Laval situado en Que bec con objeto de comparar las variedades léxicas
de diversas regiones francesas y canadienses. En alguna s regiones bilingües, los
hablantes realizan la prueba con cinco centros de interés complementarios en inglés .
Debido a la falta de consenso metodológico entre las universidades implicadas, se
crea un comité interuniversitario que en 1963 m arca las pautas de recogida,
procesamiento y análisis de datos y consensúa las divergencias. Por ejemplo, los
centros de interés seleccionad os en Montreal y en Laval eran diferentes ya que en
algunos casos se unificaban algunos centros tradicionales y en otros se añadían
nuevos. Para permitir el parangón con los datos recopilados en Le Français
Fondamental y a su vez dar respuesta a los objetivos del proyecto canadiense, se
mantienen lo s dieciséis cen tros tradiciona les y se añaden los siguientes: 17) l’église et la
vie paroissiale , 18) les sports et l’équipement , 19) les outils , 20) l’automobile et ses parties , 21)
actions courantes y 22) les affaires .
Es precisamente la fidelidad a la metodología aplicada en la investigación
francesa la que marca el inicio de las com paraciones interm uestrales en el campo d e
56 El proyecto de inves tig aci ón de Dimi tri je vi ć (1969) fue in iciado con p osterioridad , en 1963 , aunq ue la
publicac ión fue anteri or a la de Mackey (19 71).
Capítul o 2
Marc o t eór ico
67
la disponibilidad léxica a través d el léx ico disponible de F rancia y de Can adá 57 . Sin
embargo, en el prefacio el autor expone que más que presentar una comparación
entre dos vocab ularios en sí m isma, la obra intenta ex plicar la forma de llevarla cab o
para proporcionar las he rramientas adecuadas a futuros inves tigadores 58 .
Por una parte, se compara el grado de disponibilidad de las palabras en las dos
listas y, por otra parte , se analiza n las palabras que solo están presentes en u no de los
vocabularios. Para acom eter tal ob jetivo, asistentes de lingü ística y estudiantes
corrigieron a mano las listas im presas por or den alfabético tanto del vocabulario de
Francia como de Acadia para evitar fundamentalmente tres tip os de situaciones:
• Una palabra se presenta en singular en un a lista y en otra en plural.
• Una palabra aparece en género masculi no y en otra lista en femenino.
• Una palabra compuesta, una locución o un grupo de palabras pueden ser
clasificadas como palabras única s en una lista y en la otra n o. E sas palabras
compuestas pueden aparecer con o sin guión, por ejemplo el caso de pois y
petit pois , football o foot - ball .
Surgen así las primeras reglas o pautas de lematización para permitir que dos
vocablos iguales, como pied y pieds no fuesen considerado s como lexía s difer e ntes. Se
fija la h omogeneización de las palabras en númer o singular y género masculino pero
en el caso de las palabras com puestas no se establece una regla fija.
Las encuestas fueron realizadas mediante listas cerradas de 20 palabras a niños
de entre 9 y 12 años (la misma edad de los estudios franceses) de 20 clases diferentes
en 12 escuelas. C abe destacar que en un primer momento se recopilar on datos de
1745 alumnos de 9 a 18 años, repartidos en 47 clases y 19 escuelas en las diversas
regiones francófona s del Nouveau - Brunswick pero se eliminaron los resultados de
los niños de 13 a 18 años para facilitar la comparación con el vocabulario de Francia.
Asimismo, en algunas regiones bilingües, los sujetos realizaron la prueba de léxico
57 « Il a pour but non seulemen t de fourn ir la documentation pour une comparaison du vocabulaire commun de
deux régions francophones, mais également de servir d'étude témoin à d'autres étud es analogues » (Mack ey,
1971a: 13) .
58 « L'ét ude ne va pas assez loin pour établir les comparaisons entre les deux vo ca bularies. Elle se borne à
fournir les outils à c eux qui entreprenn ent une telle co mparaiso n. Elle n'ex ploi te pas la docume ntat ion; elle
explique simplement comm ent cette documentation a été obtenue » (M ackey, 1 971a: 11).
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
74
basaa y el francés de Camerún que entre el francés de Francia y el francés de
Camerún.
La investigación concluye que el bilingüismo supone un factor de
enriquecimiento en los hablante s bilingües ya que describen mejor la realidad que los
monolingües y, por tanto, son capaces de comprender mejor el medio sociocult ural
en el que viven. En cuanto al francés de Francia , con sidera que es inadecuado para
describir la realidad sociocultura l africana. Sin embargo , resalta la tendencia de las
lenguas africanas a utilizar préstamos de otra s lenguas en lugar de potenciar la
creación léxica co n términos nuevos lo cales para describir la África moderna y sus
realidades.
La primera investigación en inclu ir la disponibilidad léxica en lengua esp añola ,
además de en inglés, corresponde a la obra de Vict ery (1971). A cont inuación, le
siguen investigaciones realizada s en Puerto Rico (López M orales, 1973, 1978, 1979;
Román, 19 85), en Méxic o (Justo Hernández, 1986 68 ; Cañizal Arévalo, 1987, 1991;
Ruiz Basto, 1987); en España (Azurmendi Ayerbe, 1983; Benítez Pérez, 1992) y en
Chile ( Echeverría, Herrera, More no y Pradenas, 1987; Men a Osorio, 1986), entre
otros.
No obstante , la metodología segui da por los estudios hispanos difería de un
investigador a otro lo que dificultaba la comparación intermuestral (centros de
interés, tiempo de la prueba, lematiza ción de las palabr as, etc.) . Por ello, durante el XI
Congreso Internacional de la Asociación de Lingüística y Filología de la A mérica
Latina (ALFAL) que tuvo lugar en Las Palmas de Gran Canaria, expertos en el
ámbito de la disponibilidad léxica decidiero n consensuar algunas pautas generales
procesuales y analíticas. No será hasta 1999 cuando tenga l ugar en la Universidad del
País Vasco la reun ión científica que establecerá los objetivos y la metodología del
Proyecto Panhispánico de Disponibilidad Léxica. El objetivo del Panhispánic o,
c oordinado por López Morales, es conocer el léxico disponible de lo s diferentes
países hispanohablantes a través de diccionarios de disponibilidad creados bajo los
68 A difere ncia de la tendenc ia de otra s inves ti gaci ones , el invest iga dor mexic ano trab aja con list as cerr adas de
diez palabr as por cent ro.
Capítul o 2
Marc o t eór ico
75
mismos principios. De forma general, las bases sobre las que se asientan son las
siguientes:
• La recogida de datos se realiza mediante una encuesta de léxico di sponible que
utiliza los dieciséis centros de interés tradicionales: 1) El cuerpo humano ; 2) La
ropa ; 3) Partes de la casa (sin los muebles) ; 4) Los muebles de la casa ; 5) Alimentos ; 6)
Objetos colocados en la mesa para la comida ; 7) La cocina y sus utensi lios ; 8 ) La escuela:
muebles y materiales ; 9) Calefacción, iluminación y medios de airear un recinto ; 10) La
ciudad ; 11) El campo ; 12) Medios de transporte ; 13) Trabajos del campo y del jardín ; 14)
Los animale s ; 15) Juegos y distracciones ; 16) Profesiones y oficios .
• El tiempo de la pru eba está limitado a dos minut os por ce ntros de interés.
• Las listas son abiertas donde el sujeto puede escribir todas las palabras que le
vengan a la mente.
• La población objeto de estudio está formada por estudiantes de nivel
p reuniversitario (concretamente en el curso anterior que da acceso a la
universidad). De esta forma, se pretende h omogeneizar la edad, el nivel de
instrucción de lo s hablantes e in cluso el léxico ya que se consider a que esos
estudiantes no han adquirido los términos técnicos con estudios superio res.
• La edición de los datos atiende a un protocolo previamente acordado donde
se incluyen directrices para la transcripción de los ma teriales, lematización de
sus palabras y eliminación d e ciertos vocablos 69 .
• La fórmu la m atemática recomendada para calcular la disponibilidad léxica es
la elaborada por López Chávez y Stras sburger Frías (1991).
• Las variables utilizadas corresponden al sexo, nivel sociocultural, zona
geográfica (urbana o rural) y tipo de centro (público o privado).
• Los listados se publican en forma de diccionarios, usualmente ordenados por
orden alfabét ico y por orden decreciente de disponibilidad, pero también
puede estar organizado según variables determinadas, como el sex o o el
estatus social, entre otra s.
Con objeto de coordina r el trabajo de los diversos estudios disponibles, se
celebraron otros tres en cuentros: el II y III Encuentro Internacional de
69 Un a d e l as ob ras de referencia en este sentido es Samper Padilla (1998) y Sam per et al. (2003: 95 - 101).
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
76
Disponibil idad Léxica se realizaron en el año 2003 y 2005 en San Millán de la Cogolla
(La Rioja) y el I V Encuentro de Disponibi lidad Léxic a tuvo lugar en Salam anca 70 en
2011 . A lo largo de estos añ os, se han llevado a cabo n umerosos trabajos aplicando
esta metodología no solo en estudios de d isponibilidad léxica en español a hablantes
de lengua materna sino también a estudia ntes de español como lengua ex tranjera y
hablantes y estudiantes de otras len guas 71 .
2.4. Investigaciones relacionadas con el léxico disponible
No cabe duda que aunque el francés diera vida al campo de la disponibilidad
léxica, el español es la lengua en la que se han desa rrollado la mayoría de los estudios
sobre todo gracias a l empuje recibido por el Proyecto Panhisp ánico de
Disponibilidad Léxica. En los apartados anteriores se ha realizado un recorrido por
las primera s investigaciones y se h an abordado los principales cambios
metodológi cos desde sus orígenes hasta la actualidad. El objetivo de este apartado es
encuadrar el actual estudio en las investigaciones de español como lengua materna y
en inglés o francés como lengua ex tranjera.
En prim er lugar, se m encionan las principales investigaciones en lengua
española p artiendo de Puerto R ico, país donde Lóp ez Morales comienza realiza su
primera investigación sobre disponibilidad léxica, pasando por otros países
hispanoamericano s hasta llegar a Es paña, donde los estudios se dividen por
comunidades autóno mas. En cuanto al esp añol como lengua extranjera o segunda
lengua, cabe mencionar el florecimiento de las investigaciones en este ám bito en los
últimos años. El precursor, Carcedo González (2000c), analiza el léxico disponible de
españ ol como lengua extranjera de estudiantes fin eses. Por las características del
presente estudio, se han recopila do las principales investigaciones en inglés como
lengua extranjera.
70 Ag rade zco tanto a los organizad ores d el men cionado e nc uentro como a los directores del presente trabajo
que permitier an mi asist encia.
71 E l equipo de Dis polex recoge las referencias bibliográficas de más de 350 estudi os public ado s sobre la
disponibili dad léx ica y el directorio con los investigadores principales en este ámbito. [Consultado en
www.dis pole x.com el 19 de agos to de 2 014] .
Capítul o 2
Marc o t eór ico
77
En cambio, en francé s como lengua ext ranjera no se ha dedicado ningún
apartado específico debido al escaso número de investigaciones. Aparte de los
estudios de Mackey en Canadá (1971 a, 1971b ), se han localizado investiga ciones en la
provincia canadiense de Manitoba, zona donde el inglés es el idioma oficial de facto y
el francés es el idioma oficial de eure . Las prin cipales indagaciones han sido llevadas a
cabo po r la investigadora Rodri guez , especializada en los estudios de variación
geolingüística en Canadá (Rodriguez , 1993, 2004, 2006, 2007 , 2009, 2010). Asim ismo,
Dupré (2007) realiza un estudio comparativo sobre estudiante s bilingües en la región
de Manitoba (Saint - Lazare) y Ontario (Otawa) y analiza más en detalle la
disponibilidad léxica de los alumnos en Otawa en su tesis de doctorado (2 002) bajo la
dirección de Bougy y Rodri guez. En cuanto a las antiguas colonias francesas,
destacan los estudios de F all (1976) y Gontier (1986) en Senegal y Njock (1978 ) en
Camerún.
2.4.1. En español como leng ua matern a
2.4.1.1. En Hispanoamé rica
A pesar de que la primera investigación en lengua española la llevase a cabo
Victery (1971), por la envergadur a de los trabajos de López Morales se le considera el
precursor de la disponibilidad l éxica en español. Asimismo, Victery (1971) trabaj a con
una muestra variada (alumnos monolingües en Méx ico, alumnos bilingües y
monolingües de Estados Unidos) y analiza la disponibil idad léxica en español y en
inglés mientra s que López Mora les ( 1973 ) realiza un estudio sociolingüístico sobre
una muestra de 63 escola res de dos sociolectos de San Juan (Puerto Rico). Los
centros de interés seleccionados son los siguiente: 1) Alimentos ; 2) Animales ; 3) La casa ;
4) La cocina ; 5) El cuerpo humano ; 6) Materiales de construcc ión ; 7) Muebles ; 8) La ropa ; 10)
Transportes .
Lóp ez Morales (1978) utiliza ese léxico de los escolares de la región
metropolitana de San Juan de Puerto Rico recogido en el estudio de 1973 para
compararlo con el léxico frecuente de preescolar es puertorriqueñ os llevado a cabo
por Rodríguez Bou en 195 2. Tras cotejar la s dos obras (López Morales, 1973 y
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
78
Rodríguez Bou, 1952), López Morales (1978) manifiesta la gran diferencia encontrada
en ambos listados no solo por la diferencia de edad de los informantes estudios y su
consiguiente tiemp o de aprendizaje si no también por la metodología empleada para
crear el léxico frecuente y el léxico dispon ible.
En esa misma lí nea, López Morales continua con el estudio de la
disponibilidad des de dos vertientes: la sociolingüís tica y la lingüística aplicada a la
enseñanz a de lenguas. Por un lado, en 1979 se sirve del índice de disponibilidad para
analizar y comparar cualitativa y cuantitativamente el léxico disponible de tres
estratos sociales (bajo, obrero y medio) de la muestr a d el estudio Sa n J uan d e Puerto
Rico de 197 3. Por otro lado, en 1986 destaca la importancia del léxico disponible en
la selecció n del voca bulario. Su propuesta pasa por incorporar a los listados de léxico
frecuente los resultados del léxico d isponible.
Ya en 1991 72 , Ló pez Morales destaca la import ancia que había cobrado la
disponibilidad léxica en los años precedentes. C on objeto de seguir impulsando los
estudios en este ámbito, López Morales y García Marcos (1995) coordinan el
proyecto de investigación de disponibilidad léxica en Andalucía del que surgieron
trabajos en Almería (Mateo García, 1996, 1998) y en C ádiz (González Martínez ,
2002), entre otros. Un año más tarde, López Morales (1996) hace una revisión de los
primeros trabajos en este ámbito, de la forma de calcular la disponibilidad léxica y de
las principales aplicaciones de la d isponibilidad léxica en otras discip linas tales como,
la d ialectología, la so ciolingüística, la psicolingüística, la etnolingüística y la lingüística
aplicada a la enseñanza de la lengua.
En 1999, López Morales es tudia el léxico d isponible de P uerto Rico a partir
de una muestra de 558 estudiantes universitarios de primer año. La prueba incluye los
16 centros del Français Fondamental aunque con ligeras modificaciones para adaptarlos
al clima del país y a la muestra de estudio: chauffage se sustituye p or aire acondicionado y
école por universidad . C on ob jeto de realizar un estudio socio lingüístico, la prueba
72 «Lo relativo a la dispo nibilidad léxica ha experi mentado un auge sin precedente s desde la presentaci ón de
López Morale s en 1978. En aquel momento, l a disponi bili dad sólo se tra bajaba a b ase de f recuenc ias, s iguie ndo
el patrón d e análisis establecido por los iniciadores fran ceses (Michéa 195 7, G ougenh eim 1967); así había sido
elaborado el Proyecto de disponibilidad léxica en escolares de San Juan (López Morales 1973) del qu e sólo un
par ll egaron a la letra impresa (López Moral es 1978, 1979) » (López M orale s: 1991: 12).
Capítul o 2
Marc o t eór ico
79
incorpora va riables sociológicas referidas a l sexo, nivel sociocultural, zona geográ fica
y tipo de escuela donde los inform antes estudiaron antes de ir a la univer sidad.
Tomando como base los datos recopilados en ese estudio, en 1999b el
investigador abor da más específicam ente los anglicismos presentes en esos listados.
Asimismo, otros autores comparan los listad os puertorriqueños con distintas
variedades del español: López Chávez (1992, 1995) realiza el cotejo con el inventario
de Madrid, Las Palmas, República D ominicana y Puerto Rico; Alba (1998) lleva a
cabo una compa ración dialectal que incluye los listados de República Dominicana,
Madrid, México, Concepción (Chile) y Puert o Rico; González Martínez (2000 - 2001)
compara el léxico puertorriqueño con el léxico gaditano; Carcedo Gonz ález (2003)
añade a los listados de Puer to Rico y Cádiz el de Asturias, etc.
Tras l a merecida introducción de los trabajos de López M orales y siguiendo la
demarcación geográfica, se comentan algunos de los principales trabajos llevados a
cabo en América, por países y siguiendo el orden de publicación del primer trabajo
en el ámbito . En E spaña, debido a la vasta literatura en este campo, los estudios se
presentan según comunidade s autónomas.
En Puerto Rico, Belén Román (1985) reali za su tesina sobre una muestra de
293 estudiantes de primer, tercer y quinto grado del Distrito Escolar de Do rado
utilizando los 10 centros de interés presentes en López Morales (1973). Entre las
conclusiones del trabajo , cabe destacar la relación que guardan los resultados de
disponi bilidad léxica con las variables sociológicas del estudio: grado escolar, sexo,
zona de procedencia y niv el socioeconómico.
En 1987 , Butrón hace una revisión de la fórmula matemática de la
disponibilidad en un estudio en el que analiza el léxico de alumnos d e escuela
elemental. P osteriormente , Butrón (1989) analiza algunos aspectos sociolingüísticos
que influ yen en el léxico disponible p resentado en 1987. Asimism o, en 1991
incorpora nuevos índices representativos de la disponibilidad léxica: disponibilidad de
centros para un grupo, disponibilid ad de léxica d e un informante y disponib ilidad
léxica de un grupo.
En 2013, Fuster Pérez examina el léxico de una muestra de 60 estudiantes de
primer año de la Universidad de Puerto Rico estratificada según sexo (30 hombr es y
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
80
30 mujeres) y según el tipo de centro educativo (30 provienen de la escuela pública y
30 de la escuela privada). El estudio recoge tan solo cuatro cen tros de interés, de los
cuales realiza un análisis cuantitativo : 1) Comidas y bebidas ; 2) La ciudad ; 3) Ju egos y
distracciones ; 4) Profesione s y oficios . El análisis cualitativo lo realiza solamente sobre el
centro de interés Juegos y distr acciones el cual compara con el léxico recogido por López
Morales 23 años antes, es decir, en 1990 73 . Cabe mencio nar que p ara la comparación
solo se tuvieron en cuenta l as 100 unidades léxicas más disponibles ya que el límite de
tiempo en López Morales era de cinco minutos y el de Fuster Pér ez (2013) dos
minutos.
En Chile , el estudio pionero en disponibilida d léx ica corresponde a la tesis de
maestría real izada por Mena Osorio (1986) a un grupo de 300 escolares de 4 . º, 6 . º y
8. º grado de educación básica bajo la dirección de Echeverría , considerad o el
impulsor de la dispon ibilidad léxica en ese país. Se trata de la prim era investigación
que establece como límite temporal dos minutos por cada centr o d e interés y que se
ha convertido en la pauta seguid a por la mayoría de investigad ores.
Echeverría (1987) dirige el equipo de investigación compuesto por Herrera,
Moreno y Pradenas que se encarga de realizar la disponibilidad léxica de 200
estudiantes de primer curso y 200 de tercer curso de E duc ación Media de
Concepción . El estudio incluye el cálculo del índice de co hesión , ta n ex tendido en
numerosas investigaciones, y divide los centros de interés según ese grado de
cohesión semántica, distinguiendo entre centros de alto grado: 1) Cuerpo humano , 2)
Medios de transporte , 3) L a ropa , 4) Muebles , 5) Herramientas y materiale s de construcc ión , 6)
Alimentos , 7 ) Animales ; y centros de bajo grado 8) Naturaleza , 9) La casa y 10) La coc ina .
En 1991, Echeverría realiza un estudio comparativo del léxico de estudiantes de nivel
básico y nivel medio recogidos en los estudios anteriormente mencionados (Mena
Osorio, 1986 y Echeverría et al. , 1987 ). En el análisis destaca que adem ás d el nivel d e
escolaridad, la variable que m ás influye en el léxico dispon ible es la procedencia
sociocultural.
Ese mismo año, V argas Sandoval (1991) pretende conocer el léxico hablado
por la clase m edia de los adultos de la Región de Valparaíso. La muestra de estudio
73 Los datos del est udio de López Morales (1999) fueron r ecopilados e n 1990.
Capítul o 2
Marc o t eór ico
81
está formada por 500 informantes entre 20 y 50 años de las doce ciudades más
pobladas de esa región (San Antonio, La Ligua, Quillota, La Calera, Limache, Llay -
Llay, Quilpué, Villa Alemana, San Felipe, Los Andes , Valparaíso y Villa del Ma r). Los
centros de in terés an alizados son nuevos: 1) Arte ; 2) D erecho ; 3) Economía ; 4) Política ; 5)
Sentimiento ; 6) Teología .
En 1997 comienza un proyecto de investigación de tres años de duración bajo
la dirección de Echeverría destinado a la creación de tres p rogramas infor máticos
para la enseñanza del español. Concretamente el programa denominado Vocabulario
disponible trata de b uscar una aplicación práctica al léxico disponible dentro de la
lingüística aplicada a la enseñan za de una lengua. El léxico incorporado forma parte
del estudio de Valencia Espinoza y Echeverría (1999) que analiza el léxico disponible
de los estudi antes chilenos de todas las regiones del país. El número de informantes
asciende a un total de 2052 escolares de 4 . º año de educación media que aportan
información sobre el sexo, nivel sociocultura l, régimen educativo, región y
procedencia poblacional. Trabajan con 18 centros de interés, en su mayoría diferente s
a los tradicionales, lo que dificulta la comparación con otros estudios del Proyecto
P anhispánico 74 .
A partir de los listados del léxico disponible de Chile, Arancibia Manhey
(2006) analiza las unidades léxicas procedentes de lenguas indíge nas, concretamente
del mapudungu n, el quechua, el n áhuatl, el caribe , el arah uaco, el kunza, el kuna, el
taíno y el gu araní. La investigador a extrae 301 vocablos provenientes de algu na de las
10 familias aborígenes de América y los presenta ordenados alfabéticamente según el
centro de interés y con indicación de la lengua de origen y la frecuencia abso luta .
Las lenguas más productivas son el quechua y el mapudungun y las menos el
aymara, el kuna y el kunza. La influencia de diferentes culturas queda patente en las
unidades léxicas aportadas por los informantes chilenos ya que , por ejemplo , en el
centro d e interés denom inado Mundo espiritual aparecen vocablos provenientes de la
74 1 ) Partes del cuerp o ; 2) Ropa y calzad o ; 3) La casa ; 4) Muebl es , 5) Alime nto s ; 6) La coci na ; 7) Medi os de trans po rte ; 8)
Trabaj o de l campo y del jar dín ; 9) Plantas y ani males ; 10) Juegos y entretenim iento ; 11 ) Profesi ones y of icio s ; 12) La po lít ica ;
13) La ac tiv idad e conó mica ; 14 ) Las art es ; 15) Cie ncia y tecnol ogí a ; 16) Mundo espi ri tua l ; 17) Proce sos mentales ; 18 )
Proble mas de l ambi ente .
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
82
mitología de la Isla de Chiloé ( caicai - viú , caleuche , pincoya ) y de la zona a ndina ( Viracocha
y Mamacocha ).
Según Aranci bia Manhe y ( cf. 2006: 71) en los primeros tiempos de la
Conq uista y la C olonia l a lengua española introdujo los vocablos de los productos
autóctonos. Por esta razón, la mayoría de las entradas léxicas procedentes de lenguas
indígenas q ue forma n parte del acerbo lingüístico esp añol se localizan en el cen tro de
inter és Plantas y animales , seguido de Alimentos y Trabajos del campo y del jardí n . Por
ejemplo, en el centro d e Alimentos aparecen vocablos como maíz, cacao, mate, chocolate,
papa, tomate ; en el centro de Plantas y animales se registran las palabras coca, y erb a mate,
chirimoya, puma ; en la Ropa y calzado se encuentra alpaca , etc.
Echeverría, Urzúa e Figueroa (2005) presentan una nueva aplicación
informática para calcula r el índice de disponibilidad denominada «Dispogen II». Un
año más tarde, Urzúa, Sáez y Echeverría (2006) estudian la disponibilid ad léxica de
estudiantes y profesores de la carrera de Ingeniería Civil Ma temática en la
Universid ad de Co ncepción . La muestra está compuesta por 85 informantes, 71
estudiantes (dividid os en tres nive les según el curso en el que estaban m atriculados) y
14 profesores. Los seis centros de interés se adaptan a la muestra de estudio: 1)
Cálculo ; 2) Álg ebra ; 3) Estadística ; 4) Física ; 5) Educaci ón ; 6) Geometría . El objetivo es
conocer cómo evoluciona la adq uisición de ese vocabulario específico en función de
los años d e estudio en ese ámb ito y reflexionar sobre los errores y lagunas léx icas de
los estudiantes para intentar tomar medidas al respecto.
Ferreira (2006) presenta su tesis de m agíster sobre la disponibi lidad léxica en
inglés como lengua materna y como lengua extranjera sobre la que más tar de, en el
año 2010, publica un artículo junto con Echeverría. En su trabajo destaca la
aplicación de la psicolingüísti ca a los estudios de disponibilidad léxica a través del
análisis de las relaciones de palabras con el programa DispoGrafo, aplicación
presentada años más tarde en un artículo por Echeverría, Vargas, Urzúa y Ferreira
(2008) 75 . Se trata de la primer a herramienta informática que contabiliza el número de
75 El so ftwa re fue cre ado por Ec heve rrí a y Varg as Opit z en 2006.
Capítul o 2
Marc o t eór ico
83
relaciones entre dos palabras, los clusters y que, además, es capaz de representar de
forma gráfica esa organ ización de palabras en cada centro de interés 76 .
Fasce, Echeverría, Matus, Ortiz, Palacios y Soto (2009) publican un artículo
interdisciplinar en la Revista médica de Chile . El fin del estudio es conocer los atributos
o cualidades que estudiantes de medicina y médicos en ejercicio identifican como
recomendables para el ejer cicio de la profesión a través de la disponib ilidad léxica .
Las investigaci ones en México comienzan en 1986 con la tesina de licenciatura
de Justo Hernández, Disponi bilidad léx ica en colores . La muestra está formada por 56
informantes adultos (2 6 mujeres y 3 0 hombr es) y las varia bles sociocultura les
incluidas en el estudio son el sexo, el tipo de enseña nza y la ubicación escolar. El
principal objetivo consiste en conocer los nombres de los colores más dispon ibles
relacionados con diez centros de interés mediante el sistema de listas cerradas en los
que los informantes so lo tenían que escribir diez nombres de colores en cada
centro 77 .
Cañizal Arévalo (19 87) analiza la influencia de ciert os factores sociológ icos
como el sexo, el tip o de escuela (pública y privada) y las horas de exposición a la
televisión en seis centros de interés en una muestra de 68 escolares de primar ia. Al
igual que Justo Hernández (1986) la autora pretende recoger ad jetivos dispon ibles de
forma inclu ye el centr o de interés Defectos físicos y morales para obtener mayores
resultados. Los otros cinco centros de in terés forman parte del listado tradicion al: 1)
Partes del cuerpo ; 2) Objetos que hay en el inte rior de la cas a ; 3) Alimentos y bebidas ; 4) Medios
de transporte ; 5) Profesiones y oficios . En 1991 , estudia la organización de las palabras de
un centro de inte rés destacando la existencia de un núcleo en torno al c ual se
organizan el resto de pala bras en forma de redes o con stelaciones.
Las contribuciones mexicanas más importantes vienen de la mano de López
Chávez y Strassburger Frías (1987, 1991) gracias a l a revisión de la fórmula
matemática que permite calcular el índice de disponi bilidad léxica 78 que es empleada
76 En el a part ado 6.5 se explica el funcionam iento del programa co n detalle y se presentan los análisis
realizados con el p rograma en este estudio. Agradecemo s la colaboración de Roberto F erreira quien nos facilit ó
el DispoGrafo y el Dispogen.
77 1) La ropa ; 2) Zapato s ; 3) Cosmé tic os ; 4) Automóv il es ; 5) Anunc io s comer ci al es ; 6) Moch il as, bol sas y malet as ; 7) Muebl es ;
8) Tapi ces y alfo mbras ; 9) Pintura de c asa ; 10) Vest i do .
78 Vi d. apartado 2.5 par a una r evisión de la fórmula matemátic a.
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
90
disponibilidad y el contenido de manuales de español como segunda lengua o lengua
extranjera utilizados en España y en el extranjer o y destaca que en ellos se encuentran
palabras con un alto índice de disponibilidad junto con otras con una disponibilidad
muy baja ( Benítez Pérez, 19 94b).
Una vez comentados los trabajos pioneros en España, se mencionan las
principales investigaciones en las diecisiete comunidades autónom as y las dos
ciudades autónomas por orden alfabético. En Andalucía, el proyecto de
disponibilidad léxica está dirigido por López Morales y García Marcos (1995).
Actualment e se han recopilado los léxicos disponible s de todas las provincia s : en
Almería realizado por M ateo García (1998), en Cádiz por González Martínez (2 002),
en Córdoba por Bellón Fernández (2003 ) 84 , en Huelva por Prado Aragonés y Galloso
Camacho (2005), en Mál aga por Ávil a Muñoz (20 06), en Jaén por Ahumada Lara
(2006), en G ranada por Pastor Millán y Sánchez García (2 008) y en Sevilla por Trigo
Ibáñ ez (201 1).
E xisten numerosos estudios que complemen tan a los anteriores y que en
algunos casos incorporan otros centros de interés o se basan en una muestr a de
estudio diferente . M ateo García (1994) co mpara el léx ico d el centr o d e inter és
Alimentac ión de una m uestra de Motril con el léxico disponible de Madrid recopilado
por Benítez Pérez (1992); Cruzado Romero (2003) ha realizado el estudio sobre los
preuniversitarios de Moguer y Ortolano Ríos (2005) sobre Ayamonte; G arcía Megía
(2003) estudia el léxico dispon ible de niños almerien ses entre 9 y 12 años ; Padro
Aragonés y Galloso Camacho analizan el léxico de los esco lares de sexto de Primaria
de Huelva; Ávila Muñoz y Villena Ponsoda (2010, 2011) analizan el léxico disponible
de Málaga sobre una muestra preest rat ificada de adultos, etc.
Asimismo, habr ía que incl uir la inve stigación realizada en Gibralt ar, terri torio
de ultramar de Reino Unido ubicado en la región andaluz a , donde Escoriza Morera
(2003, 2007) analiza el léxico disponible español en contacto con el inglés. E n
español como lengua extra njera destaca la tesis doctoral de Sá nchez - Saus Laserna
84 En el año 2003 reali zó su tesi s docto ral. No obstante , se ha con sult ado la o bra publicada como fruto de la
tesis en el a ño 2011 , Léxi co dis poni ble de la pr ovi ncia de Cór doba .
Capítul o 2
Marc o t eór ico
91
(2011) sobre el léxico disponible de estudiantes extranjeros que realizan una estan cia
en Andalucía.
En Aragón, el equipo de investigación formado por Castañer Mar tín, Enguita
Utrilla , Lagüéns Gracia , Beatriz Moliné y coordinado por Arnal Purroy publica en el
año 2004 el léxico disponible de esa comunidad. La muestra está formada por
informantes preuniversitarios de las provincias de Huesca, Teruel y Zaragoz a. En el
año 2008, el grupo de investigadore s presen ta un estudio desde diferentes disciplinas
(sociolingüística, p sico lingüística , lingüística aplicada a la enseñ anza de lenguas, etc.) a
partir de los datos recopilados anteriormente. Paralelamente, Arnal Purroy ( 2008 b)
analiza la incidencia de los niveles socioculturales en el léxico disp onible de Aragón y
en el año 2009 estudia los dialectalism os presentes en los listados .
En Asturi as, se publica en el año 2001 el léxico disponible de esa com unidad
gracias a la labor de Carcedo González. Además d e las variables sociológicas más
frecuentes com o son el sexo, el centro escolar, el tipo de com unicad y el nivel
sociocultural evalúa la zona geográfica desde un punto de vista lingüístico. Para ello,
Carcedo G onzález divide la comunidad en cuatro zonas se gún la variante lingüística:
zona gallego asturiano, zona bable 85 central, zona bable occidental y zona bable
oriental. Interesado en las variantes lingüísticas, el propio autor lleva a cabo con
posterioridad estudios com parativos con otras sintopías pen ins ulares e
hispanoamericanas (C arcedo González, 2003 y 2004).
En Cantabria, Fernández Juncal (2013) recopila el léxico disponible
proveniente de once municipios de las localidades de Santander, Torrelavega, Catro -
Urdiales, Mueridas, Santoña, Reinosa, San Vi cente, Ampuero, Ca stañeda, Meruelo y
Potes. Con anterioridad, Carrera de la Red y Bradley (2004 a y 2004b ) presentan los
estudios de disponibilidad en Cantabr ia, llevan a cab o un análisis d e los
extranjerismos e inician la recopilación de datos que Fernánde z Juncal continúa y
edita. Borrego Nieto y Fernández J uncal (2002) analizan el léxico de los habitantes de
zonas rurales y se centran en el estudio de los dialectalismos . Ga rcía C asero (2013) ha
estudiado el léxico disponible en Santander de estudiantes de último curso de la
Enseñanza Secundaria Obligatoria.
85 El ba ble hace re fer enci a a la le ngua tra dici onal de la mayor pa rte del Pr inci pado de Astur ias .
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
92
En Castilla la Mancha, Hernández Muñoz (2006) presenta el léxico disponible
de la comunidad. La m uestra está formada por informantes de las cinco provincias
castellano - manchegas : Ciudad Real con 220 s ujetos, Toledo co n 180, Albacete con
120, Guadalajara con 80 y C uenca con 80. Cabe destacar que anteriormente
Hernández Muñoz (2004) había estudiado el léxico disponible de Cuencia sobre una
muestra de 117 informantes.
En Castilla y León, los resultados d el léxico disponible no est án disponibles en
todas las provincias. Galloso Camacho (2002a, 200 2b y 2003) recoge los datos de
Salamanca, Ávila y Zamora; Bartol Hernández (2004) de Soria; Fernández Juncal
(2008) de Burgos y d e Santia go Guervó s (2008) de Sego via. Además, esta comunidad
destaca por coordinar el programa Dispolex y por publicar una gran variedad de
artículos: sobre lo s dialectalismos y el nivel de instrucción ( Fernández Juncal y
Borrego Nieto, 2002, 2003 ); el concepto de dispo nibilidad (Borrego N ieto, 2004); los
extranjerismos (Bartol Hernández, 2005); los r egionalismos de Ávila ( Llorente Pinto ,
2005); sobre el léxico disponible de inmigrantes en la comunidad ( Fernán dez - Merino
Gutiérrez , 2015 ), etc. Actualmente, González está r ealizando el léx ico disponible de
Palencia y Valladolid con lo que solo faltaría la provincia de León para completar los
estudios de disponibilidad en esa comunidad.
En Cataluña, Serrano Zapata (2003) r ealiza un estudio explorato rio sobre el
léxico dispo nible de Lérida con una muestra de 48 estudiantes preuniversitarios de
tres centros educativos de la cap ital. A continuación, estudia m ás en profundidad la
influencia de factores sociales (2004) y de transferencias léxica s (2006). En el año
2014 , presenta su tesis doctoral sobre el léxico disponible de Lérida sobre una
muestra de 240 sujetos preuniversit arios. Los informantes realizan las encuestas en
español y catalá n sobre 17 centros de interés (16 centros tradiciona les y Los colores )
contribuyendo así a los estudios realiz ados en comunidades bilingües como el País
Vasco (Azurme ndi Ayerbe , 1983).
Blasco, Torres, Pérez Edo y Forment han recogido los datos de Barcelona y
presentan los a spectos metodológicos del estudio en el XXXIII Simposio de la Sociedad
de Lingüística celebrado en Geron a en diciembre de 2003. Asimism o, Forment y Pérez
Capítul o 2
Marc o t eór ico
93
han recopilado los datos de Tarragona y Gerona durante el año 2 005 y 2006 pero no
todavía no han publicado los listados del léx ico disponible.
En Ceuta, la investigado ra Ayora Esteban ( 2006 ) analiza el léxico disponible
de Ceuta con una muestra de informantes de los cinco centros educativos de la
ciudad. Entre las variables socioculturales se incluyen el lugar de na cimiento del
informante y de los padres y la lengua materna ya que algunos estudiantes son de
procedencia marroquí (en la e tapa postobligatoria la presencia es menor que las
etapas ob ligatorias). Este estudio forma parte d el grupo de in vestigación Sem aínein
que pretende desarrolla r el léxico disponible de Ceuta, Melilla y Gibraltar y que
analiza el co ntacto de lenguas. Anterio rmente, Ayor a Estaban estudia centra dos de
sus publicaciones en ese aspecto, «La disponibilidad léxica en una situación de
contacto de lenguas» en 2002 y «De ficiencias en la adquisición del léxico como
problema específico de las lenguas en contacto» en 2004. En obras posteriores, la
autora destaca los objetivos y aplicabilidad de los estudios de disponibilidad léxica
(Ayora Esteban, 200 5 y 2007).
En Extremadura, el léxico disponible está en fase de elaboraci ón. Prado
Aragonés y Galloso Camacho se han ocupado de la recogida de datos de 700
estudiantes de las provincias de Cá ceres y Bad ajoz. Asimismo, las autoras recopilaron
el l éxico disponible de H uelva de estudiantes preuniversitarios (2005) y de 6.º de
Educación Primaria (2008). E n el año 2009 junto con Conceição presentaron el
léxico disponible de zonas limítrofes de Andalucía y Extrem adura y de Algarve y
Alentejo. Las provincias seleccionadas po r el estudio fueron: O l iva d e la Frontera,
Alconchel, Olivenza, Alburquerque y San Vicente de Alcántara en Badajoz; Valencia
de Alcántara, Alcántara y Moraleja en Cáceres; Ayamonte, Puebla de Guzman y
Cortegana en Huelva; Vila Real en Algarve; Mér tola, Serpa, Moura, Vila Viçosa,
Reguengos d e Monsaraz, Elvas y Portalegr e en la Región de Alentejo ( Portugal ) . La
metodologí a de investigac ión sigue las recomendaciones del Panhi sp ánico y la
encuesta se realizó a una muestra de 240 est udiantes preuniv ersitarios españoles y
160 portugueses. El promedio de respuestas de los informantes españoles es superior
al de los estudiantes portugu eses pero el porcentaje de vocablos es in ferior.
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
94
En la Comunidad Valenciana, se ha elaborado el léxico de Valencia (Góm ez
Molina y Gómez Devís, 2004) y Alicante (Martín ez Olmos, 2008 86 ) mien tras q ue el
léxico de Castellón se encuentra en fase de ela boración po r parte de Blas y Casa nova
Ávalos. Esta última investigadora, presenta los primeros resultados de su estudio en
2006 y analiza los anglicismos que aparecen en el listado del léxico de Castellón en el
año 2008. Asimismo, Llopis Rodrigo y Gómez Devís (2010a, 2010b ) siguen las
recomendaciones del Panhispánico para estudiar la disponibilidad léxica del catalán
en Valencia.
En Galicia, López Meirama (2008 ) presenta el léxico dispon ible de la
comunidad sobre una muestra de 800 informantes . Para la recogida de datos no
estableció la distinció n según la dem arcación provincial por con siderar la comun idad
como un conjunto . Para e llo, modifica la variable rel ativa al tipo de población y
distingue entre urbana, periurbana, villa y rural. A demás de los centros tradicionales
incluye Los colores y El mar .
Esta investigación se inscribe dent ro del proyecto Disponibilid ad léxica en Gal icia
cuyo objetivo prin cipal es la rea lización de diccion arios de léxico disp onible en
español y en gallego, a demás de crear una herramienta inform ática para su consulta.
Los miembros que forman parte del proyecto son López Meirama, Álvarez de la
Granja, B lanco y García Gondar. En el año 2011 publican una obra conjunta , en la
que participa Bartol Hernández, donde se abordan las diferencias dialectales del
español y del gallego, la or tografía, la incidencia d el tipo de p oblación, entre otros
aspectos desde u na p erspectiva multidisciplinar .
En las Islas Canarias , se ha recopilad o el léxico disponible de Las Palmas de
Gran Canaria y Tenerife. García Domínguez, Marrero Pulido, Pérez Martín y Piñero
Piñero (1994) estudia n el léxico disponib le de Gran Ca naria y a nalizan la inciden cia
de la situación geográfica y el tipo de edu cación. Previamente, Sa mper Padilla y
Hernández Cabrera (1997) presentan los datos iniciales de l estudio de disponibilid ad
léxica en Gran Cana ria y dan comienzo a una serie de in vestigaciones en las islas.
En 1998 , Samper Padilla publica un artícul o sobre los criterios de edició n del
material que serán tenidos en cuent a en la mayoría de investi gaciones posteriores en
86 Te sis doctor al present ada en 2007 .
Capítul o 2
Marc o t eór ico
95
este ámbito . Hernández Cabrera, Samper Padilla y Bellón Fernández (2003) analizan
los canarismos en los listad os de disponibilidad léxica y Hernández Cabrera y Samper
Padilla (2006) abordan los dialectalismos . A simismo, el léxico gran canario ha
formado parte de co mparaciones co n otros léxico, tales co mo el de Puerto Rico
(Samper Padilla, 1999), Córdoba (Samp er Padilla, Hernández Cabrera y Bellón
Fernández, 2003) y Aragón (Samper Hernández, 2008), entre otros.
En Tenerife, Torres González y García Falero muestran algunos datos sobre
el léxico de la isla en el III Congreso Interna cional sobre L engua y Sociedad celeb rado en
Castellón en el año 2006 . E n el resto de islas, Samper Hern ández se encarga de la
recopilación de datos. Para su tesis doctoral, la investigadora realiza un estudio
comparativo entr e los escolares gra ncanarios de primaria y secundaria para analizar su
evolución ( Samper H ernández, 2009) y sobre el que previamente había aportado
datos metodoló gicos (Samper Hernández, 2004) y analizado los d ialectalismos
(Samper Hernández, 2005).
En Madrid, nace el primer estudio que sigue los criterios del Panh ispánico a
cargo de Benítez Pérez (1992) 87 . En Alcalá de He nares , Paredes García, Álvaro
García, Pérez, Rebollo y Ruiz (2002) estudian el léxico disponible de los estudiantes
del segundo ciclo de Educación S ecundaria Obligatoria (3 . º y 4 . º) y Bachillerato y lo
comparan con el obtenido por Benítez Pérez (1992). Además, Par edes García analiza
aspectos concretos del léxico como los colores (2006), los errores ortográficos (2011)
y los avances teóricos y metodoló gicos en el ám bito de la disponibilidad léxica (2012).
El léxico de la comunidad madrileña está en fase de elaboració n por el equipo
de inves tigación compuesto por Paredes García (Universidad de Alcalá) y Goméz
Sánchez y Guerras Salas (Universidad Europea de Madrid). En la comunidad, e xisten
estudios que analizan el español en info rmantes extra njeros como el de G uerra Salas
y Gómez Sánchez (2003 , 20 05a, 2005b) con una m uestra de estudiantes extranjeros
de Comunicación de la Universidad Europea de Madrid y la tesis inédita de D iego
Gallego Gallego (2014) sobre estudiantes de español como lengua extranjera en
Madrid, entre otros.
87 Gu err a Sal as, P are des Ga rcí a, y Gómez Sá nch ez pre sen tan l a c omun ica ci ón t it ul ada «Di sp oni bil id ad léx ic a e n
la C omun idad de M adrid» en el «X XXIV Simposio de la Sociedad Española de Lingüística » celebrado en
Madr id d el 1 3 al 16 de d ic ie mbr e de 20 04 .
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
96
En Melilla, el léxico disponible forma parte del proyecto de estudio del léxico
en Ceuta, Melilla y Gibraltar llevado a cabo por el grupo Semaín ein. Fernández
Smith, Rico Martín, Molina García y Jiménez Jiménez presentaron el proyecto en el
año 2006 y dos a ños más tarde, en 2008, publicaron el léxico disponible de M elilla. Al
igual que en Ceuta, utilizar on la variable lengua ma tern a pero en este caso
diferenciaron entre españo l, bereber y otras.
En Navarra , el léxico disponible no h a sido publicado todavía pero el equip o
formado por Tabernero Sala 88 , Saralegui, Martínez, Ar eta Lara, Man gado y Sanvicens
de la Universidad de Navarra h an recopilado los datos. En el año 2007, Saralegui y
Tabernero Sala (2008 89 ) participaron en el XXXVII Simposio Internacional de la Sociedad
Española de Lingüística (SEL) con la comun icación relativa a la aportación al
Panhispánico del léxico disponible de Navarra.
Ese mismo año, Sanvicens Gila (2007) rea liza su traba jo de investiga ción de
Tercer Ciclo donde analiza los aspectos teóricos del léxico disponible en
comunidades bilingües y presenta el caso de Navarra. U n año más tarde, Areta Lara
(2008 90 ) prese nta su tesis doctoral sobre el léxico disponible de estudiantes
preuniversitarios navarros y realiza un análisis sociolingüístico porm enorizado. En el
ámbito del español para extranjeros, Jiménez Berrio (2013) analiza la competencia
léxi ca de inmigrantes e n Secundaria, relaciona la disponibilidad léxica con el
aprendizaje integrado de contenidos y lenguas (Jiménez Berrio, 2012a) y los
programas de inmer sión lingüística ( Jiménez Berrio, 2012 b), entre otros.
El País Vasco es la primera comunidad en presentar un estudio relacionado
con el léxico disponib le gracias a la tesis docto ral de Azurmendi Ayerbe (1983). En el
año 1996, Etxebarria Arostegui realiza un estudio sobre el léxico de los estudiantes
preuniversitarios de Bilbao del que m ás tarde, en 1999, anal iza la enseñanza de la
lengua m aterna. La investigación se complementa con los estud ios que comienzan en
2005 en las provincias de Álaba, Vizcaya y Guipúzcoa y que están todavía en curso.
88 Es e mismo año la auto ra publi ca un artíc ulo rela ci onad o con los regi onal is mos (Taber ner o Sala , 2008a) y el
contacto de lenguas (Tabernero Sala, 2008b).
89 Las act as del congre so se publi can un año más t arde.
90 Ma nga do y Aret a Lara (200 8) publi can en las act as d el «XXX VII Sim posio Interna cional de la S ociedad
Español a d e Li ngüí sti ca (SEL) » un artícul o relacionado con el procesamiento informático de los datos.
Capítul o 2
Marc o t eór ico
97
2.4.2. En inglés como lengua extra njera
En el ámbito del inglés como len gua extranjera las investigaciones son menos
numerosas. El yugo slavo Dim itrijevi ć realiza el primer estudio en inglés en 1969.
Parte de hipótesis que el léxico disponible puede verse influido por variables como la
edad, el sexo, el estatus social y el país (Dimitrijevi ć , 1969: 5). Para corroborar esa
teoría, recopila datos en dos países: Escocia y Y ugoslavia. En el prim er caso,
selecciona a niños que viven en zonas r urales y urba nas de Esco cia de difer entes
edades m ientras que, en el segundo, selecci ona una muestra de escolares de diferente
edad (11 y 14 a ños) monolingües serbo - croatas y bilingües húngaro s co n el ser bo -
croata como segunda lengua. Sin embargo, en la obra publicada en 1969 solo
compara los resultados d e los escolares escoceses.
No es h asta el año 2000 , cuando se p ublican los resultados de una
investigación realizada por Germany y Cartes Enríquez sobre el léxico disp onible en
inglés como lengua extranjera en la enseñan za formal de la Octava Región de C hile.
La encuesta la realizan 100 es colares de primer año de enseñanza media sobre tres
centros de interés: 1) Human body ; 2) Food ; 3) House . El objetivo consiste en
determinar el léxico de los estudiantes según la variable tipo de centro educativo: 28
informantes estudian u n establecimiento escolar bilingüe, 38 en un establecim iento
escolar particular y 40 en un liceo m unicipalizado.
Tras realizar el análisis de los resultados, Germany y Cartes Enríquez (2000:
49) constatan que los escolares del colegio bilingüe aportan un mayor número de
p alabras y de vocablos que sus compañeros en los otros dos tipos de centros. A
continuación, le siguen por poca diferencia los resultados d el colegio pa rticular y, p or
último, los del liceo municipalizado donde se encuentran con encuestas sin ninguna
respue sta. Según las autoras, los r esultados de los dos prim eros centros educativos se
justifica n por la metodología aplicada en la enseñanza del inglés: mediante semi -
inmersión en el colegio bilingüe y siguiendo un método comunicativo en el colegio
particular. En cambio, en el liceo municipal izado la enseñanza del inglés se lleva a
cabo durante solo tres h oras semanales basando la metodología en el aprendiza je
gramatical.
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
98
En el año 2006, dos estudi antes de la Universid ad de Concepc ión, Ferreira y
Zubanov, prese ntan sus tesis del Magíster en Lingüística relacionadas con la
disponibilidad léxica en le ngua extranjera. El trabajo de Ferreira (2006) analiza las
diferencias entre el léxico disponible en in glés como lengua ma terna y como lengua
extranjera a través de u n análisis cuantitativo y psicolingüístico. Los datos d e la s
pruebas provienen de 50 hablantes nativos de entre 16 y 18 años del sur de Inglaterra
inscritos en The Royal School y 50 alumnos chilenos de cuarto curso de las carreras
de Pedagogía en Inglés y de Traducción en Idiomas Extranjeros de entre 21 y 22
años.
Entre los centros seleccionados, los cuatro primeros centros corresponden a
los centros trad icionales y los seis restantes son específicos del estu dio: 1) Body parts ;
2) Food and drink ; 3 ) Entert ainment ; 4) Clothe s ; 5) Holidays ; 6) Economy and finances ; 7)
Terrorism and crime ; 8) Politics ; 9) Pollution and the environment ; 10) Health and medi cine . Los
resultados presentados muestran que el número de palabras y vocablos en todos los
centros es supe rior en los hablantes de inglés como lengua materna. Además, el
vocabulario proporcionado por los escolares ingleses es más especializado y
específico mientras que el léx ico de los estudiantes chilenos es más homogéneo,
debido a que la exposición a la leng ua ex tranjera se produce en un ambiente muy
similar, el escolar.
A través de un análisis realizado con el programa DispoGrafo, el investigador
presenta la organización de los vocablos en los dos listados . De esta forma, se
observa que los hablantes nativo s organiz an la s pala bras en el lexicón menta l a través
de subnúcleos en cada centro de interés que revelan la relación semántica de las
palabras. En cambio, esa relación en subcategorías no es tan evidente en el caso de
los estudiantes chilenos ya que las palabras se integran en un centro sin una clara
organización dejando patente que su dominio léxico es solo pa rcial.
El estudio de Zubanov (2006) se basa en el progres o léxico de estudiantes
durante sus estudios universitarios en inglés y en alemán. En ing lés com o lengua
extranjera, se llevan a cabo encuestas a 80 alumnos divididos en cuatro grupos de
diferentes cursos de la carrera de Traducción en Idiomas Extranjeros de la
Universid ad de Concepción. Para poder comparar el léxico disponible cuanti tativa y
Capítul o 2
Marc o t eór ico
99
cualitativamente con ha blantes de lengua mater na, la encuesta la realiz a del mismo
modo a un grupo de 20 estudiantes norteamericanos.
Como era de esperar, los hablantes nativos muestran un vocabulario más
amplio y rico que los estudiantes de inglés como l engua extran jera. La autora destaca
algunas diferencias culturales, tales como, la m ayor asociación de palabras positivas
en el centro de los estados de ánimo en lo s estudiantes chilenos y un mayor númer o
de palabras afectivas en el centro de los animales. En cuanto a la evolución del léxico
en los estud iantes chilenos, destaca que se produce de forma progresiva a med ia que
los estudiantes adquieren la len gua extranjera.
El es tudio exploratorio llevado a cabo por Gallardo del Pue rto y Martínez
Adrián (2014 ) tiene por o bjeto conocer la influencia del con tacto de una lengua
extranjera en el léxico disponible de estudiantes de la tercera ed ad. Lo s datos
provienen de 18 informantes de edad avanzada que estudian inglés como lengua
extranjera en las Aulas de E xpe riencia de la Universidad del País Vasco durante tres
horas semanales. Los encuestados se dividen, según su experiencia previa con el
inglés como lengua extranjera, en dos gru pos: uno formado por estudiantes
principiantes que parten de cero denominados Tru e Beginner s (TBs) y otro grupo
compuesto por los falsos principiantes 91 o False Beginners (FBs) que so n estudiantes
que comienzan a estudiar una lengua desde cero pero tienen un ligero conocimiento
de la misma.
La prueba léxica se realiza a partir de quinc e centros de interés relacion ados
con la vid a d iaria: 1) Parts of the body ; 2) Clothes ; (3) House ; (4) Furniture ; (5) Food and
drink ; 6) Table ; 7) Kitchen ; 8) School ; 9) Town ; 10) Countryside ; 11) Means of transport ; 12)
Animals ; 13) Hobbies ; 14) Professio ns ; 15) Colours . Los tres factores objeto de análisis
son: el número de pa labras en general, la determ inación de los centros m ás
productivos en ambos grupos y los vocablos aportados en cada centro de interé s. El
número de palabras corrobora la hipótesis de los investigadores ya que muestran que
91 La definici ón de este conce pto puede consult arse en la vers ión electrónica del Diccio nar io de tér mino s clave de
ELE del Institut o Cervantes. Disponible en:
http://c vc.cerva ntes.es /ensenanza/bi bliote ca_ele/d iccio_el e/dicc ionario/f alsopri ncipiant e.ht m [Consultado e l
9 de marzo de 2015].
Tesis doctoral
Evaluac ión d e la compet enci a lé xic a bili ngüe en estudiantes del Máster Universitario en Profesorado
106
Tabla 2. 3. Li stado de pala bras c on un mis mo índi ce de disponi bilida d pero difer ente r ango as ociati vo. Ce ntro d e interés 01. Pa rties du co rps humai n . Extraído d e Njock ( 1978: 203 )
Rang associatif pour des concepts de même indice de disponibilité
Rang
Basaa
Disp oni bil it é
Rang
Assoc iat if
Rang
Français
Disp oni bil it é
Rang
Assoc iat if
Rang
Basaa et
Français
Disp oni bil it é
Rang
Assoc iat if
18
hyonx (chev eu)
43,6
23,6
2
oeil
87,2
57,2
35
ko xox (peau)
17,2
8,6
18
jas (me nton)
43,6
22,2
2
tête
87,2
67,2
35
crâne
17,2
8,6
26
bxep (l èvre)
22,2
10,9
11
dent
66,8
37,7
14
tol (poitrin e)
58,1
32,7
26
nla (i ntesti n)
22,2
12,7
11
pied
66,8
36,3
14
genou
58,1
29,5
28
nxexm (coeur )
21,8
10,4
17
main
51,8
30,9
15
liman x (joue)
51,8
29,5
28
hes (os )
21,8
12,2
17
joue
51,8
29,5
17
joue
51,8
29,5
30
tindi (talon )
21,3
11,8
27
orteil
32,2
17,7
17
main
51,8
30,9
30
lbxee (m ame lle)
21,3
11,3
27
tronc
32,2
19,5
33
sourcil
18,1
7,2
40
su (figure)
11,3
7,2
35
cœur
17,2
8,6
34
tuu (épa ule)
18,1
10,4
40
yiijis ( sourcil)
11,3
4,5
35
crâne
17,2
8,6
38
libxit (go rge)
11,8
7,2
42
foie
11,8
5,4
Capítul o 2
Marc o t eór ico
107
En esta misma línea , se desarrollan otr as fórmulas que in corporan la posición
que ocupan las palabras en los listados. Lo s trabajos de Lorán Santos (1983) y Lo rán
Santos y López Morales (1983) ponderan la frecuencia de las palabras según su
orden de mención. Según Lorán (1987) , l a fórmula inicial se basa en la t eoría de las
decisiones y consiste, grosso modo , en multiplicar un coeficiente con v alor infer ior a la
unidad ( λ ) por la frecuencia de la unidad. Ese cálculo no era efectivo en algunos
casos. P or ejemplo, cuando las palabras aparecían en primer lugar el co eficiente no
actuaba y, por tanto, la frecuencia era la misma. Tras varios intentos de m ejorar el
cálculo de la disponibilidad de una pa labra, lo s investiga dores pro pusieron un a
fórmula para los listados de palabras con un tamaño homogéneo que alteraba la tasa
de sustitución si el tamaño de lo s listados era diferente.
Por un lado: 𝑑 𝑝 = 𝑥 !"
!
! ! ! si 𝑥 !" = ! !"
! !
Por otro: 𝑑 ! 𝑝 = 𝜆 ! ! !
!
! ! !
! !"
! !
donde
n = máxima posición alcanzada por las palabras en la encuesta
i = número de posición
𝑥 !" ! = frecuencia rel ativa de la palabra p en la posición i
𝑓
!" ! = frecuencia absoluta de la palabra p en la posición i
𝑁 ! ! = número de informantes cuyas listas contenía n la posición i
La disponibilidad se calcula sumando el número de veces que la palabra ocupa
cada posición pondera do por una potencia del co eficiente ( λ ) . El valor de ( λ ) es 0,90
y desciende su potencia con forme disminuye la posició n de la palabra en cuestión.
Así, el valor del sumando cuando la palabra con la mi sma frecuenci a ocupa la
posic ión 1 será mayor que el del sumando cuando aparezca en cualquier otra
posición. El análisis del índice de disponibilidad léxica a partir de la fórmula reseñada
está presente en diversos estudios, tales com o, Román (1985), Mena O sorio (1986),
Justo H ernánde z (1987), Cañizal Arévalo (1987) y Echeverría et al . (1987). Sin
embargo, se constata que si la potencia de ( λ ) es super ior a 23, es decir, cua ndo la
palabra se encuentra en la posición 23 o en alguna superior, el sumando deja de ser
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
108
significativo. La pote ncia de ( λ ) se hace tan pequeña que se produce una curva
cercana al eje de abscisas.
Posteriormente, los trabajos presentados p or Butrón (1987, 1991) consiguen
corregir ese error de for ma parcial. La fórmula revisada sustituye el valor ( λ ) por un
número E elevad o a un exponente que pondera la po sición de la palabra. La
investigadora aplica la fórmula en un trabajo realizado en Puerto Rico sobre una
muestra de 154 estudiant es de quinto grado donde analiza la influencia de diversas
variables, como el sex o, e l nivel económico y la procedencia geográfica en la
disponibilidad léxica. A pesar de que la fórmula no consigue eliminar por completo
el desajuste, el estudio m uestra la efectividad de ponderación del número de palab ras
y la posición de las misma s a travé s de un número E elevado a un exponente
complejo.
En esa misma línea, los profesores de la Universi dad Nacional Autónoma de
México, López Chávez y Strassburger 99 consiguen mejorar ese artificio matemático
aplicando el número E , conocido como número d e Eu le r o cons tante de N apier,
con un valor 2, 718281828459045. La matriz p resentada por los estudiosos
mexicanos tiene en cuenta los siguientes factores (López Chávez y Strassburger ,
1987):
• La frecuencia absoluta con que fue mencionada cada palabra en cada
posic ión.
• La frecuencia absoluta de la palabra, es decir, la suma de las diferentes
frecuencias alcanzadas por la palabra en cada posición.
• El número d e hablante s que re alizan la prueba de disponibi lidad lé xica.
• El número d e posicio nes alcan zadas en e l centro d e interés en cuestión.
• Las posiciones en las que fue m encionada la palabra.
𝐷 𝑃𝑗 = + 𝑒 − 𝐶
𝑖 − 1
𝑛 − 1
𝑓𝑗𝑖
𝐼 1
!
! ! !
donde
D hace referencia a la disponibilida d de Pj de una palabra p concreta j
99 Lópe z Chávez y St rassbur ger ( 1987, 1991) .
Capítul o 2
Marc o t eór ico
109
n indica la máxima po sición alcanza en el centro de interés
fpi es la frecuencia absoluta de la pa labra en la posición i
I1 es el número de informan tes que realizaron la prueba
e es el n úmero natural con un valor de 2, 718281828459045
La fórmula mexi cana es contrastada empíricamente en estudios ulteriores,
tales como los realizados en México (López Chávez, 1995), Puerto Rico (L ópez
Morales, 1995a y 1995 b), M adrid (Benítez Pérez, 1992, 1994a, 1994b ), Las Palmas de
Gran Canaria (Samper y Hernández , 1994, l995) y República Dominicana (Alba
Ovalle , 199 5a y 199 5b). En cuanto al tratamiento de los datos, cabe destacar que los
propios autores de la fórmula, López Chávez y Strassburger Frías, desarrollaron el
programa informátic o DISPLEX. Esta aplicación permitía no solo calcul ar el índice
de disponibilidad léxica si no también la frecuencia de aparición de las palabras, la
frecuencia acumulad a, la frecuencia abso luta y la posición que ocupa cada vocablo en
un centro de interés con la posibilidad de realizar estratificaciones.
Debido a la compl ejidad del uso del prog rama creado en la Universidad
Nacional Autónoma de Méx ico y su difícil acce sibilidad , en 1995 el Grupo de
Sociolingüística Teórica y Aplicada de la Universidad de Almería desarrolla el
programa ESDIS (Estadística de disponibilidad). En 1998, Mateo Ga rcía p ublica su
tesis doctoral sobre el léxico de lo s estudiantes preuniversitarios alm erienses en la
que procesa los datos mediante este programa.
Para facilitar la ap licación de la fórmula en otros estudios, en 1996 el enton ces
presidente de la Asociación de Lingüística y Filología de la América Latina (ALFAL),
López Morales, encarga a la Universidad de Alcalá la crea ción de un program a
informático: Lexidisp. El programa permite la creación de diccionarios de
disponibilidad léxica y el cálculo del índice de d isponibilidad, la frecuencia relativa y
la frecuen cia absolu ta. No obstante, el número de variables está restringido a cinco y
solo está disponible para el sistem a operativo Microsoft Win dows.
En el año 2000, se consolid a el proyecto salmantino Dispolex que permite
trabajar con una mayor cantidad de datos y variable s (Bartol Hernández y Hernández
Muñoz, 2004). La principal diferencia en el cálculo de los datos que ofrece Lexidisp y
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
110
Di spolex reside en que el primero es un programa que analiza los datos a p artir de
ficheros organizados según unas características específicas 100 , mientr as que el
segundo es una base de da tos en la que hay que ir in troduciendo las referencias
manualmente . Además, se podría decir que Dispolex es un gran banco de datos
científico que permite que los investigadores interesados ingresen sus datos, los
calculen y los contr asten con los dato s de otras investigacion es a las que tengan
acceso 101 .
Echeverría et al. (2005) crean una aplicación en MatLab (programa
especializado en análisis estadísticos multivariantes) denominada Dispogen 102 . Este
programa realiza cálculos muy similares a los de Dispolex (número de vocablos por
centro, promedios de respuestas, frecuencia absoluta y relativa, porcentaje de
aparición y listado de vocablos por cen tro), permite conocer los datos de una gran
variedad de variables y obtener gráficos con los análisis reali zados. Al igual que
Lexidisp, se trata de un programa que puede descarg arse en cualquier ordenador pero
su última actualización es más r eciente, conc retamente en el año 2008.
En esta misma línea, Frey Pereyra crea un programa denominado Ledical que
puede ser utilizado en cualqui er sistema operativo compatible con Java. La aplicaci ón
informática se encuentr a disponible en línea y se puede descar gar gra tuitamen te 103 .
Este programa es utilizado para procesar los datos de la tesis doctoral de Frey
Pereyra (2008), El léxico disponible en los escritos de alumnos de español como ELE , así como
en otras investigaciones fruto del proyecto de investigación Estudios de Léxico
Disponible de la Universidad Nacional Autónoma de México a cargo de M arisela
Colín Rodea 104 .
100 Vid . a partado 3.5.2 referente a la metodología.
101 El acces o a cada investi gac ión es restri ngid o para pres erva r la priv acid ad de los datos . No obstant e, el
investig ador res ponsa ble de u na inve stigación podr á perm itir el acce so a otro u otro s investig adores .
102 La i nformación sobre el proyecto que financi a la creación del programa se encuentra disponi ble en
http://ds pace2.coni cyt.c l/bits tream/handle /10533/16599/105 0598 - IF .pdf?seq uence =2 [Fec ha de última
consulta el 5 de marzo de 2015] .
103 Aunqu e Frey Perey ra indica que el programa está alojado en la página web www.ledi cal. org act ualmente ese
enlace no está disponible. En camb io, se puede acceder al programa previa autentificación en la página
http://c ele.unam. mx/ledical / [Fecha de última con sulta el 9 de febrero d e 2015].
104 Para más inform ación so bre el p royecto , c onsúlte se la pá gina
http://dl a.cel e.unam.mx/ter minologia /inreri ores/proye ctos.ht ml [Fecha de última consulta el 9 de feb rero de
2015].
Capítul o 2
Marc o t eór ico
111
A través del proyecto Disponibili dad Léxica en Galicia , financiado por el
Programa de Promoción Xeral de Investigación de la Consellería de In novación e
Industria de la Xunta de G alicia, se elaboran dos diccionarios del léxico disponible
de los estudiantes preuniversitarios gallegos: uno en español y otro en gallego. Para
facilitar la consulta de los d atos de las investigaciones inscritas en este proyect o,
Guillermo Rojo crea una apl icación infor mática, Dispogal (López Meirama, 2011:
13). Cabe mencionar que en la propia p ágina del proyecto se indica que los datos han
sido procesados con Lexidisp por lo que el programa se utiliza solo como base de
consulta 105 . No ob stante, Dispoga l requiere darse de alta como usuario pa ra poder
acceder a la información 106 .
En el año 2014, Gallego Gallego propone el tratamien to de los datos
informáticos a través del programa SP SS. Entre las ventajas de utilizar este programa
e stadístico para procesar los d atos d el léxico disponible, Gallego Gallego (2014)
destaca la flexibilidad en el uso de diferentes tipos de archivos y en la incorporación
de todas las variables que el investigador desee explorar. Asimismo, propone una
revisi ón de la fórmula tradicional propuesta por López Chávez y Strassburger Frías
(1987) en la que se aconseja que la constante C tome el va lor de 2,3.
2.5.2. Índice de compatibilidad léxica y selección del léxico nuclear
El índic e de compatibilidad léxica nace a pa rtir de los estudios realizados por
Ávila Muñoz y V illena Ponsoda (2010, 2011) y Ávila Muñoz y Sánchez Sáez (2011).
Los autores parten de la hip ótesis de que el índice de disponibilidad léxica perm ite
conocer y acceder al vocabulario del grupo con creto que ha realizado el estudio y,
por ende, al prototipo léxico comunitario creado par a cada centro de interés. E ste
hecho se observa al contrastar los índices de disponibilidad de una misma palabra en
estudios diferentes ya que se ven alterados, como se expuso en la fórmula López y
Strassburger (1987), por el número de informantes, número de menciones y
posiciones de la palabra.
105 http:// gramatica .usc.e s/proxectos /dispogal /?lang=es &id=descri pcion [Fecha de última consulta el 9 d e
abril de 2015].
106 A través de esta página se puede soli cit ar el alta de usuar io en Dispoga l: http://gramati ca.us c.es/di spogal/
[Fecha d e última co nsulta el 9 d e abril de 2 015].
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
112
Vocablo
Disp oni bil ida d
Frecuenci a
Frecuenci a
acumulada
%
Apari ción
Rango
Mál aga 2 010
hígado
0,24165
1,87
36,364
49,534
14
Estud io
actual
hígado
0,09071
0,824
73,948
21,637
39
Tabla 2.4 . Ejemplo de los resu ltados del v ocablo hígado en la investigación de Ávila Muñoz y Villena Ponsoda
(2010) y el presente estudio
En la Tabla 2.4, se observa que la palabra hígado tiene una disponibilidad de
0,24165 en el estudio realizado en Málaga sobre una p oblación estratificada (Ávila
Muñoz y Vill ena Ponsoda , 2010) mientras que esa misma palabra en el presente
estudio tiene una dispo nibilidad de 0,09071. Se podría d ecir que ese vocablo es más
disponible en el primer estudio por que su accesibilidad es mayor y, por tanto, ha
venido a la mente del hab lante en más ocasiones y en posiciones más ad elantadas.
Asimismo, en el primer caso, hígad o se encuentra más cer cana al n úcleo del prototipo.
Ocupa el rango 14 en el listado de palabras ordenada s según el índice de
disponibilidad mientras que, en el segund o caso, ocupa el puesto 39. La diferencia en
el po rcentaje d e apar ición d e amb os térm inos es igualmente significativa: en el primer
estudio el vocablo ha sid o mencionado casi po r la mitad de los ha blantes mientras
que en el segundo no llega a una cuarta pa rte.
La estructura del léxico en cada centro de interés vendrá determinada por la
asociación entre las diferentes unidades lé xicas y su grado de accesibilidad. Según
Ávila Muñoz y Sánchez Sáez ( 2011: 257 ) «es necesario establecer un grado de
‘compatibilid ad’ entre, por un lado, cada uno de los vocablos aportados por los
hablantes y, por otro, el concepto que para la comunidad estudiada representa cada
uno de los centros de interés propuestos» . Par a establecer diferentes grados de
compatibilidad o accesibil idad entre un elemen to y su con junto se basa n en el
concepto matemático de ‘co njunto difuso’ .
El primer paso para calcul ar el índice de compati bilidad consiste en
determinar el espectro de un centro de interés mediante un conjunto difuso a través
de un modelo cuantitativo similar al de la ley de Z ipf. En este caso, ( t ) hace referencia
a la valoración de cada término obtenida a partir de la división del número que ocupa
en la lista un vocab lo ( n ) y u na constante para ca da caso ( k ) que representa el tamaño
relativo de los conjuntos de tér minos que superan un niv el de compatibilidad.
Capítul o 2
Marc o t eór ico
113
𝑡 =
𝑘
𝑛
A conti nuación, construyen el modelo colect ivo basado en el valor de nula
disponibilidad para to dos los términos a partir de la siguiente ley probabilística:
𝑎 + 𝑏 − 𝑎 ∙ 𝑏
d onde
a se refiere a la disponibilidad d e un término
b indica la disponibilidad p ersonal de ese término
El índi ce de compatibilidad muestra la accesibilidad de los voca blos en un
rango que oscila entre 1 y 0. En el Gráfic o 2.1 , las diferentes palabras están
representadas en un continuo en el que se destacan los primeros puestos del rango
por contar con un índice de compatibilidad cerca no a 1. Se constata que a partir de
un cierto punto las unidades léxicas pierden com patibilidad y apenas son accesibles a
los hablantes.
Gráfi co 2.2 . Número de vo cablos ord enados seg ún el índic e de comp atibilidad en españo l. Centro d e interés 09.
Ordena dore s e int erne t
El índice obtenido sirve de base para dos análisis posteriores que permitirán
seleccionar el léxico más compatible y conocer la compatibilidad de cada vocablo de
la secu encia léxica apor tada por u n infor mante. Por u n lado , el planteamien to
0"
0,1"
0,2"
0,3"
0,4"
0,5"
0,6"
0,7"
0,8"
0,9"
1"
1"
18"
35"
52"
69"
86"
103"
120"
137"
154"
171"
188"
205"
222"
239"
256"
273"
290"
307"
324"
341"
358"
375"
392"
409"
426"
443"
460"
477"
494"
511"
528"
545"
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
114
expuesto permite aplicar la herramienta FEV (Fuzzy Expected Value) para
determinar el léxico relevante. Esa se lección del vocabulario vendrá marc ada por
criterios de corte que establecerán, por niveles, la mayor o menor p ertenencia de los
vocablos al núcleo, es decir, su nivel de prototipicidad 107 . La Tabla 2.1 muestra cómo
se ha organiza do el vocabulario del continuo anterior en seis niveles según la
compatibilidad de los voca blos. En total se han destacado 69 vocablos que suponen
un 12,32 % de todos los vocablos aportados por los informantes. Por debajo del
índice d e comp atibilidad de 0,13 se sitúan los vocablos que so lo han aportado
algunos informantes y, por tanto, que no son r eprese ntativos del léxico disponible de
una comunidad de hablantes.
Nive l de
compatibilidad
Proporció
n
Nº d e
vocablos
Vocabl os
0,85
0,54
3
ratón, pantalla, teclado
0,75
0,89
5
portáti l, pá gina web
0,6
1,61
9
ordenador, monitor, Facebook, correo (elect rónico)
0,41
2,68
15
torre, im presora, r ed social, d isco dur o, progra ma, arch ivo
0,24
5,89
33
Tuenti , in ternet , s oftwar e, c able, web, hardware, pe ndrive ,
Googl e, blog, chat ear , busca dor , Windows , escán er, USB,
chat, PC, red, wifi
0,13
12,32
69
router, altavoz , mó dem, CD( - ROM ), memori a, desca rgar,
virus, placa base, tecla, d escarga, conexión, ordenador de
sobremesa, campus virtual, carpeta, navegar, TIC, pc,
(Micro soft) W ord, sistema opera tivo, do cume nto, T witter,
procesador de textos, contraseña , DV D, foro, e - mai l,
videojuego, ordenador personal, informaci ón, ventana, CPU,
antivirus, bater ía, netbook, Wikipedia, s ervidor
Tabla 2.5 . Niveles de comp atibilidad d e los vocab los en españ ol. Centro 09. Or denadores e i nternet
Por otra parte, este índice de compatibilidad es empleado para conocer cuáles
son los procesos de reentrada en el núcleo cuando un hablante realiza la prueba de
disponibilidad. El núcleo es considerado el nombre del centro de inter és, es decir, la
palabra a partir de la cual se activa un vocabulario determinado en la mente del
hablante. El orden de producción de las palabras de cada lista puede estar más o
menos asoci ado al vocabula rio colect ivo. De esta forma, cuando el hablante escri be
una palabra co n un alto índice de compatibilidad se acerca al núcleo del centro de
interés. En cam bio, cua ndo r ealiza una asocia ción de tipo personal y, p or tan to, no
compartida por la m ayoría de los hablantes, se aleja d e ese núcleo.
107 Cf. Ávil a Muñ oz y Sá nchez Sá ez ( 2010 , 2011a , 2011b , 2014) p ara una revisión más pormenorizada del tema.
Capítul o 2
Marc o t eór ico
115
Tras analizar dif erentes sujetos, Ávila Muñoz y Sánchez Sáez (2011 : 274 - 277 )
distinguen cuatro tipos de patrones do minantes d e reentr ada al núc leo:
a) Patrón centralizado. Se produce cuando los informantes solo escriben
palabras muy compa tibles, es decir, muy cercanas a l núcl eo.
Gráfi co 2.3 . Muestra de com patibilidad de vocab los. Patrón de centraliza do. Inform ante 145. C entro de in terés 04.
The sc hool : fu rnitur e and sch ool materi al
b) Patrón de reentrada. Es el patrón más frecue nte observado y se denomina de
‘reentrada’ porque una vez que los informantes han aportado una serie de
palabras centralizadas, tienden a alejarse del núcleo. A continuación, vuelven a
escribir palabras más centralizadas que lo llevan a sumergirse de nuevo en el
núcleo.
Gráfi co 2.4 . Muestra de com patibilidad de vocab los. Patrón de centraliza do. Inform ante 170. C entro de in terés 04.
L’éco le: meubl es e t mát eri el s col aire
c) Patrón de desplazamiento y desviación. Este modelo se observa cuando un
hablante, a partir de un determinado m omento, comienza a producir palabras
que se alejan del núcleo (palabras técnicas o especializadas, asociaciones
individuales, etc.).
0
0,2
0,4
0,6
0,8
1
desk book pencil pen table computer
0
0,2
0,4
0,6
0,8
1
chaise fenêtre tableau cahier g omme stylo cray on table
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
122
En el caso de la esperanza matemática para toda la prueba, el resultado sería el
siguiente:
𝐸 ! 𝑁𝑂𝑇𝐴
= 𝐸 ! 𝑛 !
!
! ! !
= 𝑁𝐸 ! 𝑛 !
=
𝑃
𝑀
1 − 𝑋 𝑀 − 1
Por último, se calcula el valor de X para saber qué valor hay que restar a cada
respuesta incorrecta. La fórmula comienza con el objetivo primero de la creación del
ICIT: si un informante responde a todas las preguntas al azar su puntuación será de
0.
𝐸 𝑁𝑂𝑇𝐴 = ! 0 ⟶ 0 =
𝑃
𝑀
1 − 𝑋 𝑀 − 1 ⟶ 1 = 𝑋 𝑀 − 1 ⟶ 𝑋 =
1
𝑀 − 1
𝐸 𝑁𝑂𝑇𝐴 = ! 0 ⟶ 0 =
10
9 0 , 56 − 0 , 07 9 − 1 ⟶ 0 , 56 = 0 , 07 9 − 1
⟶ 0 , 07 =
0 , 56
9 − 1
Una vez realizados los cálculos estadísti cos oportunos, se concluye que para
obtener unos resultados ponderados de la variable ICIT, es necesario asignar los
valores expuestos al p rincipio. Es decir, sumar 0,56 puntos por cada re spuesta
correcta y restar 0,07 por cada respuesta incorrecta. En la Tabla 2. 7 se ha n incluido las
respuestas de cuatr o informantes para comparar los resultados según el Pident y el
ICIT. Lo s informan tes 137 y 59 han aso ciado todas las palabras de forma correcta
exceptuando una. En el primer caso, el informante ha dejado la respuesta en blanco y
en el segundo la ha contes tado de forma errónea. El Pident de a mbos sujetos es igual
porque no da cuenta de la respuesta incorrecta o no contestada pero el ICIT es
diferente: 9,52 frente a 9,45.
En cuanto a los informante s 100 y 169, han asociado corre ctamente la mitad
de las palabras. El informante 100 ha dejado 8 respuestas en blanco y ha realizado
una relación incorrecta mientras que el informante 169 ha contestado la otra mitad de
forma incorrecta. A priori , par ece q ue el in formante 100 ha realiza do solo la parte de
la prueba que cono cía mientras que el sujeto 169 ha contestado a todo, con
independencia de si había identificado el vocablo o no, razón por la cual es posible
Capítul o 2
Marc o t eór ico
123
que haya acertado algunas resp uestas al azar. Este hecho se refleja en los resultados
ya que el ICIT del informante 100 es 4,97 y d el informante 169 es de 4,41.
Informante
Respue sta
correcta
Respue sta en
blanco
Respue sta
incorrec ta
Pident
ICIT
137
17
1
0
9,44
9,52
59
17
0
1
9,44
9,45
100
9
8
1
5
4,97
169
9
0
9
5
4,41
Tabla 2.7 . Ejemplos de resp uestas en la p rueba de l léxico espec ializado en español y re sultados de l Pident e IC IT
2.6. Aplicaci ones de la di sponibil idad léx ica
Los es tudios en este ámbito surgen de la búsqueda de una aplicación práctica
co ncreta: la selección del léxico para la enseñanza del francés (Gougenheim et al. ,
1964). Asimismo, los precursores franceses realizan co mparaciones y análisis en los
que se tienen en cuenta variables sociales, co mo el sexo o la procedencia, ligados a la
in corporación de nuevas disciplinas, como la dialectología o la sociolingüística.
Numerosos autores , como López M orales (199 5- 1996: 249 - 254; 1999a: 19 - 26);
Carcedo González (1998 b : 53 - 63), Samper Padilla (2003: 213 - 219), Samper Padilla,
Bellón Fernández y Sa mper Hernández (2003: 105 - 119) y Ayora Esteban (2007:
2367 - 2378 ), destacan el carácter multidisplicinar del léxico disponible y las
oportunidades que ofrece. En los párrafos sucesivos se abordan algunas de las
principales aplicaciones de la disponibilidad léxica en el ámbito de la dia lectología, la
etnolingüística, la sociolingüística y la lingüística a plicada a la enseñanza de lengua s.
Desde la perspectiva etnolingüística 109 , la dispo nibilidad puede ayudar a
describir las características de una cultura o sociedad y época histórica. Las palabras
más disponibles de los hablantes dan cuen ta de sus hábit os alimenticios , de la forma
de divertirse, de las profesi ones y problemas de la zona y demás componentes
cultur ales en el momento preciso de la encuesta. E n algunos estudios se han
adaptado los centros de interés introduciendo el m ar (Ávila Muñoz, 2006; Ayora
Esteban, 2006; etc.), el olivo y el aceite (Ahumada, 2006) o cambiando calefacción por aire
acondicionado como realiza López Morales (1999) en Puerto Rico. Asimismo, se ha
criticado que algunos centro s de interés tales como, Trabajos del campo y del jardín,
109 Vid . a partado 6.6.2 para una reflexión más profunda.
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
124
tendrían que ser actualizados y reemplazados por otro s que definan mejor las
costumbres actuales y que presenten una mayor producción léxica.
En cuanto a la dialect ología, Gougenheim et al. (1964) ya encontraron
diferencias en los listados del léxico disponible en los listados de los diferentes
departamentos franceses analizados. No obstante, M ackey (1971 a ) es el primer
investigador que describe y a naliza las sem ejanzas y diferen cias entre dos sintopías: el
léxico de Francia y de Acadi a (Canadá). A partir de ahí, son considerables los estudios
que com paran, tanto desde el punto de vista cualitativo como cua ntitativo, los léxico s
disponibles de diferentes zonas. E n el ámbito hispano, López Chávez (1992)
contrasta, por primera vez, el léxico de diferentes lugares: Madrid, Gra n Ca naria,
Repú blica Dominicana y Puerto Rico .
En el ámbito de la psicolingüísti ca, d estacan algunas investigacion es que trata n
de conocer cómo se organizan las palabras en la mente y cómo se activa el
vocabulario disponible. Cañizal Arévalo (1991) analiza las relaciones en tre las
palabras del centro de interés Partes del cuerpo y concluye que las palabras se organizan
en torno a un núcleo formando redes o constelaciones con un índice de
disponibilidad similar. López Chávez (1993) intenta conocer cómo se organiza el
lexicón mental a través del análisis de siete mu estras de escolares de dife rentes
edades. E cheverría (1991) se inter esa en las relacio nes entre las pala bras y desarrolla
el índice de cohesión y contribuye a la creación del DispoGr afo, una herramienta
computacional para contabilizar las relaciones más frecuentes entre la s palabras y
conocer cómo se o rganizan ( Echeverría et al. , 2008) . Hernández Muñoz (2006) su
describe los fundamentos teóricos que describen la producción del léxico disponible
y se centra en los procesos cognitivos.
En esta misma línea, podrían enmarcarse dentro d e la psicolingüística no solo
las p ruebas que siguen la metodología de la disponibilidad léxica del Proyecto
Panhispánico sino todas aquellas basadas en la fluencia verbal y que se ponen en
práctica en diversos ámbitos. A modo de ejemplo, cabe comentar que en la
descripción de afasia en una enciclo pedia médico - quirúrgica (Viader, Lambert , de la
Sayette , Eustache , Morin , Morin y Lechevalier , 2002), se menciona la aplicación de
algunas pruebas típicas como la disponibilidad léxica o la fluencia verbal. En general,
Capítul o 2
Marc o t eór ico
125
el ejercicio consiste en mencio nar durante un tiempo determinado (frecuentemen te
se elige un minuto y medio) palabras de form a oral relacionada s con un campo léx ico
(nombres de animales) o nom brar p alabras que empiecen por una letra determin ada.
Los Animales , precisamente , forman parte de un centro de interés tradicional y es el
ejemplo dado en este artículo de la enciclopedia. Por tan to, este hecho da cuenta de
lo s numerosos estudios que incorporan las pruebas de disponibilidad léxica o fluencia
verbal y que pueden encontrarse no solo en las investigaciones sobre la afasia sino
también en otros camp os, como puede ser el alzheimer ( Eustache, 1993: 205 - 227).
La sociolingüística está presente de una forma u otra en todos los estud ios d e
disponibilidad léxica. En Gougenheim et al. (1964) se introdujeron dos variable s
sociales: el sexo y la procedencia (rural o urbana). A partir de ahí, cada estudio ha
incluido unas variables u otras según su s objetivos específicos. Los análisis pasa n de
cuantificar el número de palabras aportadas por una parte de la muestra, com o puede
ser el léxico del socio lecto femenino y masculino 110 , hasta realizar análisis estadísticos
más complejos que miden la incidenc ia directa o indirecta de determinadas
vari ables 111 .
En el campo de la lingüística aplica da a la enseñanza de lenguas se sitúan la
mayoría de investigacio nes sobre disponibilida d léxica. No obstante , con frecuencia
los estud ios com enta n la importancia de la disponibili dad en la enseñanza de idiomas
pero se limitan a aportar los inventarios del léxico disponible a modo de léxico básico
y, so lo en alguna s oca siones, incluyen criterios de corte para establecer una selección .
En ca mbio, otros est udios cotejan el léxic o re sultante de las pruebas del lé xi co
disponible con el léxico presente en algunos manuales, como ocurre en Benítez Pérez
y Zebrowski, 1993; Benítez Pér ez, 1994 , 1997; Rueda Ber nao, 1994; García Ma rcos y
Mateo García, 2000; entre otros.
A través de un Proyecto Fondecyt 112 denominado Metacog nición en lengua
materna. Software multime dial para su des arrollo se crean tres pr ogramas informáticos
destinados a la enseñanza del español como lengua materna. El objetivo es hacer una
110 La mayor ía de estudi os su elen i nclui r est a dis tinci ón.
111 Entr e las investi gac iones con mayor profundi zac ión estadí st ica dest acan los estudi os de Ávila Muñoz y
Vill ena Pons oda (20 10, 201 1).
112 Fondo Naciona l de De sa rro ll o Ci ent íf ic o y Te cno lóg ico de Chile.
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
126
reflexión sobre los modelos psicolingüísticos del lexicón m ental par a crear
herramientas de aprendizaje que permitan un aprendizaje signi ficativo . Aunque en el
« Taller Internacional de Software Educativo TISE’99 » celebrado en San tiago de Chile
en diciembre de 1999 se pr esenta ra una versión preliminar, en 2001 Echeverría
dedica un artículo a exponer las características de uno de los programas, Vocabulari o
disponible y menciona la creación de los otros do s: Actos de Habla y Lectura Crítica
(Echeverría, 2001a). Un año más tarde, Echev erría presenta de nuevo el Vocabulario
disponible junto con o tros programas que comparten características comunes como el
hecho de ser aplicaciones de Windows multimediales e interactivas y estar centrada s
en el objetivo didá ctico de la enseñanz a del español com o lengua materna : Variación
Diale ctal del Español , Tiempo de Lectura , Lector , Act os de Habl a y Antex’ 98 .
Vocabulari o disponible incluye una breve reflexión Echeverría (2001, 2002) sobr e
las bases neur ales d el léx ico q ue fin aliza con los principios generales planteados por
Caramazza (199 9: 470). A continuación, reflexiona sobre la búsqueda del modelo
psicolingüístico del lexicón m ental y se cen tra en el modelo conexionista. Esta teoría
parte de la idea de que la mente está organizada en forma de redes neurales cuya
información (no dos) se encuentra co nectada con otr os nodos media nte uniones
nerviosas. El signific ado de cada nodo viene determinado por las relac iones con o tros
nodos o palabras dentro de un complejo sistema.
Una vez esbozados los fundamentos teóricos que intervienen en el diseño del
programa, se to ma como referencia el léxico disp onible de una muestra de más de
2000 estudiantes chilenos de educación m edia (Valencia Espinoza y Echeverría,
1999) sobre 18 centros de interés 113 . Por tanto, la prueba de disponibilidad léxica
supon e la h erramienta de selección del voca bulario en este progr ama de enseñ anza
del vocabulario del español de Chile 114 . La aplicación se divide en tres módulos:
Introducción , Diagnóstico y Tareas .
En la Introducción se presenta el programa y sus principales ca racterísticas y
tareas. Asimismo, se aborda n lo s aspecto s teór icos r elacionados con la disponibilidad
113 1) Las parte s del cuerp o ; 2) Ropa y calza do ; 3) La casa ; 4) Muebl es ; 5 ) Alimen tos ; 6) La coci na ; 7) Medi os de tran sp ort e ;
8) Trabajo de camp o y jar dín ; 9 ) Plantas y animal es ; 10) Juegos y entretenimientos ; 1 1 ) Profesion es y ofi cios ; 12 ) La polít ica ;
13) La ac tiv idad e conó mica ; 14 ) Las art es ; 15) Cie ncia y tecnol ogí a ; 16) Mundo espi ri tua l ; 17) Proce sos mentales ; 18 )
Proble mas de l ambi ente .
114 Se sel eccionó el vocabulario que se enseña en el colegi o privilegiando , por tanto, la norm a culta .
Capítul o 2
Marc o t eór ico
127
léxica y co n la form a de or ganizar las unidades léxica s. Este apa rtado es d e gran
utilidad tanto para el estudiante, para fomentar el apren dizaje autóno mo, como para
el docente, que puede con ocer las orientaciones metodológicas en las que se basa el
programa.
En e l Diagnóstico , el estudiante se somete a una evaluación inicial sobre los
centros de interés que desee . Ese examen toma como referencia la p rueba de
disponibilidad léxica: los informantes escribirán todas las palabras que se le vengan a
la mente en los centr os marcados en un tiempo determinado. Una vez finalizada la
prueba, los datos se presentan en un diagrama que incluye la media de palabras
aportadas por los estudiantes chilenos en esos centros de interés. Además, se m uestra
la diferencia entre la situación d e partida del individu o con respecto al promedio de la
muestra analizada. Asimismo, se marcan los vocablos que no aparecen en los lista dos
del estudiante y que cuentan con un alto índice de disponibilidad en la muestra del
léxico disponible recogida.
Gráfi co 2.7 . Es tadí stic o de res ultad os c omparad os . Fuente: Eche verrí a (2001: 94)
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
128
En las T areas , el estud iante puede elegir entr e nueve tipos de ejercicio s
diferentes 115 y, a continuación, el centro d e interés sobr e el que quiere realizar la
actividad. Además, este programa es editable gracias a la estructura de sistema de
autor ( authorin g system ) de forma que tanto el do cente com o el estudiante pueden
incorporar nuevos vocablos, activida des, imágenes y vídeos en cualquiera de las
nueve tareas.
Aparte de los módulos de aprendizaje, el programa incluye otros dos
apartados denominados Glo sario y Nota s al profesor . El primero consiste en un
buscador de palabras que dirige al diccionario del léxico disponible. El segundo es
una inter faz d e comunicación que facilita la comunicación entre el alumno y el
p rofesor: permite plantear dudas, coment arios a las actividades realizadas, re forzar
algún conocimiento, etc .
Hernández Solís (2006) realiza una propuesta didáctica donde pone en
práctica los resultados de las pruebas del léxico disponible realizadas en Zacateca.
E ntre los objetivos de su tesis doctoral destaca la búsqueda de una aplicación práctica
de la disponibilidad léxica (Hernández Solís, 2006: 2 ). Para ello, realiza una
microplani ficación la realiza a partir de una fundamentada sele cción del vocabulario
que, en general, proviene de los listados del léxico disponible de los estudiantes
universitarios, por considerar que esta muestra de estudio cuen ta con el léxico
indispensable que deben conocer los estudiantes pr euniversitarios. No obsta nte, al
igual que otros autores ; reconoce lagunas e n el léxico obtenido mediante los centros
de interés que completa con v ocablos del Diccio nario del Español de Méx ico (DEM).
La propia autora critica que en otros estudios, como por ejemplo en López
Morales (1986), no se realice un a propuesta sobre la sel ección del vocabulario
(Hernández Solís, 2006 : 6) aunque ella misma admite qu e presenta un m odelo pero
no una propuesta acabada (Hernández Solís, 2006: 190). Básicamente, el patrón
consta de doce pa sos en los que se presentan ejemplos de ejercicios basados en el
centro de interés décimo, La ciudad . Los p asos so n: eva luación de diagn óstico,
selección del vocabulario, lectura, ilustra ción, definición, ilustración, construcción ,
115 Asoc iar una imagen a una de varia s pala bras , a so ciar un a palab ra a una d e varias imágenes , m ím ica , p arear
un vocablo con su definici ón, g eneración de un lexe ma seg ún sus rasgo s semánti co s, clas if ic aci ón de tér min os,
vocablo d iscordan te, explo ración en lám ina y c oncentración y memoria .
Capítul o 2
Marc o t eór ico
129
lectura y co rrección, agrupamiento, combina ción (las ora ciones d e base para reda ct ar
cada uno de los núcleos), comb inación (todas las oraciones de b ase para redactar el
discurso completo) y evalua ción final.
El léxico seleccionado corresponde a los 99 vocablos más disponibles de ese
centro que se corresponden con el 75 % de la frecuen cia acumulada del índice de
disponibilidad léxica. Como la mayoría de unidades léxicas son sustantivos, incorpora
verbos del DEM , que n o aparecen en los listados de la disponibilidad léxica de los
estudiantes de p rimaria ni de la universida d, y otro tipo de palab ras que incluye en
forma de anexo.
2.7. Variables que inciden en e l léxico di sponible
Desde los inicios de los estudios de disponibilida d léxica los resultados han
sido objeto de aná lisis desde persp ectivas diversas, ta les como la sociolingüística y la
psicolingüística. Los investigadores franceses G ougenheim et al. (1964) realizaron una
comparación geográfica tomando como referencia cuatro departamentos
administrativos del país galo, Dordogne, Eure, M arne y Vendée (Gougenheim et al.
1964: 163 - 164) y un a comparación sociológica (Gougenheim et al. , 1964: 165 - 182)
basada en dos factores, el m edio (rural y urbano) y el sexo.
Las variables sociológicas fueron empleadas por estudios posteriores hasta
consolidarse en el programa de referencia en la d isponibi lidad léxica en la década de
los noventa, Lexidisp. Esta aplicación informática permite filtrar vocablos y realizar
análisis matemáticos según cinc o variables 116 . Las v ariables más utilizadas en las
investigaciones que se in scriben dentro del Proyecto Pan his pánico de Disponibilidad
Léxica corresponden al sexo, nivel sociocultural, zona geográfica (urbana o rural) y
tipo de centro (público o pr ivado).
En este estudi o se analizan las variables sexo, estancias en el extranjer o,
conocimiento de más de un idiom a, hábitos de lectura, ortografía (si lo comparo con
el número de p alabras), clase social, uso de la lengua en diferentes contextos,
exposición a los medios de comunicación, motivación del futuro profesorado y tipo
116 Las variables de refere ncia son el sexo, el centro escola r (públi co o privado), la comunidad (urbano o rural),
el n ivel sociocultural (alto, m edio, bajo) y la edad (distinguiendo diferentes generaciones). Vi d. apartado 3.3.1
para una revisi ón del funciona miento del progra ma.
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
130
de estudios universitarios. Ciertas variabl es h an sido analizadas en el ámbito de la
disponibilidad léxica m ientras que otras suponen una nueva incorporación a estos
estudios. Su selección se fundamenta en el ámbito de la lin güística aplica da a la
enseñanza de idiomas.
Larsen - Freeman y Lon g (1991 ) afirma n que existen más de cuarenta teorías
diferentes sobre los diferentes factores que inciden en el aprendizaje de una lengua.
La mayoría de ellas tienen en cuenta no solo la situación física de aprendizaje, sino
también otros facto res socia les y reti culares como la edad. A lgunos a utores como
Colletine (2009: 128) se atreven a afirmar que el contexto es una de las variables más
importantes 117 .
El contexto, en sentido amplio, puede abarcar desde la diferente exposición a
la lengua (medio endolingüe y ex olingüe), hasta las características socioculturales y
reticulares del hablante. Existen diferen tes clasificaciones al respecto en las que se
suelen incluir los siguientes cuatro fa ctores principales que influyen en el proceso de
adquisición y aprendizaje d e segundas lenguas y lenguas extranjeras: la edad, el
método, la aptitud y la actitud (Spolsky, 1969: 272 - 274). En determinados casos la
nomenclatura difiere pero los aspectos considerados suelen ser muy similares. Así,
Cenoz Iragui (1993: 29) distingue cu atro tipo de variables clave: individuales,
socioesctructurales, psicosociales y socieducativa s.
La edad es un factor ampliamente estudiado por ser considerado un factor
relevante en la adquisición de un idioma (Johnson y Newport, 1989; Long 1990;
Newport , 1990; Spad aro, 1998; Scovel, 2000; D eKeyser, 2000; Singleto n, 2001; entre
otros). Se ha estimado que los niños adquieren con más facilidad un idioma
extranjero que los adultos debid o a la mayor plasticidad del cer ebro.
117 «One of the m ost im portant variables that affects the nature and the exten t to w hich learners acquire an L2
is the co ntext of learning » (Colle ntine, 20 09: 12 8).
There is a ti me i n human development when the bra in is predispos ed for success in
langu age lea rning . Deve lopm enta l chang es in the b rain, aff ect the n ature o f langu age
acquisition, and language learning that occurs after the end of the critical period m ay n ot be
based on the innate biol ogical struct ures believed to contribute to first language acquisit ion
(Lightb own y Spad a, 2006: 68 ).
Capítul o 2
Marc o t eór ico
131
Determinar el momento exacto y el tipo de rel ación entre adquisición y edad
es una cuestión inconclusa y que genera gran controversia (Birdsong, 200 5). No
obstante, algunos investigadores como Klein (Klein, 19 86: 9) 118 aseguran que esa
facilidad pa ra el aprendizaje de u na lengua se extiende hasta la pubertad. La edad
adulta conlleva otros beneficios lingüísticos ligados a la abstracción de los términos,
la comprensión de estructuras complejas y la memor ización de reglas. En general, el
adulto adquiere de forma más rápida el vocabulario y es capaz de producir estructuras
más complejas que los niños. Según (Lightbown y Spada, 2006: 72), los adultos
muestra n u n desarrollo mayor en las primeras etapas de aprendizaje aunque le s
resulte muy difícil aprender u n idioma con un domin io casi nativo.
El factor educativo, mediante algún método de aprendi zaje o clase de
aprendizaje, supone en algunos casos la única ex posición del hablante a la lengua
extranjera. A pesar d e que autores como Krashen ( cf. 1987 : 59 ) 119 consideran que no
es suficiente para adquirir una lengua, reco nocen su importa ncia com o pun to de
partida para que los estudiantes usen la lengua en el mundo e xterior. En este sentido,
l a mayoría de las investigaciones realizadas en centros educativos con programas
bilingües (Gajo y Serra 2002; Braun, 2007) muestran los efectos positivos, no solo en
áreas lingüísticas, sino también en el resto de materias. Lyster (Lyster , 2007: 14) 120
afirma que los programas de inmersión lingüística, con independencia de la
modalidad del programa, ayudan a desarroll ar la competencia en una se gunda lengua.
La aptitud y la actitud hacen referencia a procesos diferentes. Por aptitud se
entiende la cualidad o capacidad de un hablante para aprender un idioma. En cambio,
la actitud está relacionada con la motivación y su influencia ha sido am pliamente
estudiada (Gadner y Lambert, 1972; Gardner, 1982, Castro Calvín, 1991; Dör nyei,
1994a y 1994b). La clasificación tr adicional (Baker, 1992, 2001; Finegan, 1994; entre
otros) distingue dos tipos de motivación: instrumental, para conseguir un
determinado objetivo; e i ntegradora, como medio de formar parte de una sociedad.
118 « In general, it i s reasonable to assume that little progress is made after the age of puberty» (Klein, 1986: 9).
119 « The classroom will probably never be able to complete ly overcome its limit ation s, not does it have to. Its
goal is no t to substitute for the out side world, but to bring studen ts to the point w here they can begin to use
the outsid e world for furth er acquis ition » (K rashen, 1 987: 59).
120 « Researc h has clearl y demonst rate d that immersi on students , regardles s of program type, develop much
higher levels of second language proficiency than do non - imm ersion studen ts study ing the secon d langu age as
a regular subject (i. e. for one period per sc hool day) » (Lys ter, 2007: 14 ).
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
138
transferirlas a la nueva lengua, lo ha rá de manera más o menos ráp ida. Mientras que
un estudiante que no ha desarrollado dichas habi lidades con anterioridad tendrá
dificultades en el aprendizaje de una segunda lengua. Por ello, es más conveniente
que las habilidades lingüísticas se desarrollen primero en la lengua materna para
poder tener mejor disposición para el aprendizaje de la segunda lengua. Además,
Cummins reco ge informació n de investigaciones realizadas en d iferentes partes del
mundo donde se ratifica su hipótesis (Cummins, 1991: 70 - 89): « When children begin
the acquisitio n of a second language (L2), whether in the home or at school, their
cognitive resources clearly play a central r ole in the rapidity and ultimate success with
wh ich that language is acquired».
En este senti do, gran parte de los estudi os neuroling üísticos y
psicolingüísticos que dan prueb a de los beneficios cognitivos del bilingüismo,
extienden esas ventajas al aprendizaje de una tercera lengua (Jacobsen e I mhoof,
1974; Albert, Obler y Obler, 1978). En 1961, Lerea y Kohut realizan un estud io con
30 hablantes monolingües y 30 bilingües en el que durante 70 m inutos realizan cuatro
pruebas 131 : dos lingüísticas, una de in teligencia y una de persona lidad. Los resultados
muestran que los estudiante s bilingüe s aprendieron más rápidamente a asociar
palabras del test lingüístico que los monolingües hech o que, a su vez, está
correlacionado con una mayor inteligencia.
En cuanto a los estudios con una te rcera lengua propiamente dichos, cabe
destacar el artículo de Mägiste (1984) donde extrae conclusiones de tres
investigaciones que evalúan la adquisición de una tercera le ngua en estudiantes
inmigrantes. La primera, iniciada por el National Swedish Board of Educatio n,
compara los resulta dos en inglés de estudiantes suecos m onolingües y de estudiantes
que usan el sueco en casa pero tienen un conocimiento pasivo de su lengua materna
(no hay homogeneidad en esta variable ya que depende del país de origen del
estudiante). Tra s pasar una serie de p ruebas estandar izadas en inglés divid as en cuatro
partes, se constata que los estudiantes bilingües con un conocimiento pasivo de su
l engua materna presentan mejores resultados en inglés que los estud iantes
131 Cuest iona rio bili ngüe , Columbia Me ntal Maturity Scale , Rogers ’ Test of Personal ity Adjustment y Micro
Utte ran ce - As soci ati on Test (MU - A).
Capítul o 2
Marc o t eór ico
139
monolingües . En cambio, los res ultados de los hablantes que usan diariamente su
lengua materna, en lugar del sueco, son ligeramente más ba jos.
Swain , Lapkin, Rowen y Hart (1990) dem uestra n que es errónea la tenden cia
popular a pensar que los niños no deberían recibir instrucc ión en una L2 o L3 hasta
que no muestren un elevado nivel de conocimientos en la lengua mayoritaria.
Asegura n que muchos padres inmigrantes en Canadá son reacios a enseñar la lengua
materna a sus hijos porque creen que su nivel en inglés se verá afectado. En cambio,
apoyándose en la hipótesis de la interdependencia de Cumm ins y en sus propios
resultados, explican que la tercera lengua favorece a los estudiantes de un programa
bilingüe inglés y francés en Toronto. Ese mismo año, Nayak, Hansen, Kruege r y
Mclaughlin (1990) señalan que los h ablantes multilingües muestran un mejor
rendimiento a la hora de adquirir ciertos contenidos gramaticales que los
monolingües .
En 1992, Thomas compara el rendimiento de hablantes bilingües (inglés y
español) y mon olingües (inglés) que estudian una segunda o tercera lengua. Además,
clasifica a los ha blantes bilingües en do s grupos diferenciando a los estudiantes que
han recibido una instrucción formal en una lengua semánticamente r elacionada con la
lengua meta de aquellos que lo adquirieron en otro co ntexto. En general, los
resultados m uestran que la conciencia metalingüística de los estudiantes bilingües
puede aumentar si aprenden un a tercera lengua. Así, cuando los anglófonos con
conocimiento de español realizan actividades para aprender francés, suelen tener m ás
facilidades que los monolingües. En cuanto a los ha blantes bilingües q ue han recibid o
clases formales en español, se demue str a que han desar rollado una concien cia
lingüística que les ayuda a aprender francés más fácilmente que a los bilingües que
han aprendido español en un medi o informal.
Keshavarz y Astaneh (2004) realizan una p rueba de vocabulario en inglés a
una p oblació n de estudio formada por hablantes monolingües persas y hablantes
bilingües de turco y persa o armenio y persa. Las pruebas muestran que los hablantes
nativos de turco y armenio que hablan persa como segunda lengua obtuvieron mejor
puntuación en inglés que los habla ntes monolingües.
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
140
El armenio, el persa y el inglés fueron también las lenguas objeto de estudio
de Kassaian y Esmae’li en 2011. Concretamente, realizan un análisis del rendimiento
en una p rueba de vocabulario y comprensión lectora de 30 hablantes bilingües
armenios y persas y 30 monolingües persas. Los informantes, niñas iraníes de 17 a 18
años, cuentan con un nivel intermedio de inglés. Cabe mencionar que Irán posee un
sistema educativo centralizado por lo que las pautas meto dológicas y los man uales
utilizados para el aprendizaje de inglés como lengu a extranjera fueron los mismos.
Los resultados estadísticos muestran que el bilingüismo está altamente correlacionado
de manera positiva con el dominio de vocabulario y la destreza lectora.
Aunque e stas investigaciones com parten características con estudios cen trados
en una segunda lengua, autores como Cenoz (2000: 39 - 53) considera que se debe
hacer una clara distinción entre la adquisición de una segunda lengua y la adquisición
multiling üe. Según Cl yne (1997: 113) el motivo radicaría en que los procesos de
adquisición de una tercera lengua son mucho más complejos, en parte debido a los
diferentes contextos de aprendizaje no solo del individuo sino del individuo con cada
lengua. De hecho , investigacio nes como la de Hsu (2013) muestra n diferentes
resultados no solo entre hablantes monolingües y bilingües, sino también entre
hablantes bilingües y trilingües.
En el ámbito de la disponibilida d léxica, los estudios que incluyen la variable
referida al cono cimiento de otras lenguas lo hacen para valorar su incidencia en el
léxico disponible en español como lengua extranjera. Carcedo González (2000c)
analiza la influencia del conocimiento de otras lenguas románicas de los estudiantes
finlandeses de español co mo le ngua extranjera. Prueba que aquellos informantes
habl an otras lenguas romances presentan una productividad léxic a mayor que el
resto.
Samper Hernández (2002) enriquece el análisis de esta variable en estudiantes
de español como lengua extranj era que realizan una estancia en España. No solo
pregunta al informante si conoce otr a lengua, sino también con qué nivel (inicial,
intermedio, a vanzado y superior) y cuál es su lengua materna (inglés, italiano, japonés
y otros). Destaca que el factor más influen te en el cau dal léxico es el nivel alcanzado
en lengua espa ñola. Sin em bargo, la var iable referida al conocimiento de otras lengua s
Capítul o 2
Marc o t eór ico
141
no p resenta resulta dos significativo s y los estudiantes japoneses so n los que escriben
más palabras por encima de los italia nos, ingleses y el grupo denominado «otros». No
obstante, la autora advierte que se trata de un estudio exploratorio que cuenta con
una muestra reducida y cuyos datos pueden servir de base para investigaciones
futuras.
Hugo (2003) tam bién realiza una inv estigación exploratoria donde analiza una
muestra de 84 estudiantes alemanes de la región de Sarre que estudian español en el
instituto. El estudio concluye qu e la variable con mayor incidencia en la
productividad léxica es el nivel alcanzado en lengua esp añola, con independencia del
número de lenguas que conozca el informante. Sánchez - Saus Laserna (2008) analiza
varias variables relacionadas con el aprendizaje de una lengua sobre una mestra de 81
estudiantes extranjeros de español de la Universidad de Cádi z: nivel de español (A, B
y C, como reducción de los seis del MCER), lengua materna (inglés, francés, alemán,
italiano, finés y polaco), conocim iento de otras lenguas (románica o no románica) y
uso del español (alto o bajo). Entre las conclusiones, cabe de stacar que lo s
informantes qu e conocen otra lengua rom ánica tienen m ayor producción léxica que
el resto.
En su tesis doctoral, Sánchez - Saus Laserna (2011) estudia el léxico disponible
de 322 estudiantes extranjeros de español en las ocho universidades andaluzas. Las
variables seleccionadas son similares: el sex o, el nivel de español (A, B y C, a partir de
los niveles del MCER ), las lenguas maternas (alemán, finés, francés, inglés, italiano y
polaco), la frecuencia con que hacen uso del español (alta, me dia y baja) y el
conocimiento que tienen de otr as lenguas ex tranjeras románicas (solo en el caso de
informantes que no tengan ya una lengua rom ánica como lengua materna y qe
contempla tres posibilidades: que no conozcan ninguna otra lengua extranjera; que
conozcan otra u otras, pero ninguna sea románica, y que cono zcan otras len guas
románicas).
L os r esultados muestr an que aquellos estudiantes que conocen otra lengua
extranjera producen la misma cantidad de palabras que aquellos estudiantes que
hablan otra lengua románica co mo lengua materna o incl uso producen más palabras.
Sánchez - Saus Laserna (2011) matiza los result ados indicand o que esa variable está
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
142
relacionada directamente con la lengua materna y con el nivel de español y, como no
existe el mismo núme ro de informantes en cada variable, los dat os pueden verse
influenciados.
Frey Perey ra (2008) analiza variables similares en una muestra de 31
estudiantes de esp añol como lengua extranjera: lengua materna (sueco, portugués,
noruego, mandarín, japonés, in glés, francés, danés, coreano y alemán), sexo, edad,
nacionalidad, nivel de estudios de español, conocimiento de otras lenguas extranjeras
y tiemp o de residencia en España. En el análisis cualitativo y cuantita tivo, el
con ocimiento de otras lenguas juega un papel secundario ya que la variable con
mayor incidencia es el tiempo de residencia en España.
En un trabajo prel iminar, López Rivero (2008) analiza el léxico dispon ible de
43 estudiantes adultos de español como lengua extranjera. Las variables ob jeto de
estudio son el sexo, ed ad, nivel sociocultural, conocimiento de otr as lengua s, lengua
materna, años de estudio del español y método de enseñanza del español seguido. La
incidencia del conocimiento de otras lenguas sobre el v ocabulario d isponible se hace
patente en el número de palabras aportadas por cada informante, de forma que
cuantas más lenguas con oce un informante ma yor será su caudal léxico. E ste factor
se acentúa en los hablantes que cono cen tres o más lenguas.
Magnúsdóttir (2012) realiza un estu dio con una muestra de 288 escolares de
Islandia que estudian español como tercera lengua extranjera en Secundaria. Las
variables analizadas son el sexo, la ubicación del centro, tipo de centro, modalidad de
estudio y conocimiento de otras lenguas. E n cam bio, para poder realizar los análisis
con Dispolex , Magnúsdóttir (2012: 71) reduce y simplifica las variables lo que
conlleva que no se analice el conocim iento de otras lenguas extranjeras.
García García (2014) estudia las variables sexo, edad, lengua ma ter na, nivel de
español, m otivación p ara apren der españo l, conocimiento de otras lenguas, n ivel
sociocultural y tipo d e estudia nte sob re una m uestra d e 300 estudiantes de español en
la comunidad de Madr id. El investigador concluye que la var iable relativa al
conocimiento de otras lenguas no incid e en el caudal léxico de los estudiantes ya que
se el promed io de vocablos aportado s por los informa ntes que no conocen otra
Capítul o 2
Marc o t eór ico
143
lengua extr anjera es superior a aquello s que conocen otra lengua y el promedio de
palabras es similar en ambos grupos.
En el « XI Congreso Internacional de Lingüística General » , San tos Díaz
(2014a) presenta algu nos análisis descriptivos de la relación de la varia ble del
conocimiento de otras lenguas co n el número d e palabra s y vocablos sobre l a
muestra del presente estudio. En general, el promedio de palabras y vocablos
aportados por los informantes aumenta a la par del número de idiomas que conoce
un hablante . No obstante, aquello s infor mante s que tienen un nivel avanz ado en dos
idiomas presen tan un m ayor ca udal léxico que los sujetos que cono cen dos lenguas
con un n ivel inicial o medio. Por tanto, de los resultados se desprende que la
productividad léxica se ve influida no solo por el número de lenguas que conoce un
informante sino también por el n ivel de competencia lingüística alcanzado en las
lenguas que conoce.
2.7.4. Corrección ortográfica
Las directrices dadas en las pruebas de disponibilidad léxica muestran el
carácter secundario otorgado a la corrección ortográfica. Com o no rma general, en l os
estudios her ederos del Panhispánico, al informante se le pide que escriba todas las
palabras que conozca relacionadas con un centro de interés dado. Por ello, a menudo
los hablantes escrib en todo lo qu e se les viene a la mente descuidando la forma e
incluso el contenido, ya que el ob jetivo es conseguir la máxima p roducción léxica.
Según Paredes García (1999: 76) 132 el hecho de que los inform antes no
puedan reflexionar sobre la forma correcta de cada palabra, como podría hacerse si
no existiese la limitación temporal o esta fuese superior, ayuda a conocer la forma
original de la palabra en la mente del individuo. Precisamente por esta razón, es tan
relevante desde el punto de vista de la didáctica de la ortografía puesto que permite
detectar los errores más frecuentes en una población de estudio y diseñar materiales
que hagan hincapié en determin adas reglas orto gráficas, excepciones a la norma o
132 « Podemos decir que lo que las encuestas nos ofrecen es el estado primari o de la situación ortográfica de
cada sujeto, la forma básica con la que la palabra aparece representa da en la mente del individuo. Esto parece
constatarse en el hecho de q ue proporcionalmente so n muy escasas las autocorrecciones o las grafías híbridas
(tipo b/v aca), índice s de dud as s obre el uso corr ecto del idi oma» (Paredes Garc ía , 1999: 76).
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
144
palabras específicas. A continuación, se presentan estudios de disponibilidad léxica
que han analizado en detalle los errores ortográ ficos presentes en lo s listados y que,
en general, coinciden en la predominancia de los errores de a centuación sobre el
resto.
Paredes García (1999) analiza los errores ortográficos presentes en una prueba
de disponibilidad léxica reali zada a 484 informantes de segundo ciclo de Educación
Secundaria Obligatoria y Bachillerato de Alcalá de Henares. Dadas las características
de la prueba de disponibilidad léxica, donde los informantes aportan unidades léxicas
simples o complejas, Paredes Ga rcía (1995: 76) afirma que tan solo es posible
conocer los erro res más frecuentes en el pla no fonético y léxico. En su estudio
(Paredes García, 1999: 81), los errores de acentuación ocupan el primer lugar (10 625
palabras) frente a los errores de letra (46 19 palabras), los errores léxicos (3477
palabras) y los errores de ca rácter morfosintáctico (320).
Ávila Muñoz (2007) realiza un estudio exploratorio con estudiantes de 2.º de
Traducción de la Universidad de Málaga. Destaca la proliferación de las faltas de
ortografía en los estudiantes universitarios puesto que de los 50 informantes
encuestados, tan solo 3 no cometieron ninguna falta de ortografía, 14 escribieron
menos de 10 palabras incorrect as, 19 entre 10 y 20 faltas y 1 4 cometieron más de 20
faltas. A demás, c lasifica las diferentes disortografías en errores de acentuación y
ortografía general pero n o los cuantifica.
A continuación, analiza la incidencia de determinadas variables (sexo, número
de horas semanales navegando por Internet, clase social, li bros que el estudiante lee al
año, entre otras) con objeto de conocer cuáles son los principales condicionantes de
las faltas de ortografía. Á vila Muñoz (2007 : 45) concluye que las varia bles que
guardan una mayor correlación son la clase social y los hábit os de lectura. Muestra
que cuanto m ayor es la clase social del informante y más libros lee al año, meno s
faltas de o rtografía comete en la prueba de disponibilidad léxica. En cuanto al r esto
de variables, muestra que las mujer es tienden a cometer más falta s de or tografía que
los hombres (sin tener en cuenta los errores de acentuación) y que las horas de
navegación en Internet no tienen una incidencia negativa en la correcció n ortográfica.
Capítul o 2
Marc o t eór ico
145
El estudio de Saura Rami (2008) seleccion a informantes de la muestra
aragonesa realizada durante los cursos 1998/99 y 1999/00 formada por 417
estudiantes d e 2.º de Bachillerato o CO U. Aunque los estudios se realizan en 28
centros de enseñanza , el análisis sobre la ortografía de las encuestas recoge tan solo
los datos de 45 alumnos de los IES Lucas Mallada (Huesca), Luis Buñuel (Zaragoza)
y Francés de Arand a (Teruel). De las 1394 disorto grafías detectadas, 940
corresponden a error es de acentuación y 454 a errores gráficos, es decir, que los
informantes co menten el d oble de f altas de ortografías debido a una inadecuada
acentuación
Blanco Domínguez (2011) analiza los errores ortográficos de aquellas palabras
con un índice de fr ecuencia acumulado del 80 % de los estudiantes preuniversitarios
gallegos de la obra colectiva edita da por López Meirama (2008). Del total de 11 152
errores ortogr áficos, 5756 corr esponden a una inadecuada acentuación, lo que
equivale al 51,57 %. Se trata hasta el momento del estudio que analiza de forma más
pormenorizada las formas erróneas, distinguiendo entre errores ortográficos, errores
fonéticos y lapsus. Por ejemplo, cuando el error se debe a la ausencia de tilde
distingue entre palabras: agudas (29,22 %), llanas (15,28 %), esdrújulas (37,80 %), con
diptongo (6, 02 %), con hiat o ( 11,30 %) y monosí l abas (0,38 %) . En cuanto a l a
colocación de la tilde en la sílaba incorrecta, un 68,30 % se debe a palabras agudas,
llanas y esdrújulas y, el resto (31,7 0 %), se local iza en palabras con dipton go o hiat o.
Para completar el análisis cuan titativo, Blanco Dom ínguez (2011) añade las palabras
que presentan con más frecuencia disortografías y, en determinados casos, su forma
incorrecta ( autóbus ).
2.7.5. Clase social
El estrat o sociocul tural forma parte de la mayoría de las investigac iones de
disponibilidad léxica. Los precursores de esta disciplina, Gougenheim et al. (1964),
incluyeron esta varia ble en las encuestas pero no la tuvieron en cuenta a la hor a de
realizar análisis. López Morales (1979) toma como referenci a los niveles
soc ioeconómicos de la teoría del d éficit de Bernstein (1961) para analizar cualitativa y
cuantitativamente su incidencia en el léxico disp onible. A pesar de que revela
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
146
diferencias en el número y el tip o de pa labras aportadas por los diferentes estratos,
López M orales (1979: 181) considera que esta teoría no es suficiente para afirmar que
los estratos inferiores tengan una m enor capacidad cognitiva. Años más tarde, L ópez
Morales (1996) refuta la hipótesis de que el diferen te caudal léxico de los estratos
sociales implique dificultades cognitivas en el estr ato con menor léxico.
En general, en los estudios de léxico disponible el nivel sociocultura l está
conformado por los d atos relativos a l nivel de estudios y la ocupación profesional de
los pad res del informante (E cheverría, 1991; Alba Ovalle , 1995a; Samper y
Hernández, 1997; Mateo, 1998; Echeverría y V alencia, 1999a; Carced o 2001; Gómez
Devís, 2004; entre otros). En cambio, al igual que en este estud io, algunos autores
han incluido los ingresos famili ares para mejorar la d escripción de esta variable
( López Morales, 1999a; Carcedo, 2001; Ávil a Muñoz y Villena Ponsoda, 2010, 2011).
Ávila Muñoz y Villena Ponsoda (2010) realizan un completo aná li sis
multifact orial donde evalúan la incidencia de la posición social sobre el léxico
disponible y la capacidad de identificación de tecnicismos (Pident). Destacan la
relación entre la posición social y el léxico especializado de forma que aquellos
informantes provenientes de clase alta son capaces de reconocer y asociar
correctamente una ma yor can tidad d e palab ras técnica s con los centros de interés.
No obstante, concluyen que la productivid ad léxica está más asociada a la exposición
con los medios de comunicación y al conocimiento del vocabular io especializado.
Por tanto, la clase social influye de manera indirecta, a través de la variable Pident, en
el léxico disponible.
2.7.6. Hábitos de lectura y exposición a los medios de comunicación
A través de la lectu ra, el estudiante es capaz de aprender numerosas unidades
léxicas de manera incidental (Elley y Mangub hai, 1983; Coady, 2000). En este sentido ,
existen num erosos estudios prueban el papel fundamental que juega la lectura en el
proceso d e adquisición y aprendiza je de una segunda lengua y una lengua extranjera
(Zahar y Cobb y Spada, 2001; W aring y Takaki, 2003; Horst, 2005; Pigada y Schmitt,
2006; Brown, Waring y Donkaewbua, 2008; entre otros). No obstante, el efecto de
Capítul o 2
Marc o t eór ico
147
los hábitos de lect ura y la exposición a los medios de com unicación n o son variables
comunes en los estudios de dispon ibilidad léxica.
El primer estudio de léxico disponible que incorpora una variable relativa a la
lectura es llevado a cabo por Mackey (19 71a) quien se cent ra en analizar el tipo de
lecturas que realizan los in formantes. En el año 20 07, Ávila Muñoz r elaciona el
número de libros que los informantes leen al año con los errores ortográficos que
comenten en lengua m aterna. Demuestra que se prod uce una correlación significativa
entre am bas variables de forma que cuanto más errores com ete un informante menos
libros lee al año. Ávila Muñoz y Villena Ponsoda (2010) incorporan una variable que
recoge el número de libros que el informante lee al año y que divide los res ultados en
tres grupos: entre 0 y 10, entre 10 y 20 y más de 20. En esta ocasión, la incidencia de
esta variable no r esulta significativa en el caudal léxico en la primera lengua d e los
informantes.
En cambio, incor poran una variable que hace refer encia a la exp osición a los
medios de comunicación, divida según el tipo de programas y el número de horas de
exposición, que revela d iferencias significativas entre los diferentes grupos. Á vila
Muñoz y Villena Ponsoda (2010: 264) afirman que el efecto de la expo sició n a
programas televisivos de consumo (no ticias del cora zón, telerrealidad, etc.) es
curvilíneo: quienes siguen estos p rogramas una vez a la semana presentan
puntuaciones m ás bajas en el continuo de desplazamiento (el cual m uestra los
hablantes con mayor o menor vocabulario descentralizado) que aquellos con nunca
ven este tipo de programas o lo h acen asiduamente. Esa exposición a los medios de
comunicación no resulta significativa en el n úmero de faltas d e ortografía (Ávila
Muñoz, 20 07).
2.7.7. Contacto y uso de la lengua extranjera en diferentes contextos
Esta variable se refiere al contacto y al uso de la lengua extranjera por parte
del informante: para comunicarse con amigos y familiares, para escuchar música, ver
programas de televisión, entre otros aspec tos. Es de gr an relevancia desde el punto
de vista de la lingüística aplicada a la enseñanza de una lengua, ya que es necesario
marcar la diferencia entre una situación de enseñanza - aprendizaje endolingüe y
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Univ ersi tar io e n Pr ofes orado
250
seguida por ty pist por tratarse de profesiones relacionadas con el sexo femenino. En
cambio, los listados entre ch icos y chicas p resentan una mayor coincidencia,
concretamente un 10 % ya que existen ciertas palab ras relacio nadas con los jóvenes,
como scooter , y otras que apar ecen en los tres listad os pero en posiciones más
adelantadas en el caso de los jóvenes ingleses, como bus y s chool en el centro
denominado The city .
CI
Tres lis tados
Actual /boys
Actual /gir ls
Boys/g irl s
Vocabl o
%
Vocabl o
%
Vocabl o
%
Vocabl o
%
2
12
60 %
2
10 %
1
5 %
5
25 %
3
8
40 %
2
10 %
1
5 %
7
35 %
4
13
65 %
0
0 %
0
0 %
3
15 %
5
12
60 %
0
0 %
1
5 %
3
15 %
6
6
30 %
0
0 %
1
5 %
6
30 %
7
6
30 %
1
5 %
1
5 %
6
30 %
Medi a
9,50
37,5 %
0,83
2,5 %
0,83
3,33 %
5
10 %
Tabla 4. 22 . Datos com parativos d e la investiga ción de D imitrijevi ć (1969) y de l estudio actual
A co ntinuación se presenta la co mparación con los cen tros coincidentes de la
investigación llevada a cabo por Ferreira (2006). La segunda colum na m uestra los
resultados extraídos de hablantes nativos y la tercera de estudiantes universitarios
chilenos.
Centr o
Estud io act ual
Ferrei ra (2 006): hablant es
nativos
Ferrei ra (2 006):
estudiantes chilenos
01. Human
body part s
head , eye , leg , arm , nose ,
finger , hand , mouth , ear ,
hair , sh oulder , foo t , teeth ,
neck , nail , feet , toe , knee ,
lip , heart
leg , arm , head , eye , finger ,
hand , nose , toe , ear , mouth ,
feet , knee , heart , neck ,
shoulder , lun g, hair ,
stomach, ankle, elbow
head , arm , le g , hand , eye ,
nose , mouth , finger , ear ,
hair , nail , neck , foo t ,
teeth , ton gue, knee , feet ,
lip , shoulder , f ace
02. Clothes
trouser , T - shirt , skirt , shoe ,
jeans , shirt , sock , jack et ,
hat , dress, scarf , coat ,
pullover , boot , glove , shorts ,
bra , sweater , tie , underwear
skirt , shoe , trousers , jean s ,
t- shirt , shirt , top , fashio n,
sock , sh orts , ha t , tig hts,
shopping, money, bra ,
to psho p, sho p, colo ur pan ts,
des igner, jacket
pants, shoe , t- shirt , jacket ,
trousers , sw eater , scarf ,
skirt , jeans , soc k , shirt ,
hat , coat , underwear ,
dress , blouse, glove , boot ,
shorts , tie
03. Food
and drink
water , meat , fish , to mato ,
potato , wine , milk , Coke ,
orange , ju ice , beer , bread ,
chip , coffee , apple ,
vegetable , h amb urger,
banana , chicken , pizza
water , apple , orange , coke ,
chip , c hocola te, pasta,
banana , car rot, wine ,
chicken , fruit , bre ad ,
orange - juice, fat, lemo nade,
mil k , pork, rice , vegetable
meat , tom ato , apple ,
potato , bread , milk ,
chicken , lettuc e, juice ,
orange , coffee , beer ,
vegetable , fish , tea, water ,
wine , soda, rice , fruit
07. Games
and
entertainme
nt
football, basketb all, cinema ,
tennis, videog ame, musi c ,
television , sport , chess,
theatre , card , dance , Pla y
Station, reading, swimming,
volleyball , running, jogging,
baseball , bal l
tv , film , radio , th eatre ,
musi c , cinem a , magaz ine,
medi a, movie , f un, show ,
television , friend , com edy,
play , book , part y , m oney,
sport , new spape r
cinema , movie , music,
theatre , tv , friend , party ,
television , gam e, fun ,
radio , book , spo rt,
concert, park, dancing ,
play , show , disc o,
shopping
Tabla 4. 23 . Compara ción de los veinte prim eros vocab los en inglés d e las investigac ión de Ferreira (2006) y del
estudio actual
Capítul o 4
Anális is gener al
251
En este caso, la coincidenc ia de palabras en las tres investigacione s no llega al
50 %. Los resultados más similares son los correspondiente s a estudiantes chilenos y
españoles co n un 25 % de compatibilidad aparte del 47,5 % común a los tres listados.
Sin embargo, el porcentaje de coi ncidencia con estudiantes nativos desciende a la
mitad: 12,5 % de los vocablos aportados por estudiantes chilenos y a 7,5 % por los
españoles. El hecho de que la nomenclatura fuese diversa en el centro referido a las
distracciones en español se hace patente en los resultados. El número de
coincidencias entre lo s hablantes n ativos y los estudia ntes chilenos es d el 40 %
mientras que entre los hablantes nativos y los estudiantes españoles del 0 % y solo de
un 5 % entre los estudiantes chilen os y españoles.
CI
Tres
investiga ciones
Estud io act ual y
Habl ant es nativos
Estud io act ual y
estudiantes chilenos
Habl ant es na ti vos y
estudiantes chilenos
Vocabl o
%
Vocabl o
%
Vocabl o
%
Vocabl o
%
1
14
70 %
2
10%
4
20 %
0
0 %
2
10
50 %
1
5 %
8
40 %
0
0 %
3
9
45 %
3
15 %
7
35 %
2
10 %
7
5
25 %
0
0 %
1
5 %
8
40 %
Medi a
9,5
47,50 %
1,5
7,50 %
5
25 %
2,5
12,50 %
Tabla 4. 24 . Datos comparativos de la investigación de Ferreira (2006) y del estudio actual
En el estudio de Gougenheim et al. (1964) solo se comparan los veinte
primeros vocablos por no contar con el total de palabras por centros de interés. Los
datos fueron recogidos en diferentes zonas de Francia. En el Département de la
Dordogne se recogieron 500 encuestas. Las fichas se dist ribuyeron en cuatro grupos:
120 niños de zon a urbana, 120 niñas de zona urbana, 130 niñas de zona rural y 130
niñas de zona rural. En el Département de la Marne 173 escolares realizaron la
prueba: dos grupos de 75 niños y 98 niñas, de los cuales provenían 133 de ciudad y
40 de l campo. En el D épartement de l’ Eure la muestra contó 85 informantes,
formados por 73 n iños y 12 niñas, to dos (salvo 5) de la ciudad. Por último, en el
Départment de la Vendée se pasaron 146 cuestionarios realizados a 90 niños y 56
niñ as, 130 correspondientes a la ciudad y 16 al campo.
Centr o
Estud io act ual
Dépar tme nts de l a Dord ogne ,
Marn e, Eu re , Ven dée
Dépar tme nt de la
Dord ogne
01. Le
corps
huma in
tête , mai n , bras , pied ,
bouche , oreille , jam be ,
doigt , nez , œil , yeux ,
cheveu , cou , ongle, dent ,
ventre , do s, ép aule, genou ,
langu e
oeil ( yeux) , oreille , nez , bras ,
jamb es , pied , main , bouche ,
tête , co eur, doigts , cou , fo ie,
estomac, dents , po umo ns,
langu e , cheveux , genoux ,
ventre
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Univ ersi tar io e n Pr ofes orado
252
02. Les
vêtements
pantalon , cha ussure , jupe ,
chemise , t(ee ) - shirt, robe ,
chaussette , veste ,
mant eau , jean, gant ,
chapeau , pull ( - over) ,
écharpe, cravate , culotte ,
blouse , foular d, co llant,
botte
chemise , ch aussettes , culotte ,
mant eau , robe , veste , pull - over ,
jupe , blouse , gilet , ta blier ,
pantalon , cravate , cache - nez,
combinaison , béret , chapeau ,
caleçon, bas , corsage
chemise , veste , tablier ,
mant eau , gilet , culotte ,
robe , chaussette , jupe ,
combinaison , pantalon ,
cravate , bas , gants , béret ,
impe rméab le, blo use,
chapeau , corsage , pull -
over
06.
Moye ns
de
transpo rt
voiture, vélo , avion , train ,
bus , mé tro, bat eau ,
tram(w ay) , cheval, moto ,
TGV, taxi, à pied, RER,
TER, camion , tr icycle,
navette, parachu te, mi nibús
camion , train , avion ,
bateau , moto , auto ,
charrette, car, bicyclette,
mich eli ne , autobus ,
tramw ay , vélo , vélom oteur,
camionnette, brouelle,
tracteur, dilige nc, r emorq ue,
paquebot
Tabla 4. 25 . Compara ción de los veinte prim eros vocab los en inglés de las investig ación de G ougenh eim et al.
(1964) y de l estudio actual
Esta invest igación solo permite hacer varias comparaciones ya que no recoge
el listado de palabr as ordenadas según el ín dice de disponibilidad léxica. No obstante,
se pueden observar a lgunos datos llamativos. Po r una parte, se reitera el carácter
compacto del primer centro puesto que el vocabulario presente en varios
departamentos en Francia y en la m uestra actual coincide en un 85 %. A
continuación, se comprueba que en el centro referido a la vestim enta, coinciden los
tres listados en un 55 % pero el resto de palabras escritas por franceses y españoles
solo sumaría un 5 %. Sin embargo, las dos últimas columnas añaden un 30 % al
porcentaje de coincidencia donde se incluyen términos como combinaison y coursage ,
que quizás hoy en día no serían tan disponibles.
CI
Tres inves tiga cione s
Estud io act ual y
v arios
departamento s
Estud io act ual y
Dord ogne
Varios
departamento s y
Dord ogne
Vocabl o
%
Vocabl o
%
Vocabl o
%
Vocabl o
%
1
-
-
17
85 %
-
-
-
2
11
55 %
0
1
5 %
6
30 %
6
-
-
-
-
8
40 %
-
-
Tabla 4. 26 . Datos com parativos d e la investiga ción de G ougenhe im et al. (1964) y del estudio a ctual
En líneas generales, se ha comprobado que los list ados se asemejan más o
menos según se trate de la lengua materna o la lengua extranjera de los informantes.
Este análisis inicial podría dar lugar a un estudio más pormenorizado de la
organización del lexicón mental como se realiza en el Capítulo 6. Además, es posible
conocer más allá d e las palabras localizad as, como puede ser que cier tas profesiones
estén más relaciona das con un sexo u otro, razón por la cual se dedica el últim o
Capítul o 4
Anális is gener al
253
apartado de este capítulo a presentar los listados de palabras según el sociolecto.
Además, en lengua extranjera es posible conocer la presencia del léxico en los
manuales o la facilidad d e adquirir ciertos términos.
4.6. La sit uación or tográfi ca
En el presente estudio, la recogida de errores ortotipográficos de cada
informante se realizó mediante una matriz diseñada ad hoc . El fo rmat o seguido para la
confección del listado fue el mismo que pa ra la lematización de las p alabras, por lo
que se creó una hoja de cálculo por centro de inter és donde a cada informante le
correspondía una fila que incluía diferentes tipos de anotacion es. Los errores
detectados han sido re gistrados en su forma original , es decir, sin aplicar las normas
de edición. Por tanto, se recogen palabras en género femenino, arquitecta tecnica , y
número plural, arboles 217 .
A continuación, se presenta la distribución de disorto grafías por idioma y por
centros de interés. El objetiv o es recoger qué tipo de faltas de ortografía son las más
acuciadas para reflexionar sobre las posibles causas y buscar estrategias de enseñanza
y aprendizaje adecuadas que ayuden a soslayar ese obstá culo. Además, se realiza una
comparación interm uestral c on resultados de otros estudios que recogen los errores
ortográficos de sus listados desde el punto de vista descriptivo (Paredes García , 1999;
Saura Rami, 2008; Blanco Domínguez, 2011) y s ociolingüístico (Ávila Muñoz, 2007).
4.6.1. Resultados del estudio actual
La presentación de las palabras concretas con distortografías se ha incluido en
forma de a péndice separados según el idioma: espa ñol, inglés y fra ncés. En español
se presenta según el m o delo recogido en el denominado «Apéndice ortográfico» del
estudio rea lizado en Málaga por Ávila Muñoz y V illena Ponsoda (20 10: 317 - 319) :
• Acentuaci ón
217 La conservaci ón de las form as orig inales perm ite la re alizació n de estudio s ulterio res en espa ñol y en le ngua
extranjera centrados en la didáctica de la lengua. E n este sentido, cabe m encionar el análisis de los errores
léxicos en esp añol co mo le ngua e xtranjer a de los estudi antes finlandeses realizado por Carcedo González
(1999c).
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Univ ersi tar io e n Pr ofes orado
254
• Grafía c, z + e, i
• j-g
• s-x-c-k- qu
• h
• b-v
• ll -y-ñ
• Otras
E n cambio, el formato de presentación d el anexo en l as lenguas extranjeras
difiere de l españ ol debido a la dificultad de lem atizar algunos vocablo s que se alejan de
la forma correcta. Ejem plo de ello, es el informante 25, cua ndo trata de escribir caracol
en inglés, snail , p ero lo hace en fr ancés, scargot . Por ello, los errores ortográfico s y
calcos de otros idiomas van p recedidos de la forma correcta en la que se han
lematizado los vocablo s.
Del total de vocablos con faltas de ortografía, es decir 328, más de la mitad
corresponden a erro res de acentuación, concreta mente 217 vocablos . El resto de
disortografías son meno res , c on lo que desde el punto de vista pedagógico parece
necesario insistir en la aplicación de las reglas de acentu ación. Cabe destacar que en
algunas programaciones de centros educativos las faltas de ort ografía penalizan la
calificación del a lumnado. Por tan to, el pr ofesor ha de ser capaz de correg ir
adecuadamente las producciones escritas del alumnado y conver tirse en un referente
para el mismo.
CI
Acentua ción
c, z + e, i
j-g
s-x-c-k- qu
h
b-v
ll -y- ñ
O tras
Total
C1
35
0
1
0
0
3
2
5
46
C2
13
0
1
1
0
3
1
9
28
C3
28
1
2
0
2
3
0
15
51
C4
22
0
2
1
0
1
0
8
34
C5
29
1
1
1
0
0
0
5
37
C6
19
1
0
2
0
0
0
8
30
C7
24
0
0
0
0
0
1
15
40
C8
29
0
0
2
0
1
0
5
37
C9
18
0
0
0
0
2
0
5
25
Total
217
3
7
7
2
13
4
75
328
Tabla 4. 27 . Clasificación de errores or tográficos en lengua esp añola
Capítul o 4
Anális is gener al
255
La Tabla 4. 27 co rrobora la hipótesis de estudios anterio res y muestra una gran
escala entre las falta s de ortografía deb idas a la acentuación gráfica, un 66,1 6 %,
respecto al resto de errores , 33,84 % . El apartado «Otras» recoge todas aquellas
disortografías que no han sido incluidas en el resto de secciones, entre las que
destacan las faltas relacionadas con palab ras extranjeras como leggins y paddle .
La distinción entre pares de letras que designan un mismo fonema, tales como
b y v que corresponden al fonema /b/ y la s letras j y g en los caso s que se refieren al
fonema /x/, presentan igu almente ciertas dificultades en los hablantes. Un 3,95 % de
los e rrores se derivan del uso de b y v que corresponden a trece vocablos ( bello , púvis ,
vazo , baquero , verenj ena , vikini , a luvia , cerbeza , vicarbona to , bate , avogado , grava dor , gravadora ) y
un 2,13 % al uso de la j y g relativo a siete vocablos ( vajina , trage , berengena , potage ,
conserge , jugete , agetreo ).
Gráfi co 4. 12 . Dist rib ució n por cent ual del ti po d e er ror es e n l engua es pañol a
En el Gráfico 4. 13 se muestra la distribución porcentual de lo s err ores
ortotipográficos y de las palabras en cada centro de interés . En gen eral la diferencia
entre las palabras y err ores no supera el 1 % por ámbito, es decir, que coincide el
porcentaje de palabras en un centro de interés con respecto al total . Por ejemplo, el
primer centro, Partes del cue rpo hum ano , cuenta con un 13,69 % de palabras y un
13,39 % de los errores totales. No obstante, el séptimo centro , Juegos y distracciones ,
presenta una diferencia de al go más de cuatro puntos deb ido quizás a que e n ese
apartado se han incluido una gran can tidad de nombres comu nes y propios de juegos ,
que a menudo están presen tes en el lenguaje oral pero no son tan f recuentes en un
texto escrito. Además , ese centro de interés contiene un 13,39 % de errores al igual
que el primer cen tro y se encuentra por deb ajo del tercer centro, Comidas y bebidas . Sin
66,16%
0,91%
2,13%
2,13%
0,61%
3,96%
1,22%
22,87%
Tipo de er r or es
Acentuación
c , z + e,i
j-g
s-x-c-k-qu
h
b-v
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Univ ersi tar io e n Pr ofes orado
256
embargo , estos dos últimos centros son considerablemente má s productivos, 13,6 9 %
y 14,32 % frente a 9,26 % del séptimo centro , de ahí que el porcen taje de faltas de
o rtografía se corresponda con el número de p alabras producidas.
En el lado opues to se sitúan el segundo centro, La ropa , y el noveno,
Ordenadores e internet , en cuyos casos el porcentaje de errores es considerab lemente
inferior al de palabras, 11,45 % del total de palabras en comparación con 9,47 % del
total de er rores en el prim er ca so y 10,03 % frente a l 7,62 % en el segundo. Tanto en
el segundo como en el noveno centr o , ex iste una cantidad consid erable de
extranjerismos que han sido acuñados y forman parte de nuestr o repertorio
lingüístico , tale s como, anorak , pashmina , hardware y softwa re , entre otras.
Gráfi co 4. 13 . Distribución porcentu al de errores y palabras por centros d e interés en español
La Tabla 4. 28 recoge el número de palabras total aportadas por centro de
interés, el n úmero de palabras con errores y la relación porcentual entr e ambas. El
porcentaje de lexí as incorrecta s os cila entre el 1 % del c entro 9, Ordenadores e i nternet ,
hasta el 1,91 % del centro 7, Juegos y distracciones . A unque a priori el número parezca
muy reducido, el profesor es el modelo de escrit ura del alumnado y cometería un
error por cad a 100 palabras, por ejemplo, el equivalente a una falta en cada seis o
siete líneas de este trabajo.
De igual modo se ha presentado la relación de vocablos con errores respecto a
su número total . En este caso las diferencias entre los distintos centros de interés se
acentúa . El primer centro de in terés, Partes del cuerpo humano , m uestra el mayor índice
de vocablos con errores con un 18,85 % ya que de 244 lexías diferentes 46 han sido
escrita s d e form a inco rrecta. Sin embargo, el centro con más faltas de ortografía es el
C1 C2 C3 C4 C5 C6 C7 C8 C9
P alabras
13,69
11,45
14,32
9,93
11,31
8,05
9,26
10,97
10,03
Er rores
13,39
9,47
13,91
11,33
10,16
10,85
13,39
10,85
7,62
0
2
4
6
8
10
12
14
16 Distribución porcentual de palabras y er ror es
Capítul o 4
Anális is gener al
257
tercero, Comidas y bebidas , con un total de 51 pero debido a su gran product ividad s olo
presenta un 9,62 % de sus vocablos incorrectos. Ello se debe a que el centro 1
muestra un vocabulario más hom ogéneo que el resto 218 con un índice de cohesión de
0,108 m ientras que el índ ice del centro 3 desciende hasta 0,050 y, p or tanto, en el
primer caso la propo rción es mayor que en el segundo.
CI
Total pal abras
Palabras incor recta s
%
Total
vocablos
Vocablo s
incorrec tos
%
C1
4493
58
1,29
244
46
18,85
C2
3759
41
1,09
238
28
11,76
C3
4565
62
1,36
530
51
9,62
C4
3718
43
1,16
392
34
8,67
C5
3711
44
1,19
483
37
7,66
C6
2641
47
1,78
190
30
15,79
C7
3040
58
1,91
469
40
8,53
C8
3600
47
1,31
478
37
7,74
C9
3290
33
1,00
555
25
4,50
Total
32817
433
1,32
3579
328
9,16
Tabla 4. 28 . Palabras y vo cablos inc orrectos con respecto al to tal en españ ol
En lengua extranjera la distribución porcentual de palabras por centros de
interés es similar al espa ñol, a excepción del centro 9, Ordenadore s e internet , donde
aumenta el porcentaje de palabras y vocablos aportados en lengua extranjera con
respecto al español. L os errores ortográficos se concentran en mayor med ida en el
centro de interés 8, Profesiones y oficios , con un 19,29 % del t otal de disortografías
aunque paradójicamente es el penúltimo centro en porcentaje de palabras con un
9,58 %. Existen palabra s como engineer cuya s disortografías han adoptado hasta diez
formas diferentes y otras mu y frecuentes como , professor , que presenta n un gran
número de error es repetidos en tres variantes: profesor , proffessor y pro f fesor .
En porcentaje de faltas de ortografía le sigue el centro 3, Comidas y bebidas , con
un 17,95 %, lo cua l está justificado por su peso en el porcentaje de palabras
aportadas, el mayor con un 14,63 %. El centro con mejores datos ortotipográficos es
el cuarto, La escuela: muebles y materiales , debido a que suele ser el tema más recurrido
en clase al apren der un idioma extranjero. Este h echo puede considerar se positivo ya
que el futuro profesorado que pretenda impartir clases bilingü es deb erá conocer y
escribir adecuadamente tod o el vocabulario relacionado co n su entorno escolar.
218 La in formación detal lada sobre e l í ndice de cohes ión de cada centro se e ncuentr a en e l apar tado 4 .3.
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Univ ersi tar io e n Pr ofes orado
258
Gráfi co 4. 14 . Distribución porcentu al de errores y palabras por centros de inter és en lengua extranjera
A co ntinuación, se presenta la relación entre las palabras y vocablos con
errores o rtográficos con respecto al to tal aporta do por los hablantes en inglés y en
francés. Mientras que de cada 10 0 palabras en español lo s habla ntes escriben un a
media de 1,32 palabras incorrecta s, en inglés es de 4,46 y en francés asciende a 7,67.
Al igual que en español, la mayoría de los errore s en francés se deben a la acentuación
incorr ecta de las palabras. Adem ás, en francés el acento ortográfico adopta tres
formas diferen tes: acento circu nflejo, acento grave y acento agud o. Esta dificultad
añadida provoca en cierta medida que el número de palabras incorrectas sea mayor
que en inglés.
El cent ro con mayor porcen taje de errores es el octavo, Profesione s y oficios ,
donde 9,04 palabras de cada 100 están escritas de forma incorrecta. El centro que le
sigue, Comidas y bebidas , presenta una mejora considerable ya que desciende a un
5,37 % de palabras incorrectas. El ce ntro con meno r porcentaje de errores es el
noveno, Ordenadores e internet , debido en gran parte al uso del vocabulario relacionado
con las nuevas tecno logías en forma d e préstamo en espa ñol, lo que muestra una
gran familiarización co n la escritura de las p alabras.
CI
Total
palabras
Palabras
incorrec tas
%
Total
vocablos
Vocablo s
incorrec tos
%
C1
2571
88
3,42
115
35
30,43
C2
2076
88
4,24
151
35
23,18
C3
2894
167
5,77
287
69
24,04
C4
2120
50
2,36
244
35
14,34
C5
2344
85
3,63
343
53
15,45
C6
1675
90
5,37
165
31
18,79
C7
1909
90
4,71
310
48
15,48
C8
1928
174
9,02
280
77
27,5
C1 C2 C3 C4 C5 C6 C7 C8 C9
P alabras
13,11
10,67
14,63
10,68
11,95
8,41
9,58
9,77
11,22
Er rores
9,82
8,93
17,95
6,61
10,80
9,73
10,00
19,29
6,88
0,00
5,00
10,00
15,00
20,00
25,00
Distribución porcentual entre palabras y er r ores
Capítul o 4
Anális is gener al
259
C9
2251
50
2,22
460
41
8,91
Total
19768
882
4,46
2355
424
18
Tabla 4. 29 . Palabras y vo cablos inc orrectos con respecto al to tal en inglés
Como ocurr e en lengua española, el primer centro, Partes del cuerpo humano , es
el má s compa cto y, por tanto, los vo cablos so n poco numeroso s en c omparación con
otros centros. Por tanto, e l por centaje de vocablos con errores es superior al del resto
de centros de interés ya que han sido mencionados de forma más frecuente. En el
caso opuesto se sitúa el centro de interés relaciona do con las nuevas tecnologías que
presenta un total de 460 vocablos y tan solo 41 con errores, por lo que el porcentaje
des ciende al mínimo 8,91 %.
Respecto a la lengua francesa, el porcentaje por errores en cada centro supera
los registr ados en esp añol y en inglés. Por un lado, e l centro que ocupa el primer
rango coincide con el inglés, siendo el octa vo , Profesiones y oficio s , con un 14,05 %. No
obstante, en este caso el centro con menor número de palabras incorrectas con
resp ecto a su total es el segundo, La ropa , con 3,29 pa labras de cada 100 palabras
aportadas .
Por o tro lado, e l centro con menor proporción y númer o de vocablos
incorrectos es el cua rto referido a la escuela, con ocho vocablos y un 7,08 % . En
cambio, el sexto centro p resenta mayor porcentaje, un 20,75 %, ya que los
informantes tan solo aportaron 53 vocablos diferente s y se presentan con 11
disortografías. En cuanto al noveno centro, Ordenadores e internet , la proporción de
vocablos co n faltas de ortografía se sitúa en torno a la media con un 14,17 %, puesto
que el in glés es el idioma de referencia en el campo de las nuevas tecn o logías e n
detrimento del fra ncés y otras lenguas que han incorporado las voces inglesas a ese
dominio léxico.
CI
Total pal abras
Palabras incor recta s
%
Total voca blos
Vocablo s inc orrec tos
%
C1
427
22
5,15
78
16
20,51
C2
365
12
3,29
80
14
17,50
C3
452
34
7,52
166
22
13,25
C4
323
24
7,43
113
8
7,08
C5
389
36
9,25
135
23
17,04
C6
249
19
7,63
53
11
20,75
C7
282
22
7,80
125
14
11,20
C8
299
42
14,05
119
21
17,65
C9
316
27
8,54
127
18
14,17
Total
3102
238
7,67
996
147
14,76
Tabla 4. 30 . Palabras y vo cablos inc orrectos con respecto al to tal en francé s
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Univ ersi tar io e n Pr ofes orado
266
sitúa e n un extremo el prim er centro, Human body parts , co n un 39,13 % de palabras
diferentes y el último , Computer and internet , con un 66,30 %.
Dife re nci a
entre los 20
primeros
Total voca blos
Vocablo s dif erent es
Vocablo s
comunes
CI
H ombres
M ujere
s
Ambos
H ombre
s
M ujere
s
A mbos
C1
1
81
105
115
11
34
45
39,13 %
C2
4
98
130
151
21
54
75
49,67 %
C3
4
194
227
287
60
93
153
53,31 %
C4
4
144
203
244
41
100
141
57,79 %
C5
6
198
277
343
66
145
211
61,52 %
C6
1
104
123
165
42
61
103
62,42 %
C7
6
186
251
310
59
124
183
59,03 %
C8
5
166
229
280
51
114
165
58,93 %
C9
5
269
346
460
114
191
305
66,30 %
Medi a
4
160
210,11
261,67
51,67
101,78
153,45
56,46 %
Tabla 4. 36 . Cuadro res umen co mparativ o del núm ero de voc ablos aportados por hombres y mujeres en inglés
En francés , los datos difieren con respecto al español e inglés. La muestra está
compuesta por un número inferior, 21 informantes, de a hí que en la prim era columna
los resultados sean superio res a los otros dos idiomas. En este caso, los informantes
han tenido menos oportunidades para homogeneizar el vocabulario y, por tanto, la
disponibilidad léxica de los vocablos solo se ha calculado a partir de una veintena de
respuestas.
Asimismo, algunas de las palabras aportadas por un solo grupo podrían
encuadrarse en el otro grupo si contasen con un núm ero superior de sujetos. El
centro con menor porcentaje de diferenc ia entre los vocablos aportados por hombres
y mu jeres es el séptimo, Jeux et loisirs, con un 18,40 %, seguido del quinto, La ville , con
un 20,74 % . En los centr os más produc tivos como es el caso del te rcer y cu arto
centro, la diferencia es considerablem ente mayor, 62,65 % y 68,14 %, en consonancia
con el elevado número de voca blos 166 y 113.
Dife re nci a
entre los 20
primeros
Total voca blos
Vocablo s dif erent es
Vocablo s
coincidentes
CI
H ombres
M ujeres
A mbos
H ombres
M ujeres
A mbos
C1
2
49
71
78
7
29
36
46,15 %
C2
8
52
65
80
15
28
43
53,75 %
C3
7
94
134
166
32
72
104
62,65 %
C4
7
49
100
113
13
64
77
68,14 %
C5
10
81
28
135
28
54
82
20,74 %
C6
5
40
15
53
15
13
28
28,30 %
C7
10
64
23
125
23
62
85
18,40 %
C8
8
70
29
119
30
49
79
25,21 %
C9
11
75
33
127
33
52
85
25,98 %
Medi a
7,56
63,78
53,33
110,67
55,56
47
102,56
38,81 %
Tabla 4. 37 . Cuadro res umen co mparativ o del núm ero de voc ablos apo rtados por h ombres y mujeres en francés
Capítul o 4
Anális is gener al
267
En cuanto al promedio de vocablos aportados por hombres y mujeres, en
todos los casos el sociolecto femenino presenta un mayor caudal léx ico debido a que
el númer o de informantes hombres es inferior al de mujeres, por lo que esos dato s
no se han considerados representativos de la muestra. En cambio, es posible realizar
la co mparación de la media de palabras aportadas según sexo . En este caso, la media
masculina en español solo supera a la femenina en el noveno centro, Ordenadores e
i nternet . El número de informantes hombres de la especialidad de Tecnología,
Informática y Procesos Industriales es superior al de las mujeres, por lo que m uestran
mayor dominio del ca udal léxico en el centro referido a lo s ordenadores.
Tabla 4. 38 . Media de v ocablos en los diferente s idiomas se gún sexo
Aunque las divergencias en lengua extranjera no son estadístic amente
significativas, se presentan a modo de ejemplo la media de palabras por informantes
en lengua extranjera para comprob ar si se repite el mismo modelo que en españ ol.
En este caso, también los ho mbres superan la media de las mujeres en d os centros de
interés: en el de Ordenadores e i nternet , com o ocurre en los resultados en español, y en
Medios de transport e .
Al realizar un análisis de correlaciones bi variadas con el número de lexí as
aportadas por informante en cada centro y la variable sexo en el programa SPSS, se
constata que las diferencias solo so n significativas en tres centros de interés. L a
correlación es significativa a l nivel 0,01 (bilateral) en el caso de La ropa y al nivel 0,05
en los centros Comidas y bebidas , La escuela: mueble s y materiales . En el diagram a de cajas
se muestra la diferencia entre las medias de ambos subgrupos en el centro 2, La ropa ,
siendo superior la aportada po r las mujeres (M). Se observan dos casos extremo s de
las encuestadas identificadas como 21 y 34 con un número de palabras muy por
Medi a de vocabl os
diferent es en español
Medi a de palab ras e n
inglés
Medi a de vocabl os e n
francés
CI
Hombre s
Mujeres
Ambos
Hombre s
Mujeres
Ambos
Hombre s
Mujeres
Ambos
C1
24,93
26,9
26,28
16,13
17,51
17,14
17,38
22,77
20,33
C2
19,91
22,96
21,98
12,89
14,21
13,84
15,75
18,77
17,38
C3
25,02
27,47
26,7
18,3
19,68
19,29
20,25
22,69
21,52
C4
20,56
22,3
21,74
13,98
14,15
14,13
13,25
17,08
15,38
C5
20,89
22,08
21,7
15,09
15,76
15,63
17,5
20
18,52
C6
15,22
15,55
15,44
11,35
11,05
11,17
12,25
11,92
11,86
C7
17,19
18,05
17,78
12
12,99
12,73
12,5
14,46
13,43
C8
20,26
21,42
21,05
12,76
12,84
12,85
13,5
15,15
14,24
C9
20,06
18,86
19,24
15,54
14,68
15,01
14,25
16,23
15,05
Medi a
20,45
21,73
191,91
128,04
132,87
131,79
136,63
159,08
147,71
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Univ ersi tar io e n Pr ofes orado
268
encima del promedio. L a muestra de los informantes masculinos es más homogénea
y, por tanto, la distancia entr e los valores mínimos y máxim os es más acortada.
Gráfi co 4. 15 . Diagram a de cajas q ue recoge la d istribución por sexos d el númer o de palab ras del centr o
denominado La r opa
Dada la rele vancia de la variable sexo en tres ce ntros de interés, se presentan
los veinte vo c ablos más frecuentes aportados por los hombres y mujeres de la
población de estudio para comprobar el grado de coinciden cia. Asimismo, se analiza n
las unidades léxicas que h an sido ap ortada s so lo po r el subgrupo femenino o
masculino. Para el resto de centr os de interés, la información se encuentra disponible
en el Anexo I X.
Gómez M olina (2006 : 64) concluye que la difer encia entre vocab los y palabras
aportados por el sociolecto femenino y masculino viene marcada biológica y
culturalmente. En este sentido Bel lón Fernández (2011: 119) destaca la idiosincrasia
de los centros de interés y de su relació n con el sexo de los informantes:
Por tant o, te ndremos que conclui r que l os re sulta dos obteni dos en nuestro estudi o del léxi co
disponibl e de la provincia de Córdoba no son fortuitos y que efe ctiva mente nos halla mos
ante un hecho general: algunos centros de interés son más favorables para unos hablantes
que para otros, dependie ndo de su sexo. Aún m ás, esas áreas temáticas - maneja da s en lo s
estudios de disponibilidad léxica - más propi ci as para las m ujeres suelen ser ‘La ropa’, ‘Los
mueb le s de la casa ’ , ‘Al iment os y beb ida s’ , ‘ Obje to s col o cados en la m esa para la com ida’,
‘La coc ina y sus usten silios ’ y ‘L os colo res’; m ientra s que los cam po s léxicos habitu alme nte
má s ac cesibles a los ho mbres son ‘ Calef acci ón, ilu minac ió n y medios de airear un recinto’ ,
‘El ca mp o’, ‘ Medi os de t ra ns po rte’ y ‘ T rabajos del campo y del jardín’ .
Capítul o 4
Anális is gener al
269
4.7.1. Centro 2: La ropa
Las 20 palabras más disponibles proporcionadas por hombres y mujeres
coinciden en má s de un 75 %, concretamente en 16 vocablos. Las lexías diferentes en
el grupo m asculino son som brero , cinturón , gor ra y corbata que se asocian a prendas de
vestir tradicionalm ente más usuales entre los hombres que entre la s mujeres. Del
mismo modo, el grupo femenino aporta los vocablos vestido , guante , rebeca y bota . Los
sustantivos referidos a la ropa interior, braga y calzoncillo , corresponde n a un par de
palabras que los informantes escriben en uno u otro orden hasta en 51 ocasiones, de
ahí que aunque se trate de prendas de mujer y hombre aparezcan como vocablos
disponibles en los dos listados. Del mismo modo , se observa que algunos vocablos
compartidos por ambos grupo s cuentan con un porcen taje d e apa rición mayor o
menor según el sexo. Por ejemplo, falda ha sido escrita por el 61,11 % de los hombres
y por el 85,47 % de las muje res.
Hombr es
Muje re s
Vocabl os
ID
% Apa ri ci ón
Vocabl os
ID
% Apa ri ci ón
pantalón
0,81101
92,593
pantalón
0,79874
96,581
camiseta
0,67209
85,185
falda
0,65699
85,47
camisa
0,626
75,926
camisa
0,61125
81,197
calcetín
0,54719
81,481
jersey
0,59933
77,778
chaqueta
0,53423
72,222
camiseta
0,5914
76,923
zapato
0,50085
74,074
zapato
0,5223
82,051
jersey
0,4829
62,963
vestido
0,51243
73,504
falda
0,41389
61,111
chaqueta
0,47651
70,94
calzoncillo
0,36523
57,407
bufanda
0,44305
69,231
braga
0,3177
51,852
calcetín
0,43887
76,923
abrigo
0,27886
42,593
abrigo
0,39764
64,103
bufanda
0,26667
46,296
medi a
0,31582
56,41
sombrero
0,25353
37,037
guante
0,28677
49,573
cinturón
0,24557
40,741
rebeca
0,26422
41,026
gorra
0,24167
38,889
braga
0,26202
49,573
medi a
0,23859
40,741
gorro
0,24553
43,59
sujetador
0,22879
37,037
sujetador
0,24098
43,59
(pantaló n)
vaquero
0,2284
33,333
(pantaló n)
vaquero
0,23829
37,607
gorro
0,21637
33,333
bota
0,23604
47,009
corbata
0,20402
37,037
calzoncillo
0,21359
43,59
Tabla 4. 39 . Veinte prim eros vocab los del centro 2, La rop a , según la va riable sexo
En cuanto a los vocablos aportados exclusivamente por hombres o mujeres,
se destacan los siguientes aspectos:
- Los hombres incluyen prendas de vestir femeninas tales como body , burkini ,
sostén , trik ini y Wonderbra .
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Univ ersi tar io e n Pr ofes orado
270
- Las mujeres aportan vocablos más concretos sobre el tipo d e ro pa: bota alta ,
bota de media caña , bot a de montaña , falda de tubo , falda de vuelo , falda pantalón , traje de
baño , traje de noche , tra je de vestir , vestido de flamenca , vestido de noche , vestid o de novia ,
vestido de tirantes , pañue lo palestino , pashmina .
- Los vocablos referidos a complementos se encuent ran más presentes en el
léxico del sociolecto femenino: accesorio , alianza , antifaz , bisutería , brazalete , broche ,
felpa , gargantilla , joya , muñe quera . En el sociolecto masculino: anteojo , complemento ,
peluca , reloj de pulsera .
Hombr e
Muje r
anteojo, arreglarse, babucha,
body, burkini, camisol a,
capucha, cham arra,
complemento, con junto,
estilo casual, formal,
inform al, jeans, le ncería,
manga a la s isa , mi tón, moda,
pantalón de pana, pantufla,
peluca, probador, reloj de
pulsera, ropa blanca, ropa de
color, sobrecamisa, sombrero
chambergo, sostén, tienda,
triquini, turban te,
Wond er bra , z anc o
(pantaló n) pirata, a balorio, a ccesorio , alianza, a ntifaz, baila rina, bas tón, bata
de cola, bisutería, blazer, bolsa, bolsillo, Borsalino, bota alta, bota de media
caña, bota de m ontaña, braga (del cuello), brazalete, broche, calza, calzado ,
camiseta de tirantes, casaca, chamarreta, chaqué, colgante, colorido,
combinación, corsé, cremallera, d elantal, deportivo, d iminuto, disfraz,
ejecutivo, equipación, estola , faja, fajín , fa lda de tubo , fald a de vuelo , fald a
pantalón, f elpa, forro, gargantil la, gomilla, hebilla, jersey de cuello alto,
joya, lan a, mang a, man tilla, man tón, me dia tupid a, mon o, muñ equera ,
niqui, orejera, palabra de honor, pana, pantalón de pinzas , pañ uelo
palesti no, pashmina, percha, picar día, pichi, ropa, ropa deport iva,
sombrero de copa, talla grande, talla pequ eña, tejano, tirante, toalla, tocado,
torera, traje de baño, traje de noch e, traje de vestir, túnica, uniform e,
vestido camisero, vestid o de flamenca, vestido de noche, vestido de novia,
vestido de t irantes, zapatilla de casa, zueco
Tabla 4. 40 . Vocablos ap ortados so lo por hom bres y m ujeres en el ce ntro 2, La ropa
4.7.2. Centro 3: Comidas y bebidas
E ste centro de interés presenta un repertorio lingüístico más variad o que el
anterior ya que el índice de cohesión es de 0,050 mientras que en La ropa es de 0,092.
El grado de coincidencia entre los veinte primeros vocabl os de los dos listados es el
que pre senta la mayor diferencia de todos los centros con 5 palabras, lo que
corresponde a un 25 %. Sin embargo , esas lexías no podrían considerar se
características de un sociolecto u otro ya que aparecen en posiciones más avanzadas y
con un alto índice de dispon ibilidad. Cabe destacar la alta disponibilidad del vocablo
café en las mujeres (0,237) con respecto a los hombres (0,127) q uizás por referirse,
más que a la bebida , a l a costumbre de reunirse con otra s personas en la sobremesa.
Hombr es
Muje re s
Vocabl os
ID
% Apa ri ci ón
Vocabl os
ID
% Apa ri ci ón
cerveza
0,33273
48,148
agua
0,497
66,667
agua
0,32011
46,296
tomate
0,375
64,103
pescado
0,31738
51,852
zumo
0,366
53,846
Capítul o 4
Anális is gener al
271
carne
0,30879
46,296
vino
0,332
48,718
tomate
0,28071
53,704
carne
0,332
46,154
vino
0,27126
42,593
pan
0,321
49,573
patata
0,26556
46,296
patata
0,313
52,137
arroz
0,25628
44,444
pescado
0,313
48,718
Coca - Col a
0,24428
33,333
cerveza
0,311
45,299
lechug a
0,23401
40,741
leche
0,309
47,009
ensalada
0,22796
37,037
lechug a
0,294
52,137
zumo
0,22585
33,333
café
0,237
35,043
leche
0,22201
29,63
arroz
0,235
39,316
pan
0,22095
37,037
verdura
0,231
37,607
fruta
0,18611
33,333
naranja
0,217
39,316
pollo
0,18089
29,63
fruta
0,208
29,915
manza na
0,1678
29,63
refresco
0,204
29,915
tortilla
0,15807
22,222
pasta
0,201
31,624
pizza
0,15728
27,778
Coca -
Cola
0,196
25,641
huevo
0,15596
22,222
manza na
0,188
34,188
Tabla 4. 41 . Veinte prime ros vocablo s del centro 3, Comidas y bebidas , según la variable sex o
Este centro cuenta con 530 lexías diferentes y se sitúa en el segundo rango
tras el centro 9, Ordenadores e i nternet , con 555 vocablos. Dada la heter ogen eidad del
léxico, la diferencia de las palab ras apo rtadas solo por informantes masculinos y
femeninos se acentúa, 2 80 vocablos . Los hombres aportaron 99 lexías que no
aparecen en los listados de las m ujeres y ellas a su vez apo rtaron 181 unidades léxicas
diferentes. Tras analizar l os vocablos en send os sociolectos, se pued e n destacar las
siguientes singularidades:
- Los hombres tienden a escribir más palabras relaci onadas con bebidas
alcohólicas: absenta , aguardiente , albariño , Bacardi , Cacique , Chardonnay , cubalibre ,
Dyc , ginebra , JB , Ma rtini , pacharán , ponche , Ribera del Due ro , sake , sauvignon , Sex on
the Beach , vin o blan co y vino rosa do . En cambio, las mujeres solo recogen en
exclusividad los vocablos genéricos : alcohol , brandy y sidra .
- Las mujeres han aportado más vocabulario relacionado con postres y
alimentos dulces: arro z con leche , cara melo , chuchería , chupachús , cuajada , flan , fla n de
huevo , gofre , golosin a , gominola , granizada , horchata , leche merengad a , muffin , napolitana ,
natilla , pionono , tocin o de cielo , tofu y vain illa . Los hombres s olamente incluyen :
churro , re postería , sirope , tarta de chocolate y tarta de fru ta .
Hombre
Muje r
absenta, agu ardiente, ajenjo,
aceituna rellena, agua con gas, agua mineral, alcohol, alioli, alita
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Univ ersi tar io e n Pr ofes orado
272
albariño, anguila, aperitivo, azúcar
more no, Bacard i, bebid a, bist ec,
boca de mar, bom bón, boquerón
en vinag re, Cacique, canapé,
cangrejo, caña, cardo, carne de
cerdo, cav iar, cazuela de fideos,
chacina, Chardonnay, chipirón,
choco, chop o, churro, ciervo,
cigala, conserva animal, co nserva
vegetal, coquina, criadilla, cubalibre,
Danon e, Dorit os, Dyc, espeto ,
fiambre, filete tártaro, fu silli, gallina,
gallo , ga mba reb ozad a, ginebr a,
guarnición, gula, hojaldre, jamón
cocido, JB, kiko, L a Casera,
láudan o, lechal, m anita de cer do,
Mart i ni, mate, mero, mij o, mojit o,
mozza rel la , nabo, nar anj ada ,
nugget, pacharán, palmera, papaya,
pero, pimiento morrón, pinchito,
piquito, ponche, porra, potaje de
acelgas, potaje de lentejas,
quesadilla , queso manchego,
repostería, revuelto de espárragos,
Riber a de l Duero, rioja, ro lli to de
primavera, rol lo, sacarina, sake ,
sauvignon, secreto ibérico, seso
asado, Sex on the Beach, s iro pe,
sofrito, tarta de ch ocolate, tarta de
fruta, tintorera , v ino blan co, vino
rosado, zumo de aránd ano, zumo
de melocotón, zumo de piña
de po llo, almuerzo, anacardo, Aquarius, arándano , arroz con
leche, asa do, avella na, bagu ette, ban ana, barr a de pan, b ebida
alcohólica, bebida isotónica, beicon, berberecho, berenjena con
miel , bol lo , bra ndy, bréc ol, brot e de soj a, buey , bur rit o, cabal la ,
cacahuete, cacao, calamarito, caldo A vecrem, cald o gallego,
calzone, camarón, canela, caramelo, carne a la plancha, carne
mecha da, carp acc io, cazu el a, ce bol let a, cena , chi cl e, chu che rí a,
chupachús, chu pito, cochinillo, cocinar, coco , comida basura,
concha fina, condimento, conejo a la cazadora, costilla, crema
pastele ra, cuaj ada, cucha ra, cuchi llo, cus cús, des ayuno, dorada ,
empanada, ensalada de arroz, entrante, escaro la, Fan ta Limón,
Fanta Naranja, fideuá, flan, flan de huevo, fréjol, fruto rojo,
gazpachuelo, gelatina, gofre, golosina, go minola, granizad a,
hambre, hielo, hierbabuena, hígado, horchata, huevo cocido,
huevo de codorniz, ingre diente, jabalí, jengibre, jibia, kebab, leche
mere nga da, lomo en mant eca , mace doni a, mantec a, mantec ado ,
mant el, maracu yá, McDonal d’s , meloc otó n en almíba r, merl uza ,
mig as, mitad, m ollete, mora, muffin, muslo, napolitana, n atilla,
nube, ñoqui, ostra, palmito, palomita, pan cateto, pan de ajo, pan
de mo lde, panceta, papilla, pasa, patata a lo pobre, pechuga,
pepinil lo, Peps i, pi cadill o, pimentón, piñón, pionono, pipa de
ca labaza , pip a de gira sol, pisto, pitufo , po llo al c urry, pollo asad o,
producto biológico, Puleva, puré, queso blanco, queso brie,
queso de untar, rábano, rabo de toro, rebanada, rebujito, receta,
Red Bul l, rest aura nte, rev uelt o, r evuel to de ver dura, ri ñón a l jerez,
ruca, salami, salmonete, salsa bo loñesa, salsa de yogu r, salsa ro sa,
salteado, shawarm a, sidra, sobrasa da, so da, so lomillo a la
pimienta, sopa de m arisco, sopa de picadillo, Sprite, tapa, té
verde, tenedor, tocino, tocino de cielo, tofu, tomate ch erry,
tomillo, tortellini, tortilla frances a, tostada, vaca, vainilla,
valeriana, wrap, zurrapa
Tabla 4. 42 . Vocablos ap ortados so lo por hom bres y m ujeres en el ce ntro 3, Comidas y beb idas
4.7.3. Centro 4: La escuela: muebles y materiales
La media de palabras aportadas por los hombres en este centro es de 20,56
lexías mientras que el promedio de las mu jeres es de 22,30. El númer o de vocablos
aportados por amb os grupos se sitúa en torno a la m edia (397,67) con 392 vocab los.
Solo se destacan dos lexías diferentes en los listados que inclu yen los 20 primeros
vocablos: puerta y alumno en el caso de los hombres ; rotula do r y carpeta en el listado de
las mujeres. Al igual que en los centros anterio res, ese voca bulari o está presente en
los dos listados pero con un índice de disponibilidad inferior .
Hombr es
Muje re s
Vocabl os
ID
% Apa ri ci ón
Vocabl os
ID
% Apa ri ci ón
pizarra
0,78054
90,741
pizarra
0,73421
87,179
mesa
0,70113
83,333
silla
0,6945
82,906
silla
0,65629
81,481
lápiz
0,63974
91,453
boli(gr afo)
0,58154
81,481
mesa
0,63962
71,795
lápiz
0,56808
77,778
boli(gr afo)
0,57956
84,615
tiza
0,53632
72,222
libro
0,471
75,214
libro
0,42431
72,222
goma (de borrar)
0,44064
68,376
Capítul o 4
Anális is gener al
273
pupitre
0,39129
46,296
pupitre
0,41867
48,718
goma (de borrar)
0,34779
53,704
tiza
0,41593
55,556
regla
0,27677
44,444
ordenador
0,41377
66,667
profesor
0,26359
37,037
libreta
0,32291
51,282
cuaderno
0,23179
37,037
estuche
0,28855
52,137
estuche
0,22473
38,889
borrador
0,27566
39,316
borrador
0,2223
31,481
rotulador
0,27243
46,154
libreta
0,21876
37,037
regla
0,26967
45,299
ordenador
0,21639
33,333
cuaderno
0,23811
40,171
puerta
0,20883
29,63
mochi la
0,22625
41,88
alumno
0,20247
29,63
profesor
0,20467
27,35
mochi la
0,19944
40,741
proyector
0,19224
29,915
proyector
0,19619
31,481
carpeta
0,17137
33,333
Tabla 4. 43 . Veinte prim eros vocab los del centro 4, La es cuela : mue bles y ma teri ales , según la varia ble sexo
Las columnas de la Tabla 4. 44 recogen un total de 237 palabras diferentes: 67
corresponden a l grupo ma sculino y 170 al gr upo femenino. En tre los vocablo s
aportados se observa la segregación de sexos en la enseñanza en centros religiosos ya
que los hombres han escrito cura , los cuales suelen enseñar en colegios pa ra chicos,
mientras que las mujeres han escrito monja , quienes están más presentes en colegios
para chicas.
E n cu anto al vocabulario específico, el subgrupo masculino ha escrito más
nombres de asignaturas: ciencias natura les , educación física , educación plástica y visual , filosofía ,
francés , geografía , geología , griego , inglés , latín , lengua castellana y literatur a , lenguaje y tecnología
mientras que las mujeres no han mencion ado ninguna asignatura, solo el sustantivo
genérico: materia . Por su parte, en el listado femenino se localizan los nomb res de las
diferentes partes de un centro educativo y los tipos de centro: aula de convivencia ,
campus , cen tro bilingüe , centro TIC , colegio , edificio , escuela , escuela concertada , escuela priva da ,
escuela pública , guardería , hall , institución , instituto , jefatura de estudios , polideporti vo , sala de
informática , sala de música , seminario y universidad ; en cambio, los hom bres solo han
escrito cantina .
Hombr e
Muje r
alfombra, alumnado, ascensor,
auricular, baldosa, Biblia,
bigotera , biología , boca de
incend io eq uipada , bom billa,
butaca, cajonera, c ampana,
cantina, celof án, chándal,
ciencias naturales, cuadrícula,
cura, curso académ ico, diario,
dintel, educación físi ca,
educación plástica y visual,
esquema, estante, filosofía,
forro, francés, fútbo l,
geografía, geología, globo
(rotulad or) flu orescen te, abr igo, ad ministr ativo, a filador, agua, a ire
acondicionado, am igo, AM PA, aprender, aprendizaje, ap robado,
aprobar, archivado r, aro, atlas, atril, aula de convivencia, babero, barro,
bloc, bloc de dibujo, bloc de notas, bola del mundo, bolso, cable , caja,
caligrafía, cam a, campus, canasta, cancha de baloncesto, capilla, cartilla,
cartuchera, CD( - ROM), ce lo, ce ntro b iling üe, cen tro TIC , chin cheta,
colegio, col umpio, comportamiento, concurso, conocimiento, consejo
escolar, copistería, cortina, cuadro, cuerda, desayuno, dirección,
diversión, dossier, edificio, enemigo, enseñar, escalímetr o, escáner,
escuela, escuela concertada, escuela privada, escuela pública, espejo,
estudiante, estudio, ética, excursión, fax , Fixo, fotocopia, fuente, funda,
grande, grapa, grupo, guardería, guitarra, hall, iluminación, imagen ,
impre sora, institució n, in stituto, jardín , jefatu ra d e estu dios, juego,
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Univ ersi tar io e n Pr ofes orado
274
terráqu eo, griego, im borna l,
inglés, latín , l engua castellana y
literatura , lengua je, ma nualida d,
mapamu ndi , marcad or,
matr íc ula , panel , panta ll a
digital , papel cebolla, papel
vegetal, parte, pendrive, pizarra
blanca, potro, producto
químico, profesorado, rampa
para m inusvál idos, religión,
reloj, rop ero, tarea, tecnología,
teléfono , tenis , test, trab ajo,
transpo rtador, transp orte
escolar, tubo fluorescente,
urinario
juguete , lám ina, láp iz d e m adera, lavab o, lec tura, lib rería, libro de lectura,
libro de texto , libro d el p rofesor , líqu ido corre ctor, madr ugar, man ual,
mate ri a, mesa de dibuj o, méto do, mina, monj a, muñeco, mural , netb ook,
niño, ordenad or personal, orientad or, página , pandereta , papel de seda,
papel milimetrado, papel pinocho, paragüero, parte de faltas, pegatina,
películ a, personal de limpieza, pica, Pilot, pincel, pizarra tradicional ,
plumier, polidepor tivo, porta - ángulos, portafolio, portería , porter o,
probeta, programación, pupilo, quitagrapas, radio, raqueta, ratón,
redacción, repaso , reproductor, rep roductor de DVD, repro ductor de
vídeo, respaldo, resumen, reunión, revista, sala de informática, sala de
músi ca, sanci ón, secret ar io, semicí rc u lo grad uado, semin ario, Sénec a,
separador, servicio, suspend er, suspenso , tablón de corch o, taller,
tambo r, teclad o, televis or, tem ario, tr anspor tador de áng ulos, tr imestre,
tutor, un idad didá ctica, unifo rme, un iversidad , váter, víde o
Tabla 4. 44 .Vocablos ap ortados so lo por hom bres y m ujeres en el ce ntro 4, La escu ela: muebl es y mat eria les
Debido a la disparidad entre el número de informantes de sexo masculino y
femenino, resulta evidente qu e las mujer es hayan aportado más vocablos que los
hombres. No obstante, el promedio de palabras por centro de interés sitúa al
sociolecto femenino casi siempre por encima del m asculino. Aunque se rea lizase un
estudio sobre qué factores inciden en el sexo y viceversa, es deci r, si resulta que las
mujeres tienden a escoger carreras universit arias del área lingüística mientras que los
hombres del área científi ca y que esa variable a su vez índice en el léxico disponible,
el sexo no deja constancia de diferencias estadísticamente significativas en la mayoría
de los centros 219 .
4.8. Conclusi ones parcia les
La lengua materna de los informantes resulta ser la más productiva en cuanto
a número de palabras y vocablos. En español, los informantes han escrito un
promedio de 191,91 palabras, en inglés 131,79 y en francés 147,71. En cuanto a los
vocablos, en españo l se registra una media de 20,93, en inglés de 13,77 y en francés
de 5,82. Estos datos tan diferenciados se debe a que los vocablos se ven
influenciados por el número de informantes: 171 en español, 150 en inglés y 21 en
francés.
Al comparar los resultad os con otros estudios realizados en M álaga,
concretamente sobre una muestra de estudiantes preuniversitarios (Ávila Muñoz ,
219 En el capí tul o sigu ient e no se incl uye la varia ble «sexo» porque en los análi sis estad íst icos no mostró una
influen cia signific ativa sob re las va riables a nalizada s.
Capítul o 4
Anális is gener al
275
2006) y de población adulta (Ávila Muñoz y Villena Ponsoda, 2010) se destaca la
mayor productividad de los estudiantes de postgrado. La media de palabras por
centro de interés calculada sobr e los ocho cen tros comunes, es de 19,69 en los
estudiantes preuniversitarios, 20,50 en la población a dulta estratificada y 21,59 en los
estudiantes de postgrado. Ello ind ica que a priori , el nivel de estudios parece tener
cierta influencia en el léxico disponible que se an alizará con más d etenimiento en el
capítulo siguiente.
En los estudios de español como lengua extranjera se ha comparado la media
de esta investigación en lengua extranjera ya que com o es obvio los resultados en
español eran considerab lemente super iores. Los estudiantes fin landeses (Ca rcedo
González, 2000c) han aportado una media de 13,68 palabras por centro de interés,
los extranjeros qu e r ealizan una estancia en Salamanca (Samper Hernández, 2002)
superan esa media con un promedio 15,63 palabras y los españoles del estudio actual,
17,24. Por tanto, el nivel alcanzado en lengua extranjera p or los estudiantes españoles
es considerablemente más a lto que en el resto de casos.
En inglés , la media de palabras es inferior a los estudios con hablantes na tivos.
Para los cen tros presentes en la investigación de Ferreira (2006) se h a recalculado la
media de este estudio, 23,19 palabras, mientras que los nativos encuestados por el
investigador ch ileno han escrito 27,28. Del mismo modo, los escolares de la
investigación de D imitrijevi ć (1969) aportan una media de 20,04 palabras en inglés y,
en cambio, la media de los estudiantes de postgrado en ese idioma es de 17,69
palabras. No obstante, cabe r esaltar que el promedio de respuestas de los estudiantes
de postgrado españoles es superior al de los estudiantes universitarios chilenos, con
un promedio de 23,19 frente a 20,33 p alabras por info rmante y centro de interés.
Aunque los informantes en el est udio de Chile n o han acabado la carrera
universitaria, todo s cursan estudios relacionado s con el aprendizaje del inglés como
lengua extranjera por lo que quizás los resultados deber ían ser más altos.
En los casos anteriores, se ha analizado la amplitud lé xica. En cambio, la
propuesta de este estudio radica en comparar la media de palabras según el índice
corregido de amplitud léxica (ICoAL) ya que tiene en cuenta no solo el númer o d e
palabras aportadas por un informante, sino también la relación con el cen tro de
Tesis doctoral
Evaluac ión d e la compet enci a lé xica bili ngüe en es tudia ntes del Máster Unive rsit ario en Pr ofeso rado
282
5.4.3.4 . H ábitos de lectu ra y exposició n a los medios de comunicación
en español
5.4.3.5. Motiva ción pa ra impartir clases en ens eñanza bilingüe
5.5. Análisis multivariante
5.5.1 . Análisis de componentes principales (ACP). Reducción de
dimensiones
5.5.1.1 . Clase social
5.5.1.2. Motivación para impartir clases bilingües
5.5.1.3. Uso de la lengua en diferentes ámbito s
5.5.2. Análisis de regre sión line al
5.5.2.1. Análisis de regresión lineal del ca udal léxico en lengua
extranjera
5.5.2.2. A nálisis de regresión lineal del caudal léxico en español
5.5.2.3. Análisis de regresión lineal del léxico especializado en len gua
extranjera
5.5.2.4. Análisis de regresión lineal del léxico especializado en lengua
española
5.5.3. Análisis causales
5.5.3.1. Modelo causal de los efectos del hablante sobre el caudal léxico
en lengua extranjera
5.5.3.2. Modelo causal de los efectos del hablante sobre el caudal léxico
en lengua española
5.5.3.3. Modelo causal de los efectos del h ablante sob re el léxico
especializado en lengua extran jera
5.5.3.4. Modelo causal de los efectos del h ablante so bre el léxico
especializado en lengua españo la
5.6. Conclusiones parciales
Capítul o 5
Anális is socio lingü íst ico
283
5.1. Introducción
Según Fernández Fer nández, Cordero Sánchez y Córdoba Largo (2002: 15 - 16)
la estadística ha evolucionado desde las primeras civilizaciones, d onde se recogían
datos sobre todo con fi nes recaudatorios , hasta nuestros días por medio de las
ciencias básicas. Los orígenes de esta disciplina están r elacionados con dos
necesidades: reg istrar inform ación y conocer la p robabilidad de éxito en los juegos de
azar. Ambos menesteres serán el punto de partida de las dos grandes ramas de la
estadística: la descr iptiva y la inferencial. Grosso modo , la estadística descriptiva se
encarga de orden ar, presentar y reducir los datos recopilados de una población o
muestra. En cambio, la estadística inferencial , también conocida como estadística
inductiva o deductiva, se ba sa en la teoría de probabilid ades para hacer predicciones
sobre los datos.
A lo largo de este capítulo se lleva rán a ca bo indagaciones sobre todo de tipo
descriptivo completadas con estudios inferenciales como el Análisis de Anova
imprescindibles par a conocer el co mportamiento de distintas variables. De esta
forma , se pretende orde nar la información relativa a las variables extralingüísticas y
lingüísticas generadas a partir de la s respuestas proporcionadas en las encuestas de
disponibilidad léxica, el cuestionario sociológico y la prueba de léxico especializado.
Cabe destacar que l a base de datos está formada por m ás de 500 variables que
permiten un profundo conocimiento de la muestra de estudio y, por ende, de sus
características sociocultur ales, reticulares y académicas, entre otras. Por ello, se han
seleccionado aquellos factores que contribuyen a refutar o corrobo rar las hipótesis de
la investigación.
Antes de inicia r los análisis, se det allan las hipóte sis que marcan la líne a de
trabajo y que intentan dar respuesta a los interrogantes del estudio. En un primer
estadio, se presen tan las variables a tra vés de análisis univa riantes haciendo referencia
al proceso de recogida y codificación de los datos. A continuación, los análisis
bivariantes muestran la relación entre dos características de la muestra y ayudan a
definir los análisi s po steriores. Por último, lo s análisis multivariantes presentan una
Tesis doctoral
Evaluac ión de l a competencia léxica bi lingüe en estudiantes del Máster Universitar io en Profe sorado
284
visión multidimensional para explicar la contribución de factores sociales, lingüísticos
y relacionados con el aprendizaje de una lengua extranjera sobre el índice corregido
de descentral ización léxica (ICoDD) y el índ ice corregido de identificación de
tecnicismos (ICIT).
5.2. Hipót esis
Se parte de la hipótesis que el comportamiento sociolingüístico y los
antecedentes relacionados con el aprendizaje de una lengua inciden en el vocabulario
de los informantes. El tipo d e estudios previos, la clase social, los h ábitos de lectura y
el uso de la lengua extranjera ayudan a predecir los resultados del léxico d isponible y
la capacidad de identificación de tecnicism os. Por una parte, el caudal léxico e s
medido a trav és de las pruebas de disponibilidad lé xica en español y en lengua
extranjera (inglés o francés), las cuales a portan inf ormación sobre el número de
palabras que ha actualizado un hablante en un tiempo determinado y sobre la relación
que estab lecen con el centro de interés. Por otra parte, el léxico especializa do se
obtiene mediante un ejer cicio que consiste en identificar y relacionar a qué campo
léxico correspond en palabras especializadas o técnicas. El objetivo es analizar de
forma global el vocab ulario activo y el vocabulario pasivo de un informante sobre
nueve centros de interés.
La probabilidad de que la influencia de ciertos factores releven mejores
resultados en el léxico viene supeditada por la lengua de estudio. Así, se presupone
que no tendrá igual relevancia la realización de una estancia en el extranjero en lengua
extranjera que en la lengua materna. En español , Ávila Muñoz y Villena Ponsoda
(2010) destacaron el papel de las redes sociales y la posición social sobre la capacidad
léxica. En cambio, en lengua extran jera los estudios existentes no realizan una
profundización tan precisa del conjunto multifactorial que det ermina el léxico
disponible y la capacidad d e identificación del léxico especializado.
En lengua materna , las hipóte sis apuntan a que el vo cabulario activo y , sobre
todo , el vocab ulario pasivo están condicionado s por el nivel de instrucció n. E n este
estudio , todo s los informantes son al menos diplomados, licencia dos o ingenieros ya
que es uno de los requisitos previos d e acceso al má ster. A pesar de esta aparente
Capítul o 5
Anális is socio lingü íst ico
285
homogeneización en el grado de formación de los informantes, esta variable adquiere
matices a través de otros factores como la carrera universitaria, la especi alidad del
máster y otros estudios com plementarios.
Entre las variables con mayor incidencia en el léxico , cabe destacar el
conocimiento de idiomas extranjeros . Como se abordó en los fundamentos teóricos ,
el dominio de más de una lengua aporta agilidad mental y permite establecer
conexiones entre una mayor cantidad de unidades léxicas que presum iblemente
influye en el mayor ca udal léxico 221 . Por consiguiente, el léxico disponible en esp añol
y en len gua extranjera puede m antener una relación d irecta de forma que los
informantes que aporten más p alabras en espa ñol reproduzcan ese modelo en lengua
extranjera.
La lectura contribuye a mejorar el conocimiento receptivo del léxico y , a su
vez , ese vocabulario pasivo ayuda al desarrollo de la compren sión lectora. Se da por
sentado que los informan tes que leen más tendrán menos dificultades en reconocer
las palabr as especializadas y asociarlas co n el centro de interés adecuado. En ca mbio,
en el léxico activo esa implicación no será tan plausible ya que la lectur a si bien
contribuye a incluir n uevas palabr as en el re pertorio léxico del individuo no conlleva
necesariamente al uso de la pa labra ni a incorporarlo al vocabulario activo.
La clase social puede influir de forma indirecta en el léxico a través de otras
variables como pueden ser el conocimiento de otros idio mas, la re alización de viajes y
los háb itos de lectura, entre otros facto res. No obstante, no se con sidera un factor
relevante ya que la educación ha servido para superar las barreras soci ales que llevan a
estudiantes a presentar un mayor o menor dominio léxico. En este sentido, Bernstein
(1971 - 1975) analiza el comportamiento lingüístico de las clases sociales y propone la
teoría de los códigos lingüísticos (restringid o y elab orado). El código restringido es
utilizado por la clase trabajadora y depende del contex to. En cambio, el código
elaborado es universalista y es emp leado por la clase dir igente. E n el ámbito
educativo , los modelos tienden a reproducirse de forma que provoca el fracaso
escolar de los estudiantes de estratos socioeco nómicos bajo s. De su teoría se deduce
221 P ara una revisión teórica de los fact ores que influyen en el ap rendizaje de u na lengua puede consul tarse el
a partado 2. 7.
Tesis doctoral
Evaluac ión de l a competencia léxica bi lingüe en estudiantes del Máster Universitar io en Profe sorado
286
que la mayoría de estudiantes de clase baja no llegan a finalizar los estudios de
postgraduado provocando que la clase social no sea tan relevante en hablantes con
un alto nivel de instrucción.
En lengua extranjera , la incidencia de los fa ctores puede verse multiplicada
debido a que el grado de formación específica en inglés o francés difiere
considerablemente de un estudiante a otro. Mientras que todos los informantes han
realizado sus estudios universitarios en su totalidad o en parte en lengua española,
solo unos cuantos lo han hecho en lengua extranjer a. El nivel exigido en el máster es
un B1 del Marco Común Europeo de Referencia para las Lenguas que equivale al
nivel que adquieren los estudiantes al finalizar la etapa de Bachillerato. S e produce un
agravio comparativo entre los sujetos que prácticamente no ha n co ntinuado con
estudios en lengua extranjera desde la etapa preuniversitaria y los informantes que
han cursado estudios especial izados en lengua extranjera, han realizado estanci as en el
extranjero, están motivados pa ra a prender otras lenguas y, en definitiva, han
continuado con su formación lingüística. En este sentido, la especialida d del máster
agrupa a los informantes según los estudios previos ya que el sistema de
matriculac ión establece cuáles son los títulos universitarios desde los cuales se puede
acceder a cada especialidad.
En el capítulo anterior , se h a realizado un estudio comparativo general que
incluye algunas variables de corte sociolingüístico en com paraciones intram uestrales ,
como el género . o inter muestrales en las que se se analiza el nivel de instrucción o el
lugar de residencia de los informantes. Asimismo, se han analizado los vocablos
aportados por cada sociolecto para extraer conclusiones sobre la mayor o meno r
importancia de ciertas unidades léxicas en los ho mbres o en las mujeres. Desde el
punto de vista de la estadística , el sexo no se ha considerado significa tivo por lo que
no forma parte de las hipótesis que se pretenden corroborar ni de los objetivos que
se pretenden alcanzar.
En cuanto al léxico pasivo, se presupone que la incidencia de las vari ables será
menor ya que en es a prueba el informante no tiene que producir ninguna palabra
técnica sino simplemente identificarla. Se pod ría decir incluso que alg unas de las
unidades léxicas que los informantes son capaces de asociar adecuadamente con el
Capítul o 5
Anális is socio lingü íst ico
287
centro de in terés n o for man parte de su léxico activo. Terrel l (1986) distingue dos
procesos de transferencia del léxico pasivo al léxico activo: el de ligazón ( bi nding ) y el
de acceso a la palabra ( accessing ).
Cuando un hablante comienza con el aprendizaj e de una palabra es capaz de
comp renderla pero difícilmente puede escribirla o decirla o lo hace tras una reflexión
previa. En cambio, a medida que entra en contacto con ese vocablo se vuelve más
accesible de manera que pasa a formar parte del vocabulario activo. En este sentido ,
se puede afirmar que el léxico disponible forma parte del vocabulario activo mientras
que el léxico especializado del vocabulario pasivo y , solo en ocasiones , ta mbién del
vocabulario activo. De acuerdo con es a hipótesis , las variables sociolingüísticas
predisponen en mayor medid a los resultados de la prueba de léxico disponible que
los del ejercicio de identificación de tecnicism os.
5.3. Análisis descriptivo univariante y presentaci ón de las variables
Según la hipótesis de estudio , se h an llevado a cabo diferentes tipos de análisis
que requieren variables exp erimentales de diversa índole: independientes,
dependientes e intervinien tes. Las variables ind ependientes representan fa ctores,
cualidades o características aptas p ara influir en mayor o m enor medida en otras
variables. En cambio, las variables dependientes se ven alteradas p or los valores de
otras variables y, por tanto, su presencia en la realidad de un estudio está
condicionada por otras variables. Las variables independiente s se representan en el
eje de abscisas (X) y las variables depen dientes en el eje de coordinadas (Y).
En los análisis de correlaciones influyen tanto en las variables dependientes
como independien tes algunas variables denominadas extrañas o interviniente s. Estas
variables pueden ser ajenas al objeto de estudio y se simbolizan con la letra Z . El
atributo o cualidad al que represent an estas variables suele se r complejo de delimitar y
cuantificar pero su pr esencia afecta en mayor o menor grado a otras variab les.
At first , a new form is recog niz ed as «something fam iliar» , bu t t he meanin g (or m ore
accurately, meanings) may not be recalled. L ater m eaning is slowly recogn ized. Eventually
the form is recog nized an d inter prete d within the phonological stream. Binding is complete
when the form evoke s the meaning withou t delay and the form final ly « so unds like what is
mean s» (Terrell, 198 6: 214).
Tesis doctoral
Evaluac ión de l a competencia léxica bi lingüe en estudiantes del Máster Universitar io en Profe sorado
288
Siguiendo el ejemplo anterior, la especialidad no es el único factor que influye en el
léxico virtual y especia lizado sino que ta mbién intervienen otros como el cansancio y
el interés de los alumnos al realizar la prueba. E sos factores, de dificultosa medición ,
se consideran variables intervinientes en la hipó tesis trazada y, consecuentemente,
influyentes en las variables expu estas.
El primer paso para realizar una estimación óptima de los resultados pasa por
un estudio de sus variables de forma ind ividual que comienza con u na presentación
de las variables lingüísticas o dependientes por un lado, y de las variables
independientes relacio nadas con a spectos socioculturales y con el ap rendizaje de u na
lengua extr anjera , por otro lado. A tra vés del análi sis univariante , se pretende conocer
la distribució n y dispersión d e cada variable de forma aislada . Esta fase es
indispensable como a proximación a los a nálisis bivariantes y multiv ariantes
pre sentados ulteriormente. Cada uno de estos factor es se denomina variable escalar o
univariante y el conjunto de las variables dan lugar a una variable vectorial o
multivaria nte.
Para ello, se codificaron todas las variables de forma numérica y se
categorizaron según su na turaleza (ordinales, nom inales y de escala). A continuación,
se realizaron análisis descrip tivos que se p resentan de dos formas diferentes:
mediante diagramas de sect ores y barras y a través de tablas con datos explorat orios
representados en diagramas de cajas que permiten observar de forma gráfica el
análisis de las propiedades d e las variables 222 .
Por un lado, el diagrama de sectores se ha utilizado p ara comparar las diversas
características que presenta una variable m ediante sectores. Por ejemplo, en el caso
de la prueba en lengua extranjera, el círculo se h a dividido en do s porciones: una que
hace referencia a la lengua inglesa y otra a la lengua francesa. El ángulo central de
cada sector es proporcional a la frecuencia absoluta de la lengua y se calcula mediante
una regla de tres. Si la m uestra es igua l a 360 º, la frecu encia de esa cualidad será igual
a x .
𝑥 =
360 ! ° ⋅ 𝑓𝑖
𝑁
222 Se han faci litado las descripcion es precisas de c ada uno de los de scriptor es p ara ayudar en la com pren sión
del capít ulo a l ectores profanos.
Capítul o 5
Anális is socio lingü íst ico
289
El diagrama de barra o bastones ha sido empleado en los supuestos en que la
cualidad observa da presenta numerosas opcio nes, como es el caso de la ocup ación
del padre y de la mad re. Cada barra colocada en el eje de abscisas (X) representa una
característica de la variable que muestr a su cuantificación en el eje de orden adas (Y).
De esta forma, los valores referent es a la frecuencia absoluta o relativa de cada barra
corresponden a la medida expresada en el eje de ordenad as.
Por otro lado, los análisis exploratorios permiten dispon er de herramientas de
medición más precisas donde los resultados se represen tan mediante los siguient es
parámetros:
− Medidas de tenden cia central que mu estran mediante d iferentes fórmulas
la localización de los datos. C oncretamente se analizará la media, la med iana y
la media reco rtada al 5 %. La m edia , también con ocida como media aritm ética
o promedio es tándar de los resultad os de una m uestra ( 𝑥 ), se ca lcula sumando
todos los va lores de un conjunto ( ∑ x) y dividiéndolo por el número de casos
o, en este caso, informantes ( 𝑥 = !
! ) .
− La m ediana calcula el valor central de la variable dejando el mismo
número de casos por encima y por d ebajo . En el caso de las lenguas qu e habla
un inform ante, si las posibilidades son 1, 2, 3, 4 y 5, la mediana será el número
3. En cambio, si el número de posibilidades fuese par, 1, 2, 3 y 4 la mediana
será igual a l valor situado entre 2 y 3, es decir, 2,5. L a fórmula para calcular la
mediana o K , entendido como el valor de la po sición de la p untuación en la
distribución es la siguiente: 𝐾 = ! ! !
!
En cambio, la expresió n matemática es diferente en los casos en que las
distribuciones se e ncuentran agrupadas en i ntervalos, siendo la que sigue 223 :
𝑀𝑑 = 𝐿𝑚𝑑 +
1
2 𝑁 − 𝑎𝑐𝑢𝑚 ! 𝑓𝑚𝑑
𝑓𝑚𝑑 . 𝑊
223 Fórmula extraí da de García Ferrando (1989: 90). L md se refiere al límite inferior del intervalo; N al número
total de la m ue stra, acum f md es la frecuencia acumulada por debajo de la frecuencia del intervalo que presenta la
medi a y W es l a distancia de la categoría que contiene l a mediana.
Tesis doctoral
Evaluac ión de l a competencia léxica bi lingüe en estudiantes del Máster Universitar io en Profe sorado
290
− La media recortada al 5 % es un tipo de promedio aritmético que se calcula
eliminando el 5 % de los datos más bajos y más altos y, posteriorme nte,
calculando la media con lo s valore s restantes.
a) Medidas de dispersión que presentan el grado de variabilidad de los valores
con respecto a la media por medio de la varianza, la desviación típica, los
errores típicos, el mínimo, el m áximo, el rango y el rango in tercuartílico.
− La varianza ( 𝜎 ! ) de una variable mu estra la esperanza del cu adrado de la
desviación de esa variabl e en torno a su promedio.
𝜎 ! = ( 𝑥 ! ! 𝑥 ) !
!
! ! !
𝑛 − 1
− La desviació n típica o desviación estándar ( 𝜎 o s) es una medida de dispersión
alternativa y corresponde a la raíz cuadrada positiva de la varianza y muestra la
variación esperada respecto a la media.
𝜎 = ( 𝑥 ! − 𝑥
!
! ! ! ) !
𝑛 − 1
− El rango o recorrido interarticular (R) es la diferencia entre el valor máximo y
mínimo de la muestra , es decir, entre el mayor y menor d ato de la variable.
− La amplitud intercuartil o rango intercuartílico representa la diferencia entre el
primer y tercer cuartil de una media. En general, cuanto menores sean los
datos resultantes de las medidas de dispersión mayor será la homogeneidad de
la muestra.
b) Las medidas de la forma de la distribuci ón muestran si los valores se separan o
aglomeran según su representación gráfica. Estas medidas describen la manera
en que lo s d atos tienden a r eunirse de acuerdo con la frecuen cia con que se
hallen dentro de la in formación. A través de la asimetría, la cur tosis y sus
errores típicos es posible conocer las características de la distribución sin tener
que recurrir a su gráfico.
− La asimetría refleja si los datos se distribuyen de forma uniforme alrededor del
punto central, es decir, de la media. La asimetría presenta tres estados
Capítul o 5
Anális is socio lingü íst ico
291
diferentes según la distribución de los datos con respecto al eje de asimetría:
positiva si la mayoría de los valores superan la media aritmética, negativa si
esos datos son in feriores a la media y simétrica si los datos se aglomera n de la
misma forma por encima y por de bajo de la media.
− La curtosis describe el grado en que las proporciones observadas difieren con
respecto a la distribución norm al representada a través de la conocida
campana de Gauss. Al igual que la asimetría, se distinguen tres tipos de
curtosis: m esocúrtica, cua ndo p resenta una distribució n norm al que se
considera que oscila entre más y meno s 0,5; leptocúrtica , cuando la mayoría de
los valo res se concentran en la región cen tral de la distribuc ión dando lugar a
una curtosis postivia ; y platicúrtica en el caso contrar io, es decir, cuand o la
curtosis es negativa y los valores presenta n una baja concentración .
c) El intervalo de confianza estima la probabilidad de que un número apa rezca
en un rango d e valores. El nivel d e confianza muestra la probabilidad que el
valor se encuentre en el parámetro fijado mientras que el nivel de significación
o error aleatorio muestra la posibilidad de fallar en el cálculo estimatorio. El
intervalo u tilizado en los análisis ha sido del 95 % y, por ende, el ni vel de
significación es del 5 %. Cuanto mayor sea el rango o intervalo de confianza
más preciso es el resultado y viceversa, es decir, cuanto menor sea el intervalo
de confianza y mayor la significación mayores son las posibilidades d e error.
Los resultados exploratorios se presentan de forma gráfica mediante un
diagrama de cajas que , median te rectángulos , aglomeran los datos entre los cuartiles
primero y tercero, es decir entre el 25 % y e l 75 % de los datos. El cuadro se
encuentra dividido por la mediana que muestra la simetría de lo s datos ya que cuanto
más centrada se encuen tre en la caja más simétrica será la variable. Las líneas
verticales que sobresalen por los laterales superior e in ferior de la caja, conocidas
como bigotes, muestran los valores máximos y mínimos de la muestra. Los outliers o
valores atípicos son identificados fuera de la caja co n referencia al número de
informante para po der extraer las conclusiones pertin entes.
Tesis doctoral
Evaluac ión de l a competencia léxica bi lingüe en estudiantes del Máster Universitar io en Profe sorado
298
análisis estadístico es el nivel de estudios alcanzado ya que a su vez da cuenta de los
años académicos cursados por los padres del inform ante. Los estudios de los padres
es un componente que forma pa rte de la variable del nivel sociocultural incluida en la
mayoría las investi gaciones herederas del Proyecto Panhispáni co ya que la
repercusión sobre el léxico disp onible s uele ser significativa:
El Gráfico 5.3 muestra el nivel de estudios alcanzados por el padre y la madre.
Como se observa, el sexo masculino ha logr ado un nivel de estudios superior que el
femenino en líneas generales. Los padres con máster o doctorado alcanzan un 2,35 %
y con una licenciatura 18,82 % mientras que las madres con doctorado apenas llegan
al 0,59 % y al 12,35 % con licenciatura.
Gráfi co 5.3 . Diagrama de b arras de los estudios de lo s padres
5.3.2.3. Ocupación de los padres e ingresos
La codificación de las profesiones se realizó siguiendo las pautas marcadas en
el Real Decreto 1591/2010, de 26 de noviembre, por el que se aprueba la
Clasificac ión Nacional de Ocupaciones 2011. Esta supone la última revisión en el
Los listados de léxico disponi ble aportan también interes antes dato s sobre la influ encia de
las va riable s soc iales en el d om inio lé xico de lo s inf orm antes. En gene ral, p odem os decir que
la variab le que más influ encia parece tene r s obre el domini o léxico es el niv el cultur al de la
familia, m ás qu e la variable sexo, o la pertenen cia a un am biente urban o o ru ral. La
comparación entre las disti ntas variantes de una v ariable n os informa de la diferente
integr ación de alg unas palab ras en la socied ad (B artol H ern ánd ez, 201 0: 103 ).
[Document text truncated for crawler view.]