scieee AI-readable full text Open interactive document viewer

Lietuvių kalbos padėtis skaitmeniniame amžiuje

Aurelija Tamulionienė

Full text

AURELIJA TAMULIONIENĖ Instituto de la Lengua Lituana Líneas de investigación: estudios sobre el uso actual del lituano y su variación. LA SITUACIÓN DE LA LENGUA LITUANA EN LA ERA DIGITAL Acerca de la 24.ª conferencia de Jonas Jablonskis Orientaciones para el desarrollo de los recursos lingüísticos digitales y posibilidades de aprovechamiento Jono Jablonskio (1860–1930) – žymiausio lietuvių kalbos normintojas, reikšmingų lietuvių kalbos mokslui ir praktikai darbų autorius. Pasak Zigmo Zinkevičiaus, „[V]isa Jablonskio veikla – tai ištisa epocha lietuvių bendrinės kalbos istorijoje. Iš mūsų rašomą kalbą į tinka­mas vėžes [...], jos raidą pasuko sveika linkmė“ (Zinkevičius 1992: 155). La conferencia científica que lleva el nombre de Jonas Jablonskis se celebró por primera vez en 1993, organizada por la Sección de Cultura Lingüística del Instituto de la Lengua Lituana y el Departamento de Lengua Lituana de la Universidad de Vilna. Desde entonces, las conferencias se convirtieron en una tradición y se celebran cada otoño (desde 2003, alternativamente en el Instituto de la Lengua Lituana o en la Universidad de Vilna). El 29 de septiembre de 2017 se celebró la 24.ª conferencia científica de Jonas Jablonskis, Orientaciones para el desarrollo de los recursos lingüísticos digitales y posibilidades de aprovechamiento (en inglés: Digital Language Resources, Directions of Their Development and Possibilities to Harness Them), organizada en el Instituto de la Lengua Lituana. La conferencia fue organizada por el Centro de Investigación de la Lengua Estándar del Instituto de la Lengua Lituana junto con el Instituto de Lingüística Aplicada de la Universidad de Vilna. Por su temática, esta conferencia se distinguió de las anteriores: su objetivo era debatir los problemas que surgen en la intersección de las lenguas y las tecnologías digitales, y que se encuentran al desarrollar recursos digitales y crear un mercado digital único. La conferencia se centró en el nivel semántico de los recursos digitales (la creación de redes de palabras), así como en dotar de forma sonora a los recursos digitales, crear nuevas posibilidades para difundirlos en comunidades multilingües, entre otros temas. En la conferencia participaron ponentes extranjeros: del Parlamento Europeo y de España, así como investigadores de distintas instituciones de Lituania: del Instituto de la Lengua Lituana, de la Universidad de Vilna Straipsniai / Articles 313 AURELIJA TAMULIONIENĖ universidad, Universidad Vytautas Magnus, Instituto de Tecnologías Avanzadas del Báltico, UAB «Netcode». En la conferencia se presentaron 17 ponencias. Los ponentes expusieron sus trabajos y compartieron sus investigaciones y experiencias en cuatro sesiones. La conferencia comenzó con los discursos de apertura. El eurodiputado Algirdas Saudargas y la directora del Instituto de la Lengua Lituana, la prof. dra. Jolanta Elena Zabarskaitė, dieron la bienvenida a los participantes y ponentes reunidos. La dra. Rita Miliūnaitė, investigadora principal del Centro de Investigación de la Lengua Estándar del Instituto de la Lengua Lituana, pronunció las palabras de apertura. Se habló de cómo los vínculos entre la lengua lituana y las tecnologías de la información se han fortalecido mucho en los últimos años; ya contamos con resultados tangibles tanto en la digitalización de recursos lingüísticos como en la creación de herramientas de análisis, reconocimiento y síntesis del lenguaje, pero, en comparación con la rapidez con que cambia el mundo en este ámbito, la lengua lituana todavía tiene mucho terreno que recuperar. Como el lituano es una lengua flexiva, no podemos adaptar directamente a ella las tecnologías de la información creadas para el inglés; por eso, nuestras actuales herramientas de traducción automática y otras herramientas informáticas siguen siendo muy imperfectas, mientras que el mundo ya investiga y avanza hacia el desarrollo de la inteligencia artificial, incorpora objetos inteligentes y se adentra en capas cada vez más profundas del lenguaje. En la sesión plenaria, el eurodiputado Algirdas Saudargas presentó la primera ponencia, «La lengua viva en la mente artificial». El ponente planteó una cuestión fundamental que toda comunidad lingüística debe responder: ¿hasta qué punto debe desarrollar por sí misma los recursos y las tecnologías de su lengua materna, y qué puede adquirir ya desarrollado a partir de otras lenguas? En la ponencia se expusieron ideas preocupantes: que el lituano, junto con las lenguas de algunos otros países pequeños, «cuenta con un escaso apoyo tecnológico o carece totalmente de él». Las tecnologías lingüísticas no reciben la debida atención en las agendas políticas, ni en Lituania ni en Europa. La ponencia presentó observaciones que muestran que la evolución de la inteligencia artificial converge hacia una forma híbrida, en la que las redes neuronales corresponden a mecanismos cerebrales inconscientes, mientras que la mente consciente es modelada por la inteligencia artificial tradicional, llamada simbólica. Cada comunidad lingüística debe velar por que las tecnologías del lenguaje correspondientes a la inteligencia artificial simbólica reflejen de forma exhaustiva y precisa toda la estructura de su lengua materna, y por que se cree un entorno rico en la lengua materna (y en la cultura propia) para las redes neuronales. La segunda ponencia plenaria, «Language equality in the digital age: towards a human language project», fue presentada en inglés por Rafael Rivera, director de la consultora «Claves». La ponencia presentó detalladamente el estudio de la Unidad de Prospectiva Científica del Parlamento Europeo, «La igualdad de las lenguas en la era digital. El proyecto de la lengua materna» (el estudio puede consultarse en inglés en internet: http://www.europarl.europa.eu/RegData/etudes/STUD/2017/598621/EPRS_STU(2017)598621_EN.pdf).). La ponencia examinó la situación actual de las tecnologías de la lengua materna, cuantificando 314 Acta Linguistica Lithuanica LXXVI Lietuvių kalbos padėtis skaitmeniniame amžiuje las consecuencias económicas, sociales y lingüísticas de la lengua en la era digital, y se examinó la política de la Unión Europea en materia de tecnologías de la información y las comunicaciones. En la era digital, las tecnologías lingüísticas suponen un enorme desafío para los países con pocos hablantes. El escaso desarrollo de las tecnologías lingüísticas genera brechas y obstáculos. Esto repercute en los servicios transfronterizos, la movilidad laboral y el comercio. La causa de estos obstáculos es la falta de coordinación de la investigación científica y la financiación insuficiente. El ponente subrayó que las tecnologías lingüísticas no reciben la atención adecuada de los políticos europeos. Sobre la base del análisis de la situación actual, se está desarrollando una iniciativa que aunará las políticas de las instituciones, la investigación científica, la industria, el mercado y los servicios públicos. La última ponencia de la sesión plenaria, «La lengua lituana escrita y hablada en entornos convencionales y electrónicos», fue presentada por Laimutis Telksnys, profesor del Instituto de Matemáticas e Informática de la Universidad de Vilna. En la ponencia se señaló que es necesario desarrollar métodos y herramientas —equipos y programas informáticos— que garanticen el uso correcto del lituano escrito y hablado en documentos en papel y en entornos electrónicos. El ponente planteó una cuestión importante: cómo actuarán los pocos millones de lituanos para no desaparecer en el océano de más de 7.000 millones de personas que escriben y hablan, junto con las máquinas inteligentes que están por venir. El profesor también ofreció una respuesta: para evitarlo, es necesario desarrollar métodos y herramientas —equipos y programas informáticos— que garanticen el uso correcto del lituano escrito y hablado en documentos en papel y en entornos electrónicos, y que armonicen el uso de las lenguas lituana y otras, tanto escritas como habladas, en documentos en papel y en entornos electrónicos. Es necesario crear transcriptores que representen la lengua escrita lituana mediante signos de escritura no lituanos y que transcriban los sonidos de las lenguas habladas no lituanas mediante signos de la lengua hablada lituana, adecuados para la síntesis automática de los sonidos de las palabras habladas en lituano. En la primera sesión, «Reconocimiento y síntesis del habla», se presentaron tres ponencias. En su ponencia «Más allá de la imprenta de Gutenberg: el habla lituana en las tecnologías más recientes», Audrius Valotka (VU) y Gediminas Navickas (VU) hablaron del habla lituana en las tecnologías más recientes y presentaron el proyecto financiado por los Fondos Estructurales Servicios controlados por el habla lituana – LIEPA (disponible en internet: https://www.raštija.lt/liepa),), en cuyo marco se crearon, entre otras cosas, un sintetizador y un reconocedor del habla lituana. Durante la ejecución de este proyecto se abrió a la lengua hablada lituana la puerta al espacio digital; por esta razón, está previsto el proyecto Ampliación de los servicios controlados por el habla lituana – LIEPA 2. Los ponentes hablaron de los resultados del proyecto LIEPA 2, que estarán disponibles gratuitamente y de forma abierta para todas las personas interesadas, y fomentarán el uso del habla lituana en productos de tecnologías de la información. El resultado más importante del nuevo proyecto será la posibilidad de, de forma natural Apžvalgos / Surveys 315 AURELIJA TAMULIONIENĖ comunicarse con objetos (teléfonos móviles, tabletas, relojes inteligentes, robots), dar órdenes con la voz humana y comprender sus respuestas. En LIEPA 2 se prevé crear servicios típicos que muestren nuevas posibilidades de uso de servicios controlados por voz en lituano: un controlador para robots educativos, un marcador telefónico, un sistema para pedir taxis, un sintetizador móvil para personas ciegas, un lector de noticias de internet y un comunicador interlingüístico. Laimutis Telksnys (VU) y Gediminas Navickas (VU), en su ponencia «Servicios controlados por voz en lituano. Situación. Perspectivas», hablaron de la situación y las perspectivas de los servicios controlados por voz en lituano, así como del trabajo sistemático que se lleva a cabo para crear estos servicios y ampliar su uso. El trabajo se realiza aunando los conocimientos de especialistas en tecnologías de la información y filólogos de lengua lituana, así como sus capacidades de ingeniería. En la primera etapa se crearon siete servicios controlados por voz en lituano y se estableció la infraestructura necesaria para garantizar su funcionamiento. En el futuro se prevé crear nuevos servicios controlados por voz en lituano para el entorno electrónico móvil: teléfonos inteligentes, tabletas, relojes inteligentes y robots. Pius Kasparaitis (VU) y Gintaras Skeris (VU) hablaron sobre la situación actual y las perspectivas de la síntesis de voz en lituano. En la ponencia «Situación actual y perspectivas de la síntesis de voz en lituano» se presentaron diversos servicios de locución de textos —el sintetizador LIEPA—, que se distribuye libremente junto con sus textos fuente. Esto permite que otras personas encuentren nuevas aplicaciones; por ejemplo, los sitios web ya ofrecen grabaciones de voz junto a artículos: zinios.lt, unikopedarejas.lt, vilnius.lt, m.delfi.lt, vle.lt. El servicio de locución de textos RoboBraille permite convertir automáticamente cualquier documento de texto en archivos de audio; los anuncios emitidos con voz sintética ya se escuchan en la estación de autobuses de Vilkaviškis, y los asistentes virtuales ya funcionan en el sitio web del Departamento de Migración, entre otros. En la segunda sesión, «Recursos digitales de la lengua lituana», se leyeron cuatro ponencias. La primera ponencia, «E. kalba: una innovación en el uso de los recursos lingüísticos digitales», fue presentada por Elena Jolanta Zabarskaitė (LKI), Deimantė Budriūnaitė (LKI) y Skirmantas Šermukšnis (NetCode). En ella se presentó detalladamente el nuevo proyecto del Instituto de la Lengua Lituana, destinado a ampliar la infraestructura de información de los recursos de la lengua lituana (LKIIS) (disponible en internet: www.lkiis.lt). La ponencia se centró principalmente en los servicios generados por la infraestructura del nuevo proyecto del Instituto de la Lengua Lituana E. kalba: «Búsqueda en redes léxicas», «E. marketing», «E. conceptos» y «E. consejos». Los ponentes presentaron las funcionalidades de estos servicios y sus aspectos tecnológicos. Las funcionalidades del proyecto incorporarán tecnologías innovadoras de inteligencia artificial destinadas a analizar las opiniones de los usuarios; el servicio «E. conceptos» ofrecerá búsquedas ampliadas y enriquecerá conceptos mediante la integración de recursos lingüísticos adicionales, como diccionarios bilingües, 316 Acta Linguistica Lithuanica LXXVI Lietuvių kalbos padėtis skaitmeniniame amžiuje redes léxicas de otras lenguas; además, mediante un asistente interactivo de formación de palabras, se podrá elegir de forma rápida y cómoda el procedimiento adecuado de formación de palabras según el significado categorial y grupal deseado o los medios de formación disponibles. La ponencia también presentó los principales resultados del proyecto E. kalba y sus beneficios previstos. En su ponencia «Posibilidades de búsqueda en el Lietuvių kalbos naujažodžių duomenynas en línea», Rita Milunaitė (LKI) presentó cómo revelar las características de los neologismos lituanos de manera que respondan a la mayor variedad posible de necesidades de los usuarios de la lengua mediante el Lietuvių kalbos naujažodžių duomenynas (disponible en internet: http://naujažodžiai.lki.lt/)). Actualmente se puede buscar por parámetros como la palabra lema, el origen del neologismo, la forma original, las variantes ortográficas, el ámbito de uso, etc. Los responsables de la base de datos también tienen acceso a una búsqueda más amplia, necesaria para editar los datos desde distintos enfoques. En el marco del proyecto LKIS se creará un sistema ampliado de búsqueda de información. La ponente destacó que el Lietuvių kalbos naujažodžių duomenynas es un recurso digital flexible y abierto a la expansión. Este carácter se debe, ante todo, a los propios datos: el estrato léxico de la lengua lituana, en constante cambio y renovación; también influyen los nuevos rasgos de los datos que se ponen a disposición de quienes estudian los neologismos y la evolución de las necesidades de los usuarios. Se prevé integrar este recurso en LKIS (disponible en internet: http://lkis.lki.lt/)) e incorporarlo no solo al sistema general de búsqueda del conjunto de datos, sino también utilizarlo para crear redes léxicas. La ponencia mostró gráficamente la utilidad que este conjunto de datos puede tener tanto para los especialistas en lengua como para todos los usuarios interesados en los neologismos. Daiva Murmulaitė (LKI) continuó abordando el tema de los neologismos con la ponencia «Perspectivas de la investigación sobre la formación de neologismos (el caso del Lietuvių kalbos naujažodžių duomenynas)». Habló de la investigación y las perspectivas de la formación de neologismos, así como de cómo estudiar los fenómenos emergentes en este ámbito recurriendo al Lietuvių kalbos naujažodžių duomenynas. La ponente explicó que, ya en la fase inicial de creación de esta base de datos, se habían previsto de manera preliminar los análisis de formación de neologismos: los campos correspondientes permitirían indicar los tipos de formaciones, sus formas de formación, las categorías (significados) derivativas, las palabras emparentadas, etc.; además, ya se había reunido una parte de los datos. En el campo de rasgos especiales, algunos neologismos están marcados como ocasionales (por ejemplo, varškėfobija, entre otros), de autor (por ejemplo, demagogėja, entre otros) o por contaminación (por ejemplo, murmanas, entre otros). La ponente subrayó que, para realizar un análisis detallado y de calidad de la formación de palabras, también es importante tener en cuenta algunos aspectos cuya documentación se había previsto desde el principio: la categoría gramatical de la palabra base de la formación, los cambios en la base de derivación, las analogías, el papel de la traducción en la creación de un neologismo, las manifestaciones de formación atípica, etc. Es importante crear un buen sistema de índices: exhaustivo, flexible y fácil de usar, completar y corregir. Laimutis Bilkis (LKI), en su ponencia «Estructura de la base de datos geoinformativa de los topónimos de Lituania, relaciones con otras bases de datos onomásticas y orientaciones para su desarrollo» Apžvalgos / Surveys 317 AURELIJA TAMULIONIENĖ presentó la base de datos geoinformativa de topónimos de Lituania (acceso en línea: http://lkis.lk.lt/lietuvos-vietovardziu-geoinformacine-duomenu-baze). Se pidió que hablara sobre la estructura de esta base de datos y sus relaciones con otras bases de datos onomásticas. El ponente presentó los campos de búsqueda creados en la página de acceso público de la base de datos: tipo de objeto, estado del objeto, adscripción administrativa territorial actual (municipio, distrito de submunicipio, localidad), adscripción administrativa territorial de entreguerras (distrito, municipio rural, localidad) y afluentes de los ríos. En la base de datos se puede buscar información sobre los topónimos según los siguientes atributos: nombre, género, número, acentuación, modo de formación, etimología según la lengua a la que pertenece la palabra base y etimología según el grupo léxico al que pertenece la palabra base. La base de datos permite encontrar los topónimos auténticos registrados durante el período de entreguerras en el territorio de la localidad pertinente (aldea, pueblo parroquial, finca, pequeña ciudad o asentamiento aislado) y ver su ubicación exacta o aproximada en el mapa. En la ponencia se destacó que, al integrar la base de datos en el sistema LKIS, se crearon tres tipos de enlaces a otras bases de datos onomásticas: a otro topónimo del que deriva el topónimo en cuestión; a un nombre personal de la base de datos de apellidos lituanos del que deriva el topónimo; y a las grafías históricas de ese topónimo incluidas en la base de datos de topónimos históricos. Actualmente, se han incorporado y descrito (o están en proceso de descripción) unos 25 000 topónimos. Por la tarde, los ponentes y participantes se reunieron para la tercera sesión, «Lingüística de corpus». La primera ponencia, «Corpus anotados morfológica y sintácticamente de la lengua lituana», fue presentada por ERIKA RIMKUTĖ (VDU), AGNĖ BIELINSKIENĖ (VDU), LOÏC BOIZOU (VDU) y ANDRIUS UŽA (VDU). Se habló de dos corpus anotados de la lengua lituana, preparados en el Centro de Lingüística Computacional de la Universidad Vytautas Magnus (acceso a los corpus en línea: http://nl.ijs.si/ME/V4/msd/html/index.html; https://ufal.mff.cuni.cz/tred/). Los corpus anotados son recursos fundamentales, sin los cuales resulta imposible desarrollar tecnologías del lenguaje. Por lo general, se utilizan para crear otros recursos y herramientas de procesamiento del lenguaje natural en ámbitos como los sistemas de reconocimiento automático del habla, la traducción automática, etc. El corpus anotado morfológicamente MATAS se elaboró entre 2002 y 2014. Consta de 1,6 millones de palabras procedentes de textos de diversos estilos. Se preparó a partir de un corpus de 1 millón de palabras compilado en 2006, mediante la aplicación de modelos estadísticos. El corpus anotado sintácticamente ALKSNIS, que sirve de estándar de referencia para investigaciones y recursos posteriores, se preparó en 2016. Consta de 2 355 oraciones (unas 30 000 palabras) extraídas de textos de diversos estilos. La anotación del corpus se basa en principios de anotación morfológica y sintáctica automática y aplica un modelo de dependencias sintácticas. El tema de los corpus continuó en su ponencia «Base de datos de expresiones fijas de la lengua lituana» el amplio equipo de ponentes de la conferencia ERIKA RIMKUTĖ (VDU), AGNĖ BIELINSKIENĖ (VDU), LOÏC BOIZOU (VDU), IEVA BUMBULIENĖ (Instituto Báltico de Tecnologías Avanzadas), JOLANTA KOVALSKAITĖ 318 Acta Linguistica Lithuanica LXXVI Lietuvių kalbos padėtis skaitmeniniame amžiuje (VDU), Tomas Krilavičius (Instituto Báltico de Tecnologías Avanzadas), Justina Mandravikaitė (Instituto Báltico de Tecnologías Avanzadas), Laura Vilkaitė (Instituto Báltico de Tecnologías Avanzadas). La ponencia fue presentada en la conferencia por Erika Rimkutė (VDU), quien habló principalmente de la metodología para estudiar las expresiones fijas de la lengua lituana escrita contemporánea y del diccionario de colocaciones lituanas basado en corpus que se está elaborando. El proyecto Reconocimiento automático de expresiones fijas de la lengua lituana (PASTOVU) (n.º LIP-027/2016) (véase http://mwe.lt/), tiene como objetivo crear una metodología para estudiar las expresiones fijas de la lengua lituana escrita contemporánea y elaborar un diccionario de colocaciones lituanas basado en corpus. En el proyecto se compiló y se utiliza un corpus de Delfi.lt correspondiente a 2014–2016, con una extensión de 72 millones de palabras. El diccionario de colocaciones se elaborará a partir de una base de datos que incluirá información diversa sobre las expresiones fijas: información gramatical y léxica, frecuencia de uso, sección del texto, ejemplos de concordancia, etc. También presentaron investigaciones de corpus las representantes de la Universidad de Vilna Gintarė Judžentytė (VU) y Vilma Zubaitienė (VU). En la ponencia «Estudios de frases académicas basados en corpus: estructura formal y semántica» se abordaron la estructura y la semántica de las frases del lenguaje académico, a partir del Corpus de trabajos escritos de estudiantes que se está creando actualmente en la Universidad de Vilna y que es uno de los resultados previstos del proyecto Estudios de las frases de los trabajos estudiantiles y compendio interactivo de frases, financiado por la Comisión Estatal de la Lengua Lituana. El proyecto pretende determinar la lista de palabras importantes para la escritura académica, identificar las colocaciones principales y sus extensiones, así como las secuencias recurrentes de palabras en distintas partes de los textos académicos; examinar su relación con las funciones retóricas de esas partes, y describir los significados y el uso y la semántica de palabras académicas como objetivo, tarea, métodos, conclusiones, resultados; realizar, analizar, determinar, basarse en, entre otras. En la última sesión, «Análisis automatizado de la estructura de la lengua y de los textos», se presentaron cuatro ponencias. La sesión comenzó con la ponencia de Danielius Ratys (VU), «Traducción automática para la lengua lituana», sobre la historia reciente de la traducción automática, sus logros, los proyectos llevados a cabo por diversas instituciones y los nuevos avances logrados mediante la traducción automática neuronal. El ponente habló de la evolución y los logros de la traducción automática, que hoy se aplica eficazmente también a la lengua lituana. Entre 2005 y 2007, la Universidad Vytautas Magnus llevó a cabo el proyecto financiado por los Fondos Estructurales de la UE Herramienta de traducción de información en línea. El resultado fue un servicio público en línea de traducción del inglés al lituano (acceso en línea: http://vertimas.vdu.lt/twsas/). Entre 2012 y 2014, la Universidad de Vilna llevó a cabo el proyecto financiado por la UE Desarrollo de un sistema de traducción automática entre inglés y lituano y entre francés y lituano, basado en métodos estadísticos. El resultado fue un servicio público de traducción en línea (acceso en línea: https://www.versti.eu/). No obstante Apžvalgos / Surveys 319 AURELIJA TAMULIONIENĖ Incluso las mejores traducciones automáticas requieren la intervención de un traductor. Entonces, ¿pueden las máquinas traducir realmente bien? Los últimos años auguran nuevos avances gracias al uso de la traducción automática neuronal. La Universidad de Vilna se prepara para empezar a implementar en 2018 una traducción automática neuronal de nueva generación para inglés, lituano, polaco, francés, ruso y alemán. Se celebró que los avances más recientes en traducción automática tampoco dejan de lado la lengua lituana. En su ponencia «La gramática de la lengua lituana en el mundo del código abierto digital», Virginijus Dudkevičius (VU) habló de la creación de una morfología computacional de nueva generación para la lengua lituana, del análisis morfológico y la síntesis de palabras, de la búsqueda inteligente de información textual, entre otros temas. Con la aparición de los ordenadores, surgió la necesidad de que la gramática y la lexicografía clásicas «se vistieran con un traje nuevo» y pasaran a formar parte integral de las nuevas tecnologías. Para ello se creó una morfología computacional de nueva generación para la lengua lituana y se fijaron los siguientes objetivos: utilizar y crear únicamente código abierto; solo los datos, pero no su forma ni su interpretación, pueden tener características específicas de la lengua lituana; todo el código de programación debe ser universal y servir para cualquier otra lengua; aprovechar al máximo las soluciones adaptadas con éxito a otras lenguas del mundo. La base para su elaboración es Dabartinės lietuvių kalbos gramatika (Vilna, 2006) y los corpus (en total, unos 1.500 millones de palabras). El analizador morfológico «reconoce» aproximadamente el 99% del texto medio que aparece actualmente en internet; es decir, interpreta correctamente la morfología de 99 de cada 100 palabras, en promedio. Este método de análisis morfológico, desarrollado recientemente, se aplicó con éxito en el Sistema de análisis sintáctico-semántico de la Universidad Vytautas Magnus (acceso en internet: https://semantika.lt/SyntacticAndSemanticAnalysis/Analysis) y en el Registro de Actos Jurídicos del Seimas de la República de Lituania (acceso en internet: www.e-tar.lt). Daiva Šveikauskienė (LKI) y Vytautas Šveikauskas (LKI) continuaron el tema de la gramática digital. En la ponencia «Gramática digital de la lengua lituana» se habló de la gramática digital de la lengua lituana cuya creación se ha iniciado en el Instituto de la Lengua Lituana y que puede utilizarse también en otros ámbitos del procesamiento computacional del lenguaje: análisis gramatical, traducción directa de datos, etc. Se presentó un proyecto que prevé incorporarse al sistema internacional DIGITAL GRAMMARS, que actualmente abarca 32 lenguas. El principal objetivo de crear la gramática digital es utilizarla en sistemas de traducción automática basados en métodos no estadísticos. Esto es muy relevante para la lengua lituana. Según los datos de 2017 de Tildės, la calidad de las traducciones de Google hacia y desde el lituano es incluso inferior a la de las traducciones al letón o al estonio, y desde esas lenguas. Por ello, es muy importante para Lituania desarrollar una alternativa de traducción automática. Actualmente se ha preparado un ejemplo piloto de gramática digital que abarca unas pocas palabras; aun así, permite apreciar que la calidad de la traducción es mucho mejor, sobre todo en las oraciones que reflejan rasgos específicos de la lengua lituana. Mientras se utilice el orden de palabras del inglés, los métodos estadísticos también ofrecen traducciones bastante buenas 320 Acta Linguistica Lithuanica LXXVI Lietuvių kalbos padėtis skaitmeniniame amžiuje Sin embargo, si la oración presenta un orden de palabras no estándar, la traducción de Google no pierde el sentido de la oración. La gramática digital también puede utilizarse en otros ámbitos del procesamiento computacional del lenguaje: análisis gramatical, traducción directa de datos, etc. La creación de gramáticas digitales está dirigida por Aarne Ranta, profesor de la Universidad de Gotemburgo (Suecia). La última ponencia de la conferencia, «¿Quién copió de quién? Automatización y visualización de la investigación sobre la historia de las traducciones de la Biblia», estuvo a cargo de Mindaugas Šinkūnas (LKI). En la ponencia se habló de la automatización y visualización de la investigación sobre la historia de las traducciones de la Biblia. El ponente presentó los resultados de la comparación de versículos bíblicos en diagramas ilustrativos y detallados. La abundancia de citas bíblicas en los escritos lituanos antiguos dificulta el estudio de sus relaciones. Se necesita una plataforma de datos práctica que permita agrupar los versículos bíblicos según las características de interés para el investigador. La evaluación de la semejanza entre las citas plantea las mayores dificultades. El análisis integrado del léxico, la sintaxis y la morfología (y, en algunos casos, también de la ortografía) permite realizarlo, pero este análisis filológico es lento y actualmente no se puede automatizar. La comparación se pudo automatizar mediante algoritmos iterativos cuyo cometido es detectar secuencias idénticas en dos cadenas de caracteres y calcular qué proporción de las secuencias comparadas abarcan. La ortografía ambigua de los escritos antiguos dificulta la automatización de la comparación. Tras evaluar los versículos transliterados de manera manual y automática, se determinó que el método de transliteración no influye significativamente en los resultados. Los resultados pueden ser discutibles al comparar textos escritos en diferentes dialectos (no se ha probado la nivelación de los rasgos dialectales). Los resultados de similitud obtenidos se resumen en diagramas bidimensionales. Los resultados del análisis computacional de la comparación de versículos bíblicos de la Postilės de Bretkūnas (1591) coinciden con las conclusiones a las que investigadores anteriores llegaron mediante otros métodos. La conferencia concluyó con un debate. Los artículos preparados a partir de las ponencias de la conferencia se publicarán en las revistas científicas Bendrinė kalba (acceso en internet: www.bendrinekalba.lt) y Lietuvių kalba (www.lietuviukalba.lt). LITERATŪRA Zinkevičius Zigmas 1992: Lietuvių kalbos istorija 5. Bendrinės kalbos iškilimas. Vilnius: Mokslas, 144–155. Įteikta 2017 m. lapkričio 3 d. AURELIJA TAMULIONIENĖ Lietuvių kalbos institutas Petro Vileišio g. 5, LT-10308 Vilnius, Lietuva [email protected] Apžvalgos / Surveys 321