scieee AI-readable full text Open interactive document viewer

Lietuvių kalbos padėtis skaitmeniniame amžiuje

Aurelija Tamulionienė

Full text

AURELIJA TAMULIONIENĖ Istituto di lingua lituana Ambiti di ricerca: studi sull’uso del lituano contemporaneo e sulla sua variabilità. LA CONDIZIONE DELLA LINGUA LITUANA NELL’ERA DIGITALE Sulla 24ª Conferenza di Jono Jablonskio Direzioni di sviluppo e possibilità di utilizzo delle risorse linguistiche digitali Jono Jablonskio (1860–1930) – žymiausio lietuvių kalbos normintojas, reikšmingų lietuvių kalbos mokslui ir praktikai darbų autorius. Pasak Zigmo Zinkevičiaus, „[V]isa Jablonskio veikla – tai ištisa epocha lietuvių bendrinės kalbos istorijoje. Iš mūsų rašomą kalbą į tinka­mas vėžes [...], jos raidą pasuko sveika linkmė“ (Zinkevičius 1992: 155). La conferenza scientifica intitolata a Jono Jablonskio fu organizzata per la prima volta nel 1993 dal Dipartimento di cultura linguistica dell’Istituto di lingua lituana e dalla Cattedra di lingua lituana dell’Università di Vilnius. Da allora, le conferenze sono diventate una tradizione e si svolgono ogni autunno (dal 2003, alternativamente presso l’Istituto di lingua lituana o l’Università di Vilnius). Il 29 settembre 2017 si è svolta la 24ª conferenza scientifica di Jono Jablonskio Direzioni di sviluppo e possibilità di utilizzo delle risorse linguistiche digitali (in inglese Digital Language Resources, Directions of Their Development and Possibilities to Harness Them), organizzata presso l’Istituto di lingua lituana. La conferenza è stata organizzata dal Centro di ricerca sulla lingua standard dell’Istituto di lingua lituana insieme all’Istituto di linguistica applicata dell’Università di Vilnius. Per il tema trattato, questa conferenza si differenziava dalle precedenti: il suo obiettivo era discutere i problemi che emergono all’intersezione tra lingue e tecnologie digitali e che si incontrano nello sviluppo di risorse digitali e nella creazione di un mercato digitale unico. Al centro dell’attenzione della conferenza vi erano il livello semantico delle risorse digitali (la creazione di reti di parole), nonché l’attribuzione di una forma sonora alle risorse digitali e la creazione di nuove possibilità per diffonderle in comunità multilingui, ecc. Alla conferenza hanno partecipato relatori provenienti dall’estero: dal Parlamento europeo e dalla Spagna; erano presenti anche ricercatori di diverse istituzioni lituane: dell’Istituto di lingua lituana, dell’Università di Vilnius Straipsniai / Articles 313 AURELIJA TAMULIONIENĖ dell’università, dell’Università Vytautas Magnus e dell’Istituto baltico per le tecnologie avanzate, UAB „Netcode“. Alla conferenza sono state presentate 17 relazioni. I relatori hanno presentato i propri interventi e condiviso le proprie ricerche ed esperienze nel corso di quattro sessioni. La conferenza si è aperta con i saluti introduttivi. Il deputato al Parlamento europeo Algirdas Saudargas e la direttrice dell’Istituto di lingua lituana, prof.ssa dr. Jolanta Elena Zabarskaitė, hanno rivolto un saluto ai partecipanti e ai relatori riuniti. L’intervento introduttivo è stato pronunciato dalla dr. Rita Miliūnaitė, ricercatrice senior del Centro di ricerca sulla lingua standard dell’Istituto di lingua lituana. Si è parlato del fatto che negli ultimi anni i legami tra la lingua lituana e le tecnologie dell’informazione si sono rafforzati notevolmente e che abbiamo ottenuto risultati tangibili sia nella digitalizzazione delle risorse linguistiche sia nello sviluppo di strumenti per l’analisi, il riconoscimento e la sintesi del linguaggio; tuttavia, considerando la rapidità con cui il mondo cambia in questo settore, la lingua lituana ha ancora molta strada da recuperare. Poiché il lituano è una lingua flessiva, possiamo applicare direttamente le tecnologie dell’informazione sviluppate per l’inglese; perciò gli attuali strumenti di traduzione automatica e gli altri strumenti informatici sono ancora molto imperfetti, mentre il mondo prosegue le ricerche, orientandosi verso lo sviluppo dell’intelligenza artificiale, incorporandola negli oggetti e penetrando negli strati sempre più profondi del linguaggio. La prima relazione della sessione plenaria, «La lingua viva nell’intelligenza artificiale», è stata presentata dal deputato al Parlamento europeo Algirdas Saudargas. Il relatore ha posto una questione fondamentale a cui ogni comunità linguistica deve rispondere: in che misura deve sviluppare autonomamente le risorse e le tecnologie per la propria lingua madre e che cosa può invece acquistare già realizzato sulla base di altre lingue. Nella relazione è stata espressa la preoccupazione che il lituano, insieme alle lingue di alcuni altri piccoli paesi, «disponga di un sostegno tecnologico limitato o ne sia del tutto privo». Le tecnologie linguistiche non ricevono la dovuta attenzione nell’agenda politica non solo della Lituania, ma anche dell’Europa. La relazione ha presentato riflessioni secondo cui l’evoluzione dell’intelligenza artificiale converge verso una forma ibrida, nella quale le reti neurali corrispondono ai meccanismi inconsci del cervello, mentre la mente consapevole è influenzata e modellata dall’intelligenza artificiale tradizionale, cosiddetta simbolica. Ogni comunità linguistica deve assicurarsi che le tecnologie linguistiche corrispondenti all’intelligenza artificiale simbolica riflettano in modo esaustivo e preciso l’intera struttura della lingua madre e che, per le reti neurali, venga creato un ambiente ricco della lingua madre (e della cultura d’origine). La seconda relazione plenaria, «Language equality in the digital age: towards a human language project», è stata presentata in inglese da Rafael Rivera, direttore della società di consulenza „Claves“. La relazione ha illustrato in dettaglio lo studio del Servizio di ricerca del Parlamento europeo sulle prospettive scientifiche, «L’uguaglianza delle lingue nell’era digitale. Il progetto per le lingue madri» (lo studio è consultabile online in inglese: http://www.europarl.europa.eu/RegData/etudes/STUD/2017/598621/EPRS_STU(2017)598621_EN.pdf). La relazione ha esaminato lo stato attuale delle tecnologie per le lingue madri, quantificando 314 Acta Linguistica Lithuanica LXXVI Lietuvių kalbos padėtis skaitmeniniame amžiuje le conseguenze economiche, sociali e linguistiche nell’era digitale e ha discusso la politica dell’Unione europea in materia di tecnologie dell’informazione e della comunicazione. Nell’era digitale, le tecnologie linguistiche rappresentano una sfida enorme per i paesi con pochi parlanti. Le tecnologie linguistiche poco sviluppate creano esclusione e ostacoli. Ciò incide sui servizi transfrontalieri, sulla mobilità dei lavoratori e sul commercio. La causa di tali ostacoli è la mancanza di coordinamento nella ricerca scientifica e il finanziamento insufficiente. Il relatore ha sottolineato che le tecnologie linguistiche non ricevono la dovuta attenzione da parte dei politici europei. Sulla base dell’analisi della situazione attuale, si sta sviluppando un’iniziativa che riunirà le politiche delle istituzioni, della ricerca scientifica, dell’industria, del mercato e dei servizi pubblici. L’ultima relazione della sessione plenaria, «La lingua lituana scritta e parlata nei contesti tradizionali ed elettronici», è stata presentata da Laimutis Telksnys, professore presso l’Istituto di matematica e informatica dell’Università di Vilnius. Nella relazione si è affermato che è necessario sviluppare metodi e strumenti — hardware e software — che garantiscano l’uso corretto della lingua lituana scritta e parlata nei documenti cartacei e negli ambienti elettronici. Il relatore ha posto una questione importante: come si comporteranno i pochi milioni di lituani per non scomparire nell’oceano di oltre 7 miliardi di persone che scrivono e parlano e delle macchine intelligenti in arrivo? Il professore ha anche fornito la risposta: perché ciò non accada, è necessario sviluppare metodi e strumenti — hardware e software — che garantiscano l’uso corretto della lingua lituana scritta e parlata nei documenti cartacei e negli ambienti elettronici, armonizzando l’uso scritto e parlato del lituano e delle altre lingue nei documenti cartacei e negli ambienti elettronici. Occorre creare trascrittori che rappresentino i segni della scrittura non lituana mediante i segni della scrittura lituana e rendano i suoni delle lingue parlate non lituane mediante segni della lingua parlata lituana, adatti alla sintesi automatica dei suoni delle parole pronunciate in lituano. Nella prima sessione, «Riconoscimento e sintesi del parlato», sono state presentate tre relazioni. Nella relazione «Oltre la stampa di Gutenberg: la lingua parlata lituana nelle tecnologie più recenti», Audrius Valotka (VU) e Gediminas Navickas (VU) hanno parlato del lituano parlato nelle tecnologie più recenti e hanno presentato il progetto finanziato dai fondi strutturali Servizi controllati con la voce lituana – LIEPA (accessibile online: https://www.raštija.lt/liepa),), nell’ambito del quale sono stati creati, tra l’altro, un sintetizzatore e un sistema di riconoscimento del parlato lituano. Durante la realizzazione di questo progetto si sono aperte le porte dello spazio digitale al parlato lituano; per questo motivo è previsto il progetto Sviluppo dei servizi controllati con la voce lituana – LIEPA 2. I relatori hanno parlato dei risultati del progetto LIEPA 2, che saranno aperti e accessibili gratuitamente a tutti gli interessati e promuoveranno l’uso del parlato lituano nei prodotti delle tecnologie dell’informazione. Il risultato più importante del nuovo progetto sarà la possibilità di utilizzare naturalmente Apžvalgos / Surveys 315 AURELIJA TAMULIONIENĖ dialogano tra loro e con gli oggetti (telefoni cellulari, tablet, orologi intelligenti, robot), impartiscono comandi con la voce umana e ne comprendono le risposte. LIEPA 2 prevede di creare servizi tipici che illustrino nuove possibilità di utilizzo dei servizi controllati tramite il parlato lituano: il controllore di un robot educativo, un servizio per effettuare chiamate, un servizio per chiamare un taxi, un sintetizzatore mobile per non vedenti, un lettore di notizie online e un comunicatore interlinguistico. Laimutis Telksnys (VU) e Gediminas Navickas (VU), nella relazione «Servizi controllati tramite il parlato lituano. Situazione. Prospettive», hanno parlato della situazione e delle prospettive dei servizi controllati tramite il parlato lituano, nonché delle attività sistematiche di sviluppo di tali servizi e di ampliamento del loro utilizzo. Le attività vengono svolte mettendo a frutto le conoscenze degli specialisti di tecnologie dell’informazione e dei filologi della lingua lituana, insieme alle competenze ingegneristiche. Nella prima fase dei lavori sono stati creati sette servizi controllati tramite il parlato lituano ed è stata realizzata un’infrastruttura che ne garantisce il funzionamento. In futuro si prevede di sviluppare nuovi servizi controllati tramite il parlato lituano per l’ambiente elettronico mobile: smartphone, tablet, orologi intelligenti e robot. Pius Kasparaitis (VU) e Gintaras Skeris (VU) hanno parlato del presente e delle prospettive della sintesi vocale lituana. Nella relazione «Il presente e le prospettive della sintesi vocale lituana» sono stati presentati diversi servizi di lettura ad alta voce dei testi: il sintetizzatore LIEPA, distribuito liberamente insieme ai testi sorgente, il che consente anche ad altri di trovare nuovi modi per applicarlo. Per esempio, i siti web già offrono registrazioni vocali accanto agli articoli: zinios.lt, unikopedarejas.lt, vilnius.lt, m.delfi.lt, vle.lt; il servizio di lettura ad alta voce RoboBraille converte automaticamente qualsiasi documento di testo in file audio; gli annunci trasmessi con voce sintetica vengono già ascoltati alla stazione degli autobus di Vilkaviškis; gli assistenti virtuali sono già attivi sul sito web del Dipartimento della migrazione, ecc. Nella seconda sessione, «Risorse digitali della lingua lituana», sono state presentate quattro relazioni. La prima relazione, «E. kalba – un’innovazione nell’uso delle risorse linguistiche digitali», è stata tenuta da Elena Jolanta Zabarskaitė (LKI), Deimantė Budriūnaitė (LKI) e Skirmantas Šermukšnis (NetCode). La relazione ha illustrato in dettaglio il nuovo progetto dell’Istituto di lingua lituana volto ad ampliare l’infrastruttura informativa delle risorse della lingua lituana (LKIIS) (disponibile online: www.lkiis.lt). La relazione si è concentrata soprattutto sui servizi generati dall’infrastruttura del nuovo progetto dell’Istituto di lingua lituana E. kalba: «Ricerca nella rete di parole», «E. marketing», «E. concetti» ed «E. consigli». I relatori hanno illustrato le funzionalità di questi servizi e i relativi aspetti tecnologici. Le funzionalità del progetto includeranno tecnologie innovative di intelligenza artificiale per l’analisi delle opinioni degli utenti; il servizio «E. concetti» garantirà una ricerca estesa e l’arricchimento dei concetti integrando risorse linguistiche aggiuntive, come i dizionari bilingui, 316 Acta Linguistica Lithuanica LXXVI Lietuvių kalbos padėtis skaitmeniniame amžiuje le reti di parole di altre lingue; sarà possibile utilizzare una guida interattiva alla formazione delle parole per scegliere in modo rapido e agevole i procedimenti derivazionali appropriati, in base alla categoria e al gruppo semantico desiderati oppure ai mezzi di formazione delle parole. La relazione ha presentato anche i principali risultati del progetto E. kalba e i benefici previsti. Nella sua relazione «Possibilità di ricerca nel Lietuvių kalbos naujažodžių duomenyne online», Rita Milunaitė (LKI) ha illustrato come rendere visibili agli utenti della lingua le caratteristiche dei neologismi, così da rispondere alle esigenze più diverse Lietuvių kalbos naujažodžių duomenyno (disponibile online: http://naujažodžiai.lki.lt/). Attualmente è possibile effettuare ricerche in base a parametri quali la parola lemma, l’origine del neologismo, la forma originale, le varianti ortografiche, l’ambito d’uso, ecc. I gestori del database hanno inoltre a disposizione una ricerca più ampia, necessaria per modificare i dati secondo diverse prospettive. Nell’ambito del progetto LKIS verrà sviluppato un sistema avanzato di ricerca delle informazioni. La relatrice ha sottolineato che il Lietuvių kalbos naujažodžių duomenynas è una risorsa digitale flessibile e aperta allo sviluppo. Questa sua natura è determinata innanzitutto dai dati stessi: lo strato lessicale della lingua lituana, in costante evoluzione e rinnovamento; inoltre, si aprono continuamente nuove caratteristiche dei dati per i ricercatori di neologismi e cambiano le esigenze degli utenti. Si prevede di integrare questa risorsa in LKIS (disponibile online: http://lkis.lki.lt/) e di includerla non solo nel sistema generale di ricerca del relativo insieme di dati, ma anche di utilizzarla per creare reti di parole. La relazione ha mostrato in modo vivido quanto questo repertorio possa essere utile sia agli specialisti della lingua sia a tutti gli utenti interessati ai neologismi. Il tema dei neologismi è stato ripreso da Daiva Murmulaitė (LKI) nella relazione «Prospettive della ricerca sulla formazione dei neologismi (il caso del Lietuvių kalbos naujažodžių duomenyno)», in cui ha parlato della ricerca sulla formazione dei neologismi e delle sue prospettive, nonché di come studiare i fenomeni emergenti nella formazione dei neologismi avvalendosi del Lietuvių kalbos naujažodžių duomenyną. La relatrice ha spiegato che già nella fase iniziale di creazione di questo database erano stati predisposti in via preliminare anche gli strumenti per analizzare la formazione dei neologismi: gli appositi campi prevedono l’indicazione dei tipi di derivati, delle loro forme derivazionali, delle categorie derivazionali (significati), delle parole correlate, ecc.; una parte dei dati è già stata raccolta. Nel campo dedicato alle caratteristiche particolari, alcuni neologismi sono contrassegnati come isolati (per esempio, varškėfobija, ecc.), d’autore (per esempio, demagogėja, ecc.) o contaminati (per esempio, murmanas, ecc.). La relatrice ha sottolineato che, per un’analisi dettagliata e di qualità della formazione delle parole, è importante tenere conto anche di alcuni elementi che si era previsto di registrare fin dall’inizio: la parte del discorso della parola base del derivato, le modifiche alla base derivazionale, le analogie, il ruolo della traduzione nella formazione di un neologismo, i fenomeni di derivazione atipica, ecc. È importante creare un buon sistema di indici: completo, flessibile e facile da usare, aggiornare e modificare. Nella relazione «Struttura della banca dati geoinformativa dei toponimi della Lituania, rapporti con altre banche dati onomastiche e direzioni di sviluppo», Laimutis Bilkis (LKI) Apžvalgos / Surveys 317 AURELIJA TAMULIONIENĖ ha presentato la banca dati geoinformativa dei toponimi della Lituania (accessibile online: http://lkis.lk.lt/lietuvos-vietovardziu-geoinformacine-duomenu-baze). È stato chiesto di parlare della struttura di questa banca dati e dei suoi collegamenti con altre banche dati onomastiche. Il relatore ha illustrato le aree di ricerca create nella pagina di accesso pubblico della banca dati: tipo di oggetto, stato dell’oggetto, attuale appartenenza amministrativo-territoriale (comune, circoscrizione, località), appartenenza amministrativo-territoriale nel periodo tra le due guerre (contea, distretto, località), affluenti dei fiumi. Nella banca dati è possibile cercare informazioni sui toponimi in base ai seguenti criteri: nome, genere, numero, posizione dell’accento, modalità di formazione, origine in base alla lingua cui appartiene la parola di base e origine in base al gruppo lessicale cui appartiene la parola di base. La banca dati consente di trovare i toponimi autentici registrati nel periodo tra le due guerre nel territorio della località desiderata (villaggio, villaggio con chiesa, tenuta, cittadina, fattoria isolata) e di visualizzarne la posizione esatta o approssimativa sulla mappa. Nella relazione è stato sottolineato che, con l’integrazione della banca dati nel sistema LKIS, sono stati creati tre tipi di collegamenti ad altre banche dati onomastiche: a un altro toponimo da cui deriva il toponimo in questione, a un antroponimo presente nella banca dati dei cognomi lituani da cui deriva il toponimo, e alle attestazioni storiche del toponimo contenute nella banca dati dei toponimi storici. Attualmente nella banca dati sono stati caricati e descritti (o sono in corso di descrizione) circa 25.000 toponimi. Nel pomeriggio relatori e partecipanti si sono riuniti per la terza sessione, «Linguistica dei corpora». La prima relazione, «Corpora della lingua lituana annotati morfologicamente e sintatticamente», è stata tenuta da ERIKA RIMKUTĖ (VDU), AGNĖ BIELINSKIENĖ (VDU), LOÏC BOIZOU (VDU), ANDRIUS UŽA (VDU). Si è parlato di due corpora annotati della lingua lituana, realizzati presso il Centro di linguistica computazionale dell’Università Vytautas Magnus (accessibili online: http://nl.ijs.si/ME/V4/msd/html/index.html; https://ufal.mff.cuni.cz/tred/). I corpora annotati sono risorse essenziali, senza le quali non è possibile sviluppare le tecnologie linguistiche. In genere vengono utilizzati per creare altre risorse e strumenti per il trattamento del linguaggio naturale, in settori quali i sistemi di riconoscimento automatico del parlato, la traduzione automatica e così via. Il corpus annotato morfologicamente MATAS è stato realizzato tra il 2002 e il 2014. È composto da 1,6 milioni di parole tratte da testi di vari stili. Il corpus è stato realizzato sulla base di un corpus di un milione di parole compilato nel 2006, applicando modelli statistici. Il corpus annotato sintatticamente ALKSNIS, elaborato nel 2016 come standard di riferimento per ulteriori ricerche e risorse, è composto da 2.355 frasi (circa 30.000 parole) tratte da testi di vari stili. L’annotazione del corpus si basa sui principi dell’annotazione morfologica e sintattica automatica e adotta un modello di dipendenze sintattiche. Il tema dei corpora è stato ulteriormente sviluppato nella relazione «Banca dati delle espressioni polirematiche della lingua lituana» dal numeroso gruppo di relatori della conferenza: ERIKA RIMKUTĖ (VDU), AGNĖ BIELINSKIENĖ (VDU), LOÏC BOIZOU (VDU), IEVA BUMBULIENĖ (Istituto baltico per le tecnologie avanzate), JOLANTA KOVALSKAITĖ 318 Acta Linguistica Lithuanica LXXVI Lietuvių kalbos padėtis skaitmeniniame amžiuje (VDU), Tomas Krilavičius (Istituto baltico per le tecnologie avanzate), Justina Mandravikaitė (Istituto baltico per le tecnologie avanzate), Laura Vilkaitė (Istituto baltico per le tecnologie avanzate). La relazione è stata presentata alla conferenza da Erika Rimkutė (VDU), che si è soffermata soprattutto sulla metodologia per lo studio delle espressioni polirematiche nella lingua lituana scritta contemporanea e sul dizionario delle collocazioni lituane basato su corpora, attualmente in preparazione. Il progetto Riconoscimento automatico delle espressioni polirematiche della lingua lituana (PASTOVU) (n. LIP-027/2016) (cfr. http://mwe.lt/), si propone di sviluppare una metodologia per lo studio delle espressioni polirematiche nella lingua lituana scritta contemporanea e di preparare un dizionario delle collocazioni lituane basato su corpora. Nell’ambito del progetto è stato compilato e viene utilizzato un corpus di Delfi.lt del periodo 2014–2016, con un’estensione di 72 milioni di parole. Il dizionario delle collocazioni sarà redatto sulla base di una banca dati, che conterrà informazioni di vario tipo sulle espressioni polirematiche: informazioni grammaticali e lessicali, frequenza d’uso, sezione del testo, esempi di concordanza e così via. Le ricerche sui corpora sono state presentate anche dalle rappresentanti dell’Università di Vilnius Gintarė Judžentytė (VU) e Vilma Zubaitienė (VU). Nella relazione «Ricerche sulle frasi accademiche basate su corpora: struttura formale e semantica» si è parlato della struttura e della semantica delle frasi del linguaggio accademico, sulla base del corpus dei lavori scritti degli studenti attualmente in corso di realizzazione presso l’Università di Vilnius, uno dei risultati previsti dal progetto sostenuto dalla Commissione statale per la lingua lituana Ricerche sulle frasi dei lavori degli studenti e repertorio interattivo di frasi. Il progetto mira a individuare un elenco di parole importanti per la scrittura accademica, a estrarre le collocazioni principali e le loro espansioni, nonché le sequenze di parole ricorrenti nelle diverse sezioni dei testi accademici, a esaminare i loro legami con le funzioni retoriche delle sezioni testuali e a descrivere i significati e gli usi di parole accademiche quali: obiettivo, compito, metodi, conclusioni, risultati; eseguire, analizzare, determinare, basarsi e altre, nonché la loro semantica. Nell’ultima sessione, «Analisi automatizzata della struttura della lingua e dei testi», sono state lette quattro relazioni. La sessione è iniziata con la relazione di Danielius Račys (VU), «Traduzione automatica per la lingua lituana», dedicata agli sviluppi più recenti della storia della traduzione automatica, ai suoi risultati, ai progetti realizzati da diverse istituzioni e alle nuove svolte rese possibili dall’uso della traduzione automatica neurale. Il relatore ha parlato dell’evoluzione e dei progressi della traduzione automatica, oggi applicata con efficacia anche alla lingua lituana. Nel periodo 2005–2007 l’Università Vytautas Magnus ha realizzato il progetto finanziato dai Fondi strutturali dell’UE Strumento online per la traduzione di informazioni. Il risultato è stato un servizio pubblico online per la traduzione dall’inglese al lituano (accessibile online: http://vertimas.vdu.lt/twsas/). Nel periodo 2012–2014 l’Università di Vilnius ha realizzato il progetto finanziato dall’UE Creazione di un sistema di traduzione automatica basato su metodi statistici per le lingue inglese-lituano-inglese e francese-lituano-francese. Il risultato è stato un servizio pubblico di traduzione online (accessibile online: https://www.versti.eu/). Tuttavia Apžvalgos / Surveys 319 AURELIJA TAMULIONIENĖ Anche le migliori traduzioni automatiche richiedono l’intervento di un traduttore. Le macchine, dunque, possono tradurre davvero bene? Gli ultimi anni promettono nuove svolte grazie all’uso della traduzione automatica neurale. L’Università di Vilnius si prepara ad avviare nel 2018 l’implementazione di una nuova generazione di traduzione automatica neurale per le lingue inglese, lituana, polacca, francese, russa e tedesca. È stato accolto con soddisfazione il fatto che i più recenti progressi nella traduzione automatica non trascurino neppure la lingua lituana. Nella relazione «La grammatica della lingua lituana nel mondo open source» Virginijus Dudkevičius (VU) ha parlato dello sviluppo di una nuova generazione di morfologia computazionale della lingua lituana, dell’analisi e della sintesi morfologica delle parole, della ricerca intelligente di informazioni testuali e di altri temi. Con l’avvento dei computer, è emersa la necessità che la grammatica e la lessicografia classiche «indossassero un abito nuovo» e diventassero parte integrante delle nuove tecnologie. A tal fine è stata sviluppata una nuova generazione di morfologia computazionale della lingua lituana, con i seguenti obiettivi: utilizzare e sviluppare esclusivamente software open source; solo i dati, e non la loro forma né la loro interpretazione, possono presentare caratteristiche specifiche della lingua lituana; tutto il codice software deve essere universale e applicabile a qualsiasi altra lingua; sfruttare al massimo le soluzioni già adattate con successo ad altre lingue del mondo. La base per la sua compilazione è la Dabartinės lietuvių kalbos gramatika (Vilnius, 2006) e i corpora (circa 1,5 miliardi di parole in totale). Il riconoscimento medio dei testi che compaiono attualmente su Internet è di circa il 99%, vale a dire che l’analizzatore morfologico interpreta correttamente, in media, 99 parole su 100. Questo metodo di analisi morfologica di nuova concezione è stato applicato con successo nel sistema di analisi sintattico-semantica dell’Università Vytautas Magnus (accessibile online: https://semantika.lt/SyntacticAndSemanticAnalysis/Analysis) e nel Registro degli atti giuridici della Repubblica di Lituania (accessibile online: www.e-tar.lt). Il tema della grammatica digitale è stato approfondito da Daiva Šveikauskienė (LKI) e Vytautas Šveikauskas (LKI). Nella relazione «La grammatica digitale della lingua lituana» si è parlato della grammatica digitale lituana, il cui sviluppo è stato avviato presso l’Istituto della lingua lituana e che può essere utilizzata anche in altri ambiti dell’elaborazione informatica del linguaggio: analisi grammaticale, traduzione diretta dei dati e altro. È stato presentato un progetto che prevede l’adesione al sistema internazionale DIGITAL GRAMMARS, che attualmente comprende 32 lingue. L’obiettivo principale della creazione di una grammatica digitale è utilizzarla nei sistemi di traduzione automatica basati su metodi non statistici. Per la lingua lituana si tratta di una questione molto attuale. Secondo i dati del 2017 di Tildės, la qualità delle traduzioni di Google verso e dalla lingua lituana è persino peggiore di quella per il lettone o l’estone. Per la Lituania è quindi molto importante sviluppare un’alternativa alla traduzione automatica. Attualmente è stato preparato un prototipo di grammatica digitale, che comprende poche parole; tuttavia, già da questo si può vedere che la qualità della traduzione è molto migliore, soprattutto nelle frasi che riflettono caratteristiche specifiche della lingua lituana. Finché si usa l’ordine delle parole inglese, anche i metodi statistici forniscono traduzioni abbastanza buone 320 Acta Linguistica Lithuanica LXXVI Lietuvių kalbos padėtis skaitmeniniame amžiuje ma se in una frase l’ordine delle parole non è standard, la traduzione di Google non perde il senso della frase. La grammatica digitale può essere utilizzata anche in altri ambiti dell’elaborazione informatica del linguaggio: analisi grammaticale, traduzione diretta dei dati e altro. Lo sviluppo delle grammatiche digitali è diretto dal professor Aarne Ranta dell’Università di Göteborg (Svezia). L’ultima relazione della conferenza, «Chi ha copiato da chi? Automazione e visualizzazione della ricerca sulla storia delle traduzioni della Bibbia», è stata tenuta da Mindaugas Šinkūnas (LKI). La relazione ha trattato l’automazione e la visualizzazione della ricerca sulla storia delle traduzioni della Bibbia. Il relatore ha mostrato i risultati del confronto tra versetti biblici in diagrammi chiari e dettagliati. L’abbondanza di citazioni bibliche negli antichi scritti lituani rende difficile studiarne i rapporti. È necessaria una piattaforma di dati pratica, che permetta di raggruppare i versetti biblici secondo le caratteristiche di interesse per il ricercatore. La difficoltà maggiore consiste nel valutare la somiglianza delle citazioni. Un’analisi complessiva del lessico, della sintassi e della morfologia (e, in alcuni casi, anche dell’ortografia) permette di farlo, ma questo tipo di ricerca filologica è lento e al momento non è possibile automatizzarlo. È stato possibile automatizzare il confronto con algoritmi iterativi, il cui compito è individuare sequenze identiche in due sequenze di caratteri e calcolare quale parte delle sequenze confrontate esse coprano. A ostacolare l’automazione del confronto è l’ortografia ambigua degli antichi scritti. La valutazione di righe traslitterate manualmente e automaticamente ha mostrato che il metodo di traslitterazione non influisce in modo sostanziale sui risultati. I risultati possono essere discutibili quando si confrontano testi scritti in dialetti diversi (non è stata sperimentata la neutralizzazione delle caratteristiche dialettali). I risultati di somiglianza ottenuti vengono riassunti in diagrammi bidimensionali. I risultati dell’analisi computazionale del confronto tra versetti biblici della Postilės di Bretkūnas (1591) corrispondono alle conclusioni raggiunte in precedenza da altri studiosi con metodi diversi. La conferenza si è conclusa con una discussione. Gli articoli elaborati sulla base delle relazioni della conferenza saranno pubblicati nelle riviste scientifiche Bendrinė kalba (accessibile online: www.bendrinekalba.lt) e Lietuvių kalba (www.lietuviukalba.lt). LITERATŪRA Zinkevičius Zigmas 1992: Lietuvių kalbos istorija 5. Bendrinės kalbos iškilimas. Vilnius: Mokslas, 144–155. Įteikta 2017 m. lapkričio 3 d. AURELIJA TAMULIONIENĖ Lietuvių kalbos institutas Petro Vileišio g. 5, LT-10308 Vilnius, Lietuva [email protected] Apžvalgos / Surveys 321