scieee AI-readable full text Open interactive document viewer

Lietuvių kalbos padėtis skaitmeniniame amžiuje

Aurelija Tamulionienė

Full text

AURELIJA TAMULIONIENĖ Litevský jazykový institut Směry výzkumu: výzkum současného užívání litevštiny a jeho variabilnosti. POSTAVENÍ LITEVŠTINY V DIGITÁLNÍM VĚKU O 24. konferenci Jona Jablonského Směry rozvoje digitálních jazykových zdrojů a možnosti jejich využití Jono Jablonskio (1860–1930) – žymiausio lietuvių kalbos normintojas, reikšmingų lietuvių kalbos mokslui ir praktikai darbų autorius. Pasak Zigmo Zinkevičiaus, „[V]isa Jablonskio veikla – tai ištisa epocha lietuvių bendrinės kalbos istorijoje. Iš mūsų rašomą kalbą į tinka­mas vėžes [...], jos raidą pasuko sveika linkmė“ (Zinkevičius 1992: 155). Vědecká konference pojmenovaná po Jonu Jablonském se poprvé konala v roce 1993. Uspořádaly ji Oddělení jazykové kultury Litevského jazykového institutu a Katedra litevského jazyka Vilniuské univerzity. Od té doby se konference staly tradicí a konají se každý podzim (od roku 2003 střídavě v Litevském jazykovém institutu nebo na Vilniuské univerzitě). Dne 29. září 2017 se v Litevském jazykovém institutu konala 24. vědecká konference Jona Jablonského Směry rozvoje digitálních jazykových zdrojů a možnosti jejich využití (angl. Digital Language Resources, Directions of Their Development and Possibilities to Harness Them). Konferenci uspořádalo Centrum výzkumu spisovného jazyka Litevského jazykového institutu ve spolupráci s Ústavem aplikované lingvistiky Vilniuské univerzity. Tematicky se tato konference lišila od předchozích; jejím cílem bylo diskutovat o problémech vznikajících na pomezí jazyků a digitálních technologií, s nimiž se setkáváme při rozvoji digitálních zdrojů a vytváření jednotného digitálního trhu. Pozornost konference se zaměřila na sémantickou úroveň digitálních zdrojů (tvorbu slovních sítí) a také na zvukovou podobu digitálních zdrojů, vytváření nových možností šíření digitálních zdrojů v mnohojazyčných komunitách aj. Konference se zúčastnili přednášející ze zahraničí: z Evropského parlamentu a ze Španělska; dále výzkumníci z různých litevských institucí: z Litevského jazykového institutu, z Vilniuské Straipsniai / Articles 313 AURELIJA TAMULIONIENĖ univerzity, Univerzity Vytautase Velikého, Baltského institutu pokročilých technologií, UAB „Netcode“. Na konferenci bylo předneseno 17 příspěvků. Přednášející přednesli své příspěvky a sdíleli své výzkumy a zkušenosti na čtyřech zasedáních. Konference byla zahájena úvodními projevy. Účastníky konference a přednášející přivítali poslanec Evropského parlamentu Algirdas Saudargas a ředitelka Institutu litevského jazyka prof. dr. Jolanta Elena Zabarskaitė. Úvodní slovo pronesla dr. Rita Miliūnaitė, vedoucí vědecká pracovnice Centra výzkumu spisovného jazyka Institutu litevského jazyka. Hovořilo se o tom, že propojení litevského jazyka a informačních technologií se v posledních letech výrazně posílilo; máme hmatatelné výsledky jak v digitalizaci jazykových zdrojů, tak ve vývoji nástrojů pro analýzu, rozpoznávání a syntézu jazyka. Ve srovnání s tím, jak rychle se svět v této oblasti mění, však litevský jazyk musí ještě mnoho dohánět. Protože je litevština flektivním jazykem, nelze na ni přímo uplatnit informační technologie vytvořené pro angličtinu, a naše současné nástroje strojového překladu a další počítačové nástroje jsou proto stále velmi nedokonalé. Svět už ale zkoumá a postupuje dál směrem k vývoji umělé inteligence, vdechuje život předmětům a proniká do stále hlubších vrstev jazyka. Na plenárním zasedání přednesl první příspěvek „Živý jazyk v umělé mysli“ poslanec Evropského parlamentu Algirdas Saudargas. Přednášející nastolil zásadní otázku, na niž musí odpovědět každé jazykové společenství: do jaké míry si má samo připravit zdroje a technologie pro svůj mateřský jazyk a co lze pořídit již hotové na základě jiných jazyků. V příspěvku zazněly znepokojivé myšlenky, že litevština spolu s jazyky některých dalších malých zemí „má jen malou technologickou podporu, nebo ji nemá vůbec“. Jazykovým technologiím se nedostává patřičné pozornosti nejen v agendě litevských, ale ani evropských politiků. Příspěvek nabídl postřehy, podle nichž vývoj umělé inteligence konverguje k hybridní podobě, v níž neuronové sítě odpovídají nevědomým mechanismům mozku, zatímco vědomé myšlení ovlivňuje a modeluje tradiční, takzvaná symbolická umělá inteligence. Každé jazykové společenství musí dbát na to, aby technologie odpovídající symbolické umělé inteligenci komplexně a přesně odrážely celou strukturu mateřského jazyka a aby pro činnost neuronových sítí bylo vytvořeno bohaté prostředí mateřského jazyka (a mateřské kultury). Druhý plenární příspěvek „Language equality in the digital age: towards a human language project“ přednesl v angličtině Rafael Rivera, ředitel poradenské společnosti „Claves“. V příspěvku byla podrobně představena studie oddělení Evropského parlamentu pro výzkum vědeckých perspektiv „Jazyková rovnost v digitálním věku. Projekt mateřského jazyka“ (s anglickou verzí studie se lze seznámit na internetu: http://www.europarl.europa.eu/RegData/etudes/STUD/2017/598621/EPRS_STU(2017)598621_EN.pdf).). Příspěvek přehledově popsal současný stav technologií mateřského jazyka a kvantitativně vyhodnotil 314 Acta Linguistica Lithuanica LXXVI Lietuvių kalbos padėtis skaitmeniniame amžiuje ekonomické, sociální a lingvistické důsledky jazyka v digitálním věku a zabýval se politikou Evropské unie v oblasti informačních a komunikačních technologií. V digitálním věku představují jazykové technologie obrovskou výzvu pro země s malým počtem mluvčích. Nedostatečně rozvinuté jazykové technologie vytvářejí nerovnosti a překážky. To ovlivňuje přeshraniční služby, mobilitu pracovníků i obchod. Příčinou těchto překážek jsou nekoordinovaný výzkum a nedostatečné financování. Přednášející zdůraznil, že jazykovým technologiím se nedostává náležité pozornosti evropských politiků. Na základě analýzy současné situace se připravuje iniciativa, která sjednotí politiku institucí, výzkumu, průmyslu, trhu a veřejných služeb. Poslední příspěvek plenárního zasedání „Litevský psaný a mluvený jazyk v běžném a elektronickém prostředí“ přednesl profesor Laimutis Telksnys z Ústavu matematiky a informatiky Vilniuské univerzity. Hovořilo se o nutnosti připravit metody a nástroje – technické a programové vybavení –, které zajistí správné používání litevského psaného i mluveného jazyka v tištěných dokumentech a elektronickém prostředí. Přednášející položil důležitou otázku: jak se zachová několik milionů Litevců, aby nezanikli v oceánu více než 7 miliard píšících a mluvících lidí a přicházejících inteligentních strojů? Profesor nabídl i odpověď: aby se tak nestalo, je nutné připravit metody a nástroje – technické a programové vybavení –, které zajistí správné používání litevského psaného i mluveného jazyka v tištěných dokumentech a elektronickém prostředí a harmonizují používání litevského i dalších psaných a mluvených jazyků v tištěných dokumentech a elektronickém prostředí. Je třeba vytvořit transkripční nástroje, které budou znaky psaných jazyků jiných než litevština zobrazovat pomocí znaků litevského písma a zvuky mluvených jazyků jiných než litevština vyjadřovat znaky litevského mluveného jazyka vhodnými pro automatickou syntézu zvuků litevských mluvených slov. Na prvním zasedání „Rozpoznávání a syntéza řeči“ byly předneseny tři příspěvky. Audrius Valotka (VU) a Gediminas Navickas (VU) v příspěvku „Dál od Gutenbergova tiskařského lisu: litevská řeč v nejnovějších technologiích“ hovořili o litevské řeči v nejnovějších technologiích a představili projekt financovaný ze strukturálních fondů Služby ovládané litevskou řečí – LIEPA (přístup na internetu: https://www.raštija.lt/liepa),), v jehož rámci byl mimo jiné vytvořen litevský syntetizátor řeči a systém pro její rozpoznávání. V průběhu realizace tohoto projektu se litevské řeči otevřela brána do digitálního prostoru; z tohoto důvodu se plánuje projekt Rozvoj služeb ovládaných litevskou řečí – LIEPA 2. Přednášející hovořili o výsledcích projektu LIEPA 2, které budou otevřené a bezplatně dostupné všem zájemcům a podpoří používání litevské řeči v produktech informačních technologií. Nejdůležitějším výsledkem nového projektu bude možnost přirozenou Apžvalgos / Surveys 315 AURELIJA TAMULIONIENĖ komunikuje s přístroji (mobilními telefony, tablety, chytrými hodinkami, roboty), zadávat jim příkazy lidským hlasem a rozumět jejich odpovědím. V rámci projektu LIEPA 2 se plánuje vytvoření typických služeb, které ukážou nové možnosti využití služeb ovládaných litevskou řečí: ovladače výukového robota, telefonní služby, služby pro přivolání taxi, mobilního syntetizátoru pro nevidomé, čtečky internetových zpráv a mezijazykového komunikátoru. Laimutis Telksnys (VU) a Gediminas Navickas (VU) ve svém příspěvku „Služby ovládané litevskou řečí. Současný stav. Perspektivy“ hovořili o současném stavu a perspektivách služeb ovládaných litevskou řečí a o systematicky prováděných pracích na jejich vytváření a rozšiřování možností jejich využití. Práce se uskutečňují spojením znalostí odborníků na informační technologie a filologů litevského jazyka s inženýrskými kapacitami. V první etapě prací bylo vytvořeno sedm služeb ovládaných litevskou řečí a vybudována infrastruktura zajišťující jejich fungování. V budoucnu se plánuje vytvoření nových služeb ovládaných litevskou řečí pro mobilní elektronické prostředí – chytré mobilní telefony, tablety, chytré hodinky a roboty. O současnosti a perspektivách litevské hlasové syntézy hovořili Pius Kasparaitis (VU) a Gintaras Skeris (VU). V příspěvku „Současnost a perspektivy litevské hlasové syntézy“ byly představeny různé služby pro převod textu na řeč – syntetizátor LIEPA, který je volně šířen spolu se zdrojovými texty, což umožňuje i dalším lidem najít pro něj nová využití. Například zvukové nahrávky článků již nabízejí internetové stránky: zinios.lt, unikopedarejas.lt, vilnius.lt, m.delfi.lt, vle.lt; služba převodu textu na řeč RoboBraille umožňuje automaticky převádět jakékoli textové dokumenty na zvukové soubory, hlášení syntetickým hlasem se již přehrávají na cestě na autobusovém nádraží ve Vilkaviškisu, virtuální asistenti již fungují na webových stránkách Migračního úřadu atd. Na druhém zasedání „Digitální jazykové zdroje litevštiny“ byly předneseny čtyři příspěvky. První příspěvek „E. kalba – inovace ve využívání digitálních jazykových zdrojů“ přednesli Elena Jolanta Zabarskaitė (LKI), Deimantė Budriūnaitė (LKI) a Skirmantas Šermukšnis (NetCode). Příspěvek podrobně představil nový projekt Ústavu litevského jazyka zaměřený na rozšíření informační infrastruktury jazykových zdrojů litevštiny (LKIIS) (dostupné online: www.lkiis.lt). Hovořilo se především o službách generovaných infrastrukturou nového projektu Ústavu litevského jazyka E. kalba – „Vyhledávání ve slovních sítích“, „E. marketing“, „E. pojmy“ a „E. rady“. Přednášející představili funkce těchto služeb a jejich technologické aspekty. Funkce projektu budou zahrnovat inovativní technologie umělé inteligence určené k analýze názorů uživatelů; služba „E. pojmy“ zajistí rozšířené vyhledávání a obohacování pojmů integrací dalších jazykových zdrojů, jako jsou dvojjazyčné slovníky, 316 Acta Linguistica Lithuanica LXXVI Lietuvių kalbos padėtis skaitmeniniame amžiuje slovní sítě jiných jazyků. Pomocí interaktivního průvodce slovotvorbou bude možné rychle a pohodlně zvolit vhodné slovotvorné způsoby podle požadovaného kategoriálního a skupinového významu nebo podle slovotvorných prostředků. Příspěvek představil také hlavní výsledky projektu E. kalba a jeho očekávaný přínos. Rita Milunaitė (LKI) ve svém příspěvku „Možnosti vyhledávání v internetovém Databázi neologismů litevského jazyka“ představila, jak lze uživatelům jazyka zpřístupnit rozmanité funkce, které odpovídají jejich potřebám, v rámci Databáze neologismů litevského jazyka (dostupné online: http://naujažodžiai.lki.lt/)). V současnosti lze vyhledávat podle těchto parametrů: heslové slovo, původ neologismu, původní podoba, pravopisné varianty, oblast užití atd. Správcům databáze je k dispozici také rozšířené vyhledávání potřebné k úpravám dat z různých hledisek. V rámci projektu LKIS bude vytvořen rozšířený systém vyhledávání informací. Přednášející zdůraznila, že Databáze neologismů litevského jazyka je flexibilní digitální zdroj otevřený dalšímu rozvoji. Tento charakter určují především samotná data – neustále se měnící a obnovující vrstva slovní zásoby litevštiny – a také nové rysy dat, které se otevírají badatelům neologismů, a měnící se potřeby uživatelů. Plánuje se integrace tohoto zdroje do LKIS (dostupné online: http://lkis.lki.lt/)) a jeho zapojení nejen do systému společného vyhledávání v souboru dat, ale také jeho využití při tvorbě slovních sítí. Příspěvek názorně ukázal, jak může být tato databáze užitečná jak jazykovým odborníkům, tak všem uživatelům, kteří se zajímají o neologismy. Tématu neologismů se dále věnovala Daiva Murmulaitė (LKI) v příspěvku „Perspektivy výzkumu slovotvorby neologismů (případ Databáze neologismů litevského jazyka)“. Hovořila o výzkumu slovotvorby neologismů a jeho perspektivách a o tom, jak zkoumat rýsující se slovotvorné jevy s využitím Databáze neologismů litevského jazyka. Přednášející uvedla, že již v počáteční fázi tvorby této databáze se předběžně počítalo také s analýzou slovotvorby neologismů: příslušná pole měla obsahovat údaje o typech odvozenin, jejich slovotvorných formách a kategoriích (významech), příbuzných slovech atd.; část dat již byla shromážděna. V poli zvláštních rysů jsou některé neologismy označeny jako ojedinělé (například varškėfobija a další), autorské (například demagogėja a další) nebo kontaminační (například murmanas a další). Přednášející zdůraznila, že pro podrobnou a kvalitní slovotvornou analýzu je důležité zohlednit také některé položky, jejichž zaznamenávání se plánovalo od počátku – slovní druh základového slova odvozeniny, změny slovotvorného základu, analogie, úlohu překladu při tvoření neologismu, projevy netypické slovotvorby atd. Je důležité vytvořit kvalitní systém indexů – podrobný, flexibilní, snadno použitelný, doplňovatelný i upravitelný. Laimutis Bilkis (LKI) ve svém příspěvku „Struktura geoinformační databáze litevských místních názvů, její vazby na další databáze vlastních jmen a směry dalšího rozvoje“ Apžvalgos / Surveys 317 AURELIJA TAMULIONIENĖ představil Geoinformační databázi místních názvů Litvy (přístup online: http://lkis.lk.lt/lietuvos-vietovardziu-geoinformacine-duomenu-baze). Požádali jsme ho, aby pohovořil o struktuře této databáze a jejích vazbách na další onomastické databáze. Přednášející představil oblasti vyhledávání vytvořené na stránce veřejného přístupu k databázi: typ objektu, status objektu, současnou administrativně-územní příslušnost (obec, seniūnija, sídlo), administrativně-územní příslušnost v meziválečném období (okres, valsčius, sídlo) a přítoky řek. Informace o místních názvech lze v databázi vyhledávat podle těchto znaků: jméno, rod, číslo, přízvukový typ, způsob tvoření, původ podle příslušnosti základového slova k jazyku a původ podle příslušnosti základového slova k lexikální skupině. V databázi lze nalézt autentické místní názvy zaznamenané v meziválečném období na území příslušného sídla (vesnice, církevní vesnice, panského dvora, městečka, samoty) a zobrazit jejich přesné či přibližné umístění na mapě. V příspěvku bylo zdůrazněno, že při integraci databáze do systému LKIS byly vytvořeny tři typy odkazů na další onomastické databáze: na jiný místní název, od něhož je daný místní název odvozen, na osobní jméno z Databáze litevských příjmení, od něhož je daný místní název odvozen, a na historické zápisy daného místního názvu obsažené v Databázi historických místních názvů. V současné době bylo do databáze vloženo a popsáno (popisuje se) přibližně 25 000 místních názvů. Odpoledne se přednášející a účastníci sešli na třetím zasedání „Korpusová lingvistika“. První příspěvek „Morfologicky a syntakticky anotované korpusy litevského jazyka“ přednesli ERIKA RIMKUTĖ (VDU), AGNĖ BIELINSKIENĖ (VDU), LOÏC BOIZOU (VDU), ANDRIUS UŽA (VDU). Hovořili o dvou anotovaných korpusech litevského jazyka, které byly připraveny v Centru počítačové lingvistiky Univerzity Vytautase Velikého (přístup ke korpusům online: http://nl.ijs.si/ME/V4/msd/html/index.html; https://ufal.mff.cuni.cz/tred/). Anotované korpusy jsou základními zdroji, bez nichž nelze rozvíjet jazykové technologie. Obvykle se používají k vytváření dalších zdrojů a nástrojů pro zpracování přirozeného jazyka v oblastech, jako jsou systémy automatického rozpoznávání řeči, strojový překlad apod. Morfologicky anotovaný korpus MATAS byl vytvářen v letech 2002–2014. Tvoří jej 1,6 milionu slov z textů různých stylů. Korpus byl připraven na základě korpusu o rozsahu 1 milionu slov sestaveného v roce 2006, a to aplikací statistických modelů. Syntakticky anotovaný korpus ALKSNIS, připravený v roce 2016, slouží jako zlatý standard pro další výzkum a zdroje. Tento korpus tvoří 2 355 vět (přibližně 30 tisíc slov) převzatých z textů různých stylů. Anotace korpusu vychází z principů automatické morfologické a syntaktické anotace a využívá model syntaktických závislostí. Tématu korpusů se ve svém příspěvku „Databáze ustálených spojení v litevském jazyce“ dále věnoval početný kolektiv přednášejících: ERIKA RIMKUTĖ (VDU), AGNĖ BIELINSKIENĖ (VDU), LOÏC BOIZOU (VDU), IEVA BUMBULIENĖ (Institut pokročilých technologií Baltu), JOLANTA KOVALSKAITĖ 318 Acta Linguistica Lithuanica LXXVI Lietuvių kalbos padėtis skaitmeniniame amžiuje (VDU), Tomas Krilavičius (Institut pokročilých technologií Baltu), Justina Mandravikaitė (Institut pokročilých technologií Baltu), Laura Vilkaitė (Institut pokročilých technologií Baltu). Příspěvek na konferenci představila Erika Rimkutė (VDU); hovořila především o metodice zkoumání ustálených slovních spojení v současné psané litevštině a o připravovaném slovníku kolokací litevského jazyka založeném na korpusu. Cílem projektu Automatické rozpoznávání ustálených slovních spojení v litevském jazyce (PASTOVU) (č. LIP-027/2016) (viz http://mwe.lt/), je vytvořit metodiku zkoumání ustálených slovních spojení v současné psané litevštině a připravit slovník kolokací litevského jazyka založený na korpusu. V rámci projektu byl sestaven a používá se korpus Delfi.lt z let 2014–2016 o rozsahu 72 milionů slov. Slovník kolokací bude připravován na základě databáze. Ta bude obsahovat různé informace o ustálených spojeních: gramatické a lexikální informace, četnost užití, rubriku textu, příklady konkordance apod. Výzkum korpusů představily také zástupkyně Vilniuské univerzity Gintarė Judžentytė (VU) a Vilma Zubaitienė (VU). V příspěvku „Výzkum akademických frází založený na korpusech: formální struktura a sémantika“ hovořily o struktuře a sémantice frází akademického jazyka na základě Korpusu studentských písemných prací, který se v současnosti vytváří na Vilniuské univerzitě a je jedním z plánovaných výstupů projektu podporovaného Státní komisí pro litevský jazyk Výzkum frází ve studentských pracích a interaktivní soubor frází. Cílem projektu je sestavit seznam slov důležitých pro akademické psaní, vyčlenit hlavní kolokace a jejich rozšíření i opakující se slovní sekvence v různých částech akademického textu, pojednat o jejich souvislostech s rétorickými funkcemi jednotlivých částí textu a popsat významy akademických slov, jako jsou: cíl, úkol, metody, závěry, výsledky; provést, analyzovat, stanovit, vycházet z a další, a jejich užití a sémantiku. Na posledním zasedání „Automatizovaná analýza jazykové struktury a textů“ byly předneseny čtyři příspěvky. Zasedání zahájil příspěvek Danielia Račyse (VU) „Strojový překlad pro litevštinu“, který pojednával o nejnovějším vývoji v historii strojového překladu, dosažených výsledcích, projektech realizovaných různými institucemi i o nových průlomech v používání neuronového strojového překladu. Přednášející hovořil o vývoji a úspěších strojového překladu, které se dnes účinně uplatňují také v litevštině. V letech 2005–2007 realizovala Univerzita Vytautase Velikého projekt financovaný ze strukturálních fondů EU Internetový nástroj pro překlad informací. Výsledkem byla veřejně dostupná internetová služba pro překlad z angličtiny do litevštiny (přístup online: http://vertimas.vdu.lt/twsas/). V letech 2012–2014 realizovala Vilniuská univerzita projekt financovaný EU Vytvoření systému strojového překladu mezi angličtinou a litevštinou a mezi francouzštinou a litevštinou založeného na statistických metodách. Výsledkem byla veřejně dostupná internetová překladatelská služba (přístup online: https://www.versti.eu/). Přesto Apžvalgos / Surveys 319 AURELIJA TAMULIONIENĖ I ty nejlepší strojové překlady vyžadují zásah překladatele. Mohou tedy stroje překládat opravdu dobře? Posledních několik let slibuje nové průlomy díky využití neuronového strojového překladu. Vilniuská univerzita se připravuje na to, že v roce 2018 zahájí zavádění neuronového strojového překladu nové generace pro angličtinu, litevštinu, polštinu, francouzštinu, ruštinu a němčinu. Potěšilo, že nejnovější pokroky strojového překladu neobcházejí ani litevštinu. Virginijus Dudkevičius (VU) ve svém příspěvku „Litevská gramatika ve světě digitálních technologií s otevřeným zdrojovým kódem“ hovořil o tvorbě morfologie litevštiny nové generace pro počítačové zpracování, morfologické analýze a syntéze slov, inteligentním vyhledávání textových informací apod. S příchodem počítačů se klasická gramatika a lexikum ocitly před nutností „obléci si nový háv“ a stát se plnohodnotnou součástí nových technologií. Za tímto účelem byla vytvořena počítačová morfologie litevštiny nové generace a stanoveny tyto cíle: používat a vytvářet pouze otevřený zdrojový kód; pouze samotná data, nikoli jejich forma a interpretace, mohou mít specifické vlastnosti litevštiny; veškerý programový kód musí být univerzální a vhodný pro jakýkoli jiný jazyk; v maximální míře využívat řešení úspěšně přizpůsobená jiným jazykům světa. Základem pro její sestavení je Dabartinės lietuvių kalbos gramatika (Vilnius, 2006) a textové korpusy (celkem přibližně 1,5 miliardy slov). Morfologický analyzátor v současnosti „rozpozná“ přibližně 99% průměrného textu zveřejňovaného na internetu, tj. správně interpretuje morfologii v průměru u 99 ze 100 slov. Tento nově vytvořený způsob morfologické analýzy byl úspěšně použit v systému syntakticko-sémantické analýzy Univerzity Vytautase Magnuse (přístup na internetu: https://semantika.lt/SyntacticAndSemanticAnalysis/Analysis) a v registru právních předpisů Seimasu Litevské republiky (přístup na internetu: www.e-tar.lt). Tématu digitalizace gramatiky se věnovali také Daiva Šveikauskienė (LKI) a Vytautas Šveikauskas (LKI). V příspěvku „Digitální gramatika litevštiny“ hovořili o digitální gramatice litevštiny, jejíž tvorba byla zahájena v Institutu litevského jazyka a kterou lze využít i v dalších oblastech počítačového zpracování jazyka: při gramatické analýze, přímém překladu dat atd. Představili projekt, v jehož rámci se plánuje připojení k mezinárodnímu systému DIGITAL GRAMMARS, který v současnosti zahrnuje 32 jazyků. Hlavním cílem vytvoření digitální gramatiky je její využití v systémech automatického překladu fungujících na nestatistických metodách. Pro litevštinu je to velmi důležité. Podle údajů společnosti Tildės z roku 2017 je kvalita překladů Google do litevštiny a z litevštiny dokonce horší než u lotyštiny či estonštiny. Proto je pro Litvu velmi důležité vyvíjet alternativní způsob automatického překladu. V současnosti je připraven zkušební příklad digitální gramatiky, který zahrnuje několik slov, ale už z něj lze vidět, že kvalita překladu je zde mnohem lepší, zejména u vět, v nichž se projevují specifické rysy litevštiny. Dokud se používá anglický slovosled, poskytují slušné překlady i statistické 320 Acta Linguistica Lithuanica LXXVI Lietuvių kalbos padėtis skaitmeniniame amžiuje metody; pokud má však věta nestandardní slovosled, překlad Google neztrácí smysl věty. Digitální gramatiku lze využít i v dalších oblastech počítačového zpracování jazyka: při gramatické analýze, přímém překladu dat atd. Tvorbu digitálních gramatik řídí profesor Aarne Ranta z univerzity v Göteborgu (Švédsko). Poslední konferenční příspěvek „Kdo od koho opisoval? Automatizace a vizualizace výzkumu dějin překladů Bible“ přednesl Mindaugas Šinkūnas (LKI). Hovořil o automatizaci a vizualizaci výzkumu dějin překladů Bible. Výsledky porovnání biblických veršů přednášející představil na názorných a podrobných diagramech. Množství biblických citátů ve starých litevských textech ztěžuje výzkum jejich vzájemných vztahů. Je zapotřebí praktická datová platforma, která umožňuje seskupovat biblické verše podle vlastností zajímavých pro badatele. Největší obtíže působí hodnocení podobnosti citátů. Komplexní analýza lexika, syntaxe a morfologie (a v některých případech také pravopisu) to umožňuje, filologický výzkum je však pomalý a v současnosti jej nelze automatizovat. Porovnání se podařilo automatizovat pomocí algoritmů pracujících v cyklech, jejichž úkolem je v dvou posloupnostech znaků nalézt totožné řetězce a vypočítat, jakou část porovnávaných posloupností pokrývají. Automatizaci porovnávání brání nejednoznačný pravopis starých textů. Vyhodnocení ručně a automaticky transliterovaných veršů ukázalo, že způsob transliterace nemá na výsledky zásadní vliv. Výsledky mohou být sporné při porovnávání textů napsaných různými dialekty (nivelace dialektologických rysů nebyla vyzkoušena). Získané výsledky podobnosti jsou shrnuty ve dvourozměrných diagramech. Výsledky počítačové analýzy porovnání biblických veršů z Bretkūnaseovy Postilės (1591) odpovídají závěrům, k nimž dřívější badatelé dospěli jinými metodami. Konference skončila diskusí. Články připravené na základě konferenčních příspěvků budou publikovány ve vědeckých časopisech Bendrinė kalba (přístup na internetu: www.bendrinekalba.lt) a Lietuvių kalba (www.lietuviukalba.lt). LITERATŪRA Zinkevičius Zigmas 1992: Lietuvių kalbos istorija 5. Bendrinės kalbos iškilimas. Vilnius: Mokslas, 144–155. Įteikta 2017 m. lapkričio 3 d. AURELIJA TAMULIONIENĖ Lietuvių kalbos institutas Petro Vileišio g. 5, LT-10308 Vilnius, Lietuva [email protected] Apžvalgos / Surveys 321