Page 1AURELIJA TAMULIONIENĖ
Litvanca Enstitüsü
Araştırma alanları: çağdaş Litvancanın kullanımı ve değişkenliği üzerine araştırmalar.
DİJİTAL ÇAĞDA LİTVANCANIN DURUMU
24. Jono Jablonskio Konferansı Hakkında
Dijital dil kaynaklarının geliştirilme yönleri ve kullanım olanakları
Jono Jablonskio (1860–1930) – žymiausio lietuvių kalbos normintojas, reikšmingų lietuvių kalbos mokslui ir praktikai darbų autorius. Pasak Zigmo Zinkevičiaus, „[V]isa Jablonskio veikla – tai ištisa epocha lietuvių bendrinės kalbos istorijoje. Iš mūsų rašomą kalbą į tinkamas vėžes [...], jos raidą pasuko sveika linkmė“ (Zinkevičius 1992: 155).
Jono Jablonskio’nun adını taşıyan bilimsel konferans ilk kez 1993 yılında Litvanca Enstitüsünün Dil Kültürü Bölümü ile Vilnius Üniversitesi Litvanca Bölümü tarafından düzenlendi. O zamandan beri konferanslar geleneksel hâle geldi ve her sonbaharda düzenleniyor (2003’ten itibaren dönüşümlü olarak Litvanca Enstitüsünde veya Vilnius Üniversitesinde).
29 Eylül 2017’de, Litvanca Enstitüsünde 24. bilimsel Jono Jablonskio Konferansı Dijital dil kaynaklarının geliştirilme yönleri ve kullanım olanakları (İng. Digital Language Resources, Directions of Their Development and Possibilities to Harness Them) düzenlendi. Konferansı, Litvanca Enstitüsü Standart Dil Araştırmaları Merkezi, Vilnius Üniversitesi Uygulamalı Dilbilim Enstitüsüyle birlikte organize etti. Konusu bakımından bu konferans öncekilerden farklıydı; amacı, diller ile dijital teknolojilerin kesişiminde ortaya çıkan, dijital kaynakların geliştirilmesi ve ortak dijital pazarın oluşturulması sırasında karşılaşılan sorunları ele almaktı. Konferansın gündeminde dijital kaynakların anlamsal düzeyi (sözcük ağlarının oluşturulması) ve dijital kaynaklara sesli biçim kazandırılması, ayrıca çok dilli topluluklarda dijital kaynakların yaygınlaştırılması için yeni olanakların geliştirilmesi vb. konular vardı.
Konferansa yurt dışından Avrupa Parlamentosu ve İspanya’dan konuşmacılar, ayrıca Litvanya’daki çeşitli kurumlardan araştırmacılar katıldı: Litvanca Enstitüsü, Vilnius
Straipsniai / Articles
313
Page 2AURELIJA TAMULIONIENĖ
üniversitesinden, Vytautas Magnus Üniversitesinden, Baltık İleri Teknolojiler Enstitüsünden ve Netcode Ltd. şirketinden. Konferansta 17 bildiri sunuldu. Konuşmacılar dört oturumda bildirilerini sundu ve araştırma ve deneyimlerini paylaştı.
Konferans açılış konuşmalarıyla başladı. Konferans katılımcılarını ve konuşmacıları Avrupa Parlamentosu üyesi Algirdas Saudargas ile Litvanya Dili Enstitüsü Müdürü Prof. Dr. Jolanta Elena Zabarskaitė selamladı. Açılış konuşmasını Litvanya Dili Enstitüsü Standart Dil Araştırmaları Merkezi Baş Araştırmacısı Dr. Rita Miliūnaitė yaptı. Litvanca ile bilgi teknolojileri arasındaki bağların son yıllarda çok güçlendiği; dil kaynaklarını dijitalleştirme ve dil çözümleme, tanıma ve sentezleme araçları geliştirme alanlarında somut sonuçlar elde ettiğimiz, ancak dünyanın bu alandaki hızlı değişimi karşısında Litvancanın hâlâ katetmesi gereken uzun bir yol olduğu belirtildi. Litvanca bükümlü bir dil olduğundan, İngilizce için geliştirilmiş bilgi teknolojilerine doğrudan uyarlanamaz; bu nedenle mevcut makine çevirisi ve diğer bilgisayar araçlarımız hâlâ çok kusurludur. Oysa dünya çoktan araştırmalarını ilerletmiş, yapay zekâ geliştirme yönünde ilerlemekte, nesneleri akıllandırmakta ve dilin giderek daha derin katmanlarına nüfuz etmektedir.
Genel kurul oturumundaki ilk bildiriyi Avrupa Parlamentosu üyesi Algirdas Saudargas, “Yapay Zekâda Canlı Dil” başlığıyla sundu. Konuşmacı, her dil topluluğunun yanıtlaması gereken temel bir soruyu gündeme getirdi: Ana dilinin kaynaklarını ve teknolojilerini ne ölçüde kendisi hazırlamalı, neleri ise başka diller temel alınarak önceden üretilmiş biçimde satın alabilir? Bildiride, Litvancanın bazı diğer küçük ülke dilleriyle birlikte “teknolojik desteğinin az olduğu ya da hiç olmadığı” yönündeki sorunlu görüşler dile getirildi. Dil teknolojileri, yalnızca Litvanya’daki değil, Avrupa’daki siyasetçilerin gündeminde de gereken ilgiyi görmüyor. Bildiride, yapay zekânın gelişiminin hibrit bir biçime yakınsadığını gösteren değerlendirmeler sunuldu: sinir ağları beynin bilinçsiz mekanizmalarına karşılık gelirken, bilinçli düşünce geleneksel, sözde sembolik yapay zekâ tarafından etkilenip modelleniyor. Her dil topluluğu, sembolik yapay zekâyı temsil eden dil teknolojilerinin ana dilinin bütün yapısını kapsamlı ve doğru biçimde yansıtmasını; sinir ağlarının eğitimi içinse zengin bir ana dil (ve ana kültür) ortamı oluşturulmasını sağlamalıdır.
İkinci genel kurul bildirisini, “Dijital çağda dil eşitliği: insan dili projesine doğru” başlığıyla, danışmanlık şirketi Claves’in direktörü Rafael Rivera İngilizce olarak sundu. Bildiride, Avrupa Parlamentosu Bilimsel Öngörü Birimi’nin “Dijital çağda dil eşitliği. Ana dil projesi” başlıklı araştırması ayrıntılı olarak tanıtıldı (İngilizce araştırmaya çevrimiçi olarak erişilebilir: http://www.europarl.europa.eu/RegData/etudes/STUD/2017/598621/EPRS_STU(2017)598621_EN.pdf). Bildiride ana dil teknolojilerinin mevcut durumu gözden geçirilerek nicel olarak değerlendirildi
314
Acta Linguistica Lithuanica LXXVI
Page 3Lietuvių kalbos padėtis skaitmeniniame amžiuje
dijital çağda dilin ekonomik, toplumsal ve dilbilimsel sonuçları; Avrupa Birliği’nin bilgi ve iletişim teknolojileri politikası ele alındı. Dijital çağda dil teknolojileri, az sayıda konuşuru olan ülkeler için büyük bir meydan okumadır. Yeterince gelişmemiş dil teknolojileri eşitsizliğe ve engellere yol açar. Bu durum sınır ötesi hizmetleri, çalışanların hareketliliğini ve ticareti etkiler. Bu engellerin nedeni, araştırmaların eşgüdümsüz yürütülmesi ve yetersiz finansmandır. Konuşmacı, dil teknolojilerinin Avrupalı siyasetçilerden gereken ilgiyi görmediğini vurguladı. Mevcut durumun analizine dayanarak kurumların, araştırmaların, sanayinin, pazarın ve kamu hizmetleri politikalarının bir araya getirileceği bir girişim oluşturuluyor.
Genel kurulun son bildirisini, “Olağan ve elektronik ortamlarda yazılı ve sözlü Litvanca” başlığıyla, Vilnius Üniversitesi Matematik ve Bilişim Enstitüsü profesörü Laimutis Telksnys sundu. Bildiride, kâğıt belgelerde ve elektronik ortamda yazılı ve sözlü Litvancanın doğru kullanımını sağlayacak yöntemlerin ve araçların—donanım ve yazılımın—hazırlanması gerektiği ele alındı. Konuşmacı önemli bir soru yöneltti: Birkaç milyon Litvanyalı, yazan ve konuşan yedi milyardan fazla insanın ve gelecekteki akıllı makinelerin okyanusunda yok olmamak için nasıl davranacak? Profesör yanıtını da verdi: Bunun olmaması için kâğıt belgelerde ve elektronik ortamda yazılı ve sözlü Litvancanın doğru kullanımını sağlayan; Litvanca ile diğer dillerin yazılı ve sözlü kullanımını kâğıt belgelerde ve elektronik ortamda uyumlaştıran yöntemler ve araçlar—donanım ve yazılım—hazırlanmalıdır. Litvanca dışındaki yazı sistemlerinin harflerini Litvanca yazı işaretleriyle, Litvanca dışındaki konuşma seslerini ise Litvanca konuşma işaretleriyle gösterecek; bu işaretler Litvanca konuşma sözcüklerinin seslerini otomatik olarak sentezlemeye uygun olacak biçimde dönüştürücüler oluşturulmalıdır.
“Konuşma tanıma ve sentezi” başlıklı ilk oturumda üç bildiri sunuldu.
Audrius Valotka (VU) ve Gediminas Navickas (VU), “Gutenberg matbaasından uzaklaşırken: en yeni teknolojilerde Litvanca konuşma” başlıklı bildirilerinde en yeni teknolojilerde Litvanca konuşmayı ele aldılar ve Yapısal Fonlar tarafından finanse edilen Litvanca konuşmayla yönetilen hizmetler – LIEPA projesini tanıttılar (çevrimiçi erişim: https://www.raštija.lt/liepa),). Proje kapsamında, diğer çalışmaların yanı sıra, Litvanca konuşma sentezleyicisi ve tanıyıcısı geliştirildi. Projenin yürütülmesi sırasında Litvanca konuşmanın dijital alana açılan kapıları aralandı; bu nedenle Litvanca konuşmayla yönetilen hizmetlerin geliştirilmesi – LIEPA 2 projesi planlanıyor. Konuşmacılar, LIEPA 2 projesinin herkesin kullanımına açık ve ücretsiz olacak, bilgi teknolojisi ürünlerinde Litvanca konuşmanın kullanımını teşvik edecek sonuçlarından söz ettiler. Yeni projenin en önemli sonucu, doğal bir biçimde
Apžvalgos / Surveys
315
Page 4AURELIJA TAMULIONIENĖ
nesnelerle (cep telefonları, tabletler, akıllı saatler, robotlar) konuşmak, insan sesiyle komut vermek ve onların yanıtlarını anlamak. LIEPA 2 kapsamında, Litvanca konuşmayla kontrol edilen hizmetlerin yeni kullanım olanaklarını gösteren tipik hizmetlerin oluşturulması öngörülmektedir: eğitici robot kontrolörü, arama hizmeti, taksi çağırma hizmeti, görme engelliler için mobil sentezleyici, internet haber okuyucusu ve diller arası iletişim aracı.
Laimutis Telksnys (VU) ve Gediminas Navickas (VU), “Litvanca Konuşmayla Kontrol Edilen Hizmetler. Durum. Perspektifler” başlıklı bildirilerinde, Litvanca konuşmayla kontrol edilen hizmetlerin durumunu ve perspektiflerini, bu hizmetleri oluşturmak ve kullanım alanlarını geliştirmek için sistematik biçimde yürütülen çalışmaları ele aldılar. Çalışmalar, bilgi teknolojileri uzmanlarının, Litvanca filologlarının bilgi birikimi ve mühendislik kapasitesi bir araya getirilerek yürütülmektedir. Çalışmaların ilk aşamasında Litvanca konuşmayla kontrol edilen yedi hizmet oluşturulmuş ve bu hizmetlerin çalışmasını sağlayan altyapı kurulmuştur. Gelecekte, akıllı cep telefonları, tabletler, akıllı saatler ve robotlar gibi mobil elektronik ortamlar için Litvanca konuşmayla kontrol edilen yeni hizmetler oluşturulması öngörülmektedir.
Litvanca ses sentezinin bugünü ve geleceği hakkında Pius Kasparaitis (VU) ile Gintaras Skeris (VU) konuştu. “Litvanca Ses Sentezinin Bugünü ve Geleceği” başlıklı bildiride, çeşitli metin seslendirme hizmetleri tanıtıldı: kaynak metinleriyle birlikte serbestçe dağıtılan LIEPA sentezleyicisi. Bu durum, başkalarının da sentezleyiciye yeni uygulama alanları bulmasına olanak sağlıyor. Örneğin, makalelerin yanında ses kayıtlarını şu internet siteleri sunuyor: zinios.lt, unikopedarejas.lt, vilnius.lt, m.delfi.lt, vle.lt; RoboBraille metin seslendirme hizmeti her türlü metin belgesini otomatik olarak ses dosyalarına dönüştürüyor; Vilkaviškis otobüs terminalinde sentetik sesle yapılan anonslar artık dinlenebiliyor; Göç Dairesi’nin internet sitesinde sanal asistanlar çalışıyor vb.
“Dijital Litvanca Dil Kaynakları” başlıklı ikinci oturumda dört bildiri sunuldu.
İlk bildiriyi “E. kalba – dijital dil kaynaklarının kullanımında bir yenilik” başlığıyla Elena Jolanta Zabarskaitė (LKI), Deimantė Budriūnaitė (LKI) ve Skirmantas Šermukšnis (NetCode) sundu. Bildiride, Litvanca Dil Enstitüsünün Litvanca dil kaynaklarının bilgi altyapısını genişletmeye yönelik yeni projesi (LKIIS) ayrıntılı biçimde tanıtıldı (çevrimiçi erişim: www.lkiis.lt). Bildiride ağırlıklı olarak, Litvanca Dil Enstitüsünün yeni projesi E. kalba altyapısının ürettiği “Sözcük Ağında Arama”, “E. pazarlama”, “E. kavramlar” ve “E. öneriler” hizmetleri ele alındı. Sunum yapanlar bu hizmetlerin işlevlerini ve teknolojik yönlerini tanıttılar. Projenin işlevleri, kullanıcı görüşlerini analiz etmeye yönelik yenilikçi yapay zekâ teknolojilerini kapsayacak; “E. kavramlar” hizmeti ise iki dilli sözlükler gibi ek dil kaynaklarını bütünleştirerek genişletilmiş arama ve kavram zenginleştirme sağlayacak,
316
Acta Linguistica Lithuanica LXXVI
Page 5Lietuvių kalbos padėtis skaitmeniniame amžiuje
diğer dillerin sözcük ağları sisteme dâhil edilecek ve etkileşimli sözcük türetme sihirbazı kullanılarak, istenen kategorik ve grup anlamına ya da sözcük türetme araçlarına göre uygun sözcük türetme yöntemlerini hızlı ve kolay biçimde seçme olanağı sunulacaktır. Bildiride ayrıca E. kalba projesinin temel sonuçları ve öngörülen yararları da tanıtıldı.
Rita Milunaitė (LKI), “Çevrimiçi Litvanca Neolojizm Veri Tabanı’nda Arama Olanakları” başlıklı bildirisinde, dil kullanıcılarının çeşitli ihtiyaçlarını karşılayan özelliklerin Litvanca Neolojizm Veri Tabanı aracılığıyla nasıl ortaya çıkarılabileceğini tanıttı (çevrimiçi erişim: http://naujažodžiai.lki.lt/)). Şu anda başlık sözcüğü, neolojizmin kökeni, özgün biçimi, yazım varyantları, kullanım alanı vb. ölçütlere göre arama yapılabiliyor. Veritabanı yöneticileri, verileri çeşitli açılardan düzenlemek için gereken daha kapsamlı arama olanağına da sahip. LKIS projesi kapsamında genişletilmiş bir bilgi arama sistemi oluşturulacak. Sunum yapan kişi, Litvanca Neolojizm Veri Tabanı’nın gelişime açık ve esnek bir dijital kaynak olduğunu vurguladı. Bu niteliği öncelikle verilerin kendisi, yani Litvanca söz varlığının sürekli değişen ve yenilenen katmanı belirliyor; ayrıca neolojizm araştırmacılarının karşısına çıkan yeni veri özellikleri ve kullanıcıların değişen ihtiyaçları da bu niteliği şekillendiriyor. Bu kaynağın LKIS’e entegre edilmesi (çevrimiçi erişim: http://lkis.lki.lt/)), yalnızca sistemdeki veri havuzunda genel arama yapılmasına katkı sağlamakla kalmayıp sözcük ağlarının oluşturulmasında da kullanılması planlanıyor. Bildiride, bu veri tabanının hem dil uzmanları hem de neolojizmlerle ilgilenen tüm kullanıcılar için ne kadar yararlı olabileceği çarpıcı biçimde gösterildi.
Neolojizm konusunu, “Neolojizm Türetme Araştırmalarının Perspektifleri (Litvanca Neolojizm Veri Tabanı Örneği)” başlıklı bildirisiyle Daiva Murmulaitė (LKI) sürdürdü. Neolojizmlerin türetilmesine ilişkin araştırmaları, bu araştırmaların perspektiflerini ve belirginleşen neolojizm türetme olgularının Litvanca Neolojizm Veri Tabanı kullanılarak nasıl incelenebileceğini ele aldı. Sunum yapan kişi, veritabanının oluşturulmasının ilk aşamasında bile neolojizm türetme çözümlemesi için ön hazırlıkların yapıldığını belirtti: bu amaçla ayrılan alanlarda türetme türlerinin, türetim biçimlerinin, türetme kategorilerinin (anlamlarının), ilişkili sözcüklerin vb. belirtilmesi öngörülmüş ve verilerin bir bölümü biriktirilmiştir. Bazı neolojizmler, özel nitelikler alanında tekil (örneğin, varškėfobija vb.), yazara özgü (örneğin, demagogėja vb.) ve kaynaşmalı (örneğin, murmanas vb.) olarak işaretlenmiştir. Sunum yapan kişi, sözcük türetmenin kapsamlı ve nitelikli biçimde çözümlenebilmesi için başlangıçta kaydedilmesi öngörülen bazı unsurların da dikkate alınmasının önemli olduğunu vurguladı: türemiş sözcüğün taban sözcüğünün sözcük türü, türetme tabanındaki değişiklikler, benzetmeler, neolojizmin türetilmesinde çevirinin rolü, atipik türetme örnekleri vb. Ayrıntılı, esnek, kullanımı, doldurulması ve düzeltilmesi kolay, iyi bir dizin sistemi oluşturmak önemlidir.
Laimutis Bilkis (LKI), “Litvanya Yer Adlarının Jeoinformasyon Veritabanının Yapısı, Diğer Ad Bilimi Veritabanlarıyla İlişkileri ve Gelişim Yönleri” başlıklı bildirisinde
Apžvalgos / Surveys
317
Page 6AURELIJA TAMULIONIENĖ
Litvanya Yer Adları Coğrafi Bilgi Veritabanı’nı tanıttı (çevrimiçi erişim: http://lkis.lk.lt/lietuvos-vietovardziu-geoinformacine-duomenu-baze). Bu veritabanının yapısı ve diğer adbilim veritabanlarıyla ilişkileri hakkında konuşması istendi. Sunucu, veritabanının herkese açık erişim sayfasında oluşturulan arama alanlarını tanıttı: nesne türü, nesnenin durumu, günümüzdeki idari-bölgesel bağlılığı (belediye, bucak, yerleşim yeri), savaşlar arası dönemdeki idari-bölgesel bağlılığı (il, bucak, yerleşim yeri) ve nehir kolları. Veritabanında yer adları hakkında bilgi şu özelliklere göre aranabilir: ad, cinsiyet, sayı, vurgu türü, oluşum biçimi, kök sözcüğün ait olduğu dile göre köken ve kök sözcüğün ait olduğu sözcük grubuna göre köken. Veritabanında, istenen yerleşim yerinin (köy, kilise köyü, malikâne, kasaba, çiftlik) topraklarında savaşlar arası dönemde kaydedilmiş otantik yer adları bulunabilir ve bunların haritadaki kesin ya da yaklaşık konumları görülebilir. Sunumda, LKIS sistemine entegre edilen veritabanında diğer adbilim veritabanlarına üç tür bağlantı oluşturulduğu vurgulandı: yer adının türediği başka bir yer adına, yer adının türediği ve Litvanya Soyadları Veritabanı’nda bulunan kişi adına ve Tarihî Yer Adları Veritabanı’nda bulunan söz konusu yer adının tarihî yazılışlarına. Şu anda veritabanına yaklaşık 25.000 yer adı yüklenmiş ve tanımlanmıştır (tanımlanmaktadır).
Öğleden sonra konuşmacılar ve katılımcılar, “Derlem Dilbilimi” başlıklı üçüncü oturum için bir araya geldi.
“Litvancanın Morfolojik ve Sözdizimsel Olarak Etiketlenmiş Derlemleri” başlıklı ilk sunumu ERIKA RIMKUTĖ (VDU), AGNĖ BIELINSKIENĖ (VDU), LOÏC BOIZOU (VDU), ANDRIUS UŽA (VDU) yaptı. Vytautas Magnus Üniversitesi Bilgisayarlı Dilbilim Merkezi’nde hazırlanan, Litvanca için etiketlenmiş iki derlem hakkında konuşuldu (derlemlere çevrimiçi erişim: http://nl.ijs.si/ME/V4/msd/html/index.html; https://ufal.mff.cuni.cz/tred/). Etiketlenmiş derlemler, dil teknolojilerini geliştirmenin onsuz mümkün olmadığı temel kaynaklardır. Genellikle otomatik konuşma tanıma sistemleri ve otomatik çeviri gibi alanlarda başka doğal dil kaynakları ve araçları geliştirmek için kullanılırlar. Morfolojik olarak etiketlenmiş MATAS derlemi 2002–2014 yılları arasında hazırlanmıştır. Çeşitli üsluplardan metinlerden alınan 1,6 milyon sözcükten oluşur. Derlem, 2006’da oluşturulmuş 1 milyon sözcüklük bir derlem temel alınarak istatistiksel modeller uygulanmak suretiyle hazırlanmıştır. Daha ileri araştırmalar ve kaynaklar için altın standart olarak hazırlanan ALKSNIS adlı sözdizimsel olarak etiketlenmiş derlem 2016’da oluşturulmuştur. Bu derlem, çeşitli üsluplardan alınmış 2.355 cümleden (yaklaşık 30 bin sözcük) oluşur. Derlemin etiketlenmesi, otomatik morfolojik ve sözdizimsel etiketleme ilkelerine dayanır; sözdizimsel bağımlılık modeli uygulanmıştır.
Derlem konusunu “Litvancadaki Kalıplaşmış İfadeler için Veritabanı” başlıklı sunumunda, konferansta çok sayıda bildiri sunan ekip üyeleri ERIKA RIMKUTĖ (VDU), AGNĖ BIELINSKIENĖ (VDU), LOÏC BOIZOU (VDU), IEVA BUMBULIENĖ (Baltık İleri Teknolojiler Enstitüsü), JOLANTA KOVALSKAITĖ sürdürdü.
318
Acta Linguistica Lithuanica LXXVI
Page 7Lietuvių kalbos padėtis skaitmeniniame amžiuje
(VDU), Tomas Krilavičius (Baltık İleri Teknolojiler Enstitüsü), Justina Mandravikaitė (Baltık İleri Teknolojiler Enstitüsü) ve Laura Vilkaitė (Baltık İleri Teknolojiler Enstitüsü). Sunumu konferansta Erika Rimkutė (VDU) yaptı; ağırlıklı olarak günümüz yazılı Litvancasındaki kalıplaşmış sözcük öbeklerini araştırma yönteminden ve hazırlanmakta olan derlem temelli Litvanca eşdizim sözlüğünden söz etti. Litvancadaki Kalıplaşmış Sözcük Öbeklerinin Otomatik Tanınması (PASTOVU) (no. LIP-027/2016) projesi kapsamında (bkz. http://mwe.lt/), günümüz yazılı Litvancasındaki kalıplaşmış sözcük öbeklerini araştırma yönteminin oluşturulması ve derlem temelli bir Litvanca eşdizim sözlüğünün hazırlanması amaçlanmaktadır. Projede 2014–2016 yıllarına ait Delfi.lt derlemi oluşturulmuş ve kullanılmıştır; derlem 72 milyon sözcükten oluşmaktadır. Eşdizim sözlüğü bir veritabanından yararlanılarak hazırlanacaktır. Veritabanında kalıplaşmış öbeklerle ilgili çeşitli bilgilere yer verilecektir: dilbilgisel ve sözcüksel bilgiler, kullanım sıklığı, metin kategorisi, konkordans örnekleri vb.
Derlem araştırmalarını Vilnius Üniversitesi temsilcileri Gintarė Judžentytė (VU) ve Vilma Zubaitienė (VU) de tanıttı. “Derlem Temelli Akademik İfade Araştırmaları: Biçimsel Yapı ve Anlam Bilimi” başlıklı sunumda, Vilnius Üniversitesi’nde şu anda oluşturulmakta olan ve Litvanya Devlet Litvanca Komisyonu’nun desteklediği Öğrenci Çalışmalarındaki İfade Dizilerinin Araştırılması ve Etkileşimli İfade Dizisi Derlemi projesinin öngörülen sonuçlarından biri olan Öğrenci Yazılı Çalışmaları Derlemi temel alınarak akademik dildeki ifadelerin yapısı ve anlamı ele alındı. Proje; akademik yazım açısından önemli sözcükleri belirlemeyi, temel eşdizimleri ve bunların genişletilmiş biçimlerini, ayrıca akademik metinlerin farklı bölümlerinde yinelenen sözcük dizilerini saptamayı, bunların metin bölümlerinin retorik işlevleriyle bağlantılarını tartışmayı ve şu tür akademik sözcüklerin anlamlarını açıklamayı amaçlamaktadır: amaç, görev, yöntemler, sonuçlar, bulgular; gerçekleştirmek, analiz etmek, belirlemek, dayanmak vb. sözcüklerin kullanımını ve anlam bilimini incelemek.
“Dil Yapısının ve Metinlerin Otomatik Çözümlenmesi” başlıklı son oturumda dört sunum yapıldı.
Oturum, Danielius Račys’in (VU) “Litvanca için Makine Çevirisi” başlıklı sunumuyla başladı. Sunumda makine çevirisinin tarihi, en yeni gelişmeler, çeşitli kurumların yürüttüğü projeler ve sinirsel makine çevirisinin kullanılmasındaki yeni atılımlar ele alındı. Konuşmacı, bugün Litvanca için de etkili biçimde uygulanan makine çevirisinin gelişimi ve başarılarından söz etti. Vytautas Magnus Üniversitesi, 2005–2007 yıllarında AB Yapısal Fonları tarafından finanse edilen Çevrimiçi Bilgi Çeviri Aracı projesini yürüttü. Sonuç, İngilizceden Litvancaya çeviri sağlayan herkese açık çevrimiçi bir hizmetti (çevrimiçi erişim: http://vertimas.vdu.lt/twsas/). 2012–2014 yıllarında Vilnius Üniversitesi, AB tarafından finanse edilen İngilizce–Litvanca–İngilizce ve Fransızca–Litvanca–Fransızca Dillerinde İstatistiksel Yöntemlere Dayalı Makine Çevirisi Sisteminin Geliştirilmesi projesini yürüttü. Sonuç, herkese açık çevrimiçi bir çeviri hizmetiydi (çevrimiçi erişim: https://www.versti.eu/). Ancak
Apžvalgos / Surveys
319
Page 8AURELIJA TAMULIONIENĖ
En iyi makine çevirileri için bile çevirmenin müdahalesi gereklidir. Peki makineler gerçekten iyi çeviri yapabilir mi? Son birkaç yıl, sinirsel makine çevirisi kullanımında yeni atılımlar vaat ediyor. Vilnius Üniversitesi, 2018’de İngilizce, Litvanca, Lehçe, Fransızca, Rusça ve Almanca için yeni nesil sinirsel makine çevirisini uygulamaya koymaya hazırlanıyor. Makine çevirisindeki en yeni gelişmelerin Litvancayı da es geçmemiş olması memnuniyet vericidir.
Virginijus Dudkevičius (VU), “Açık kaynak dünyasında Litvanca dilbilgisi” başlıklı sunumunda yeni nesil bilgisayarlı Litvanca morfolojisinin geliştirilmesi, sözcüklerin morfolojik çözümlemesi ve sentezi, metinsel bilginin akıllı biçimde aranması ve benzeri konulardan söz etti. Bilgisayarların ortaya çıkmasıyla klasik dilbilgisi ve söz varlığının “yeni bir giysiye bürünmesi” ve yeni teknolojilerin ayrılmaz bir parçası hâline gelmesi gerekti. Bu amaçla yeni nesil bilgisayarlı Litvanca morfolojisi geliştirildi ve şu hedefler belirlendi: yalnızca açık kaynak kullanmak ve geliştirmek; Litvancaya özgü özellikler yalnızca verilerde bulunabilir, verilerin biçimi ve yorumlanmasında değil; tüm program kodu evrensel olmalı ve başka herhangi bir dile uygun olmalıdır; dünyanın diğer dilleri için başarıyla uyarlanmış çözümlerden mümkün olduğunca yararlanılmalıdır. Temel olarak Dabartinės lietuvių kalbos gramatika (Vilnius, 2006) ve derlemler (toplam yaklaşık 1,5 milyar sözcük) kullanılmıştır. Şu anda internette ortaya çıkan ortalama bir metnin yaklaşık%99’u “tanınabilir”; yani morfolojik çözümleyici her 100 sözcükten ortalama 99’unu doğru yorumlamaktadır. Bu yeni geliştirilen morfolojik çözümleme yöntemi, Vytautas Magnus Üniversitesi’nin Sözdizimsel-Anlamsal Çözümleme Sistemi’nde başarıyla uygulanmıştır (çevrimiçi erişim: https://semantika.lt/SyntacticAndSemanticAnalysis/Analysis) ve Litvanya Cumhuriyeti Seimas’ının Hukuki İşlemler Sicili’nde (çevrimiçi erişim: www.e-tar.lt).
Dilbilginin dijitalleştirilmesi konusunu Daiva Šveikauskienė (LKI) ve Vytautas Šveikauskas (LKI) sürdürdü. “Litvancanın dijital dilbilgisi” başlıklı sunumda, Litvanca dilbilgisinin Litvanya Dili Enstitüsü’nde geliştirilmeye başlanan ve dilin bilgisayarlı işlenmesinin başka alanlarında da kullanılabilecek dijital dilbilgisinden söz edildi: dilbilgisel çözümleme, verilerin doğrudan çevirisi vb. Şu anda 32 dili kapsayan DIGITAL GRAMMARS adlı uluslararası sisteme katılmayı planlayan proje tanıtıldı. Dijital dilbilgisi geliştirmenin temel amacı, onu istatistiksel olmayan yöntemlerle çalışan otomatik çeviri sistemlerinde kullanmaktır. Bu, Litvanca için son derece önemlidir. 2017 yılı Tildės verilerine göre, Google çevirilerinin Litvancaya ve Litvancadan çeviri kalitesi, Letonca ve Estonca için olduğundan bile daha kötüdür. Bu nedenle Litvanya için alternatif bir otomatik çeviri seçeneği geliştirmek çok önemlidir. Şu anda birkaç sözcük içeren bir dijital dilbilgisi örneği hazırlanmıştır; ancak bu örnekten bile, özellikle Litvancanın kendine özgü özelliklerini yansıtan cümlelerde çeviri kalitesinin çok daha iyi olduğu görülebilir. İngilizce sözcük dizilişi kullanıldığında, istatistiksel yöntemler de fena olmayan çeviriler sunmaktadır.
320
Acta Linguistica Lithuanica LXXVI
Page 9Lietuvių kalbos padėtis skaitmeniniame amžiuje
Ancak cümlede alışılmadık bir sözcük dizilişi varsa, Google çevirisi cümlenin anlamını koruyamaz. Dijital dilbilgisi, dilin bilgisayarlı işlenmesinin başka alanlarında da kullanılabilir: dilbilgisel çözümleme, verilerin doğrudan çevirisi vb. Dijital dilbilgilerinin geliştirilmesine İsveç’in Göteborg Üniversitesi profesörü Aarne Ranta başkanlık etmektedir.
Konferansın son sunumu olan “Kim kimden kopya çekti? Kutsal Kitap çevirileri tarihine ilişkin araştırmaların otomasyonu ve görselleştirilmesi” başlıklı sunumu Mindaugas Šinkūnas (LKI) yaptı. Sunumda Kutsal Kitap çevirileri tarihine yönelik araştırmaların otomasyonu ve görselleştirilmesi ele alındı. Sunucu, Kutsal Kitap ayetlerinin karşılaştırılmasının sonuçlarını açıklayıcı ve kapsamlı diyagramlarla gösterdi. Eski Litvanca yazılardaki Kutsal Kitap alıntılarının bolluğu, aralarındaki ilişkilerin incelenmesini zorlaştırmaktadır. Araştırmacının ilgilendiği özelliklere göre Kutsal Kitap ayetlerini gruplandırmaya olanak veren kullanışlı bir veri platformuna ihtiyaç vardır. En büyük güçlük, alıntıların benzerliğini değerlendirmektir. Söz varlığının, sözdiziminin ve morfolojinin (bazı durumlarda yazımın da) bütünleşik çözümlemesi bunu mümkün kılar; ancak bu filolojik inceleme yavaştır ve şu anda otomatikleştirilmesi mümkün değildir. Karşılaştırma, döngüler hâlinde çalışan algoritmalarla otomatikleştirilebilmiştir; bu algoritmaların görevi, iki karakter dizisinde özdeş dizileri bulmak ve karşılaştırılan dizilerin ne kadarını kapsadıklarını hesaplamaktır. Eski yazıların ortografisindeki belirsizlik, karşılaştırmanın otomatikleştirilmesini engellemektedir. Elle ve otomatik olarak çevriyazıya aktarılmış dizeler değerlendirildiğinde, çevriyazı yönteminin sonuçlar üzerinde belirleyici bir etkisi olmadığı saptanmıştır. Farklı lehçelerde yazılmış metinler karşılaştırıldığında sonuçlar tartışmalı olabilir (lehçe özelliklerinin nötrleştirilmesi denenmemiştir). Elde edilen benzerlik sonuçları iki boyutlu diyagramlarda özetlenmektedir. Bretkūnas’ın Postilės (1591) adlı eserindeki Kutsal Kitap ayetlerinin bilgisayar destekli çözümleme yoluyla elde edilen karşılaştırma sonuçları, önceki araştırmacıların başka yöntemlerle ulaştığı sonuçlarla örtüşmektedir.
Konferans tartışmalarla sona erdi. Konferans sunumlarına dayanarak hazırlanan makaleler Bendrinė kalba (çevrimiçi erişim: www.bendrinekalba.lt) ve Lietuvių kalba (www.lietuviukalba.lt) adlı bilimsel dergilerde yayımlanacaktır.
LITERATŪRA
Zinkevičius Zigmas 1992: Lietuvių kalbos istorija 5. Bendrinės kalbos iškilimas. Vilnius: Mokslas, 144–155.
Įteikta 2017 m. lapkričio 3 d.
AURELIJA TAMULIONIENĖ
Lietuvių kalbos institutas
Petro Vileišio g. 5, LT-10308 Vilnius, Lietuva
[email protected]
Apžvalgos / Surveys
321