Koncovky -a a -u genitivu singuláru maskulin neživotných s ohledem na korpusový přístup ve výuce češtiny jako cizího jazyka
Abstract
39
Full text
Koncovky -aa-ugenitivu singuláru maskulin neživotných sohledem na korpusový přístup ve výuce češtiny jako cizího jazyka Adrian Jan Zasina ABSTRACT: Endings -aand -uof genitive singular inanimate masculine nouns: acorpus approach to teaching Czech as aforeign language. The aim of this study is the issue of competitive endings -aand -uof genitive singular inanimate masculine nouns in the context of foreign language teaching. The emphasis is on asystematic description of genitive endings -aand -uusing corpus methods. In the first step, we analysed the part of the learner corpus including texts of Slavic language speaking students. The results have shown that students quite often confuse both of these endings: the correct ending -ufrequently substituted by -a. Next, we examined the competition of genitive endings within the corpus of contemporary Czech using the Morfio tool that identifies relevant word pairs for further analysis. The identified pairs were divided into three categories: a) nouns with the same etymological origin and meaning, b) nouns with the same etymological origin but different meaning, and c) nouns with inconclusive competition of genitive endings. Asystemised list of pairs, along with the proportional and absolute frequency given, is asource of information on the use of appropriate endings, with respect to frequency. The information is crucial for students of Czech as aforeign language in order to choose an appropriate variant with the ending that is closest to the current usage. Based on the analysed material, we proposed three model corpus exercises: two direct exercises for determining amore frequent variant, and one indirect exercise— taking into account semantic differences in the usage of particular endings. KLÍČOVÁ SLOVA / KEYWORDS čeština, genitiv, korpusová lingvistika, korpusový přístup ve výuce, morfologie, výuka cizího jazyka, žákovský korpus corpus linguistics, Czech, DDL, foreign language teaching, Genitive case, learner corpus, morphology 1. ÚVOD Kolísání genitivních koncovek -aa-uvsinguláru maskulin neživotných (dále jen Gsg Mi) je zapříčiněno dosud nezavršeným přechodem zkmenového deklinačního systému na rodový (Vážný, 1964, s.9), přičemž se tento proces netýká pouze češtiny, ale je přítomen ivostatních slovanských jazycích (srov.Bígl, 2013; Janda, 1996, s.121–145; Zasina, 2017; Žigo, 2012).1 Včeském prostředí se této tematice věnuje řada studií (např.Bermel, 2010; Rusínová, 1992; Šimandl, 2003) agramatik (Cvrček et al., 2010; 1 Variantnost koncovek -aa-umůže být rovněž zapříčiněna fakultativní životností (viz Bermel, 2011, s.517), která spočívá vnabývání gramatických vlastností názvů živých bytostí bytostmi neživými (Шарабуряк, 2012, s.362). OPEN ACCESS
40 STUDIE ZAPLIKOVANÉ LINGVISTIKY 2/2019 Karlík, Nekula, & Rusínová, 1995). Poslední dobou vznikají ikorpusové studie zaměřené na morfosyntaktické variace mj.genitivu (Bermel & Knittl, 2012a, 2012b; Bermel, Knittl, & Russell, 2014, 2018). Tyto práce primárně analyzují korpusová data kvalitativním způsobem anásledně prostřednictvím dotazníků zkoumají přijatelnost dubletních tvarů rodilými mluvčími. Experimenty vždy probíhaly na dvou rovinách: dotazovaní jednak sami doplňovali genitivní koncovku do modelových vět, jednak dvěma dubletám vkontextu přiřazovali hodnotu přijatelnosti. Výsledky průzkumu ukázaly souvislost proporcionální frekvence tvarů vjazykovém korpusu spřijatelností hodnocenou rodilými mluvčími. Ipřes značnou pozornost věnovanou genitivním koncovkám -aa-unebylo dosud toto téma zcela vyčerpáno. Vtéto studii se na danou problematiku zaměřujeme nově zhlediska výuky češtiny jako cizího jazyka (ČCJ). Klademe důraz na systematický popis zkoumaného jevu korpusovými metodami scílem nabídnout žákům2 přehled ovariantních koncovkách Gsg Mi3 tvrdého vzoru azároveň identifikovat ty varianty, jež jsou včeském jazyce nejběžnější, atudíž jejich použití cizincem nebude vnímáno vkomunikaci srodilým mluvčím jako rušivé nebo neobvyklé. Na základě získaných výsledků následně uvádíme příkladová korpusová cvičení, která uvádějí žáky do problematiky konkurence koncovek Gsg Mi aumožňují tuto látku procvičovat. Problematice záměny koncovek -aa-uje třeba věnovat zvýšenou pozornost zvl. užáků se slovanským mateřským jazykem, vjejich případě totiž bývá nejčastějším důvodem chyb interference zmateřského jazyka. Existují substantiva, která mají ve slovanských jazycích stejnou koncovku, např.čes. kousek chleba, pol. kawałek chleba, rus. кусок хлеба, srb. комад хлеба, uřady slov se však genitivní koncovky napříč slovanskými jazyky neshodují, srov.čes. slovníku vs. pol. słownika, rus. словаря, srb.речника. Proto je důležité slovanské žáky na tuto skutečnost upozornit. Vnásledující kapitole se zaměříme na popis dat ametodologii výzkumu: nejdříve shrneme chyby vžákovském korpusu anásledně identifikujeme množinu konkurenčních substantiv vkorpusu synchronní češtiny. Ve třetí kapitole získaný materiál roztřídíme do tří kategorií. Ve čtvrté kapitole pak uvádíme přímá anepřímá korpusová cvičení ana závěr shrnujeme nejpodstatnější zjištění. 2. POSTUP AZKOUMANÝ MATERIÁL Analýza žákovského korpusu CzeSL-SGT (Šebesta et al., 2014), jež se soustředila na subkorpus obsahující pouze texty žáků se slovanským mateřským jazykem (dále jen slovanský subkorpus), odhalila problém cizinců sGsg Mi, kdy dochází vrámci tvrdého vzoru ke konkurenci koncovek -aa-u. Kidentifikaci chyb vprvním kroku byla použita automatická chybová anotace4 (Petkevič et al., 2012), která vyhodnocovala 2 Termín žák zde používáme ve významu učící se (ang. learner), srov.Gráf, 2019, s.16–17. 3 Opomíjíme zde jména svýhradní koncovkou -a, jejich výčet prezentuje např.Bermel (2011, s.513). 4 Seznam identifikovaných chyb viz http://utkl.ff.cuni.cz/~rosen/public/SeznamAutoChybR0R1.html OPEN ACCESS
ADRIAN JAN ZASINA 41 problémy se záměnou jednoho znaku za druhý (SingCh). Vdruhém kroku vrámci typu chyb se záměnou znaku byly ručně identifikovány obtíže sGsg Mi. Otázka konkurence koncovek vgenitivu se ukázala nejčastější obtíží u21 různých typů chybných slovních tvarů, činících dohromady 189 tokenů. Tabulka 1 prezentuje podrobnější data spolu sabsolutní frekvencí apočtem žáků, kteří se dané chyby dopustili. Chybný tvar Frekvence Počet studentů 1. mosta 23 21 2. kluba 21 17 3. životu 21 18 4. pátka 13 13 5. obchoda 11 11 6. byta 9 7 7. stola 9 9 8. lesu 9 7 9. světu 9 9 10. hrada 8 8 11. páteka 8 8 12. pateka 8 8 13. Vyšehrada 6 6 14. názora 6 6 15. bara 5 5 16. výleta 4 4 17. hotela 5 5 18. roka 5 4 19. důma 5 4 20. stůla 2 2 21. diploma 2 2 Celkově 189 174 Tabulka 1:Problematické slovní tvary substantiv ve slovanském subkorpusu CzeSL-SGT.5 Ukazuje se, že častěji dochází kvýměně -uza -a– celkově v18 typech chybných tvarů (např.*pátka, *hrada, *názora)—, ve zbývajících 3 případech studenti vyměnili -aza -u(*životu, *lesu, *světu). Pokud prověříme chybné slovní tvary identifikované vkorpusu CzeSL-SGT na základě jazykové úrovně, zjistíme, že nejvíce chyb se podle očekávání dopustili žáci na základních úrovních A1 aA2 (tabulka 2), chybování se ale nevyhnuli ani žáci úrovně B1, B2 aojediněle ani C1. Chybovost genitivních koncovek -aa-uje vůči zvyšující se jazykové úrovni nepřímo úměrná (na rozdíl od případu zakončení -ání a-aní, kde 5 Vpřípadě chybných tvarů světu, roka, stůla, diploma byly frekvence apočet studentů upraveny, poněvadž se vrámci těchto typů vyskytly ijiné chyby (např.vrodě, tvaru plurálu), které byly vyloučeny na základě ruční analýzy. OPEN ACCESS
42 STUDIE ZAPLIKOVANÉ LINGVISTIKY 2/2019 nejčastěji chybují úrovně A1 aB2 (Zasina, 2019), ataké na rozdíl od obtíží spříčestím minulým, kde nejčastěji chybují úrovně A1, A2 aB1 (Zasina, 2018, s.289)). Ztoho vyplývá, že během vyučovacího procesu je tato konkrétní obtíž nivelována srůstem jazykové kompetence žáka. Proto je třeba se vpřípadě žáků na základních úrovních zaměřit na jasný výklad dané látky, zatímco vpřípadě těch pokročilých bude spíše potřeba tento jazykový jev opakovat. Úroveň Frekvence ipm[1] A1 76 311,87 A2 68 272,73 B1 30 215,89 n/a 6 181,99 B2 8 92,3 C1 1 57,16 Tabulka 2:Úroveň studentů podle SERR, unichž se vyskytla chyba vGsg Mi. [1] Vztaženo kjednotlivým úrovním. Vdalším kroku jsme se zaměřili na prozkoumání konkurence genitivních koncovek -aa-uvčeském jazyce na základě dat synchronního korpusu SYN2015 (Křen et al., 2015, 2016). Kzískání relevantních slov jsme použili nástroj Morfio (Cvrček & Vondřička, 2013a; Cvrček & Vondřička, 2013b), který odhaduje rozsah aproduktivitu slovotvorných modelů včeštině.6 Aplikace postihuje slovotvorný vztah7 jednak na základě formální shody/podobnosti vurčitých částech slova (tzv.báze), jednak na základě formálních odlišností včástech specifických (tzv.formanty). Morfio tak dokáže vyhledat dvojice (popř. trojice, čtveřice) shodující se vbázi ališící se pouze specifikovanými formanty. Vnaší analýze posloužil knalezení morfologických variant. VMorfiu jsme hledali dvojice slov se stejnou bází aodlišnými koncovkami -aa-u. Specifikovali jsme rovněž dotaz vlastním tagem NNIS2.*, abychom získali pouze tvary Gsg Mi. Frekvence byla pragmaticky stanovena na minimálně 4 výskyty pro obě varianty; vyhledávali jsme jednotlivé tvary aty následně vyhodnocovali. Tímto jsme získali 123 dvojic, jež bylo nutné ještě manuálně protřídit. Nejčastěji jsme naráželi na problém životného substantiva, které vGsg tvrdého vzoru má výhradní koncovku -a, chybně označkovaného jako maskulina neživotného. Vždy se to týkalo jednoho lexému vpáru (např.Austina ‘jméno’ × Austina ‘město’, favorita ‘oblíbenec’ × favoritu8 ‘značka auta’, Hudsona ‘jméno’ × Hudsona ‘řeka’). Tyto výsledky byly zanalýzy vy6 Nově ivpolštině, srov.Zasina, 2017, aZasina & Škrabal, 2018. 7 Vztah sémantický je těžce uchopitelný ukorpusů, unichž nemáme kdispozici sémantickou anotaci. Proto dále získaný materiál třídíme ručně, abychom homonymní tvary analyzovali jako samostatné instance. 8 Vcelé práci soustavně používáme malé počáteční písmeno pro značky aut, které se vmnoha případech taktéž vyskytují voriginálních textech. Toto rozhodnutí je motivováno faktem, že použitá propria fungují vtextu jako apelativa nahrazující lexém auto. OPEN ACCESS
ADRIAN JAN ZASINA 43 loučeny. Kdalším vyloučeným případům patří lexémy formálně označené jako Gsg, které jsou však funkčně Asg (Gsg jointa : Gsg jointu ‘droga’), ataké lexémy, jež nemají stejný etymologický původ (turka ‘turecká káva’ × Turku ‘toponymum’). 3. ANALÝZA Výsledný materiál jsme setřídili do tří skupin po vzoru obdobného výzkumu na polštině (Zasina, 2017). Ve většině sporných případů, kde bylo určení kategorií nejasné, rozhodoval ozařazení do skupiny kontext. Navíc jsme si jasně stanovili charakteristiku jednotlivých kategorií takto: 1. dvojice substantivních tvarů se stejným etymologickým původem ivýznamem; koncovky -aa-use liší frekvencí a/nebo je jedna preferována vurčitých kolokačních spojeních; 2. dvojice substantivních tvarů se stejným etymologickým původem, avšak rozdílným významem— tj.substantiv polysémních; koncovky -aa-udiferencují význam; 3. dvojice substantivních tvarů, ukterých je konkurence genitivních koncovek zpochybnitelná zdůvodu vysoké chybovosti anotace nebo malého zastoupení jedné zvariant vkorpusu. Následující tabulky 3, 5, 6 prezentují výše popsané tři skupiny substantiv Gsg Mi, suvedeným významem, absolutní frekvencí výskytu vkorpusu aproporcionální frekvencí.9 Jednotlivé lexémy jsou seřazeny podle abecedy. První kategorie obsahuje celkem 102 dvojic, unichž se koncovky -aa-uliší frekvencí. Nicméně absolutní frekvence zcela nevypovídá opřevládající tendenci použití jedné zvariant, proto uvádíme rovněž procentový podíl konkurujících tvarů (neboli proporcionální frekvenci— Bermel et al., 2014), který můžeme dále využít pro určení frekvenčních pásem (viz dále tabulka 4). Ta vypovídají opreferované dubletě, která by zhlediska didaktického měla být cizinci nabízena aupevňována během vyučovacího procesu. Pro češtinu škálu pro klasifikaci variant podrobně popsali Cvrček aKodýtek (2013) avtéto podobě ji zde používáme. Tato klasifikace je také respektována vMSČ1 (Cvrček et al., 2010).10 Skládá se celkově ze sedmi pásem: nikdy nebo skoro nikdy (vrozmezí 0–1 %), zřídka (1–10 %), někdy (10–35 %), stejně (35–65 %), často (65–90 %), zpravidla (90–99 %), vždycky nebo skoro vždycky (99–100 %). Tabulka 4 seskupuje lexémy první kategorie (řazené podle frekvence) na základě frekvenčních pásem: Podíváme-li se na lexémy uvedené vtabulce 4 sohledem na význam, zjistíme, že tu figuruje několik tematických skupin jako např.toponyma, značky aut či geometrické útvary. Na základě frekvenčních pásem lze jednoznačně konstatovat, že 9 Proporcionální frekvence, tj.procentový podíl konkurujících tvarů (viz Bermel et al., 2014). 10 Podrobnější diskusi na téma dalších možných přístupů ve zkoumání frekvenčních pásem vedou Bermel et al. (2014, s.218–221). OPEN ACCESS
44 STUDIE ZAPLIKOVANÉ LINGVISTIKY 2/2019 Číslo Koncovka Význam -a -u Lexém Frekvence Proporcionální frekvence Lexém Frekvence Proporcionální frekvence 1. Androida 13 5,58 % Androidu 220 94,42 % operační systém 2. antona 25 58,14 % antonu 18 41,86 % policejní vozidlo 3. bavoráka 728,00 % bavoráku 18 72,00 % značka auta 4. betléma 38 40,00 % betlému 57 60,00 % jesličky 5.[1] Blaníka 722,58 % Blaníku 24 77,42 % toponymum 6.[2] Braníka 19 70,37 % Braníku 829,63 % toponymum 7. budíka 65,61 % budíku 101 94,39 % zařízení kbuzení 8. Cimburka 10 71,43 % Cimburku 428,57 % toponymum 9. Čeljabinska 422,22 % Čeljabinsku 14 77,78 % toponymum 10. čtvrtka 401 83,72 % čtvrtku 78 16,28 % den vtýdnu 11. debla 533,33 % deblu 10 66,67 % dvouhra 12. dneška 1028 97,35 % dnešku 28 2,65 % dnešní den 13. dvorka 12 8,63 % dvorku 127 91,37 % malý dvůr 14. ferneta 824,24 % fernetu 25 75,76 % alkohol 15. fiata 21 11,67 % fiatu 159 88,33 % značka auta 16. forda 45 15,90 % fordu 238 84,10 % značka auta 17. Frymburka 956,25 % Frymburku 743,75 % toponymum 18. galavečera 59 93,65 % galavečeru 46,35 % slavnostní společenské setkání 19. Gdaňska 30 41,10 % Gdaňsku 43 58,90 % toponymum 20. golfa 10 3,83 % golfu 251 96,17 % značka auta 21. góla 40,91 % gólu 437 99,09 % branka 22. hřiba 516,13 % hřibu 26 83,87 % houba 23. Chabarovska 414,81 % Chabarovsku 23 85,19 % toponymum 24. chevroleta 612,24 % chevroletu 43 87,76 % značka auta 25. chlívka 914,75 % chlívku 52 85,25 % chlév 26. jaguara 616,22 % jaguaru 31 83,78 % značka auta 27. Javorníka 520,83 % Javorníku 19 79,17 % toponymum 28. jazyka 3716 96,62 % jazyku 130 3,38 % mluva; orgán 29. Jeseníka 53,03 % Jeseníku 160 96,97 % toponymum 30. kalicha 54 43,9 % kalichu 69 56,10 % nádoba 31. kláštera 1597 97,68 % klášteru 38 2,32 % církevní budova 32. klína 831 91,22 % klínu 80 8,78 % vnější část těla 33. komína 476 72,12 % komínu 184 27,88 % zařízení odvádějící kouř 34. kopečka 27 35,53 % kopečku 49 64,47 % malý kopec 35. kostelíčka 14 70,00 % kostelíčku 630,00 % malý kostel 36. kostelíka 99 77,34 % kostelíku 29 22,66 % malý kostel OPEN ACCESS
ADRIAN JAN ZASINA 45 Číslo Koncovka Význam -a -u Lexém Frekvence Proporcionální frekvence Lexém Frekvence Proporcionální frekvence 37. kouska 50 16,84 % kousku 247 83,16 % část celku 38. koutka 13 4,14 % koutku 301 95,86 % prostor mezi dvěma stěnami 39. kouta 792 75,29 % koutu 260 24,71 % prostor mezi dvěma stěnami 40. Kurska 19 67,86 % Kursku 932,14 % toponymum 41. Kynšperka 14 60,87 % Kynšperku 939,13 % toponymum 42. lesíka 103 77,44 % lesíku 30 22,56 % malý les 43. lincolna 18 48,65 % lincolnu 19 51,35 % značka auta 44. Lipníka 16 32,65 % Lipníku 33 67,35 % toponymum 45. Mělníka 121 93,08 % Mělníku 96,92 % toponymum 46. mercedesa 11 3,97 % mercedesu 266 96,03 % značka auta 47. Minska 911,39 % Minsku 70 88,61 % toponymum 48. mlýna 448 94,32 % mlýnu 27 5,68 % budova na výrobu mouky 49. mnohoúhelníka 633,33 % mnohoúhelníku 12 66,67 % geometrický útvar 50. národa 2308 96,93 % národu 73 3,07 % společenství lidí 51. Nazareta 23 56,10 % Nazaretu 18 43,90 % toponymum 52. Norimberka 41 35,96 % Norimberku 73 64,04 % toponymum 53. Nymburka 436 91,98 % Nymburku 38 8,02 % toponymum 54. obdélníka 43 25,29 % obdélníku 127 74,71 % geometrický útvar 55. oběda 818 98,79 % obědu 10 1,21 % polední jídlo 56. octa 485 97,98 % octu 10 2,02 % potravinářská kapalina 57. opela 97,89 % opelu 105 92,11 % značka auta 58. Orlíka 526,32 % Orlíku 14 73,68 % toponymum 59. Oseka 30 63,83 % Oseku 17 36,17 % toponymum 60. pětiúhelníka 423,53 % pětiúhelníku 13 76,47 % geometrický útvar 61. peugeota 86,78 % peugeotu 110 93,22 % značka auta 62. popela 583 96,2 % popelu 23 3,80 % zbytek po spálení něčeho 63. potoka 1320 97,78 % potoku 30 2,22 % vodní tok 64. Proseka 857,14 % Proseku 642,86 % toponymum 65. Příbora 17 65,38 % Příboru[3] 934,62 % toponymum 66. renaulta 13 9,22 % renaultu 128 90,78 % značka auta 67. roka 841 1,21 % roku 68745 98,79 % 365 dní OPEN ACCESS
46 STUDIE ZAPLIKOVANÉ LINGVISTIKY 2/2019 Číslo Koncovka Význam -a -u Lexém Frekvence Proporcionální frekvence Lexém Frekvence Proporcionální frekvence 68. Rumburka 17 26,56 % Rumburku 47 73,44 % toponymum 69. rybníčka 16 14,29 % rybníčku 96 85,71 % malý rybník 70. rybníka 928 87,05 % rybníku 138 12,95 % umělá vodní nádrž 71. saaba 14 17,72 % saabu 65 82,28 % značka auta 72. Saturna 56,1 % Saturnu 77 93,90 % planeta 73. saturna 535,71 % saturnu 964,29 % značka auta 74. silvestra 18 78,26 % silvestru 521,74 % poslední den vroce 75. Smolenska 730,43 % Smolensku 16 69,57 % toponymum 76. sna 226 17,44 % snu 1070 82,56 % iluze během spánku 77. Sokola 499 97,08 % Sokolu 15 2,92 % tělovýchovná jednota 78. Suchdola 36 76,60 % Suchdolu 11 23,40 % toponymum 79. sýra 712 88,12 % sýru 96 11,88 % jídlo 80. šajna 13 68,42 % šajnu 631,58 % ponětí, zdání 81. šestiúhelníka 726,92 % šestiúhelníku 19 73,08 % geometrický útvar 82. Šternberka 365 94,32 % Šternberku 22 5,68 % toponymum 83. Štramberka 19 61,29 % Štramberku 12 38,71 % toponymum 84. Šumperka 119 76,28 % Šumperku 37 23,72 % toponymum 85. Tábora 339 99,12 % Táboru 30,88 % toponymum 86. tábora 2366 99,75 % táboru 60,25 % ubytovací zařízení 87. taxíka[4] 51,31 % taxíku 378 98,69 % dopravní prostředek 88. trabanta 23 62,16 % trabantu 14 37,84 % značka auta 89. trojúhelníka 75 23,36 % trojúhelníku 246 76,64 % geometrický útvar 90. týla 163 68,31 % týlu 28 31,69 % část hlavy 91.[5] Újezda 33 45,21 % Újezdu 40 54,79 % toponymum 92. Úštěka 538,46 % Úštěku 861,54 % toponymum 93. velína 12 35,29 % velínu 22 64,71 % ovládací stanoviště 94. Vimperka 23 69,70 % Vimperku 10 30,30 % toponymum 95. vnějška 42,76 % vnějšku 141 97,24 % vnější prostor 96. všehomíra 71 92,21 % všehomíru 67,79 % vesmír 97. walkmana 31 68,89 % walkmanu 14 31,11 % přehrávač kazet OPEN ACCESS
ADRIAN JAN ZASINA 47 geometrické útvary mají zpravidla koncovku -u(srov.mnohoúhelníku, šestiúhelníku, obdélníku, pětiúhelníku, trojúhelníku). Rovněž značky aut mají větší tendenci vyskytovat se skoncovkou -u, nicméně existují případy, kdy obě koncovky mají víceméně stejné postavení (trabant, lincoln, saturn).11 Utoponym však není situace jednoznačná: vyskytují se jak lexémy sgenitivní koncovkou -a(Tábor, Šternberk, Mělník, Nymburk), tak s-u(Jeseník), kolísání mezi jednou adruhou koncovkou je však vysoké. MSČ1 (Cvrček et al., 2010, s.165) udává, že: [k]oncovku -amají vGsg. vždy nebo zpravidla názvy měst aobcí zakončené na -ov (Prostějov, Mnichov atd.) ařada dalších: Zlín, Londýn, Temelín, Berlín, Řím atd., je iEgypt— Egypta. Unázvů českých amoravských míst záleží ina místním úzu ajeho rozšíření: jen do Zlína, většinou zMělníka, zřídka izMělníku, jen do Českého Dubu, ale místně do Duba. Internetová jazyková příručka12 popisuje situaci obdobně: uvlastních jmen místních zakončených na -ov nebo -ín se používá koncovka -a(např.Benešova, Lvova, Kojetína, Londýna). Navíc komentuje, že vpřípadě „nevymezitelného množství“ substantiv dochází kuplatnění obou koncovek (např.Fulneku/Fulneka, Mělníka/Mělníku, Lipníka/ Lipníku, Příbora/Příboru, Zábřehu/Zábřeha). Dále tvrdí, že uplatnění obou koncovek je možné uněkterých jmen na -ík (např.ugeometrických termínů: -úhelník, -běžník, -délník; ataké dalších jmen: bochník, budík, holubník). Korpusová data však ukazují, že 11 Může to také souviset sfakultativní životností, která je ustandardních názvů značek aut (např.peugeot, mercedes) řídkým jevem, častá je naopak usubstandardních tvarů (např.bavorák; viz Bermel, 2011, s.520). 12 http://prirucka.ujc.cas.cz/?id=221&dotaz=koncovka#nadpis5 (cit.5.3.2019) Číslo Koncovka Význam -a -u Lexém Frekvence Proporcionální frekvence Lexém Frekvence Proporcionální frekvence 98. Zábřeha 11 15,28 % Zábřehu 61 84,72 % toponymum 99. záchoda 53 14,10 % záchodu 323 85,90 % toaleta 100. zákona 10607 99,48 % zákonu 55 0,52 % ustálené pravidlo 101. Zbiroha 16 64,00 % Zbirohu 936,00 % toponymum 102. zítřka 433 98,19 % zítřku 81,81 % zítřejší den Tabulka 3:Dvojice substantivních tvarů mající stejný etymologický původ avýznam (kategorie 1). [1] Frekvence je zde ručně ověřena, upravena avýznamově desambiguována. [2] Frekvence je zde ručně ověřena, upravena avýznamově desambiguována. [3] Frekvence je zde ručně ověřena aupravena. [4] Frekvence je zde ručně ověřena aupravena. [5] Frekvence je zde ručně ověřena aupravena. OPEN ACCESS
54 STUDIE ZAPLIKOVANÉ LINGVISTIKY 2/2019 Substantivum Frekvence Procento Frekvenční pásmo -a -u -a -u -a -u zákon jazyk sýr rybník trabant kopeček trojúhelník kousek taxík gól Frekvenční pásma Procento 0–1 1–10 10–35 35–65 65–90 90–99 99–100 Pásmo nikdy zřídka Někdy stejně často zpravidla vždycky Poslední cvičení nevyžaduje přímou práci spočítačem aje založeno na informacích uvedených vtabulce 5 se substantivy, unichž rozdílná koncovka genitivu diferencuje význam. Vcvičení 3 má student za úkol doplnit do vět chybějící substantivum se správnou genitivní koncovkou sohledem na význam věty. Věty obsažené vzadání pocházejí zkorpusu současné psané češtiny SYN2015. Díky tomuto přístupu má student možnost seznámit se snejčastějšími neživotnými maskuliny tohoto typu vjejich přirozeném kontextu. Je však třeba žáky upozornit, že se vbodě c) setkají sgrafickou podobou zprostředka, která se běžně vyskytuje ijako adverbiální spřežka zprostředka. Jelikož se celkově jedná ořidší jev, je toto cvičení doporučováno pro studenty minimálně na úrovni B2. Cvičení 3: Doplňte do níže uvedených vět správné tvary genitivu singuláru následujících lexémů: a) betlém/Betlém — Na samotné Vánoce by do třicetitisícového mělo podle starosty Batársy dorazit až pětadvacet tisíc lidí. — Ponocný apekař budou součástí nového dřevěného , který se stane vánoční ozdobou poutního kostela. b) klín — Knihu si položil do arychle naplnil sklenici. — Podobné zvuky už slyšel— po bitvě, když ranění muži zatínali zuby do stočeného hadru nebo dřevěného , zatímco jim rovnali kosti. OPEN ACCESS
ADRIAN JAN ZASINA 55 c) prostředek — Na první pohled šílený nápad podivného dopravního sdílí celá řada konstruktérů po celém světě. — Musela jsem dostat auto z ulice; stála jsem vneosvětlené zatáčce abyla tma. Tato cvičení jsou příkladem aplikace korpusového přístupu ve vyučovacích hodinách češtiny. První dvě cvičení na sebe navazují asnaží se postupně poukazovat na problémy skoncovkami Gsg Mi, třetí cvičení je příkladem aktivity pro pokročilejší žáky. Vhodnost cvičení pro danou skupinu žáků by měl vždy určit učitel. Zde úroveň doporučujeme na základě vlastní zkušenosti sprací se Slovany. Tato zadání jsou rovněž přiměřená jako opakování aupevňování dříve probrané problematiky Gsg Mi. 5. ZÁVĚR Problematice konkurenčních koncovek Gsg Mi bylo již věnováno mnoho pozornosti, dosud však nebyl brán zřetel na popis tohoto jevu ve výuce ČCJ pomocí korpusových metod. Jako základ ktéto studii jsme použili analýzu žákovského korpusu, vněmž byly problémy cizinců sGsg Mi identifikovány. Zjistili jsme, že chybovost ugenitivních koncovek -aa-use sjazykovou úrovní snižuje. Obecně také dochází knahrazování správné koncovky -ukoncovkou -a. Vdalší fázi byla na základě dat ze synchronního korpusu češtiny variantní substantiva roztříděna do tří kategorií: dvojice substantivních tvarů mající stejný etymologický původ ivýznam, dvojice substantivních tvarů mající stejný etymologický původ, avšak rozdílný význam advojice substantivních tvarů sneprůkaznou konkurencí genitivních koncovek (danou nedostatkem dat). Toto rozdělení systematicky třídí substantiva, unichž si buď koncovky ze synchronního hlediska vzájemně konkurují, nebo se ustálily anesou konkrétní význam. Takové rozdělení suvedením proporcionální aabsolutní frekvence je zdrojem informací, která koncovka je frekventovaněji volena rodilými mluvčími. Nadto je zdrojem pro sestavení vhodných korpusových cvičení, jejichž tři příklady zde prezentujeme. Dvě přímá cvičení se zabývají konkurenčními koncovkami ažák díky nim identifikuje častější variantu, zatímco nepřímé cvičení upozorňuje žáka na možné sémantické rozdíly při použití různých koncovek. Tato studie přistupuje kdatům jak kvantitativně, tak ikvalitativně aje tedy komplementární kdřívějším korpusovým studiím (srov.Bermel & Knittl, 2012a, 2012b), zvláště pak voblasti jazykové výuky. Zde prezentovaný korpusový přístup se skládá ze tří částí: identifikace problematického jevu pomocí žákovského korpusu, klasifikace tohoto jevu pomocí korpusu synchronního akonečně generalizace výsledků. Tento postup systemizuje práci skorpusem pro účely výuky azároveň může být pokynem ainspirací pro pedagogy, jak skorpusem pracovat. Vrámci substantiv se stejným etymologickým původem avýznamem korpusová data rovněž potvrdila určité sémantické preference dané koncovky. Substantiva zakončená na -ýn a-ín mají tendenci vyskytovat se skoncovkou -a, pokud jde otoponyma, vpřípadě zakončení -on utoponym naopak převažuje koncovka -u. SubOPEN ACCESS
56 STUDIE ZAPLIKOVANÉ LINGVISTIKY 2/2019 stantiva se zakončením na -in, -en, -ol a-id mají tendenci vyskytovat se skoncovkou -uunázvů chemických látek. Dále je koncovka -upreferována unázvů geometrických útvarů aznaček aut. Hlavním cílem bylo prozkoumat variantní tvary Gsg Mi anabídnout jednotný korpusový přístup ve výuce této problematické látky. Vtéto oblasti je nicméně zapotřebí podrobnějšího výzkumu sémantických rozdílů konkurenčních genitivních koncovek, který by měl být proveden vsamostatné studii. Nové poznatky týkající se významových rozdílů by dozajista přispěly ike zkvalitnění výuky ČCJ. LITERATURA Bermel, N. (2010). Variace afrekvence variant na příkladu tvrdých neživotných maskulin. In S.Čmejrková, J.Hoffmannová, & E.Havlová (Eds.), Užívání aprožívání jazyka (s.135–140), Praha: Karolinum. Bermel, N. (2011). Variantnost ve flexi tvrdých neživotných maskulin. In F.Štícha (Ed.), Kapitoly zčeské gramatiky (s.509–522). Praha: Academia. Bermel, N., & Knittl, L. (2012a). Corpus frequency and acceptability judgments: Astudy of morphosyntactic variants in Czech. Corpus Linguistics and Liguistic Theory, 8, 241−275. Bermel, N., & Knittl, L. (2012b). Morphosyntactic variation and syntactic constructions in Czech nominal declension: corpus frequency and native-speaker judgments. Russian linguistics, 36(1), 91−119. Bermel, N., Knittl, L., & Russell, J. (2014). Absolutní aproporcionální frekvence vČNK ve světle výzkumu morfosyntaktické variace včeštině. Naše řeč, 97(4–5), 216–227. Bermel, N., Knittl, L., & Russell, J. (2018). Frequency data from corpora partially explain native-speaker ratings and choices in overabundant paradigm cells. Corpus Linguistics and Linguistic Theory, 14(2), 197–231. Bígl, R. (2013). Vývoj lužickosrbského skloňování astupňování. Praha: Karolinum. Cvrček, V., & Kodýtek, V. (2013). Ke klasifikaci morfologických variant. Slovo aslovesnost, 74(2), 139–146. Cvrček, V., Kodýtek, V., Kopřivová, M., Kováříková, D., Sgall., P., Šulc, M., … Waclawičová, M. (2010). Mluvnice současné češtiny 1. Jak se píše ajak se mluví. Praha: Karolinum. Cvrček, V., & Vondřička, P. (2011a). SyD— Korpusový průzkum variant (Version 2.2) [Corpus tool]. Dostupné zhttp://syd.korpus.cz Cvrček, V., & Vondřička, P. (2011b). Výzkum variability vkorpusech češtiny. In F.Čermák (Ed.), Korpusová lingvistika Praha 2011. 2.Výzkum avýstavba korpusů (s.184–195). Praha: Nakladatelství Lidové noviny. Cvrček, V., & Vondřička, P. (2013a). Morfio [Corpus tool]. Dostupné zhttps://morfio. korpus.cz/ Cvrček, V., & Vondřička, P. (2013b). Nástroj pro slovotvornou analýzu jazykového korpusu. Gramatika akorpus 2012. Hradec Králové: Gaudeamus. Dostupné zhttp://www.ujc. cas.cz/miranda2/export/sitesavcr/ujc/vedavyzkum/vyzkum/gramatika-a-korpus/ proceedings-2012/konferencni-prispevky/ CvrcekVaclav_VondrickaPavel.pdf Divjak, D. (2018). How machines that learn language can help language instructors teach language: acase study on the genitive singular of masculine inanimate nouns in Polish. Paper presented at the conference Nowości w glottodydaktyce polonistycznej, Warszawa, Poland. Gráf, T. (2019). Teorie osvojování jazyka akorpusový výzkum. In K.Šormová & K.Šebesta (Eds.), Korpusy vjazykovém vyučování (s.16−33). Praha: Filozofická Fakulta Univerzity Karlovy. Janda, L.A. (1996). Back From The Brink. München: LINCOM Europa. OPEN ACCESS
ADRIAN JAN ZASINA 57 Karlík, P., Nekula, M., & Rusínová, Z. (Eds.). (1995). Příruční mluvnice češtiny. Praha: Nakladatelství Lidové noviny. Křen, M., Cvrček, V., Čapka, T., Čermáková, A., Hnátková, M., Chlumská, L., … Zasina, A. (2015). SYN2015: reprezentativní korpus psané češtiny. Praha: Ústav Českého národního korpusu FF UK. Dostupné zhttp://www. korpus.cz Křen, M., Cvrček, V., Čapka, T., Čermáková, A., Hnátková, M., Chlumská, L., … Zasina, A.J. (2016). SYN2015: Representative Corpus of Contemporary Written Czech. In N.Calzolari et al. (Eds.), Proceedings of the Tenth International Conference on Language Resources and Evaluation (LREC‘16) (s.2522–2528). Portorož: ELRA. Leech, G. (1997). Teaching and language corpora: Aconvergence. In A.Wichmann, S.Fligelstone, T.McEnery & G.Knowles (Eds.), Teaching and Language Corpora (s.11–23). Harlow: Addison Wesley Longman. Machálek, T., & Křen, M. (2013). Query interface for diverse corpus types. In K.Gajdošová & A.Žáková (Eds.), Natural Language Processing, Corpus Linguistics, E-learning (s.166–173). Lüdenscheid: RAM Verlag. Petkevič, V., Rosen, A., Štindlová, B., Jelínek, T., Hnátková, M., & Jäger, P. (2012). Anotace chybových textů včeském žákovském korpusu. In K.Šebesta & S.Škodová (Eds.), Čeština— cílový jazyk akorpusy (s.61–87). Liberec: Technická univerzita vLiberci. Rusínová, Z. (1992). Některé aspekty distribuce alomorfů: (genitiv alokál sg. maskulin). In V.Podborský (Ed.), Sborník prací Filozofické fakulty brněnské univerzity. A, Řada jazykovědná XLI (s.23–31). Brno: Masaryková univerzita vBrně. Šebesta, K., Bedřichová, Z., Šormová, K., Štindlová, B., Hrdlička, M., Hrdličková, M., … Rosen, A. (2014). CzeSL-SGT: korpus češtiny nerodilých mluvčích sautomaticky provedenou anotací, verze 2 z28.7.2014. Praha: Ústav Českého národního korpusu FF UK. Dostupné zhttp://www.korpus.cz Šimandl, J. (2003). Od čvrtku do pátka. Naše řeč, 86(3), 161–164. Vážný, V. (1964). Historická mluvnice česká. 2. Tvarosloví. Praha: Státní pedagogické nakladatelství. Zasina, A.J. (2017). Konkurence koncovek -aa-uvgenitivu singuláru neživotných maskulin vpolštině. In M.Stluka & M.Škrabal (Eds.), Liſka aczban— Sborník příspěvků k70.narozeninám prof. Karla Kučery (s.90−98). Praha: Nakladatelství Lidové noviny. Zasina, A.J. (2018). Oproblémech nerodilých mluvčích skvantitou na základě analýzy korpusových dat. In S.Škodová, & M.Hrdlička (Eds.), Čeština jako cizí jazyk vprůsečíku pohledů (s.281–298). Praha: Univerzita Karlova, Filozofická fakulta Zasina, A.J. (2019). Dlouhá, nebo krátká? Verbální substantiva na -ání a-aní ve výuce cizinců. Manuscript in preparation. Zasina, A.J., & Škrabal, M. (2018). Morfio.pl— the possibilities for the application of Czech corpus tools to other languages. Paper presented at the SlaviCorp 2018. Prague. Dostupné z: https:// slavicorp.ff.cuni.cz/wp-content/uploads/ sites/144/2018/10/Zasina_Morfio_pl.pptx Žigo, P. (2012). Variantnosť vretrospektíve. In K.Buzássyová, B.Chocholová, & N.Janočková (Eds.), Slovo vSlovníku. Aspekty lexikálnej sémantiky— gramtika— štylistika (pragmatika). Na počesť Alexandry Jarošovej (s.27−40). Bratislava: VEDA. Шарабуряк, А.А. (2012). Rozszerzenie klasy gramatycznej rzeczowników żywotnych we współczesnym języku polskim. Наукові записки. Серія: Філологічна, 26, 362–364. Adrian Jan Zasina | Ústav Českého národního korpusu FF UK <[email protected]> OPEN ACCESS