scieee AI-readable full text Open interactive document viewer

Korpusová kritická analýza diskurzu: povaha, možnosti a limity (na příkladu analýzy jazykových ideologií v českém parlamentním diskurzu)

Dufek, Ondřej

Abstract

7

Full text

Korpusová kritická analýza diskurzu: povaha, možnosti alimity (na příkladu analýzy jazykových ideologií včeském parlamentním diskurzu)1 Ondřej Dufek ABSTRACT: Corpus-assisted Critical Discourse Analysis: nature, possibilities and limits (Exemplified on the analysis of language ideologies in the Czech parliamentary discourse). The paper provides athorough review of the corpus-linguistic approach to critical discourse analysis. It briefly presents the core of critical discourse analysis (CDA) and examines the possibilities of applying corpus tools to it. In the next step, critical commentaries on CDA are summarized and at the same time, possible corpus-linguistic solutions are offered. The final part offers an illustrative application of corpus-assisted CDA focusing on language ideologies in the Czech parliamentary discourse. KLÍČOVÁ SLOVA / KEYWORDS český parlamentní diskurz, jazykové ideologie, jazykový zákon, korpusová kritická analýza diskurzu, kritická analýza diskurzu, korpusová lingvistika, kritika kritické analýzy diskurzu corpus linguistics, corpus-assisted critical discourse analysis, critical discourse analysis, criticism of critical discourse analysis, Czech parliamentary discourse, language bill, language ideologies 1. ÚVOD Studium užívání jazyka (adalších sémiotických kódů) vsociální realitě vkonfrontaci sideologiemi amocenskými vztahy má ve světové vědě tradici dlouhou již několik desetiletí— přinejmenším pod označením kritická analýza diskurzu (critical discourse analysis, CDA). Tento výzkumný proud obdržel za dobu své existence řadu kritických komentářů, které zčásti posílily jeho rozvoj. Ten je do značné míry (ovšem rozhodně ne výlučně) spjat svyužíváním korpusové lingvistiky (corpus linguistics, CL), která umožňuje solidnější datové založení avyužití dříve nedostupných způsobů poznávání textů. Tento článek chce představit korpusovou kritickou analýzu diskurzu, ukázat její výhody arelevanci, diskutovat její limity ailustrovat její využití na českém materiálu. Domnívám se, že takový přehled může být užitečný, neboť včeském prostředí zatím korpusová CDA byla zohledněna jen sporadicky. Ozapojení korpusových nástrojů do analýzy diskurzu se nedávno zmínily Jindřiška Svobodová, Šárka Hamrusová aBarbora Hinková (2018), ovšem na ploše pouhé jedné ačtvrt stránky avpodobě, která je do značné míry redukuje na pouhé dosažení větší spolehlivosti azpracování většího 1 Článek vychází zmé disertační práce (Dufek, 2018)— je přepracovanou verzí části její čtvrté kapitoly rozšířenou ovybrané pasáže zkapitoly šesté. Děkuji oběma recenzentům tohoto článku za kritické čtení vedoucí ke skutečně podnětným připomínkám. OPEN ACCESS 8 STUDIE ZAPLIKOVANÉ LINGVISTIKY 2/2019 množství dat. To je— jak ukážu vtomto článku— jen jedna zvýhod korpusové CDA. Solidnější, byť též stručné seznámení nabízí Eva Lehečková (2016b). Jednotlivé případové studie podnikli Tess Slavíčková (2015), Irene Elmerot (2017) aMichal Hořejší (2019). Tím se, pokud vím, literatura vztažená kčeskému prostředí vpodstatě vyčerpává. Sluší se nicméně zmínit, že včeském prostředí / na českém materiálu vzniklo už několik studií, které se sice nehlásí ke kritickým východiskům, ale svou korpusově- -diskurzní povahou se dostávají do nemalé blízkosti toho, co chce představit tento článek. Jsou to např.Zasina (2018) analyzující kolokačně českou mediální reprezentaci političek nebo Fidlerová aCvrček (2018) rozebírající, včem spočívá alternativnost jazyka zpravodajského webu Sputnik Česká republika. Tyto studie sCACDA sdílejí část nástrojů iteoretických konceptů, opírají se zčásti iokritickoanalytickou literaturu, nedeklarují však svou ideologickou/politickou pozici ve vztahu krozebíraným jevům aneformulují takto pozičně ukotvené ahodnotící interpretace. Vtomto textu nejprve velmi stručně představím podstatu CDA apak rozeberu možnosti jejího obohacení okorpusové prvky. Následně shrnu nejdůležitější kritické výtky vůči CDA azhodnotím, nakolik je může pomoci vyřešit právě korpusový přístup. Poslední částí textu je ilustrativní analýza části parlamentního diskurzu onávrzích jazykových zákonů, která předestře praktické možnosti využití korpusových nástrojů vkritické analýze jazykových ideologií. 2. ZÁKLADY KRITICKÉ ANALÝZY DISKURZU Definovat CDA není snadný úkol. Pro účely toho článku se omezím na několik stručných poznámek věnovaných samé podstatě CDA, jejím cílům, vnitřnímu členění na samostatné směry apovaze její kritičnosti. 2.1 CO JE CDA CDA2 je obecně vzato přístup ke studiu jazyka aspolečnosti, sociopoliticky angažovaný vědecký směr; není to však teorie ani metoda (ke zdrojům, znichž CDA čerpá, podrobněji vnásledujícím oddílu). Označuje také síť lidí spodobnými hodnotovými východisky, cíli azpůsoby jejich dosahování, ale není to jednotná škola; termín CDA se vžil jako zastřešující označení do značné míry samostatných přístupů. Za dobu své existence (resp.existence onoho označení, lze říct iznačky) už CDA získala akademickou relevanci, má vlastní časopisy,3 konference.4 2 Nověji se začíná prosazovat ioznačení critical discourse studies (CDS), které bylo určitou dobu synonymní sCDA, ale nyní podle Johna Flowerdewa aJohna E.Richardsona (2018) odráží stále výraznější posun od aplikovaných analýz kfilozofickému, teoretickému, metodologickému ipraktickému obohacování tohoto směru (ostatně si všímají změny názvu 3.vydání knihy Ruth Wodakové aMichaela Meyera zMethods of Critical Discourse Analysis na Methods of Critical Discourse Studies (2015)). 3 Discourse & Society, Journal of Language and Politics, Critical Discourse Studies aj. 4 Např.Critical Approaches to Discourse Analysis Across Disciplines. OPEN ACCESS ONDřEJ DUfEK 9 Stručně řečeno, CDA je analýza diskurzu využívající vědecké metody, ovšem nikoli se snahou onedosažitelnou objektivnost, nýbrž spřiznanými politickými cíli upozornit na nerovnost apřispět kjejímu odstranění. 2.2 CÍLE ATÉMATA CDA se snaží rozkrývat azviditelňovat mocenské vztahy ve společnosti ajejich jazykovou/diskurzní povahu; soustředí se na moc vdiskurzu amoc nad diskurzem. Ztoho důvodu coby materiál analýzy používá autentické promluvy, reálné texty. Vtomto smyslu se řadí do souboru směrů reagujících na redukcionistický Chomského generativismus. Vznikla primárně na lingvistickém základě, snaží se však zohledňovat ijiné sémiotické kódy, především však není popisem jazyka, nýbrž popisem jeho užívání. Využívá lingvistický deskriptivní aparát, zajímá ji především nadvětná, textová adiskurzní rovina; lexikon či gramatiku vždy vykládá ve vztahu krovinám vyšším ausouvztažňuje srelevantním kontextem (významy kontextu viz níže). Lingvistické analýzy zpravidla poukazují na ideologie ana nich postavenou nerovnost, nespravedlnost, uplatňování a/nebo zneužívání mocenského postavení ve společnosti pomocí rozkrývání jejich projevů vdiskurzu.5 Widdowson (1998, s.136) ji označuje za uvědomělou lingvistiku („linguistics with aconscience“). CDA není studium humanitní, nezkoumá člověka ajeho nástroje dorozumívání, nezjišťuje primárně, jak jazyk funguje vmozku či mysli6— je studiem sociálním, protože ji zajímá, jak jazyk funguje coby prostředek určitých sociálních aktů, jak jazykové prostředky manifestují interakci vrámci sociálních vztahů. Jinak řečeno, propojuje „lingvistický výzkum jazykových struktur aspolečenskou roli jazykové komunikace jako prostředku pro utváření, předávání auchovávání různých sociálních praktik (social practices)“ (Lehečková, 2016a, s.79). Rozpětí vztahu CDA kjazyku lze postihnout mj.dvojicí výrazů language in use alanguage in action— jde oto, co kdo (s) jazykem činí. 2.3 SMĚRY Když uvádím, že CDA není koherentní školou, patří se vysvětlit, zčeho různého se tedy skládá. Označení critical discourse analysis se (podle Breezeové (2011, s.495)) obje5 Někteří badatelé jsou spatřují stopy mocenských vztahů ipřímo vsystému jazyka, viz např.Caldas-Coulthardová aCoulthard (1996, s. xi), podle nichž CDA zjišťuje, „how power and discriminatory value are inscribed in and mediated through the linguistic system“. Většinově však dnes panuje konsensus na tom, že jádrem zájmu CDA je užívání jazyka. Mocenské potenciály přímo vjazyce bychom našli např.vstarší kritické lingvistice (např.Fowler et al., 1979; Fowler, 1996; či Kress & Hodge, 1979), ale také např.vlingvistice genderové (včeském prostředí viz např.Valdrová, 1997; Čmejrková, 1995; 2002). 6 Srov.však zaměření na kognitivní rozměr reprezentace diskurzu např.uTeuna van Dijka (např.2000, s.11n.), Paula Chiltona (2011, 2014) nebo Chrise Harta (2015, 2019) aj.; viz též odd. 2.3. OPEN ACCESS 10 STUDIE ZAPLIKOVANÉ LINGVISTIKY 2/2019 vilo poprvé včlánku Normana Fairclougha (1985, s.739), ve známost vešlo hlavně svydáním jeho knihy Critical discourse analysis (1995). Zčásti fundující funkci mělo (jak uvádí Wodaková aMeyer (2009, s.3)) sympozium vAmsterdamu vr.1990; ve stejném roce vznikl ičasopis Discourse & Society. Hlavní směry jsou dialekticko-relační přístup Normana Fairclougha, socio-kognitivní přístup Teuna A. van Dijka adiskurzně- -historický přístup Ruth Wodakové, multimodální studia vrámci CDA rozvíjí Theo van Leeuwen. Někdy se uvádějí ještě francouzská škola (Michel Pêcheux), duisburská škola (Siegfried Jäger) aj. (viz Wodak, 2011). Vposlední době se rozvíjejí novější zajímavé varianty: kognitivní CDA (viz např.Hart, 2015, 2019; Cap, 2018), kombinace CDA ateorie metafor (Musolff, 2016; Li, 2016; Charteris-Black, 2004, 2014) aj. 2.4 VČEM SPOČÍVÁ KRITIČNOST? Přestože je kritičnost obsažena vsamém názvu CDA, její podstata není nikterak samozřejmá ani nesporná. Ruth Breezeová (2011, s.499–500) poukazuje na to, že může mít přinejmenším dva významy: Může jít oodkaz ke kritické teorii frankfurtské školy (ovšem vrámci toho ještě není zřejmé, zda se akcentuje kritický postoj ke statu quo, anebo k„authoritarian positivism of orthodox Marxism“ (ibid.)), stejně tak ale dává smysl kritický ve významu nepřijímající vše bez okolků, ověřující apromýšlející. Norman Fairclough (1992, s.9) při charakteristice CDA napsal, že „‚Critical‘ implies showing connections and causes which are hidden“. Příbuzná, byť ne tak vyhraněná, je pozice Ruth Wodakové aMichaela Meyera (2009, s.2), kteří vysvětlují, že „[a]ny social phenomenon lends itself to critical investigation, to be challenged and not taken for granted“. Podle jejich slov je frankfurtská kritická teorie důležitý inspirační zdroj. Kromě toho (ibid., s.7) sodkazem na Thea van Leeuwen (2005, s.293) vysvětlují, že „[n] aming oneself ‚critical‘ only implies superior ethical standards: an intention to make their position, research interests and values explicit and their criteria as transparent as possible, without feeling the need to apologize for the critical stance of their work“. Ostatně soudím, že tyto dvě strany kritického postoje nejsou vrozporu. 3. KORPUSOVÁ KRITICKÁ ANALÝZA DISKURZU Na základě kritiky CDA se množství badatelů začalo ohlížet po korpusové lingvistice (corpus lingustics; CL), jelikož se zdá(lo), že některé výtky může alespoň částečně řešit. Zodpovídání otázky, proč takové zdání budí (anakolik to je/není zdání iluzorní), bude předmětem následující kapitoly. Nejprve však učiním několik poznámek kvariaci označování korpusové CDA (oddíl 3.1) astručně vysvětlím podstatu kombinace CL aCDA (oddíl 3.2). 3.1 CORPUS-ASSISTED CRITICAL DISCOURSE ANALYSIS Stejně jako CDA ani corpus-assisted critical discourse analysis (CACDA) není homogenní skupina či škola. Ostatně na rozdíl od CDA nemá ani označení, na němž by se OPEN ACCESS ONDřEJ DUfEK 11 všichni shodli. Vliteratuře se, často bez jakýchkoli vysledovatelných pravidelností, objevují kombinace naznačené ve schématu 1— aani to nevyčerpává všechny možnosti, např.corpus approaches to discourse studies nebo discourse-oriented corpus studies.7 Ostatně název tohoto oddílu je prostě jen dosud neobsazená kombinace, která se zdá být dostatečně výstižná. Výraz assisted je navíc výhodný tím, že nevstupuje do dichotomie corpus-based vs. corpus-driven (viz níže). corpus assisted (critical) discourse analysis computer based studies driven approach informed aided Schéma 1:Kombinatorika složek označení přístupů kombinujících CL aCDA Jediná škola, která sama sebe označuje ustáleným názvem, je corpus-assisted discourse studies (CADS), spojovaná především spracemi Alana Partingtona ajeho spolupracovníků (např.Partington, Duguid & Taylor, 2013). Proti tomu lze postavit podobný, leč vněkterých základních aspektech (přinejmenším deklarativně) odlišný přístup, který můžeme označit jako corpus-based critical discourse analysis (CBCDA) reprezentovaný lancasterskou školou, zejména Paulem Bakerem, Costasem Gabrielatosem aj. (např.Baker, Gabrielatos & McEnery, 2013). Alternaci studies/analysis zde můžeme považovat za málo významotvornou (srov.však poznámku 2); vdruhém přístupu je klíčový výraz critical; nejproblematičtější je pak rozlišení corpus-assisted vs. -based. První podobu si pro sebe rezervovala CADS, naopak lancasterská škola se proti pouhé asistenci korpusové lingvistiky vymezuje aprosazuje rovnoprávnost CL aCDA (Baker et al., 2008, s.274).8 Kromě výše nastíněných pojmenovacích odlišností zmíním ještě variantu corpus- -informed, kterou nalezneme uKierana O’Hallorana (2007) nebo computer-assisted vyskytující se zejména ve starších pracích Michaela Stubbse (1994, 1996). Už vdevadesátých letech vznikla řada průkopnických studií, viz např.Louw (1993), Caldas-Coulthard (1993; 1995), Hardt-Mautner (1995), Krishnamurthy (1996), Stubbs (1996), Flowerdew (1997). Před necelými patnácti lety se počet článků kombinujících CL aanalýzu diskurzu začal významně zvětšovat aod té doby téměř neustále roste— viz graf 1. 7 Dvě varianty názvu oborové bibliografie sestavované Costasem Gabrielatosem, donedávna dostupné na <http://www.gabrielatos.com/CLDA-Biblio.htm>. 8 Distinkce assisted vs. based ovšem není tak jednoznačná, jak bývá deklarováno. Paul Baker má vsamotném názvu některých svých studií (viz např.Baker, 2014, 2015) označení corpus-assisted, naproti tomu Alan Partington (2006) hned vabstraktu svého článku říká, že rozpracoval „corpus-based methodology“. OPEN ACCESS 12 STUDIE ZAPLIKOVANÉ LINGVISTIKY 2/2019 Graf 1:Vývoj počtu studií kombinujících korpusovou lingvistiku a(kritickou) analýzu diskurzu vdatabázi Scopus; dotaz: TITLE-ABS-KEY(corpus OR corpora OR „corpus linguistics“) AND TITLE- -ABS-KEY(CDA OR „critical discourse analysis“ OR „discourse analysis“ OR „discourse studies“); výběr omezen na články, konferenční příspěvky akapitoly vmonografiích; manuálně nečištěno. 3.2 PODSTATA KORPUSOVÉ KRITICKÉ ANALÝZY DISKURZU Vtomto oddíle představím samotnou povahu korpusové kritické analýzy diskurzu, především to, jaké korpusové nástroje ajakými způsoby pro kritické rozbory využívá. Jak trefně poznamenává Debbie Orpinová (2005, s.38), „[t]he major problem in combining aCDA approach with corpus methodology is deciding where to start“. Jedním zvýznamných smyslů využívání CL je možnost zvládnout analyticky zpracovat větší množství dat, tj.takový jejich objem, který by člověk jednoduše nedokázal vrozumném čase / při rozumné námaze přečíst, natož pak intelektuálně uchopit ahledat výrazné prvky, pravidelnosti apod. To však rozhodně není jediná motivace— korpusový pohled na diskurz nabízí zároveň příležitost dostat se kběžným čtením nepostihnutelným pravidelnostem napříč texty. Korpusový přístup (nejen vCDA), ostatně jako empirický výzkum jazyka obecně, nutně staví na práci sjednotkami vedoucí kjistému abstrahování od jejich zasazení vjazykovém, situačním asociálním kontextu. Tato ztráta informací je však vyvážena ziskem na jiné straně. Michal Hořejší (2016, s.5) ktomu poznamenává, že „[k]aždá korpusová analýza je zprincipu postavená na mechanismu nabývání informací zvertikály protínající velký počet jednotlivých textů (či korpusů) za cenu ztráty přirozené horizontály realizované linearitou textu adialogickým rámcem diskurzu (intertextualitou)“. Corpus-assisted critical discourse analysis (CACDA) minimalizuje míru ztráty horizontály obvykle několika způsoby: opakovaným pohybem od počítačově generovaných průřezů korpusem kjednotlivým konkordancím až kširšímu kotextu originálních textů (azpět) azapojováním znalostí osituačním asociálním kontextu na různých stupních analýzy. Přidaná hodnota korpusového přístupu je přitom nemalá. Jejím smyslem je „snaha se od této reality [jazykové situace; OD] odpoutat ado0 1982 1986 1990 1994 1998 2002 2006 2010 2014 zákon_noun český_adjective ochrana být_verb používání_noun právní_adjective mít_verb L L L R R R R jazyk_noun 20 40 60 80 100 120 OPEN ACCESS ONDřEJ DUfEK 13 stat se za jazykovou praxi její fragmentací amechanizací (sr. Stubbs 1996, Partington 2008). CL [korpusová lingvistika; OD] vCDA jinými slovy slouží kautomatickému odhalování pravidelných (lexikálně-gramatických) schémat vrámci daného diskurzu za současného rozbití přirozené textové linearity (kotextu)“ (Hořejší, 2016, s.3). Vtakto nastaveném prostředí, kde máme velké množství textů zpracovaných do korpusově prohledávatelné podoby, se nabízejí dvě cesty. První předpokládá, že analytik již alespoň do určité míry zná diskurz a/nebo že má již určité hypotézy, předpoklady, jež chce otestovat. Vtakovém případě může zadat dotaz na určité slovo či obecněji jazykový prostředek, který ho zajímá, anapř.zkoumat, jak se chová vkonkordancích. Jsouli kdispozici taková data aje-li korpus vhodně strukturován, lze věnovat pozornost diachronii asledovat vývoj funkce či pozice onoho jazykového prostředku vdiskurzu. Na takovýto přístup se dobře hodí označení corpus-based— korpus asním spojené standardní nástroje pomáhají hledat anacházet to, co analytik hledá. Druhá možnost se hodí pro situace, kdy analytik buď nemá dobrou představu opovaze diskurzu, anebo se chce záměrně co nejvíce oprostit od svých intuicí; to bychom mohli označit jako corpus-driven přístup. Pak může být dobré začít něčím takovým, jako je frekvenčně seřazený seznam slov (který concordancery běžně umějí generovat). Aniž bych zabíhal do problematických detailů, můžu si snad dovolit tvrdit, že frekvence nějak souvisí stypičností, významem— míněno významností— vrámci diskurzu. Přirozeně takový frekvenční seznam bude na horních příčkách obsahovat jen těžko překvapivá, „zajímavá“ slova— snejvětší pravděpodobností tam nalezneme synsémantika, pak nejspíš pomocná slovesa, osobní zájmena apod., tedy slova, která se velmi často vyskytují přirozeně vkaždém textu bez ohledu na příslušnost kurčitému diskurzu. Pro ilustraci uveďme dvacet nejfrekventovanějších lemmat zprvní kapitoly knihy Paula Bakera (2006, s.1–24) Using corpora in discourse analysis (viz tabulka 1).9 Vtabulce vidíme, že prvních osm pozic zabírají synsémantika10 asloveso to be, užité pravděpodobně zvelké části jako pomocné. Poté však narazíme na lemmata, která už mohou ozkoumaném diskurzu (resp.vnašem případě malé části textu) něco vypovídat. Je patrně vpořádku, že mezi nejčastějšími autosémantiky najdeme lemmata discourse, corpus alanguage. Čtenář by mohl zapochybovat nad užitečností takového seznamu, mohl by ho považovat za nepřekvapivý anezajímavý. Avšak itato ukázková tabulka nabízí podnětů mnohem víc, než se na první pohled zdá: Vztahuje se sloveso/substantivum use spíš kuplatňování nějakých postupů/nástrojů, anebo kužívání jazyka (language use)? Je tedy kapitola zaměřena spíše na techničtější, instrumentálnější výklad, anebo na konceptuální podloží analýzy diskurzu? Dále, proč je zosobních zájmen nejčastější we anikoli Inebo you? Jaký plurál Baker používá— začleňuje do něj čtenáře, nebo 9 Seznam byl vytvořen vsoftwaru AntConc svyužitím anglické lemmatizace nabízené na webu softwaru. 10 Vědomě nechávám stranou otázku, jak přesně je ošetřena lemmatizace výrazu that, tedy jaká část dokladů je ve funkci spojky ajaká ve funkci zájmena— pro můj výklad to není relevantní. OPEN ACCESS 14 STUDIE ZAPLIKOVANÉ LINGVISTIKY 2/2019 ne? Apokud ano, jde okontaktovou strategii, nebo má jinou funkci? Ado třetice, proč mezi frekvenční špičkou chybí poslední slovo ztitulu celé knihy, unějž by bylo možno předpokládat taktéž jistou prominenci, tedy analysis? Toto lemma je ve skutečnosti 25.aje pouze důsledkem formálně založeného výběru, že se nedostalo před oči čtenáře (stejně tak dobře mohla mít tabulka 15 nebo třeba 30 řádků adůvod/vysvětlení by těžko mohl/obýt lepší či horší). Poslední otázka však poukazuje na klíčový problém využívání CL vCDA: Co vkorpusu není, to vkorpusu nenajdeme. Moderní korpusové softwary jako #Lancsbox (Březina, Timperley & McEnery, 2018) však při použití některých metrik velikosti účinku nabízejí kromě seznamů (pozitivních) klíčových slov také negativní klíčová slova, tj.výrazy, které se výrazně málo vyskytují ve zkoumaném korpusu vporovnání skorpusem referenčním. Taková negativní klíčová slova mohou analytika upozornit na jevy, jejichž přítomnost by očekával, které však vkorpusu chybějí. Nepřítomnost (nebo méně kategoricky vzato nízká frekvence) může být srovnatelně důležitá avýznamná jako vysoká četnost. Zde je vhodné upozornit na neustálou nutnost kontroly azvažování kroků, které analytik nechá na počítači akteré by měl podniknout sám dále. Takový frekvenční seznam, jaký představuje tabulka 1, je jistě podnětný, jenže— jak jsme viděli— itak plný balastu pravděpodobně bez větší relevance pro rozkrývání na první pohled neviditelné povahy diskurzu. Vtomto směru může lépe sloužit navazující seznam klíčových slov. Klíčová slova jsou totiž postavena na optice frekvenční významnosti určitých slov pro zkoumaný korpus vporovnání skorpusem referenčním, atudíž opomíjejí to, co je oběma srovnávaným souborům společné. Zde takový seznam nenabídnu, neboť není zcela triviální říct, sčím by se měla četnost porovnávat, oproti čemu by mělo být klíčové slovo četnější. Jedna možnost by samozřejmě byla porovnat předmět našeho zájmu sobecným korpusem, dejme tomu Bank of English nebo British National Corpus. Možná by však bylo zajímavější zkusit porovnat knihu Paula Bakera sněčím srovnatelnějším, např.spublikací Patterns and Meanings in Discourse Alana Partingtona et al. (2013). Klíčová slova budou představena avyužita vnásledující kapitole. pořadí frekvence lemma pořadí frekvence lemma 1 399 of 11 119 or 2 395 be 12 110 as 3 346 the 13 90 have 4 303 a 14 86 we 5 297 to 15 82 for 6 237 and 16 76 language 7 232 in 17 73 which 8 166 that 18 72 it 9 132 discourse 19 71 use 10 130 corpus 20 67 this Tabulka 1:Začátek word listu první kapitoly knihy Baker (2006). OPEN ACCESS ONDřEJ DUfEK 15 Dalším krokem může být kolokační analýza. Může mít například smysl ptát se, sjakými adjektivy-přívlastky se určité klíčové slovo pojí, jak se (např.na škále pozitivně–negativně) konstruuje vdiskurzu. Uslov reprezentujících aktéry lze sledovat statisticky podložené pravidelnosti vuvádění charakteristik, činností apod. Evaluativní potenciál kolokací pokrývá koncept sémantické/diskurzní prozodie— viz Monika Bednareková (2008) aPaul Baker, Andrew Hardie aTony McEnery (2006, s.58). Obvyklou součástí CACDA bývá analýza konkordancí. Ta umožňuje sledovat pravidelnosti bezprostředního jazykového kontextu vyhledaného výrazu azvýrazňuje tak vlastnosti korpusu/diskurzu vjiž vyváženějším poměru horizontálního avertikálního pohledu. Většina dosavadního výkladu se orientovala především na lexikální stránku diskurzu. Užitečnou součástí korpusových analýz diskurzu však bývají irozbory gramatických pravidelností (viz např.Partington, 2002, s.7–9; Baker, 2006, s.151–174). Lze si představit např.studii zahrnování či vylučování určitých aktérů pomocí sledování zájmen a/nebo užití kategorie čísla. Vúvahu přichází výzkum výskytu konkrétního výrazu vrůzných syntaktických funkcích (např.podmět/agens vs. předmět/patiens), Podmínkou uskutečnitelnosti takových sond je však do značné míry gramaticky (typicky morfologicky, případně isyntakticky) anotovaný korpus. Zásadním principem CACDA, má-li si zachovat ohled na kontext, je (podle potřeby opakovaně aplikovaná) kombinace kvantitativního aspektu skvalitativním. Konkrétní sled kroků zapojujících frekvenčně založené korpusové nástroje adetailní čtení širších jazykových kontextů spolu se zohledněním kontextu situačního, sociál ního, kulturního apod. je třeba samozřejmě ušít na míru příslušnému předmětu zkoumání aanalyzovanému materiálu. Bez kvantitativní složky bychom však studii vrámci CDA těžko mohli označit za korpusovou, bez kritického kvalitativního zaměření na kontextualizovaný detail bychom podnikali korpusovou studii bez kritické analýzy diskurzu. 4. KRITIKA CDA AJEJÍ KORPUSOVÁ ŘEŠENÍ Poté, co se kritická analýza diskurzu ustálila azačala být vnímána jako (alespoň do určité míry) smysluplný areálně praktikovaný způsob vědeckého bádání jak samotnými jejími představiteli (tzn.že se sami identifikovali jako příslušníci směru, jejž lze označit zkratkou CDA), tak akademiky stojícími mimo tento proud, začaly se pochopitelně objevovat na její adresu kritické poznámky. Některé byly vzneseny, protože se původní jednotlivosti vrostoucím objemu vznikající literatury ukazovaly být pravidelnostmi, jiné zase proto, že se představitelé kritizovaných praktik postupně stali vůdčími osobnostmi apříslušníky kánonu, ajejich práce tedy částečně reprezentovala celou CDA. Vnásledujících odstavcích shrnu hlavní výtky— kritériem jejich výběru je kombinace frekvence azávažnosti. Dělím je na dvě základní skupiny: (1) na ty, které se týkají samotné podstaty CDA, jejího založení, tedy výtky jdoucí kjádru přístupu jako takového; (2) na ty, které upozorňují na neblahou praxi, nedostatečné dodržování postupů považovaných za nezbytné pro vědecké počínání, jež je však spatřováno nikoliv OPEN ACCESS 22 STUDIE ZAPLIKOVANÉ LINGVISTIKY 2/2019 5. ANALÝZA JAZYKOVÝCH IDEOLOGIÍ VČESKÉM PARLAMENTNÍM DISKURZU 5.1 DATA Použití představeného přístupu teď předvedu na ilustrativní ukázce, která představuje jen úzký výřez plné analýzy, ale zachycuje všechny její fáze. Ukázka vychází zrozboru jazykových ideologií včeském parlamentním diskurzu (podrobněji Dufek, 2018). Východisko tvoří návrhy jazykových zákonů vPoslanecké sněmovně Parlamentu ČR od vzniku samostatné České republiky do současnosti (srov.Velčovský, 2015; Sojka, 2018).16 Zde analyzovaný materiál se skládá se dvou korpusů— jednoho zkoumaného ajednoho referenčního. Jádrem je korpus nazvaný JazParl obsahující sněmovní rozpravy onávrzích jazykových zákonů17 apříslušné dokumenty (texty zákonů, důvodové zprávy, stanoviska vlády apod.) od vzniku České republiky do roku 2015 (viz tabulka 2). Texty zařazené do korpusu jsou zkopírovány zdigitálního repozitáře stenoprotokolů rozprav volně přístupného ve Společné česko-slovenské digitální parlamentní knihovně.18 Korpus je lemmatizován aanalyzován pomocí softwaru #LancsBox (Březina, Timperley & McEnery, 2015).19 Ktomuto zkoumanému korpusu byl pro potřeby analýzy klíčovosti stejným způsobem pořízen referenční korpus RefParl, který obsahuje přepisy tematicky nespecifikovaných sněmovních rozprav— zvolil jsem vždy celou jednu předchozí ajednu následující schůzi po té, na níž se projednával některý znávrhů jazykových zákonů. 16 Vdobě započetí analýzy byl návrh zákona „oúředním jazyce České republiky aozměně zákona č.200/1990 Sb., opřestupcích, ve znění pozdějších předpisů (zákon oúředním jazyce)“ (sněmovní tisk t0629) ze dne 21.října 2015 nejnovějším pokusem olegislativní regulaci jazyka. Poté ještě poslanci KSČM předložili podobný návrh vroce 2017, ale Poslanecká sněmovna ho— stejně jako zmíněný návrh zroku 2015— do konce svého funkčního období neprojednala. Vliv jeho nepřítomnosti ve zkoumaném korpusu je tedy ve výsledku marginální. 17 „Jazykový zákon“ je zde idále označení neterminologické, zahrnující pro stručnost veškeré legislativní návrhy týkající se nějak úpravy věcí souvisejících sjazykem, tj.od dílčího pozměňovacího návrhu novely zákona oprovozování rozhlasového atelevizního vysílání přes samostatné návrhy zákona ostátním/úředním/apod. jazyce až po návrhy ústavních zákonů. 18 Viz <http://www.psp.cz/eknih/index.htm>. 19 #LancsBox lemmatizuje data pomocí nástroje TreeTagger, který podporuje ičeštinu, není však zcela spolehlivý. Proto se vanalýzách např.jako samostatná klíčová slova objevují inezákladní tvary, neboť jsou chybně nepřiřazeny k(často) separátně existujícímu správně rozpoznanému lemmatu (např.etnický_adjective ietnických_adjective). Dalším typem chyby, kterou TreeTagger generuje, je chybné slovnědruhové tagování (např.čl_verb— ve skutečnosti zkratka pro „článek“). To sice potenciálně znamená do určité míry zkreslení, na základě práce sdaty popsané vnásledujícím oddíle ho však lze prohlásit za velmi malé. Při samotném nakládání sklíčovými slovy, jejich sémantickém sdružování ainterpretaci už tyto chyby zohledňuji avdůsledku odstraňuji. OPEN ACCESS ONDřEJ DUfEK 23 Díky tomu, že se takto sestavený referenční korpus shoduje skorpusem zkoumaným zhlediska časového ižánrového, lze předpokládat, že jediná proměnná, kterou bude pomocí analýzy klíčových slov možné sledovat, bude téma, tedy vpřípadě korpusu JazParl legislativní úprava jazykové oblasti. Korpus JazParl dělím na dva subkorpusy— JazParl_pro aJazParl_proti; viz tabulka 3. Tyto subkorpusy neodrážejí pouze diskurzně konstituované skupiny aktérů, jejichž přesvědčení se projevují vpromluvách— dělicí linie mezi nimi je demonstrována ireálně existujícími projevy, totiž hlasováním poslanců opříslušném návrhu zákona. Např.hlasování poslance pro jeho postoupení do dalšího čtení, resp.proti jeho zamítnutí (dohledatelné na webu poslanecké sněmovny) tedy znamená zařazení jeho promluv do subkorpusu JazParl_pro.20 skupina (sub)korpus textů tokenů typů lemmat zkoumaný JazParl 89 40423 7843 5155 pro × proti JazParl_pro 38 28671 6249 4112 JazParl_proti 40 10502 3214 2258 referenční RefParl 14 300779 28377 19195 Tabulka 3:Velikost korpusů asubkorpusů. 5.2 ANALÝZA JAZYKOVÝCH IDEOLOGIÍ VČESKÉM PARLAMENTNÍM DISKURZU Ideologie, včetně jejich konkrétních aplikací/realizací týkajících se jazyka, považuji za vlastní každému jedinci účastnícímu se sociálních interakcí avstupujícímu do sociálních kontextů (viz např.Silverstein, 1979, s.193; Woolard, 1998, s.3. Tyto ideologie 20 Do ani jednoho ztěchto subkorpusů nebyly zařazeny promluvy poslanců, kteří se sice vprůběhu projednávání kzákonu vyjádřili, nakonec však oněm nehlasovali nebo se zdrželi hlasování. Vtakovém případě je nebylo možno spolehlivě přiřadit kani jedné skupině, vsubkorpusech proto nejsou. Vtabulce 3 proto subkorpusy JazParl_pro aJazParl_proti mají dohromady jen 78 textů / 39 173 tokenů, přestože JazParl jako celek má o11 textů / 1 250 tokenů víc. Zkritéria postoje projeveného hlasováním se vymykají dokumenty (texty zákonů, důvodové zprávy, stanoviska vlády apod.), které byly rozřazeny na základě převažujícího stanoviska na základě kvalitativního čtení. období zákon 1995 ústavní zákon 1995/1996 zákon ostátním jazyce České republiky aojazycích národnostních menšin 1999/2000 zákon ojazyce České republiky 2002/2003 pozměňovací návrh knovele zákona oprovozování rozhlasového atelevizního vysílání 2003/2004 ústavní zákon 2015 zákon oúředním jazyce České republiky (neprojednáno) Tabulka 2:Přehled návrhů jazykových zákonů. OPEN ACCESS 24 STUDIE ZAPLIKOVANÉ LINGVISTIKY 2/2019 mají potenciál formovat sociální akce, které se mohou střetávat se zájmy ostatních jedinců askupin (např.McGroarty, 2008, s.98). Vtomto momentu se do úvah oideologiích dostávají jako proměnné moc (příp. hegemonie apod.). Právě uplatňování moci ssebou nese riziko nespravedlnosti autlačování. To je také perspektiva, která spoluutváří relevanci jakožto faktor při mém rozhodování opodrobení konkrétních částí diskurzu bližšímu zkoumání ajíž interpretuji výsledky analýzy. Jazykové ideologie jsem ve zde představených datech zkoumal perspektivou komparace textů dvou diskurzních skupin— zastánců aodpůrců jazykových zákonů. Zprostorových důvodů se zaměřím pouze na druhou znich, díky své reaktivní podstatě však zčásti osvětlí ipovahu skupiny první. Kzodpovězení otázky, jaké jazykové ideologie jsou manifestovány vpromluvách poslanců, použiju analýzu klíčových slov, kolokační analýzu, konkordanční analýzu akvalitativní, interpretativní kritickou analýzu. Klíčovými slovy rozumím lexikální jednotky, které mají ve zkoumaném korpusu významně vyšší frekvenci než vkorpusu referenčním sohledem na jejich disperzi. Výpočet klíčovosti kombinuje tři podstatné aspekty: zamítnutí nulové hypotézy (tj.že konkrétní slovo je ve zkoumaném korpusu frekventovanější jen náhodou) na určité hladině pravděpodobnosti, velikost efektu azohlednění vnitrokorpusové variability. Proto využívá log-likelihood (která plní první požadavek) aCohenovo d (druhý atřetí požadavek). Za klíčová budu tedy považovat taková slova, která budou mít kladnou hodnotu Cohenova d azároveň hodnotu log-likelihood vyšší než 3,84 (což odpovídá p < 0,05). Kritická reflexe konceptu klíčovosti viz Dufek (2018, s.35–45).21 Jelikož jsou předmětem zájmu témata (koncepty, motivy), zaměřím se na plnovýznamová slova (bez zájmen ačíslovek). Klíčová slova, která se zdají být významově související, vždy sdružím do sémantických skupin (toto sdružování dělám pouze na základě lemmat, ověřování vkonkordancích je vždy předmětem následných kroků; názvy skupin jsou ilustrativní, rozhodně nikoliv jediné možné), poté uvedu zbývající klíčová slova seskupená podle slovnědruhové platnosti.22 21 Dufkův (2018) přehled způsobů výpočtu klíčových slov ajejich výhod aomezení ovšem nezahrnuje aktuální návrh Jesseho Egberta aDouga Bibera (2019). Autoři představují novou metodu určování klíčových slov— text dispersion keyness, která na rozdíl od corpus frequency keyness zcela opomíjí frekvenci asoustředí se pouze na disperzi slov vkorpusu. Jejich kvalitativní zhodnocení seznamů klíčových slov generovaných jednou čistě frekvenčně založenou metodou, třemi metodami různými způsoby zohledňujícími disperzi anakonec čistě disperzní metodou se zdá zřetelně favorizovat jejich vlastní text dispersion keyness. Je však třeba podotknout, že Egbert aBiber svou metodu nekonfrontují spřístupy používajícími metriky velikosti efektu. Důkladnější validizace jejich návrhu je tedy zatím otevřenou otázkou, přesto jde bezesporu opozoruhodný apotenciálně zásadní příspěvek do debaty oadekvátnosti užívání klíčových slov vanalýze diskurzu. Za upozornění na tuto práci děkuji recenzentovi. 22 Neuvádím chybně lemmatizované výrazy, tj.např.případy, kdy jsou jako lemmata uvedeny nezákladní tvary. Také přehlížím výrazy zjevně odkazující ksněmovnímu diskurzu, jako jsou pan, kolega, předsedající, předkladatel, navrhovatel, paragraf apod., kromě toho též rodná jména apříjmení. OPEN ACCESS ONDřEJ DUfEK 25 Logika analýzy je následující: Zaprvé srovnám prozkoumám seznam klíčových slov vytvořený pro subkorpus JazParl_proti na pozadí subkorpusu JazParl_pro coby referenčního. To zvýrazní specifika zkoumaného subkorpusu vůči tomu druhému (specifika korpusů lze pak vztáhnout kspecifikům subdiskurzů). Zadruhé budu věnovat pozornost klíčovým slovům subkorpusu JazParl_proti sreferenčním parlamentním korpusem RefParl. To ukáže specifika subkorpusu/ subdiskurzu vůči obecnému sněmovnímu korpusu/diskurzu. Zatřetí prověřím vnávaznosti na druhý krok některá klíčová slova společná pro oba subkorpusy (tedy iJazParl_pro) pomocí kolokační analýzy, která pomůže ukázat, do jakých kontextů se klíčová slova prostřednictvím svých kolokátů zasazují. Každý ztěchto tří kroků bude podle potřeby průběžně podpořen detailnějším popisem užívání vybraných klíčových slov pomocí konkordanční analýzy akvalitativního, kontextualizujícího kritického čtení. Nejen vtéto ilustrativní sondě, ale ivplné analýze je přijatelné (nikoliv ideální, leč obhajitelné) nepodrobit všechna klíčová slova detailní analýze. Některá lze ponechat stranou už jen na základě úvahy ojejich relevanci pro zkoumané téma, některá lze prověřit pohledem na výpis konkordancí, oněkterých může rozhodnout až podrobnější konkordanční analýza či přímo kvalitativní čtení širších kontextů. Podstatné je činit takové kroky transparentně. Vnásledujících oddílech věnuji pozornost zejména těm klíčovým slovům, která dobře plní ilustrativní funkci, ato buď ve vztahu kprůběhu analýzy, nebo kzjištěním vzešlým zanalýzy (jejichž užití je výstižně dokládají). Vzhledem knutně omezenému rozsahu komentování postupu analýzy vtomto článku platí, že nejsou projevem strategie popsané voddílu 4.4 jako cherry-picking, aže ta klíčová slova, která zde nepodrobuji podrobnějšímu rozboru, byla vyhodnocena jako doklady vyjádření nepřispívajících kutváření jazykových ideologií, ato právě těmi postupy, které jsem načrtl. Kompletní analýza viz Dufek (2018, s.53–98). 5.2.1 JAZPARL_PROTI — JAZPARL_PRO Seznam klíčových slov subkorpusu JazParl_proti vůči referenčnímu JazParl_pro obsahuje (opět mimo jiné) tato klíčová slova: — cizí: slovensky, slovenština, Slovák, Morava; — legislativa: řád, projev, přepracování, legislativně, přijmout; — hodnocení: dostatečný, stávající, nutný, obvyklý, duplicitní, protiústavní, proklamativní, upravený. — substantiva: závěr, titulek, aplikace, pocit, výjimka, tvrzení, kvóta, soudruh, potíž; — adjektiva: následující, faktický, jasný, chybný, konkrétní, stručný, pouhý, praktický; — slovesa: souhlasit, mít, způsobit, být, omezovat, učit, vystupovat, spadat, odpovědět, hodit, naznačovat, vracet, přinést;— OPEN ACCESS 26 STUDIE ZAPLIKOVANÉ LINGVISTIKY 2/2019 — adverbia: jaksi, pouze, zvláště, fakticky, totiž, případně, bohužel, nikoliv, koncepčně, přesně, shora, krásně, výjimečně. Potenciál vyjadřovat postoje kprojednávanému tématu nebo jeho protagonistům lze předpokládat uslov, jako jsou soudruh, dostatečný, nutný, chybný, souhlasit či krásně. Klíčové slovo krásně tento předpoklad jako jediné nepotvrzuje— jde pouze odvě ocenění kvality projevu předřečníka. Ostatní slova však předpoklad potvrzují: Soudruh se sice objevuje pouze třikrát, ale jak ukazují příslušné texty, jeho funkce je delegitimizační. Všechna tři adjektiva vyjadřují většinově odmítavou pozici odpůrců jazykových zákonů: dostatečná je současná zákonná úprava, nedostatečná pak provázanost konkrétního návrhu správním řádem, jeho určitost či jeho ochrana slovenštiny; polovina výskytů adjektiva nutný říká, že navrhovaná úprava není nutná, koncepčně chybný je pak vždy návrh zákona. Níže uvádím dva příklady projevů, které mj.pomocí uvedených (tučně zvýrazněných) klíčových slov vyjadřují signifikantní mínění jejich autorů stran jazyka ajeho legislativní regulace. (1) „Národní“ je ve své podstatě něco, co se dotýká jednotlivých národů, kmenů, atěch na našem území žil vprůběhu dějin nemalý počet. Češi, Moravané, Slezané, Valaši, to vše jsou historické kmeny, které se naučily žít nejen pospolu, ale též sNěmci, Poláky, Židy, Slováky anevyjímaje ani Romy, Araby adalší. Proto by nebylo správné určovat češtinu za kulturní dědictví „jen“ Čechů, Moravanů aSlezanů. Čeština není jazykem jediného národa, je to jazyk občanů České republiky. […] idíky cizím vlivům, se čeština vmluvené formě vyvíjí, ato do podoby, která vyhovuje všem, takže se stala jakýmsi univerzálním dorozumívacím nástrojem lidí žijících na území Čech, Moravy aSlezska. Jazyk je totiž jako živý organismus— žije, roste avyvíjí se ažádná omezení nebo zákony na tomto nemohou nic změnit (t0485-20040615-004-USDEU-Bielesz). (2) Osobně vážím si snahy předkladatelů, hluboce však nesouhlasím stím, že jazykovou kulturu unás je možno zlepšovat zákonem, který nadto pouze apeluje aneukládá sankce. Dobré ovládání už je— adoufám bude— prestižní záležitostí zvýhodňující všechny, kteří dobrou češtinu používají. Český jazyk je poklad, který svobodně kultivujme (t0319-20000222-009-ODS-Nájemník). Vzávěru prvního příkladu nacházíme projev jazykového organicismu (jazyk má podobné vlastnosti aprojevy jako živé organismy), jinak je však celá citace zaměřena na obhajobu inkluzivnějšího pojetí jazyka, než je pojetí nacionální. Druhý příklad je pozoruhodný tím, že obsahuje dva výrazy, které nejsou jednoznačně kompatibilní— poklad asvobodně. Interpretuji to tak, že poklad znamená cosi cenného acenné věci je běžné chránit, což by předpokládalo spíš regulační opatření vtom smyslu, aby cennost nebyla ohrožena. Adverbium svobodně však jde významově proti takové představě. Na druhou stranu lze isvobodu pojímat jako hodnotu, která si zaslouží ochranu. Spojují se tak zde dva potenciálně, ale nejednoznačně odlišné pohledy na jazyk; jak uvidíme dále, není to případ ojedinělý. OPEN ACCESS ONDřEJ DUfEK 27 Už zprostého pohledu na klíčová slova ajejich skupiny lze získat hrubou představu osubkorpusu/subdiskurzu odpůrců návrhů jazykových zákonů— mimo jiné je orientován evaluativně. Ukazují to výše komentovaná adjektiva dostatečný, nutný achybný. Blíže kjádru diskurzu se však dostaneme až vnásledujících dílčích analýzách, které se budou zabývat klíčovými slovy lépe odrážejícími podstatu subdiskurzu. 5.2.2 JAZPARL_PROTI — REfPARL Vtéto části subkorpus JazParl_proti vztáhnu kreferenčnímu korpusu RefParl. Vyjdu ze dvou seznamů, zde pro názornost dokumentovaných itabulkami: Tabulka4 1/3 2/3 3/3 Pořadí Lemma Pořadí Lemma Pořadí Lemma 5dámy_noun 50 nesouhlas_noun 82 zajišťovat_verb 9 pán_noun 52 titulek_noun 83 předkladatel_noun 13 kolega_noun 54 například_adverb 84 nerozumí_verb 14 předsedající_ adjective 56 spotřebitel_noun 86 takový_pronoun 16 stručný_adjective 57 vedle_preposition 88 kučera_noun 21 slovensky_adverb 60 tlumočníka_noun 89 nikterak_adverb 22 nadbytečný_ adjective 61 předkladatelům_ noun 90 rodném_adjective 23 projev_noun 62 ústavou_noun 93 spisovný_adjective 24 paragraf_noun 64 nepřijal_verb 96 živnostenském_ adjective 25 často_adverb 65 slovenština_noun 97 kučery_noun 27 mít_verb 66 dostatečně_adverb 98 důvodová_adjective 30 hovořit_verb 67 velice_adverb 100 ověřeného_adjective 32 dostatečný_adjective 68 potřeba_noun 102 aplikační_adjective 33 řád_noun 69 česky_adverb 103 legislativy_noun 34 pouze_adverb 71 úředním_adjective 105 tolik_adverb 35 předkladatele_noun 72 předložený_ adjective 107 občanství_noun 37 jaksi_adverb 73 legislativně_adverb 108 ustanovením_noun 38 předkladatelů_noun 74 upravující_adjective 109 bičík_noun 39 výjimka_noun 75 dobře_adverb 110 nějaký_pronoun 40 obsažený_adjective 76 navazovat_verb 112 právnickými_ adjective 42 navrhovatelé_noun 78 řešit_verb 113 dobala_verb 44 navrhovatelů_noun ti 65_numeral Tabulka 4:Klíčová slova přítomná ve 100 nejklíčovějších slovech subkorpusu JazParl_proti vůči referenčnímu RefParl azároveň nepřítomná ve 100 nejklíčovějších slovech subkorpusu JazParl_pro vůči referenčnímu RefParl; šedě jsou uvedena klíčová považovaná za irelevantní, kurzívou chybně lemmatizovaná klíčová slova. OPEN ACCESS 28 STUDIE ZAPLIKOVANÉ LINGVISTIKY 2/2019 ukazuje klíčová slova, která se vyskytují mezi sto nejvýznamnějšími vsubkorpusu JazParl_proti, anejsou mezi první stovkou klíčových slov druhého subkorpusu ( JazParl_pro). Po jejich analýze se dostanu ktabulce 5, která obsahuje klíčová slova sdílená mezi první stovkou oběma subkorpusy. Jinak řečeno, zaměřím se nejprve na komparativní specifika, poté na společné motivy. Klíčová slova uvedená vtabulce opět pro větší názornost sdružím do skupin. — zahraničí: slovenský, slovensky, slovenština; nerozumí; — český: česky, rodném; — mluvení: hovořit, projev; — hodnocení: dobře, dostatečný, dostatečně, stručný, pouze, výjimka, nadbytečný; — legislativa: dámy, pán, kolega, předsedající, paragraf, řád, předkladatel, předkladatele, předkladatelů, předkladatelům, navrhovatelé, navrhovatelů, ústavou, legislativy, legislativně, ustanovením, předložený, upravující, důvodová, nepřijal. — substantiva: nesouhlas, titulek, spotřebitel, tlumočníka, potřeba, občanství; — adjektiva: obsažený, úředním, spisovný, živnostenském, ověřeného, aplikační, právnickými; — slovesa: mít, navazovat, řešit, zajišťovat; — adverbia: velice, často, jaksi, například, nikterak, tolik. Lemmata dobře, nadbytečný, potřeba, spisovný ahovořit relevanci vzhledem kpřesvědčením týkajícím se jazyka vanalýze konkordancí akontextů většinově nepotvrzují. Podobně ponechám stranou lemmata hovořit, spisovný, dobře apotřeba. Adjektivum nadbytečný přesvědčení připsatelná předkladatelům jazykových zákonů odráží přece jen lépe: tři výskyty zpěti představují citace či parafráze jiných výroků (onadbytečnosti zákonné úpravy jazykové situace), knimž se připojuje nesouhlas, ve dvou výskytech se pak uznává nadbytečnost jednoho konkrétního článku návrhu zákona. Pro zajímavost připojuji jeden příklad ze subkorpusu JazParl_pro: (3) Nedomnívám se, že ohrožení českého jazyka neúměrně velkým působením cizích slov lze zabránit např.tím, že napíšeme nesouhlasný dopis tomu redaktorovi soukromé rozhlasové stanice, který hovoří jakýmsi „světovým českých jazykem“, jak otom píše vLidových novinách právě již zmíněný profesor filozofické fakulty bohemista Alexander Stich. Nesouhlasím ani snázorem ředitele Ústavu českého jazyka filozofické fakulty Univerzity Karlovy Oldřichem Uličným— jakkoli si obou bohemistů velmi vážím—, který mimo jiné nevítá tento zákon, protože, cituji: „Žijeme ve společnosti, která se nachází vhluboké morální depresi, ve společnosti bez ideálů, cílů, víry avzorů, ale také bez respektu kzákonům. Od této společnosti lze stěží očekávat, že bude respektovat nadbytečný jazykový zákon.“ Ajá dodávám: to by také mohlo znamenat, že není-li vnaší společnosti respekt kzákonům, nebudeme tedy přijímat zákony žádné (t0319-19991102-009-KSČM-Svobodová). Nyní přesunu svou pozornost kpodobnostem obou subkorpusů. OPEN ACCESS ONDřEJ DUfEK 29 1/2 2/2 JazParl_ pro Lemma JazParl_ proti JazParl_ pro Lemma JazParl_ proti Cohenovo d Pořadí Pořadí Cohenovo d Cohenovo d Pořadí Pořadí Cohenovo d 2,09 1 jazyk_noun 1 1,65 0,58 33 užívat_verb 18 0,50 1,03 2 český_adjective 7 0,61 0,57 34 úprava_noun 11 0,59 1,00 3 ústava_noun 58 0,37 0,57 35 kulturní_adjective 59 0,37 0,95 4 čeština_noun 4 0,71 0,57 36 styk_noun 47 0,40 0,88 6 národnostní_adjective 8 0,61 0,56 39 chránit_verb 19 0,45 0,88 7 zákon_noun 3 0,77 0,55 43 ochrana_noun 2 0,78 0,87 8 národní_adjective 70 0,36 0,55 44 menšina_noun 29 0,42 0,81 12 používání_noun 15 0,55 0,53 51 překlad_noun 26 0,42 0,77 13 jazykový_adjective 17 0,50 0,51 54 evropa_noun 111 0,32 0,73 14 úřední_adjective 10 0,59 0,51 56 francie_noun 55 0,38 0,67 17 právní_adjective 28 0,42 0,50 59 jiný_adjective 63 0,37 0,66 19 etnický_adjective 101 0,32 0,47 69 upravovat_verb 95 0,33 0,65 20 etnických_adjective 31 0,42 0,47 71 národnost_noun 20 0,44 0,64 21 menšin_noun 12 0,59 0,46 76 upravit_verb 43 0,41 0,63 25 cizí_adjective 6 0,62 0,46 78 slovenský_adjective 45 0,40 0,62 27 užívání_noun 51 0,39 0,44 91 předkladatelé_noun 41 0,41 0,61 28 identita_noun 53 0,38 0,43 100 listina_noun 104 0,32 0,60 29 příslušník_noun 49 0,39 Tabulka 5:Klíčová slova přítomná ve 100 nejklíčovějších slovech subkorpusu JazParl_pro vůči referenčnímu RefParl azároveň ve 100 nejklíčovějších slovech subkorpusu JazParl_proti vůči referenčnímu RefParl; kurzívou chybně lemmatizovaná klíčová slova. — jazyk: jazyk, jazykový, český, čeština; — atributy jazyka: národní, úřední; — užívání: užívat, užívání, používání; — zákony: ústava, zákon, úprava, upravovat, upravit, listina; — menšiny: národnost, národnostní, etnický, etnických, menšina, menšin, příslušník; — cizí: Evropa, Francie, slovenský, cizí; — styk: styk, překlad, jiný; — hodnoty: kulturní, identita, chránit, ochrana. Zklíčových slov obsažených vtabulce 5 je vidět, že se oba subkorpusy shodují ve zmiňování základních pojmů diskurzu ojazykových zákonech— kromě výrazů označujících legislativní stránku věci (ústava, zákon, úprava, upravovat, upravit, listina) zde najdeme lemmata přímo „jádrová“— jazyk, jazykový, český, čeština, národní, úřední; používání, užívání, užívat. Obě strany se zjevně vyjadřují kprávům menšin (národnost, OPEN ACCESS 30 STUDIE ZAPLIKOVANÉ LINGVISTIKY 2/2019 národnostní, etnický(ch), menšin(a), příslušník). Shodují se též ve vztahování se kzahraničním situacím, viditelném už vpředchozím oddíle (evropa, francie, slovenský, cizí). Sohledem na to, že podstatnou součástí jazykových ideologií jsou hodnoty, bude zajímavé podrobit bližšímu zkoumání skupiny klíčových slov, která do této skupiny řadím: 1) chránit, ochrana; 2) kulturní, identita. 5.2.3 KOLOKAČNÍ ANALÝZA Obrázek 1 atabulka 6 zachycují kolokace23 lemmatu ochrana vsubkorpusu JazParl_ proti. Podrobnější pohled do konkordancí prokázal, že lemmata zlevého kontextu vypovídají okonceptualizaci ochrany vkorpusu/diskurzu jen málo. Vpravo vsubkorpusu JazParl_proti však najdeme typicky (odhlédnuto od skloňování) sousloví ochrana českého jazyka (13 výskytů), pouze jednou jde oto, zda český jazyk potřebuje [takovouto] ochranu. Obrázek 1:Kolokace lemmatu ochrana vJazParl_proti-RefParl. Pozice Lemma Log-likelihood Frekvence kolokace Frekvence kolokátu vpravo jazyk_noun 117,78 22 206 vpravo být_verb 117,21 28 522 vpravo český_adjective 80,49 15 125 vlevo používání_noun 36,77 5 15 vlevo zákon_noun 35,6 10 191 vlevo právní_adjective 33,39 7 70 vpravo mít_verb 16,77 5 100 Tabulka 6Kolokace lemmatu ochrana vJazParl_proti-RefParl 23 Hodnota log-likelihood 6,63, frekvence kolokátu min. 5. 0 1982 1986 1990 1994 1998 2002 2006 2010 2014 zákon_noun český_adjective ochrana být_verb používání_noun právní_adjective mít_verb L L L R R R R jazyk_noun 20 40 60 80 100 120 OPEN ACCESS ONDřEJ DUfEK 31 Jelikož je sousloví jako ochrana českého jazyka společné pro oba subkorpusy, mohli bychom usuzovat, že zastánci předkládaných jazykových zákonů ji budou prezentovat jako potřebnou, nutnou apod., zatímco odpůrci budou totéž zmiňovat, avšak odmítat, tj.že ochrana českého jazyka není žádoucí. Detailnější rozbor rozšířených kontextů avněkterých případech icelých textů však vyznívá zřetelně méně jednoznačně. Uvedu několik příkladů ze subkorpusu JazParl_proti. (4) Český jazyk je dostatečně chráněn speciálními právními předpisy pro jednotlivé obory atento zákon není třeba (t0319-20000331-004-ODS-Pejřil). (5) Nepochybuji otom, že předkladatele návrhu vedl skutečně dobrý aušlechtilý úmysl, tj.legislativně podpořit ochranu českého jazyka, který— jak všichni víme— je vystaven těžkým zkouškám, ato nejen vkaždodenním životě, vúředním styku, médiích, reklamě, adovolíte-li, velice často ivtomto sále. […] Mne překvapilo, že navrhovatelé zákona— přestože, jak říkám, důvod kjeho přípravě byl nepochybně ušlechtilý— se sami vzdali možnosti sankcionovat jednání, které bude vrozporu sliterou či duchem zákona, aspoléhají na to, že použití češtiny bude vpříslušných případech vynuceno jinými, již existujícími zákony. Jako příklad bych uvedl zákon na ochranu spotřebitele. Předložený zákon skutečně ani vjednom zparagrafů neuvádí, jaké sankce hrozí tomu, kdo nebude jednat vsouladu stímto zákonem, přičemž ani nestanoví, zda avjakých situacích je čeština chráněna jako jazyk obecně, kdy je to spisovná čeština, kdy jsou to oprávněné dialekty atd. Ačkoliv já sám— stejně jako naprostá většina znás, předpokládám— mám velmi často pocit, že čeština jako součást kulturní identity je devastována nad únosnou mez, nedomnívám se, že předložený zákon této devastaci vtéto podobě bude bránit účinněji než jiné aktivity aexistující legislativa (t031919991102-002-US-Matějů). (6) Smyslem návrhu zákona je— slovy předkladatelů, teď budu citovat: „rámcovým způsobem kodifikovat platné právní normy azvyklosti založené vhistorickém vývoji tak, aby se vkoncentrované normativní podobě zdůraznil morální, politický aprávní příkaz zachovávat češtinu jako jeden ze základních prvků české kulturní identity“. Autoři zákona sami přiznávají, že smyslem zákona není zavádět nová opatření kpoužívání aochraně češtiny. Zákon si tedy klade za cíl češtinu chránit. Spadá tedy do skupiny jazykových zákonů, které mají bránit devastaci národního jazyka, zejména pronikáním různých -ismů— amerikanismů, germanismů atd.—, které souvisejí skulturní aprofesionální globalizací, asamozřejmě omezit používání cizích jazyků tam, kde se buď zpraktických, či kulturních důvodů předpokládá použití národního jazyka, vnašem případě češtiny (t0319-19991102-002-US-Matějů). Uvedené příklady ukazují, že zmínky oochraně jazyka se rozpadají na několik skupin. Některé jsou neutrální nebo citátové (např.č.6). Významná je skupina takových, které říkají, že češtinu není třeba chránit víc, než je tomu dosud (např.č.4). Poslední OPEN ACCESS 38 STUDIE ZAPLIKOVANÉ LINGVISTIKY 2/2019 Pragmatics (s.50–69). Amsterdam: John Benjamins. Wodak, R., & Meyer, M. (2009). Critical discourse analysis: history, agenda, theory, and methodology. In R.Wodak & M.Meyer (Eds.), Methods for Critical Discourse Analysis (s.1–33). London: Sage, Wodak, R., & Meyer, M. (2015). Methods of Critical Discourse Studies. London: Sage. Woolard, K.A. (1998). Language ideology as afield of inquiry. In B.B.Schieffelin, K.A.Woolard, & P.V.Kroskrity (Eds.), Language Ideologies: Practice and Theory (s.3–47). Oxford: Oxford University Press. Zasina, A.J. (2018). Image of Politicians and Gender in Czech Daily Newspapers. In M.Fidler & V.Cvrček (Eds.), Taming the Corpus. From Inflection and Lexis to Interpretation (s.167–194). Cham: Springer. Ondřej Dufek | Ústav pro jazyk český AV ČR, Praha <[email protected]> OPEN ACCESS