scieee AI-readable full text Open interactive document viewer

Process of creating linguistic maps: A case study of 'month' in Kra-Dai

ENDO, Mitsuaki

Abstract

This article describes a trial-and-error process for creating linguistic maps, using the example of the word “month” in Kra-Dai. Automatically generated color maps are not suitable as ordinary linguistic maps when there are more than seven types, since the colors become difficult to distinguish. It is therefore essential for linguists to adjust them by using symbols of various shapes and sizes. Generally speaking, frequently occurring types should be represented with small and simple symbols, while rare types should be marked with large and striking symbols. The most crucial step is determining how to classify the types of word forms. A type should consist of items with the same diachronic origin. Resemblance in sound shapes provides a clue, and comparative studies should be consulted as much as possible to identify exact sound correspondences. As for subtypes reflecting sound differences, it is generally impossible to rely solely on geographical distribution to determine the chronological order of changes. However, it is effective to first deduce the chronological order and then verify its validity according to geographical distribution. Regarding the specific case of “month” in Kra-Dai, the most widespread type, Type A, derives from Austronesian bulan. The first vowel was dropped, resulting in bl-, due to the iambic stress pattern in Kra-Dai. This stage is reflected in the Saek language. The bl- form changed into ml- in remote dialects, as implosive b- tends to shift to nasals. Other forms include b- and l-, created by dropping one of the consonants. A frequent form beginning with d- —for example, dɯan in Siamese— resulted from the assimilation of the place of articulation of the first consonant b- to that of the second consonant -l-, after which the first consonant was dropped. Such changes may occur independently in each location; however, it is also possible that sound-shape differentiation had already taken place in the homeland, and groups of speakers with each type migrated to different locations along separate routes in different periods.

Full text

『地理言語学研究』 | Studies in Geolinguistics 5, 2025 109 資料(特集:2025 年における地理言語学の手法) 言語地図を描くプロセス クラ・ダイ語族の「月month」を例として 遠藤 光暁 青山学院大学 Process of creating linguistic maps A case study of ‘month’ in Kra-Dai ENDO, Mitsuaki Aoyama Gakuin University Abstract: This article describes a trial-and-error process for creating linguistic maps, using the example of the word “month” in Kra-Dai. Automatically generated color maps are not suitable as ordinary linguistic maps when there are more than seven types, since the colors become difficult to distinguish. It is therefore essential for linguists to adjust them by using symbols of various shapes and sizes. Generally speaking, frequently occurring types should be represented with small and simple symbols, while rare types should be marked with large and striking symbols. The most crucial step is determining how to classify the types of word forms. A type should consist of items with the same diachronic origin. Resemblance in sound shapes provides a clue, and comparative studies should be consulted as much as possible to identify exact sound correspondences. As for subtypes reflecting sound differences, it is generally impossible to rely solely on geographical distribution to determine the chronological order of changes. However, it is effective to first deduce the chronological order and then verify its validity according to geographical distribution. Regarding the specific case of “month” in Kra-Dai, the most widespread type, Type A, derives from Austronesian bulan. The first vowel was dropped, resulting in bl-, due to the iambic stress pattern in Kra-Dai. This stage is reflected in the Saek language. The blform changed into mlin remote dialects, as implosive btends to shift to nasals. Other forms include band l-, created by dropping one of the consonants. A frequent form beginning with d- —for example, dɯan in Siamese— resulted from the assimilation of the place of articulation of the first consonant bto that of the second consonant -l-, after which the first consonant was dropped. Such changes may occur independently in each location; however, it is also possible that sound-shape differentiation had already taken place in the homeland, and groups of speakers with each type migrated to different locations along separate routes in different periods. キーワード:ArcGIS online;言語地図の解釈;語形の分類;音韻対応;記号の選択 Keywords: ArcGIS online; interpretation of linguistic maps; classifying word forms; sound correspondence; selecting symbols 遠藤光暁 (2025)「言語地図を描くプロセス:クラ・ダイ語族の「月month」を例として」『地理言語学研究』 5: 109–124. doi: https://doi.org/10.5281/zenodo.17479590  JSPS科研費JP23K25322による研究成果の一部である。基礎データは富田愛佳氏と共同入力したものである。 『地理言語学研究』 | Studies in Geolinguistics 5 110 1. はじめに 言語地図の描き方についてはグロータース (1976) の懇切にして本質的な 解説があり,古典的なものと言ってもよい。また徳川編 (1979) も『日本言語 地図』の簡略化した地図として記号の使い方においても参考になり,もちろん 方言地理学とは何かを知るのにも最もよい入門書として勧めている。その後で 柴田 (1969) を言語地理学概論として読み,その先は日本語方言地理学の個別 の論文を読んでいくという順番がスムーズかと思われる。 日本語に対する言語地理学は世界的にも最高水準にあったかと考えている が,ここではアジア・アフリカを始めとする言語地理学的研究がほとんど立ち 上がっていなかった地域を念頭において,ArcGIS online をツールとして言語 地図を描くプロセスについて初歩的な解説をしたためたい。もっと高度な作図 法があることは承知しているが,さしあたり初めの一歩を踏み出すことを主眼 としている。 個人で使用するのに適した言語地図描画ツールとしては他にも SEAL, MANDARA,QGIS などがあり,SEAL は言語地図用の記号を揃えてあり,ず っと美しい地図が描ける長所があるのだが,広域の地図を語族ごとに分担して 地図を繋げたり,大小さまざまなスケールの地図を取得するためには ArcGIS online が適している。ArcGIS のデスクトップ版は GIS としての世界シェアが トップクラスのはずで,デファクトスタンダードとして安定したサポートが得 られ,他分野とのコラボや,高度の地理分析に進むのにも適している。デスク トップ版は機能が高度すぎて言語地図作成には不要な機能が大半であり,操作 が複雑で専門的な訓練を受ける必要があるのに対して,online 版は言語地図の 描画も可能で,操作も簡便で,無料であるので,多人数で共用するのにも好適 で,デスクトップ版との互換性もある。足りない言語地図用の記号は岸江信介 先生・福嶋秩子先生・清水勇吉さんのご好意でオンライン上にイメージが提供 されており(日本地理言語学会 HP のリンク集を参照),それを参照する形で ArcGIS online で使用することが可能になっている。 しかし,データと描画ツールは分離してあるので,他のツールで描画する場 合でも小文の内容が当てはまることはあるだろう。 小文ではアフロ・ユーラシア地理言語学プロジェクトを始めとして,さまざ まな地域・語族で個人レベルで言語地図を描く際の参考となることを目指して いる。ちょうど同プロジェクトでは「月 moon」が第一の課題となっていて, 私と富田愛佳さんの担当するクラ・ダイ語族は 200 地点ていどと,多からず少 なからずの規模なので,それをサンプルにしようとしたが,‘month’の意味の 「月」も比較のため入力してあるので,重複を避けるためこちらを例として記 述を進めていきたい。 遠藤「言語地図を描くプロセス」 111 2. 自動的に描画された地図 さて,それでは早速クラ・ダイ語族の「月 month」を例として作図を始める こととしよう。実は私自身も ArcGIS online の新版を使って初めから作図した ことはなく,白井聡子さんのマニュアルを参照しながら心細い思いで作業を進 めているのである。旧版は 10 年くらい使い慣れているが,もはや使用できな くなるとのことでやむを得ない。旧版を知っている者からしても使い勝手が違 っていて,対応するボタンを探すのに一苦労なので,初めて使う方は一層のこ とであろう。 データ形式は以前は Unicode text が使えたのだが,CSV とあと何だか分から ない形式と合わせて 3つだけ OK と表示されたので,やむなく CSV に保存し 直すこととした。IPA を正確に表示するためには Unicode text が必要であり, CSV だと「?」に文字化けするのだが,実際にはタイプ分けした A1, A2…など のアルファベットと数字だけの列で作図するので,CSV でも差し支えない。 その結果が地図 1である。少し手間取った後なので,私も初めて ArcGIS online で地図が出てきたときのような安堵感と感動を味わった。ただし,これ も実は記号の大きさを 15 ピクセルに変えたものである。また,旧版ではシス テムが自動的に描画する色を変えることはできなかったが,新版ではいろいろ なセットに変えることができるようになったようだ。 右側のキャプションにそれぞれのタイプの頻度も出ており,頻度が 10 位ま でのものが表示されていることが分かる。第 9位・第 10 位の色はまぎらわし いので,タイプの種類が 7つくらいまでなら色の違いだけでも区別ができ,単 図1:クラ・ダイ語族「月 month」の頻度 10 位までの色分け地図 『地理言語学研究』 | Studies in Geolinguistics 5 112 純な現象を扱うためならばこのデフォルトのままでそのまま使えることもあ るだろう。 実際,私の問題意識からしても第一位はともかくとして第二位の地理分布が地 図上で現れてきたときには,入力時にもベトナムに集中していることは分かった ものの,中国側の分布が連続していることが確認できて有益であった。第一位の タイプ A5 はタイ語(バンコク方言など)のdɯan A1(ここでの A1 は声調を表す) であり,第二位のタイプ A2 では頭子音が b-となっている。タイ語の dɯan がオー ストロネシア語族の bulan に対応することは Benedict (1942) のつとに指摘すると ころであり,ベトナムに主として分布する b-で始まる語形はその頭子音を保存す る点でまず重要である。更に Endo (forthcoming 1) で東南アジアの西南タイ語 派の 源郷が広西壮族自治区の龍州あたりであるという説を論じたのだが,そこから 出発した時点での音形が bulan に近い形であったならばよいものの,出発時に すでに単音節化して dやbで始まる形になってから各集団が違う経路をた どって東南アジアに移住したのか,が問題になる。この点についてはこの一語 だけから論ずるのは性急すぎ,なお例を蓄積していく必要がある。しかし,図 1だけでもそうした問題の一端が看取できることとなる。 ところが,実際には図 1は反面教師として出したのである。システムが自動 的に描画した地図はそれぞれのタイプの間の関係にヒエラルキーがあること を反映していない点で大きな問題がある。後で具体的にどのような分類をした のかは記すが,語として同じものを A,B,C…などアルファベットの大文字 図2:全地点を表示した色分け地図 遠藤「言語地図を描くプロセス」 113 で示し,音形の違いだけのものは A1,A2,A3…などと数字を後に付けること によって分類している。その相互関係の遠近ではなく,出現頻度によって自動 的に色わけし,デフォルトのものは一番目立つ色である赤が与えられている。 実際には少数例のほうが言語学的に重要なタイプであることも少なくないの で,頻度が多いものはむしろ背景に退かせ,少数例が目立つように描画したい ところである。 システムが与えたままの地図に致命的な欠陥があることは図 2により知ら れる。これは図 1では灰色の記号となっていた 11 位以下のすべての語形を表 示したものであるが,色による区別には限度があり,順位の低いタイプにも同 じ色がランダムに与えられるため,結局どのタイプがどこに位置するかを正確 に知ることができなくなってしまうのである。 以上からして,7種ていどより多いタイプを扱う場合は,必ず人が記号を与 え直すのでなければならないことが理解できよう。Google maps などで自動的 に表示された地図にも同じ問題があり,逆にシステムの制約に合わせてタイプ を単純な形に合わせてしてしまうのでは WALS のような単純な分類に陥り, 単にその現象がどこにあるかを示しただけのものになってしまう。もっとも一 枚一枚の地図がバイナリーデータで有無だけ示すように作ってあれば,重ね合 わせることによっていろいろな特徴間の相関関係を見るのに有利であるから, その意味では役立つことはあろう。 3. 単色の手動による記号付与をした言語地図の試作 さて,Linguistic Atlas of Asia やLinguistic Atlas of Asia and Africa では同じ地域 に数種類もの語族が入り混じって分布することがあるため,語族ごとに違う色 を与えて,重ね合わせたときに色で語族が識別できるようにした。その場合, 語族内は規定の色で単色で描画することとなる。 これは実は以前はごく普通の条件であり,カラー印刷は黒一色の印刷の 4倍 のコストがかかるので,通常は黒一色で地図を出すことが求められていた。こ の条件下でいかに解釈を明瞭に読み取れる地図を描くかの工夫が重ねられて きたので,先人の智慧に学べばよいこととなる。このような厳しい条件がない 場合は,色を自在に使えばよく,単色でセンスを磨いた後ならば容易に適応で きるので,小文では扱わないこととする。 単色で地図を描く場合は,記号の形をさまざまなものに散らばらせたり,大 きさにメリハリをつけることがカギとなる。クラ・ダイ語族では濃紺一色を使 ってきたが,以下の例では黒一色で作図例を挙げることとしたい。 それではまず「基本」から,ということで,ArcGIS online で基本図形として 提供されている丸・四角・菱形・三角などを使い,15 ピクセルの同一の大きさ で描画した地図 3を見てみよう。これは音形の違いは捨象してある。 『地理言語学研究』 | Studies in Geolinguistics 5 114 図3:基本記号で同一色・同一サイズで描画した地図 一見して視認性が悪いことが見て取れると思う。ベタの丸・四角・菱形・三 角だけ使用することの不利を理解していただくための例であった。 これまでの経験からして,最高頻度のタイプには最も目立たない小さな記号 を与えておくと,他のタイプを突出しやすくなることが分かっている。そこで, 黒い点を与えることとし,Aタイプの音形違いの下位分類には丸型系の記号で 統一してみよう。また黒ベタと白抜きでは同じピクセルの記号でも黒ベタのほ うが大きく印象に残り,白抜きは影が薄くなることが分かっているので,大き さも 15 ピクセルに機械的に統一することはせず,見えた感じによって臨機応 変に調整していくこととしたい。 以上までのプロセスで戸惑ったこととしては,レイヤーの「追加」ボタンを クリックしても自分の入力したデータを取り込む画面が現れず、右端の∨のボ タンをクリックしないとだめで,しかもはじめは「ファイルからレイヤーを追 加」のボタンが現れず,何度か操作し直してやっと表示されるようになる,と いったことがあった。しかし,システム内の記号でなく,外部の記号を使用す る段になって,Chrome を使っているにも関わらずドラッグ・アンド・ドロッ プが使えないところで先に進めなくなり,「万事休す」の感を催した。新しい PC・ソフトを使い始めると決まって経験する蹉跌である。悪戦苦闘の末,GIF 画像を保存して読み込むことで外部記号が使用できることが分かり,ようやく 遠藤「言語地図を描くプロセス」 115 図4:途中までやりかけた地図 這い上がった。 気を取り直して当初意図していた作業を途中までやりかけたのが図 4であ るが,一晩寝た後の朝,これは失敗作であると悟り,方針を大幅に変えること とした。 その理由は,まずこれまでのところで既に少数例に大きな記号を与えて目立 つようにしてあり,この先更に一連の少数例を追加していくとかかなり密集し た感じになり訳が分からなくなるだろうからである。これまでは多数派は音声 差は捨象して語彙レベルだけで表示し,この地図で丸系の記号になっているの はぜんぶ小さな黒丸で表示してきたので,それならば問題ないのだが,このケ ースの場合,音声差が非常に重要な意味を持っており,頭子音が違えばすべて 『地理言語学研究』 | Studies in Geolinguistics 5 116 違う下位区分を与えたので,このような記号選択になったのであった。そこで, ここまで描画した範囲のうちの多数派はもっと目立たない線系の記号を与え ることとしたい。 もう一つ,図 4を見るとただちに理解できるように,中国では系統的な方言 調査資料が数多く得られるのに対して東南アジア地域では零細な資料が多く, 地点密度がまばらであり,このバランスがとれる記号の大きさの選択でいつも 苦労している。そして,図 4からして結果的にはタイ東部の車のハンドル型の 記号で示したセーク語以北を収め,西側は雲南あたりの記号が入るあたりまで 入れれば,それ以外の地理分布は単純なので捨象してよい,という結論がこの たびも得られる。それによって広西あたりの記号が密集している地域を大きく 表示できる利点がある。ちなみに,セーク語は -lで終わる音節を保っており, それは他のすべてのクラ・ダイ語族では -nに合流している,などのように古 風な特徴を示すことが多く,重要地点である。ただし,タイでは大規模な方言 通信調査の結果がまとめられており,また方言地理学の博論・修論も多く出て おり,そういうものを集成できれば地点密度を格段に上げることができる項目 もある。またベトナム北部のタイ系言語の多地点の方言調査を進めている院生 がベトナムにいて,その博論が出ればベトナムの空白もかなり埋められる希望 もある。ラオス・ミャンマー・インドに関しても最善を尽くせば地点密度をず っと上げられる潜在的条件があることは承知しているが,諸般の事情により実 現できずにいる。 更に,「月 moon」の語形の分類を先にやったため,month のほうには現れ ないタイプが欠番になっており,実は moon に関しても month の地理分布のほ うがより早期の地理分布を留めていると推定すべきであることを作図の過程 で悟り,まず month に即して語形分類を行うべきことが明らかとなった。 ハンコで手作業で方言地図を作成していた頃ならば,中途で方針を転換する と再作図はゼロからやり直さなければならなかったが,PC ならば試行錯誤が かなり簡単にできるので,再分類して,それに合わせてエクセルデータの語形 分類のセルの入力も改め,大局観に基づき細部の整合性が取れた地図の再描画 に取り掛かるのも躊躇せずにできるようになった。 4. さしあたりの到達点 そうすると,この主題は本来は Linguistic Atlas of Afro-Eurasia の課題である moon に付随して入力しておいたものなので,本来の課題と関連づけて論ずる 必要からすると同地図集の Kra-Dai の規定色である濃紺を使ったほうが好ま しいこととなる。その結果が,地図 5と地図 6である。 分類については地図 6につけておき,それぞれの類に該当する語形は図 6の 後に表 1として掲げておく。 遠藤「言語地図を描くプロセス」 117 図5:全体図 分類が最も本質的な部分であり,そのためには様々な音形を示す語の語源の 同定作業が必要であり,参照できる限りにおいて比較言語学的研究を総動員す る必要がある。しかしながら,比較言語学で扱われている地点数はふつうは多 くとも数十地点くらいであり,方言学で扱う数百地点のすべてに及んでいるわ けではない。そこで,かなりの程度に heuristic なアプローチに依らざるを得ず, 音韻対応をきちんと把握した上ではないが,第一近似としてこの辺は同源であ ろう,という判定をしていかなければならない。 具体例に即して言うと,A類はタイ語(バンコク方言など)では dɯan A1 (A1 はタイ祖語の声調)であり,それに類似する音形のものを含めることと なる。「類似する」というのはずいぶん大雑把な表現であり,これは本来的に は自然音類のようなものを事前にマニュアル化しておいて得られるものでは 『地理言語学研究』 | Studies in Geolinguistics 5 124 参考文献/References 遠藤光曉(2011)20 世紀初台灣原住民語言地圖:「手」和「五」,『臺灣語文研究』6(2): 1– 14。https://doi.org/10.6710/JTLL.201109_6(2).0002 グロータース,W. A.(1976)方言地図の書き方と読み方,『日本の方言地理学のために』141– 165,東京:平凡社。https://ndlsearch.ndl.go.jp/books/R100000002-I000001262583 柴田武(1969)『言語地理学の方法』東京:筑摩書房。https://ndlsearch.ndl.go.jp/books/R100000039I12442743 徳川宗賢編(1979)『日本の方言地図』東京:中央公論社。 Benedict, Paul (1942) Thai, Kadai and Indonesian: a new alignment in Southeastern Asia. American Anthropologist, New Series 44: 576–601. Endo, Mitsuaki (2011) Introduction. Endo, Mitsuaki et al. (eds.) Linguistic Atlas of Asia. Tokyo: Hituzi Syobo. Endo, Mitsuaki (forthcoming 1) Homelands, migration, and dispersion of the Kra-Dai. Proceedings of the sixth International Conference of Asian Geolinguistics. Endo, Mitsuaki (forthcoming 2) Words for the numbers one to ten reflect the migration patterns of the Hlai and Kra people from Taiwan. Matisoff, James. 1975. Rhinoglottophilia: the mysterious connection between nasality and glottality. Ferguson, Charles et al. (eds.) Nasálfest, 265-287. Stanford: Language Universals Project, Department of Linguistics, Stanford University. https://stedt.berkeley.edu/pdf/JAM/Matisoff_1975_rhinoglottophilia.pdf Ostapirat, Weera. 2000. Proto-Kra. Linguistics of the Tibeto-Burman Area 23(1): 1–251. doi: https://doi.org/10.15144/LTBA-23.1.1 出版情報 投稿受理日:2025年8月3日 採用決定日:2025年8月31日