言語年代学 (アッティカ・ギリシア語の γλῶττα 「舌、言語」とχρόνος 「時間」に由来)は、比較言語学を含む語彙統計学 の一分野であり、言語間の年代的 関係を扱う。[ 1 ] : 131
この考えは、 1950年代にモリス・スワデシュ がサリッシュ語の内部関係に関する論文で提唱したものです。[ 2 ] 彼は、世界のすべての言語には比較的安定した基本語彙( スワデシュ・リスト と呼ばれる)が存在すること、そして、あらゆる置き換えは、経過時間ごとに一定の割合で放射性崩壊 に似た方法で起こるという2つの仮定に基づいてこの考えを提唱しました。スワデシュは、数学と統計学を用いて、言語が分岐した時期を特定し、分岐が起こったおおよその時期を示す方程式を開発しました。彼の方法は、2つの言語間の分岐日を決定的に特定する方法を提供することで、言語人類学者を支援することを目的としていました。この式は、2つの言語が単一の共通祖先から分岐したと推定されてからのおおよその世紀数を示します。彼の方法はまた、古代言語がいつ存在した可能性があるかについての情報を提供するとも主張していました。[ 3 ]
言語年代学に関する情報を含む研究や文献が多数存在するにもかかわらず、今日では広く使用されておらず、論争に包まれている。[ 3 ] 言語年代学は数千年前からの言語の分離を追跡するが、多くの言語学者は、それが「確実性」というより「可能性」に近いという理由で、この概念に懐疑的である。一方、言語年代学は考古学的年代との関連性から注目を集めていると言う言語学者もいる。言語年代学は考古学的データほど正確ではないが、一部の言語学者は、確かな推定値を提供できると考えている。[ 4 ]
時を経て、スワデシュの方法のさまざまな拡張が発展したが、スワデシュの元の方法は非常によく知られているため、「言語年代学」は通常彼と関連付けられる。[ 1 ] : 133 [ 5 ]
方法論 言語年代学の本来の手法は、言語の中核となる語彙がすべての言語や文化において一定の(あるいは平均的な)速度で置き換えられるという前提に基づいており、時間の経過を測定するために利用できると考えられていた。この手法では、複数の言語に共通する語彙や形態素のリストが用いられる。
リストはモリス・スワデシュによって作成され、借用されにくいと考えられていた(元々は1952年に200項目のリストとして設計されたが、スワデシュ(1955)[ 6 ] の洗練された100語のリストは現代の言語学者の間でははるかに一般的である)。
中核語彙は、人称代名詞、身体部位、天体や生物、基本的な動作の動詞、数詞、基本的な形容詞、親族関係を表す語、自然現象や出来事など、あらゆる人間の言語に共通する概念を網羅するように設計されました。[ 7 ] 基本的な単語リストを通して、特定の文化や時代に特有の概念を排除することができます。単語リストを区別することで、理想は実際には不可能であり、意味セットは比較対象の言語に合わせて調整する必要があることがわかっています。単語リストは研究全体を通して均一ではなく、研究対象の両方の言語に合うように変更および設計されることがよくあります。言語学者は、使用されているすべての単語が文化的に偏りのない単語リストを見つけるのは難しいと考えています。[ 8 ] 他の言語学者によって多くの代替単語リストがまとめられており、多くの場合、意味スロットが少なくなっています。
次に、単語リストにおける同族語 (共通の語源を持つ単語)の割合を測定する。同族語の割合が高いほど、比較対象の2つの言語が分岐したのは比較的最近のことであると推定される。
声門時定数 単語リストの決定は、形態素の衰退または語彙の変化に依存します。言語年代学を言語に適用するには、形態素の衰退が一定の速度で維持されなければなりません。これは、形態素の衰退速度が歴史を通じて一定であるとは限らないと主張する言語学者もいるため、言語年代学の公式に対する批判につながります。[ 8 ]
アメリカの言語学者ロバート・リーズは 、200語のリストを用いて13組の言語における既知の変化を考慮することで、単語の「言語年代定数」(r )の値を求めました。彼は90%の信頼度で0.8048 ± 0.0176という値を得ました。スワデシュは100語のリストで0.86という値を得ましたが、この高い値は意味的に不安定な単語が除外されたことを反映しています。
分岐時間 モリス・スワデシュ が提唱した声門年代学の基本公式は以下のとおりです。
t = − ln ( c ) 2 ln ( r ) {\displaystyle t=-{\frac {\ln(c)}{2\ln(r)}}} t = 言語のある段階から別の段階までの特定の期間(千年単位で測定)、[ 9 ] c = その期間の終わりに保持された単語リスト項目の割合、r = その単語リストの置換率。
スワデシュは、 t が非言語的データ(古典ラテン語から現代ロマンス語までの概算距離など)によって既知である歴史的に検証可能な事例を検証することにより、 L の経験的値である約 0.14 ( c ? ) に到達しました。これは、置換率が 100 語リストから 1000 語あたり約 14 語であることを意味します。これは以下の表に示されています。
例となる単語リスト 以下は、基本的なトルコ語とその英語訳で構成された基本的な単語リストの例です。[ 16 ]
議論 言語変化の概念は古く、その歴史は Hymes (1973) と Wells (1973) で概説されている。ある意味では、言語年代学は歴史の再構築であり、考古学と密接に関連していることが多い。多くの言語学的研究は、言語年代学の成功が考古学的データと並んで見られることを発見している。[ 4 ] 言語年代学自体は 20 世紀半ばに遡る。[ 6 ] [ 17 ] [ 7 ] この主題の入門は Embleton (1986) [ 18 ] および McMahon と McMahon (2005) [ 19 ]で提供されている。
言語年代学は、正確性の問題だけでなく、その根拠が妥当かどうかという疑問もあって、それ以来ずっと議論の的となってきた(例えば、Bergsland 1958; Bergsland and Vogt 1962; Fodor 1961; Chrétien 1962; Guy 1980)。これらの懸念は、Dobson et al. (1972)、Dyen (1973) [ 20 ] 、Kruskal、Dyen and Black (1973) [ 21 ] によって取り上げられている。単語置換率の仮定は、借用語が含まれる場合に分岐時間の推定を歪める可能性がある(Thomason and Kaufman 1988)。
発表内容は「言語学者が日付を扱わない理由」から、以下で論じるスタロスティンの発表まで多岐にわたる。 [ 22 ] 言語年代学は、その創始以来、多くの言語学者、特に伝統的な比較方法 の学派に属するインド・ヨーロッパ語学者によって否定されてきた。批判に対する回答は、主に次の3つの論点を中心になされている。
スワデシュのリストのみにおける語彙の安定性の高さに対する批判(ハーマン 1990)は的を外している。なぜなら、ある程度の損失は計算を可能にするだけだからである(サンコフ 1970)。単語リストの非均質性は、しばしば言語学者間の理解不足につながる。言語学者は、完全に偏りのない基本的な文化的単語のリストを見つけることにも苦労している。言語学者が実行可能な単語リストを見つけるには長い時間がかかることがあり、使用可能なリストを見つけるには複数のテストリストが必要になる場合がある。[ 8 ] 伝統的な言語年代学は、言語が安定した速度で変化するという前提に基づいている。 したがって、Bergsland & Vogt (1962) では、著者らは、言語外の情報源によって検証可能な実際の言語データに基づいて、アイスランド語 の「変化率」は千年あたり約 4% であるが、密接に関連するリクスマル語 (ノルウェー語の文語) では、20% にも達するという印象的な実証を行っている (Swadesh が提案した「一定の変化率」は千年あたり約 14% とされていた)。 それとその他いくつかの類似例は、スワデシュの公式が入手可能なすべての資料に適用できるわけではないことを効果的に証明した。これは深刻な非難である。なぜなら、L (長期間にわたって記録された言語の歴史)の意味を「調整」するために使用できる証拠は、そもそも圧倒的に多いわけではないからだ。 単語や特徴ごとに置換の可能性が異なる可能性が非常に高い(「各単語には独自の歴史がある」など、他の何百もの情報源がある:[ 23 ] )。 この世界的な前提は、多くの新しい試みにおいて、単語単位、さらには単一言語単位にまで修正され、格下げされてきた(下記参照)。 スワデシュの数学的・統計的手法に対する理解が不足している。一部の言語学者は、統計学は「確率」につながるが、言語学者は「確実性」をより信頼するため、その手法を全面的に拒否している。[ 8 ] 言語変化は、当然ながら予測不可能であり、したがって計算不可能な社会歴史的出来事から生じるという深刻な議論がある。
変更点 スワデシュの当初のコンセプトと、言語年代学の全面的な否定の間には、言語年代学が形式的な言語分析方法として、いくつかの重要な修正によって有効になるという考えがある。このように、置換率の不均一性は、Van der Merwe (1966) [ 8 ] が単語リストをそれぞれ独自の置換率を持つクラスに分割することで対処したが、Dyen、James、Cole (1967) [ 24 ]は各意味に独自の置換率を持たせた。分岐時間と置換率の同時推定は、Kruskal、Dyen、Black [ 21 ] によって研究された。
ブレイナード(1970)は偶然の同族関係を考慮に入れ、グリーソン(1959)はドリフト効果を導入した。サンコフ(1973)は借用パラメータの導入を提案し、同義語を許容した。
サンコフの「完全パラメータ化語彙統計学」では、様々な改良点が組み合わされている。1972年、サンコフは生物学的文脈において集団の遺伝的分岐のモデルを開発した。エンブレトン(1981)は、言語学的文脈においてその簡略版を導出した。彼女はこのモデルを用いて多数のシミュレーションを行い、良好な結果が得られることを示した。
系統発生学 、すなわち時間の経過に伴うDNAの変化を研究する全く異なる科学分野に関連する統計的手法の進歩が、 近年再び注目を集めている。新しい手法は、系統樹上の点を既知の歴史的出来事で較正し、それらの間の変化率を平滑化するため、以前の手法よりも堅牢である。そのため、変化率が一定であるという仮定はもはや必要ない(Gray & Atkinson 2003)。
スタロスティンの方法こうした修正を導入しようとする別の試みは、ロシアの言語学者セルゲイ・スタロスティン によって行われ、彼は次のような提案をした。
ある言語から別の言語へ借用された体系的な借用語は 、混乱要因であり、計算から除外する必要があります。本当に重要なのは、同じ言語の語による「ネイティブ」な置き換えです。この要因を見落としたことが、スワデシュが当初、100語リストからの置き換え率を1000年あたり14語未満と推定した主な理由ですが、実際の置き換え率ははるかに遅い(5~6語程度)です。この修正を導入すると、「ベルクスランド&フォークト」の議論は事実上無効になります。なぜなら、リクスモールのデータを徹底的に分析すると、その基本語彙リストには他のゲルマン語派(主にデンマーク語 )からの借用語が約15~16語含まれており、これらの要素を計算から除外すると、置き換え率は1000年あたり5~6語という予想される「ネイティブ」な置き換え率にまで低下するからです。 変化率は実際には一定ではなく、その単語が言語に存在してきた期間に依存します(語彙素Xが語彙素Yに置き換えられる可能性は経過時間に正比例して増加し、いわゆる「単語の老化」は、獲得された二次的な意味の重みの下で単語の本来の意味が徐々に「侵食」されることとして経験的に理解されています)。 100語のリストに含まれる個々の単語は、それぞれ異なる安定性を持っている(例えば、「I」という単語は、「yellow」という単語よりも置き換えられる可能性がはるかに低い)。 時間依存性と個々の安定性指数を両方考慮に入れた結果として得られる式は次のようになります。
t = ln ( c ) − L c {\displaystyle t={\sqrt {\frac {\ln(c)}{-Lc}}}} この式において、−Lcは、 最も不安定な要素が最初に、そして最も速く置き換えられるため、個々の置換速度が異なることから、置換プロセスの緩やかな減速を反映しており、平方根は逆の傾向、つまり元の単語リストの項目が「古くなり」、意味が変化しやすくなるにつれて置換が加速することを表しています。この式は明らかにスワデシュの元の式よりも複雑ですが、スタロスティンが示したように、以前の式よりも信頼できる結果をもたらし、歴史的知識によって確認できる言語分離のすべての事例とほぼ一致します。一方で、この式は、言語年代学が真に本格的な科学的ツールとして使用できるのは、歴史的音韻論が綿密に研究されている言語族(少なくとも同族語と借用語を明確に区別できるレベルまで研究されている言語族)に限られることを示しています。
参考文献 1 2 Sheila Embleton (1992). 歴史言語学: 数学的概念。W. Bright (編)、国際言語学百科事典 ↑ Swadesh, Morris (1950 年 10 月). "Salish の内部関係" . International Journal of American Linguistics . 16 : 157– 167. doi : 10.1086/464084 . JSTOR 1262898 . S2CID 145122561 . 1 2 オッテンハイマー、ハリエット・ジョセフ( 2006)。言語 の 人類学 。ベルモント、カリフォルニア州:ワズワース、センゲージラーニング。pp. 292–293。ISBN 978-0-495-50884-7 。1 2 Brown, Cecil H. (2006 年 9 月). 「新世界におけるインゲンマメの先史時代の年代記: 言語学的証拠」 . American Anthropologist . 108 (3): 507–516 . doi : 10.1525/aa.2006.108.3.507 . JSTOR 3804627 . ↑ Holm, Hans J. (2007).インド・ヨーロッパ語族の「樹木」の新しい樹木園;新しいアルゴリズムはインド・ヨーロッパ語族の系統発生、さらには先史時代を明らかにできるか?定量言語学ジャーナル 14-2:167–214 1 2 スワデシュ、モリス。(1955)。語彙統計学的年代推定の精度向上に向けて。InternationalJournal of American Linguistics 、 21、121–137 1 2 リーズ、ロバート。 (1953年)。声門年代学の基礎。言語 、 29 (2)、113–127。 1 2 3 4 5 van der Merwe, NJ 1966 「言語年代学のための新しい数学」 Current Anthropology 7: 485–500 ↑ マクマホン、エイプリル;マクマホン、ロバート(2005)。 『数値による言語分類 』OUPオックスフォード、 180ページ 。ISBN 9780191535369 。↑ Swadesh, Morris (1950 年 10 月). "Salish の内部関係" . International Journal of American Linguistics . 16 : 157– 167. doi : 10.1086/464084 . JSTOR 1262898 . S2CID 145122561 . ↑ Arndt, Walter W. (1959). "ゲルマン語における言語年代学の成果". Language . 35 (2): 180– 192. doi : 10.2307/410532 . JSTOR 410532 . ↑ 服部史郎 (1961). 「沖縄の3つの方言に関する言語年代学的研究」. International Journal of American Linguistics . 27 (1): 52– 62. doi : 10.1086/464603 . ISSN 0020-7071 . ↑フレミング、ハロルド C. ( 1973年12月 31日)「ハム語派の下位分類」『 遺伝 言語学における語彙統計学 』De Gruyter、pp. 85–88。doi : 10.1515 /9783110880847-007。ISBN 978-3-11-088084-7 。↑ Munro, Stanley R. (1978). "グロット年代学理論:中国語では有効か無効か?". Canadian Journal of Linguistics . 23 ( 1– 2): 55– 65. doi : 10.1017/S0008413100008707 . ISSN 0008-4131 . ↑ スターク、ルイーザ R. (1973-12-31)。 「声門年代学と西南アメリカの先史時代」。 遺伝言語学における辞書統計学 。デ・グルイテル。ページ 100–107 。 土井 : 10.1515/9783110880847-009 。 ISBN 978-3-11-088084-7 。↑ Pierce, Joe E. (1996年2月). 「グロットクロノロジーとトルコ語の基本語彙」 . American Anthropologist . 68 (1): 137– 143. doi : 10.1525/aa.1966.68.1.02a00150 . JSTOR 668071 . ↑ スワデシュ、モリス (1972)。言語年代学とは何か? M. スワデシュ編『言語の起源と多様化』 (271–284頁 )。ロンドン:ラウトレッジ&キーガン・ポール。 ↑ エンブレトン、シーラ・M. (1986).歴史言語学における統計学 [定量言語学、第30巻]. ボーフム:ブロックマイヤー。ISBN 3-88339-537-4 ― それまでの最先端技術。 ↑ マクマホン、エイプリル、マクマホン、ロバート(2005)『数値による言語分類 』オックスフォード:オックスフォード大学出版局(特に95ページ) ↑ Dyen, Isidore 編 (1973).遺伝言語学における語彙統計学: 1971 年 4 月 3-4 日のイェール会議の議事録 . La Haye: Mouton. 1 2 語彙法による言語系統樹再構築の結果、ジョセフ・B・クラスカル、イシドール・ディエン、ポール・ブラック、「遺伝言語学における語彙統計学」、イシドール・ディエン(編)、ムートン、ハーグ、1973年、30~55ページ ↑ Pereltsvaig, Asya; Lewis, Martin W. (2015年5月5日). 「8 - 言語学者はなぜ日付を扱わないのか? - それとも扱うのか? 第3部 - インド・ヨーロッパ語族の起源を探る」 『インド・ヨーロッパ語族論争:歴史言語学における事実と誤謬』 ケンブリッジ大学 出版局、 159頁以降。doi : 10.1017 / CBO9781107294332.012。ISBN 978-1-107-05453-0 2024年12月25日 に取得 。↑ Kirk JM、St Anderson、JDA Widdowson、1985年『言語地理学研究:イギリスとアイルランドの英語方言』ロンドン:Croom Helm ↑ Dyen, I., James, AT, & JWL Cole 1967 「言語の分岐と推定される単語保持率」 <Language 43: 150–171
参考文献 ベルクスランド、クヌート 、フォークト、ハンス。(1962)。言語年代学の妥当性について。Current Anthropology 、3、115-153 。Brainerd, Barron (1970). 言語変化に関連する確率過程. Journal of Applied Probability 7, 69–78. Callaghan, Catherine A. (1991). Utian と Swadesh リスト。JE Redden (編)、1991 年 7 月と 8 月にカリフォルニア大学サンタクルーズ校で開催されたアメリカ先住民言語会議の論文集 (pp. 218–237)。言語学に関する臨時論文集 (No. 16)。カーボンダル: 南イリノイ大学言語学部。 キャンベル、ライル。(1998)。歴史言語学入門 [第6.5章]。エディンバラ:エディンバラ大学出版局。ISBN 0-7486-0775-7 。 クレティエン、ダグラス(1962)。言語年代学の数学的モデル。 言語 38、11-37。 クロウリー、テリー(1997)。歴史言語学入門。第3版。オークランド:オックスフォード大学出版局。pp. 171–193。 Dyen, Isidore (1965). 「オーストロネシア語の語彙統計学的分類」『国際アメリカ言語学ジャーナル 』、Memoir 19。 Gray, RD & Atkinson, QD (2003): 「言語系統樹の分岐年代はインド・ヨーロッパ語族起源のアナトリア説を支持する」Nature 426–435–439. グズチンスキー、サラ。 (1956年)。辞書統計学の ABC (声門年代学)。ワード 、12、175–210 。 ハールマン、ハラルド。 (1990年)。 「基本的な語彙と言語の接触、声門年代学への幻滅。Indogermanische Forshungen 95:7ff より」 ホケット、チャールズ・F. (1958).現代言語学入門 (第6章). ニューヨーク:マクミラン. ホイジャー、ハリー。(1956)。語彙統計学:批判。言語 、32、49-60 。 Holm, Hans J. (2003).比例性の 罠。あるいは、語彙統計的サブグループ化の何が問題なのか 。Wayback Machine に 2019-06-02 に アーカイブ済み。Indogermanische Forschungen 、108、38–46 。 ホルム、ハンス J. (2005)。 Genealogische Verwandtschaft。キャップ。量的言語学 で45位。アインインターナショナルハンドバッグ。 Herausgegeben von R.Köhler、G. Altmann、R. Piotrowski 、ベルリン: Walter de Gruyter。 Holm, Hans J. (2007). インド・ヨーロッパ語族の「樹木」の新しい樹木園;新しいアルゴリズムはインド・ヨーロッパ語族の系統発生、さらには先史時代を明らかにできるか?. Journal of Quantitative Linguistics 14-2:167–214 Hymes, Dell H. (1960). これまでの語彙統計学。Current Anthropology 、1 (1)、3–44。 マクウォーター、ジョン 。(2001)。バベルの力 。ニューヨーク:フリーマン。ISBN 978-0-7167-4473-3 。Nettle, Daniel. (1999). アメリカ大陸の言語的多様性は、最近の植民地化と調和させることができる。PNAS 96 (6):3325–9。 サンコフ、デイビッド(1970)。「語義関係の置換率について」『言語 』 46.564–569。 Sjoberg, Andree; & Sjoberg, Gideon. (1956). 言語年代学における問題点。American Anthropologist 、58 (2)、296–308。 スタロスティン、セルゲイ。「長距離比較の方法論」。2002年。pdf トマソン、サラ・グレイ、およびカウフマン、テレンス。(1988)。言語接触、クレオール化、および発生言語学 。バークレー:カリフォルニア大学出版局。 ティシュラー、ヨハン、1973 年。Glottochronologie und Lexikostatistik [Innsbrucker Beiträge zur Sprachwissenschaft 11]。インスブルック。 ヴィットマン、ヘンリ (1969)。 「ヒッタイトの通時性に関する辞書統計的調査」インドゲルマニッシュ・フォルシュンゲン 74.1–10。 Wittmann, Henri (1973). 「フランス語を基盤とするクレオール語の語彙統計学的分類」『遺伝言語学における語彙統計学:1971年4月3日~4日開催のイェール会議議事録 』、Isidore Dyen 編、89–99頁。La Haye: Mouton。 ジップ、ジョージ・K. (1965).言語の精神生物学:動的言語学入門. マサチューセッツ州ケンブリッジ:MIT Press.