
言語学において、膠着とは、それぞれが単一の統語的特徴に対応する形態素を連結することによって単語が形成される形態学的プロセスである。膠着を広く使用する言語は膠着言語と呼ばれる。例えば、膠着言語であるトルコ語では、evlerinizden (「あなたの家から」)という単語は、ev-ler-in-iz-denという形態素から構成される。膠着言語は、単語が単形態素である孤立言語や、単語が複雑であっても形態素が複数の特徴に対応することがある融合言語と対比されることが多い。
膠着語の例
膠着語は特定の言語族の特徴ではあるが、特定の地理的地域にある複数の言語がすべて膠着語である場合、必ずしも系統学的に関連があるというわけではない。過去には、この仮定に基づいて言語学者は、ウラル語族、テュルク語族、モンゴル語、韓国語、日本語を含むいわゆるウラル・アルタイ語族を提唱した。現代の言語学者はこの提案を物議を醸すものと見ており、[1]代わりにこれを言語収束と呼ぶ人もいる。
上記の提案を評価する際に考慮すべきもう一つの点は、膠着語祖語から発展した言語の中には、膠着語の特徴を失ったものがあるということである。例えば、現代のエストニア語は融合型へと移行している。[2] (また、母音調和など、ウラル語族に典型的な他の特徴も失っている。)
ユーラシアとオセアニア
膠着語の例としては、フィンランド語、エストニア語、ハンガリー語などのウラル語族の言語が挙げられます。これらの言語では日常的に膠着表現が高度に用いられ、ほとんどの単語は2音節以上です。西インド・ヨーロッパ語族の接尾辞で表現される文法情報は、通常、接尾辞に見られます。
ハンガリー語では、ほぼすべての部分で広範な膠着語が使用されています。接尾辞は、接尾辞の役割に基づいて特別な順序で互いに続き、多くの接尾辞が積み重ねられるため、複雑な意味を凝縮した形で伝える単語になります。たとえば、fiaiéi では、語根「fi(ú)-」は「息子」を意味し、後続の 4 つの母音はすべて別々の接尾辞であり、単語全体で「[複数の特性] は彼/彼女の息子に属する」という意味になります。入れ子になった所有格構造と複数形の表現は非常に注目に値します (ハンガリー語では性別が使用されないことに注意してください)。
ペルシア語には膠着語の特徴があり、動詞や名詞の語幹に接頭辞や接尾辞が付くため、分析言語というよりは合成言語となっている。ペルシア語はSOV言語であるため、主要部終止句構造となっている。[3]ペルシア語はトルコ語に似た名詞語根 + 複数接尾辞 + 格接尾辞 + 後置接尾辞構文を使用している。例えば、「私は彼らの車を見ていた」という意味の「mashinashuno nega mikardam」というフレーズは、直訳すると「(車が彼らのところに)(見て)(私はしていた)」となる。最初の単語を分解すると:
mashin(車)+a(複数接尾辞)+shun(所有接尾辞)+o(助詞接尾辞)
ペルシア語の膠着的な性質と、ペルシア語が語根形態素(この例では car)に一定数の従属形態素を付加できるという事実が分かります。
マレー語などのほぼすべてのオーストロネシア語族や、ほとんどのフィリピン語もこのカテゴリに属しており、単純な基本形から新しい単語を形成できます。インドネシア語とマレー語の単語mempertanggungjawabkanは、「説明する」を意味する複合動詞tanggung jawabに能動態、使役、および利益の接辞を追加して形成されます。タガログ語(およびその標準化されたレジスターであるフィリピン語)のnakakapágpabagabag (「動揺させる/不安にさせるもの」) は、語根bagabag (「動揺させる」または「不安にさせる」) から形成されます。
東アジアでは、韓国語は膠着語です。韓国語では、「조사」、「접사」、「어미」の使用により膠着語になります。これらは時制、時間、数、カジュアル、敬語を表します。
日本語も韓国語のように膠着語であり、動詞の形に否定、受動態、過去形、尊敬度、因果関係などの情報が加わります。一般的な例としては、「働かせられたら(働かせられたら)」は使役、受動態または可能、条件の活用を組み合わせて、文脈に応じて2つの意味になります(「(主語)が働かされていたら」と「(主語)が(目的語)を働かせることができれば」)。また、「食べたくなかった(食べたくなかった)」は欲求、否定、過去形の活用を組み合わせて「私は/彼/彼女/彼らは食べたくなかった」を意味します。
- 食べる
- 食べたい
- 食べたくない
- 食べたくなかった
トルコ語は、他のすべてのテュルク語族と同様、膠着語です。極端な例として、 Muvaffakiyetsizleştiriveremeyebileceklerimizdenmişsinizcesineという表現は、トルコ語では1語として発音されますが、英語に翻訳すると「あたかもあなたが、私たちが失敗作を作る者には変えられないような者たちであるかのように」となります。「-siniz」は「you」の複数形で「-sin」は単数形であり、「-im」は「I」であるのと同じです(「-im」は「私の」を意味し、「I」ではありません。元の編集者はこれを「-yim」と間違えたに違いありません)。この2番目の接尾辞は、「Oraya gideyim」(「そこに行ってもいいですか」または「そこに着いたら」)のように使用され、「-imiz」で「we」になります。同様に、この接尾辞は「our」を意味し、「we」を意味し、「we」を意味しません。
タミル語は膠着語です。たとえば、タミル語の「அதைப்பண்ணமுடியாதவர்களுக்காக」(ataippaṇṇamuṭiyātavarkaḷukkāka)という単語は「それができない人のために」を意味し、文字通り「不可能なことをするために、彼は[複数マーカー] [与格マーカー]になる」という意味です。別の例は動詞の活用です。すべてのドラヴィダ語族の言語では、動詞マーカーは時制、人称、および気分を伝えるために使用されます。たとえば、タミル語では、「சாப்பிடுகிறேன்」 ( cāppiṭukiṟēṉ、「私は食べる」) は動詞の語根சாப்பிடு- ( cāppiṭu-、「食べる」) から形成されます。 + 現在時制マーカー-கிற்- ( -kiṟ- ) + 一人称単数接尾辞-ஏன் ( -ēṉ )。
膠着語もバスク語の顕著な特徴です。たとえば、動詞の活用は、動詞の語源に異なる接頭辞または接尾辞を追加することによって行われます。「私はそれらを持ってくる」を意味するdakartzat は、 da (現在時制を示す)、kar (動詞ekarri → 持って来るの語源)、tza (複数を示す)、およびt (主語、この場合は「私」を示す) から形成されます。別の例としては、Etxean =「家の中で」、etxe = 家があります。
アメリカ大陸

膠着語は、イヌイット語、ナワトル語、マプドゥン語、ケチュア語、ツツジル語、カクチケル語、チャパラチ語、キチェ語などのほとんどのネイティブアメリカンの 言語で非常に頻繁に使用されており、1つの単語に、他の言語では複文となる意味を伝えるのに十分な形態素を含めることができます。逆に、ナバホ語にはいくつかの用途で接辞が含まれますが、予測不可能で分離不可能な方法で接辞が重ね合わされているため、融合言語と呼ばれることがよくあります。[要出典]
スロット
上で述べたように、膠着語の典型的な特徴は、接尾辞と統語的カテゴリが 1 対 1 で対応していることです。たとえば、名詞には、数、格、所有格、接続法などの個別のマーカーがあります。これらの接尾辞の順序は固定されています。[注 1]そのため、任意の名詞または動詞を、語幹にいくつかの屈折および派生「スロット」、つまり特定の接尾辞が出現する位置、および/または接頭辞のいくつかの「スロット」が続くものと見なすことができます。特定の文法カテゴリの最も一般的なインスタンスにはマークが付いていない、つまり対応する接尾辞が空であることがよくあります。
品詞のスロット数は驚くほど多い。例えば、韓国語の動詞には7つのスロットがある(内側の丸括弧は、音韻環境によっては省略される可能性のある形態素の一部を示す)[4] 。
- 敬称:-( eu)si ((으)시)は話者が文の主語を敬うときに使われる。
- 時制: -(eo)ss (었) は完了した(過去の)動作または状態を表します。このスロットが空の場合、時制は現在として解釈されます('ss' は子音の後ろに置かれた場合 't' と発音されます。たとえば、-었어(eoss-eo) は (eosseo) と発音されますが、-었다(eoss-ta) は (eotta) と発音されます。'ss' で終わるすべてのインスタンスに同じルールが適用されることに注意してください。)
- 経験的対照相: -(eo)ss (었) 過去形マーカーを二重にすると、「主語は動詞によって説明される経験をした」という意味になります。
- 助動詞: -gess (겠) は、一人称主語では明確な未来を表す場合にのみ使用され、二人称または三人称主語では、可能性のある現在または過去を表す場合にも使用されます。
- 正式: -(eu)pni ((으)ㅂ니) は聞き手に対して丁寧さを表します
- 回想相: -deo ; (더) は、話者が過去に観察したことを思い出し、現在の状況を報告することを示す。
- 法: 平叙文の場合は-da (다)、疑問文の場合は-kka (까)、命令文の場合は-ra/-la (라)、主張文の場合は-ja (자)、丁寧な平叙文の場合は-yo (요)、その他多数の法を表す記号
さらに、受動態や使役態の動詞は、語幹に接尾辞を追加することで派生することができ、これはヌル番目のスロットとして見ることができます。
接尾辞の組み合わせによっては不可能なものもありますが (たとえば、アスペクト スロットの 1 つだけが空でない接尾辞で埋められるなど)、単一の語源から 400 を超える動詞の形を形成できます。以下は、語根ga「行く」から形成された例です。数字は、どのスロットに空でない接尾辞が含まれているかを示しています。
- 7 (命令法マーカー): 命令形接尾辞-ra (라) が語根ga- (가) と結合して命令形を表す:
- ga-ra (ガラ) 「行け!」
- 7 (肯定法マーカー): 命令ではなく命題を表現したい場合には、肯定法マーカーが使用されます: -ra (라)の代わりに-ja (자) が使用されます:
- ga-ja (가자) 「さあ行こう!」
- 5と7: 話し手が聞き手に敬意を表したい場合、丁寧さを表すマーカー-(eu)pni ((으)ㅂ니) (スロット5) を使用します。さまざまな法則マーカーを同時に使用できます (スロット7、つまり丁寧さを表すマーカーの後)。
- ギャップニダ(갑니다) 「彼は行きます。」
- ギャップニッカ? (갑니까) 「彼は行きますか?」
- 6: 回顧的側面:
- ジョン・イ・ジベ・ガデオラ(존이 집에 가더라) 「私はジョンが家に帰るのを観察しましたので、今あなたに報告します。」
- 7: 単純な直説法:
- ソンセンニムイ ジベ ガンダ(선생님이 집에 간다) 「先生がお帰りになります。 (敬意や礼儀正しさを表現していない)」
- 5と7: 聞き手に対する丁寧さ:
- ソンセンニムイ ジベギャップニダ (선생님 이 집 에 갑니다) またはソンセンニムイ ジベガヨ ( 선생님이 집에 가요) 「先生がお帰りになります。 '、
- 1と7: 対象に対する敬意:
- ソンセンニムイ ジベ ガ シンダ(선생님이 집에 가신다) 「(尊敬される)先生がお帰りになります。」
- 1、5、7: 1つの文に2種類の丁寧さが表れている:
- ソンセンニムイ ジブエガシプニダ (선생님이 집에 가셔요 )またはソンセンニムイ ジブエガシプニダ ( 선생님이 집에 가십니다)先生は家に帰ります。 (聞き手と教師の両方に敬意を表します)」
- 2、3、7: 過去形:
- ジョンイ ハクギョエ ガッスダ/ガッタ(존이 학교에 갔다) 「ジョンは学校に行きました (そして今もそこにいます)。」
- ジョンイ ハクギョエ ガスエオッダ/ガスエオタ(존이 학교에 갔었다) 「ジョンは学校に行ってきました(そして戻ってきました)。」
- 4と7: 一人称助動詞:
- nae-ga nae-il ga-gess-da/ga-get-ta (내가 내일 가겠다) 「明日行きます。」
- 4と7: 三人称助動詞:
- ジョンイ・ネイル・ガゲスダ/ガゲタ(존이 내일 가겠다) 「ジョンは明日行くと思います。」
- ジョンイオジェガスゲスダ/ガッゲタ(존이 어제 갔겠다) 「ジョンは昨日出発したと思います。」
接尾辞または接頭辞
ヨーロッパとアジアの膠着語のほとんどは主に接尾辞を伴いますが、東アフリカと南アフリカのバントゥ語族は、接頭辞、接尾辞、重複が非常に複雑に混在していることで知られています。この言語族の典型的な特徴は、名詞が名詞クラスに分類されることです。名詞クラスごとに、特定の単数および複数の接頭辞があり、主語と動詞の一致のマーカーとしても機能します。さらに、名詞はそれを修飾するすべての単語の接頭辞を決定し、主語は同じ動詞句内の他の要素の接頭辞を決定します。
例えば、スワヒリ語の名詞-toto(「子供」)と-tu(「人」)はクラス1に属し、単数接頭辞m-と複数接頭辞wa-を持ちます。名詞-tabu(「本」)はクラス7に属し、単数接頭辞ki-と複数接頭辞vi-を持ちます。[5]次のような文が作られることがあります。
ユル
1SG -それ
m-tu
1SG -人
m-モジャ
1SG -1つ
m-refu
1SG - 背の高い
アーリ
1SG -彼-過去
そうだ
7SG - REL -it
キソマ
7SG -読む
キレ
7SG -それ
キタブ
7SG -ブック
キレフ
7SG -ロング
「あの長い本を読んだ背の高い人。」
ワレ
1PL -それ
ワトゥ
1PL -人
ワウィリ
1PL -2つ
ワレフ
1PL - 背の高い
ワリ
1PL -彼-過去
(w)-o
7PL - REL -it
ヴィソーマ
7PL -読む
ヴィレ
7PL -それ
ヴィタブ
7PL -書籍
ヴィレフ
7PL -長い
「あの長い本を読んでいる背の高い二人。」
定量言語学の文脈では
アメリカの言語学者ジョセフ・ハロルド・グリーンバーグは、1960 年の論文で、いわゆる膠着指数を使用して数値を計算し、研究者がさまざまな言語の「膠着度」を比較できるようにすることを提案しました。[6]グリーンバーグにとって、膠着とは、形態がわずかな変更のみで、またはまったく変更されずに結合されることを意味します。 [7]形態素が自動的であるとは、単一の表層形式 (形態) をとるか、その表層形式がその言語のすべての類似の例に当てはまる音韻規則によって決定される場合です。[8]形態結合点 (単語内で 2 つの形態が出会う位置) は、含まれる形態素が両方とも自動である場合に膠着的であると見なされます。膠着指数は、膠着結合点の数と形態結合点の数の平均比に等しくなります。膠着指数の値が高い言語は膠着語であり、膠着指数の値が低い言語は融合語です。
同じ論文で、グリーンバーグは他の指標をいくつか提案しましたが、その多くは膠着の研究に関連することが判明しています。合成指標は単語あたりの形態素の平均数であり、考えられる最小値は孤立言語(分析言語)の場合は 1 で、現実の値が 3 を超えることはめったにありません。複合指標は単語あたりの語根形態素の平均数に等しくなります(派生形態素や屈折形態素とは対照的です)。派生、屈折、接頭辞、接尾辞の指標はそれぞれ派生形態素、屈折形態素、接頭辞、接尾辞の平均数に対応します。
以下にサンプル値の表を示します: [9]
音声学と膠着語
接辞とその文法機能との 1 対 1 の関係は、その言語で活発に行われている音韻プロセスによって多少複雑になる場合があります。たとえば、次の 2 つの音韻現象は、ウラル語とトルコ語の多くに見られます。
- 子音の段階的変化、つまり、特定の子音群のペアが交互に現れ、ペアの一方が開音節の先頭に現れ、もう一方が閉音節の先頭に(ウラル語族)。
- 子音の無声化同化: 上記と似ているが異なるプロセスで、語幹末尾の無声子音の無声化を同化する。(一部のトルコ語)
- 母音調和。複合語ではない単語では、特定の母音のサブクラスのみが共存することを意味します。
フィンランド語のいくつかの例は、これら2つの規則と他の音韻的プロセスが、形態とその統語的・意味的機能との間の基本的な1対1の関係から逸脱する様子を示している。talo「家」の語形変化には音韻的規則は適用されていない。しかし、2番目の例はいくつかの種類の音韻的現象を示している。[ 10] [11]
極端
実際には役に立たないが、文法の理論的凝集能力を示す、人工的に極端な膠着の例を作ることは可能です。これは「長い単語」の問題ではありません。なぜなら、一部の言語では、複合語や否定接語などとの無限の組み合わせが許可されており、実際の使用では分析構造で表現できる (そして実際に表現されている) からです。
英語はun-whole-some-nessのように、完全にネイティブ(ゲルマン)起源の形態素を膠着させることができるが、一般的に言えば、最も長い単語はラテン語または古代ギリシャ語起源の形態から組み立てられている。古典的な例はantidisestablishmentarianismである。膠着言語は孤立言語よりも複雑な派生膠着を持つことが多いため、同じことをはるかに大規模に行うことができる。たとえば、ハンガリー語では、「非国民化可能性のために」を意味するelnemzetietleníthetetlenségnekなどの単語が実際に使用されることがある。 [12]同様に、legeslegmegszentségteleníttethetetlenebbjeitekkéntのように意味はあるがおそらく決して使用されない単語もある。これは「あなた方のうちの最も冒涜できない人々のほとんどと同じように」を意味するが、ネイティブ話者にとっても解読が難しい。これらは屈折膠着法を使って拡張することができます。たとえば、公式のギネス世界記録はフィンランド語のepäjärjestelmällistyttämättömyydellänsäkäänköhän「体系化されていないという彼/彼女の資質をもってしても、私は疑問に思う」です。これは派生語のepäjärjestelmällistyttämättömyysを語源とし、屈折語尾-llänsäkäänköhänで長くなります。ただし、この単語は文法的に異常です。-kään「また」は否定節でのみ使用され、-kö (疑問) は疑問節でのみ使用されるからです。
非常に人気のあるトルコ語の膠着語はÇekoslovakyalılaştıramadıklarımızdanmışsınızで、「(どうやら / 聞いた話では)あなたは私たちがチェコスロバキア人に変えることができなかった人々の一人ですね」という意味です。この歴史的な言及は、なかなか変えられない個人やグループの中で目立つ人々に対するジョークとして使われます。
一方、Afyonkarahisarlılaştırabildiklerimizdenmişinizcesineは、人々を驚かせないより長い単語で、「あたかもあなたが、私たちがアフィヨンカラヒサールの人々に似せることができた人々の一人であるかのように」という意味です。この主張に最近加わったのが、トルコ語でmuvaffakiyetsizleştiricileştiriveremeyebileceklerimizdenmişinizcesineという単語で、これは「(あなたは)あたかも、私たちが失敗者を作る者(人々を教育しないで失敗させる人)に変えることができなかった人々の一人であるかのように話している」というような意味です。
グルジア語も非常に膠着性の高い言語です。たとえば、「gadmosakontrrevolucieleblebisnairebisatvisaco ( გადმოაკონტრრევოლუციელებლებისნ」という単語აირებისათვისაცო ) は、「(特定されていない誰かが)反革命を再び/反革命する必要があるような人々のためでもあると言いました」という意味になります。
アリストパネスの喜劇『議会の女性たち』には、ギリシャ語のλοπαδοτεμαχοσελαχογαλεοκρανιολειψανοδριμυποτριμματοσιλφιοκαραβομελιτοκατακεχυμενοκιχλεπικοσσυφοφοφατοπεριστεραλευυφοφατοπεριστεραλεκτρυονοπτοκεφαλλιοκιγκλοπελειολαγῳοσιραιοβαφητραγανοπτερύγων という単語が登場する。これは、材料を列挙した単語で名付けられた架空の料理である。これは、当時のアッティカ方言の長い複合語の流行を揶揄するために作られた。 [要出典]
スラヴ語族は膠着語ではなく融合語であると考えられている。しかし、典型的な膠着語に見られるような極端な派生語も存在する。有名な例はブルガリア語のнепротивоконституциослователствувайтеで、憲法に反対して発言するな、第二に憲法に反対して行動するなという意味である。これは、 против against、 конституция constitution(外来語なので内部構成を欠いている)、 слово という語のたった3つの語根から構成されている。残りは、否定を表す束縛形態素(не、先験的、そうでなければ動詞では別々に書かれる)、名詞強意語(-ателств)、名詞から動詞への変換(-ува)、命令法二人称複数語尾(-йте)である。これはかなり珍しい用語ですが、いくつかの使用例があります。例えば、現在のブルガリア憲法が多くの論争や議論、さらにはスキャンダルを伴いながら採択された翌日の 1991 年 7 月 13 日の新聞の見出しなどです。
単語の他の用法凝集そして膠着性の
凝集と凝集という言葉は、ラテン語で「くっつく」を意味するagglutinareに由来します。言語学では、これらの言葉は、ヴィルヘルム・フォン・フンボルトが死後に出版した著作『 Über die Verschiedenheit des menchlichen Sprachbaues und ihren Einfluß auf die geistige Entwicklung des Menschengeschlechts』 [直訳:人間の言語構造の違いとその影響について] が出版された 1836 年以来使用されています。人類の精神的発達について] は、言語を分離型、屈折型、膠着型、組み込み型に分類することを導入しました。[13]
特に古い文献では、膠着語が合成語の同義語として使われることがあります。その場合、膠着語は膠着語と屈折語と呼ばれる言語を包含し、分析語や孤立語の反意語となります。明らかな語源的な動機(結局のところ、屈折語尾も語幹に「接着」されている)に加えて、このより一般的な用法は、膠着語と屈折語の区別が、すでに述べたように明確ではないという事実によって正当化されます。
19世紀後半、多くの言語学者は、言語の進化には自然なサイクルがあると信じていました。孤立型の機能語が主要語に接着され、言語が膠着語になり、その後、音韻過程を通じて形態が融合し、屈折言語が生まれ、最終的に、速い会話では屈折語尾が省略されることが多くなり、屈折が省略され、言語は孤立型に戻ります。[14]
ロード (1960) の次の一節は、凝集という言葉が持つ意味の全範囲をよく示しています。
(凝集...)は、統語的グループとして絶えず出現する 2 つ以上の用語を 1 つの単位に結合させることから成り、その後は分析が困難または不可能になります。
膠着にはさまざまな形がある。フランス語では、welding は complete fusion になる。ラテン語のhanc horam「この時間」はフランス語の副詞単位encoreである。古フランス語のtous jours はtoujoursになり、dès jà (「今から」) はdéjà (「もう」) になる。一方、英語では、God be with youのgood-bye、Wales nutのwalnut、wind-eye (ON vindauga )のwindowなどのまれな組み合わせを除けば、膠着形を構成する単位はそれぞれ独自性を保持している。blackbirdやbeefeaterのような単語は別問題で、単位は保持しているが、最終的な意味はこれらの単位から完全には推測できない。(...)
ソシュールは複合語と真に合成されたあるいは膠着した組み合わせ を区別することを好んだ。[15]
自然言語処理における膠着語
自然言語処理において、形態論が豊富な言語は孤立言語とはまったく異なる種類の問題を提起します。膠着言語の場合、主な障害は単一の語根から得られる語形の数が多いことにあります。すでに述べたように、これらの語形の生成は、特定の言語の音韻プロセスによって多少複雑になります。フィンランド語では、語形と統語機能の基本的な一対一の関係は崩れていませんが、権威ある機関であるフィンランド言語研究所( Kotus ) は、フィンランド語の名詞、形容詞、代名詞、数字の 51 種類の変化をリストしています。
語形の認識では、さらに多くの問題が発生する。現代の言語学的手法は、主にコーパスの活用に基づいているが、語形の候補数が多い場合、コーパスに含まれる語形は必然的にそのごく一部にしかならない。Hajič (2010) は、今日ではコンピュータのスペースと電力が非常に安価であるため、すべての語形候補を事前に生成し、任意の語形のすべての解釈をリストした辞書の形式で保存できると主張している。(辞書のデータ構造は、検索が迅速かつ効率的になるように最適化する必要がある。) Hajič によると、これらの語形の曖昧さを解消することが難しい (膠着語よりも曖昧さが高い屈折語ではさらに困難である)。[16]
他の著者は、スペースは問題ではないというハジッチの見解に賛同せず、語彙集にすべての可能な語形をリストする代わりに、表層語を言語で許容される順序で出現する形態素のシーケンスに分解しようとするモジュールによって語形分析を実装する。このような分析の問題は、膠着語に典型的な形態素境界の数が多いことである。屈折言語の単語には語尾が 1 つしかないため、語を基底語と語尾に分割できる可能性の数は、単語の長さに比例するだけである。複数の接尾辞が単語の末尾に連結される膠着語では、一貫性をチェックしなければならない異なる分割の数は膨大である。このアプローチは、たとえばアラビア語のシステムの開発で使用された。アラビア語では、冠詞、前置詞、接続詞が次の単語と結合し、代名詞が前の単語と結合すると膠着が発生する。Grefenstette らを参照。詳細は(2005)を参照。
参照
注記
- ^ 言語によっては、一部の接辞を予期しない位置に置く必要がある例外が存在する場合があります。
参考文献
- ^ バーナード・コムリー:「序論」、コムリー(1990)7および9ページ。
たとえば、チュルク語族は、ウラル語族、モンゴル語族、ツングース語族と同様に、確立された言語族です。しかし、議論の余地があるのは、これらの個々の語族が、さらに大きな語族のメンバーとして関連しているかどうかです。チュルク語族、モンゴル語族、ツングース語族を含むアルタイ語族の可能性は、かなり広く受け入れられており、ウラル語族、韓国語族、日本語族の一部またはすべてを追加して、この語族のサイズを拡大することを提唱する学者もいます。
たとえば、グリーンバーグによる語順の普遍性に関する研究 (「意味のある要素の順序に関する文法の普遍性の一部」、JH グリーンバーグ編:言語の普遍性、MIT 出版、マサチューセッツ州ケンブリッジ、1963 年、73 ~ 112 ページ) によると、言語が動詞末尾の語順である場合 (つまり、「その男は女性を見た」が文字通り「その女性が見た男」と表現される場合)、前置詞ではなく後置詞も使用される可能性が高く (つまり、「家の中で」は「その家の中」と表現される)、名詞の前に属格が来る可能性も高くなります (つまり、「猫の家」ではなく「猫の家」というパターン)。したがって、動詞末尾の語順、後置詞、前名詞の属格という特徴を偶然共有する 2 つの言語が見つかった場合、これらの特徴の共起は遺伝的関連性の証拠にはなりません。広範囲にわたる遺伝的関係を確立しようとするこれまでの多くの試みは、まさにこの類型的パターンの特性を考慮に入れていないことに起因しています。したがって、トルコ語、モンゴル語、ツングース語、韓国語、日本語がこれらすべての特徴を共有しているという事実は、それらの遺伝的関連性の証拠にはなりません (もちろん、反復する類型的パターンとは関係のない、遺伝的関連性を確立する他の類似点がある場合もあります)。
- ^ レヘチコヴァ(1983)、17ページ:
柔軟に対応することができます。 Projevuje se kongruencí、nedostatkemposesivních sufixů、větší同音異義、同義語、tolika alternacemi、že se dá mluvit or různých deklinacích。 Koncovky jsou většinou fonologicky redukovány、takze ztracejí slabičnou samostatnost。
- ^ ライアン・ムーシュ、アシュリー・レンフロ、マーシャル・ランス(2019年5月15日)。「ペルシア語の統語論」。Scholars Week。
- ^ ナムキル・キム:韓国語、p.890-897、Comrie(1990)。
- ^ 最初の12の例はFromkin et al. (2007) p. 110から引用したもので、以下の調整を加えた: 元々現在完了形(マーカー-me-付き)だった文を過去形( -li )に変更した。また、最後の4つの文の主語を-kapu 'かご'から同じクラスに分類されるtabu '本'に変更した。最後の2つの例は、Benji Wald: Swahili and the Bantu Languages 、p. 1002 in Comrie (1990)から引用した。クラス7の接頭辞については、Mwana Simba Archived 4 May 2011 at the Wayback Machine、Chapter 16 Archived 26 March 2011 at the Wayback Machineを参照。過去形については、第 32 章 Archived 7 April 2011 at the Wayback Machineと動詞ジェネレーター Archived 21 July 2011 at the Wayback Machineを参照してください。
- ^グリーン バーグ、ジョセフ H. (1960)。「言語の形態学的類型論への定量的アプローチ」。国際アメリカ言語学ジャーナル。26 (3): 178–194。doi :10.1086/464575。JSTOR 1264155。
- ^ デニングら。 (1990)、12 ページ。
- ^驚くべきことに、グリーンバーグは英語の複数形 -sが自動的であるとは考えていません。確かに、音声実現-s、-z、-ezの交替は自動的ですが、複数形が-en 、 -∅ などの場合もあります(まれですが)。Denning et al. (1990)、20ページを参照してください。
- ^ グリーンバーグは各言語について100語の単一文章からのみ指数を計算した。表の値はLuschützky (2003)、p. 43から引用したものであり、Greenberg (1954)およびWarren Crawford Cowgill: A Search for Universals in Indo-European Diachronic Morphology , Universals of Language, MIT Press, Cambridge (Massachusetts), 1963, p. 91–113から編集したものである。
- ^ 例はフィンランド語の形態素解析ツールで確認できます。
- ^ フィンランド語には冠詞がないので、英訳における a/the の使用は任意であることに注意してください。
- ^ 例えば、József Végváry 博士の本の中で使用されている:「És mégsem mozog ...」
- ^ この区分は、Luschützky (2003)、p. 17 でフンボルトによるものとされている。日付は Michael Losonsky (ed): Wilhelm von Humboldt: on language、p. xxxvi による (Googlebooks で入手可能)。
- ^ Vendryes (1925)、349ページでは、この仮説は時代遅れであるとすでに述べており、3種類のプロセスがすべて同時に存在するというより現代的な見解を述べています。Vendryesによると、この仮説の支持者には、A. Hovelacque: La linguistique、パリ1888年、F. Misteli: Charakteristik der hauptsächlichsten Typen des Sprachbaus、ベルリン1893年、そして最後にAH Sayce: Introduction to the Science of Language、第2巻、第3版、ロンドン1890年が含まれます。また、別々の段階という当初のコンセプトにかなり近い一節であるLehečková (2003)、18〜19ページと比較してください。
- ^ ロード(1960年)、160ページ。
- ^ Hajič (2010)、要約:
しかし、頭痛の種となっているのは形態論そのものではなく(屈折言語や膠着言語でも同様)、今日の安価なスペースとパワーでは、考えられるすべての形態を適切にハッシュ化されたリストにリストするだけで十分です。問題は、分析言語よりも、形態論的に豊富な言語(おそらく驚くべきことに、膠着言語よりも屈折言語の方が難しい)の方が明らかに難しい、曖昧さ回避の問題です。
文献
- Kimmo Koskenniemi および Lingsoft Oy: フィンランド語形態素解析ツール、Lingsoft Language Solutions、1995–2011。
- バーナード・コムリー(編):『世界の主要言語』、オックスフォード大学出版局、ニューヨーク – オックスフォード、1990年。
- Keith Denning、Suzanne Kemmer (編):On language: selected writings of Joseph H. Greenberg、Stanford University Press、1990 年。選択した部分は Google Books で入手できます。
- ビクトリア・フロムキン、ロバート・ロッドマン、ニーナ・ハイアムズ:言語入門、トンプソン・ワズワース、2007年。
- ジョセフ・H・グリーンバーグ:言語の形態学的類型論への定量的アプローチ、1960年。JSTORおよびDenning et al. (1990)、p. 3-25から入手可能。また、簡潔でわかりやすい要約も掲載されている。
- Gregory Grefenstette、Nasredine Semmar、Faïza Elkateb-Gara:「情報処理および情報検索アプリケーションでアラビア語を扱うためのヨーロッパ言語の自然言語処理システムの修正」、セム語族言語への計算的アプローチ - ワークショップ議事録、ミシガン大学2005年、p. 31-38。[1]で入手可能。
- Jan Hajič:歴史を振り返る: 統計的機械翻訳の始まりと豊富な形態論を持つ言語、IceTAL'10 Proceedings of the 7th international conference on Advances in natural language processing、Springer-Verlag Berlin、ハイデルベルク、2010年。要約は[2]で入手可能。
- Helena Lehečková: Úvod do ugrofinistiky、Státní pedagogické nakladatelství、プラハ 1983。
- ロバート・ロード:『比較言語学を自分で学ぶ』、The English Universities Press Ltd.、セントポールハウス、ロンドン 1967 年(初版 1966 年)。
- Hans Christian Luschützky: Uvedení do typologie jazyků、Filozofická fakulta カルロヴィ大学、プラハ 2003。
- J. ヴェンドリース: 言語 - 歴史への言語学的入門、キーガン ポール、トレンチ、トゥルブナー社、ロンドン 1925 年 (ポール ラディン訳)
外部リンク
- Mwana Simba、スワヒリ語の文法に関するウェブページ。
