
単語とは、意味を持ち、単独で使用でき、中断されない言語の基本要素である。 [ 1 ]言語話者は単語とは何かを直感的に理解していることが多いにもかかわらず、言語学者の間ではその定義について合意が得られておらず、この概念の具体的な基準を見つけようとする多くの試みは依然として議論の的となっている。[ 2 ]理論的背景や記述的文脈に応じて、さまざまな基準が提案されているが、これらは単一の定義に収束していない。[ 3 ] : 13:618「単語」という用語のいくつかの具体的な定義は、例えば音韻論的、文法的、または正書法的な基準に基づいて、さまざまな記述レベルでその異なる意味を伝えるために用いられる。また、この概念は単に日常的な状況で使用される慣習であると示唆する意見もある。[ 4 ] : 6
「単語」の概念は、それ自体では意味を持たないとしても意味を持つ言語の最小単位である形態素の概念とは区別されます。 [ 1 ]単語は少なくとも 1 つの形態素から構成されます。形態素は、形態派生の過程で結合して他の単語を作成することもできます。[ 2 ] : 768英語や他の多くの言語では、単語を構成する形態素には、一般的に少なくとも 1 つの語根(「rock」、「god」、「type」、「writ」、「can」、「not」など) と、場合によってはいくつかの接辞(「-s」、「un-」、「-ly」、「-ness」) が含まれます。複数の語根を持つ単語 (「type][writ]er」、「cow][boy]s」、「tele][graph]ically」は複合語と呼ばれます。短縮形(「can't」、「would've」) は、複数の単語が 1 つにまとめられた単語です。今度は単語が組み合わさって、句(「赤い岩」、「我慢する」)、節(「私は石を投げた」)、文(「私は石を投げたが、外れた」)などの言語の他の要素が形成される。
ほとんどの言語では、「単語」を構成する概念は、文字体系を学ぶ過程で学ぶことができます。[ 5 ]これは英語の場合であり、古代ラテン語やギリシャ語のアルファベットから派生したアルファベットで書かれているほとんどの言語の場合も同様です。英語の正書法では、「rock」、「god」、「write」、「with」、「the」、「not」という文字の並びは単一の形態素の単語とみなされますが、「rocks」、「ungodliness」、「typewriter」、「cannot」は2つ以上の形態素(「rock」+「s」、「un」+「god」+「li」+「ness」、「type」+「writ」+「er」、「can」+「not」)で構成される単語です。
言語学の研究が始まって以来、単語とは何かを定義しようとする試みが数多く行われ、その基準も多岐に渡ってきた。[ 5 ]しかし、すべての言語、すべての言語分析レベルに適用できる満足のいく定義はまだ見つかっていない。ただし、記述の異なるレベルにおいて、「単語」の一貫した定義を見つけることは可能である。[ 4 ]: 6これらの定義には、音声学的・音韻論的レベルでは、単語アクセントや境界マーカーによって理論的に分離できる最小の音素であるとするもの、正書法レベルでは、書き言葉や印刷物における空白によって示されるセグメントであるとするもの、形態論的レベルでは、語形とは異なる、屈折などの文法パラダイムの基本要素であるとするもの、意味論的レベルでは、語彙における最小かつ比較的独立した意味の担い手であるとするもの、そして統語論的レベルでは、文の最小の置換可能かつ代替可能な単位であるとするものなどがある。[ 2 ]: 1285
一部の言語では、これらの異なる種類の単語が一致し、たとえば「音韻的単語」を「文法的単語」と本質的に同じものとして分析することができます。しかし、他の言語では、これらは異なるサイズの要素に対応する場合があります。[ 4 ]: 1このような不明確な状態のため、一部の言語学者は「単語」という用語を完全に避け、代わりに形態素などのより明確に定義された用語に焦点を当てることを提案しています。[ 6 ]
辞書は、言語の語彙を、レマと呼ばれる個別にリストされた形式に分類します。これらは、その言語の書き手が考える「単語」を構成するものを示すものとみなすことができます。この単語の書き言葉の形式は、レクセムを構成します。[ 2 ]: 670-671単語の長さを測る最も適切な方法は、音節または形態素を数えることです。[ 7 ]単語に複数の定義や複数の意味がある場合、議論や話し合いで混乱が生じる可能性があります。[ 8 ]
「単語」という用語の区別できる意味の一つは、音韻論に基づいて定義できます。単語は音節以上の単位であり、分節的特徴や韻律的特徴、あるいは音韻規則との相互作用によって区別できます。オーストラリアの言語であるワルマチャリ語では、語根や接尾辞は1音節しか持たない場合もありますが、音韻的な単語は少なくとも2音節を持たなければなりません。2音節の動詞語根は、例えばluwa-ø 「打て!」のようにゼロ接尾辞を取ることができますが、1音節の語根は、例えばya-nta 「行け!」のように接尾辞を取らなければならず、ワルマチャリ語の単語の分節パターンに適合します。オーストラリアの別の言語であるワティ語のピチャンチャチャラ方言では、単語の中間の音節は子音で終わることができますが、単語の最後の音節は母音で終わらなければなりません。[ 4 ]: 14
ほとんどの言語において、アクセントは音韻的単語の基準となり得る。アクセントが固定されている言語では、アクセントの位置から単語の境界を特定することが可能である。[ 4 ]: 16
多くの音韻規則は、音韻語内、あるいは単語境界を越えてのみ作用する。ハンガリー語では、歯音子音 /d/、/t/、/l/、/n/ は、後続の半母音 /j/ に同化し、対応する口蓋音を生成するが、これは単語内のみである。逆に、外部サンディ規則は単語境界を越えて作用する。この規則の典型的な例はサンスクリット語に見られるが、現代ケルト語における語頭子音の変異や、一部の非ローティック英語方言における連結r現象も、単語境界を示す例として挙げられる。[ 4 ]: 17
音韻的な単語が、私たちが直感的に抱く単語の概念と一致しないことはよくある。フィンランド語の複合語pääkaupunki「首都」は、フィンランド語の単語内の母音調和のパターンに当てはまらないため、音韻的には2つの単語( pää「頭」とkaupunki 「都市」)から成る。逆に、英語のI'll comeというフレーズのように、1つの音韻的な単語が複数の統語的要素から構成されている場合もある。この場合、I'll は1つの音韻的な単語となる。[ 3 ] : 13:618
単語は、話者の内部語彙集における項目と考えることができます。これを語彙素と呼びます。しかし、これは日常会話における「単語」の意味とは異なる場合があります。なぜなら、1つの語彙素にはすべての活用形が含まれるからです。例えば、「teapot 」という語彙素は、単数形の「teapot」と複数形の「teapots」の両方を指します。また、特に膠着語においては、活用形や複合語をどの程度まで語彙素に含めるべきかという問題もあります。例えば、トルコ語では、「家」という語彙素には主格単数形の「ev」と複数形の「evler 」が含まれることはほぼ間違いありません。しかし、規則的な接尾辞によって形成された「 evlerinizden 」(あなたの家から)という単語も含まれるべきかどうかは明らかではありません。また、「black and white」や「do-it-yourself」のような語彙素もあります。これらは複数の単語から構成されていますが、それでも一定の意味を持つ単一のコロケーションを形成しています。[ 3 ] : 13:618
文法語は、一定の順序で(節内の別々の場所にではなく)一緒に現れ、決まった意味を持つ複数の文法要素から構成されるとされている。しかし、これらの基準にはすべて例外がある。[ 4 ]: 19
文法的な単語は固定された内部構造を持ち、その構造が変化すると単語の意味も変化します。多くの派生接辞を名詞に用いることができるディルバル語には、「別の」という意味の双数接尾辞-jarranと接尾辞-gabunがあります。名詞yibiの場合、yibi-jarran-gabun(「別の2人の女性」)またはyibi-gabun-jarran (「他の2人の女性」)のように並べることができますが、接尾辞の順序を変えると意味も変わります。言語話者は通常、単語に特定の意味を関連付け、単一の形態素には関連付けません。例えば、不誠実さについて話すように求められた場合、 -thや-nessなどの形態素の意味に焦点を当てることはほとんどありません。[ 4 ]: 19-20
レナード・ブルームフィールドは1928年に「最小自由形式」の概念を導入しました。単語は、それ自体で成立する最小の意味のある言語単位と考えられています。 [ 9 ] : 11これは、音素(音の単位)と語彙素(意味の単位)を関連付けています。しかし、書かれた単語の中には、それ自体では意味をなさないため、最小自由形式ではないものもあります(たとえば、theとof など)。[ 10 ] : 77一部の意味論者は、いわゆる意味原始語または意味素の理論を提唱しています。これは、直感的に意味のある基本的な概念を表す定義不可能な単語です。この理論によれば、意味素は、循環論法を用いずに、他の単語とその関連する概念的指示の意味を記述するための基礎となります。[ 11 ] [ 12 ]
ミニマリスト理論統語論では、単語(文献では語彙項目とも呼ばれる)は、形式と意味を持つ構造に統合された言語的特徴の「束」として解釈される。 [ 13 ]: 36-37例えば、「koalas」という単語には、意味的特徴(現実世界の物体であるコアラを指す)、カテゴリー的特徴(名詞である)、数的特徴(複数形であり、その領域の動詞、代名詞、指示詞と一致しなければならない)、音韻的特徴(特定の方法で発音される)などがある。

文学的伝統を持つ言語では、何が単語とみなされるかという問題は、正書法に影響されます。単語の区切り文字、典型的にはスペースと句読点は、アルファベット文字を使用する言語の現代の正書法で一般的ですが、これらは文字の歴史の中では比較的新しい発展です。文字エンコーディングでは、単語の分割は、どの文字が単語の区切り文字として定義されているかに依存します。英語の正書法では、複合表現にスペースが含まれる場合があります。たとえば、ice cream、air raid shelter、get up each は、一般的に複数の単語で構成されていると考えられています ( getを除く各構成要素は自由形式であるため)。no one も同様ですが、同様に複合したsomeoneとnobody は単語とみなされます。
文法的に近い言語でも、同じ語順でも異なる扱いをすることがあります。例えば、フランス語の再帰動詞の不定詞は、それぞれの助詞とは別々に扱われます(例:se laver(「体を洗う」))。一方、ポルトガル語ではハイフンで繋がれ(例:lavar-se)、スペイン語では繋がれています(例:lavarse ) 。[ a ]
すべての言語が単語を明示的に区切るわけではありません。中国語は、屈折接辞が少ない分析的な言語であるため、単語を正書法で区切る必要はありません。しかし、中国語には多くの多形態素複合語があり、さまざまな束縛形態素があるため、何が単語を構成するのかを明確に判断するのは困難です。[ 14 ] : 56日本語は、漢字(中国語の文字から借用した文字)と2つの仮名音節文字を切り替えるなど、正書法の手がかりを使用して単語を区切っています。これはかなり緩やかな規則であり、内容語は効果のためにひらがなで書くこともできますが、広範囲にわたって行う場合は、読みやすさを維持するために通常スペースが追加されます。ベトナム語の正書法は、ラテン文字を使用していますが、単語ではなく単音節形態素を区切っています。
単語を構成するものを定義する作業には、ある単語がどこで終わり、別の単語がどこで始まるかを判断することが含まれます。音声に存在する単語の境界を識別する方法はいくつかあります。[ 5 ]

形態論は、単語の形成と構造を研究する学問です。単語はさまざまな形態論的プロセスを経ることがあり、それらは伝統的に派生と屈折という2つの大きなグループに分類されます。派生とは、既存の単語から新しい単語が作られるプロセスであり、意味が調整され、多くの場合、品詞も変化します。例えば、英語では、動詞のto convertは、アクセント移動によって名詞のa convertに、接辞付加によって形容詞のconvertibleに変化します。屈折は、格、時制、性などを示すなど、単語に文法的な情報を付加します。[ 14 ] : 73
合成言語では、単一の語幹(例えば、love)が活用して複数の異なる形(例えば、loves、loving、loved )を持つことがあります。しかし、場合によっては、これらは異なる単語ではなく、同じ単語の異なる形とみなされることもあります。これらの言語では、単語は複数の形態素から構成されていると考えることができます。
特にインド・ヨーロッパ語族では、区別される形態素は以下のとおりである。
したがって、インド・ヨーロッパ祖語の* wr̥dhom は、
哲学者たちは、少なくとも紀元前5世紀以来、言語哲学の基礎を築いて以来、言葉を魅了する対象としてきた。プラトンは、言葉の起源とそれを構成する音の観点から言葉を分析し、言葉は時間の経過とともに大きく変化するものの、音と意味の間には何らかの関連性があると結論づけた。ジョン・ロックは、言葉の使用は「観念の感覚的な印となるべきである」と書いたが、言葉は「特定の発音音と特定の観念の間にある自然なつながりによって選ばれるのではなく、そうであればすべての人々の間に一つの言語しか存在しないことになるので、自発的な強制によって選ばれる。そうすることで、そのような言葉は恣意的にそのような観念の印となる」[ 16 ]としている。ウィトゲンシュタインの思想は、意味の表象としての言葉から、「言葉の意味は言語におけるその使用である」へと移行した[ 17 ]。
各単語は、共通の文法特性に基づいてカテゴリーに属します。一般的に、言語の語彙は、このような単語のグループに複数分類できます。カテゴリーの総数や種類は普遍的ではなく、言語によって異なります。例えば、英語には、the(定冠詞)やa (不定冠詞)などの冠詞と呼ばれる単語群があり、これらは明確性や識別可能性を示します。このカテゴリーは日本語には存在せず、日本語では文脈によってこの違いが示されます。一方、日本語には助詞と呼ばれる単語群があり、名詞句を文法機能や主題関係に基づいて示すために使用されます。英語では、語順や韻律によって名詞句を区別します。[ 18 ]: 21-24
間投詞以外のカテゴリーが人間の言語の普遍的な部分であるかどうかは明らかではありません。自然言語に遍在する基本的な二分法は、名詞と動詞です。しかし、ワカシャン語やサリッシュ語の一部では、すべての内容語が動詞的性質を持つと理解されることがあります。サリッシュ語のルショツィード語では、「名詞のような」意味を持つすべての単語が述語的に使用でき、動詞のように機能します。たとえば、sbiawという単語は、単に「コヨーテ」ではなく、「(は)コヨーテである」と理解できます。[ 19 ] [ 3 ] : 13:631一方、エスキモー・アリュート語では、すべての内容語が名詞として分析でき、行為者名詞が動詞に最も近い役割を果たします。最後に、一部のオーストロネシア語では、この区別が適用可能かどうかは明らかではなく、すべての単語は他のカテゴリーの役割を果たすことができる間投詞として最もよく説明できます。[ 3 ] : 13:631
単語を分類する現在の方法は、紀元前1世紀に古代ギリシア語の単語を名詞、動詞、分詞、冠詞、代名詞、前置詞、副詞、接続詞の8つのカテゴリーに分類したディオニュシオス・トラクスの研究に基づいている。後のラテン語の著述家であるアポロニウス・ディスコルスとプリスキアヌスは、彼の枠組みを自らの言語に適用した。ラテン語には冠詞がないため、彼らはこのカテゴリーを間投詞に置き換えた。形容詞(「幸せな」)、数量詞(「少ない」)、数詞(「11」)は、ラテン語と古代ギリシア語の名詞と形態的に類似しているため、これらの分類では区別されなかった。これらが独立したカテゴリーとして認識されるようになったのは、学者たちが後のヨーロッパ言語の研究を始めたときになってからである。[ 3 ] : 13:629
インドの文法伝統では、パーニニは、単語に付く接尾辞に基づいて、名詞(nāma、suP)と動詞(ākhyāta、tiN)のクラスに同様の基本的な分類を導入しました。一部の単語は、フォーマルな文脈でのスラング、意味が示唆するものとは異なる誤称、またはさまざまな意味の間で混乱が生じる可能性のある多義語など、議論の余地がある場合があります。[ 20 ]
古代ギリシャ語とローマ語の文法伝統では、単語が分析の基本単位でした。与えられた語彙素のさまざまな文法形式が研究されましたが、それらを形態素に分解する試みはありませんでした。[ 21 ] : 70これは、これらの言語の総合的な性質の結果である可能性があります。これらの言語では、単語の内部構造は分析的な言語よりも解読が難しい場合があります。また、文法的な単語や音韻的な単語など、異なる種類の単語の概念もありませんでした。単語は単一の構成要素と考えられていました。[ 4 ] : 269単語(dictiō )は、完全な思考の表現である発話( ōrātiō )の最小単位として定義されました。 [ 21 ] : 70
{{cite book}}: CS1 メンテナンス: その他 (リンク){{cite book}}: CS1 メンテナンス: その他 (リンク){{cite book}}: CS1メンテナンス: 場所の発行元が見つかりません (リンク){{cite book}}: CS1メンテナンス: 場所の発行元が見つかりません (リンク){{cite book}}: CS1 メンテナンス: その他 (リンク){{cite book}}: CS1 メンテナンス: その他 (リンク)