音素(/ ˈfoʊniːm /)とは、言語話者が知覚的に単一の基本音(最小の音声単位)とみなす類似した音声の集合であり、単語を区別するのに役立つ。[ 1 ]すべての言語には音素(または手話における空間的・身振り的な同等物)が含まれており、すべての話し言葉には子音と母音の両方の音素が含まれている。音素は、言語、文字、音声、および関連事項の科学的研究を含む学問分野である言語学の一分野である音韻論の下で研究されている。
音素は、伝統的に、書き言葉では、2 つの斜線/で囲まれたグリフ (文字) として表されます。たとえば、/ɒ/ は、英語の単語potの真ん中で使用されている音素、つまり音のセットを示します。この音素の正確な音声的実在はアクセントによって異なり、発音は[ ɔ ]です。ⓘイギリス英語やオーストラリア英語の多くのアクセントでは、 [ ɑ ]ⓘ多くの米国およびアイルランドのアクセントでは、 [ a ]ⓘ は米国の五大湖方言で使われます。それでも、/ɒ/ は、例えばputの/ʊ/やpitの/ɪ/。
cellとset という単語は、最後の子音を除いて同じ音の並びを持っています。つまり、国際音声記号(IPA)では/sɛl/と/sɛt/となります。IPA は音素を表すために使用できる表記体系です。/l/ と /t/ だけで cell と set という単語を区別できるので、/ l /と/ t /は英語の音素の例です。具体的には、/s/とともに子音音素であり、/ɛ/は母音音素です。英語の綴りは、必ずしも音素と密接に一致するわけではありません。たとえば、英語のknot、nut、gnat はすべて子音音素/n/と/t/を共有しており、母音音素/ɒ/、/ʌ/、/æ/のみが異なります。音素転写のもう 1 つの例は/pʊʃt/です。これは、単語pushedの発音を構成する4 つの音素( /p/、/ʊ/、/ʃ/、/t/ )のシーケンスの表記です。
音素、つまり単語を区別する音(または音の集合)は、言語使用者によって知覚の仕方が異なります。たとえば、[ n ]ⓘおよび[ ŋ ]英語では、 ⓘはsin単語とsing(/sɪn/対/sɪŋ/)。しかし、スペイン語などの他の言語では、これらは単一の音素を構成します[pan]と[paŋ]を同じ単語 ( pan : スペイン語で「パン」)の地域的または方言固有の発音として解釈します。このような単一の音素の発音のバリエーションは、言語学者によって異音として知られています。一方、 [ y ]ⓘと[ u ]英語では、 ⓘは通常 1 つの音素のバリエーションとして聞こえますが、フランス語などの他の言語では完全に別々の音素であり、rue(「通り」/ʁy/)とroue(「車輪」/ʁu/)。
言語学者は、IPA でスラッシュを使用して音素を表記し、角括弧を使用して異音を含むより正確な発音の詳細を表記します。彼らはこの区別を音素[ a ]対音声的と表現します。したがって、 tapとtab、またはpatとbatの発音は音素的に表すことができ、スラッシュで囲んで表記されます ( /p/、/b/など)。一方、話者が/p/ をどのように発音するかのニュアンスは音声的に表され、角括弧で囲んで表記されます。たとえば、spitのpは[ p] 、 pitのpは[pʰ]と表記されます。英語では、pit は/p/ の有気異音 (つまり、余分な空気の噴出を伴って発音される) です。
音素が正確には何であるか、また特定の言語を音素論的にどのように分析すべきかについては、様々な見解が存在する。一般的に、音素は、ある言語の通常のネイティブスピーカーによって単一の基本的な音の単位として認識される、音声のバリエーションの集合(または同値類)の抽象化であると考えられている。音素は単語内の音のセグメントの抽象化された基底表現とみなされるが、それらの音素に対応する音声的実現(各音素とその様々な異音)は、実際に発話され、聞こえる表面的な形式を構成する。異音はそれぞれ、特定の単語内または単語内の特定の環境内で技術的に異なる発音を持つが、これらの違いは意味のある区別を生み出すものではない。あるいは、これらの発音のうち少なくとも1つは、そのようなすべての単語で実際に使用でき、それでもなお、その単語は言語の使用者によってその単語として認識される可能性がある。アメリカ英語の例を挙げると、記号tで綴られる音は、 catという単語では通常声門閉鎖音[ʔ] (または同様の声門音化音)で発音され、datingでは歯茎弾音[ɾ]で発音され、stickでは歯茎破裂音[t]で発音され、tieでは有気歯茎破裂音[tʰ]で発音されます。しかし、アメリカ英語話者は、これらの音すべてを (通常は意識的な努力なしに) 単一の音素の異音として知覚または「聞き」ます。その音素は、伝統的に IPA で/t/として表されます。
コンピュータ入力の目的では、ASCII文字のみを使用してIPA記号を表すX-SAMPAなどのシステムが存在する。しかし、特定の言語の説明では、その言語の音素を表すために異なる慣習的な記号が使用される場合がある。音素原理を採用する表記体系を持つ言語では、通常の文字を使用して音素を表すことができるが、この方法は不完全な場合が多い。なぜなら、言語の発音は時間の経過とともに自然に変化し、以前の綴り体系が時代遅れになったり、言語の音を正確に表さなくなったりするからである(詳しくは、下記の「文字と音素の対応」の項を参照)。

音素とは、ある言語または方言の話者によって同じ機能を持つと認識される音、または異なる音のグループのことです。例として、英語の音素/k/があり、これはc at、k it、s c at、s k itなどの単語に現れます。ほとんどのネイティブスピーカーはこれに気づきませんが、ほとんどの英語の方言では、これらの単語の「c/k」の音は同一ではありません。ⓘ [ kʰɪt ]、音は有気音だが、ⓘ [ skɪl ]は無気音です。したがって、これらの単語には、有気形が[kʰ][k]表記される、音声、つまり音素が含まれています。これらの異なる音は、話者が一方を他方の代わりに使用しても単語の意味が変わらないため、同じ音素に属すると考えられています。skillで[kʰ]しれませんが、単語は認識されます。対照的に、他のいくつかの音は、置き換えると意味が変わります。たとえば、[t]異なる単語s t ill、したがって、その音は別の音素 (音素/t/) を表していると考えられなければなりません。
上記のことから、英語では[k]と[kʰ]は単一の音素/k/の異音であることがわかります。しかし、一部の言語では、[kʰ]と[k]は母語話者によって大きく異なる音として認識され、一方を他方に置き換えると単語の意味が変わることがあります。したがって、そのような言語では、2つの音は異なる音素を表します。たとえば、アイスランド語では、[kʰ]は「陽気な」という意味のkáturの最初の音ですが、[k]は「なぞなぞ」という意味のgáturの最初の音です。したがって、アイスランド語には/kʰ/と/k/という2つの異なる音素が存在します。
káturとgátur (上記) のように、1 つの音素のみが異なる単語のペアは、問題となっている 2 つの異なる音素 (この場合は[kʰ]と[k] ) の最小対と呼ばれます。最小対の存在は、2 つの音素が異なる音素を表しているのか、それとも同じ音素の異音なのかを判断するための一般的なテストです。
別の例を挙げると、最小対語のt ipとd ip は、英語では[tʰ]と[d]が別々の音素/t/と/d/に属していることを示しています。これらの単語は意味が異なるため、英語話者はこの2つの音の区別を意識しなければなりません。
アメリカ手話(ASL)などの手話にも、手の形、動き、位置、手のひらの向き、非手動信号またはマーカーといった手話のパラメータのうち、(正確に)1つだけが異なる最小対語が存在する。基本手話は同じままで、パラメータの1つが変わる場合、手話に最小対語が存在する可能性がある。[ 4 ]
しかし、ある音素のペアに最小対がないからといって、必ずしも同じ音素に属するとは限りません。音韻的に非常に異なっているため、話者が同じ音として認識する可能性は低いからです。例えば、英語には[h] ( h atのように) と[ŋ] ( ba ngのように) の最小対がなく、それらが相補分布にあることが示せるという事実は、それらが同じ音素の異音であると主張する根拠として使用できます。しかし、それらは音韻的に非常に異なっているため、別々の音素とみなされます。[ 5 ]このような例は、音素を確立する上で、語彙的文脈ではなく体系的区別が決定的な役割を果たす場合があることを示しています。これは、音素は語彙レベルで対立的であるか、体系レベルで弁別的である最小の音韻単位として定義されるべきであることを意味します。[ b ]
音韻論者は、語彙の中に正確な最小対が存在しなくても、言語話者が 2 つの音を著しく異なるものとして認識していることを示すために、「近似最小対」に頼ることがある。英語の /ʃ/ と /ʒ/ を区別する最小対を見つけるのは難しいが、この2つの子音が異なる音素であると主張することは議論の余地がないようだ。pressure /ˈprɛʃər/ と pleasure / ˈplɛʒər /という2つの単語は、近似最小対として機能する。[ 6 ]これが音素であることの許容される証拠である理由は、追加の差異 ( /r/対/l/ ) には、単一の基底の後部歯茎摩擦音の有声性の違いを何らかの形で条件付けるようなものは何もないからである。しかし、あまり一般的でない単語を考慮すれば、 /ʃ/と/ʒ/の真の最小対を見つけることができる。たとえば、Confucianとconfusionは有効な最小対である。
母音や子音といった分節音素の他に、発音には超分節的な特徴(声調や強勢、音節境界やその他の連結形態、鼻音化、母音調和など)もあり、多くの言語ではこれらが単語の意味を変えるため、音素的な特徴と言えます。
英語などの言語では、音素的アクセントが見られます。例えば、inviteという単語は 2 つあります。1 つは動詞で、2 音節目にアクセントがあります。もう 1 つは名詞で、1 音節目にアクセントがあります (個々の音は変化しません)。アクセントの位置によって単語が区別されるため、完全な音素的仕様にはアクセントの位置の表記が含まれます。動詞の場合は/ɪnˈvaɪt/ 、名詞の場合は/ˈɪnvaɪt/ となります。フランス語などの他の言語では、単語のアクセントはこのような機能を持たないため (その位置は一般的に予測可能であるため)、音素的ではありません (したがって、辞書には通常記載されません)。
音素的な声調は、中国語(北京語)などの言語に見られ、同じ音節でも5つの異なる声調発音を持つことができる。
こうした言語における音調の「音素」は、時に音調音素と呼ばれる。英語のような言語には音素的な音調はないが、強調や態度などの機能のためにイントネーションを用いる。
ある音素に複数の異音が存在する場合、その音素が特定の場面で実際に聞こえる異音は、周囲の音などの音声環境に依存することがあります。通常、同じ環境に同時に出現することのない異音は、相補分布にあると言われます。また、異音の選択は、話者個人やその他の予測不可能な要因に依存する場合もあります。このような異音は自由変異にあると言われますが、異音は特定の音声的文脈の中で選択されるのであって、その逆ではありません。
フォネーム(古代ギリシア語: φώνημα 、ローマ字表記: phōnēma、「発せられた音、発話、話されたもの、言語」[ 7 ] )という用語は、1873年にA. Dufriche-Desgenettesによって初めて使用されたと伝えられているが、それは音声のみを指していた。抽象概念としてのフォネームという用語は、1875年から1895年にかけてポーランドの言語学者ヤン・ボードゥアン・ド・クルトネーとその弟子ミコワイ・クルシェフスキによって開発された[ 8 ] 。この2人が使用した用語はフォネマであり、彼らが心理音声学と呼んだものの基本単位であった。ダニエル・ジョーンズは、西洋世界で初めてフォネームという用語を現在の意味で使用した言語学者となり、彼の論文「セチュアナ語の音声構造」でこの言葉を使用した。[ 9 ]音素の概念はその後、ニコライ・トルベツコイやプラハ学派の他の研究者(1926~1935年)の著作や、フェルディナン・ド・ソシュール、エドワード・サピア、レナード・ブルームフィールドなどの構造主義者の著作で詳細に論じられた。構造主義者の中には(サピアは除く)、音素の認知機能や心理言語学的機能という考えを否定する者もいた。[ 10 ] [ 11 ]
その後、この用語は生成言語学で使用され、再定義され、最も有名なのはノーム・チョムスキーとモリス・ハレによるものであり、[ 12 ]現代音韻論の発展に関する多くの説明の中心であり続けている。しかし、理論的概念またはモデルとしては、他のものによって補完され、さらには置き換えられてきた。[ 13 ]
言語学者の中には(ロマン・ヤコブソンやモリス・ハレなど)、音素はさらに特徴に分解できる可能性があり、そのような特徴が言語の真の最小構成要素であると提唱した者もいる。[ 14 ]特徴は、口語の超分節音素や手話の多くの音素と同様に、時間的に互いに重なり合っている。特徴はさまざまな方法で特徴づけることができる。ヤコブソンらは音響用語で定義し、[ 15 ]チョムスキーとハレは主に調音的基盤を使用したが、いくつかの音響的特徴を保持し、ラデフォゲッドのシステム[ 16 ]は音響用語「歯擦音」の使用を除けば純粋に調音的システムである。
一部の言語の説明において、クロネームという用語は、音素の対照的な長さや持続時間を示すために用いられてきた。声調が音素である言語では、声調音素はトーンネームと呼ばれることがある。こうした言語を研究する学者全員がこれらの用語を用いるわけではないが、決して時代遅れの用語ではない。
音素との類推から、言語学者は他の種類の基礎的な対象を提案し、形態素や文字素のように接尾辞-emeを付けて名前を付けました。これらはエミック単位と呼ばれることもあります。後者の用語はケネス・パイクによって初めて使用され、彼はまた、エミック記述とエティック記述(それぞれ音素と音声から)の概念を言語学以外の分野にも応用するように一般化しました。[ 17 ]
言語では一般的に、単語や音節を任意の音素の並びで構成することはできません。音素の並び方には音韻構造上の制約があり、特定の音素が出現できる環境も決まっています。このような制約によって著しく制限される音素は、制限音素と呼ばれることがあります。
英語では、このような制限の例としては以下のようなものがあります。
音韻構造上の制約の中には、中和現象として分析できるものもある。下記の「中和とアーキフォナム」の項、特に英語の3つの鼻音が破裂音の前に現れる例を参照されたい。
双一意性は、古典的な構造主義音韻論の要件である。これは、特定の音素がどこに現れても、必ずただ一つの音素に一意に割り当てられなければならないことを意味する。言い換えれば、音素と音素の対応関係は、多対多ではなく多対一でなければならない。双一意性の概念は、生成文法以前の言語学者の一部で議論の的となり、 1950年代後半から1960年代初頭にかけて、モリス・ハレとノーム・チョムスキーによって特に批判された。
双固有性要件から生じる問題の一例として、北米英語におけるフラッピング現象が挙げられる。これは、適切な環境下では、/t/または/d/のいずれかが[ɾ]音(歯茎フラップ)で実現される可能性がある。例えば、 hi tt ingとbi dd ing という単語では同じフラップ音が聞こえるが、これは前者の単語では/t/ 、後者の単語では/d/という音素を実現することを意図している。これは双固有性に矛盾するように見える。
こうした事例に関する詳細な議論については、次のセクションを参照してください。
特定の環境で対立する音素が、すべての環境で対立するとは限らない。対立しない環境では、対立は中和されると言われる。このような位置では、特定の音声がどの音素を表しているかが分かりにくくなることがある。絶対的中和とは、基底表現のセグメントが、その音声表現(表層形式)のいずれにも実現されない現象である。この用語は、ポール・キパルスキー(1968)によって導入され、特定の環境で一部の音素が対立しない文脈的中和とは対照的である。 [ 18 ]音韻論者の中には、このような場合に固有の音素を指定すると冗長な情報や恣意的な情報を提供することになるため、指定しないことを好む者もいる。代わりに、彼らは不完全指定の手法を用いる。アーキフォネームは、不完全指定の音素を表すために用いられることがある対象である。
中和の例として、ロシア語の母音/a/と/o/が挙げられます。これらの音素は強勢のある音節では対立していますが、強勢のない音節では対立が失われ、両方とも同じ音、通常は[ə]に弱化されます(詳細は、ロシア語の母音弱化を参照)。このような[ə]を/a/と/o/のいずれかの音素に割り当てるには、形態論的要因 (単語の他の形式でどちらの母音が出現するか、どの屈折パターンが従っているかなど)を考慮する必要があります。場合によっては、これでも明確な答えが得られないことがあります。不完全指定のアプローチを用いた記述では、これらの場合の一部またはすべてにおいて[ə] を特定の音素に割り当てようとはしませんが、この位置にある 2 つの中和された音素を反映した⫽A⫽のようなアーキフォネーム、または統合されていない値を反映した{a|o}などに割り当てられる可能性があります。[ d ]
英語には、3 つの鼻音音素/m, n, ŋ/があり、やや異なる例が見られます。語末の位置では、これらはすべて対立しており、最小の 3 つ組の合計/sʌm/、sun /sʌn/、sung /sʌŋ/で示されています。しかし、/p, t, k/のような破裂音の前 (形態素の境界がない場合) では、任意の位置で可能な鼻音は 1 つだけです。 / p /の前には/m/、/ t/または/d/の前には/n/ 、/k/の前には/ŋ/があり、limp、lint、link ( /lɪmp/、/lɪnt/、/lɪŋk/ ) のようになります。したがって、これらの環境では鼻音は対立的ではなく、一部の理論家によれば、このためここで聞かれる鼻音をいずれかの音素に割り当てるのは不適切である(この場合、音声学的証拠は明確であるにもかかわらず)。代わりに、これらの音素を単一のアーキフォナミーに属するものとして分析し、⫽N⫽のように表記し、limp、lint、linkの基底表現を⫽lɪNp⫽、⫽lɪNt⫽、⫽lɪNk⫽と述べるかもしれない。
後者のタイプの分析は、プラハ学派のニコライ・トルベツコイと関連付けられることが多い。アーキフォナムは、上記の例⫽A⫽と⫽N⫽のように、二重のヴィルグルまたはパイプの中に大文字で表記されることが多い。これら2番目の表記法には、|mn-ŋ|、{m, n, ŋ}、⫽n*⫽などがある。
英語の別の例として、ロシア語の例と同様に完全な音声的収束を伴うものとして、一部のアメリカ英語における/t/と/d/のフラッピング(上記「二重固有性」の項で説明)がある。ここでは、 bettingとbeddingという単語はどちらも[ˈbɛɾɪŋ]と発音される可能性がある。言語学の生成文法理論によれば、話者がこのようなフラッピングを一貫して適用する場合、どの形態素が使用されているかが分かれば、形態論的証拠(例えば、関連形式betとbedの発音)によって、フラッピングがどの音素を表しているかが明らかになる。 [ 19 ]しかし、他の理論家はこのような決定を下すことを好まず、両方のケースでフラッピングを単一のアーキフォナムに単純に割り当て、(例えば)⫽D⫽と表記する。
英語におけるさらなる融合は、/s/ の後の破裂音であり、/p, t, k/ が/b, d, ɡ/と融合します。これは、 skettiやsghettiという別の綴りからも示唆されます。つまり、spin を/ˈspɪn/ではなく/ˈsbɪn/と転写する特別な理由は、その歴史的発展以外にはなく、⫽ˈsBɪn⫽と転写した方が曖昧さが少ないかもしれません。
形態音素は、従来の音素よりも深い抽象度を持つ理論上の単位であり、形態素が構築される単位とみなされます。形態素内の形態音素は、その形態素の異なる異形態において(形態音韻論の規則に従って)異なる方法で表現されることがあります。たとえば、catsやdogsなどの単語に現れる英語の複数形形態素-s は、単一の形態音素とみなすことができ、これは(たとえば)⫽z⫽または|z|と転写される可能性があり、ほとんどの無声子音の後では/s/として( cat sのように)、その他の場合では/z/として( dog sのように)音素的に実現されます。
既知のすべての言語は、人間の発声器官が生成できる多くの可能な音のごく一部しか使用しておらず、異音性のため、異なる音素の数は一般的に識別可能な音の数よりも少なくなります。さまざまな言語は、その体系に含まれる音素の数にかなりの違いがあります(ただし、見かけ上の差異は、分析を行う言語学者の異なるアプローチに起因する場合があります)。言語の音素の総数は、ピラハ語の9~11個、ロトカス語の11個から、 ǃXũの141個までと大きく異なります。[ 20 ] [ 21 ] [ 22 ]
音素的に区別できる母音の数は、ウビフ語やアレンテ語のように2つしかない場合もある。その反対に、バントゥー語のングウェ語には14種類の母音があり、そのうち12種類は長母音または短母音となるため、口母音は26種類、さらに鼻母音(長短)が6種類あるため、合計38種類の母音となる。一方、!Xóõ語は、母音の長さによる追加のバリエーションを除いて、発声法を変えることで31種類の純粋な母音を実現している。子音の音素に関しては、プイナベ語とパプア語のタウアデ語はそれぞれ7種類しかなく、ロトカス語は6種類しかない。一方、!Xóõには 77 個、 Ubykhには81 個の音素があります。英語では、二重母音を含めて 13 ~ 21 個のかなり大きな母音音素セットを使用していますが、子音は 22 ~ 26 個と平均に近い数です。すべての言語を通して、言語あたりの子音音素の平均数は約 22 個、母音音素の平均数は約 8 個です。[ 23 ]
フランス語のように音韻的な声調やアクセントを持たない言語もあれば、広東語やカムスイ語族のいくつかの言語には(数え方によって異なるが)6~9の声調があり、カムスイ・ドン語には同じ基準で9~15の声調がある。クル語族の1つであるウォベ語には14の声調があると主張されているが[ 24 ]、これは議論の余地がある[ 25 ] 。
最も一般的な母音体系は、5 つの母音/i/、/e/、/a/、/o/、/u/から構成されています。[ 26 ] [ 27 ] [ 28 ] 5 つの母音体系を持つ言語は世界中に広がり、無関係な言語ファミリーに及んでいます。最も注目すべき 5 つの母音を持つ言語には、スペイン語、[ 29 ]セルビア・クロアチア語、[ 30 ]ヘブライ語、[ 31 ]タガログ語、[ 32 ]ハワイ語、[ 33 ]日本語などがあります。最も一般的な子音は、/p/、/t/、/k/、/m/、/n/です。[ 34 ]これらの子音を欠く言語は比較的少ないが、実際に存在する。例えば、アラビア語には/p/がなく、標準ハワイ語には/t/がなく、モホーク語とトリンギット語には/p/と/m/がなく、フパ語には/p/と単純な/k/ の両方がなく、口語サモア語には/t/と/n/がなく、ロトカス語とクイリユート語には/m/と/n/がない。
20世紀半ばの音素理論の発展において、音韻論者は、特定の言語の音の音素分析を行う手順や原理だけでなく、音素解の現実性や一意性にも関心を寄せていた。これらは音韻論の中心的な関心事であった。ケネス・パイクが表明した「与えられたデータセットに対して正確な音素分析は1つしかない」[ 35 ]という立場を取る著者もいれば、同じデータに対して同様に有効な異なる分析を行うことができると考える著者もいた。袁仁超(1934)は、論文「音声体系の音素解の非一意性」[ 36 ]の中で、「ある言語の音が与えられた場合、それを音素の集合に還元する方法は通常複数あり、これらの異なる体系や解は単に正しいか間違っているかではなく、さまざまな目的に対して良いか悪いかとしか考えられない」と述べている。言語学者のFWハウスホルダーは、言語学におけるこの議論を「神の真理」(つまり、特定の言語には発見されるべき固有の構造があるという立場)対「まやかし」(つまり、提案された首尾一貫した構造はどれでも同じくらい良いという立場)と呼んだ。[ 37 ]
英語の母音体系のさまざまな分析を用いて、これを説明することができる。英語の音韻論に関する記事では、「英語には特に多くの母音音素がある」とし、「容認発音では20個、一般アメリカ英語では14~16個、オーストラリア英語では20~21個の母音音素がある」と述べている。これらの数字は事実として引用されることが多いが、実際には多くの可能な分析のうちの1つを反映しているにすぎず、英語の音韻論に関する記事の後半では、一部の二重母音と長母音は、/ j /または/ w /に連結した短母音で構成されていると解釈できるという別の分析が提案されている。このアプローチの最も詳細な説明は、TragerとSmith(1951)に見られ、そこではすべての長母音と二重母音(「複合核」)は、短母音と/j/、/w/、または/h/(さらにr音アクセントの場合は/r/)の組み合わせで構成され、それぞれが2つの音素から成り立っている。[ 38 ]通常/aɪ/と転写される母音の転写は/aj/となり、/aʊ/は/aw/となり、/ɑː/は/ah/または綴りに⟨ r ⟩がある場合は、r アクセントで /ar/となります。また、英語の長母音と二重母音を 2 つの母音音素の組み合わせとして扱うことも可能で、長母音は 2 つの短母音の連続として扱われるため、「palm」は /paam/ と表されます。このように、英語には約 7 つの母音音素があると言えますが、シュワーを/ʌ/または他の短母音の異音として扱う場合は 6 つになります。
同時期には、音素分析の正しい基礎について意見の相違があった。構造主義の立場は、分析は音素とその分布のみに基づいて行うべきであり、文法、形態論、母語話者の直感といった外的要因には言及すべきではないというものであった。この立場は、レナード・ブルームフィールドと強く結びついている。[ 39 ]ゼリッグ・ハリスは、音素セグメントの分布を調べることによってのみ、言語の音素を発見できると主張した。[ 40 ]音素の精神主義的な定義について、トゥワデル(1935)は次のように述べている。「そのような定義は無効である。なぜなら、(1)アクセス不可能な『心』の言語的働きについて推測する権利はなく、(2)そのような推測から何の利益も得られないからである。『心』の言語的プロセスそのものは、単純に観察不可能であり、言語的プロセスについての内省は、周知のように薪ストーブの火事である。」[ 10 ]このアプローチは、特定の音または音のグループがパターンのどこに位置するかについてのネイティブスピーカーの直感に重要な役割を与えたエドワード・サピアのアプローチとは反対であった。英語の[ŋ]を例にとり、サピアは、この音が 3 つの鼻音子音音素 (/m/、/n/、/ŋ/) のグループに属しているように見えるにもかかわらず、ネイティブスピーカーは軟口蓋鼻音は実際には [ŋɡ]/ のシーケンスであると感じていると主張した。[ 41 ] 1960 年代に登場した生成音韻論の理論は、音韻論に対する構造主義的アプローチを明確に否定し、サピアの精神主義的または認知的見解を支持した。[ 42 ] [ 12 ]
これらのトピックについては、英語の音韻論#論争の的となっている問題でさらに詳しく議論されています。
音素はアルファベット表記体系の基礎と考えられています。このような体系では、書かれた記号(文字)は、原則として、書かれている言語の音素を表します。これは、アルファベットが特定の言語を念頭に置いて発明された場合に最も顕著です。たとえば、ラテン語アルファベットは古典ラテン語のために考案されたため、その時代のラテン語では、ほとんどの場合、音素と文字の間にほぼ1対1の対応関係がありましたが、アルファベットの考案者は母音の長さによる音素効果を表現しないことを選択しました。しかし、話し言葉の変化は、確立された正書法の変化を伴わないことが多いため(方言の違い、形態音韻論が正書法に与える影響、一部の借用語に対する外国語の綴りの使用など、他の理由もあります)、特定の言語における綴りと発音の対応関係は大きく歪むことがあります。たとえば、英語がこれに該当します。
アルファベット表記体系における記号と音素の対応は、必ずしも一対一の対応ではありません。音素は、英語の⟨sh⟩やドイツ語の⟨sch⟩(どちらも音素/ʃ/を表す)のように、2つ以上の文字の組み合わせ(二重音字、三重音字など)で表されることがあります。また、英語の⟨x⟩が/ gz /または/ ks /を表すように、1つの文字が2つの音素を表すこともあります。さらに、綴りと発音に関する規則(イタリア語の⟨c⟩の発音規則など)が存在する場合もあり、文字と音素の対応関係は複雑になりますが、規則が一貫していれば、綴りから発音を予測したり、その逆を行ったりする能力に影響を与えることはありません。
手話の音素は、発音の特徴の束です。ストコーは、アメリカ手話( ASL)の音素体系を初めて記述した学者です。彼は、 tab(位置の要素、ラテン語のtabulaに由来)、dez(手の形、designatorに由来)、sig(動き、signationに由来)という束を特定しました。一部の研究者は、 ori(方向)、顔の表情、口の動きも識別しています。音声言語と同様に、特徴が組み合わさると音素が作られます。音声言語と同様に、手話にも、1 つの音素だけが異なる最小対語があります。たとえば、ASL の父と母の手話は、位置に関しては最小限の違いしかありませんが、手の形と動きは同じです。したがって、位置は対照的です。
ストコーの用語と表記体系は、手話の音素を記述するために研究者によって使用されなくなりました。ウィリアム・ストコーの研究は、依然として先駆的であると考えられていますが、アメリカ手話や他の手話を十分に特徴づけていないことがわかっています。[ 43 ]例えば、非手動の特徴はストコーの分類には含まれていません。その後、ブレンタリ[ 44 ] 、サンドラー[ 45 ]、ファン・デル・コーイ[ 46 ]によって、より洗練された手話音韻論モデルが提案されました。
手話学と手話言語学(古代ギリシア語のχείρ 「手」に由来)は、以前は手話の研究で使用されていた音韻論と音素の同義語です。これらの用語は、1960 年にギャローデット大学のウィリアム・ストコー[ 47 ]によって造語され、手話とその構成要素を真の完全な言語として記述しようとしました。かつては議論の的となった考え方でしたが、現在では言語学において広く受け入れられています。しかし、ストコーの用語は大部分が放棄されています。[ 48 ]
手話コミュニケーションの基本単位であるチェレムは、機能的にも心理的にも、口語における音素と同等である。言語におけるチェレムの研究であるチェロロジーは、したがって音韻論と同等である。これらのcher語根の用語は、学術文献などで廃止または置き換えられている。代わりに、音韻論と音素(または特徴)という用語が使用され、これは手話と口語の言語的類似性を強調する傾向がある。[ 49 ]
ワットモー教授による「phonemic」と「phonemics」という用語への攻撃は、私を含め多くの人に、<binary data, 3 bytes>理屈っぽいと思われた。そのため、彼が現在では十分に定着しているこれらの用語に対して抱いている反感が、CP XXXVIII (1943), 211 での彼の言葉から想像されるほど根深く一貫したものではないと知って、嬉しく思う。「mathemicsの代わりにmathemicsと言う人はいないし、私自身もphonematicsの代わりにphonemicsと言ったり、phonematicの代わりにphonemic と言ったりはしないし、これからも言うつもりはない。」たまたまホルガー・ペダーセン氏に捧げられた言語学論文集(1937年)に掲載された彼の以前の論文を読み返したところ、彼は「理想的には言語の音素体系は…」という文で始まっているのを見つけた(46ページ)。