アルファベットとは、話し言葉の特定の音を多かれ少なかれ表すために、文字と呼ばれる標準的な記号セットを使用する表記体系です。具体的には、文字は、特定の言語で単語を区別できる最小の音素として、音素にほぼ対応しています。 [ 1 ]すべての表記体系がこのように言語を表すわけではありません。音節文字は話し言葉の音節に記号を割り当て、表意文字は単語、形態素、またはその他の意味単位に記号を割り当てます。 [ 2 ] [ 3 ]
最初の文字は古代エジプトで、エジプト象形文字を書くための補助として発明されました。これらは辞書編纂者によってエジプト単音字と呼ばれています。[ 4 ]このシステムは西暦5世紀まで使用され、[ 5 ]それまで発音情報を持っていなかった既存の象形文字に発音のヒントを追加することで根本的に異なっていました。後に、これらの音素記号は外国語を転写するために使用されました。[ 6 ]最初の完全な音素文字は、エジプト象形文字から派生した原シナイ文字で、後に修正されてフェニキア文字が作成されました。フェニキア文字は最初の真のアルファベットと考えられており、アラビア語、キリル文字、ギリシャ語、ヘブライ語、ラテン語、そしておそらくブラーフミーを含む多くの現代の文字の究極の祖先です。[ 7 ] [ 8 ] [ 9 ] [ 10 ]

ピーター・T・ダニエルズは、子音と母音の両方を表すために文字を使用する真のアルファベットを、子音にのみ文字を必要とするアブギダとアブジャドの両方から区別している。アブギダは文字に発音記号を追加して子音を表すが、アブジャドは一般的に母音の指示をまったく持たない。この狭義の意味では、ギリシャ文字が最初の真のアルファベットであった。[ 11 ] [ 12 ]それはもともとアブジャドであるフェニキア文字から派生したものである。 [ 13 ]
アルファベットには通常、文字の標準的な順序があります。そのため、アルファベットは照合において有用なツールとなります。単語を明確に定義された順序(一般にアルファベット順と呼ばれる)でリスト化できるからです。これはまた、文字を順序付けられた項目の「番号付け」の方法として使用できることを意味します。一部のシステムでは、文字に発音とは異なる名前が付けられている現象である頭音化が見られます。頭音化のあるシステムには、ギリシャ語、アラビア語、ヘブライ語、シリア語などがあり、頭音化のないシステムにはラテン語アルファベットなどがあります。
英語のalphabetという単語は、中期英語では後期ラテン語のalphabetumから来ており、これはさらにギリシャ語のἀλφάβητος alphábētosに由来し、ギリシャ語アルファベットの最初の 2 文字、 alpha (α) とbeta (β)から作られました。 [ 14 ]ギリシャ文字の名前は、さらにフェニキア語アルファベットの最初の 2 文字、つまり雄牛を意味するalephと家を意味するbetから来ています。[ 15 ]
古代エジプトの文字体系には、単音字と呼ばれる約24のヒエログリフのセットがありました[ 16 ]。単音字とは、1つの音を表すグリフのことです[ 17 ] 。これらのグリフは、表意文字の発音ガイドとして、文法的な屈折を記述するために、そして後には、借用語や外国語の名前を転写するために使用されました[ 6 ] 。この文字は、西暦4世紀にかなり使用されました[ 18 ] 。しかし、異教の神殿が閉鎖された後、5世紀には忘れ去られ、ロゼッタストーンが発見されるまで使われなくなりました[ 5 ]。また、主にシュメール語を含むいくつかの古代言語を記述するために使用された楔形文字もありました[ 19 ]。楔形文字が最後に使用されたことが知られているのは西暦75年で、その後、この文字は使用されなくなりました。[ 20 ]中期青銅器時代 には、紀元前1840年頃、シナイ半島のエジプトのトルコ石鉱山で、明らかにアルファベット体系である原シナイ文字が出現した。これは、カナン人の労働者によって残されたものと思われる。オーリー・ゴールドワッサーは、読み書きのできないトルコ石鉱夫の落書き説をアルファベットの起源と結びつけている。[ 9 ] 1999 年、アメリカのエジプト学者ジョンとデボラ・ダーネルは、ワディ・エル・ホル渓谷でこの最初のアルファベットのより古いバージョンを発見した。この文字は紀元前1800年頃のもので、紀元前2000年頃のエジプト象形文字の特定の形式から適応した証拠を示しており、最初のアルファベットがその頃に発達したことを強く示唆している。[ 21 ]この文字は、エジプト象形文字に基づいていると考えられている文字の外観と名前に基づいていた。[ 7 ]この文字体系には母音を表す文字がありませんでした。元々は音節文字(音節を文字で表す文字体系)だったと考えられ、不要な記号が削除されたのでしょう。最もよく知られている青銅器時代のアルファベットはウガリット文字で、紀元前15世紀以前にウガリットで発明されました。これはアルファベット楔形文字でした。 30個の記号からなる文字体系で、そのうち3つは後続の母音を示す記号である。この文字体系は紀元前1178年のウガリットの破壊以降は使用されなくなった 。[ 22 ]

原シナイ文字は、紀元前1050年頃までに、慣習的に原カナン文字と呼ばれるフェニキア文字へと発展した。[ 8 ]フェニキア文字で書かれた最古の文書は、紀元前1000年頃のアヒラム王の石棺に刻まれた碑文である。この文字は、すべての西洋アルファベットの祖文字である。紀元前10世紀までに、カナン文字とアラム文字という2つの別の形態が区別されるようになった。アラム文字はヘブライ文字を生み出した。[ 23 ]
南アラビア文字はフェニキア文字の姉妹文字であり、ゲエズ文字の起源となった文字です。アブギダは子音と母音の連続で構成される文字体系です。必須の母音を持たないアルファベットはアブジャドと呼ばれ、アラビア語、ヘブライ語、シリア語などがその例です。聖典を保存する必要性から、母音の省略は必ずしも満足のいく解決策ではありませんでした。「弱い」子音は母音を示すために使用されます。これらの文字は純粋な子音としても使用できるため、二重の機能を持っています。[ 24 ] [ 25 ]
原シナイ文字とウガリット文字は、楔形文字、エジプト象形文字、線文字Bとは対照的に、単語に多くの異なる記号を使用するのではなく、限られた数の記号を使用した最初の文字体系でした。フェニキア文字はおそらく最初の音素文字体系であり、[ 7 ] [ 8 ]約20種類の異なる文字しか含まれていなかったため、商人が習得できるほど単純な文字体系でした。フェニキア文字のもう1つの利点は、単語を音素的に記録していたため、さまざまな言語を記述できたことです。[ 26 ]
フェニキア文字はフェニキア人によって地中海全域に広まった。[ 8 ]ギリシャ文字は、母音が子音とは別の独立した文字形を持つ最初の文字体系だった。ギリシャ人は、ギリシャ語には存在しない音を表す文字を選んで母音を表した。紀元前16世紀からミケーネ文明のギリシャ人が使用していた線文字B音節文字には、5つの母音を含む87の記号があった。初期の頃は、ギリシャ文字には多くの変種があり、そこから多くの異なる文字体系が発展した。[ 27 ]

エウボイア文字のギリシャ文字は、紀元前800~600年頃にギリシャ人植民者によってイタリア半島に持ち込まれ、エトルリア文字など、イタリック語を書くためのさまざまな文字体系を生み出した。[ 28 ]これらのうちの1つがラテン文字となり、ローマ人が共和政を拡大するにつれてヨーロッパ中に広まった。西ローマ帝国の崩壊後も、この文字体系は知的・宗教的な著作の中で生き残った。ラテン語から派生したロマンス語や、西ヨーロッパと中央ヨーロッパの他のほとんどの言語で使用されるようになった 。今日では、世界で最も広く使われている文字体系である。[ 29 ]
エトルリア文字は数百年間ほとんど変化しなかった。エトルリア語自体が変化した時に初めて進化し、存在しない音素を表す文字は削除された。[ 30 ]しかしその後、文字はさまざまな変化を経た。最終的な古典エトルリア文字は20文字で構成され、そのうち4文字は母音(⟨a、e、i、u⟩ )で、以前の文字より6文字少なかった。古典文字は 紀元1世紀まで使用された。エトルリア語自体はローマ帝国時代には使用されなかったが、文字は宗教文書に使用された。[ 31 ]
ラテン文字のいくつかの適応には、デンマーク語とアイスランド語の æ やアルゴンキン語の ⟨ Ȣ ⟩ のように、2 つの文字を組み合わせて 1 つの文字にする合字があります。また、古英語とアイスランド語の⟨ þ ⟩のように、他のアルファベットからの借用があり、これはフサルクルーン文字に由来します。[ 32 ]さらに、古英語とアイスランド語の⟨ ð ⟩のように、既存の文字を修正したものもあり、これはdを修正したものです。ハワイ語やイタリア語のように、ラテン文字のサブセットのみを使用するアルファベットもあり、これらの言語では、j、k、x、y、w は外来語でのみ使用されます。[ 33 ]
もう一つ注目すべき文字は、紀元100年頃から使われ、最終的にはフェニキア文字から派生したエルダー・フサルクです。エルダー・フサルクは、そこから派生したアングロ・フリジア・フソルクやヤンガー・フサルクとともに、ルーン文字を順番に列挙した碑文によく見られる最初の6つのルーン文字にちなんで名付けられています。現存する碑文は石や金属に刻まれていることが多いですが、ブリッゲン碑文のように保存に適した条件が整った場所では有機物に刻まれた碑文も見られます。これらの文字は時を経てラテン文字に取って代わられましたが、 J.R.R.トールキンの作品など、今日でも限られた文脈で使用されています。[ 34 ]

古ハンガリー文字はハンガリー人の文字体系でした。ハンガリーの歴史全体を通して使用されていましたが、公式の文字体系ではありませんでした。19世紀以降、再びますます普及しました。[ 35 ]
グラゴル文字は、典礼言語である古教会スラヴ語の初期の文字体系であり、ギリシャ語のアンシャル体とともにキリル文字の基礎となった。キリル文字は、現代のアルファベット文字体系の中で最も広く使われているものの1つであり、スラヴ語だけでなく、旧ソ連の他の言語でも使われていることで知られている。キリル文字体系には、セルビア語、マケドニア語、ブルガリア語、ロシア語、ベラルーシ語、ウクライナ語などがある。グラゴル文字は聖キュリルとメトディウスによって作られたと考えられている一方、キリル文字は、プレスラフ文学学校の彼らの弟子たち(プレスラフのナウム、プレスラフのコンスタンティン、チェルノリゼツ・フラバルなど)によって作られた。キリル文字体系には、ギリシャ語やヘブライ語から借用または影響を受けたと思われる文字が多数含まれている。[ 36 ]
アジアには多くの表音文字が存在する。アラビア文字、ヘブライ文字、シリア文字、および中東の他のアブジャドは、アラム文字の発展形である。[ 37 ] [ 38 ]
インドと東アジアのほとんどのアルファベット文字は、アラム語の子孫と考えられているブラーフミー文字に由来する。 [ 39 ]
ヨーロッパのアルファベット、特にラテン文字とキリル文字は、アジアの多くの言語に採用されている。アラビア語も広く使用されており、ウルドゥー語やペルシア語のようにアブジャドとして使用される場合もあれば、クルド語やウイグル語のように完全なアルファベットとして使用される場合もある。[ 40 ] [ 41 ]
韓国では、世宗大王が1443年にハングル文字を創製しました。ハングルは独特な文字体系です。特徴的な文字体系であり、[ 42 ] [ 43 ]多くの文字のデザインは発音時の音の位置から来ており、例えばPは口を大きく開けたような形、Lは舌を引っ込めたような形をしています。[ 44 ]ハングルの創製は当時の政府によって計画され、[ 45 ]中国語の漢字と同じように、個々の文字を同じ大きさの音節のまとまりに配置しています。この変更により、複数の文字が積み重なって一つの音節を構成する場合でも、一つの音節が常に一つの文字スペースを占めるという、混合文字表記が可能になりました。[ 46 ]
注音符号(ボポモフォ)は、主に台湾で標準中国語の音を表記するために使われる半音節文字です。1949年に中華人民共和国が建国され、 1956年に漢語ピンインが採用されて以来、中国本土でのボポモフォの使用は限られています。ボポモフォは、1900年代初頭に漢字を基にした中国語の速記法から発展したもので、アルファベットと音節文字の両方の要素を持っています。アルファベットと同様に、音節頭子音は個別の記号で表されますが、音節文字と同様に、音節末子音は表されません。中間子音を除くすべての可能な末子音には独自の文字があり、例えば、luanは注音符号ではㄌㄨㄢ ( lu-an )と表記されます。最後の記号である注音符誅好: ㄢ は、語尾の-an全体として現れます。ボポモフォは主流の表記体系ではありませんが、発音の補助や、コンピューターや携帯電話での中国語文字の入力方法として、ローマ字表記体系と同様の方法でよく使用されます。[ 47 ]
「アルファベット」という用語は、言語学者や古文書学者によって、広い意味でも狭い意味でも使用されています。広い意味では、アルファベットは音素レベルの分節文字です。つまり、音節や単語などの大きな単位ではなく、個々の音に別々の文字があります。狭い意味では、一部の学者は「真の」アルファベットを、アブジャドとアブギダという他の2種類の分節文字と区別しています。これら3つは、母音の扱い方が異なります。アブジャドは子音を表す文字を持ち、ほとんどの母音は表現されません。アブギダも子音ベースですが、母音は発音記号、つまり子音の体系的なグラフィック変更によって示されます。[ 48 ]この意味での最も古い既知のアルファベットは、アブジャドであると考えられているワディ・エル・ホル文字です。その後継であるフェニキア文字は、アラビア文字、ギリシャ文字、ラテン文字(古イタリック文字経由)、キリル文字(ギリシャ文字経由)、ヘブライ文字(アラム語経由)など、現代のアルファベットの祖先である。 [ 49 ] [ 50 ]
現代のアブジャドの例としては、アラビア文字とヘブライ文字があります。[ 51 ]真のアルファベットには、ラテン文字、キリル文字、韓国語のハングルなどがあります。また、ティグリニャ語、アムハラ語、ヒンディー語、タイ語の表記にはアブギダが使用されています。カナダ先住民の音節文字も、その名前が示唆するように音節文字ではなく、アブギダです。なぜなら、各グリフは子音を表し、回転によって次の母音を表すように変更されるからです。真の音節文字では、各子音と母音の組み合わせが別々のグリフで表されます。[ 52 ]
3 種類すべてに音節文字が追加されることがあります。たとえば、ウガリット文字は基本的にアブジャドですが、/ʔa、ʔi、ʔu/の音節文字があります[ 53 ] [ 54 ]母音が示されるのはこれらの場合のみです。コプト文字には/ti/の文字があります。[ 55 ]デーヴァナーガリー文字は通常、語頭の母音専用の文字が追加されているアブギダですが、一部の伝統では、そのような母音のグラフィックベースとしてゼロ子音अ を使用しています。 [ 56 ] [ 57 ]
3 種類の分節文字の境界は必ずしも明確ではありません。たとえば、ソラニクルド語はアラビア文字で書かれていますが、アラビア文字は他の言語で使用される場合はアブジャドです。クルド語では母音の表記が必須であり、文字全体が使用されるため、この文字は真のアルファベットです。他の言語では、強制母音発音記号付きのセム語アブジャドが使用される場合があり、事実上アブギダになります。一方、モンゴル帝国のʼPhags-pa 文字はチベットのアブギダに非常に近いものでしたが、母音記号は発音記号としてではなく、前の子音の後に書かれます。短いaは、インド語のアブギダとは異なり、現在アムハラ語とティグリニャ語で使用されているゲエズ文字では書かれません。 「アブギダ」という用語の起源は、短い母音aを子音変化に同化させたことで、アブギダはもはや体系的ではなくなり、定義上、分節文字ではなく音節文字となった。さらに極端なことに、パフラヴィー語のアブジャドは最終的に表意文字となった。[ 58 ]
このように、アルファベットの主な分類は、母音の扱い方を反映しています。声調言語の場合、声調の扱い方に基づいてさらに分類することができます。ただし、さまざまなタイプを区別するための名前はまだ存在しません。一部のアルファベットは、特に声調が大きな機能負荷を担っていない場合、声調を完全に無視します。 [ 59 ]ソマリ語やアフリカおよびアメリカの他の多くの言語のように。 [ 60 ]最も一般的なのは、声調が発音記号で示されることです。これは、ベトナム語(真のアルファベット)とタイ語(アブギダ)の場合のように、アブギダで母音が扱われる方法です。タイ語では、声調は主に子音によって決定され、発音記号は曖昧さを解消するために使用されます。アブギダであるポラード文字では、母音は発音記号で示されます。子音に対する発音記号の位置は、声調を示すために変更されます。[ 41 ]まれに、モン語やチワン語のように、声調を表す別の文字を持つ文字体系もある。[ 61 ]多くの文字体系では、文字や発音記号が使われるかどうかに関わらず、最も一般的な声調はマークされない。これは、インド語のアブギダスで最も一般的な母音がマークされないのと同様である。注音符号では、声調の1つがマークされないだけでなく、インド語のヴィラマのように、声調がないことを示す発音記号がある。
アルファベットは、文字の標準的な順序と関連付けられることが多い。これは照合のため、つまり単語やその他の項目を「アルファベット順」にリストするためである。[ 62 ]
北西セム語の「アブガド」順序[ 63 ]に由来するラテン文字( A B C D E F G H I J K L M N O P Q R S T U V W X Y Z )の順序は既に確立されている。ただし、このアルファベットを使用する言語では、変化した文字(フランス語のé、à、ôなど)や特定の文字の組み合わせ(多重字)の扱いに関して異なる慣習がある。フランス語では、これらは照合のための追加文字とはみなされない。しかし、アイスランド語では、 á、í、öなどのアクセント付き文字は、アクセントなしの文字で表される音とは異なる母音を表す別の文字とみなされる。スペイン語では、ñは別の文字とみなされるが、 áやéなどのアクセント付き母音はそうではない。 llとchも以前は単一の文字とみなされ、lとc の後に別々に並べられていましたが、1994 年にスペイン語アカデミー協会の第 10 回大会で照合順序が変更され、辞書ではll はlkとlmの間に、 ch はcgとciの間に並べられるようになりました。これらの二重音字は形式的には文字として指定されていましたが、2010 年にスペイン王立アカデミーがそれを変更したため、もはや文字とはみなされなくなりました。[ 64 ] [ 65 ]
ドイツ語では、 sch- (ドイツ語の音素/ ʃ /を表す)で始まる単語は、sca-やsci- (いずれも外来語)で始まる単語の間に挿入され、 szの後に 1 文字として現れることはありません。これは、アルバニア語などいくつかの言語とは対照的です。アルバニア語では、dh-、ë-、gj-、ll-、rr-、th-、xh-、 zh-はすべて音素を表し、個別の 1 文字とみなされ、それぞれ⟨d、e、g、l、n、r、t、x、z⟩の後に続きます。ハンガリー語やウェールズ語も同様です。さらに、ウムラウト付きのドイツ語の単語はウムラウトを無視して照合されます。これは、 öとüの文字を採用したトルコ語とは対照的です。トルコ語では、辞書でtuzの後にtüfekのような単語が出てきます。例外として、ドイツの電話帳ではウムラウトはä = aeのように分類されています。これは、 Jägerのような名前がJaeger という綴りでも表示され、話し言葉では区別されないためです。[ 66 ]
デンマーク語とノルウェー語のアルファベットは⟨ æ, ø, å ⟩で終わるが[ 67 ] [ 68 ]、スウェーデン語では慣習的に⟨ å, ä, ö ⟩が最後に来る。しかし、⟨ æ ⟩ は音声的に⟨ ä ⟩に対応し、⟨ ø ⟩と⟨ ö ⟩も同様である。[ 69 ]
初期のアルファベットに決まった順序があったかどうかは不明である。今日では、ハヌノ文字のように、特定の順序ではなく一文字ずつ学習するアルファベットもあり、明確な順序が求められる照合には使用されていない。 [ 70 ]しかし、紀元前14世紀のウガリット語の粘土板十数枚には 、アルファベットが2つの順序で保存されている。1つは、後にフェニキア語で使用されたABCDEの順序で、ヘブライ語、ギリシャ語、アルメニア語、ゴート語、キリル文字、ラテン語でわずかな変更を加えながら継続されている。もう1つはHLĦMで、南アラビアで使用され、今日ではゲエズ語に保存されている。[ 71 ]したがって、両方の順序は少なくとも3000年間安定している。[ 72 ]
古フサルク文字は「フサルク」で始まる無関係な配列を持ち、後に若フサルクで簡略化され、アングロ・フリジア・フソルクで拡張された。[ 73 ]アラビア語は通常その配列を使用するが、アラビア語は数字に使用される伝統的なアブジャディ順序を保持している。[ 74 ]
インドで使用されているブラーフミー文字は、音韻論に基づいた独自の順序を採用しています。文字は、口の中で音がどのように、どこで生成されるかに応じて配置されています。この組織は、東南アジア、チベット、韓国のハングル、さらにはアルファベットではない日本語の仮名にも見られます。 [ 75 ]
フェニキア語では、各文字がその音で始まる単語と結び付けられました。これは頭音化と呼ばれ、サマリア語、アラム語、シリア語、ヘブライ語、ギリシャ語、アラビア語では現在も様々な程度で使用されています。[ 76 ]
ラテン語では頭音表記は廃止されました。子音の前後に母音(通常は⟨e⟩ 、時には⟨a⟩または⟨u⟩ )を付けて文字を表しました。例外はYとZで、これらはエトルリア語ではなくギリシャ語のアルファベットから借用されました。これらはY Graeca(ギリシャ語のY)とzeta (ギリシャ語由来)として知られていました。この相違は、アメリカ英語以外のすべての英語でZをzedと呼ぶように、多くのヨーロッパ言語に受け継がれました。 [ 77 ]時が経つにつれて、名前は変化したり追加されたりすることがあり、例えば、Wの二重 U、フランス語の「二重 V」、英語の Y の名前、アメリカのZ のzeeなどです。英語とフランス語で比較すると、大母音推移が明確に反映されています。A、B、C、D は、今日の英語では/eɪ、biː、siː、diː/と発音されますが、現代フランス語では/a、be、se、de/と発音されます。[ 78 ]フランス語の名前 (英語の名前の由来) は、大母音推移以前の英語の母音の特性を保持しています。対照的に、F、L、M、N、S ( /ɛf、ɛl、ɛm、ɛn、ɛs/ ) の名前は、両言語で同じままです。これは、「短い」母音が大母音推移の影響をほとんど受けなかったためです。[ 79 ]
キリル文字では、元々はスラヴ語の単語を用いた頭音化が見られました。最初の3つの単語は、azŭ、buky、věděで、キリル文字の照合順序はА、Б、Вでした。しかし、これは後にラテン語に似たシステムに置き換えられました。[ 80 ]
ある言語を表すためにアルファベットが採用または開発されると、一般的に正書法が生まれ、アルファベットの基礎となる原理に従って単語の綴りの規則が提供されます。これらの規則は、アルファベットの文字を話し言葉の音素に対応付けます。 [ 81 ]完全な音素正書法では、文字と音素の間に一貫した1対1の対応関係があり、書き手は発音から単語の綴りを予測でき、話し手は綴りから単語の発音を常に知ることができ、その逆もまた同様です。しかし、この理想は実際には通常達成されません。スペイン語やフィンランド語のように、それに近い言語もあります。英語のように、それよりもはるかに大きく逸脱している言語もあります。[ 82 ]
言語の発音は、その表記体系とは独立して進化することが多い。表記体系は、当初は正書法が使用されていなかった言語にも借用されてきた。アルファベットの文字が言語の音素に対応する程度は様々である。[ 83 ]
言語において、文字と音の1対1の対応関係が実現できない理由はいくつか考えられます。
国語は、アルファベットを国の標準と関連付けることで方言の問題に対処することを選択する場合がある。フィンランド語、アルメニア語、トルコ語、ロシア語、セルビア・クロアチア語(セルビア語、クロアチア語、ボスニア語)、ブルガリア語などの国語は、文字と音素がほぼ1対1で対応している非常に規則的な綴り体系を持っている。[ 93 ]同様に、「綴る」に対応するイタリア語の動詞compitare は、イタリア語の綴りが非常に音素的であるため、綴りが通常は些細なため、多くのイタリア人には知られていない。[ 94 ]標準スペイン語では、単語の綴りから発音を判断できるが、逆はできない。音素は複数の方法で表されることがあるが、特定の文字は一貫して発音されるからである。無音文字、鼻母音、エリジョンを使用するフランス語は、綴りと発音の対応があまりないように見えるかもしれない。しかし、発音に関する規則は複雑ではあるものの、一貫性があり、かなりの精度で予測可能である。[ 95 ]
もう一方の極端な例として、英語のような言語では、発音は綴りと一貫して対応しないため、ほとんどの場合、発音を暗記する必要があります。英語の場合、これは正書法が確立された後に大母音推移が起こったことと、英語がさまざまな時期に多数の借用語を獲得し、元の綴りをさまざまなレベルで保持してきたことが原因です。[ 96 ]しかし、英語にも、綴りから発音を予測する一般的な、ただし複雑な規則があります。このような規則は通常成功します。しかし、発音から綴りを予測する規則は失敗率が高いです。[ 97 ]
国によっては、書き言葉を現代の話し言葉に合わせるために、書き言葉の綴り字改革を行うことがあります。これは、単純な綴り字の変更や単語の形の変更から、書き言葉体系全体の切り替えまで多岐にわたります。たとえば、トルコはアラビア文字からラテン文字をベースとしたトルコ語のアルファベットに切り替えました[ 98 ]。また、カザフスタンはソ連の影響でアラビア文字からキリル文字に変更しました。カザフスタンは2021年にラテン文字のバージョンを作成した後、公式の書き言葉をラテン文字に移行する過程にあります[ 99 ] 。ウズベキスタンとトルクメニスタンでは、ラテン文字に切り替える前はキリル文字が公式でした。ウズベキスタンは、アポストロフィでマークされた文字と二重音字の文字に発音記号を使用するようにアルファベットを改革しています[ 100 ] [ 101 ] 。
言語学者が正書法に関係なくあらゆる言語の音を表すために使用する標準的な記号体系は、国際音声記号と呼ばれています。[ 102 ]
{{cite book}}: CS1メンテナンス: 日付と年 (リンク){{cite book}}ISBN /日付の不一致(ヘルプ){{cite book}}: CS1 メンテナンス: その他 (リンク)周明朗(2003)。中国の多言語主義。土井:10.1515/9783110924596。ISBN 978-3-11-017896-8。