
発音区別符号(発音区別符号マーク、発音区別点、発音区別符号記号、アクセントとも呼ばれる)は、文字または基本グリフに追加されるグリフです。この用語は、古代ギリシャ語の διακριτικός ( diakritikós 、「区別する」) から派生した語で、これはδιακρίνω ( diakrínō、「区別する」) に由来しています。発音区別符号という単語は名詞ですが、限定的な意味で使われることもあります。一方、発音区別符号は形容詞にすぎません。鋭アクセント⟨ó⟩、重アクセント⟨ò⟩、曲折アクセント⟨ô⟩ (すべて 'o' の上に表示される)などの発音区別符号は、アクセントと呼ばれることがよくあります。発音区別符号は、文字の上または下、または文字内や 2 つの文字の間などの他の位置に表示されることがあります。
ラテン文字における分音記号の主な用途は、追加された文字の音価を変更することです。歴史的に、英語は分音記号を使用して、"coöperate" などのあいまいな単語の正しい発音を示してきました。これがないと、<oo> の文字シーケンスが/ˈkuːpəreɪt/と発音されると誤解される可能性があります。他の例としては、鋭アクセントと重アクセントがあり、これは、その位置で通常とは異なる方法で母音を発音する必要があることを示し、たとえば、名詞résumé (動詞resumeとは対照的) で文字 e が 2 回使用されている場合のように、/ə/ に短縮または黙字にしないことや、 doggèd、learnèd、blessèdなどの一部の単語、特に詩の中で通常とは異なる発音になる単語 (たとえば、movèd、Breathèd )の発音を支援することがあります。
英語で発音区別符号が使われている他のほとんどの単語は、綴りをより良く保存するためにフランス語などの言語から借用されたものであり、たとえばnaïveやNoëlの発音区別符号、cafeの鋭アクセント、crêpeの曲折アクセント、façadeのセディーユなどである。しかし、これらすべての発音区別符号は書き言葉では省略されることが多く、英語は現代ヨーロッパの主要言語の中で発音区別符号が日常的に使用されていない唯一の言語である。[a]
他の言語のラテン文字のアルファベットでは、発音区別符号によって同音異義語が区別される場合があります。たとえば、フランス語の là (「the」) とla (「the」) は、どちらも/la/ と発音されます。ゲール語の文字では、子音の上の点は、その子音の軟音化を示します。他の表記システムでは、発音区別符号が他の機能を果たす場合があります。母音指示システム、つまりアラビア語の harakatシステムとヘブライ語の niqqudシステムは、基本アルファベットで伝えられない母音を示します。インドの virama ( ् など) とアラビア語のsukūn ( ـْـ ) は、母音がないことを示します。カンティレーション記号は韻律を示します。その他の用法としては、 それぞれ略語や頭字語を示す初期キリル文字の ティトロストローク ( ◌҃ ) とヘブライ語のゲルシャイム( ״ ) 、アルファベットの文字が数字として使用されていたことを示すギリシャ語の発音区別符号などがあります。ベトナム語と中国の北京語の公式ローマ字表記システムである漢語ピンインでは、発音区別符号は、マークされた母音が出現する音節の 声調を示すために使用されます。
正書法と照合では、発音区別符号で修飾された文字は、新しい別個の文字として扱われるか、文字と発音区別符号の組み合わせとして扱われます。これは言語によって異なり、言語内でもケースごとに異なる場合があります。
場合によっては、文字が「インライン ダイアクリティカル マーク」として使用され、補助グリフと同じ機能を持ち、先行する文字の音を変更する。英語の「sh」と「th」の発音における「h」の場合がそうだ。[2]このような文字の組み合わせは、1 つの別個の文字としてまとめられることさえある。たとえば、ドイツ語では sch という綴りは伝統的に別の文字として扱われることが多かった。たとえば、ウィーンの公共図書館のカード カタログでは、この綴りの単語は、s で綴られる他のすべての単語の後にリストされていた (デジタル化前)。
種類
ラテン文字に基づくアルファベットで使用される分音記号の種類には、次のものがあります。
- アクセント(鋭アクセント、重アクセント、曲折アクセントは、もともとギリシャ語の多音表記において異なる種類のピッチアクセントを示すために使用されていたため、このように呼ばれる)
- 1つの点
- ◌̇ –オーバードットは多くの綴り方や転写で使用されます。例: ȯ
- ◌̣ –アンダードットは多くの綴り方や転写にも使われます。例えばọ
- ◌·◌ –間句はカタルーニャ語 ela geminada (l·l)で使用されます。
- ◌͘ – 右上の点はPe̍h-ōe-jīで使用されます
- title 、現代ラテン語の小文字⟨i⟩と⟨j⟩の上付き文字
- 2つのドット:
- 2つのオーバードット (◌̈ )はウムラウトや分音記号などに使用されます(例:ö) 。
- 国際音声記号(IPA)とALA-LCローマ字表記システムでは、 2つのアンダードット (◌̤)が使用される。
- ◌ː –三角形のコロン。IPA で長母音を示すために使用されます(「点」は円形ではなく三角形です)。
- 曲線
- 縦線
- ◌̩ – 下付き縦線はIPAでは音節を示すために、ライン語文書ではシュワーを示すために使用される。
- ◌̍ – Pe̍h-ōe-jī では上付き縦線が使われます。
- マクロンまたは水平線
- オーバーレイ
- ◌⃓ –文字に縦線を入れる
- ◌̷ –文字に斜線を引いてください。例: ø
- ◌̵ –文字を横切る横棒
- 指輪
- ◌̊ –オーバーリング: 例: å
- 上付き文字のカール
- 下付き文字カール
- 二重マーク(2つの基本文字の上または下)
- 二重の上付き/下付き発音区別符号
- ◌̧ ̧ – ダブルセディラ
- ◌̨ ̨ – ダブルオゴネク
- ◌̈ ̈ – 二重分音記号
- ◌ͅͺ – ダブルイポゲグラム
チルダ、ドット、カンマ、ティトロ、アポストロフィ、バー、コロンなどは、発音区別符号として使われることもありますが、他の用途もあります。
すべての発音区別符号が、修飾する文字の隣に配置されるわけではありません。たとえば、ガーナのワリ語では、アポストロフィは母音の質の変化を示しますが、 'Bulengee方言や'Dolimi方言のように、単語の先頭に配置されます。母音調和のため、単語内のすべての母音が影響を受けるため、発音区別符号の範囲は単語全体になります。ヒンディー語やタイ語の表記に使用されるようなアブギダ文字では、発音区別符号は母音を示し、修飾する子音文字の上、下、前、後、または周囲に配置されます。
ラテンアルファベットの文字⟨i⟩や文字⟨j⟩の上の点(ドット) は、 ⟨i⟩ を隣接する文字のミニム(下線)と明確に区別するための発音区別符号として始まりました。これは 11 世紀にiiのシーケンス( ingenííのように) で初めて登場し、その後、m、n、uに隣接するiに広がり、最終的にはすべての小文字のiに広がりました。⟨j⟩は元々 iの変形であり、点 (ドット) を継承しました。発音区別符号の形状は、当初は今日の鋭アクセントに似ていましたが、15 世紀までに長い装飾文字に発展しました。ローマン体の出現により、今日の丸い点に縮小されました。[3]
東ヨーロッパのいくつかの言語では、子音と母音の両方に発音区別符号が使用されていますが、西ヨーロッパでは、子音の音を変更するために二重音字がよく使用されています。ヨーロッパのほとんどの言語では、母音に発音区別符号が使用されていますが、英語では通常発音区別符号は使用されていません (いくつかの例外があります)。
非ラテン文字特有の発音区別符号
アラビア語
- (「」「」「独立」「」) hamza :声門閉鎖を示します。
- (ــًــٍــٌـ) tanwīn ( تنوين ) 記号:アラビア語で文法的な役割を果たします。記号 ـً は、ـًاのように、最も一般的にはalifと組み合わせて書かれます。
- (ــّـ) shadda : 子音の二重化。
- (ٱ) waṣla : 最も一般的には単語の先頭に来ます。話の冒頭で文字が読まれる場合にのみ発音されるハムザのタイプを示します。
- (آ) madda :ハムザの後にアリフが続く表記法、すなわち ( ءا )。声門閉鎖音に長い/aː/が続く音節音符として読みます。例えば、ءاداب، ءاية، قرءان، مرءاةは、それぞれآداب، آية، قرآن، مرآةと表記されます。この表記法は、ハムザに続くアリフが語幹の一部でない場合は適用されません。例えば、نتوءات はنتوآتと表記されません。語幹نتوءにはハムザに続くアリフがないためです。
- (ــٰـ)上付きアリフ(「短い」または「ダガーアリフ」とも呼ばれる):いくつかのまれな単語の表記で省略される元のアリフの代わり。たとえば、لاكنは、単語の発音にある元のアリフでは表記されず、代わりにلٰكنと表記されます。
- ḥarakāt (アラビア語: حركات、تشكيل tashkīlとも呼ばれる):
- (ــَـ)ファタハ(a)
- (ــِـ)カスラ(i)
- (ــُـ)ダンマ(u)
- (ــْـ)スクン(母音なし)
- ハラカットまたは母音記号には 2 つの目的があります。
- 母音点またはタシュキール (tashkīl) は、子音点またはイジャム( إعجام )と混同しないでください。イジャムとは、同じまたは類似の形式の文字を区別するために子音の上または下に書かれた 1 つ、2 つ、または 3 つの点のことです。
ギリシャ語
これらの発音区別符号は、鋭アクセント、重アクセント、曲折アクセント、および分音記号に加えて使用されます。
- ◌ͺ – iota 添字( ᾳ、εͅ、ῃ、ιͅ、οͅ、υͅ、ῳ )
- ῾◌ –荒い呼吸(古代ギリシャ語: δασὺ πνεῦμα、ローマ字: dasỳ pneûma、ラテン語: spīritus asper ): 誤嚥
- ᾿◌ –スムーズな (またはソフトな) 呼吸(古代ギリシャ語: ψιλὸν πνεῦμα、ローマ字: psilòn pneûma、ラテン語: spīritus lēnis ): 誤嚥の欠如
ヘブライ語

文字は黒、ニクドは赤、カンティレーションは青
(カンティレーション記号は通常は正しく表示されません。Web ブラウザーで表示する可能性を最大限に高める方法の説明を含む完全な表については、ヘブライ語のカンティレーション#タアミムの名前と形状を参照してください。)
韓国語

補助記号〮と〯 は 、中期朝鮮語のハングルで高低アクセントを示すために使われました。縦書きでは音節の左側に、横書きでは音節の上に書かれました。
サンスクリット語とインド語

シリア語
- 文字の上下の点は[a]を表し、aまたはăと表記される。
- 文字の上に斜めに置かれた2つの点は[ɑ]を表し、āまたはâまたはåと表記される。
- 文字の下に横に並んだ2つの点は[ɛ]を表し、eまたはĕと音訳される。東シリア語方言では[ɪ]と発音され、 iと音訳されることが多い。
- 文字の下に斜めに置かれた2つの点は[e]を表し、ēと音訳される。
- ベスの下にある点は柔らかい[v]音を表し、vと表記される。
- ガメルの下に置かれるチルダ(~)は[dʒ]音を表し、 jと音訳される。
- 下に点がある文字「ワウ」は[u]を表し、ūまたはuと音訳される。
- 上に点がある文字「ワウ」は[o]を表し、 ōまたはoと表記される。
- 下に点がある文字Yōḏは[i]を表し、īまたはiと転写される。
- カフの下のチルダ(~)は[ t͡ʃ]音を表し、chまたはčと表記される。
- Pehの下の半円は[f]の音を表し、fまたはphと表記されます。
上記の母音記号に加えて、シリア語の音訳にはə、e̊、または上付き文字のe(または何も付かないこともしばしば)が含まれることがあります。これは、シリア語の発展の過程で後に失われた元のアラム語のシュワーを表すためです。 [4]一部の音訳体系では、スピラント化を示すため、または歴史的な理由から、この記号を含めることが必要であるとされています。[5] [6]
非アルファベット文字
アルファベット以外の文字の中には、基本的に分音記号として機能する記号を使用するものもあります。
- 非純粋アブジャド(ヘブライ文字やアラビア文字など)とアブギダでは、母音を表すために分音記号を使用します。ヘブライ語とアラビア語では、子音の重複や変化も分音記号で示します。ヘブライ語とデーバナーガリー語では、外来語に分音記号を使用します。デーバナーガリー語と関連するアブギダでは、母音の不在を示すためにヴィラマと呼ばれる分音記号も使用します。さらに、デーバナーガリー語では、母音の鼻音化に月点のチャンドラビンドゥ(ँ)を使用します。
- 統一カナダ先住民音節文字では、中音と終音と呼ばれるアルファベットの特性を持つ発音区別符号を含む、いくつかの種類の発音区別符号が使用されています。長母音は元々、音節文字にマイナス線を引いて文字が途切れたように示されていましたが、現代の形式では、上部の点を使用して母音の長さを示します。一部のスタイルでは、上部のリングは[j] オフグライドを伴う長母音を示します。別の発音区別符号である「内側のリング」は、文字の先頭に配置され、[p] を [f] に、[t] を [θ] に変更します。音節文字の横にある「w ドット」などの中音は、音節の頭子音と中核母音の間に [w] が配置されていることを示します。終音は音節の末尾子音を示します。 「h-tick」などの単語の中間位置にある音節末尾の子音の一部は、それに続く音節の子音の強化を示します。
- 日本語のひらがなとカタカナは 濁点( ◌゛) と半濁点(◌゜) (日本語: 濁点、半濁点) 記号を使用しており、にごり(濁「濁る」) または点点(点々 「点々」)とも呼ばれます。 ) と丸(丸「丸」)、有声子音またはその他の音声変化を示します。
- 絵文字は一般的に発音区別記号を使用して作成され、特に人気のある画像掲示板上の日本語の絵文字は発音区別記号を使用して作成されます。
アルファベット順または照合
異なる言語では、発音区別符号をアルファベット順に並べる規則が異なります。たとえば、フランス語とポルトガル語では、順序付けや辞書の目的で、発音区別符号の付いた文字をその基になる文字と同じように扱います。対照的に、スカンジナビア語とフィンランド語では、発音区別符号付きの文字⟨å⟩、⟨ä⟩、および⟨ö⟩ をアルファベットの別個の文字として扱い、⟨z⟩の後に並べます。通常、⟨ä⟩ (a ウムラウト) と⟨ö⟩ (o ウムラウト) [スウェーデン語とフィンランド語で使用] は、 ⟨æ⟩ (ash) と⟨ø⟩ (o スラッシュ) [デンマーク語とノルウェー語で使用]と同等として並べられます。また、 aaが⟨å⟩の代替スペルとして使用される場合、そのように並べられます。発音区別符号によって変更される他の文字は、基になる文字の変形として扱われますが、例外として、⟨ü⟩は頻繁に⟨y⟩として分類されます。
アクセント記号付きの文字を基となる文字の変形として扱う言語では、通常、類似のマークされていない単語の直後にそのような記号が付いた単語をアルファベット順に並べます。たとえば、ドイツ語では、2 つの単語の違いがウムラウトだけである場合、ドイツ語の辞書では、ウムラウトのない単語が最初に並べられます (たとえば、schonと次にschön、またはfellと次にfällen )。ただし、名前の場合 (電話帳や図書館の著者カタログなど)、ウムラウトは母音と接尾辞⟨e⟩の組み合わせとして扱われることが多く、オーストリアの電話帳では現在、ウムラウト付きの文字を (基となる母音の直後に) 別々の文字として扱っています。
スペイン語では、書記素⟨ñ⟩は⟨n⟩とは異なる別個の文字と見なされ、⟨n⟩と⟨o⟩の間に位置付けられます。これは、書記素 ⟨ñ⟩ が単純な⟨n⟩とは異なる音を表すためです。しかし、アクセント付き母音⟨á⟩、⟨é⟩、⟨í⟩、⟨ó⟩、⟨ú⟩は、アクセントのない母音⟨a⟩、⟨e⟩、⟨i⟩、 ⟨o⟩ 、⟨u⟩から分離されていません。これは、スペイン語の鋭アクセントは単語内の強勢を修正するか、同音異義語の区別を示すだけであり、文字の音を修正しないためです。
さまざまな言語の照合順序の包括的なリストについては、「照合順序」を参照してください。
コンピューターによる世代

現代のコンピュータ技術は、主に西ヨーロッパの言語(特に英語)を話す国々で開発され、初期のバイナリエンコードの多くは、発音区別符号なしで書かれる言語である英語を優先して開発されました。コンピュータのメモリとストレージが貴重であったため、初期の文字セットはラテンアルファベット、10桁の数字、いくつかの句読点と慣用記号に限られていました。1963年に初めて発行された米国標準情報交換コード(ASCII)は、わずか95の印刷可能文字をエンコードしました。これには、アキュート、グレイブ、サーカムフレックス、チルダの4つの独立した発音区別符号のみが含まれており、これらはバックスペースして基本文字に重ねて印刷することで使用されました。ISO /IEC 646規格(1967)は、言語に応じて一部のアメリカの書記素を合成文字( ⟨é⟩、⟨è⟩、⟨ë⟩など)に置き換える国別バリエーションを定義しましたが、印刷可能文字は95文字に制限されました。
Unicode は、既知の文字すべてに独自のコードを割り当てることでこの問題を解決するために考案されました。このコードがわかっている場合、ほとんどの最新のコンピュータ システムでは、それを入力する方法が提供されています。歴史的な理由から、ヨーロッパの言語で使用されるほとんどすべての文字とアクセントの組み合わせには、固有のコード ポイントが割り当てられており、これらは合成文字と呼ばれています。他の言語では、通常、目的の基本文字と一緒に結合文字の発音区別符号を使用する必要があります。残念ながら、2024 年現在でも、多くのアプリケーションと Web ブラウザーは、結合発音区別符号の概念を適切に操作できないままです。
キーボードのレイアウトとキーボード マッピングに応じて、コンピューターやタイプライターで発音区別符号付きの文字を入力するのは、多少は簡単です。発音区別符号付きの文字が標準である国で使用されるキーボードには、関連する記号が刻まれたキーがあります。米国国際マッピングや英国拡張マッピングが使用される場合など、その他のケースでは、アクセント記号付きの文字は、最初に発音区別符号付きのキーを押してから、アクセント記号を配置する文字を押すことで作成されます。この方法は、それ自体は出力を生成せず、その後に押されたキーの出力を変更するため、デッド キー手法として知られています。
発音区別符号を含む文字を持つ言語
以下の言語には、発音区別符号付きの文字と発音区別符号なしの文字とは綴り方が異なります。
ラテン文字
バルト
ケルト
- ウェールズ語では、7つの母音⟨a⟩、⟨e⟩、⟨i⟩、⟨o⟩、⟨u⟩、⟨w⟩、⟨y⟩に曲折アクセント、分音アクセント、鋭アクセント、重アクセントを使用します(そのため、複合語⟨â⟩、⟨ê⟩、⟨î⟩、⟨ô⟩、⟨û⟩、⟨ŵ⟩、⟨ŷ⟩、⟨ä⟩、⟨ë⟩、⟨ï⟩、⟨ö⟩、⟨ü⟩、⟨ẅ⟩、⟨ÿ⟩、⟨á⟩、⟨é⟩、⟨í⟩、⟨ó⟩、⟨ú⟩、⟨ẃ⟩、⟨ý⟩、⟨à⟩、⟨è⟩、⟨ì⟩、⟨ò⟩、⟨ù⟩、⟨ẁ⟩、⟨ỳ⟩ )。ただし、サーカムフレックス (マクロンとして使用) 以外はすべてかなりまれです。
- 1970年代以降の綴りの改革により、スコットランド・ゲール語では、どの母音にも使用できる抑音符のみを使用しています(⟨ à ⟩、⟨ è ⟩、⟨ ì ⟩、⟨ ò ⟩、⟨ ù ⟩ )。以前は、特定の母音の質を示すために使用されていた鋭アクセントは、⟨á⟩、⟨ó⟩、および⟨é⟩に使用されていました。これらのアクセントが削除されたため、新しい正書法では、読者が特定の単語の発音を事前に知っていることが必要になります。
- マン島語では、セディーユの発音区別符号⟨ ç ⟩ をh と組み合わせて二重音字⟨çh⟩ (発音は/tʃ/ ) とし、二重音字⟨ch⟩ (発音は/h/または/x/ ) との違いを示します。マン島語で使用されるその他の発音区別符号には、サーカムフレックスと分音記号があり、⟨â⟩、⟨ê⟩、⟨ï⟩などで、綴りが似ているが発音がわずかに異なる2つの単語を区別します。
- アイルランド語では、1948年の綴り改革に従い、長母音を示すために鋭アクセントのみを使用します。ゲール語の書体では、長母音のアクセントはオーバードットで示されます( ⟨ ċ ⟩、⟨ḋ⟩、⟨ḟ⟩、⟨ ġ ⟩、⟨ṁ⟩、⟨ṗ⟩、⟨ ṡ ⟩、⟨ṫ⟩ )。ローマ字の書体では、接尾辞⟨h⟩が使用されます。したがって、 ṁáṫair はmháthairに相当します。
- ブルトン語には単一の正書法(綴りシステム)はありませんが、さまざまな目的で分音記号を使用します。分音記号は、2 つの母音が二重母音/二重音字としてではなく別々に発音されることを示すために使用されます。サーカムフレックスは長母音を示すために使用されますが、通常は音韻論で母音の長さを予測できない場合のみです。母音の鼻音化は、チルダで示すか、母音の後に文字⟨ñ⟩を付けて示します。複数形の接尾辞 -où は、異なる方言でいくつかの発音を持つ接尾辞を表す統一された綴りとして使用され、この接尾辞を/u:/と発音される二重音字⟨ou⟩と区別するために使用されます。アポストロフィは、他のケルト語で二重音字⟨ch⟩が使用されているため/x/と発音される⟨c'h⟩ を、フランス語の影響を受けた二重音字 ch (/ʃ/と発音) と区別するために使用されます。
フィン・ウゴル語
- エストニア語には、チルダを含む独自の文字⟨ õ ⟩があります。二重点の発音区別符号付きのエストニア語の母音 ⟨ä⟩、⟨ö⟩、⟨ü⟩はドイツ語に似ていますが、 ドイツ語のウムラウト文字とは異なり、これらも独自の文字です。これら 4 つはすべて、アルファベットでは⟨w⟩と⟨x⟩の間に独自の位置を持っています。⟨š⟩または⟨ž⟩のカロンは、外国の固有名詞と借用語にのみ表示されます。これらも、アルファベットではsとt の間に置かれる独自の文字です。
- フィンランド語では、二重点母音(⟨ä⟩と⟨ö⟩)を使用します。スウェーデン語やエストニア語と同様に、これらは「母音 + 発音区別符号」の組み合わせ(ドイツ語の場合)ではなく、個別の文字として扱われます。また、外国語の名前や借用語には、 ⟨å⟩、⟨š⟩、⟨ž⟩ の文字が使用されます。フィンランド語とスウェーデン語のアルファベットでは、⟨å⟩、⟨ä⟩、⟨ö⟩ は⟨z⟩の後の独立した文字として照合され、その他は基本文字の変形として照合されます。
- ハンガリー語では、二重点、鋭アクセント、二重鋭アクセント(最後のものはハンガリー語に特有)が使用されます: ( ⟨ö⟩、⟨ü⟩ )、 ( ⟨á⟩、⟨é⟩、⟨í⟩、⟨ó⟩、⟨ú⟩ )、 ( ⟨ő⟩、⟨ű⟩ )。鋭アクセントは母音の長音形( ⟨i⟩ / ⟨í⟩、⟨o⟩ / ⟨ó⟩、⟨u⟩ / ⟨ú⟩の場合)を示し、二重鋭アクセントは⟨ö⟩と⟨ü⟩に対して同じ機能を果たします。鋭アクセントは異なる音を示すこともできます(より開いた音、たとえば⟨a⟩ / ⟨á⟩、⟨e⟩ / ⟨é⟩など)。ハンガリー語のアルファベットでは、母音の長形と短形の両方が別々に記載されていますが、 ⟨a⟩ / ⟨á⟩、⟨e⟩ / ⟨é⟩、⟨i⟩ / ⟨í⟩、⟨o⟩ / ⟨ó⟩、⟨ö⟩ / ⟨ ő ⟩ 、 ⟨u⟩ / ⟨ú⟩、⟨ü⟩ / ⟨ ű ⟩のペアのメンバーは、辞書では同じ文字として照合されています。
- リヴォニア語には次の文字があります: ⟨ā⟩、⟨ä⟩、⟨ Ɵ ⟩、⟨ ḑ ⟩、⟨ē⟩、⟨ī⟩、⟨ļ⟩、⟨ņ⟩、⟨ō⟩、⟨ Š ⟩、⟨ ű ⟩、⟨ õ ⟩、⟨ ž ⟩、⟨ŗ⟩、⟨š⟩、⟨Š⟩、⟨ō⟩、⟨ž⟩。
ゲルマン語
- ドイツ語では、2つの点からなる発音区別符号(ドイツ語:ウムラウト)を使用します。文字⟨ ä ⟩、⟨ ö ⟩、⟨ ü ⟩は、後ろの母音の前置を示すために使用されます(ウムラウト(言語学)を参照)。
- オランダ語では、フランス語と同様に、ほとんどの母音に鋭アクセント、曲折アクセント、重アクセント、2 点アクセントの発音区別符号が使用され、c にはセディーユが使用されます。この結果は、⟨ á ⟩、⟨ à ⟩、⟨ ä ⟩、⟨ é ⟩、⟨ è ⟩、⟨ ê ⟩、⟨ ë ⟩、⟨ í ⟩、⟨ î ⟩、⟨ ï ⟩、⟨ ó ⟩、⟨ ô ⟩、⟨ ö ⟩、⟨ ú ⟩、⟨ û ⟩、⟨ ü ⟩および⟨ ç ⟩。これは主にフランス語に由来する単語 (および名前) (クレーム、カフェ、ジェネ、ファサードなど) に関するものです。鋭アクセントは母音を強調するためにも使用されます ( éénなど)。2 つの点の発音区別符号は、ドイツ語で使用される言語的なウムラウトを示すためではなく、 2 つの母音を分割する言語的な分音記号 (母音の空白) として使用されます (例: reële、reünie、coördinatie )。
- アフリカーンス語では、大文字と小文字の両方で 16 の追加母音形式が使用されます: ⟨ á ⟩、⟨ ä ⟩、⟨ é ⟩、⟨ è ⟩、⟨ ê ⟩、⟨ ë ⟩、⟨ í ⟩、⟨ î ⟩、⟨ ï ⟩、⟨ ó ⟩、⟨ ô ⟩、⟨ ö ⟩、⟨ ú ⟩、⟨ û ⟩、⟨ ü ⟩、⟨ ý ⟩。
- フェロー語では、鋭アクセントといくつかの追加文字が使用されます。これらはすべて別々の文字とみなされ、アルファベット内で独自の位置を持ちます: ⟨ á ⟩、⟨ í ⟩、⟨ ó ⟩、⟨ ú ⟩、⟨ ý ⟩および⟨ ø ⟩。
- アイスランド語では、鋭アクセントやその他の追加文字が使用されます。これらはすべて別々の文字と見なされ、アルファベット内で独自の位置を持ちます: {{angbrZ á }}, ⟨ é ⟩、⟨ í ⟩、⟨ ó ⟩、⟨ ú ⟩、⟨ ý ⟩および⟨ ö ⟩。
- デンマーク語とノルウェー語では、o スラッシュ⟨ ø ⟩や a 重ね文字⟨ å ⟩などの追加の文字が使用されます。これらの文字は、⟨z⟩と⟨ æ ⟩の後に、 ⟨ø⟩、⟨å⟩の順で来ます。歴史的に、⟨å⟩は、小文字の⟨a⟩の上に小さな上付き文字⟨a⟩を書く合字から発展しました。 ⟨å⟩文字が使用できない場合、一部のスカンジナビア言語では、 aを 2 つ重ねて⟨aa⟩のように代用できます。スカンジナビア言語では、これらの文字を⟨z⟩の後に照合しますが、国ごとに照合基準が異なります。
- スウェーデン語では、 a の分音記号 ( ⟨ ä ⟩ ) と o の分音記号 ( ⟨ ö ⟩ ) を、 ash ( ⟨æ⟩ )の代わりに使用し、a の重ね書き ( ⟨å⟩ )に加えて斜線付きの o ( ⟨ ø ⟩ ) も使用します。歴史的に、スウェーデン語の文字⟨ä⟩と⟨ö⟩の 2 つの点の分音記号は、文字の上に書かれた小さなゴシック体の⟨e⟩から発展しました。これらの文字は、 ⟨z⟩の後に、 ⟨å⟩、⟨ä⟩、⟨ö⟩の順序で並べられます。
ロマンス
- アストゥリアス語、ガリシア語、スペイン語では、文字⟨ ñ ⟩は文字であり、nとoの間に配置されます。
- アストゥリアス語では下点が使われる: ⟨ Ḷ ⟩ (小文字, ⟨ḷ⟩ )、⟨ Ḥ ⟩ (小文字 ⟨ḥ⟩ ) [7]
- カタルーニャ語では、急性アクセント⟨é⟩、⟨í⟩、⟨ó⟩、⟨ú⟩、重アクセント⟨à⟩、⟨è⟩、⟨ò⟩、分音符⟨ï⟩、⟨ü⟩、セディラが使用されます。 ⟨ç⟩、およびインターパンクト ⟨l・l⟩。
- バレンシア語では、曲折アクセント⟨â⟩、⟨ê⟩、⟨î⟩、⟨ô⟩、⟨û⟩も使用されることがあります。
- コルシカ語では、アルファベットで以下を使用します: ⟨À⟩ / ⟨à⟩、⟨È⟩ / ⟨è⟩、⟨Ì⟩ / ⟨ì⟩、⟨Ò⟩ / ⟨ò⟩、⟨Ù⟩ / ⟨ù⟩。
- フランス語では、母音に現れる 4 つの分音記号 (曲折アクセント、鋭アクセント、重アクセント、分音記号) と、 ⟨ç⟩に現れるセディーユが使用されます。
- イタリア語では、母音(鋭母音、重母音)に現れる2つの発音区別符号を使用する。
- レオニーズ語: ⟨ñ⟩または⟨ nn ⟩を使用できます。
- ポルトガル語では、母音⟨a⟩と⟨o⟩にはチルダを使用し、母音 c にはセディーユを使用します。
- ルーマニア語では、 a ( ⟨ ă ⟩ )の文字に短音符を付けてシュワー/ə/ の音を表し、 a ( ⟨ â ⟩ ) とi ( ⟨ î ⟩ ) の文字に曲折アクセントを付けて/ɨ/ の音を表します。また、ルーマニア語では、s ( ⟨ ș ⟩ ) とt ( ⟨ ț ⟩ ) の文字の下にカンマを付けて、それぞれ/ʃ/と/t͡s/ の音を表します。これらの文字は、発音区別符号のない同等の文字の後に並べられます。
- スペイン語では、鋭アクセント(⟨á⟩、⟨é⟩、⟨í⟩、⟨ó⟩、⟨ú⟩)を使用して、デフォルトの規則に基づいて配置される音節とは異なる音節にストレスが配置されていることを示し、特定の1音節の同音異義語(例:el(男性単数定冠詞)とél [he])を区別します。分音記号は u にのみ使用され、gue、 gui /ge/、 /gi/の組み合わせをgüe、 güi /gwe/、 /gwi/(例:vergüenza、 lingüística )と区別します。 ⟨ñ⟩のチルダは分音記号とは見なされません。これは、 ⟨ñ⟩が⟨n⟩の変化形ではなく、別の文字と見なされるためです。
スラブ語
- クロアチア語とラテン語化されたセルビア語で使用されるガイのラテンアルファベットには、 ⟨ č ⟩、⟨ ć ⟩、⟨ đ ⟩、⟨ š ⟩ 、および⟨ ž ⟩の記号があり、これらは別々の文字とみなされ、辞書やアルファベット順に単語がリストされているその他の文脈ではそのようにリストされています。また、ダイアクリティカルマークを含む1つの二重音字džもあり、これも独立してアルファベット順に並べられ、アルファベット順では⟨ d ⟩の後で⟨ đ ⟩の前にあります。
- チェコ語のアルファベットでは、アキュート (á é í ó ú ý)、カロン ( č ď ě ň ř š ť ž )、および 1 つの文字 ( ů ) に環音を使用します。(ď と ť では、カロンはアポストロフィのように見えるように変更されます。) カロンのある文字は別の文字とみなされますが、母音はアクセントのない文字の長い変形としてのみみなされます。アキュートはアルファベットの順序に影響を与えず、カロンのある文字は元の文字の後に並べられます。
- ポーランド語には以下の文字があります: ą ć ę ł ń ó ś ź żこれらは別々の文字とみなされます。つまり、アルファベットではそれぞれラテン文字の直後に配置され(例: ⟨ą⟩は⟨a⟩と⟨b⟩の間)、⟨ź⟩と⟨ż⟩ は⟨z⟩の後にその順序で配置されます。
- セルビア語のキリル文字には発音区別符号はありませんが、代わりにラテン語の各文字(発音区別符号付きのラテン文字と二重音字の dž、lj、nj を含む)に対応する書記素(グリフ)があります。
- スロバキア語のアルファベットでは、アキュート (á é í ó ú ý ĺ ŕ )、カロン (č ď ľ ň š ť ž dž)、ウムラウト (ä)、および曲折アクセント (ô) が使用されます。これらはすべて別の文字とみなされ、アルファベットの元の対応する文字の直後に配置されます。[8]
- 基本的なスロベニア語のアルファベットには、 ⟨ č ⟩、⟨ š ⟩、⟨ ž ⟩の記号があり、これらは別々の文字とみなされ、辞書やアルファベット順に単語がリストされているその他の文脈ではそのようにリストされています。キャロンの付いた文字は、発音区別符号なしで書かれた文字の直後に置かれます。文字⟨đ⟩ (「バー付きのd」) は、特に名前など、音訳されない外国語で使用される場合があり、⟨č⟩の後、⟨d⟩ の前に置かれます。
トルコ語
- アゼルバイジャン語には、独特のトルコ語アルファベットÇ、Ğ、I、İ、Ö、Ş、Üが含まれます。
- クリミアタタール語には、トルコ語のアルファベット文字であるÇ、Ğ、I、İ、Ö、Ş、Üが含まれます。トルコ語とは異なり、クリミアタタール語にはÑ という文字もあります。
- ガガウズ語には、トルコ語のアルファベット文字であるÇ、Ğ、I、İ、Ö、Üが含まれます。トルコ語とは異なり、ガガウズ語にはÄ、Ê 、 Ș、Țの文字もあります。ȘとȚ は、同じ音を表すルーマニア語のアルファベットに由来しています。 Șの代わりにトルコ語のŞが使用されることもあります。
- トルコ語では、短音の付いた⟨G⟩ ( ⟨ Ğ ⟩ )、2つの点が付いた2つの文字( ⟨ Ö ⟩と⟨ Ü ⟩、2つの円唇前母音を表す)、セディーユ付きの2つの文字 ( ⟨ Ç ⟩と⟨ Ş ⟩、破擦音/tʃ/と摩擦音/ʃ/を表す) が使用され、点付きの大文字⟨İ⟩ (および点のない小文字⟨ı⟩、高非円唇後母音を表す) もあります。トルコ語では、これらはそれぞれ別の文字であり、他の文字のバージョンではありません。他の文字では、点付きの大文字⟨İ⟩ と小文字 ⟨i⟩ は同じ文字であり、点のない大文字 ⟨I⟩ と小文字 ⟨ı⟩ も同じ文字です。印刷上、 ⟨Ç⟩と⟨Ş⟩は、 ⟨Ṣ⟩のように、下点を付けて表現されることがあります。新しいアゼルバイジャン語、クリミア・タタール語、ガガウズ語のアルファベットは、トルコ語のアルファベットとその同じ発音区別文字に基づいていますが、いくつか追加されています。
- トルクメン語には、トルコ語独自のアルファベット文字Ç、Ö、Ş、Üがあります。さらに、トルクメン語では、 /æ/ を表すために分音記号 ( Ä )付きの A を、軟口蓋鼻音/ŋ/ を表すためにカロン ( ⟨ Ň ⟩ ) 付きの Nを、口蓋接近音/j/ を表すために鋭音記号 ( ⟨ Ý ⟩ ) 付きの Y を、/ʒ/ を表すためにカロン ( ⟨ Ž ⟩ )付きの Z を使用します。
他の
- アルバニア語には大文字と小文字のÇとËという2 つの特殊文字があります。これらは、アルファベットで最も類似する文字である c と e の隣に配置されます。
- エスペラント語には、 ŭ、ĉ、ĝ、ĥ、ĵ、ŝという記号があり、これらはアルファベットに含まれており、別の文字とみなされます。
- フィリピン語にもñという文字があり、n と o の間に配置されます。
- 現代のグリーンランド語では発音区別符号は使用されていないが、øとåは特にデンマーク語と英語からの借用語を綴るのに使用される。[9] [10] 1851年から1973年まで、グリーンランド語はサミュエル・クラインシュミットによって発明されたアルファベットで書かれ、長母音と重子音は母音の上に発音区別符号を付けて示した(子音が重なる場合は、発音区別符号は影響を受ける子音の前の母音に置かれる)。例えば、Kalaallit Nunaatという名前はKalâdlit Nunâtと綴られる。このスキームでは、長母音 (例: ⟨ât, ît, ût⟩ ; 現代: ⟨aat, iit, uut⟩ ) を示すためにサーカムフレックス(◌̂) を使用し、次の子音の促音を示すために急性アクセント(◌́) を使用します: (例: ⟨ák, ík, úk⟩ ; 現代: ⟨akk, ikk、ukk⟩ )、最後にチルダ(◌̃) またはグレーブアクセント(◌̀) は、作者に応じて、後続の子音の母音の長さと促音を示します (例: ⟨ãt/àt、ĩt/ìt、ũt/ùt⟩、現代: ⟨aatt、iitt、uutt⟩ )。⟨ê, ô⟩は⟨r, q⟩の前でのみ使われていましたが、現在はグリーンランド語では⟨ee, oo⟩と書かれます。
- ハワイ語では母音の上にkahakō (マクロン) を使用しますが、母音を個別の文字として扱うかどうかについては意見が分かれています。母音の上に kahakō を付けると、kahakō なしで同じ綴りの単語の意味がまったく変わってしまうことがあります。
- クルド語では、記号Ç、Ê、Î、ŞおよびÛ が、他の 26 の標準ラテン文字記号とともに使用されます。
- ラコタ語のアルファベットでは、č、ȟ、ǧ、š、žの文字にキャロンを使用します。また、強勢のある母音 á、é、í、ó、ú、áŋ、íŋ、úŋ には鋭アクセントを使用します。
- マレー語では、á、ā、ç、í、ñ、ó、š、úなどの発音区別符号が使用されます。āとēを除いて、発音区別符号の使用は19世紀後半まで続けられました。
- マルタ語では、C、G、Z の上に点が付き (Ċ、Ġ、Ż)、H に追加の横棒が付きます。大文字の H の場合、追加の横棒は通常の横棒より少し上に書きます。小文字の H の場合、追加の横棒は t のように垂直を横切り、下部には触れないように書きます ( Ħ、ħ)。上記の文字は別の文字とみなされます。点のない文字 'c' は冗長性のため使用されなくなりました。'Ċ' は英語の 'ch' のように発音され、'k' は 'cat' のように硬い c として使用されます。'Ż' は 'Zebra' のように英語の 'Z' と同じように発音され、'Z' は英語の 'ts' ('tsunami' や 'maths' など) の発音に使用されます。 「Ġ」は「geometry」のような柔らかい「G」として使用され、「G」は「log」のような硬い「G」のように発音されます。二重音字「għ」(アラビア語の文字名「غ」の「ayn 」にちなんで「għajn」と呼ばれる)は別物とみなされ、「g」の後に並べられることもありますが、他の巻では「n」と「o」の間に配置されています(ラテン文字「o」はもともとフェニキア語の「ayin 」の形から発展したもので、伝統的にフェニキア語の「nūn 」に倣って照合されていました)。
- シリア語のローマ字表記では、標準的なラテンアルファベット26文字に加えて、Ā、Č、Ḏ、Ē、Ë、Ġ、Ḥ、Ō、Š、Ṣ、Ṭ、Ū、Žの改変された文字が使用される。 [11]
- ベトナム語では、 ơとư の文字に角アクセント記号、â、ê、ô の文字に曲折アクセント記号、 ă の文字に短音、 đ の文字に縦棒を使用します。また、平音「a」の他に、á、à、ả、ã、ạ の 5 つの母音音調も使用されます。
キリル文字
- ベラルーシ語とウズベク語のキリル文字には⟨ ў ⟩という文字があります。
- ベラルーシ語、ブルガリア語、ロシア語、ウクライナ語には⟨ й ⟩ という文字があります。
- ベラルーシ語とロシア語には⟨ ё ⟩という文字がある。ロシア語では、この文字は通常⟨ е ⟩に置き換えられるが、発音は異なる。 ⟨ё⟩の代わりに⟨е⟩を使用しても、発音には影響しない。Ё は、子供向けの本や辞書では常に使用される。最小のペアは все ( vs'e、「みんな」の複数形) と всё ( vs'o、「すべて」の名詞) である。ベラルーシ語で⟨е⟩に置き換えるのは間違いである。ロシア語では、 ⟨ё⟩の代わりに⟨е⟩と⟨ё⟩のどちらを使用してもかまわないが、日常的な文章では前者の方が一般的である (指導的または児童向けの文章とは対照的)。
- キリル文字のウクライナ語アルファベットには、⟨ ґ ⟩、⟨ й ⟩、⟨ ї ⟩の文字があります。ウクライナ語のラティンカ文字には、他にも多くの文字があります。
- マケドニア語には⟨ќ⟩と⟨ѓ⟩の文字があります。
- ブルガリア語とマケドニア語では、所有代名詞 ѝ ( ì 、「彼女」) は、接続詞 и ( i 、「そして」)と区別するために重アクセントで綴られます。
- キリル文字の母音の上にある鋭アクセント◌́ は、辞書、子供向けの本、外国人学習者向けの本で単語の強勢を示すために使用され、異なる語彙の強勢を持つ類似の綴りの単語の曖昧さを解消するためにも使用されます。
新しい文字を生成しない発音区別符号

英語
英語は、発音区別符号を含む単語があまりない数少ないヨーロッパ言語の 1 つです。代わりに、現代英語のアルファベットでは、主に二重音字を使用してラテン語を音素に適応させています。例外は、フランス語(および、jalapeñoやpiñataなどのスペイン語) からの借用語を含む、同化されていない外来語です。ただし、そのような単語では発音区別符号が省略されることもあります。英語で発音区別符号とともに頻繁に現れる借用語には、cafe、résuméまたはresumé (この用法は、動詞resumeと区別するのに役立ちます)、soufflé、およびnaïveté があります (発音区別符号を含む英語の用語を参照)。古い慣習では (そして綴りを保守的に考える現代の作家の間でも)、 élite、mêlée、rôleなどの例が見られます。
英語話者や作家はかつて、coöperation(フランス語coopérationから)、zoölogy(ギリシャ語zoologiaから)、seeër(現在はsee-erまたは単にseerの方が一般的)などの単語で、隣接する母音が別の音節に属していることを示す方法として、現在よりも頻繁に分音記号を使用していましたが、この習慣は非常に一般的ではなくなりました。ニューヨーカー誌は、明瞭さとスペースの節約のためにハイフンの代わりに分音記号を使用し続けている主要な出版物です。[12]
英語のいくつかの単語は、文脈から外れて、特に単独で使用される場合、発音区別符号または変更された文字を使用することによってのみ、同じ綴りの他の単語と区別できます。これらには、 exposé、lamé、maté、öre、øre、résumé、およびrosé が含まれます。いくつかの単語では、maté (スペイン語およびポルトガル語でmate に由来) 、 saké (日本語の標準的なローマ字表記にはアクセント記号がありません) 、およびMalé (ディベヒ語 ʉʧʍʬ に由来)のように、曖昧さ回避のために元の単語にはなかった発音区別符号が追加され、英語のmate、sake、およびmaleと明確に区別されています。
鋭アクセントと抑アクセントは、詩や歌詞の中で時々使用されます。鋭アクセントは、曖昧な場合 ( rébelとrebél ) や韻律上の理由で非標準な場合 ( caléndar ) に、強勢を明示的に示すために使用され、抑アクセントは通常は発音されない、または省略される音節が発音されることを示します ( warnèd、 parlìament )。
RenéeやZoëなどの特定の人名では、2 種類の綴りが存在することが多く、本人の希望は近しい人にしか知られていない。Charlotte Brontëのように人名に発音区別符号が付けられている場合でも、英語の記事やパスポートなどの公式文書では、不注意、タイピストが発音区別符号付きの文字の入力方法を知らない、または技術的な理由 (たとえばカリフォルニア州では、コンピュータシステムがそのような文字を処理できないため、発音区別符号付きの名前は許可されていません[説明が必要] ) により、発音区別符号が省略されることがある。これらは、 NestléやCitroënなど、世界的な企業名や商標にも見られる。
その他の言語
次の言語には、独立した文字とは見なされない文字と発音区別記号の組み合わせがあります。
- アフリカーンス語では、別々に発音され、一緒に出現すると予想される母音をマークするために分音記号を使用します。たとえば、voel (感じる) はvoël (鳥) とは対照的です。サーカムフレックスは、ê、î、ô、ûで一般的に、長閉中母音を示すために使用され、開中母音とは対照的です。たとえば、wêreld (世界) やmôre (朝、明日) という単語です。アキュートアクセントは、英語で下線を引いたり、太字や斜体で書いたりするのと同じように、強調を加えるために使用されます。たとえば、Dit is jóú boek (それはあなたの本です) です。グレイブアクセントは、 appel (リンゴ) とappèl (訴える)のように、ストレスの位置のみが異なる単語を区別するために使用されます。また、発音には影響しないが同音異義語を区別する少数のケースでも使用されます。後者の最も一般的な2つの例は、òf... òf (どちらか... または) とnòg... nòg (どちらも... または) という言い方で、 of (または) とnog (再び、それでも)と区別するために使われます。
- アイマラ語では、p、q、t、k、chに発音区別音のホルンを使用します。
- カタロニア語には、 à、ç、é、è、í、ï、ó、ò、ú、ü、l·lという複合文字があります。鋭アクセントと抑音は強勢と母音の高さを示し、セディーユは歴史的な口蓋化の結果を示し、分音記号は休止、または書記素gü、qüの後にeまたはiが続く場合に文字uが発音されることを示します。句読点(·) はll/l·lの異なる値を区別します。
- ケルノウェック標準や統一コーンウォール語などの一部のコーンウォール語の正書法では分音記号が使用されていますが、ケルノウェック・ケミンや標準書き言葉など他の正書法では分音記号は使用されていません(または教材でオプションとしてのみ使用しています)。
- オランダ語では分音記号が使われる。例えば、ruïneではuとiが通常通り別々に発音され、ui の組み合わせが通常発音される方法ではない。したがって、分音記号は分離記号として機能し、 iの別バージョンを示すものではない。分音記号は強調( érg koudは非常に寒い)や、文脈から正しい意味が分からない場合に同じ綴りの複数の単語の曖昧さを解消するために使用される( één appel = リンゴ 1 個、een appel = リンゴ 1 個、vóórkomen = 発生する、voorkómen = 防ぐ)。重アクセントと鋭アクセントは、ほとんどが借用語であるごく少数の単語に使用される。一部の借用語には ç も現れる。[13]
- フェロー語。フェロー語以外のアクセント付き文字はフェロー語アルファベットに追加されません。これには、é、ö、ü、åが含まれ、最近ではš、ł、ćなどの文字も含まれています。
- フィリピン語には、á、à、â、é、è、ê、í、ì、î、ó、ò、ô、ú、ù、ûという合成文字があります。ただし、フィリピン語で分音記号を日常的に使用することはまれであり、通常の最後から2番目の強勢を持つ単語と強勢の配置が異なる単語の同音異義語を区別する場合にのみ使用されます。これは、両方がテキスト内で比較的隣接している場合、または単語自体の意味があいまいな場合に、理解と発音の両方に役立ちます。文字ñ (「eñe」) は分音記号付きのnではなく、スペイン語から借用した 8 つの文字の 1 つとして、独立した文字として照合されます。分音記号は、スペイン語の正書法規則に従って、スペイン語の借用語と名前に表示されます。
- フィンランド語。šとžのカロンは外国の固有名詞と借用語にのみ現れますが、媒体でアクセント付き文字を生成することが技術的に不可能な場合に限り、 shまたはzhで置き換えられることがあります。エストニア語とは異なり、フィンランド語ではšとžは別個の文字とは見なされません。
- フランス語では 5 つの発音区別符号が使用される。抑音 (アクセント grave )は、 père (「父」)のように e の上にある/ɛ/ の音を示すか、またはa / à (「持っている」/「〜に」) やou / où (「または」/「どこ」) など、そうでなければ同音異義語となる単語を区別するために使用される。鋭音(アクセント aigu ) は「é」でのみ使用され、「e」を修飾して/e/ の音を作る。例: étoile (「星」)。サーカムフレックス(アクセント circonflexe ) は一般に、古フランス語またはラテン語で S がかつて母音の後に続いたことを表す。例: fête (「パーティー」)。古フランス語はfeste、ラテン語はfestum。サーカムフレックスが母音の発音を修飾するかどうかは、方言と母音によって異なる。セディーユ( cédille )は、通常硬い「c」(母音「a」、「o」、「u」の前) をça (「that」)のように/s/ と発音することを示します。分音記号 (フランス語: tréma ) は、通常 1 つとして発音される 2 つの隣接する母音が、 Noël (「クリスマス」)のように別々に発音されることを示します。
- ガリシア語の母音には、アクセント ( á、é、í、ó、ú ) を付けて、同じ表記の 2 つの単語 ( é、「is」とe、「and」) 間の強勢または違いを示すことができますが、分音記号は、発音で 2 つの別々の母音を示すためにïとüでのみ使用されます。ガリシア語では、外来語でのみ、 ç (中世で一般的)、ê、àなどの他の分音記号が使用される場合があります。
- ドイツ語では、 3 つのウムラウト付き文字ä、ö、üが使われます。これらの発音区別符号は母音の変化を示します。たとえば、Ofen [ˈoːfən]「オーブン」という単語の複数形はÖfen [ˈøːfən]です。この記号は上付き文字のeとして始まりました。手書きの黒文字のe は、分音記号のように 2 本の平行な垂直線に似ています。この歴史により、ウムラウト文字が使用できない場合、「ä」、「ö」、「ü」はそれぞれ「ae」、「oe」、「ue」と書くことができます。
- ヘブライ語には、文字の上や下に置かれて母音を表すニクドと呼ばれるさまざまな発音区別符号があります。これらは、発音と構文の鍵となるカンティレーションとは区別する必要があります。
- 国際音声記号は、発音特徴または二次的な発音を示すために、発音区別記号と文字を使用します。
- アイルランド語では、母音が長音であることを示すために急性を使用します: á、é、í、ó、ú。これは、アイルランド語でsíneadh fada「長いサイン」または単にfada「長い」として知られています。古いゲール語タイプでは、子音の緩和を示すためにオーバードットが使用されます: ḃ、ċ、ḋ、ḟ、ġ、ṁ、ṗ、ṡ、ṫ。
- イタリア語には主に鋭アクセントと重アクセント(à、è / é、ì、ò / ó、ù)があり、通常は通常の発音規則では強勢のない強勢音節を示しますが、それ以外は同じ綴りの単語を区別する場合もあります(例:"e"、and; "è"、is)。まれにしか使用されませんが、イタリア語の正書法では曲折アクセント(î)も2つの場合に認められています。古い文学的文脈(およそ19世紀まで)では失音を示すために( fêro→fecero、彼らはそうしました)、または現代イタリア語では、語根が別の-iで終わるのに対し複数形の-iで終わるため、「-ii」が縮約されることを示すために使用されています。例:s. demonio、p. demonii→demonî。この場合、曲折アクセントはアクセントをずらすことで、意図されている単語が「demone」の複数形である demoni ではないことも示しています (demònî、「悪魔」; dèmoni、「悪魔」)。
- リトアニア語では、辞書では、言語のピッチアクセント体系における強勢の種類を示すために、鋭アクセント、抑アクセント、チルダを使用しています。
- マルタ語では、2音節以上の単語の末尾の強勢を示すために母音に重音符を使用します。小文字: à、è、ì、ò、ù; 大文字: À、È、Ì、Ò、Ù
- マオリ語では長母音を表すためにマクロンを使用します。
- オック語には、á、à、ç、é、è、í、ï、ó、ò、ú、ü、n·h、s·hという複合文字があります。鋭アクセントと抑音は強勢と母音の高さを示し、セディーユは歴史的な口蓋化の結果を示し、分音記号は休止、または書記素gü、qüの後にeまたはiが続く場合に文字uが発音されることを示します。句点(·)は、nh/n·hとsh/s·hの異なる値を区別します(つまり、文字は別々に発音されるべきであり、「ny」と「sh」に結合されるべきではないこと)。
- ポルトガル語には次の複合文字があります: à、á、â、ã、ç、é、ê、í、ó、ô、õ、ú。急性と曲旋律は強勢と母音の高さを示し、墓はクラシスを示し、チルダは鼻音化を表し、セディラは歴史的な緩和の結果を示します。
- スラブ語の辞書や教科書では、アクセント記号は語彙の強勢を示すためにも使われており、強勢のある音節の母音の上に置かれる。これは意味の曖昧さを解消する役割も果たす(例えば、ロシア語ではписа́ть(pisáť)は「書く」を意味するがпи́сать(písať)は「小便をする」を意味する)、または「бо́льшая часть」(最も大きな部分)と「больша́я часть」(大きな部分)を区別する役割も果たす。
- スペイン語では、鋭音と分音階が使われます。鋭音は、不規則な強勢パターンを持つ単語の強勢のある音節の母音に使われます。また、 tío (アクセントなしの[ˈtjo]ではなく[ ˈti.o]と発音)のように二重母音を「分割」するのにも使われます。さらに、鋭音は、 si (「もし」) やsí (「はい」) など、同じように綴られる単語を区別するのにも使われます。また、 donde/¿dónde? (「どこ」/「どこで?」) やcomo/¿cómo? (「として」/「どのように?」)など、疑問代名詞や感嘆代名詞を、文法的機能が異なる同音異義語と区別するのにも使われます。鋭音は、 1 ó 2 (「1 または 2」)のように、印刷上の曖昧さを避けるためにも使用されることがあります。鋭音がなければ、「1 0 2」と解釈される可能性があります。分音記号は、 gueとgui の組み合わせで[w]と発音するためにu ( ü ) にのみ使用されます。この場合、 u は通常は発音されません (例: ambigüedad)。詩では、分音記号はiとuで使用され、中断を強制するために使用されます。上で予告したように、鼻音ñでは、チルダ(波線)は分音記号とはまったく見なされておらず、辞書に独自の章がある個別のグリフの複合部分と見なされています。このグリフは、スペイン語のアルファベットの 15 番目の文字を示すグリフです。
- スウェーデン語では、 kafé (カフェ) やresumé (レジュメ)のように、非標準的な強勢を表すために鋭アクセントを使用します。これは、 ide (冬眠) とidé (アイデア) などの曖昧さを解決するのに役立つことがあります。これらの単語では、鋭アクセントは必須です。 Carolina KlüftやStaël von Holsteinなど、一部の固有名詞では非標準的な発音区別符号が使用されています。外来語については、その単語が言語に浸透していない限り、元のアクセントを使用することを強くお勧めします。その場合はアクセントは必須ではありません。したがって、crème fraîche but ampere です。スウェーデン語にはå、ä、öという文字もありますが、これらは発音区別符号付きのaとoではなく、別の文字と見なされます。
- タミル語自体には発音区別符号はありませんが、タミル文字を使用してサンスクリット語の長い文章を書くときに、有声音、有声音、有声有声音を表すためにアラビア数字の2、3、4 を発音区別符号として使用します。
- タイ語にはインドの数字から派生した独自の発音区別符号システムがあり、さまざまな声調を表します。
- ベトナム語では、母音の強音 ( dấu sắc )、墓音 ( dấu huyền )、チルダ ( dấu ngã )、アンダードット ( dấu nặng )、母音の上のフック ( dấu hỏi ) を声調の指標として使用します。
- ウェールズ語では、 7 つの母音a、e、i、o、u、w、yにサーカムフレックス、分音記号、鋭アクセント、抑アクセントを使用します。最も一般的なのはサーカムフレックス ( 「小さな屋根」を意味するbach、または「曲がったアクセント」を意味するacen grom、または「長い記号」を意味するhirnodと呼ばれます) で、長母音を表し、通常は短母音または半母音を持つ類似の単語と区別します。まれな抑アクセントは逆の効果があり、通常は長く発音される母音を短くします。鋭アクセントと分音記号も、それぞれ強勢と母音の分離を表すために時々使用されます。wサーカムフレックスŵとyサーカムフレックスŷ は、ウェールズ語で最も一般的にアクセントが付けられる文字の 1 つですが、一般的な言語では珍しく、最近までワードプロセッサや HTML ドキュメントで取得するのは非常に困難でした。
音訳
ローマ字で書かれていない言語の中には、発音区別符号を使用して音訳(ローマ字化)されるものもあります。例:
- アラビア語には、アプリケーションの種類、地域、対象読者、国などに応じて、いくつかのローマ字表記法があります。その多くは、発音区別符号を多用します。たとえば、強調子音(ṣ、ṭ、ḍ、ẓ、ḥ) を表現するために下点を使用する方法もあります。長母音を表現するには、マクロンがよく使用されます。š は/ʃ/に、ġ は/ɣ/によく使用されます。
- 中国語にはウムラウトを使用するローマ字表記がいくつかありますが、 u ( ü ) のみです。漢語ピンインでは、中国語の4 つの声調は、長音 (第 1 声調)、鋭音 (第 2 声調)、カロン (第 3 声調)、および抑音 (第 4 声調) の発音区別符号で表されます。例: ā、á、ǎ、à。
- ローマ字表記の日本語(ローマ字) では、長母音を表すために長音記号が使用されることがあります。ヘボン式ローマ字表記では長母音を表すために長音記号が使用され、訓令式および日本式では曲折アクセント記号が使用されます。
- サンスクリット語、およびヒンディー語やベンガル語などの多くの派生語では、ロスレスローマ字化システムであるIASTが使用されています。これには、長音記号 (ā、ī、ū)、上付き点と下付き点 (ṛ、ḥ、ṃ、ṇ、ṣ、ṭ、ḍ)、およびその他のいくつかの文字 (ś、ñ) などの発音区別符号付きの文字が含まれます。
制限
正書法
おそらく、Unicode言語で有効な文字を構成するために必要な結合発音区別符号の最大数は8で、「チベット文字とランジャナ文字のよく知られた書記素クラスター」またはHAKṢHMALAWARAYAṀである。[14]
それは
- U+0F67 ཧ チベット文字 HA
- U+0F90 ྐ チベット語の連結文字 KA
- U+0FB5 ྵ チベット語 結合文字 SSA
- U+0FA8 ྨ チベット語の連結文字 MA
- U+0FB3 ླ チベット語 連結文字 LA
- U+0FBA ྺ チベット語 連結文字 固定形式 WA
- U+0FBC ྼ チベット語 連結文字 固定形式 RA
- U+0FBB ྻ チベット語 連結文字 固定形式 YA
- U+0F82 ྂ チベットサイン ニィズラ ナア ダ
レンダリングの例。ブラウザによっては表示されない場合があります。
言語
非綴字的/装飾的
一部のユーザーは、文字ごとに意味のない発音区別符号を過剰に使って単語を「装飾」し、いわゆるZalgo テキストを作成することで、Web ブラウザーやその他のソフトウェアでのレンダリングの限界を探りました。
Unicode の発音区別記号の一覧
Unicode のラテン文字の発音区別符号:
参照
- ラテン文字アルファベット
- 代替コード
- カテゴリ:発音区別符号付き文字
- 照合順序
- 組み合わせ文字
- キーの作成
- 発音区別符号付きの英語の用語
- 重金属ウムラウト
- ISO/IEC 8859 8ビット拡張ラテンアルファベットヨーロッパ文字エンコーディング
- ラテンアルファベット
- ラテン文字の一覧
- Unicode の合成済みラテン文字の一覧
- 発音区別符号付きの米国の都市一覧
- ローマ字
注記
- ^ ニューヨーカー誌は、これを継続して使用している点でユニークであると報告されている。[1]
参考文献
- ^ Baum, Dan (2010 年 12 月 16 日). 「The New Yorker の奇妙な記号 — 分音記号」. dscriber . 2010 年 12 月 16 日時点のオリジナルよりアーカイブ。The
New Yorker の多くの謎の 1 つに、coöperate や reëlect などの単語の上に付けられる、あのおかしな小さなウムラウトがあります。The New Yorker は、この記号を使用する地球上で唯一の出版物のようで、調べてみるまでは、少し気取った感じがしていました。結局、この記号はウムラウトではなく、分音記号でした。
- ^ Sweet, Henry (1877). A Handbook of Phonetics . Cambridge: Cambridge University Press. pp. 174–175.
アクセントや発音区別符号付きの文字であっても、 [...] 少数のフォント用にのみ鋳造されているため、実質的には新しい文字として機能します。 [...] sh や th の h は、単に、修飾する文字と同じ行に便宜上書かれた発音区別符号と見なすことができます。
- ^ オックスフォード英語辞典
- ^ ネスレ、エバーハルト(1888)。Syrische Grammatik mit Litteratur、Christomathie und Glossar。ベルリン: H. ロイターの Verlagsbuchhandlung。 [RS Kennedy による、参考文献、聖典、用語集を含むシリア語文法として英語に翻訳。ロンドン: ウィリアムズとノルゲート 1889]。
- ^ Coakley, JF (2002). Robinson's Paradigms and Exercises in Syriac Grammar (第5版). Oxford University Press. ISBN 978-0-19-926129-1 .
- ^ ミカエリス、イオアニス・ダヴィディス (1784)。グラマティカ シリアカ。
- ^ アストゥリアナ言語学(PDF) (第 3 版)。アストゥリアナ大学。 2001 年、セクション 1.2。ISBN 84-8168-310-8. 2011年5月25日時点のオリジナル(PDF)からアーカイブ。2011年6月7日閲覧。
- ^ http://www.juls.savba.sk/ediela/psp2000/psp.pdf 12 ページ、セクション I.2
- ^ グロンランドの発展 (1992)
- ^ ピーターセン(1990)
- ^ SP ブロック、「シリア語研究入門」、JH イートン(編)、セム語研究の地平(1980 年)
- ^ ノリス、メアリー(2012年4月26日)。「分音記号の呪い」。ニューヨーカー。 2014年4月18日閲覧。
- ^ ヴァン・ゲローベン、サンダー (2012).オランダの Diakritische tekens (オランダ語)。ユトレヒト: ヘレバールト。 2013年10月29日のオリジナルからアーカイブ。
- ^ Steele, Shawn (2010-01-25). 「Unicode グリフ/文字/その他におけるほとんどの結合文字」。Microsoft。2019 年 5 月 16 日時点のオリジナルよりアーカイブ。2019年 11 月 25 日閲覧。
外部リンク
- 発音区別符号のコンテキスト | 研究プロジェクト 2014-10-12 にWayback Machineでアーカイブ
- 発音区別符号プロジェクト
- ユニコード
- 正書法の発音区別符号と多言語コンピューティング、JC ウェルズ著
- 発音区別符号の使用に関する注釈、Markus Lång 著
- 国際文字の入力 (Linux、KDE)
- Adobe の Macintosh PDF の標準文字セット
