ユニコード標準では、ラテン文字の1000を超える文字がエンコードされており、いくつかの基本ラテンブロックと拡張ラテンブロックにグループ化されています。拡張範囲には、主に合成文字と、結合発音区別符号で同等にエンコードされた発音区別符号、およびいくつかの合字と独特の文字が含まれており、たとえば、さまざまなアフリカ言語の正書法(ラテン拡張Bのクリック記号を含む)やベトナム語アルファベット(ラテン拡張追加)で使用されています。ラテン拡張Cには、ウイグル文字とクラウディオ文字の追加が含まれています。ラテン拡張Dは、主に中世学者の関心を引く文字で構成されています。ラテン拡張Eは、主にドイツ語方言学( Teuthonista)で使用される文字で構成されています。 [1]ラテン拡張Fと-Gには、音声転写用の文字が含まれています。
ブロック
Unicode規格バージョン16.0では、以下の19ブロックの1,487文字がラテン文字に分類されています。[2]
- 基本ラテン文字、0000~007F。このブロックはASCIIに対応します。
- Latin-1 Supplement、0080~00FF。このブロックとASCII部分は、IANA Latin-1に総合的に対応します。
- ラテン語拡張-A、0100–017F
- ラテン語拡張-B、0180–024F
- IPA 拡張、0250–02AF
- 間隔修飾文字、02B0~02FF
- 音声拡張、1D00~1D7F
- 音声拡張補足、1D80–1DBF
- ラテン語拡張追加、1E00–1EFF
- 上付き文字と下付き文字、2070~209F
- 文字のような記号、2100–214F
- 数形式、2150~218F
- ラテン語拡張-C、2C60–2C7F
- ラテン拡張D、A720~A7FF
- ラテン語拡張-E、AB30–AB6F
- アルファベット表記形式(ラテン合字)FB00~FB4F
- 半角および全角フォーム、FF00~FFEF
- ラテン語拡張-F、10780–107BF
- ラテン拡張-G、1DF00–1DFFF
さらに、通貨記号、制御ピクチャ、CJK 互換、囲み英数字、囲み CJK 文字と月、数学英数字記号、囲み英数字補足ブロックには、ラテン文字に似た文字が多数エンコードされていますが、これらはグラフィカルにはラテン文字ですが、スクリプト プロパティがcommon であるため、Unicode の用語ではラテン スクリプトには属しません。Lisuもほぼ完全にラテン形式で構成されていますが、独自のスクリプト プロパティを使用します。
文字一覧
この表では、 Unicode スクリプト プロパティがラテン文字である文字が色で強調表示され、その文字が導入された Unicode のバージョンが示されています。予約済みのコード ポイント (将来文字として割り当てられる可能性がある) の背景は灰色です。ラテン文字に属さないすべての文字の背景は白です (したがって、導入された Unicode のバージョンは示されません)。
参照
参考文献
- ^ Everson, Michael ; Dicklberger, Alois; Pentzlin, Karl; Wandl-Vogt, Eveline (2011-06-02). 「UCS で「Teuthonista」音声文字をエンコードするための改訂提案」(PDF)。
- ^ "Scripts-16.0.0.txt". Unicode Consortium . 2024-04-30 . 2024-09-12閲覧。
