Unicode規格では、プレーンは65,536(2 16)個のコードポイントの連続したグループです。0から16までの数字で識別される17のプレーンがあり、 6桁の16進数形式(U+ hh hhhh )の最初の2桁の可能な値00~10 16に対応します。プレーン0は基本多言語プレーン(BMP)で、最もよく使用される文字が含まれています。より高いプレーン1から16は「補助プレーン」と呼ばれます。[1] Unicodeの最後のコードポイントは、プレーン16の最後のコードポイント、U+10FFFFです。Unicodeバージョン16.0の時点で、5つのプレーンにコードポイント(文字)が割り当てられ、7つに名前が付けられています。
17プレーンの制限はUTF-16によるもので、UTF-16では2 20コードポイント(16プレーン)を単語のペアとしてエンコードでき、BMPは1単語としてエンコードできます。[2] UTF-8は2 31 (2,147,483,648)コードポイント(32,768プレーン)というはるかに大きな制限で設計されており、現在の4バイトの制限でも2 21 (2,097,152)コードポイント(32プレーン)をエンコードできます。[3]
17 のプレーンには 1,114,112 個のコード ポイントを収容できます。このうち、2,048 個はサロゲート(UTF-16 でペアを作成するために使用される)、66 個は非文字、137,468 個は私的使用のために予約されており、残りの 974,530 個が公的割り当て用です。
プレーンはさらにUnicodeブロックに細分化されますが、プレーンとは異なり、ブロックのサイズは固定されていません。Unicode 16.0で定義されている338のブロックは、可能なコードポイント空間の27%をカバーし、サイズは最小16コードポイント(16ブロック)から最大65,536コードポイント(プレーン15と16全体を構成する補足私的使用領域AとB)までです。将来の使用に備えて、ほとんどの既知の現在および古代の書記体系の文字の範囲が暫定的にマッピングされています。[4]
概要
割り当てられた文字
- ^ Unicode ブロックに割り当てられたコード ポイント。
基本的な多言語面

最初のプレーンであるプレーン 0、つまり基本多言語プレーン( BMP ) には、ほぼすべての現代言語の文字と、多数の記号が含まれています。 BMP の主な目的は、以前の文字セットと書き込み用文字の統一をサポートすることです。 BMP で割り当てられたコード ポイントのほとんどは、中国語、日本語、韓国語 ( CJK ) の文字をエンコードするために使用されます。
上位サロゲート ( U+D800–U+DBFF ) および下位サロゲート ( U+DC00–U+DFFF ) コードは、 16ビットコードのペア(上位サロゲート 1 つと下位サロゲート 1 つ)を使用して、UTF-16 で非 BMP 文字をエンコードするために予約されています。単一のサロゲート コード ポイントに文字が割り当てられることはありません。
このプレーンの 65,536 個のコード ポイントのうち 65,520 個が Unicode ブロックに割り当てられており、割り当てられていない単一の範囲 (2FE0..2FEF) には 16 個のコード ポイントだけが残っています。
Unicode 16.0 以降[update]、BMP は次の 164 個のブロックで構成されています。
- 左から右に書くアルファベットの文字:
- 基本ラテン文字( ISO/IEC 8859-1の下位半分: ISO/IEC 646:1991-IRV別名ASCII ) (0000–007F)
- ラテン語-1補足( ISO/IEC 8859-1の上位半分)(0080–00FF)
- ラテン語拡張A(0100~017F)
- ラテン語拡張B(0180~024F)
- IPA 拡張(0250–02AF)
- 間隔修飾文字(02B0–02FF)
- 結合発音区別符号(0300–036F)
- ギリシャ語とコプト語(0370–03FF)
- キリル文字(0400–04FF)
- キリル文字補足(0500–052F)
- アルメニア語(0530–058F)
- セム語のアブジャド文字およびその他の右から左に書く文字:
- ブラーフミー文字:
- その他のアルファベットまたは音節の左から右への文字:
- グルジア語(10A0–10FF)
- ハングル文字(1100–11FF)
- エチオピア語(1200~137F)
- エチオピアサプリメント(1380–139F)
- チェロキー(13A0–13FF)
- 統一カナダ先住民音節文字(1400~167年)
- オガム文字(1680–169F)
- ルーン文字(16A0~16FF)
- フィリピン文字:
- クメール語(1780–17FF)
- モンゴル語(1800–18AF)
- カナダ先住民族の統一音節拡張版(18B0–18FF)
- ブラーフミー文字:
- リンブー(1900~194年)
- タイ文字:
- 結合発音区別符号拡張(1AB0–1AFF)
- インドネシア語の文字:
- レプチャ語(1C00–1C4F)
- オルチキ(1C50–1C7F)
- その他の左から右へのアルファベットまたは音節の補足:
- スンダ語補足(1CC0–1CCF)
- ヴェーダ拡張(1CD0–1CFF)
- その他の左から右へのアルファベットの補足:
- 音声拡張(1D00~1D7F)
- 音声拡張補足(1D80–1DBF)
- 結合発音区別符号補足(1DC0–1DFF)
- ラテン語拡張追加(1E00–1EFF)
- ギリシャ語拡張(1F00–1FFF)
- シンボル:
- 一般的な句読点(2000~206F)
- 上付き文字と下付き文字(2070–209F)
- 通貨記号(20A0~20CF)
- 記号の結合発音区別符号(20D0~20FF)
- 文字のようなシンボル(2100–214F)
- 数形式(2150~218F)
- アローズ(2190–21FF)
- 数学演算子(2200–22FF)
- その他技術(2300–23FF)
- コントロール画像(2400~243F)
- 光学文字認識(2440~245F)
- 囲み英数字(2460~24FF)
- ボックス図面(2500–257F)
- ブロック要素(2580–259F)
- 幾何学的形状(25A0–25FF)
- その他の記号(2600–26FF)
- ディンバット(2700–27BF)
- その他の数学記号-A (27C0–27EF)
- 補助矢印-A (27F0–27FF)
- 点字パターン(2800–28FF)
- 補足矢印-B (2900–297F)
- その他の数学記号-B (2980–29FF)
- 補足数学演算子(2A00–2AFF)
- その他の記号と矢印(2B00–2BFF)
- その他の左から右に書くアルファベットの文字または補足:
- アフリカの文字:
- その他の左から右へのアルファベットの補足:
- CJK文字と記号:
- CJK ラジカル補足(2E80–2EFF)
- 康熙部首(2F00~2FDF)
- 表意文字記述文字(2FF0~2FFF)
- CJK 記号と句読点(3000–303F)
- ひらがな(3040~309F)
- カタカナ(30A0~30FF)
- ボポモフォ(3100~312F)
- ハングル互換文字(3130~318F)
- 漢文(3190~319F)
- ボポモフォ拡張(31A0–31BF)
- CJK ストローク(31C0–31EF)
- カタカナ音声拡張(31F0~31FF)
- 囲み付き CJK 文字と月(3200–32FF)
- CJK 互換性(3300–33FF)
- CJK 統合漢字拡張 A (3400–4DBF)
- 易経の卦のシンボル(4DC0~4DFF)
- CJK 統合漢字(4E00–9FFF)
- 彝語音節(A000~A48F)
- イ部首(A490~A4CF)
- リス語(A4D0–A4FF)
- アフリカの文字:
- ヴァイ(A500~A63F)
- その他の左から右へのアルファベットの補足:
- キリル文字拡張B (A640–A69F)
- アフリカの文字:
- バムム(A6A0~A6FF)
- その他の左から右へのアルファベットの補足:
- ブラーフミー文字:
- シロティ・ナグリ(A800~A82F)
- 一般的なインド数字形式(A830~A83F)
- パグスパ(A840–A87F)
- サウラーシュトラ(A880–A8DF)
- 拡張デーヴァナーガリー文字(A8E0–A8FF)
- カヤ・リー(A900–A92F)
- レジャン(A930~A95F)
- ハングル文字墨拡張-A (A960–A97F)
- ブラーフミー文字:
- エチオピア語拡張A(AB00~AB2F)
- ラテン語拡張-E (AB30–AB6F)
- チェロキーサプリメント(AB70–ABBF)
- ミーテイ・マエク(ABC0~ABFF)
- ハングル音節(AC00–D7AF)
- ハングル文字文字拡張-B (D7B0–D7FF)
- 代理人:
- 高サロゲート(D800~DB7F)
- プライベート使用率の高いサロゲート(DB80~DBFF)
- 低サロゲート(DC00~DFFF)
- 私的使用エリア(E000~F8FF)
- CJK 互換表意文字(F900–FAFF)
- アルファベット順プレゼンテーションフォーム(FB00~FB4F)
- アラビア語プレゼンテーションフォーム A (FB50–FDFF)
- バリエーションセレクター(FE00~FE0F)
- 縦型フォーム(FE10~FE1F)
- ハーフマークの組み合わせ(FE20~FE2F)
- CJK互換フォーム(FE30~FE4F)
- 小型フォームバリアント(FE50~FE6F)
- アラビア語プレゼンテーションフォーム B (FE70–FEFF)
- 半角および全角フォーム(FF00~FFEF)
- スペシャル(FFF0~FFFF)
補足多言語面

第 1 面である補助多言語面( SMP ) には、歴史的文字 ( CJK 表意文字を除く) と、特定の分野内で使用される記号および表記法が含まれています。文字には、線文字 B、エジプトの象形文字、楔形文字が含まれます。また、シャーヴィアン文字やデゼレト文字などの英語改革正書法、およびオセージ文字、ワラン シティ文字、アドラム文字、ワンチョ文字、トト文字などの一部の現代文字も含まれます。記号および表記法には、歴史的および現代的な音楽記譜法、数学の英数字、速記、絵文字およびその他の絵文字セット、トランプ、麻雀、ドミノのゲーム記号が含まれます。
Unicode 16.0 時点で[update]、SMP は次の 161 個のブロックで構成されています。
- 古代ギリシャ語およびその他の左から右に書く文字:
- 線文字B音節文字(10000~1007F)
- 線文字B表意文字(10080~100FF)
- エーゲ海番号(10100–1013F)
- 古代ギリシャ数字(10140–1018F)
- 古代のシンボル(10190–101CF)
- ファイストスディスク(101D0~101FF)
- リュキア(10280–1029F)
- カリアン(102A0~102DF)
- コプト語エパクト番号(102E0–102FF)
- 古代イタリック体(10300–1032F)
- ゴシック(10330~1034F)
- オールドパーミック(10350~1037F)
- ウガリット語(10380–1039F)
- 古代ペルシア語(103A0–103DF)
- デゼレト(10400~1044F)
- シャビアン(10450~1047F)
- オスマニヤ(10480–104AF)
- オセージ(104B0~104FF)
- エルバサン(10500~1052F)
- コーカサスアルバニア語(10530–1056F)
- ヴィトクキ(10570–105BF)
- トドリ(105C0–105FF)
- 線状A(10600~1077F)
- ラテン拡張F(10780–107BF)
- 右から左に書くスクリプト:
- キプロス音節文字(10800–1083F)
- 帝国アラム語(10840–1085F)
- パルミラネ(10860–1087F)
- ナバテア人(10880–108AF)
- ハトラン(108E0–108FF)
- フェニキア語(10900–1091F)
- リディア語(10920–1093F)
- メロエ文字(10980~1099年)
- メロエ文字筆記体(109A0–109FF)
- カロシュティ(10A00–10A5F)
- オールドサウスアラビアン(10A60–10A7F)
- オールドノースアラビアン(10A80~10A9F)
- マニ教(10AC0~10AFF)
- アヴェスター語(10B00–10B3F)
- パルティア碑文(10B40–10B5F)
- 碑文パフラヴィー語(10B60–10B7F)
- パフラヴィー語詩篇(10B80–10BAF)
- 古代トルコ語(10C00–10C4F)
- 古ハンガリー語(10C80–10CFF)
- ハニフィ・ロヒンギャ(10D00–10D3F)
- ガライ(10D40~10D8F)
- ルミ数字記号(10E60–10E7F)
- イェジディ(10E80–10EBF)
- アラビア語拡張C (10EC0–10EFF)
- 古代ソグド語(10F00–10F2F)
- ソグド語(10F30–10F6F)
- 古代ウイグル語(10F70~10FAF)
- コーラスミアン(10FB0~10FDF)
- エリマック語(10FE0–10FFF)
- ブラーフミー文字:
- ブラーフミー語(11000–1107F)
- カイティ(11080–110CF)
- ソラ・ソンペン(110D0–110FF)
- チャクマ(11100~1114F)
- マハジャニ(11150–1117F)
- シャラダ(11180–111DF)
- シンハラ古数字(111E0–111FF)
- ホイキ(11200~1124F)
- ムルタニ語(11280–112AF)
- クダワディ(112B0–112FF)
- グランサ(11300~1137F)
- トゥル・ティガラリ(11380–113FF)
- ネヴァ(11400~1147F)
- ティルフタ(11480–114DF)
- シッダム(11580–115FF)
- モディ(11600~1165F)
- モンゴル語補足(11660~1167F)
- タクリ(11680–116CF)
- ミャンマー拡張C(116D0~116FF)
- アホーム(11700~1174F)
- ドグラ語(11800–1184F)
- ワランシティ(118A0–118FF)
- アクルのダイビング(11900~1195F)
- ナンディナガリ文字(119A0–119FF)
- ザナバザル広場(11A00~11A4F)
- ソヨンボ(11A50–11AAF)
- 統一カナダ先住民音節文字拡張 A (11AB0–11ABF)
- ブラーフミー文字:
- パウ・シン・ハウ(11AC0~11AFF)
- デーヴァナーガリー拡張文字-A (11B00–11B5F)
- スヌワール(11BC0–11BFF)
- バイクスキ(11C00–11C6F)
- メルヘン(11C70–11CBF)
- マサラム・ゴンディ(11D00~11D5F)
- ガンジャラ・ゴンディ(11D60~11DAF)
- マカサル(11EE0~11EFF)
- カウィ(11F00~11F5F)
- リスサプリメント(11FB0–11FBF)
- タミル語補足(11FC0–11FFF)
- 楔形文字:
- 楔形文字(12000–123FF)
- 楔形文字の数字と句読点(12400~1247年)
- 初期王朝の楔形文字(12480~1254年)
- キプロ・ミノア語(12F90–12FFF)
- 象形文字:
- エジプトの象形文字(13000~1342年)
- エジプト象形文字のフォーマットコントロール(13430–1345F)
- エジプト象形文字拡張版-A (13460–143FF)
- アナトリア象形文字(14400~1467年)
- グルン・ケマ(16100–1613F)
- バムムサプリメント(16800–16A3F)
- ムロ(16A40–16A6F)
- タンサ(16A70–16ACF)
- バッサ・ヴァー(16AD0~16AFF)
- パハウ・モン語(16B00–16B8F)
- キラット・ライ(16D40–16D7F)
- メデファイドリン(16E40–16E9F)
- ミャオ語(16F00~16F9F)
- 東アジアの文字:
- 表意文字と句読点(16FE0–16FFF)
- タングート語 (17000–187FF)
- Tangut コンポーネント(18800–18AFF)
- 契丹小文字(18B00~18CFF)
- タングート語補足(18D00~18D7F)
- カナ拡張B (1AFF0–1AFFF)
- かな補足(1B000~1B0FF)
- カナ拡張A(1B100~1B12F)
- 小さなかな拡張子(1B130–1B16F)
- ヌシュ(1B170–1B2FF)
- 表記法:
- デュプロヤン(1BC00–1BC9F)
- 短縮書式コントロール(1BCA0–1BCAF)
- レガシーコンピューティング補足のシンボル(1CC00–1CEBF)
- 記号と数字:
- 楽譜:
- ズナメニー音楽記譜法(1CF00–1CFCF)
- ビザンチン音楽記号(1D000–1D0FF)
- 音楽記号(1D100–1D1FF)
- 古代ギリシャの音楽記法(1D200–1D24F)
- カクトビク数字(1D2C0–1D2DF)
- マヤ数字(1D2E0–1D2FF)
- 数学記号:
- Tai Xuan Jing シンボル(1D300–1D35F)
- 数え棒の数字(1D360–1D37F)
- 数学英数字記号(1D400–1D7FF)
- 楽譜:
- 表記法:
- サットン サインライティング(1D800–1DAAF)
- その他の左から右に書く文字:
- ニャケン・プアチュ・モン族(第一紀100年~第一紀14年)
- トト(1E290–1E2BF)
- ワンチョ(1E2C0~1E2FF)
- ナグ・ムンダリ(1E4D0~1E4FF)
- オル・オナル(1E5D0–1E5FF)
- アフリカの文字:
- 記号と数字:
- インド系シヤク数字(1EC70–1ECBF)
- オスマン帝国のシヤク番号(1ED00–1ED4F)
- アラビア語の数学アルファベット記号(1EE00–1EEFF)
- ゲームタイルとカード:
- 英数字補足資料(1F100~1F1FF)
- 付属の表意文字補足(1F200~1F2FF)
- その他の記号と絵文字(1F300~1F5FF)
- 絵文字(1F600~1F64F)
- 装飾用ディンバット(1F650~1F67F)
- 交通機関と地図のシンボル(1F680–1F6FF)
- 錬金術シンボル(1F700~1F77F)
- 幾何学的形状の拡張(1F780–1F7FF)
- 補助矢印-C (1F800–1F8FF)
- 補助記号と絵文字(1F900~1F9FF)
- チェスのシンボル(1FA00–1FA6F)
- 記号と絵文字 拡張版 A (1FA70–1FAFF)
- レガシーコンピューティングのシンボル(1FB00~1FBFF)
補助表意文字面

プレーン 2 の補助表意文字プレーン( SIP ) は、以前の文字エンコード標準には含まれていなかっ た CJK 表意文字 (主にCJK 統合表意文字)に使用されます。
Unicode 16.0 以降[update]、 SIP は次の 7 つのブロックで構成されています。
- CJK 統合漢字拡張 B (20000–2A6DF)
- CJK 統合漢字拡張 C (2A700–2B73F)
- CJK 統合漢字拡張 D (2B740–2B81F)
- CJK 統合漢字拡張 E (2B820–2CEAF)
- CJK 統合漢字拡張 F (2CEB0–2EBEF)
- CJK 統合漢字拡張 I (2EBF0–2EE5F)
- CJK互換表意文字補足(2F800–2FA1F)
第三表意文字面

第3面は第三表意文字面(TIP)である。CJK統合表意文字拡張Gは、2020年3月にリリースされたUnicode 13.0でTIPに追加されました。[5]また、甲骨文字と小篆書体にも暫定的に割り当てられています。[6]
Unicode 16.0 以降[update]、TIP は次の 2 つのブロックで構成されます。
- CJK 統合漢字拡張 G (30000–3134F)
- CJK 統合漢字拡張 H (31350–323AF)
未割り当ての飛行機
プレーン 4 から 13 ( 16 進数ではプレーン4からD ): プレーン 4 から 13 にはまだ文字が割り当てられていないか、割り当てが提案されていません。
補助特殊機

プレーン 14 ( 16 進数ではE ) は、補助特殊目的プレーン( SSP )として指定されています。Unicode 16.0 時点では、次の 2 つのブロックで構成されています。 [update]
- タグ(E0000~E007F)
- バリエーションセレクタサプリメント(E0100~E01EF) – 文字の代替グリフを示すために使用されます。
プライベートエリアの飛行機
2 つのプレーン 15 と 16 (16 進数ではプレーンFと10 ) にはそれぞれ「私的使用領域」が含まれています。これらには、補足私的使用領域 A ( PUA-A ) と-B ( PUA-B )という名前のブロックが含まれています。私的使用領域は、ISO および Unicode (私的使用文字エンコーディング) 以外の関係者が使用できます。
参考文献
- ^ 「用語集」www.unicode.org . 2021年9月27日閲覧。
- ^ Unicode 標準の表 3.5「UTF-16 ビット分布」を参照してください https://www.unicode.org/versions/Unicode6.0.0/UnicodeStandard-6.0.pdf
- ^ Unicode 標準の表 3.6「UTF-8 ビット分布」を参照してください https://www.unicode.org/versions/Unicode6.0.0/UnicodeStandard-6.0.pdf
- ^ 「Unicodeへのロードマップ」www.unicode.org . 2021年9月27日閲覧。
- ^ 「Unicode 標準バージョン 13.0 の発表」。
- ^ 「提案された新文字: パイプライン」www.unicode.org。
