背景
他のほとんどのCJK統一表意文字セットとは異なり、拡張Iは表意文字研究グループ(IRG)によって作成および提出されたものではありません。[ 3 ]
GB 18030は中華人民共和国(PRC)の強制的な国家規格です。これは、以前のGBKおよびEUC-CN文字エンコーディングの既存データとの互換性を維持するUnicode 変換フォーマットを定義し、中国で販売されるデバイスがサポートしなければならない特定の Unicode 文字を指定します。[ 4 ] 2022 年版のGB 18030-2022では、必要な文字のいくつかが、私的使用エリアコード ポイントではなく、標準の Unicodeコード ポイントにマッピングされるように変更されました。
2022年後半、中国はGB 18030のさらなる改正案を一般公開し、意見を募った。この改正案では、まだ名称が付けられていないUnicodeプレーン10(16進数:0A)に897の新しい漢字を配置する予定だった。[ 5 ]これは「中国における市民の実名認証の強いニーズ」が動機となった。[ 6 ] ISO/IEC 10646 (Unicodeと同期したISO規格であるUniversal Coded Character Set )に影響を与えるため、この改正案はISO 10646を担当するISO小委員会であるISO/IEC JTC 1/SC 2で回覧された。中国の国家機関は、「ISO/IEC 10646は0Aプレーンの目的を規定していない」とし、ISO 10646では0Aプレーンは「将来の標準化のために予約されている」とされているため、この使用は「不適切ではない」と主張した。[ 5 ]
しかし、ISO 10646 の意図は、プレーン 10 を ISO 10646 と Unicode が通常の投票プロセスを通じて将来割り当てるために予約することであり、各国の標準化団体が一方的に割り当てることではなかったため、この提案された動きは、GB 18030 と ISO/IEC 10646 (したがって Unicode) の間の「同期を不安定にする」ものであり、単一の実装で両方に準拠することが不可能になるものとして、専門家や他の各国の団体から批判された。 [ 5 ]事実上、Unicodeが分岐することになる。2023 年 3 月の会議で、IRG は、その後の GB 18030 の修正案をタイムリーに IRG の専門家に提供すること、および「ISO/IEC 10646 規格を不適切に使用しない」ことの重要性を強調した。[ 7 ]
代替案として、このレパートリー(専門家によるレビューを経て最終的に622文字に削減)は、CJK統合漢字拡張Iブロックとして、2023年9月にUnicodeバージョン15.1に迅速に採用されました。[ 5 ]これらの文字は「GIDC23」Unihanソースを構成しており、[ 8 ]「中国公安部IDシステム、2023」からソースされたものと定義されています。[ 9 ] CJK統合漢字拡張Dブロックは、IRGメンバー団体からの緊急に必要な文字(UNC)のレパートリーで構成されていたため、前例として挙げられました。一方、当初拡張Dとなる予定だったIRGワーキングセットは、代わりに拡張Eとなりました。[ 10 ]コンパクトさのために、このブロックはCJK統合漢字拡張Hの後の三次漢字平面ではなく、 CJK統合漢字拡張Fの後の補助漢字平面の利用可能なスペースに割り当てられました。これは、CJK拡張ブロックが拡張文字によるアルファベット順ではなくなったことを意味します。[ 11 ]これを受けて、GB 18030改正案は拡張Iコードポイントを使用するように修正されました。[ 6 ]
2023年10月の次回の会議で、IRGはCJK文字の大規模なコレクションについてIRGを迂回することへの懸念を表明し、拡張Iの2つの文字は、他の地域の文字ソースの目的で、以前にIRGの統合ルールに基づいて既存の文字と統合されていたことを指摘した。[ 3 ] [ 12 ]
- 草部首の互換性のある形式を許容すると、U+2ED9D CJK UNIFIED IDEOGRAPH-2ED9Dは、U+8286芆CJK UNIFIED IDEOGRAPH-8286 ( CNS 11643から参照)の既存の T ソース (台湾) グリフと、同じものに対する提案された J ソース (日本) グリフの両方に対応します。[14 ] U + 8286のもう一方の( G ソース、つまり中国本土) グリフに対応する文字は、CNS 11643 のより新しい版の他の場所に存在するため、U+2ED9D の追加は、CNS 11643 と Unicode の間の既存の対応関係に影響を与えますが、どちらの文字もプレーン 1 または 2 にないため、Big5 の Unicode マッピングには影響はありません。[ 12 ]
- U+2EDE0 CJK UNIFIED IDEOGRAPH-2EDE0 は、U+8FF3迳CJK UNIFIED IDEOGRAPH-8FF3の提案された J ソース (日本) グリフに対応します。 [ 15 ]これは以前に新しい文字として 2 回提案されました (1 回は CNS 11643 を参照、もう 1 回は日本から) が、U+8FF3 と統合可能であるという理由で却下されました。 [ 12 ]この提案されたグリフは、後に日本の国家機関の要請により、新しいU+2EDE0 CJK UNIFIED IDEOGRAPH-2EDE0コード ポイントに移動されました。 [ 16 ]
これに対し、IRGは、今後、提案されたCJK文字の提出者は、提出物によって提案された分割が他のCJK文字ソースに与える影響に関する情報を提供することが義務付けられるべきであり、IRGはすべての大規模なCJK文字の提出物を審査する時間を確保すべきであると勧告した。IRGは、中国側に対し、次回のIRG会議でこれら2文字の追加によって生じた問題に対する解決策を提案するよう促した。[ 3 ]
ブロック
CJK 統合表意文字拡張 I ブロックには、Unicode 表意文字バリエーション データベース (IVD) に登録されている2 つの表意文字バリエーション シーケンスがあります。 [ 17 ] [ 18 ]これらのシーケンスは、特定の Unicode 文字の目的のグリフ バリエーションを指定します。
歴史
以下のUnicode関連文書は、CJK統合漢字拡張Iブロックにおける特定の文字の定義の目的とプロセスを記録したものです。
参考文献
- ↑ 「Unicode文字データベース」。Unicode標準。 2023年9月12日取得。
- ↑ 「Unicode標準の列挙バージョン」。Unicode標準。 2023年9月12日取得。
- 1 2 3象形文字研究グループ(2023-10-20)。「勧告 IRG M61.12: 他の CJK ソース文字への拡張 I の問題 (IRGN2635 およびフィードバック、IRGN2622)」(PDF)。IRG会議 #61 勧告およびアクション項目。ISO /IEC JTC1/SC2 N4885、WG2 N5243、IRG N2620; UTC L2/23-250。
- ↑ Kaplan, Michael S (2013-03-28). 「あなたはそれをGB18030と呼ぶが、私はそれをUTF-GBKと呼ぶ…」すべてを整理する。
- 1 2 3 4米国国家機関(2023 年 5 月 1 日)。「GB 18030-2022 改正 1 のドラフト 2 および ISO/IEC 10646:2020 改正 2 の勧告に関する USNB コメント」(PDF)。ISO /IEC JTC1/SC2 N4852、WG2 N5222、UTC L2/23-115。
- 1 2中国国家体(2023-10-13)。「IRG#61活動報告書」(PDF)。ISO/IEC JTC1/SC2 /WG2/ IRG N2623; UTC L2/23-240。
- ↑象形文字研究グループ(2023-03-24)。「勧告 IRG M60.7: GB18030-2022 改正案フィードバック (IRGN2591、IRGN2605)」(PDF)。IRG会議 #60 勧告およびアクション項目。ISO /IEC JTC1/SC2 N4840、WG2 N5205、IRG N2600; UTC L2/23-087。
- ↑ 「CJK 統一漢字拡張 I」(PDF)。Unicode標準、バージョン 15.1。Unicodeコンソーシアム。2023年。
- ↑ケン、ルンデ;リチャード・クック編。 (2023-09-01)。「kIRG_GSource」。Unicode Han データベース (Unihan)。ユニコード 15.1.0。 UAX #38。
- ↑ Lunde, Ken (2023-04-22). "03) L2/23-100: GB 18030-2022 改正案、草案 2 + コメントの処理、草案 1" (PDF) . CJK & Unihan Group による UTC #175 会議への勧告. UTC L2/23-082.
- ↑「CJK/Unihan の変更」。Unicode 15.1.0。Unicodeコンソーシアム。2023年 9 月 12 日。CJK
ブロック範囲をできるだけコンパクトに保つため、拡張 I は、プレーン 3 の拡張 H の直後ではなく、プレーン 2 に追加されました。実装者は、コードが CJK 拡張がすべて拡張文字のアルファベット順になっていることを前提としていないことも確認する必要があります。
- 1 2 3シム・チョンヒョン(2023-05-17)「2. 新たに導入された半重複文字」(PDF) . CJK-ExtI における複数ソースの水平拡張の適用. pp. 3–5 . ISO/IEC JTC1/SC2 /WG2/ IRG N2635. (注:参照文書は、Unicodeに採用された最終版とは異なるコードポイントを持つ、拡張Iの初期草案を参照しています。参照文書のU+2ED90は、最終版のU+2ED9D CJK UNIFIED IDEOGRAPH-2ED9Dに相当し、参照文書のU+2EDD1は、最終版のU+2EDE0 CJK UNIFIED IDEOGRAPH-2EDE0に相当します。)
- ↑ 「CJK 統一漢字」(PDF)。Unicode標準、バージョン 15.0。Unicodeコンソーシアム。p . 823。
- ↑日本国内機関(2023-04-24)。「WG2 n5221 データファイル:水平拡張案」(PDF)。ISO /IEC 10646 の J 列の水平拡張要求(PDF)。p. 414。ISO /IEC JTC1/SC2 /WG2 N5221; UTC L2/23-144。
- ↑日本国内機関(2023-04-24)。「WG2 n5221 データファイル:水平拡張案」(PDF)。ISO /IEC 10646 の J 列の水平拡張要求(PDF)。p. 458。ISO /IEC JTC1/SC2 /WG2 N5221; UTC L2/23-144。
- ↑スイニャール、ミシェル編 (2024-01-03)。「ISO/IEC 10646 第 6 版に対する CDAM2.3 に関するコメントの処理」(PDF)。ISO /IEC JTC1/SC2 /WG2 N5245、UTC L2/24-016。
- ↑ 「表意文字のバリエーションデータベース」。Unicodeコンソーシアム。
- ↑ 「UTS #37、Unicode表意文字バリエーションデータベース」。Unicodeコンソーシアム。
さらに読む
- ルンデ、ケン(2023-07-15)。「憲法修正第 1 条」。この記事では、CJK統一漢字拡張Iブロックがどのように標準化されたか、そしてGB 18030-2022改正案の2つの草案との関係について詳しく説明します。