| ハングル音節 | |
|---|---|
| 範囲 | U+AC00..U+D7AF (11,184 コードポイント) |
| 飛行機 | BMP |
| スクリプト | ハングル |
| 主なアルファベット | ハングル |
| 割り当て済み | 11,172 コードポイント |
| 未使用 | 12 個の予約コードポイント |
| ソース標準 | KS C 5601-1992 |
| Unicode バージョン履歴 | |
| 2.0 (1996) | 11,172 (+11,172) |
| Unicodeドキュメント | |
| コードチャート ∣ Webページ | |
| 注: [1] [2] Unicode 1.1では6,656文字がU+3400..U+4DFF に存在していましたが、Unicodeバージョン2.0では4,516文字が追加され、現在の位置に移動されました。 | |
Hangul Syllablesは、現代韓国語用にあらかじめ作成されたハングル音節ブロックを含むUnicode ブロックです。音節は、アルゴリズムによってHangul Jamo Unicode ブロックの 2 文字または 3 文字のシーケンスに直接マッピングできます。
- U+1100~U+1112 のいずれか: 19 個の現代ハングルの先頭子音字母。
- U+1161 ~ U+1175 の 1 つ: 21 の現代ハングル母音ジャムス。
- なし、または U+11A8 ~ U+11C2 のいずれか: 27 個の現代ハングル末尾子音字母。
このブロックは、各音節を構成するこれら(2 つまたは 3 つ)の字母(上記の字母の各サブ範囲に 1 つ)の標準的に同等な順序に従ってエンコードされます。
完全なハングル音節にはこれらの文字の 1 つが含まれる場合がありますが、その前に 1 つ以上の先頭子音字母が付き、その後に 1 つ以上の末尾字母が続く場合があります (エンコードされた音節が 2 つの字母で構成され、末尾子音字母が含まれない場合は、1 つ以上の母音字母が前に付く可能性があります)。また、ハングル音節の中には、これらの合成済み文字が 1 つも含まれないものもあります。しかし、ハングル文字のこのような拡張 (同じ四角形で構成されるより複雑な音節を作成できる) は、現代の韓国語ではあまり一般的ではありません。
ブロック
歴史
ハングル音節を Unicode でエンコードすることは、コード ポイントの再編成によって複雑になりました。
- Unicode バージョン 1.0.0 では、 KS C 5601-1987の U+3400–U+3D2D から2,350 の現代韓国語ハングル音節がエンコードされました。この範囲は現在、 CJK 統合表意文字拡張 Aの一部となっています。
- バージョン 1.1 では、 KS C 5657-1991のU+3D2E–U+44B7 から1,930 個の現代音節、 GB 12052 -89 の U+44B8–U+44BD から 6 個の現代音節、および前述の 3 つのセットに含まれない最初の 2,370 個の音節が U+44BE–U+4DFF に追加されました。これらは、現在のCJK 統合表意文字拡張 Aの残りの部分と、現在の易経六十四卦記号のすべてをまとめてカバーしています。
- さらに、Unicode 1.1には3つのエラーがありました。[3]
- U+384E: Unicode 文字データベースでは 삤 ですが、Unicode 1.0 および ISO/IEC 10646-1:1993 コード表およびソース標準マッピングでは 삣 です。
- U+40BC: Unicode文字データベースでは삣だが、ISO/IEC 10646-1:1993コード表およびソース標準マッピングでは삤である
- U+436C: Unicode文字データベースでは콫だが、ISO/IEC 10646-1:1993コード表およびソース標準マッピングでは콪である
- さらに、Unicode 1.1には3つのエラーがありました。[3]
- バージョン2.0では、KS C 5601-1992から残りの4,516の可能な音節が追加され、エンコードされたすべての音節が現在のU+AC00~U+D7AFの範囲に再配置され[4] [5]、個々のジャモへのアルゴリズム分解が可能になりました。
RFC 2279 では、この重大な互換性のない変更は、韓国語用の Unicode を使用するデータやソフトウェアが存在しないという前提で行われたと説明されています。
「このような互換性のない変更を許可した公式の理由は、ハングルを含む実装やデータが存在しないということでしたが、これは真実である可能性が高いですが、証明は不可能です。この事件は「韓国の混乱」と呼ばれ、関係委員会は、このような互換性のない変更を二度と行わないことを誓約しました。」— RFC 2279
その後、Unicodeは「一度エンコードされた文字は移動または削除されない」というエンコード安定性ポリシーを採用しました。[6]
次の Unicode 関連ドキュメントには、ハングル音節ブロック内の特定の文字を定義する目的とプロセスが記録されています。
参考文献
- ^ 「Unicode 文字データベース」。Unicode標準。2023 年 7 月 26 日閲覧。
- ^ 「Unicode 標準の列挙バージョン」。Unicode標準。2023 年 7 月 26 日閲覧。
- ^ Chung, Jaemin (2017-03-29). 「Unicode 2.0 以前の現代ハングル音節 3 つに関する情報文書」(PDF)。
- ^ Chang, KD; Choi, In Sook; Kim, Jung Ho (1995-10-04). 「韓国語ハングルエンコーディング変換表」。
- ^ 「HANGUL.TXT の注記と訂正」 2005-10-13.
- ^ 「Unicode 文字エンコーディング安定性ポリシー」。Unicode コンソーシアム。2016 年 11 月 14 日。
