Loading article…
| チベット語 | |
|---|---|
| 範囲 | U+0F00..U+0FFF (256 コードポイント) |
| 飛行機 | BMP |
| スクリプト | チベット語(207文字) 共通語(4文字) |
| 主なアルファベット | チベット・ゾンカ 語 |
| 割り当て済み | 211 コードポイント |
| 未使用 | 45 予約コードポイント 2非推奨 |
| Unicode バージョン履歴 | |
| 2.0 (1996) | 168 (+168) |
| 3.0 (1999) | 193 (+25) |
| 4.1 (2005) | 195 (+2) |
| 5.1 (2008) | 201 (+6) |
| 5.2 (2009) | 205 (+4) |
| 6.0 (2010) | 211 (+6) |
| Unicodeドキュメント | |
| コードチャート ∣ Webページ | |
| 注: [1] [2] ISO 10646 との統合により、元のチベットブロックはUnicode 1.0.1で削除されました。[3]現在のブロック(新しいエンコーディングモデルと異なる範囲を持つ)はバージョン2.0で導入されました。 | |
チベット語は、チベット語、ゾンカ語、および中国、ブータン、ネパール、モンゴル、インド北部、パキスタン東部、ロシアのその他の言語の文字を含む Unicode ブロックです。
ブロック
旧チベットブロック
| チベット語 (Unicode 1.0.0) | |
|---|---|
| 範囲 | U+1000..U+104F (80 コードポイント) |
| 飛行機 | BMP |
| スクリプト | チベット語 |
| 主なアルファベット | チベット・ゾンカ 語 |
| 状態 | Unicode 2.0 のリリース前に削除されました |
| 現在、 | ミャンマー |
| Unicode バージョン履歴 | |
| 1.0.0 (1991) | 71 (+71) |
| 1.0.1 (1992) | 0 (-71) |
| チャート | |
| コードチャート | |
| 注: ISO 10646との統合により、Unicode 1.0.1では元のチベット語ブロックが削除されました。[3]チベット語は後にUnicode 2.0の新しいエンコードモデルで再導入されました。 | |
チベット語の Unicode ブロックは、可視のsrog medと接続子音を正しく区別できなかったviramaベースのエンコーディングを使用してバージョン 1.0.0 で割り当てられたという点で独特です。 [注 1]このエンコーディングは、バージョン 1.1 のISO 10646との統合プロセスでバージョン 1.0.1 のUnicode 標準から削除され、[3]その後、バージョン 2.0 で、より大きなブロック サイズで明示的なルート/サブジョイン エンコーディングとして再導入されました。Unicode 2.0 に続くすべてのバージョンでは、Unicode 安定性ポリシーによって既存の文字の移動または削除が禁止されているため、Unicode 2.0 およびそれ以降のすべてのバージョンでエンコードされたチベット語の文字は不変です。
旧Unicode 1.0.0チベットブロックの範囲は、Unicode 3.0以降ミャンマーブロックによって占められている。Microsoft Windowsでは、旧チベットブロックを参照する照合データはWindows XPまで保持され、Windows 2003で削除された。[4]
歴史
以下の Unicode 関連文書には、チベット文字ブロック内の特定の文字を定義する目的とプロセスが記録されています。
脚注
- ^ほとんどの Unicode インド語エンコーディングでは、 ゼロ幅非結合子(ZWNJ)を使用してシステムに目に見えるハランタを表示させたり、ゼロ幅結合子(ZWJ)を使用して非結合子音形式の使用を強制したりすることはできますが、チベット語を書くときに重要な結合子音のレンダリングを強制する方法はありません。例外がいくつかあります。たとえば、シンハラ語では結合子音を強制するために ZWJ を使用します。
参考文献
- ^ 「Unicode 文字データベース」。Unicode標準。2023 年 7 月 26 日閲覧。
- ^ 「Unicode 標準の列挙バージョン」。Unicode標準。2023 年 7 月 26 日閲覧。
- ^ abc 「Unicode 1.0.1 補遺」(PDF)。Unicode標準。1992 年 11 月 3 日。2016 年 7 月 9 日閲覧。
- ^ Kaplan, Michael (2007-08-28). 「すべての文字には物語がある #29: U+1000^H^H^H^H0f40、(いつ尋ねるかによって、チベット文字またはミャンマー文字の KA)」。すべてを整理します。
- Unicode コンソーシアムに投稿された中国の懸念では、接続文字「སྐྤྵྴྍྐ」(EWTS s+k+p+Sh+sh+x+ka、IAST skpṣśxka) が引用されており、エンコードの複雑さが示されています。(デーヴァナーガリー文字のエンコードでは「ᳵ」の接続が許可されていないため、「स्क्प्ष्श्ᳵ्क」は存在しません。)
