| 言語 | 日本語サポートのためにJIS X 0208と併用することを目的としています。単独では実質的にどの言語もサポートしません。 |
|---|---|
| 標準 | JIS X 0212:1990 |
| 現在の状況 | Unihanソース。コード化文字セット自体はJIS X 0208ほど広くサポートされていないが、EUC-JPで使用されることもある。[1] |
| 分類 | |
| 拡張機能 | |
| エンコード形式 | |
| 後継者 | JIS X 0213 |
| その他の関連エンコーディング | 補足目的: JIS X 0208 その他の補足 ISO 2022 CJK DBCS: KS X 1002 |
JIS X 0212は、日本語で使用する補助文字をエンコードするためのコード化文字セットを定義する日本工業規格です。この規格は、 JIS X 0208 (コード ページ 952) を補足することを目的としています。IBMコードページでは、953または5049という番号が付けられています(下記参照)。
これは、Unicode のCJK 統合表意文字のソース標準の 1 つです。
歴史
1990 年に日本規格協会 (JSA) は、補助文字セット規格 JIS X 0212-1990 情報交換用漢字記号-補助漢字 (Jōhō Kōkan'yō Kanji Fugō - Hojo Kanji) を発表しました。この規格は、メインのJIS X 0208文字セットで使用可能な文字の範囲を拡大し、そのセットのカバレッジの欠点に対処することを目的としていました。
特徴

この標準では、次の 6,067 文字が指定されています。
- 21 個のギリシャ文字と発音区別符号
- 26 個の東ヨーロッパ文字(主にキリル文字)と発音区別符号
- 発音区別符号付きアルファベット198文字
- 5,801漢字
エンコーディング
JIS X 0212 文字をファイルなどで使用できるようにするには、次のエンコードまたはカプセル化を使用します。
- EUC-JPでは、文字は 3 バイトで表され、最初のバイトは0x8F 、次の 2 バイトは0xA1~0xFE の範囲になります。
- ISO 2022ベースのJIS エンコーディングの特定の実装( ISO-2022-JP-EXT、ISO-2022-JP-1、ISO-2022-JP-2 など)では、このシーケンスは
ESC $ ( DJIS X 0212 文字を示すために使用されます。
Shift JIS には文字用の未割り当てコード領域が十分ではないため、 一般的なShift JISエンコードで JIS X 0212 文字をカプセル化することはできません。
実装
JIS X 0212はIBMではコードページ953と呼ばれ、ベンダー拡張が含まれています。 [2] [3] [4]代替CCSID 5049ではこれらの拡張は除外されています。[5]
JIS X 0212 文字は、日本語の情報処理で伝統的に主流となっているコード体系である Shift JIS ではエンコードできないため、この文字セットの実用的な実装はほとんど行われていません。前述のように、Unix / Linuxシステムで一般的に使用されている EUC-JP ではエンコードできるため、ほとんどの実装がこの EUC-JP で行われています。
- 1990 年代初頭には、基本的な「BDF」フォントが Unix X ウィンドウ システムで使用するためにコンパイルされました。
- Wnnシステム用のIME変換ファイルがコンパイルされました。
- kterm コンソール ウィンドウ アプリケーションがこれをサポートするために拡張されました。
- Emacsおよびjstevieエディタはこれをサポートするために拡張されました。
Netscape / Mozilla / Firefoxファミリー、Operaなどの多くの WWW ブラウザや、 Mozilla Thunderbirdなどの関連アプリケーションは、EUC-JP エンコードでの JIS X 0212 文字の表示をサポートしていますが、Internet Explorer はJIS X 0212 文字をサポートしていません。GNOME Terminalなどの最新の端末エミュレーションパッケージも JIS X 0212 文字をサポートしています。
EUC コーディングで JIS X 0212 をサポートするアプリケーションには、次のものがあります。
- Unix/Linux 用の xjdic 辞書プログラム。
- WWWJDIC日本語辞書サーバー (ただし、Internet Explorer はEUC の JIS X 0212 拡張をサポートしていないため、このサーバーは EUC-JP モードに設定するとこれらの文字のビットマップ グラフィックを送信します。 )
JIS X 0212 と Unicode
JIS X 0212 の漢字は、漢字統一のソースの 1 つとして採用され、最初のISO 10646 / Unicode標準のCJK文字の統一セットにつながりました。5,801 の漢字がすべて組み込まれました。
未来
前述のアプリケーションを除けば、 JIS X 0212 規格は事実上廃止されています。この規格の 2,743 個の漢字は、後のJIS X 0213規格に取り入れられました。長期的には、この規格の貢献は、 Unicodeに取り入れられた 5,801 個の漢字であると見なされるでしょう。
参照
参考文献
- JIS X 0212-1990 情報交換用漢字記号―補助漢字、日本規格協会、東京 (1990年10月1日制定)。(日本の規格書)
- 日本語情報処理の理解、ケン・ルンデ、オライリー&アソシエイツ、1993年
- CJKV Information Processing、Ken Lunde、O'Reilly & Assoc. 1999年、2008年。
- ^ アン・ファン・ケステレン。 「5. 索引(§ 索引 jis0212)」。エンコーディング標準。なんてことだ。
- ^ 「コード ページ 953 情報ドキュメント」。2016 年 3 月 17 日時点のオリジナルよりアーカイブ。
- ^ 「CCSID 953 情報文書」。2016 年 3 月 28 日時点のオリジナルよりアーカイブ。
- ^ コードページ CPGID 00953 (pdf) (PDF)、IBM
- ^ 「CCSID 5049 情報文書」。2016 年 3 月 27 日時点のオリジナルよりアーカイブ。
外部リンク
- 日本語版WikipediaのJIS X 0212の記事
- KANJD212 データベースドキュメント
- JIS X 0212 コード表
- 国際 Unicode コンポーネント (ICU)、jisx-212.ucm
