ISO/IEC 10367 :1991は、 ISO/IEC JTC 1/SC 2 [1]によって開発された標準であり、ISO/IEC 4873 [2]のレベル2および3を実装する文字エンコーディングで使用するグラフィカル文字セットを定義しています(ISO/IEC 4873のレベル1の文字エンコーディングを定義するISO/IEC 8859とは対照的です)。
ISO/IEC 8859との関係
ISO/IEC 8859の各パートは、ISO/IEC 4873のレベル1の完全なエンコーディング(つまり、C1領域を予約したステートレス拡張ASCII シングルバイトエンコーディング)を定義しており、複数のパートを一緒に使用することはできません。ISO/IEC 4873のレベル2および3(つまり、追加のグラフィカル文字セット用のシフトコード付き)で使用する場合、ISO/IEC 8859では、代わりにISO/IEC 10367の同等のセットを使用する必要があると規定しています。[3]
ISO/IEC 10367:1991には、 ASCIIに加えて、ISO/IEC 6937 ( ITU T.51 )およびISO/IEC 8859パート1から9 (つまり、1991年に発行された時点で存在していた部分)の右側(非ASCII部分)に使用されるG1セットに一致するセット、それらの部分の一部を補足する追加のローマ字セット、およびボックス描画文字セット(以下に示す)が含まれています。[2] [4]
補足 G3 ラテン語セット
ISO/IEC 10367 には、ラテンアルファベットの 1、2、5 番 ( ISO-8859-1、ISO-8859-2、ISO-8859-9 )を補足することを目的としたISO-IR-154グラフィカル セットが含まれています。 [4]具体的には、ISO/IEC 4873 のプロファイルで G3 セットとして使用することを意図しており、G1 セットと G2 セットには ISO-8859-2 の右側と、ISO-8859-1 または ISO-8859-9 のいずれかの右側が含まれています。[5]これらの構成は、非スペーシング コードなしでISO/IEC 6937レパートリー (ITU T.51 付録 A)全体を表します。 [6]
たとえば、文字 Ĉ は、0x8F 0x23このセットが含まれているかのように ISO/IEC 4873 レベル 2 でエンコードされます。
強調表示された文字はISO-8859-1またはISO-8859-9にも登場します。ISO/IEC 4873 / ECMA-43の現在の版では(以前の版ではそうではありませんが)、文字は登場する最も番号の小さいワーキングセットから使用されなければなりません。そのため、ISO-8859の右側のセットがG1またはG2セットとして使用される場合、これらの文字はこのG3セットからは使用されません。[8]
ボックス描画セット
以下はISO/IEC 10367のボックス描画セットで、ISO/IEC 2022ではISO-IR-155として登録されています。0x20 /A0や0x7F/FFの位置は使用していませんが、96文字セットとして登録されています。[9]
Perl libintl には「ISO_10367-BOX」コーデックが含まれています。これは、GL 上の ASCII と GR 上の ISO-IR-155 ボックス描画セットを、若干の差異を伴ってエンコード/デコードします。具体的には、太線文字の代わりに二重線のボックス描画文字が含まれ、0xCB の上半分のブロック (▀) が「ユニット スペース B」として文書化されている私用文字U+E019 に置き換えられます。[10]
参考文献
- ^ ISO/IEC JTC 1/SC 2 (1991). 「情報技術 - 8 ビット コードで使用するための標準化されたコード化グラフィック文字セット」. ISO . ISO/IEC 10367:1991.
{{cite web}}: CS1 maint: 数値名: 著者リスト (リンク) - ^ ab van Wingen, Johan W (1999). 「8. コード拡張、ISO 2022 および 2375、ISO 4873 および 10367」。文字セット。文字、トークン、コード。Terena。2020 年 8 月 1 日時点のオリジナルよりアーカイブ。
- ^ ISO/IEC JTC 1/SC 2 (1998-02-12). DIS 8859-10 の最終テキスト、情報技術 - 8 ビット 1 バイト符号化グラフィック文字セット - パート 10: ラテン アルファベット No. 6 (PDF)。ISO/IEC FDIS 8859-10:1998、JTC1/SC2 N2992、WG3 N415。
{{citation}}: CS1 maint: 数値名: 著者リスト (リンク) - ^ ab 「8 ビット文字セット - ISO/IEC 10367」。ヨーロッパにおける文字セットの使用ガイド。DKUUG。
- ^ ab ECMA (1990-03-01). ラテンアルファベット1、2、5の補足セット(PDF) . ITSCJ/ IPSJ . ISO-IR -154.
- ^ ISO/IEC JTC 1/SC 2/WG 3 (1998-04-15)。「付録 E: 非スペーシング分音記号のないレパートリーの代替コード化表現」。WD 6937、テキスト通信用コード化グラフィック文字セット - ラテンアルファベット(PDF)。p. 37。JTC1/SC2/N454。
{{citation}}: CS1 maint: 数値名: 著者リスト (リンク) - ^ ECMA (1991)。「この ECMA 標準の第 2 版 (1985) と現在の (第 3) 版の主な違い」。ECMA-43: 8 ビットコード化文字セットの構造と規則(PDF) (ECMA 標準) (第 3 版)。p. 23。
- ^ ECMA (1991)。「文字の一意のコーディング」。ECMA-43: 8 ビットコード化文字セットの構造と規則(PDF) (ECMA 標準) (第 3 版)。p. 10。
- ^ ab ISO/IEC/JTC1/SC2/WG3 (1990-04-16). 基本ボックス図面セット(PDF) . ITSCJ/ IPSJ . ISO-IR -155.
{{citation}}: CS1 maint: 数値名: 著者リスト (リンク) - ^ Flohr, Guido. 「ISO_10367_BOX の変換ルーチン」. libintl-perl . Locale::RecodeData::ISO_10367_BOX.
