| エイリアス | ISO-IR-111 |
|---|---|
| 言語 | ロシア語、ベラルーシ語、マケドニア語、セルビア語、ウクライナ語(一部) |
| 標準 | ECMA-113:1986 |
| 分類 | 拡張ASCII、KOI |
| 拡張 | KOI8-B |
| 後継者 | ECMA-113:1988 ( ISO-8859-5 ) |
| その他の関連エンコーディング | KOI8-F |
ISO-IR-111 [1]またはKOI8-E [2]は、8ビットの文字セットです。これは、ベラルーシ語、マケドニア語、セルビア語、ウクライナ語(KOI8-Fに追加されたҐґを除く)用のKOI-8の多国間拡張です。「ISO-IR-111」という名前は、 ISO-IRレジストリの登録番号を指し、 ISO/IEC 2022で使用できるセットであることを示します。
これは、 ISO/IEC 8859-5に対応するEcma International規格であるECMA-113の最初の版(1986年)[3]で定義され、ISO-8859-5の1987年ドラフト版にも対応しています。[4] ISO/IEC 8859-5の公開版は、代わりに、異なるエンコーディングを定義するECMA-113の後続版に対応しています。[5]
命名の混乱
ECMA-113の1985年版であるISO-IR-111(「ECMA-Cyrillic」または「KOI8-E」とも呼ばれる)は、GOST 19768の1974年版(すなわちKOI-8)に基づいていました。1987年にECMA-113は再設計されました。[5]これらの新しいECMA-113版はISO-8859-5と同等であり、[5] [6] KOIレイアウトに従っていません。この混乱により、ISO-8859-5はGOST 19768-74で定義されたか、またはGOST 19768-74に基づいているという一般的な誤解につながりました。[6]
おそらくこれの別の結果として、RFC 1345 は誤って「ISO-IR-111」および「ECMA-Cyrillic」という名前で別のコードページをリストしています。これは、行の順序が変更された ISO-8859-5 に似ており、Windows-1251と部分的に互換性があります。[7] [6]既存の実装がこれら 2 つのラベルに RFC 1345 の定義を使用する可能性があるという懸念から、IANA がKOI8-EECMA-113:1985 コンテンツのラベルとしてさらに認識することが提案され、 [7] IANA は現在そのラベルを別名としてリストしています。[2]
文字セット
次の表は ISO-IR-111 エンコードを示しています。各文字は、対応するUnicodeコード ポイントとともに表示されます。
拡張版と修正版
KOI8 Unified またはKOI8-Fと呼ばれる修正版が、Fingertip Software 社が作成したソフトウェアで使用され、KOI8-Uの位置にҐが追加され(ソフトハイフンが置き換えられ、ユニバーサル通貨記号が置き換えられました)、C1 制御コード領域に主にKOI8-RとWindows-1251からのいくつかのグラフィカル文字が追加されました。[4] [6] [8] [9]
RFC 1345 コード ページが正しくありません
| 言語 | ロシア語、ベラルーシ語、マケドニア語、セルビア語 |
|---|---|
| 標準 | RFC 1345 |
| 分類 | 拡張ASCII |
| 変換/エンコード | ISO-IR-111 |
| その他の関連エンコーディング | ISO-8859-5、Windows-1251 |
RFC 1345 では、誤って ISO-IR-111 という別のコード ページがリストされています。これは、同じキリル文字を異なるレイアウトでエンコードしたものです。これは、Windows-1251とISO-8859-5が混在したものに似ています。[7]具体的には、行 A_ は ISO-8859-5 に対応し、行 C_ から F_ は Windows-1251 [6]に対応し (ISO-8859-5 の行 B_ から E_ に相当)、行 B_ は、 § が¤に置き換えられていることを除いて、ISO-8859-5 の行 F_ にほぼ対応しています。
一部のコードは大文字と小文字が反転した ISO-IR-111 に似ており、これが混乱の原因となっている可能性があります。大部分は異なり、以下に示します。
参照
参考文献
- ^ ECMA (1985年8月1日). キリル文字の右側部分(PDF) . ITSCJ/ IPSJ . ISO-IR -111.
- ^ ab 「文字セット」。IANA。
- ^ ECMA-113. 8 ビット 1 バイト符号化グラフィック文字セット - ラテン文字/キリル文字アルファベット (第 1 版、1986 年 6 月)
- ^ ab Czyborra, Roman (1998-11-30) [1998-05-25]. 「The Cyrillic Charset Soup」. 2016-12-03時点のオリジナルよりアーカイブ。2016-12-03に閲覧。
- ^ abc ECMA-113. 8 ビット 1 バイト符号化グラフィック文字セット - ラテン文字/キリル文字アルファベット (第 2 版、1988 年 6 月)
- ^ abcde Nechayev, Valentin (2013) [2001]. 「8ビットキリル文字エンコーディングの世界のレビュー」。2016年12月5日時点のオリジナルよりアーカイブ。2016年12月5日閲覧。
- ^ abc Sokolov, Michael (2003-04-05). 「ECMA-cyrillic alias iso-ir-111 sore」. IETF Charsets メーリング リスト。
- ^ 「KOI8 Unified」。Fingertip Software。1998年1月9日時点のオリジナルよりアーカイブ。2020年2月11日閲覧。
- ^ Leisher, Mark (2008) [1998-03-05]. 「KOI8 統合キリル文字から Unicode 2.1 へのマッピング表」. ニューメキシコ州立大学数学科学部. 2020年5月2日閲覧。
