ISO/IEC 8859-5:1999、「情報技術 - 8ビットシングルバイト符号化グラフィック文字セット - 第5部:ラテン/キリル文字」は、 ASCIIベースの標準文字エンコーディングであるISO/IEC 8859シリーズの一部であり、初版は1988年に発行されました。非公式には、ラテン/キリル文字と呼ばれています。
これは、ブルガリア語、ベラルーシ語、ロシア語、セルビア語、マケドニア語など、キリル文字を使用する言語をカバーするように設計されましたが、広く使用されることはありませんでした。8 ビット エンコーディングのKOI8-RとKOI8-U、IBM-866、およびWindows-1251の方がはるかに一般的に使用されています。Windows -1252とISO 8859-1の関係とは対照的に、Windows-1251 は ISO 8859-5 とは密接な関係がありません。ただし、Unicodeのメインのキリル文字ブロックは、ISO-8859-5 に基づくレイアウトを使用しています。
ISO 8859-5 は、1933年から1990年までのソビエト連邦におけるウクライナ語 にも使用可能であったが、それ以前およびそれ以降、そしてソビエト連邦ウクライナ国外においてもウクライナ語の正書法で必要とされるウクライナ語の文字ge、ґが欠落している。そのため、IBM はコード ページ 1124を作成した。
ISO-8859-5は、ISO/IEC 6429のC0 および C1 制御コードを追加した場合の、この標準のIANA推奨文字セット名です。ISO -8859-5 のWindows コード ページは、コード ページ 28595、別名Windows-28595です。[ 3 ] IBM は、コード ページ 915 が拡張されるまで、ISO-8859-5 にコード ページを割り当てていました。
ISO 8859-1との相違点は、対応するUnicodeコードポイントとともに示されています。
ECMA-113 規格は、第 2 版以降 ISO-8859-5 と同等であり、[ 4 ]第 1 版 ( ISO-IR-111 ) は、可能な限りロシア語の文字を ASCII ローマ字と同じ方法で配置する以前のKOI-8 (GOST 19768-74 で定義)の拡張版でした。ISO-8859-5 (DIS-8859-5:1987) の最初の草案は ISO-IR-111 に倣っていましたが、 1987 年にGOST 19768-74 が新しいISO-IR-153 (Ё を除く)に置き換えられた後[ 5 ]改訂されました[ 4 ]。[ 5 ] [ 6 ] ISO-IR-153 には、Ё を含むロシア語の文字、改行しないスペース、ソフトハイフンが含まれていますが、ISO-8859-5 の完全なキリル文字セットは ISO-IR-144 とも呼ばれます。[ 7 ]
おそらくこの混乱の結果として、RFC 1345 は別のコード ページを「ISO-IR-111」と誤ってリストしており、ISO-8859-5 の文字順序と大文字小文字の順序を ISO-IR-111 の行順序と組み合わせたものです (そのため、実際にはどちらとも互換性がありませんが、実際にはWindows-1251と部分的に互換性があります[ 2 ] )。[ 8 ] [ 2 ]
IBMコードページ915はISO/IEC 8859-5の拡張版で、C1領域にいくつかのセミグラフィック記号やその他の記号を追加しています。IBMコードページ1124はISO-8859-5とほぼ同じですが、ウクライナ語で使用するためにѓをґに置き換えています。
ISO-IR-200、「ウラル補助キリル文字セット」[ 9 ]は、1998年にEverson Gunn Teoranta( Michael Eversonが2001年のEvertype設立以前に取締役を務めていた会社) [ 10 ]によって登録され、ISO-8859-5自体ではサポートされていないキルディン・サーミ語、コミ語、ネネツ語をサポートするために、ロシア語以外の文字をいくつか変更しています。Michael Eversonはまた、クラシックMac OSで同じ言語のためにMac OS Barents Cyrillicを導入しました。FreeDOSでは、これをコードページ59283と呼んでいます。[ 11 ]
ISO-IR-201、「Volgaic Supplementary Cyrillic Set」[ 12 ]も同様に、ロシアの共和国で話されているチュヴァシ語、コミ語、マリ語、ウドムルト語をサポートするためにエバーソン・ガン・テオランタによって導入されました。FreeDOS ではこれをコード ページ 58259と呼んでいます。[ 13 ]