MIK ( МИК ) は、 DOSで使用される8 ビットのキリル文字 コード ページです。これは、ブルガリアのPravetz 16 [1] IBM PC 互換システムで使用される文字セットに基づいています。Kermitはこの文字セットを「BULGARIA-PC」または「bulgaria-pc」と呼んでいます。[2] [3] [4]ブルガリアでは、誤ってコード ページ 856 と呼ばれることがありました (これは、IBM のヘブライ語コード ページの定義と衝突します)。このコード ページは、Star プリンターとFreeDOSではコード ページ 3021として知られています (以前は FreeDOS ではコード ページ 30033 (現在はクリミア タタール語のグリブナ記号を含むコード ページ 857 のバリアントに使用されています) として知られていましたが、Star プリンターのコード ページに一致するように番号が付け直されました)。
これは、 CP 808、CP 855、CP 866、CP 872 ではなく、ブルガリアで最も広く使用されているDOS / OEMコード ページです。
ブルガリアで作成され、ブルガリア語の文字列を含むほぼすべての DOS プログラムは、エンコードとして MIK を使用しており、そのようなプログラムの多くは現在でも使用されています。
文字セット
各文字は、対応するUnicodeコード ポイントと 10 進コード ポイントとともに表示されます。表の後半部分 (コード ポイント 128 ~ 255) のみが表示され、前半部分 (コード ポイント 0 ~ 127) はASCIIと同じです。
Unicode へのマッピング テーブルを実装する人への注意
Unicode へのマッピング テーブルを実装する場合は、MIK コード ページによって一部の文字が統合されることに注意する必要があります。
バイナリ文字操作
MIKコード ページはすべてのキリル文字をアルファベット順に保持し、バイナリ形式での文字操作を非常に簡単にします。
10xx xxxx - キリル文字
100x xxxx - 大文字のキリル文字
101x xxxx - 小文字のキリル文字
このような場合、テストと文字操作は次のようになります。
IsAlpha()、IsUpper()、IsLower()、ToUpper()、ToLower()、
はビット操作であり、ソートは文字値の単純な比較によって行われます。
参照
参考文献
- ^ “Pravetz 16”. 2016年12月6日時点のオリジナルよりアーカイブ。2016年12月6日閲覧。
- ^ da Cruz, Frank (2010-04-02). 「Kermit と MIME 文字セット名」. The Kermit Project .コロンビア大学、ニューヨーク、米国。2016 年 12 月 3 日時点のオリジナルよりアーカイブ。2016年 12 月 2 日閲覧。
- ^ 「Kermit 95 - キリル文字セット」。
- ^ ab http://www.columbia.edu/kermit/ftp/charsets/cp856.txt [単なる URL のプレーンテキストファイル]
- ^ Czyborra, Roman (1998-11-30) [1998-05-25]. 「The Cyrillic Charset Soup」。2016年12月3日時点のオリジナルよりアーカイブ。2016年12月3日閲覧。[1] [2]
- ^ Hohlov, Yu. E. 「電子形式でのキリル文字情報表現 - 文字セット (コード ページ) テーブル」。2016 年 12 月 5 日時点のオリジナルよりアーカイブ。2016年 12 月 5 日閲覧。
外部リンク
- https://www.unicode.org/Public/MAPPINGS/VENDORS/IBM/IBM_conversions.html Unicode Consortium による IBM のコード ページと Unicode 間のマッピング
- http://www.cl.cam.ac.uk/~mgk25/unicode.html#conv Markus Kuhnによる Unix/Linux 向け UTF-8 および Unicode FAQ
