コードページ番号付けシステム IBMは、コンピュータシステムまたはコンピュータシステムの集合が遭遇する可能性のある各文字エンコーディングに、小さくてもグローバルに一意な16ビットの数値を体系的に割り当てるという概念を導入しました。この番号付け方式がIBM発祥であることは、最小の(最初の)数値がIBMのEBCDICエンコーディングのバリエーションに割り当てられ、それより少し大きい数値がIBMのPCハードウェアで使用されている拡張ASCIIエンコーディングのバリエーションに対応しているという事実からも明らかです。
PC DOS バージョン 3.3 (およびほぼ同じMS-DOS 3.3)のリリースに伴い、IBM はコード ページ番号システムを一般の PC ユーザーに導入しました。コード ページ番号 (および「コード ページ」という語句) は、OS のすべての部分で使用される文字エンコーディングを体系的に設定できるようにするための新しいコマンドで使用されました。[ 10 ]
IBMのCJKエンコーディングに使用されるコードページ番号(CPGIDおよびCCSID)。MicrosoftのCJKエンコーディングにおけるコードページ番号の使用方法は異なり、該当する場合は括弧内に明記されています。 IBMとMicrosoftが1990年代に協力関係を解消した後、両社は割り当てられたコードページ番号のリストをそれぞれ独立して管理しており、その結果、割り当てに矛盾が生じている。少なくとも1つのサードパーティベンダー(Oracle )も、独自の異なる数値割り当てリストを持っている。[ 3 ] IBMの現在の割り当てはCCSID リポジトリにリストされているが、Microsoftの割り当てはMSDN に文書化されている。[ 11 ] さらに、任意のWindowsマシンにインストールされているコードページの名前とIANA(Internet Assigned Numbers Authority )の略語の近似リストは、そのマシンのレジストリで見つけることができる(この情報は Internet Explorer などのMicrosoftプログラムで使用されている)。
CJK 言語とベトナム語 を除く、よく知られているほとんどのコードページは、すべてのコードポイントを8ビットに収めており、各コードポイントを1文字にマッピングする以上のことは何もしていません。さらに、文字の組み合わせや複雑なスクリプトなどの技術は使用されていません。
標準的な ( VGA 互換 ) PC グラフィックス ハードウェアのテキスト モードは、8 ビット コード ページの使用を中心に構築されていますが、色深度を多少犠牲にすれば 2 つを同時に使用でき、簡単に切り替えられるように最大 8 つをディスプレイ アダプタ に格納できます。[ 12 ] このようなハードウェアにロードできるサードパーティ製のコード ページ フォントがいくつかありました。しかし、現在では、オペレーティングシステム ベンダーがグラフィックス モードで動作し、このハードウェアの制限を完全に回避する独自の文字エンコードおよびレンダリング システムを提供することが一般的になっています。ただし、文字エンコードをコード ページ番号で参照するシステムは、電子メールやウェブ ページなどのさまざまなプロトコルで使用するために IETF や IANA によって指定されている文字列識別子などの効率的な代替手段として、依然として適用可能です。
ASCIIとの関係 現在使用されているコードページの大部分は、128個の制御コードと印刷可能な文字を表す7ビットコードであるASCII のスーパーセットです。遠い昔、ASCIIコードの8ビット実装では、最上位ビットをゼロに設定するか、ネットワークデータ伝送のパリティビット として使用していました。最上位ビットが文字データの表現に使用できるようになったことで、合計256個の文字と制御コードを表現できるようになりました。ほとんどのベンダー(IBMを含む)は、この拡張された範囲を使用して、さまざまな言語で使用される文字や、テキストのみの出力デバイスで原始的なグラフィックを模倣できるグラフィック要素をエンコードしました。これらの「拡張ASCII文字セット」には正式な標準は存在せず、ベンダーは、IBMがEBCDICエンコーディングのバリアントに対して常にそうしてきたように、これらのバリアントをコードページと呼んでいました。
Unicodeとの関係 Unicodeは、現在および過去に使用されてきたすべての人間の言語のすべての文字を単一の文字列挙(実質的には1つの大きな単一のコードページ)に含め、デジタルで保存されたテキストを扱う際に異なるコードページを区別する必要性をなくすための取り組みです。Unicodeは、多くの従来のコードページとの後方互換性を維持しようとしており、設計プロセスで一部のコードページを1対1でコピーしています。Unicodeの明確な設計目標は、すべての一般的な従来のコードページ間で往復変換を可能にすることでしたが、この目標は必ずしも達成されていません。IBMやMicrosoftなどの一部のベンダーは、時代錯誤的にUnicodeエンコーディングにコードページ番号を割り当てています。この慣習により、コードページ番号をメタデータとして使用して、バイナリで保存されたデータに遭遇したときに正しいデコードアルゴリズムを識別できます。
IBMコードページ
DOSコードページ これらのコードページは、IBMがPC DOS オペレーティングシステムで使用しています。これらのコードページは、元々はIBM PC とその互換機で使用されていたグラフィックアダプタのテキストモード ハードウェアに直接組み込まれていました。これには、フォントを含むROMチップを物理的に交換することによってのみ文字セットを変更できた、初期のMDAアダプタやCGAアダプタも含まれます。これらのアダプタのインターフェース(VGAなどの後継アダプタすべてでエミュレートされています)は、通常、各フォント/エンコーディングで256文字のみのシングルバイト文字セットに制限されていました(ただし、VGAでは、やや大きな文字セットの部分的なサポートが追加されました)。
301 – IBM-PCジャパン(漢字)DBCS437 – オリジナルのIBM PCハードウェアコードページ720 – アラビア語 (透明ASMO) 737 –ギリシャ語 775 – ラテン7 808 – ロシア通貨(ユーロ込み)(ユーロなしの場合:866 )848 – ウクライナ・ユーロ(ユーロなしの場合:1125 )849 – ユーロを含むベラルーシドル(ユーロを含まない場合:1131 )850 – ラテン語-1851 – ギリシャ語 852 – ラテン語-2 853 – ラテン語-3 855 –キリル文字 (ユーロも同様:872) 856 –ヘブライ語 857 – ラテン5 858 – ユーロ 記号付きラテン1859 – ラテン9 860 –ポルトガル語 861 –アイスランド語 862 –ヘブライ語 863 –カナダフランス語 864 –アラビア語 865 –デンマーク語 /ノルウェー語 866 – ベラルーシ、ロシア、ウクライナ(ユーロも同様:808 )867 –ヘブライ語 + ユーロ (CP862 に基づく) (競合する ID: NECチェコ語 (Kamenický) 、このコードページより前に作成された)868 –ウルドゥー語 869 –ギリシャ語 872 – ユーロ記号付きキリル文字(ユーロ記号なし:855) 874 – 低音記号と古代文字を含むタイ語(Windows 874 と競合する ID。ユーロ付きバージョン: 1161 、Windows バージョン: IBM 1162 )876 – OCR A 877 – OCR B 878 – KOI8-R 891 – 韓国のPC SBCS898 – IBM-PC WP 多言語版 899 – IBM-PCシンボル903 – 簡体字中国語 PC SBCS904 – 繁体字中国語 PC SBCS906 – インターナショナルセット #5 3812/3820 907 – ASCII APL (3812)909 – IBM-PC APL2 拡張版910 – IBM-PC APL2911 – IBM-PCジャパン #1926 – 韓国のPC DBCS927 – 繁体字中国語 PC DBCS928 – 簡体字中国語 PC DBCS929 – タイPC DBCS932 – IBM-PC Japan MIX (DOS/V) (DBCS) ( 897 + 301 ) (Windows 932 と ID が競合します。Windows 版は IBM 943 です)934 – IBM-PC Korea MIX (DOS/V) (DBCS) ( 891 + 926 )936 – IBM-PC 簡体字中国語 MIX (gb2312) (DOS/V) (DBCS) ( 903 + 928 ) (Windows 936 と ID が競合します。Windows 版は IBM 1386 です)938 – IBM-PC 繁体字中国語 MIX (DOS/V、OS/2) ( 904 + 927 )942 – IBM-PC Japan MIX (日本語版 SAA (OS/2)) ( 1041 + 301 )943 – IBM-PC Japan OPEN ( 897 + 941 ) (Windows CP 932)944 – IBM-PC Korea MIX (韓国語 SAA (OS/2)) ( 1040 + 926 )946 – IBM-PC 簡体字中国語 (簡体字中国語 SAA (OS/2)) ( 1042 + 928 )948 – IBM-PC 繁体字中国語 (繁体字中国語 SAA (OS/2)) ( 1043 + 927 )949 – 韓国語(拡張万城(ks_c_5601-1987))(1088 + 951 )(Windows 949(統一ハングルコード)とIDが競合します。Windows版はIBM 1363です)951 – 韓国語 DBCS (IBM KS コード) (ファイル名に基づくと、Windows 951 と ID が競合します。Windows 951 は、HKSCS に含まれる一部の PUA Unicode 文字の Unicode マッピングを含む Windows 950 の改造版です)1034 – プリンターアプリケーション - 配送ラベル、セット番号2 1040 – 韓国語拡張版1041 – 日本語拡張版 (JIS X 0201 拡張版)1042 – 簡体字中国語拡張版1043 – 繁体字中国語拡張版1044 – プリンターアプリケーション - 配送ラベル、セット番号1 1086 – IBM-PCジャパン #11088 – 改訂韓国語(SBCS)1092 – IBM-PC 修正シンボル1098 –ペルシア語 1108 – DITROFベースとの互換性 1109 – DITROF スペシャル互換性 1115 – IBM-PC 中華人民共和国1116 – エストニア語1117 – ラトビア語1118 – リトアニア語(IBMによるLikaのコードページ774 の実装)1119 – リトアニア語とロシア語(IBMによるLikaのコードページ772 の実装)1125 – キリル文字、ウクライナ語(ユーロと同じ:848 )(IBMによるRUSCII の修正)1127 – IBM-PC アラビア語/フランス語1131 – IBM-PCデータ、キリル文字、ベラルーシ語(ユーロ版:849 )1139 – 日本の英数字カタカナ1161 – 低音記号と古代文字を使用したタイ語(ユーロ記号付き)(ユーロ記号なしの場合:874 )1167 – KOI8-RU 1168 – KOI8-U 1370 – 繁体字中国語 MIX ( Big5 エンコーディング ) ( 1114 + 947 + ユーロ) (ユーロなしの場合: 950 )1380 – IBM-PC 簡体字中国語 GB PC-DATA (DBCS PC IBM GB 2312-80)1381 – IBM-PC 簡体字中国語 ( 1115 + 1380 )1393 – 日本語 JIS X 0213 DBCS1394 – IBM-PC Japan (JIS X 0213) ( 897 + 1393 )古いハードウェア、プロトコル、ファイル形式を扱う場合、これらのコードページをサポートする必要が生じることが多いが、新しい設計においては、より新しいエンコーディングシステム、特にUnicodeの使用が推奨される。
DOSコードページは通常.CPIファイルに格納されます。[ 16 ] [ 17 ] [ 18 ] [ 19 ] [ 20 ]
IBM AIX コードページ これらのコードページは、IBMのAIX オペレーティングシステムで使用されています。これらは、ISO規格に準拠して使用されるように設計された文字セット、例えばUNIX系オペレーティングシステムで使用される文字セットなどをエミュレートします。
コードページ819は、 ISO/IEC 8859-1規格 のLatin-1と同一であり、コマンドを若干変更することで、MS-DOSマシンでこのエンコーディングを使用できるようになります。IBM AS/400ミニコンピュータで使用されていました。
IBM OS/2コードページこれらのコードページは、IBMが自社のOS/2 オペレーティングシステムで使用しています。
1004 – Latin-1 Extended、デスクトップパブリッシング/Windows [ 21 ]
Windowsエミュレーションコードページ これらのコードページは、IBMがMicrosoft Windowsの 文字セットをエミュレートする際に使用します。これらのコードページのほとんどは、Microsoftのコードページと同じ番号を持っていますが、完全に 同一ではありません。ただし、一部のコードページは、Microsoftが考案したものではなく、IBMが新たに作成したものです。
Macintoshエミュレーションコードページ これらのコードページは、IBMがApple Macintoshの 文字セットをエミュレートする際に使用されます。
Adobeのエミュレーションコードページ これらのコードページは、IBMがAdobeの 文字セットをエミュレートする際に使用されます。
1038 – Adobeシンボルエンコーディング1276 – Adobe (PostScript) 標準エンコーディング1277 – Adobe (PostScript) Latin 1
HPエミュレーションコードページ これらのコードページは、IBMがHPの 文字セットをエミュレートする際に使用されます。
DECエミュレーションコードページ これらのコードページは、IBMがDEC 文字セットをエミュレートする際に使用されます。
1020 – 7ビット カナダ(フランス語)NRCセット1021 – 7ビット スイスNRCセット1023 – 7ビットスペイン語NRCセット1090 – 特殊文字と線画セット1100 – 12月 多国籍企業1101 – 7ビット英国NRCセット1102 – 7ビット オランダ NRC セット1103 – 7ビット フィンランド NRC セット1104 – 7ビット フランス NRC セット1105 – 7ビット ノルウェー/デンマーク NRC セット1106 – 7ビット スウェーデン NRC セット1107 – 7ビット ノルウェー語/デンマーク語 NRC 代替1287 – ギリシャ語1288 – DEC トルコ語
Microsoftコードページ
DBCSコードページ これらのコードページは、さまざまなCJK言語のDBCS 文字エンコーディングを表しています。Microsoftオペレーティングシステムでは、これらは該当するロケールの「OEM」コードページと「Windows」コードページの両方として使用されます。
MS-DOSコードページ これらのコードページは、マイクロソフトがMS-DOSオペレーティングシステムで使用しています。マイクロソフトはこれらをOEMコードページと呼んでいます。なぜなら、これらはマイクロソフトや標準化団体ではなく、ハードウェアに同梱して配布するためにMS-DOSのライセンスを取得した機器メーカー によって定義されたものだからです。これらのコードページのほとんどは、対応するIBMコードページと同じ番号を持っていますが、完全に 同じではないものもあります。[ 26 ]
Macintoshエミュレーションコードページ これらのコードページは、マイクロソフトがApple Macintoshの 文字セットをエミュレートする際に使用されます。
その他の様々なマイクロソフトコードページ 以下のコードページ番号は、Microsoft Windows固有のものです。IBMはこれらのコードページに異なる番号を使用する場合があります。これらは、 UNIX系オペレーティングシステムなど、ISO規格に準拠して使用されるように設計された複数の文字セットをエミュレートします。
HPシンボルセット HPは、自社製文字セットまたは他社製文字セットをエンコードするために、一連のシンボルセット(それぞれにシンボルセットコードが関連付けられている)を開発しました。これらは通常7ビットの文字セットですが、上位ビットに移動してASCII文字セットと組み合わせることで、8ビットの文字セットを構成します。
HP独自のシンボルセット シンボルセット0E — HP Roman拡張 — アクセント付き文字を含む7ビット文字セット(IBMによりコードページ1050 としてコード化) シンボルセット0G — HP 7ビットドイツ語 シンボルセット0L — HP 7ビットPCシリーズ(IBMによりコードページ1055 としてコード化) シンボルセット 0M — HP Math-7 シンボルセット0T — HP Thai-8 シンボルセット1S — HP 7ビットスペイン語 シンボルセット 1U — HP 7ビット ゴシック体リーガル(IBMによりコードページ1052 としてコード化) シンボルセット4Q — HPラインドロー(IBMによりコードページ1056 としてコード化) シンボルセット 4U — HP Roman-9 — Roman-8 + € シンボルセット7J — HPデスクトップ シンボルセット7S — HP 7ビット ヨーロッパスペイン語 シンボルセット8E — HP East-8 シンボルセット8G — HP Greek-8(IR 088に基づく。ELOT 927に基づくものではない) シンボルセット 8H — HP Hebrew-8 シンボルセット8I — MS LineDraw(ASCII + HP PC Line) シンボルセット 8K — HP Kana-8 (ASCII + 日本語カタカナ) シンボルセット 8L — HP LineDraw (ASCII + HP LineDraw) シンボルセット 8M — HP Math-8 (ASCII + HP Math-8) シンボルセット 8R — HP キリル文字-8 シンボルセット8S — HP 7ビット ラテンアメリカスペイン語 シンボルセット 8T — HP トルコ語-8 シンボルセット 8U — HP Roman-8 (ASCII + HP Roman拡張; IBMによりコードページ1051 としてコード化) シンボルセット 8V — HPアラビア語-8 シンボルセット9K — HP韓国語-8 シンボルセット9T — PC 8T(コードページ437-Tとも呼ばれます。これはコードページ857ではありません) シンボルセット9V - Windows用ラテン語/アラビア語(これはコードページ1256 ではありません ) シンボルセット 11U — PC 8D/N (コードページ 437-N とも呼ばれ、IBM ではコードページ 1058 としてコード化されています。これはコードページ 865では ありません ) シンボルセット14G — PC-8ギリシャ語代替(コードページ437-Gとも呼ばれ、コードページ737 とほぼ同じ)シンボルセット 18K — シンボルセット18T — シンボルセット19C — シンボルセット19K —
他社ベンダーのコードページ これらのコードページは、サードパーティベンダーによる独立した割り当てです。オリジナルのIBM PCコードページ(番号437 )は、国際的な使用を想定して設計されたものではなかったため、国や地域ごとに部分的に互換性のある複数のバリエーションが登場しました。
これらのコードページ番号の割り当ては、 IBM、Microsoftのいずれによっても公式なもの ではなく、IANAによって使用可能な文字セットとして参照されているものもほとんどありません。これらのコードページに割り当てられた番号は任意であり、IBMまたはMicrosoftが使用している登録番号と競合する可能性があります。これらのコードページの中には、DOS 3.3でコードページ切り替え機能が追加される以前から存在していたものもあるかもしれません。
コードページ割り当ての一覧既知のコードページ割り当て一覧(不完全):
批判 Unicodeとは異なり、多くの古い文字エンコーディングにはいくつかの問題があります。ベンダーによっては、コードページ内のすべてのコードポイント値の意味を十分に文書化していないため、さまざまなコンピュータシステムでテキストデータを一貫して処理する際の信頼性が低下します。また、ベンダーによっては、既存のコードページに独自の拡張機能を追加して、特定のコードポイント値を追加または変更しています。たとえば、Shift JISのバイト0x5Cは、プラットフォームによって バックスラッシュ または円記号 を表す場合があります。さらに、Unicodeを使用しないプログラムで複数の言語をサポートするには、各文字列/ドキュメントに使用されるコードページを保存する必要があります。
アプリケーションは、 Windows-1252 のテキストをISO-8859-1 と誤ってラベル付けすることもあります。これらのコード ページの唯一の違いは、ISO-8859-1 で制御文字に使用される 0x80 ~ 0x9Fの範囲のコード ポイント値が、Windows-1252 では追加の印刷可能文字として使用されることです。 特に、引用符、 ユーロ記号 、商標記号 などに使用されます。Windows 以外のプラットフォームのブラウザーでは、これらの文字に対して空のボックスまたは疑問符が表示される傾向があり、テキストが読みにくくなります。ほとんどのブラウザーは、文字セットを無視して Windows-1252 として解釈することでこれを修正し、許容できる外観にしました。HTML5 では、ISO-8859-1 を Windows-1252 として扱うことがW3C 標準としてコード化されています。[ 47 ] ブラウザーは通常この動作に対処するようにプログラムされていましたが、他のソフトウェアでは必ずしもそうではありませんでした。したがって、Windowsシステムからファイル転送を受信した場合、Windows以外のプラットフォームはこれらの文字を無視するか、標準の制御文字として扱い、それに応じて指定された制御アクションを実行しようとします。
Unicode の広範なドキュメント、膨大な文字レパートリー、および文字の安定性ポリシーにより、上記の問題は Unicode にとってほとんど問題になりません。UTF -8 (100 万以上のコードポイントをエンコード可能) は、インターネット上での人気という点でコードページ方式に取って代わりました。[ 48 ] [ 49 ]
プライベートコードページパーソナルコンピュータの歴史の初期において、ユーザーが文字エンコーディングの要件を満たせない場合、常駐型ユーティリティを使用したり、 BIOS EPROM を再プログラムしたりすることで、プライベートまたはローカルのコードページが作成されました。場合によっては、非公式のコードページ番号(例:CP895)が考案されました。
より多様な文字セットがサポートされるようになると、チェコ語 とスロバキア語のアルファベット用の カメニツキー やKEYBCS2エンコーディングなど、いくつかの例外を除いて、これらのコードページのほとんどは使用されなくなりました。もう1つの文字セットは、イランシステム社がペルシア語 サポートのために作成したイランシステムエンコーディング規格 です。この規格はイランでDOSベースのプログラムで使用されていましたが、Microsoftコードページ1256の導入後、この規格は廃止されました。しかし、このエンコーディングを使用するWindowsおよびDOSプログラムの一部は現在も使用されており、このエンコーディングを使用するWindowsフォントもいくつか存在します。
このような問題を克服するために、IBM 文字データ表現アーキテクチャ レベル 2 では、ユーザー定義可能およびプライベート使用の割り当て用にコード ページ ID の範囲が特別に予約されています。このようなコード ページ ID を使用する場合、ユーザーは、特に注意を払わない限り、同じ機能と外観が別のシステム構成または別のデバイスやシステムで再現できると想定してはなりません。コード ページ範囲 57344-61439 ( E000h - EFFFh ) は、ユーザー定義可能なコード ページ (実際には IBM CDRA のコンテキストでは CCSID) 用に正式に予約されていますが、範囲 65280-65533 ( FF00h - FFFDh ) は、ユーザー定義可能な「プライベート使用」割り当て用に予約されています。例えば、登録されていないコードページ 437 ( 1B5h ) または 28591 ( 6FAF ) のカスタムバリアントは、他の割り当てとの潜在的な競合を回避し、元のコードページの割り当てに存在することがある内部数値ロジックを維持するために、それぞれ 57781 ( E1B5h ) または 61359 ( EFAFh ) になることがあります。既存のコードページに基づかない未登録のプライベートコードページ、プリンタフォントなどのデバイス固有のコードページ(システムでアドレス指定可能にするために論理ハンドルのみが必要)、頻繁に変更されるダウンロードフォント、またはローカル環境でシンボル意味を持つコードページ番号は、65280 ( FF00h ) のようなプライベート範囲に割り当てられることがあります。
コードページID 0、65534 ( FFFEh )、および65535 ( FFFFh ) は、DOSなどのオペレーティングシステムの内部使用のために予約されており、特定のコードページに割り当てることはできません。
参考文献 ↑ 「目次」 . www.ibm.com . ↑ 「コードページ」 . sap.com . 2009年11月14日にオリジナルから アーカイブ済み 。 2009年8月8日 に取得。 1 2 "用語集" . oracle.com . 2011-09-30 のオリジナルから アーカイブ済み . 2009-08-08 に取得. ↑ 「VT510 ビデオ端末プログラマ情報」 。Digital Equipment Corporation (DEC)。7.1. 文字セット - 概要。 2016年1月26日にオリジナルから アーカイブ 。 2017年2月15日 に取得。従来の DEC および ISO文字セット( ISO 2022 の構造と規則に準拠) に加えて 、 VT510は PCTerm モードで多数のIBM PCコードページ( IBMの標準文字セットマニュアルの ページ番号)をサポートし、業界標準のPCの コンソール端末を エミュレートします 。 ↑ "7.1. 文字セット - 概要". VT520/VT525 ビデオ端末プログラマ情報 (PDF) . Digital Equipment Corporation (DEC). 1994 年 7 月. p. 7-1. EK-VT520-RM. A01. 2017 年 2 月 15 日にオリジナルから アーカイブ (PDF) 。 2017 年 2 月 15 日 に取得 。 VT520は、従来の DEC および ISO 文字セット に加えて、 PCTerm モードで多数の IBM PC コード ページ ( IBM の標準文字セット マニュアルの ページ番号 を参照)をサポートし、 業界標準の PC の コンソール端末を エミュレートします。 1 2 3 Paul, Matthias R. (2001-06-10) [1995]. "DOS、OS/2、およびWindowsコードページの概要" (CODEPAGE.LSTファイル) (1.59暫定 版)。2016-04-20 のオリジナルから アーカイブ 。2016-08-20 に取得 。 ↑ 「プリンタコマンド言語シンボルセット」 。www.pclviewer.com 。 2020年7 月 31日にオリジナルから アーカイブ済み 。 2021年5月25日 に取得。 ↑ 「HP シンボル セット」 。pclhelp.com 。2015年2月19日にオリジナルからアーカイブ済み 。 2017 年 2 月20日 に取得。 ↑ 「PCL5比較ガイド」 (PDF) 。 2017年2月21日にオリジナルから アーカイブ (PDF) 。 2017年2月20日 に取得。 ↑ Zbikowski, Mark ; Allen, Paul ; Ballmer, Steve ; Borman, Reuben; Borman, Rob; Butler, John; Carroll, Chuck; Chamberlain, Mark; Chell, David; Colee, Mike; Courtney, Mike; Dryfoos, Mike; Duncan, Rachel; Eckhardt, Kurt; Evans, Eric; Farmer, Rick; Gates, Bill ; Geary, Michael; Griffin, Bob; Hogarth, Doug; Johnson, James W.; Kermaani, Kaamel; King, Adrian; Koch, Reed; Landowski, James; Larson, Chris; Lennon, Thomas; Lipkie, Dan; McDonald, Marc ; McKinney, Bruce; Martin, Pascal; Mathers, Estelle; Matthews, Bob; Melin, David; Mergentime, Charles; Nevin, Randy; Newell, Dan; Newell, Tani; Norris, David; O'Leary, Mike; O'Rear, Bob ; Olsson, Mike; Osterman, Larry; Ostling, Ridge; Pai, Sunil; Paterson, Tim ; Perez, Gary; Peters, Chris; Petzold, Charles ; Pollock, John; Reynolds, Aaron ; Rubin, Darryl; Ryan, Ralph; Schulmeisters, Karl; Shah, Rajen; Shaw, Barry; Short, Anthony; Slivka, Ben; Smirl, Jon; Stillmaker, Betty; Stoddard, John; Tillman, Dennis; Whitten, Greg; Yount, Natalie; Zeck, Steve (1988). "テクニカルアドバイザー". MS-DOS 百科事典: バージョン 1.0 ~ 3.2 . 著: Duncan, Ray; Bostwick, Steve; Burgoyne, Keith; Byers, Robert A.; Hogan, Thom;カイル、ジム; レットウィン、ゴードン ; ペッツォルド、チャールズ ;ラビノウィッツ、チップ;トムリン、ジム;ウィルトン、リチャード;ウォルバートン、ヴァン;ウォン、ウィリアム;ウッドコック、ジョアン(全面改訂 版 )。米国ワシントン州レドモンド: マイクロソフトプレス 。ISBN 1-55615-049-0 . LCCN 87-21452 . OCLC 16581341 . Wayback Machine に2018年10月14日にアーカイブされました (xix+1570ページ、26cm )。(注:この版は、1986年に出版中止となった初版を別の著者チームが大幅に改訂し、1988年に出版されたものです。)↑ 「コードページ識別子」 . microsoft.com . Microsoft . 2014年10月27日にオリジナルから アーカイブ済み 。 2014年10月27日 に取得。 ↑ 「VGA/SVGAビデオプログラミング - VGAテキストモード操作」 。osdever.net 。 2010 年9月1日にオリジナルから アーカイブ済み 。 2006年9月23日 に取得。 ↑ 「IBM i グローバリゼーション:コードページ」 。IBM。 2012年7月16日に オリジナル からアーカイブ済み。 1 2 3 4 5 6 xlate - レコードの内容を音訳する 、 IBM Corporation 、2010 [1986]、 2019年6月16日にオリジナルから アーカイブ 、 2016年10月18日に取得 ↑ 「コードページ CPGID 01093 (pdf)」 (PDF) 。 2015年7月8日に オリジナル (PDF) からアーカイブされました。 ↑ Paul, Matthias R. (2001-06-10) [1995]. "DOS、OS/2、Windows NT .CPI、および Linux .CP ファイルのフォーマット記述" (CPI.LST ファイル) (1.30 版). 2016-04-20 のオリジナルから アーカイブ 。2016-08-20 に取得 。 ↑ エリオット、ジョン C. (2006-10-14). "CPI ファイル形式" . Seasip.info . 2016-09-22 のオリジナルから アーカイブ済み . 2016-09-22 に取得. ↑ Brouwer, Andries Evert (2001-02-10). "CPI fonts" . 0.2. 2016-09-22 のオリジナルから アーカイブ済み 。2016-09-22 に取得 。 ↑ ハランブス、ヤニス(2007年9月)。 フォントとエンコーディング 。P.スコット・ホーン訳(第1 版)。米国カリフォルニア州セバストポル: オライリー・メディア社。601 ~ 602、611 ページ 。ISBN 978-0-596-10242-5 。↑ MS-DOSプログラマーズ・リファレンス 。 マイクロソフトプレス 。1991年 。ISBN 1-55615-329-5 。↑ 「コードページ 1004 - Windows Extended」 . IBM . 2001. 2018年5月13日にオリジナルから アーカイブ済み 。 2018年5月13日 に取得。 ↑ 「文字データ表現アーキテクチャ」 。IBM 。 2019年6月23 日にオリジナルから アーカイブ済み 。 2019年10月12日 に取得。 1 2 3 4 5 6 7 8 9 10 11 12 "IBM Coded Character Set Identifier (CCSID)" . IBM . 2009年11月26日に オリジナル からアーカイブされました。 ↑ ISO/IEC 8859-1:1998(E) . ISO . 1998-04-15. p. 1. 2020-10-30 のオリジナルから アーカイブ済み 。2020-10-30 に取得。 この セットのコード化された文字は、ISO/IEC 6429 から選択されたコード化された制御機能と組み合わせて使用できます。 ↑ 「コードページ」 . microsoft.com . Microsoft . 2011年2月27日にオリジナルから アーカイブ済み 。 2010年12月21日 に取得。 ↑ "pentaho/pentaho-reporting" . GitHub . 2019年6月16日のオリジナルから アーカイブ済み。 2017年2月20日 取得 。 1 2 3 4 5 「コード ページ識別子」 。Microsoft Developer Network。Microsoft 。2014年。2016 年6月19日にオリジナルから アーカイブ済み 。 2016年6月19日 に取得。 1 2 3 4 5 「Web エンコーディング - Internet Explorer - エンコーディング」 . WHATWG Wiki . 2012-10-23. 2016-06-20 のオリジナルから アーカイブ済み . 2016-06-20 に取得. ↑ Foller, Antonin (2014) [2011]. "Western European (IA5) encoding - Windows charsets" . WUtils.com - Online web utility and help . Motobit Software. 2016-06-20 のオリジナルから アーカイブ済み 。2016-06-20 に取得 。 ↑ Foller, Antonin (2014) [2011]. "ドイツ語 (IA5) エンコーディング - Windows 文字セット" . WUtils.com - オンライン Web ユーティリティとヘルプ . Motobit Software. 2016-06-20 のオリジナルから アーカイブ済み 。2016-06-20 に取得 。 ↑ Foller, Antonin (2014) [2011]. "スウェーデン語 (IA5) エンコーディング - Windows 文字セット" . WUtils.com - オンライン Web ユーティリティとヘルプ . Motobit Software. 2016-06-20 のオリジナルから アーカイブ済み 。2016-06-20 に取得 。 ↑ Foller, Antonin (2014) [2011]. "ノルウェー語 (IA5) エンコーディング - Windows 文字セット" . WUtils.com - オンライン Web ユーティリティとヘルプ . Motobit Software. 2016-06-20 のオリジナルから アーカイブ済み 。2016-06-20 に取得 。 ↑ Foller, Antonin (2014) [2011]. "US-ASCII エンコーディング - Windows 文字セット" . WUtils.com - オンライン Web ユーティリティとヘルプ . Motobit Software. 2016-06-20 のオリジナルから アーカイブ済み 。2016-06-20 に取得 。 1 2 3 4 5 6 7 Paul, Matthias R. (2002-09-05)、「 LCASE、ARAMODE、CCTORC レコードの文書化されていない DOS 国情報に関する技術情報」 、Topica の FreeDOS 開発リスト fd-dev、 2016-05-27 の オリジナルからアーカイブ、 2016-05-26 に取得 1 2 3 4 5 6 7 8 Brown, Ralf D. (2002-12-29). x86割り込みリスト . 61. 1 2 3 4 5 6 7 8 ポール、マティアス R. (1997-07-30)。 NWDOS-TIP — Novell DOS 7 に関するヒントとコツ、詳細、バグ、回避策を含む Blick です 。 MPDOSTIP (ドイツ語) (第 3 版)。 2016 年 5 月 22 日に オリジナル からアーカイブされました 。 2012 年 1 月 11 日 に取得 。 (注:NWDOSTIP.TXTは、 Novell DOS 7 およびOpenDOS 7.01 に関する包括的な資料であり、多くの未公開機能や内部構造の説明が含まれています。これは、著者が2001年まで管理し、当時多くのサイトで配布していた、より大規模なMPDOSTIP.ZIPコレクションの一部です。提供されているリンクは、NWDOSTIP.TXTファイルのHTML変換版(旧バージョン)を指しています。)1 2 3 4 5 6 7 8 ポール、マティアス R. (2001-04-09)。 NWDOS-TIP — Novell DOS 7 に関するヒントとコツ、詳細、バグ、回避策を含む Blick です 。 MPDOSTIP (ドイツ語) (第 3 版)。 ↑ "770" 。 2017年2月26日にオリジナルから アーカイブされました 。 2017年2月25日 に取得。 リトアニアのLika Software社製1 2 3 4 5 6 7 8 "LIKIT" . www.likit.lt . 2017年4月19日にオリジナルから アーカイブ済み 。 2017年2月25日 に取得。 ↑ "771" 。 2017年2月26日にオリジナルから アーカイブされました 。 2017年2月25日 に取得。 リトアニアのLika Software社製↑ "772" 。 2017年2月26日にオリジナルから アーカイブされました 。 2017年2月25日 に取得。 リトアニアのLika Software社製↑ "774" 。 2017年2月26日にオリジナルから アーカイブされました 。 2017年2月25日 に取得。 リトアニアのLika Software社製1 2 3 "lietuvybė.lt - Rašmenų koduotės" [ lietuvybė.lt - 文字エンコーディング ] (リトアニア語)。 2019年8月28日のオリジナルから アーカイブ 。 2019年8月28日 に取得 。 ↑ ホーガン、トム (1992)。 Die PC-Referenz für Programmierer (ドイツ語) (第 2 版)。システマ フェルラグ GmbH。 ISBN 3-89390-272-4 。 (注:本書はマイクロソフトプレス発行の『プログラマーのためのPCソースブック』のドイツ語版です。スペイン向けのコードページID 854について言及しています。)1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 「Star LC 8021 ユーザーマニュアル」 (PDF) 。 2020年9月29日にオリジナルから アーカイブされました (PDF) 。 2017年2月20日 に取得 。 ↑ IBM. "SBCS コード ページ情報ドキュメント - CPGID 00437" 。2016 年 6 月 9 日にオリジナルから アーカイブされました 。2014 年 7 月 4 日 に取得。 ↑ 「エンコーディング」 . WHATWG . 2015-01-27. sec. 4.2 名前とラベル。2015-02-04 のオリジナルから アーカイブ済み 。2015-02-04 に 取得 。 ↑ 「Webサイトの文字エンコーディングの使用統計(毎日更新)」 。 w3techs.com 。 2015年8月6日 取得 。 ↑ 「UTF-8 使用統計」 。trends.builtwith.com 。2011年3月24日のオリジナルからアーカイブ済み 。 2011 年 3月28日 取得 。
外部リンク IBM CDRA 用語集 Wayback Machine に保存されている IBMのコードページ(2016年2月5日アーカイブ) IBMのコードページをエンコーディング方式別にまとめたWayback Machine の アーカイブ(2009年9月6日アクセス) IBM/ICU 文字セット情報 Microsoftコードページ識別子(Microsoftのリストには、Windows上の通常のアプリケーションで実際に使用されているコードページのみが含まれています。サポートされているコードページの完全なリストについては、 Torsten Mohrinのリストも参照してください。) Microsoftが作成した、ANSIおよびOEMコードページのみを含む簡略版リスト。各ページの詳細については、Wayback Machine (2012年10月23日アーカイブ) へのリンクが掲載されています。 ボタン一つで文字セットとコードページを切り替え Microsoft Chcp コマンド: コンソールのアクティブなコード ページを表示および設定する