| MIME / IANA | ウィンドウズ-1258 |
|---|---|
| エイリアス | cp1258 (コードページ1258) |
| 言語 | ベトナム語、英語、フランス語、ドイツ語、スペイン語、デンマーク語、ノルウェー語、スウェーデン語、フィンランド語、アイルランド語、アルバニア語、ルクセンブルク語、オランダ語。 複合発音区別符号付き: エストニア語、イタリア語、ポルトガル語、ヨルバ語、グアラニー語、イボ語、ナウル語、デーヴァナーガリー語の音訳。 |
| 作成者 | マイクロソフト |
| 標準 | WHATWGエンコーディング標準 |
| 分類 | 拡張ASCII、Windows-125x |
| に基づく | Windows-1252 |
Windows-1258 は、Microsoft Windowsでベトナム語のテキストを表すために使用されるコード ページです。結合発音区別符号を使用します。
Windows-1258 は、ベトナム語の標準 ( TCVN 5712 / VSCII ) とも、実際に使用されているその他のさまざまなエンコード ( VISCII、VNI、VPS ) とも互換性がありません。むしろ、 Windows-1252と非常によく似ていますが、違いは、 s-caron と z-caron (これらは後で Windows-1252 に追加されました) が欠落していること、発音区別符号付きの文字のうち 5 つがベトナム語の声調記号の結合発音区別符号に置き換えられていること、1 つがđông 記号に置き換えられていること、および他の 8 つ (ケースごとに 4 つ) が、それ以外ではサポートされていない 4 つのベトナム語文字に変更されていることです。
結合発音区別符号の使用は、Windows-1258 が制御コードや記号の適用範囲を犠牲にすることなく、ベトナム語の文字と声調記号の多数の組み合わせをカバーできることを意味します。ただし、これはまた、他のエンコードとの間で変換するときに、ソフトウェアが事前構成された文字と結合シーケンス間の変換を正しく処理するように注意する必要があり、ユーザーに見える文字列の長さを判断するのがより困難になることも意味します。
IBMはWindows-1258にコードページ1258(CCSID 1258およびユーロ記号拡張CCSID 5354)を使用しています。[1] [2] [3]
現代のアプリケーションでは、ベトナム語のエンコードにはUTF-8が推奨されています。Windows-1258 は、Unicode 正規化による変更により、Unicode でエンコードされたベトナム語と必ずしも往復しない可能性があります。[4]結合発音区別符号は、Windows-1258 と Unicode [4]の両方で文字の後にエンコードされます( ANSELとは異なり、VNIと同様)。
文字セット
次の表は Windows-1258 を示しています。各文字はUnicode の同等文字とともに表示されます。
コードページ 1129
IBMのコードページ1129(CCSID 1129およびユーロ記号拡張CCSID 1163)[11] [12] [13]はコードページ1258に似ていますが、次の違いがあります。
参照
参考文献
- ^ 「コード ページ 1258 情報ドキュメント」。2016 年 3 月 3 日時点のオリジナルよりアーカイブ。
- ^ 「CCSID 1258 情報文書」。2014 年 11 月 29 日時点のオリジナルよりアーカイブ。
- ^ 「CCSID 5354 情報文書」。2014 年 11 月 29 日時点のオリジナルよりアーカイブ。
- ^ ab Kaplan, Michael S. (2005-04-19). 「MultiByteToWideChar のいくつかの落とし穴」。すべてを整理する。
- ^ Steele, Shawn (1998-04-15). 「cp1258 から Unicode へのテーブル」. Microsoft .
- ^ 「最適」なウィンドウ 1258 の Unicode マッピング
- ^ コード ページ CPGID 01258 (pdf) (PDF)、IBM
- ^ コードページ CPGID 01258 (txt)、IBM
- ^ 国際 Unicode コンポーネント (ICU)、ibm-1258_P100-1997.ucm、2002-12-03
- ^ 国際 Unicode コンポーネント (ICU)、ibm-5354_P100-1998.ucm、2002-12-03
- ^ 「コード ページ 1129 情報ドキュメント」。2010 年 9 月 21 日時点のオリジナルよりアーカイブ。
- ^ 「CCSID 1129 情報文書」。2016 年 3 月 27 日時点のオリジナルよりアーカイブ。
- ^ 「CCSID 1163 情報文書」。2014 年 11 月 29 日時点のオリジナルよりアーカイブ。
- ^ Lunde, Ken (2009年1月13日). 「付録L: ベトナム語文字セット」(PDF) . CJKV情報処理(第2版). ISBN 978-0-596-51447-1。
- ^ コードページ CPGID 01129 (pdf) (PDF)、IBM
- ^ コードページ CPGID 01129 (txt)、IBM
- ^ 国際 Unicode コンポーネント (ICU)、ibm-1129_P100-1997.ucm、2002-12-03
- ^ コード ページ CPGID 01163 (pdf) (PDF)、IBM
- ^ コードページ CPGID 01163 (txt)、IBM
外部リンク
- windows-1258 の IANA 文字セット名登録
- Windows 1258 エンコードの動作を説明する Michael Kaplan のブログ
