ISO-8859-8- Iは、C0 ( 16 進数00~1F) および C1 (16 進数 80~9F) 部分のISO/IEC 6429の制御コードとともに使用される文字エンコードISO/IEC 8859-8のIANA 文字セット名です。文字は論理的な順序になっています。
エスケープ シーケンス (ISO/IEC 6429 またはISO/IEC 2022から) は解釈されません。ほとんどのアプリケーションは、LF、CR、およびHTの制御コードのみを解釈します。一部のアプリケーションでは、 VT、FF、およびNEL (C1 内)も解釈します。その他のC0 および C1 制御コードを解釈するアプリケーションはほとんどありません。
ISO-8859-8は、論理順序(HTML、XML)の場合もあれば、視覚的順序(左から右)(マークアップのないプレーンテキスト)の場合もあります。HTML5で使用されるWHATWGエンコーディング標準では、レイアウト方向への影響により、 ISO-8859-8とISO-8859-8- Iを同じマッピングを持つ異なるエンコーディングとして扱いますが、これはISO-8859-6 (アラビア語)には適用されなくなり、ISO-8859-8にのみ適用されることに注意してください。[1]
この文字セットの論理順序を表示するには、 bidi処理が必要です。
ヘブライ語の Microsoft Windows コード ページWindows - 1255は、論理順序を使用し、結合文字としての母音点のサポートと、いくつかの追加の句読点が追加されています。これは、二重アンダースコアの省略と、世界共通通貨記号 ( ¤ )をシェケル記号(₪) に置き換えたことを除いて、主にC1 制御のない ISO-8859-8- I の拡張です。
参考文献
- ^ van Kesteren, Anne . 「9. レガシー シングルバイト エンコーディング」.エンコーディング標準. WHATWG .
注: ISO-8859-8 と ISO-8859-8- I は、ISO-8859-8 がレイアウト方向に影響を及ぼすため、異なるエンコーディング名です。歴史的には ISO-8859-6 と「ISO-8859-6- I 」にも当てはまっていたかもしれませんが、現在はそうではありません。
