| MIME / IANA | ISO-8859-8 |
|---|---|
| エイリアス | iso-ir-138、ヘブライ語、csISOLatinHebrew [1] |
| 言語 | ヘブライ語、英語 |
| 標準 | ISO/IEC 8859-8、ECMA-121、SI 1311 |
| 分類 | 拡張ASCII、ISO 8859 |
| に基づく | DEC ヘブライ語 (8 ビット)、ISO/IEC 8859-1 |
| その他の関連エンコーディング | Windows-1255 |
ISO/IEC 8859-8、「情報技術 - 8ビットシングルバイトコード化グラフィック文字セット - パート8:ラテン語/ヘブライ語アルファベット」は、 ASCIIベースの標準文字エンコードのISO/IEC 8859シリーズの一部です。 1999年のISO/IEC 8859-8:1999は、1988年の初版ISO/IEC 8859-8:1988に続く、2回目で最新の改訂版です。非公式にはラテン語/ヘブライ語と呼ばれています。ISO /IEC 8859-8はすべてのヘブライ文字をカバーしていますが、ヘブライ語の母音記号はカバーしていません。IBMはこれにコードページ916(CCSID 916および5012)を割り当てました。 [2] [3] [4]この文字セットは、いくつかの拡張とともに、イスラエル標準SI1311:2002 でも採用されました。
ISO-8859-8は、 ISO/IEC 6429のC0 および C1 制御コードが補足された場合のこの標準のIANA推奨文字セット名です。テキストは (通常) 論理順序であるため、表示にはbidi処理が必要です。名目上、ISO-8859-8 (コード ページ 28598 ) は「視覚順序」用、ISO-8859-8- I (コード ページ 38598 ) は論理順序用です。しかし、実際には通常、XML 文書に必要なため、[引用が必要] ISO-8859-8は論理順序テキストも表します。HTML5で使用されるWHATWGエンコーディング標準では、レイアウト方向への影響により、 ISO-8859-8 とISO-8859-8- Iを同じマッピングを持つ異なるエンコーディングとして扱いますが、これはISO-8859-6 (アラビア語)には適用されなくなり、ISO-8859-8 にのみ適用されることに注意してください。[5]
また、方向性を特殊な制御文字で明示的に指定する必要があるとされる ISO-8859-8-Eもありますが、この後者のバリエーションは実際には使用されていません。
ヘブライ語のMicrosoft Windowsコード ページWindows-1255は、二重アンダースコアの省略と、汎用通貨記号 ( ¤ ) のシェケル記号(₪) への置き換えを除いて、C1 コントロールのない ISO/IEC 8859-8 の拡張版です。結合文字としての母音点のサポートと、いくつかの追加の句読点が追加されています。
この標準規格の発行から10年以上経った現在、少なくともインターネットではUnicodeが好まれています[6](つまり、ウェブページの主なエンコーディングであるUTF-8)。ISO-8859-8はウェブサイトの0.1%未満で使用されています。[7]
コードページレイアウト
FD は左から右へのマーク (U+200E)、FE は右から左へのマーク (U+200F) であり、新しい修正である ISO/IEC 8859-8:1999 で指定されています。
2002 イスラエル標準拡張
イスラエル規格SI1311:2002は、ユーロ記号、新シェケル記号、およびより高度な明示的な双方向書式設定のためのいくつかの追加文字割り当てを除いて、ISO/IEC 8859-8:1999と一致しています。[12]
参照
- 8 ビット DEC ヘブライ語(DEC コード ページと同様)
- コード ページ 1255 (Windows コード ページと同様)
- SI960 1960年
- 7 ビット DEC ヘブライ語
参考文献
- ^ 文字セット、インターネット割り当て番号機関(IANA)、2018-12-12
- ^ 「コード ページ 916 情報ドキュメント」。2017 年 2 月 16 日時点のオリジナルよりアーカイブ。
- ^ 「CCSID 916 情報文書」。2014 年 11 月 29 日時点のオリジナルよりアーカイブ。
- ^ 「CCSID 5012 情報文書」。2016 年 3 月 27 日時点のオリジナルよりアーカイブ。
- ^ van Kesteren, Anne . 「9. レガシー シングルバイト エンコーディング」.エンコーディング標準. WHATWG .
注: ISO-8859-8 と ISO-8859-8-
I は、ISO-8859-8 がレイアウト方向に影響を及ぼすため、異なるエンコーディング名です。歴史的には ISO-8859-6 と「ISO-8859-6-
I
」にも当てはまっていたかもしれませんが
、現在はそうではありません。
- ^ John , Nicholas A. (2013). 「多言語インターネットの構築: Unicode、ヘブライ語、グローバリゼーション」。Journal of Computer-Mediated Communication。18 ( 3): 321–338。doi : 10.1111 /jcc4.12015。ISSN 1083-6101。
背景: ヘブライ語とインターネットの問題
- ^ 「ウェブサイトにおける ISO-8859-8 の使用統計、2019 年 1 月」。w3techs.com。2019年 1 月 17 日閲覧。
- ^ コードページ CPGID 00916 (pdf) (PDF)、IBM
- ^ コードページ CPGID 00916 (txt)、IBM
- ^ 国際 Unicode コンポーネント (ICU)、ibm-916_P100-1995.ucm、2002-12-03
- ^ 国際 Unicode コンポーネント (ICU)、ibm-5012_P100-1999.ucm、2002-12-03
- ^ ab イスラエル標準化協会. ISO-IR-234: 8ビットコード用ラテン語/ヘブライ語文字セット(PDF) . ITSCJ/ IPSJ .
外部リンク
- ISO/IEC 8859-8:1999
- 標準 ECMA-121 - 8 ビット シングルバイト コード化グラフィックス文字セット - ラテン語/ヘブライ語アルファベット
- イスラエル規格 SI1311:2002 2005-11-24 にWayback Machineでアーカイブ(ヘブライ語)
- ISO-IR登録:
- ECMA-121:1987 および ISO/IEC 8859-8:1988 に準拠: European Computer Manufacturers Association (1987-07-31)。ISO-IR-138: ラテン語/ヘブライ語アルファベット(PDF)。ITSCJ/ IPSJ。
- ISO/IEC 8859-8:1999 および ECMA-121:2000 に準拠:イスラエル標準化協会(1998-05-01)。 ISO-IR-198: ラテン語/ヘブライ語アルファベット(PDF)。 ITSCJ/ IPSJ。
- SI 1311:2002:イスラエル標準化機構(2004-07-20) より。 ISO-IR-234: 8 ビット コードのラテン語/ヘブライ語文字セット(PDF)。 ITSCJ/ IPSJ。
