| MIME / IANA | ISO-8859-15 |
|---|---|
| エイリアス | ラテン 9、ラテン 0、ラテン 6 |
| 標準 | 8859 国際標準化機構 |
| に基づく | ISO-8859-1 |
| 先行 | ISO-8859-1 |
| 後継者 | UTF-8 |
ISO/IEC 8859-15:1999、情報技術 - 8ビットシングルバイトコード化グラフィック文字セット - パート15:ラテンアルファベット第9号は、 ASCIIベースの標準文字エンコーディングのISO/IEC 8859シリーズの一部であり、1999年に初版が発行されました。非公式にはラテン-9(およびしばらくの間ラテン-0 )と呼ばれています。これはISO 8859-1に似ており、したがって「西ヨーロッパ」言語を対象としていますが、あまり一般的ではない記号をユーロ記号と必要な文字に置き換えています。[1]
ISO-8859-15 は、ISO/IEC 6429のC0 および C1 制御コードが追加された場合のこの標準に対するIANA推奨文字セット名です。
Microsoftはコードページ28605(別名Windows-28605 )をISO-8859-15に割り当てました。IBMはコードページ923(CCSID 923)をISO 8859-15に割り当てました。[2] [3]
ISO/IEC 8859-1とISO/IEC 8859-15の両方の印刷可能な文字はすべてWindows-1252にも含まれています。2016年10月以降、すべてのWebサイトの0.1%未満(実際には現在0.02%未満)がISO-8859-15を使用しています。[4] [5]
歴史
1996年にサーミ語族の識別子ISO 8859-15が提案されたが、最終的には却下されたが、ISO-IR 197として承認された。[6] [7] [8]
ISO 8859-16は、今日のISO 8859-15と同様のエンコーディングとして提案され、未使用またはめったに使用されない11のISO 8859-1文字を、フランス語のŒ œ( DEC-MCSおよびLotus国際文字セットと同じ場所)とŸ(これらのセットと同じ場所にはないが、アイスランド語ではÝがその場所にあった)、オランダ語のIJ ij、トルコ語のĞ ğ İ ı Ş şで置き換えるものである。当時はユーロ記号は存在しなかった。[9]
草案は次の通りでした。
その後、名前は ISO-8859-0 に変更され、1997 年までに再構成されました。トルコ語の文字は、UCS (Unicode) の実装がそれほど遠くない時期に、当時のトルコの慣習に悪影響を及ぼす可能性があると考えられたため削除され、オランダ語のIJ合字は、既存の二重字ijで十分であると判断されたため削除されました。ウェールズ語のŴ ŵ と Ŷ ŷ を追加することも検討されましたが、さらなる調査が完了するまで延期されました。未使用またはまれにしか使用されない 4 つのISO 8859-1文字 ( ¤、¨、´、¸ ) は、それぞれ€、Ÿ、Œ、œに置き換えられました。[10] € は、ユーロが導入されたときに必要になりました。 Ÿ は、フランス語のテキストを小文字から大文字に、またその逆に変換できるようにするために必要であり、Œとœはフランス語の合字です。皮肉なことに、最後の 3 つは、 ECMA-94 (1985) と ISO-8859-1 (1987)の元となった文字セットであるDECの多国籍文字セット(MCS)に 1983 年にすでに存在していました。元のコード ポイントが他の文字で占められていたため、再導入するには、論理的ではないコード ポイントを選択する必要がありました。
同じ提案では、さらに6つの文字(¢、¦、±、¼、½、¾)を「最大限多くの言語をカバーする他の文字」に置き換えることも推奨されています。これらの文字を選択した理由は提案に記載されています。[10] ユーロ記号については、通貨記号の代わりにプラスマイナス記号を置き換えたい人もいました。通貨記号は、一部のアプリケーションではフィールド区切りとして使用され、他のアプリケーションでは小計を示すために使用されます。これには強い反対がありました。ある人は、「提案されている「+-」は適切な代替手段ではありません。このシーケンスはめったに使用されませんが、すでに数学的な意味が固定されており、「±」とはまったく異なります。また、読者が文脈から意図された意味である「±」を推測したとしても、「±」の代わりに「+-」を使用すると、少なくともフランス語圏のoe合字の代わりに「oe」を使用するのと同じくらい物理学者の美的感覚が損なわれるでしょう」と述べました。[11] 結局、±は残され、¤は削除されました(当初の計画通り)。
1997/1998 年頃 ( Windows-1252が更新されたとき)、Š、š、Ž、žの 4 つの文字が選択されました。これらは、フィンランド語とエストニア語でロシア語の借用語と名前の音訳に使用されます。この提案は、同時に ISO 8859-15 に名前が変更されました。最終的に、¦、¼、½、¾の文字は削除されましたが、¢ は他の 4 つよりも一般的であったため保持されました。
ISO 8859-15 を 8 ビット通信のデフォルト文字セットにしようとする試みもありましたが、人気の高い ISO 8859-1 に取って代わることはできませんでした。ユーロ記号が必要なときに Linux のテキスト コンソールおよびターミナル プログラムのデフォルト文字セットとして使用されましたが、完全なUnicodeの使用は現実的ではありませんでした。その後、これはUTF-8に置き換えられました。
カバレッジ
ISO 8859-15 は、「ラテンアルファベット第 9 号」と呼ばれる文字をエンコードします。この文字セットは、アメリカ大陸、西ヨーロッパ、オセアニア、およびアフリカの大部分で使用されています。また、東アジア言語のほとんどの標準的なローマ字表記でも一般的に使用されています。
各文字は、単一の 8 ビット コード値としてエンコードされます。これらのコード値は、ほぼすべてのデータ交換システムで使用でき、次の言語で通信できます。
- アルファベットを完全に網羅した現代言語
- 注記
- ^ Ǿ/ǿ が欠落している点を除き、完全にサポートされています。 Ǿ/ǿ は、あいまいさが増すという代償を払って、Ø/ø に置き換えることができます。
- ^ オランダ語のアルファベットをほぼ完全にカバーして一般的にサポートされていますが、欠落しているIJ、 ij は電子形式では常に 2 文字の IJ または ij として表される必要があります。
- ^ 米国および現代のイギリス
- ^ 2017年、ドイツ語正書法協議会は、ドイツ語のサポートが完了する前に、大文字⟨ẞ⟩ を正式に採用しました。
- ^ 新しい綴り
- ^ ab 基本的な古典正書法
- ^ ルミ文字
- ^ ブークモール語とニーノシュク語
- ^ ヨーロッパとブラジル
句読点とアポストロフィのカバー範囲
上記の一部の言語では、«、»、"、および ' のみが含まれているため、正しい印刷上の引用符が欠落しています。
また、このエンコーディングでは、アポストロフィや一重引用符の正しい文字が提供されません。ただし、一部のテキストでは、6 字型/9 字型の引用符やアポストロフィの代わりに、ISO 8859-1 の一部であるスペース グレイブ アクセントとスペース アキュート アクセントが使用されています (これは、これらの文字がすべて斜めのくさび形グリフとして表示される一部のフォント スタイルでは確実に機能します)。
コードページレイアウト
ISO-8859-1との違いは、文字の下に Unicode コード ポイントが表示されることです。
エイリアス
ISO 8859-15 には、次のベンダー固有のエイリアスもあります。
- WE8ISO8859P15 ( Oracleデータベース) [15]
参照
- 西ラテン文字セット (コンピューティング)
- DIN 91379ヨーロッパ向け Unicode サブセット
参考文献
- ^ 「ISO-8859-15」IANA 。 2016年3月8日閲覧。
- ^ 「コード ページ 923 情報ドキュメント」。2013 年 2 月 28 日時点のオリジナルよりアーカイブ。
- ^ 「CCSID 923 情報文書」。2014 年 12 月 1 日時点のオリジナルよりアーカイブ。
- ^ 「文字エンコーディングの使用に関する歴史的傾向、2018 年 11 月」。w3techs.com。
- ^ 「よくある質問」w3techs.com。
- ^フィンランド規格協会SFS を代表するTIEKE (1999-12-07)。サーミ語補足ラテン語セット第2号(PDF)。ITSCJ/ IPSJ。ISO -IR -209。
- ^ エバーソン、マイケル。「提案された ISO 8859-15」。2017 年2 月 26 日閲覧。
- ^ エバーソン、マイケル。「提案された ISO 8859-14 (後の 15)」。2017 年2 月 26 日閲覧。
- ^ エバーソン、マイケル。「提案された ISO 8859-16」。2017 年2 月 26 日閲覧。
- ^ ab Everson, Michael. 「提案された ISO 8859-0 (後の 15)」。2017 年2 月 26 日閲覧。
- ^ Stolz, Otto (1997 年 7 月 11 日). 「Re: New Draft ISO 8859-0」. Unicode Mail List (メーリング リスト).
- ^ コードページ CPGID 00923 (pdf) (PDF)、IBM
- ^ コードページ CPGID 00923 (txt)、IBM
- ^ 国際 Unicode コンポーネント (ICU)、ibm-923_P100-1998.ucm、2002-12-03
- ^ Baird, Cathy; Chiba, Dan; Chu, Winson; Fan, Jessica; Ho, Claire; Law, Simon; Lee, Geoff; Linsley, Peter; Matsuda, Keni; Oscroft, Tamzin; Takeda, Shige; Tanaka, Linus; Tozawa, Makoto; Trute, Barry; Tsujimoto, Mayumi; Wu, Ying; Yau, Michael; Yu, Tim; Wang, Chao; Wong, Simon; Zhang, Weiran; Zheng, Lei; Zhu, Yan; Moore, Valarie (2002) [1996]. 「付録 A: ロケール データ」. Oracle9i データベース グローバリゼーション サポート ガイド(PDF) (リリース 2 (9.2) 版). Oracle Corporation . Oracle A96529-01. 2017-02-14 のオリジナルからアーカイブ(PDF)されました。2017年2月14日閲覧。
外部リンク
- ISO/IEC 8859-15:1999 - 8 ビット 1 バイト符号化グラフィック文字セット、パート 15: ラテン アルファベット No. 9 (1999 年 3 月 15 日発行)
- ISO/IEC 8859-15 (1997年8月1日付けの最終委員会草案)
- ISO Latin 9 と ISO Latin 1 の比較
- ISO-IR 203 ヨーロッパ補足ラテン語セット(1998 年 9 月 16 日)
