ISO/IEC 8859-1 (一般にLatin-1と呼ばれる)は、 ASCIIベースの標準文字エンコーディングであるISO/IEC 8859シリーズの文字エンコーディングです。ラテン文字から191文字をエンコードします。多くの一般的な8ビット文字セットの基盤となっており、Unicodeの2番目の文字ブロックであるLatin -1 Supplementにも含まれています。南北アメリカ、西ヨーロッパ、オセアニア、そしてアフリカの大部分で使用されています。
これはウェブページで最も多く宣言されているシングルバイト文字エンコーディングですが、HTML5標準[ 1 ]によれば、ウェブブラウザはこれを上位セットのWindows-1252として解釈するため、これらのドキュメントにはそのセットの文字が含まれる可能性があります。
ISO-8859-1は、ISO/IEC 6429のC0 および C1 制御コードを追加した場合のこの標準のインターネット割り当て番号機関(IANA) の推奨名です。次の他のエイリアスが登録されています: iso-ir-100、csISOLatin1、latin1、l1、IBM819、コード ページ28591 、別名Windows-28591が Windows で使用されます。[ 2 ] IBM はこれをコード ページ819またはCP819 ( CCSID 819 ) と呼んでいます。[ 3 ] [ 4 ] [ 5 ] [ 6 ] Oracle はこれをWE8ISO8859P1と呼んでいます。[ 7 ]
この符号化方式は、多くの言語の文字を十分にカバーしています。
ISO-8859-1は、一部の言語で使用される文字が欠けているにもかかわらず、これらの言語で広く使用されていました。ほとんどの場合、欠けている文字はごくわずかであるか、使用頻度が低いため、ISO-8859-1に含まれる文字を用いて、何らかの印刷上の近似処理によって置き換えることができます。以下の表に、そのような言語を示します。
フランス語ではごくまれにしか登場しない文字ÿ (主にL'Haÿ-les-Rosesのような都市名に見られ、単語の先頭には決して現れない)は、小文字のみで採用されている。大文字に対応する位置は、ドイツ語の小文字ßで占められている。ドイツ語には、この規格が作成された当時、大文字が存在しなかった。
ISO-8859エンコーディングやASCIIと同様に、魅力的で正確なタイポグラフィに必要な記号が欠けています。
Windows-1252ではこれらの文字がすべて追加され、ISO/IEC 8859-15ではユーロ記号が追加されました。
ISO 8859-1は、1983年にDigital Equipment Corporation(DEC)が人気端末VT220で使用した多国籍文字セット(MCS)に基づいていました。これは欧州コンピュータ製造業者協会(ECMA)内で開発され、1985年3月にECMA-94として発行されました[ 9 ] 。この名前で今でも知られていることがあります。
ISO 8859-1の原案では、フランス語のŒとœは MCS と同様にコード ポイント 215 (0xD7) と 247 (0xF7) に配置されていました。しかし、フランス代表は言語学者でもタイポグラファーでもなかったため、これらは独立したフランス語の文字ではなく、単なる合字( fiやflなど) であると誤って主張しました。これは、当時自社のスタイルでŒ / œをフランス語で印刷していなかったBull Publishing Companyの代表団によって支持されました。カナダの英語圏代表はŒ / œを残すよう主張しましたが、フランス代表と Bull のチームに拒否されました。これらのコード ポイントは、ドイツ代表の提案によりすぐに×と÷で埋められました。フランス語への支持は、文字ÿが「フランス語ではない」と再び誤って主張されたことでさらに低下し、結果として大文字のŸがなくなりました。実際、ÿという文字は多くのフランス語の固有名詞に見られ、大文字は辞書や百科事典で使用されています。[ 10 ]これらの文字はISO/IEC 8859-15:1999に追加されました。BraSCIIは元の草案と一致しています。
1985年、コモドールは新しいAmigaOSオペレーティングシステムにECMA-94を採用した。[ 11 ] Amiga 1000で使用されるセイコーシャMP-1300AIインパクトドットマトリックスプリンタには、このエンコーディングが含まれていた。
ECMA-94の第2版(1986年6月)[ 12 ]には、仕様の一部としてISO 8859-2、ISO 8859-3、およびISO 8859-4も含まれていました。
ISO規格の初版は1987年に発行されました(最新版は1998年に発行)。そのタイトルは「情報技術 ― 8ビットシングルバイト符号化グラフィック文字セット ― パート1:ラテンアルファベットNo.1」です。
1990年に発表されたUnicodeの最初のバージョンでは、ISO-8859-1のコードポイントが最初の256個のUnicodeコードポイントとして使用されました。
1992年、IANAは文字マップISO_8859-1:1987(一般的には推奨MIME名であるISO-8859-1(ISO 8859-1の上にハイフンが1つ付いていることに注意)として知られている)をインターネットでの使用のために登録しました。 これはISO 8859-1の上位セットです。このマップは、未割り当てのコード値にC0およびC1制御コードを割り当て、可能なすべての8ビット値を介して256文字を提供します。
ISO-8859-1は、(少なくとも規格上は)HTTP経由で配信されるMIME タイプがで始まるドキュメントのデフォルト エンコーディングでありtext/、特定の記述 HTTP ヘッダーの値のデフォルト エンコーディングであり、HTML 3.2 ドキュメントで使用可能な文字セットを定義していました。これは他の多くの規格でも規定されています。実際には、上位エンコーディングである Windows-1252 がより効果的なデフォルトとなり、規格で指定されているかどうかに関わらずUTF-8が機能することがますます一般的になっています。
2026年4月現在 静的ウェブページの 6.7% はISO/IEC 8859-1を使用して配信され、その上位セットであるWindows-1252 は静的ページの 9.3%で使用されています(さらに一部のサブタイプやカテゴリでは、さらに多く使用されています。下記参照)。これは、すべてのWeb サイトのうちISO/IEC 8859-1を使用している0.9% とは大きく異なります(ほとんどの Web サイトはプログラムによって配信され、通常は静的ページが混在しているためです)。[ 13 ] [ 14 ]これは最も多く宣言されているシングルバイト文字エンコーディングですが、Web ブラウザとHTML5標準[ 1 ]はそれらを上位セットのWindows-1252として解釈するため、これらのドキュメントにはそのセットの文字が含まれる可能性があります。一部の国や言語では、世界平均よりも高い使用率を示しています。2025 年、Web サイトの使用状況によると、ブラジルでは使用率が2.2% [ 15 ]、ドイツでは2.1% [ 16 ] [ 17 ]です。
HTML5 は、ほぼすべてのウェブページで使用される最新の標準ですが、古い標準に関しては、HTML Transitional ウェブページの 14.0% がISO-8859-1を使用しています[ 18 ] (HTML Transitional は、すべての Web サイトのうち 2.9% で使用されています[ 19 ] )。HTML Strict は17.0% で使用されています[ 20 ] (ただし、HTML Strict は Web サイトのうち 0.1% でしか使用されていないことに注意してください[ 21 ] )。廃止され、あまり使用されていないフレームセットサイト要素を使用する Web サイト (全体の 0.2%) では、そのうち 24.7% が ISO 8859-1 を使用しています[ 22 ] 。したがって、レガシー エンコーディングは古いテクノロジーでより多く使用されており、HTML5 はそれらの使用をほぼ排除していると言えます。
ISO/IEC 8859-15は、ISO/IEC 8859-1 の更新版として 1999 年に開発されました。ISO/IEC 8859-1にはない フランス語とフィンランド語のテキストとユーロ記号 を提供します。このため、 ISO/IEC 8859-1 から使用頻度の低い文字の一部を削除する必要がありました。これには 、分数記号や文字のない発音記号 ( ¤、¦、 、¨、´、¸、¼、½、 )が含まれます¾。皮肉なことに、新しく追加された文字 ( Œ、œ、 、 ) のうち 3 つは、 ISO/IEC 8859-1 (1987 年) の前身であるDECの 1983 年多国籍文字セットŸ(MCS)に既に存在していました。これらの文字の元のコード ポイントは他の目的で再利用されたため、これらの文字は、論理的ではない別のコード ポイントで再導入する必要がありました。
ISO-IR-204は、よりマイナーな変更(FreeDOSではコードページ 61235と呼ばれている)であり、1998年に登録され、ISO-8859-1の共通通貨記号(¤)をユーロ記号に置き換えることで変更した[ 24 ](ISO-8859-15で行われたのと同じ置換)。
広く使われているWindows-1252文字セットは、 ISO/IEC 8859-15で提供されていない文字をすべて追加し、さらに、128 ~ 159 ( 16 進数80 ~ 9F)の範囲でほとんど使用されない C1 コントロールを置き換えることで、多数の活字記号を追加しています。Windows-1252 テキストが ISO-8859-1 と誤ってラベル付けされることは非常によくあります。よくある結果として、すべての引用符とアポストロフィ (ワープロソフトの「スマート引用符」で生成される) が、Windows 以外のオペレーティングシステムでは疑問符やボックスに置き換えられ、テキストが読みにくくなります。多くの Web ブラウザーや電子メール クライアントは、ISO-8859-1 コントロール コードを Windows-1252 文字として解釈し、この動作は後にHTML5で標準化されました。[ 25 ]
Apple Macintoshコンピュータは、1984 年にMac Romanと呼ばれる文字エンコーディングを導入しました。これは、西ヨーロッパのデスクトップ パブリッシングに適したものでした。これは ASCII の上位セットであり、ISO-8859-1 に含まれるほとんどの文字と Windows-1252 の追加文字をすべて含んでいますが、配列は全く異なります。ISO/IEC 8859-1 には含まれているものの、このセットには含まれていない印刷可能な文字は、 Mac 版 Internet Explorer の最終バージョンを含む、古い Macintosh ブラウザを使用して Web サイトでテキストを編集する際に、しばしば問題の原因となります。
DOSにはコードページ850があり、ISO-8859-1にある印刷可能な文字はすべて含まれていますが、配置は全く異なります。さらに、コードページ437の最も広く使用されているグラフィック文字も含まれています。
1989年[ 26 ]から2015年の間、ヒューレット・パッカードは多くの電卓でISO-8859-1の別のスーパーセットを使用していた。この独自の文字セットは、単に「ECMA-94」と呼ばれることもあった[ 26 ] 。HPには、0x7Fに中程度の濃淡(▒、U+2592)を追加するコードページ1053もある[ 27 ] 。
EBCDICのコードページの中には、ISO-8859-1と同じ文字セットを持つように意図的に設計されたものがいくつかあり、それによって両者間の容易な変換が可能になっている。
2 月に ECMA TC1 は ISO/TC97/SC2 にそのようなエンコード 文字セットの提案を提出しました。1984 年 4 月に SC の会議で、このトピックの新しい作業項目の提案を TC97 に提出することを決定しました。この会議中および会議後の技術的な議論の結果、TC1はX3L2が提案した符号化方式を採用した。国際規格案DTS 8859のパート1は、このANSI/ECMA共同提案に基づいている。[…] 1984年12月13~14日の総会でECMA規格として採択された。[…]