半角カナは、通常の正方形(1:1)のアスペクト比ではなく、通常の半分の幅(1:2のアスペクト比)で圧縮されて表示されるカタカナ文字です。たとえば、カタカナの「ka」の通常(全角)形式は「カ」ですが、半角形式は「к」です。また、半角ひらがなはUnicodeに含まれており、Adobe-Japan1-6ベースのOpenTypeフォントを使用してCSSを介してWebまたは電子書籍で使用できます。 [1]最後に、半角漢字は現代のコンピュータで使用でき、一部のレシートプリンター、電光掲示板、古いコンピュータで使用されています。[2]font-feature-settings: "hwid" 1
半角カナは、日本語のコンピューターが普及した初期に使用されていたもので、日本語の文字をラテン文字の等幅フォントと同じグリッド上に表示できるようにするためのものでした。半角漢字は使用されていませんでした。半角カナは現在では一般的には使用されていませんが、レジの表示、お店の領収書、日本のデジタルテレビや DVD の字幕、郵送先住所ラベルなど、特定の設定で使用されています。半角カナの使用は、特に特定のインターネットスラングで頻繁に行われる、文体上の選択である場合もあります。
「半角カナ」という用語は、厳密にはカナの表示方法のみを指し、格納方法を指すものではありませんが、一部の文字エンコーディング( JIS X 0201 (1969)など)でカタカナが格納される A0~DF(16 進数)ブロックを指すためにも緩く使用されます(以下のエンコーディングを参照)。ただし、これは正式には誤りです。この JIS 規格では、カタカナをこれらの場所に格納できることを単に指定しているだけで、表示方法については指定していません。混乱が生じるのは、初期のコンピューターでは、ここに格納された文字が実際には半角カナとして表示されていたためです(以下の混乱を参照)。
歴史

半角カナと2/3角カナは、コンピュータ以前の時代から使用されていました。[3]コンピュータの初期の時代、ASCIIは7ビットの文字セットとして定義され、128文字のスペースがありました。しかし、この標準は米国向けに設計されたため、日本の通貨を表すために必要な円(¥)記号などの文字や記号は含まれていませんでした。また、かなや漢字など他のアルファベットの文字のためのスペースも含まれていなかったため、日本語の文字をエンコードすることはできませんでした。さらに、日本語の文字は、かなと漢字の両方が正方形のグリッド上に描かれているのに対し、ラテン文字は一般的にもっと狭く書かれるため、日本語の文字も表示できませんでした。
JIS X 0201は 1969 年に開発されましたが、当時はコンピュータはソフトウェア設計とハードウェア リソースの両方の面で、日本語で使用される何千もの中国語ベースの漢字を表現できなかった時代でした。妥協案として、この標準では、カタカナ (ひらがなや漢字ではなく) のみを、上位バイト値の範囲 0x80 ~ 0xFF に割り当てられた小さな文字セットとしてエンコードしました。これにより、8 ビット プロセッサは、ひらがなや漢字を処理できないものの、日本語のテキストを音声的に (カタカナとして) エンコードして処理できるようになりました。これらのカタカナ文字は、今度は「半角カナ」として表示されました。これは、マシンが印刷および表示できる等幅のラテン アルファベットと同じ幅に収まる、新しい非正統的な狭いフォーム ファクタです。エンコードの点では、JIS X 0201 は ASCII のさまざまな拡張であり、追加の文字が含まれており、重複部分 (ラテン文字セクション) では ASCII と完全に一致しません。

半角カナは「日本の電報に使われるため、コンピュータでエンコードされた最初の日本語文字」として開発されました。[1]
全国銀行データ通信システムは、日本最大の資金移動システムであり、1973年に設立されました。銀行間の取引メッセージは、 20文字以内のラテン文字、数字、半角カタカナのみを使用できました。このシステムは、2018年にZEDI(全国銀行データ通信システム)に置き換えられ、可変長文字のひらがなと漢字を処理できるようになりました。[4] [5]
カタカナを狭いセル領域に収めるために、いくつかの妥協が行われました。たとえば、発音区別符号の 濁点と半濁点は、前の文字の一部ではなく、別の文字として扱われます。この妥協により、多くの人が「半角カナ」を見た目に魅力的でないと考えるようになり、今日多くのコンピュータ プログラムで問題を引き起こしています。[引用が必要]

半角カナのもう一つの用途は、スペースを節約することです。Windows 95の日本語版では、ユーザーインターフェースにMS Pゴシックの半角カタカナを使用していました。これは、MS Pゴシックよりも少し狭いMS UIゴシックの全角カナに置き換えられました。[6] [7]
エンコーディング
JIS X 0201仕様 (1969)では、カタカナは A0~DF (16 進数) のブロックでエンコードされます。表示方法は指定されておらず、全角カナと半角カナを別々にエンコードすることもありません。JIS X 0208では、カタカナ、ひらがな、漢字はすべてエンコードされ (全角文字として表示され、半角文字はありません)、カナの順序は異なります。JIS X 0208#ひらがなとカタカナを参照してください。
JIS X 0201 と JIS X 0208 を組み合わせたシフト JISでは、これらのエンコーディング (どちらもラテン文字とカタカナをエンコードできます) は別々に格納されており、JIS X 0201 はすべて半角で表示されます (したがって、JIS X 0201 カタカナは半角カナとして表示されます)。一方、JIS X 0208 はすべて全角で表示されます (したがって、JIS X 0208 ラテン文字はすべて全角ラテン文字として表示されます)。したがって、シフト JIS では、ラテン文字とカタカナには、半角と全角の 2 つの別々の表示形式を持つ 2 つのエンコーディングがあります。
Unicodeでは、カタカナとひらがなは主に通常の全角文字として使用されます (カタカナ ブロックとひらがな ブロックは全角文字として表示されます)。別のブロックである半角および全角形式ブロックは、半角カナや全角ラテン文字などの異体文字を格納するために使用されます。
したがって、JIS X 0201 および派生エンコーディングの対応する部分 (Shift JIS の JIS X 0201 部分) のカタカナは半角で表示されますが、Unicode では半角形式が別途指定されます。
半幅テーブル
「J」はJIS X 0201の最初の 4 ビットを示します(ただし、以下を参照してください。これらは必ずしも半角を示すわけではありません)。また、Shift JISなどの他のセットでは、「U」は半角および全角形式ブロックの Unicodeの行を示します。
空白の最初のセルは、JIS では存在しない文字 (A0) を表しますが、 Unicode では全角の二重括弧 ( U+FF60) を表すことに注意してください。
インターネット上の半角カナ
電子メール
SMTPプロトコルとNNTPプロトコル (それぞれ電子メールとUsenet の配信に使用) は以前は 7 ビット バイトしか送信できなかったため、日本語で電子メールを送信するには ISO-2022-JP を使用するのが慣例でした。
ISO-2022-JP には半角カナは含まれていません。JIS X 0201 のローマ字セットと JIS X 0208 のすべてが含まれていますが、JIS X 0201 のカタカナセットは含まれていません (これは、たとえば、Shift JIS の半角カナに使用されます)。JIS X 0201 の両方のセットには ISO 2022 コードがありますが、ISO-2022-JP プロファイルにはローマ字セットのみが含まれています。つまり、ISO-2022-JP に半角カタカナを含めるための形式は明確に定義されており、ISO-2022-JP 形式に違反しています。このため、半角カナが誤ってメッセージに含まれていた場合、送信中に文字化けする可能性があります ( mojibakeを参照)。HTML5で使用されているWHATWGエンコーディング標準では、ISO-2022-JP形式の拡張としてJIS X 0201カタカナのデコードは許可されているが、エンコードは許可されておらず、エンコード時に半角カタカナをJIS X 0208の同等のものに変換します。[8]
現在、ほとんどの電子メール サーバーは8BITMIME拡張をサポートしており、8 ビット文字を認識できるため、これはもはや問題ではありません。代わりに、 Base64などのエンコード システムを使用し、 MIME を使用してメッセージに指定することもできます。
ウェブページ
HTTP は8 ビット文字を受け入れる ため、電子メールに存在する問題は Web ページでは発生しません。
ただし、コンピュータ プログラムが文字をShift JIS、EUC-JP、UTF-8のいずれとして扱うかを判断するのが難しいという問題が存在します。そのため、文字コード情報は HTTP 応答ヘッダーまたはMeta タグで指定する必要があります。
混乱
厳密に言えば、JIS X 0201 エンコードを「半角カタカナ」とするのは誤りです。この規格では文字幅は定義されておらず、カタカナ文字のコード表現のみが定義されているからです。JIS X 0201 規格では、カタカナ文字は半角ではなく、通常 (全角) の幅で印刷されます。
半角文字は、全角文字の表示(および関連する JIS X 0208 などの 2 バイト エンコーディング)が普及する前、文字が半角で表示されていた期間(および 1 バイト エンコーディングが使用されていた期間)にのみ表示に使用されていました。しかし、JIS X 0201規格(ラテン文字とカタカナが半角で表示されていた)とJIS X 0208規格(カタカナ、ひらがな、漢字、ラテン文字が全角で表示されていた)を組み合わせたシフトJIS規格では、カタカナとラテン文字は、JIS X 0201とJIS 0208の両方で2回エンコードされ、セクション(0201または0208)に応じて半角または全角で表示されます。そのため、0201カタカナブロックは「半角カナ」に対応すると考えられ、0201規格が「半角」文字を定義しているという誤解が広まっています。
さらに、JIS X 0201 は 1 バイト エンコーディング (半角で表示)、JIS X 0208 は 2 バイト エンコーディング (全角で表示) ですが、バイト数と幅 (上記の Shift JIS の対応を除く) には関連性がありません。たとえば、Unicode は 4 バイト ( UTF-32 ) でエンコードして、全角文字と半角文字の両方を表示できます。
参照
参考文献
- ^ 改訂新版スタイルシートポケットコンセプト p.107 、藤本肇、2013年3月5日、ISBN 978-4774154862
- ^ TSP100futurePRNT (日本語)、スター精密
- ^ 東京築地活版製造所 - 活版見本 p.33 、野村宗十郎、1903
- ^ “経理部門の人材不足で悩む会社に朗報、金融EDI「ZEDI」が2018年稼働へ”.日経X-TECH。 2017-11-30 。2019年5月11日に取得。
- ^ “全銀EDIシステム(ZEDI)に対応したサービスの提供について”.みずほ銀行。 2018-12-25 。2019年5月11日に取得。
- ^ “Windows 98 日本語版β3 ファーストインプレッション 第 1 回”. PC Watch を感動させます。 1998-03-03 。2019年5月11日に取得。
- ^ “Windows98のインターフェイス”. 1998-06-26 。2019年5月11日に取得。
- ^ 「12.2. ISO-2022-JP」。エンコード標準。WHATWG。
- ^ ルンデ、ケン。 CJKV 情報処理。オライリー、第 2 版、2009 年、p. 224–226 (同じく第 1 版、1999。p. 144–145)
