半角および全角形式は、Unicode ブロックU+FF00 – FFEFであり、半角文字と全角文字の両方を含む古いエンコーディングが Unicode との間でロスレス変換できるように提供されています。これは、基本多言語面の最後から 2 番目のブロックであり、その後ろにはU+FFF0 – FFFF の短い特殊ブロックのみが続きます。Unicode 1.0 でのブロック名はHalfwidth and Fullwidth Variantsでした。[ 4 ]
U+FF01 ~ FF5Eの範囲は、 ASCII 21~7Eの文字を全角形式で再現します。U+FF00は全角ASCII 20(スペース文字)には対応していません。なぜなら、その役割は既にU+3000「表意文字スペース」によって担われているからです。
範囲 U+FF61 – FF9F は、JIS X 0201エンコーディングの A1 から DF への転置で、カタカナの半角形と関連する句読点をエンコードします–半角カナを参照してください。
U+FFA0 – FFDC の範囲は、1974 年の標準レイアウトの転置で、ハングルの互換性ジャモ文字の半角形をエンコードします。これは、IBM コード ページ 933 など、韓国語用の一部の IBM エンコーディングのマッピングで使用され、Shift Out および Shift In 文字を使用して 2 バイト文字セットにシフトできます。[ 5 ] 2 バイト文字セットには互換性ジャモが含まれる可能性があるため、往復互換性を提供するために半角バリアントが必要です。[ 6 ] [ 7 ]
範囲 U+FFE0 – FFEE には、全角シンボルと半角シンボルが含まれます。
このブロックには、東アジアの句読点の位置的変異体用に定義された変異シーケンスがあります。 [ 8 ] [ 9 ] これらは、U+FE00 VARIATION SELECTOR-1 (VS01) とU+FE01 VARIATION SELECTOR-2 (VS02) を使用します。
短い斜線を持つ全幅ゼロには、追加のバリアントが定義されています。U+FF10 FULLWIDTH DIGIT ZERO、U+FE00 VS1 ( 0︀ )。[ 10 ] [ 9 ]
以下のUnicode関連文書には、半角形および全角形ブロックにおける特定の文字の定義の目的と手順が記載されています。