
ミャンマーは、ミャンマーのビルマ語、モン語、シャン語、パラウン語、カレン語、そしてインド北東部のアイトン語とパケ語の文字を含むUnicodeブロックです。また、ミャンマーではパーリ語とサンスクリット語の表記にも使用されます。
このブロックには、標準化されたバリアント用に定義された 16 のバリエーション シーケンスがあります。[ 3 ] これらは、カムティ語、アイトン語、およびファケ語で使用される点付き文字を示すためにU+FE00 VARIATION SELECTOR-1 (VS01) を使用します。[ 4 ] (これはフォントに依存することに注意してください。たとえば、パダウク フォントは、一部の点付き形式をサポートしています。)
以下のUnicode関連文書は、ミャンマー文字ブロックにおける特定の文字の定義の目的とプロセスを記録したものです。
Unicode 1.0.0 では、現在のミャンマー語ブロックの一部がチベット語に使用されていました。Microsoft Windowsでは、古いチベット語ブロックを参照する照合データがWindows XPまで保持され、Windows 2003で削除されました。[ 5 ]
ミャンマーでは、デバイスやソフトウェアのローカライズに、Unicode 準拠のフォントではなくZawgyi フォントがよく使われます。 [ 6 ]これらは Unicode ミャンマー ブロック (0x1000–0x109F) と同じ範囲を使用し、コード ポイントのサブセットのみが同じように解釈されるにもかかわらず、 UTF-8のようにエンコードされたテキストにも適用されます(Zawgyi テキストは公式には UTF-8 を構成していません)。Zawgyi はビルマ語以外のミャンマー文字言語をサポートしていませんが、ビルマ語と想定されるテキストのエンコードを検出するためのヒューリスティックな方法があります。[ 7 ]