TRONコードは、 TRONプロジェクトで使用されているマルチバイト文字コードです。Unicodeに似ていますが、 Unicodeの漢字統合プロセスは使用していません。各CJK文字セットの各文字は、現代の文字の古風な形や歴史的な形も含めて個別にエンコードされます。つまり、中国語、日本語、韓国語のテキストを混在させても、文字の正確な形について曖昧さが生じることはありません。しかし、意味的に同等の文字が複数回エンコードされるため、一部の操作が複雑になる場合もあります。
TRON には 1億5000 万のコード ポイントを収容できます。Unicode 4.1 の 70,000 字以上の漢字の中国語、韓国語、日本語のバリアント用に個別のコード ポイント (必要だと判断された場合) を用意すると、TRON では 200,000 以上のコード ポイントが必要になります。TRON には Unicode 2.0 の漢字以外の文字が含まれていますが、Unicode が基本多言語面を超えて拡張し、既存のスクリプトに文字を追加しているため、最近の Unicode の改訂には対応していません。TRON のエンコーディングは、JIS X 0213などの最近のコード ページの更新を含めるように更新されています。[ 1 ]
TRONエンコーディング用のフォントは入手可能ですが、商用利用には制限があります。[ 2 ]
TRONコードでは、各文字は(現在のエンコードプレーンに存在する限り)2バイトとしてエンコードされます。ISO /IEC 2022と同様に、TRON文字エンコーディングは、言語指定子コードと呼ばれるエスケープシーケンスを使用して48,400コードポイントのプレーンを切り替えることにより、単一の文字エンコーディング内で複数の文字セットの文字を処理します。TRONコードに組み込まれている文字セットには、JIS X 0208やGB 2312などの既存の文字セット、大漢字字典などの他の文字ソース、および東巴記号など他のエンコーディングに含まれていない一部のスクリプトが含まれます。
TRONコードに文字セット全体が組み込まれているため、意味が等しい文字の多くが複数回エンコードされています。たとえば、GT Typefaceの漢字はすべて独自のコードポイントを持ちますが、その多くはJIS X 0208などの既に含まれている他の漢字文字セットと重複しています。そのような例の1つが、文字「亜」(UnicodeではU+4E9C)で、JIS X 0208領域の1-3021、GT Typeface領域の2-2464、および大漢字字典領域の8-2373に現れます。
0x00から0x20および0x7Fの範囲のバイトは、制御コードで使用するために予約されています。
各プレーンの文字は4つのゾーンに分割されます。各ゾーンは個別に割り当てられます。例えば、プレーン1では、JIS X 0208文字はゾーンA(0x2121から始まる)に、JIS X 0213文字はゾーンAとゾーンBの両方に、GB 2312文字はゾーンC(0x2180から始まる)に配置されます。
TRONコードポイントはX-YYYYと表記され、Xは10進数でのプレーン番号、YYYYは16進数でのコードポイントです。あるいは、 0xNNYYYYという表記も使用できます。ここでNNは言語指定子コードの2バイト目(16進数)です。テキスト形式&TNNYYYY;は、HTML、SGML、XMLにおける数値文字参照と同様に、ASCIIテキストでTRONコードポイントを表すために使用できます。しかし、標準に準拠した HTML または XML パーサーでは、これらを名前付きエンティティとして扱います。そのため、これらを定義する広範な DTD (おそらく、TRON エスケープ用のプライベート使用文字を使用したり、UCS で同じ文字として表現される異なる TRON 文字をエンコードするために TRON 文字にマッピングされた Unicode バリエーションセレクタを使用したりすることによって) がない限り、UCS の有効で曖昧さのないコード ポイントのシーケンスに直接かつ容易にマッピングすることはできません。そのため、UCS の標準 UTF と相互運用可能な方法で TRON テキスト フォーマットをサポートするには、別の SGML ベースのパーサーが必要になります。
言語指定子コードには、0xFE という接頭辞が付きます。有効な接尾辞は、0x21 ~ 0x7E (プレーン 1 ~ 94 を参照) および 0x80 ~ 0xFE (将来のプレーン用) であり、その多くは未割り当てです。
特殊コードには0xFFという接頭辞が付きます。
以下は、TRONコードで使用するために割り当てられたプレーンと、それに対応する言語指定子コード、および各プレーンに含まれる文字セットの説明です。
11番から15番までの機体は当初、文字セット「文字京」を保管するために割り当てられていましたが、意見の相違により除外されました。31番までのその他の機体は現在、将来の割り当てのために確保されています。