漢字には、同じ意味と発音を表すものの、視覚的に異なる複数の異体字が存在する場合があります。ある文字の異体字は互いに異体字であり、多くは英語のアルファベットに存在する異体字と直接的に類似しています。例えば、文字Aの二階建ての⟨a⟩と一階建ての⟨ɑ⟩の異体字があり、後者は手書きでより一般的に見られます。状況によっては、特定の異体字の使用が求められる場合があります。
20世紀以前は、文字の形状の多様性は至る所に見られ、木版印刷の発明後もその傾向は続いた。例えば、秦王朝( 紀元前221~206年)以前は、「明るい」という意味の文字は明または朙と書かれており、左側に日「太陽」または囧「窓」 、右側に月「月」の要素があった。秦の宰相であった李斯(紀元前208 年没)は、中国を初めて政治的に統一した戦争の後、秦小篆を中国全土に普及させようと試みた。李斯は「明るい」という単語の朙形を規定したが、一部の書記はこれを無視して明と書き続けた。しかし、朙の使用が増加すると、左側に目「目」がある眀という3番目の異形が広まった。これはおそらく朙の短縮形から派生したものと考えられる。最終的に、明はキャラクターの標準形となった。[ 1 ]
また、書記体系全体の大きな変化、例えば、書道体を生み出した筆字体と筆字化の過程からも新しい変種が生まれます。古文書学者の邱西貴によれば、中国文字の歴史における進化の最も大きな傾向は、文字の形(字形; zìxíng)、「個々の文字の外見」と、書体(字体; zìtǐ ) 、「書体と書体の区別する特徴の全体的な変化」の両方における簡略化であり、ほとんどの場合、かなり明白でかなり実質的な変化を指しています。[2] 筆字体では、秦小篆書で使用されていた形が大幅に省略、追加、または変形されることが多かったのに対し、筆字化では、元の構造を維持しながら、形を直接規則化および線状にして書道体に変換することになりました。例えば、「年」という漢字は、聊字(りゅう)によって秊字(しゅう)の形に変化したが、同じ漢字が聊字(りん)によって正統的な年字(しゅう)の形になった。同様に、聊字と聊字によって、「虎」という漢字は虎と乕という二つの異なる形に変化した。
多義的な文字の特定の定義を表すために、異なる部首を用いることで生じる異形が存在する。例えば、「雕」という文字は「鷹の一種」または「彫刻」を意味する。このように異なる部首を用いて特定する異形がそれぞれ発展した。鵰は「鳥」の部首を、琱は「翡翠」の部首を用いる。
まれに、古代中国語で意味が似ている2つの漢字が、現代中国語の読みが統合された際に混同され、同一視されることがあります。例えば、飢と饑はどちらもjīと読み、「飢饉」を意味し、現代中国語では互換的に使われています。しかし、古代中国語では、飢はもともと「満腹になるほどの食料が不足している」という意味で、饑は「飢饉」を意味していました。この2つの漢字は、かつては異なる古代中国語の韻グループ(それぞれ脂グループと微グループ)に属しており、過去には異なる発音をしていたことを示しています。同様の状況は、古代形于(現在は簡体字として使われている)の助詞於「in」の異形が存在する理由でもあります。上記のいずれの場合も、異形は単一の簡体字に統合されました。
最も正統的な文字の形は正字(zhèngzì )と呼ばれ、これは通常、中国の後期帝国時代に使われていた正統的な形を表す『康熙字典體(Kāngxī zìdiǎn tǐ)』に収録されている形を指す場合もある。非正統的な形は俗字(súzì、改訂ローマ字表記:sokja、ヘボン式ローマ字表記:zokuji )と呼ばれる。俗字の中には、古くから使われている略字や書体があり、後に中国本土で採用された簡体字の基礎となったものもある。例えば、痴は正統的な「癡」(愚かな)に対応する俗字である。これらの形は発音の要素が異なり、俗字は発音が「ほぼ」同じだが画数がはるかに少なく、そのため書きやすい文字を使用している。中国本土では、簡体字は「新子星」と呼ばれ、通常 は康熙字である「九子星」と対比される。
正統的な形と俗的な形は、個々の画の長さや位置、特定の画が交差するかどうか、または小さな画(点)の有無によってのみ異なる場合があります。これらは、個別の異体字とはみなされないことがよくあります。たとえば、「述」は、伝統的な正書法の「述」(「語る」「説明する」)という文字の新しい形です。別の例として、姓の吴(古代の国の名前でもある)は、伝統的に吳と書かれる文字の「新しい文字の形」です。

漢字を使用するあらゆる表記体系、すなわち中国語、日本語、韓国語において、文字の異体字は存在してきた。これらの言語を話す国々の政府は、特定の異体字を標準形として指定することで、表記体系を標準化してきた。どの異体字を使用するかという選択の結果、中国語の表記体系は簡体字と繁体字に二分されることになった。日本における簡体字の標準化は、中国本土における標準化とは異なる過程をたどった。
各地域の政府が定める標準文字形式は、以下に記載されています。

Unicode は、漢字統一の過程の結果として、異体字を複雑な方法で扱います。漢字統一では、中国語、日本語、韓国語圏でほぼ同じ異体字は同じコードポイントにエンコードされ、異なるフォントを使用することによってのみ区別できます。より異なる異体字は、異なるコードポイントにエンコードされます。ウェブページでは、目的の言語の正しい異体字の表示は、コンピュータにインストールされているフォント、ウェブブラウザの設定、およびウェブページの言語タグに依存します。多くのコンピュータユーザーが標準フォントをインストールしておらず、最も一般的なウェブブラウザがデフォルトで正しい異体字を表示するように設定されていないため、正しい異体字を表示できるシステムはまれです。以下は、異なるコードポイントと言語タグを持つ中国語の異体字の例です。
以下の例は、コードポイントは同じですが、言語タグが異なります。しかし、言語タグはテキストレンダラーから期待どおりの形式を取得するために正しく機能することは稀です(例えば、下の表では、レンダリングされたグリフがすべて同じように見える場合があります)。
代わりに、Unicode 標準では、これらのバリアントをバリアント シーケンスとしてエンコードできます。[ 3 ]標準の CJK 統一表意文字にバリアントセレクタ(グリフのない非スペース マーク)を追加することによってエンコードできます (適切な言語やスクリプトを選択するためにリッチ テキスト形式を使用する必要はなく、プレーン テキスト内で直接機能し、同じ言語/スクリプトの組み合わせで複数のバリアントが必要な場合に、より簡単で選択的な制御が可能になります)。有効な異体字配列のリストは、Unicode によって標準化されており、Unicode 文字データベース (UCD) の一部である表意文字異体字データベース (IVD) [ 4 ] [ 5 ]で定義されています。また、 UCS で新しいコード ポイントを再エンコードすることなく拡張可能です (異体字セレクタがエンコードされ、IVD が確立された Unicode バージョン以降、それらをレンダリングするために新しい互換性表意文字をエンコードする必要はなくなりました。BMPのCJK互換性表意文字とSIPの CJK互換性表意文字補足の2 つのブロックは、規範的ソースのレビューのために漢統一プロセス中に忘れられた過去のいくつかの間違いを修正することを除いて、Unicode 4.1 以降凍結されています)。[ 7 ]