漢字[ a ]は、中国語や、日本、韓国、ベトナムなど、歴史的に中国文化の影響を受けた地域の言語を表記するために用いられる表意文字です。学者によって認められている4つの独立して発明された文字体系(楔形文字、エジプト象形文字、漢字、マヤ文字)の中で、漢字は唯一、継続的に使用されてきたものです。3000年以上にわたる記録された歴史の中で、漢字の機能、スタイル、表記方法は大きく変化してきました。音声を反映するアルファベットの文字とは異なり、漢字は一般的に形態素、つまり言語における意味の単位を表します。ある言語で頻繁に使用される語彙をすべて表記するには、およそ2000~3000文字が必要です。2025年現在、 より多いUnicode規格には、 10万字の中国語文字が識別され、収録されています。文字はいくつかの原則に基づいて作成されており、形状や発音といった要素を用いて文字の意味を示すことができます。
最初に確認された文字は、紀元前13世紀に現在の河南省安陽市で、殷王朝の王室が行った占いの一環として作られた甲骨文字である。文字の形は当初、表意文字または象形文字の様式であったが、中国全土に文字が広まるにつれて進化した。秦王朝(紀元前221~206年)による小篆書の普及など、文字の改革は数多く試みられた。漢王朝初期(紀元前202 ~ 220年)までに成熟した楷書は、文字の形を抽象化し、象形文字としての起源を曖昧にして書きやすさを向上させた。漢王朝以降、楷書は楷書に草書の影響を受けて出現し、それ以来、文字の主要な書体として用いられている。長い辞書編纂の伝統に影響を受け、中国語を使用する国々は文字の形式を標準化してきた。大まかに言えば、中国本土、シンガポール、マレーシアでは簡体字が中国語の表記に用いられ、台湾、香港、マカオでは繁体字が用いられている。
漢字の使用が中国国外に広まった地域では、当初は文語中国語の表記に用いられ、その後、中国語圏全体で話されている現地語の表記に用いられるようになった。日本語、韓国語、ベトナム語では、漢字はそれぞれkanji、hanja、chữ Hánと呼ばれている。広西チワン族自治区のチワン族語の表記に用いられた鑢箪字のように、中国の他の言語にも独自の表記法が生まれた。これらの言語はそれぞれ、中国語から借用した外来語を加えた上で、既存の文字を用いてその言語固有の語彙を表記した。さらに、それぞれの言語は現地で使用するために独自の文字を発明した。韓国語とベトナム語の表記では、漢字は大部分がアルファベットに置き換えられており、日本語は、日本語表記体系の他の要素とともに、漢字を用いて表記される唯一の主要な非中国語言語となっている。
最も基本的なレベルでは、文字は一定の順序で書かれた画で構成されています。歴史的に、文字を書く方法としては、石、骨、青銅に刻むこと、絹、竹、紙に墨を塗ること、木版や活版印刷などが用いられてきました。19世紀以降、文字の利用を容易にするために発明された技術には、中国語の電信符号、中国語のタイプライター、そしてコンピュータ用の様々な文字符号化方式や中国語入力方式などがあります。
漢字は、人類の歴史における4つの独立した文字の発明の1つとして認められています。[ b ]いずれの場合も、文字は2つの異なるタイプの表意文字を使用するシステムから進化しました。表意文字とは、物体や概念を視覚的に表現する絵文字、または共通の慣習によってのみ概念を表す固定記号です。これらのシステムは、使用された技術だけでは話し言葉の意味を伝えるのに不十分であったため、原文字に分類されます。[ 3 ]
原文字から漢字が生まれるには、さまざまな革新が必要でした。まず、象形文字は、使用法と外観において単純な絵とは区別されるようになりました。例えば、「大きい」を意味する象形文字「大」は、元々は大柄な男性の絵でしたが、 「大鹿」という文字を「大きな鹿」と解釈するには、その特定の意味を知っている必要があり、単に大柄な男性と鹿が並んでいる絵だとは解釈できませんでした。このような抽象化の過程と、文字を書きやすくするために、象形文字は徐々に簡略化され、規則化されていきました。その結果、元の対象物がもはや明らかでなくなることもよくありました。[ 4 ]
この原始的な文字体系は、比較的狭い範囲の概念を比較的少ない記号ライブラリで表現することに限られていました。そのため、話し言葉の要素を直接示す記号を可能にする革新が促されました。[ 5 ]いずれの歴史的事例においても、これはリブス技法の何らかの形で実現されました。リブス技法では、単語の記号が、文脈に応じて、似た発音の別の単語を示すために使用されます。[ 6 ]これにより、適切な絵文字表現を持たない単語が初めて書き留められるようになりました。この技法は、語彙をさらに拡大する、より洗練された文字作成方法に先駆けるものでした。原始的な文字から文字体系が出現する過程は長い期間にわたって行われました。純粋に絵文字的な記号の使用が消え、話し言葉を表す記号だけが残ったとき、その過程は完了しました。[ 7 ]
中国語の文字は、歴史を通じていくつかの異なる表記体系で使用されてきました。表記体系は、文字、数字、句読点などを含む文字記号自体(文字素と呼ばれる)と、言語を記録するために使用される規則によって定義されるのが一般的です。[ 8 ]中国語の文字は表意文字であり、言語の意味の単位を表す文字素です。具体的には、文字は言語の形態素、つまり最も基本的な意味の単位を表します。中国語の形態素、したがってそれらを書くために使用される文字は、ほぼ常に1音節の長さです。特別な場合、文字は非形態素の音節も表すことがあります。このため、中国語の書き言葉はしばしば形態音節的であると特徴づけられます。[ 9 ] [ c ]表意文字は、一般的に音素、つまり言語話者が使用する音の個別の単位を表すアルファベットの文字と対比されます。 [ 11 ]漢字は絵文字に由来するにもかかわらず、もはや直接的に概念を表すことができる表意文字ではなく、その理解は読者が書かれている特定の言語の知識に依存している。[ 12 ]
漢字が歴史的に使用されてきた地域(まとめて「漢字圏」と呼ばれることもある)には、漢字の使用法を説明し洗練しようとする長い辞書編纂の伝統がある。歴史の大部分において、分析は2世紀の『説文解子』で最初に普及したモデルを中心に展開された。[ 13 ]より最近のモデルでは、漢字の作成方法、漢字の構造、特定の表記体系における漢字の機能などが分析されている。[ 14 ]
ほとんどの文字は、より小さな構成要素(部件; bùjiàn )からなる複合文字として構造的に分析することができ、これらの構成要素は多くの場合、それ自体が独立した文字であり、複合文字内の特定の位置を占めるように調整されています。[ 15 ]文字内の構成要素は特定の機能を果たす場合があります。音韻的構成要素は文字の発音のヒントを提供し、意味的構成要素は文字の意味の何らかの要素を示します。どちらの機能も果たさない構成要素は、ある文字を別の文字と区別する以外に特別な意味を持たない純粋な記号として分類されることがあります。[ 16 ]
単純な構造的分類体系は、意味的、音韻的、形態的要素をそれぞれ持つ、意味文字、表音文字、記号の 3 つの純粋なクラスと、各要素タイプの組み合わせに対応するクラスから構成される可能性がある。[ 17 ]標準中国語で頻繁に使用される3500文字のうち、純粋な意味文字は最も少なく、語彙の約5%を占めると推定され、次いで純粋な記号が18%、意味形式と音形式の複合語が合わせて19%を占める。残りの58%は音意味複合語である。[ 18 ]
20世紀の中国の古文書学者、邱西貴は、唐蘭と陳夢佳の以前の提案を基に、文字機能の3つの原則を提示した[ 19 ]。意味文字は、意味が元々どのように表現されたかに関わらず、その形が意味と完全に関連しているすべての文字を記述する。表音文字は、音の要素を含む。借用文字は、他の単語を書くために借用された既存の文字を含む。邱はまた、純粋な記号など、これらの原則から外れた文字クラスの存在も認めた[ 20 ] 。
最も古い文字のほとんどは象形文字(xiàngxíng)であり、物理的な物体を象徴的に表した絵文字です。[ 21 ]例としては、日(「太陽」)、月(「月」)、木(「木」)などがあります。時間の経過とともに、象形文字の形は書きやすくするために簡略化されました。[ 22 ]その結果、現代の読者は、多くの象形文字が元々何を表していたのかを推測することが一般的にできません。絵文字の起源の文脈を知らなければ、それらは純粋な記号として解釈される可能性があります。しかし、日in晴(「晴れた空」)のように、複合語における象形文字の使用が依然としてその元の意味を反映している場合は、意味要素として分析することができます。[ 23 ] [ 24 ]
象形文字は、元の意味から拡張され、比喩や提喩の層が加わることで、文字の本来の意味が失われることもあります。この過程で、同じ文字で書かれた異なる意味の間に過度の曖昧さが生じた場合、通常は特定の意味を表す新しい複合語が作られることで解決されます。[ 25 ]
直説法(指事; zhǐshì)は、単純な表意文字または自明文字とも呼ばれ、[ 21 ]具体的な形を持たない抽象的な概念を視覚的に表現したものです。例としては、上( 「上」)と下(「下」)があります。これらの文字は元々、線の上と下に点を配置して書かれていましたが、後に文脈における図像的な曖昧さの可能性が少ない現在の形に進化しました。[ 26 ]より複雑な直説法には、凸(「凸」)、凹(「凹」)、平(「平らで水平」)などがあります。[ 27 ]
複合表意文字(会意、会意、huìyì )は、論理集合体、連想的観念文字、または体系的意味文字とも呼ばれ、他の文字を組み合わせて新しい総合的な意味を伝えます。典型的な例は明(「明るい」)で、空で最も明るい2つの物体である日(「太陽」)と月(「月」)を並置したものと解釈され、それらが共有する明るさという性質を表しています。他の例としては、人(「人」)と木(「木」)の象形文字で構成された休(「休む」)や、女(「女」)と子(「子供」)で構成された好(「良い」)などがあります。[ 28 ]
複合表意文字の多くの伝統的な例は、実際には音と意味が複合したもので、その後の発音の変化によって不明瞭になったと考えられている。[ 29 ]例えば、『説文解子』では信(「信頼」)は人(「人」)と言(「言葉」)の表意文字の複合であると説明されているが、現代の分析では音と意味が複合したものとされている(ただし、どちらの要素が音であるかについては意見が分かれている)。[ 30 ]ピーター・A・ブードバーグとウィリアム・G・ボルツは、古代に複合表意文字が考案されたことを否定し、現在失われている二次的な読みが音の指標の明らかな欠如の原因であると主張しているが、[ 31 ]彼らの主張は他の学者によって否定されている。[ 32 ]
音意味複合語(形声;形声; xíngshēng)は、少なくとも 1 つの意味要素と 1 つの音要素から構成されます。[ 33 ]これらは、借用語の曖昧さを解消するために音要素を追加したり、文字の意味の特定の拡張を表すために意味要素を追加したりするなど、いくつかの方法のいずれかによって形成されることがあります。[ 34 ]音意味複合語の例としては、河(hé ; 「川」)、湖(hú ; 「湖」)、流(liú ; 「流れ」)、沖(chōng ; 「増水」)、滑(huá ; 「滑りやすい」)などがあります。これらの文字はそれぞれ、左側に 3 つの短い画があります。氵 は、 ⽔ (「水」)の簡略化された結合形です。この要素は各例において意味的な機能を果たし、文字が水に関連する何らかの意味を持っていることを示しています。各文字の残りの部分は音韻要素です。湖( hú )は標準中国語の胡( hú )と全く同じように発音され、河( hé )は可( kě )と似たように発音され、沖( chōng )は中( zhōng )と似たように発音されます。[ 35 ]
ほとんどの複合語の音声要素は、話し言葉におけるその後の音韻変化以前であっても、おおよその発音しか提供しない可能性があります。一部の文字は、音声要素と共通する音節の最初または最後の音だけを持つ場合があります。[ 36 ]音声系列は、同じ音声要素を使用して作成されたすべての文字で構成され、時間の経過とともに発音が大きく異なっている可能性があります。たとえば、茶( chá ; caa4 ; ' tea ' )と途( tú ; tou4 ; ' route ' )は、文学的な一人称代名詞である余( yú ; jyu4 )を使用した音声系列の文字です。これらの古代中国語の発音は似ていましたが、その後の音韻変化により、音声要素は現代中国語の発音の有用な手がかりとして機能しなくなりました。これは、ここで北京語と広東語の両方の読みで示されています。[ 37 ]
既存の文字を類似した発音を持つ他の単語の表記に用いるという現象は、中国語の文字体系の初期発展において必要であり、その後の歴史を通じて一般的であり続けている。借用文字(假借; jiǎjiè ; 「借用」)の中には、以前は表記形がなかった単語を表すために導入されたものがあり、これは之や其などの抽象的な文法助詞によく見られる。[ 38 ]借用文字として文字が借用される過程は、単語が追加の意味を獲得し、多くの場合同じ文字で表記される意味拡張という別の過程と混同してはならない。どちらの過程も、多くの場合、単一の文字形が複数の異なる意味の表記に使用される結果となるため、借用文字は意味拡張の結果であると誤解されることが多く、その逆もまた然りである。[ 39 ]
借用語は、古代に中国に伝わった仏教用語や、現代の中国語以外の新しい単語や名前など、他の言語から借用された単語を表記するためにも使用されます。たとえば、加拿大(Jiānádà ; 「カナダ」)という名前の各文字は、それぞれの音節の借用語としてよく使用されます。しかし、文字の発音と意味の間に完全な境界があるわけではありません。中国語に転写する際には、特定の意味合いを生み出すために借用語が意図的に選択されることがよくあります。これは、企業ブランド名でよく行われます。たとえば、コカ・コーラの中国語名は可口可乐;可口可樂(Kěkǒu Kělè ; 「おいしい、楽しい」)です。[ 40 ] [ 41 ] [ 42 ]
文字や構成要素の中には、固定された明確な形を持つことから意味が生まれるだけの純粋な記号もあります。純粋な記号の基本的な例としては、4を超える数字、例えば五(「五」)や八(「八」)などが挙げられます。これらの形は、それが表す量を視覚的に示唆するものではありません。[ 43 ]
『説文解字』は、紀元100年頃に学者徐申によって書かれた漢字辞典である。徐申は後書きで、漢字が作られるすべての方法を分析している。後世の著者は徐申の分析を発展させ、「六書」(六書; liùshū)と呼ばれる分類体系を開発した。これは、すべての漢字を『説文解字』で既に言及されている6つのカテゴリーのいずれかに分類するものである。この体系は、約2000年にわたり、中国語圏全体で使用されている漢字分析の主要な枠組みであった。[ 44 ]徐申は、分析の大部分を、彼より数世紀前に書かれた秦の篆書の例に基づいて行った。これらは通常、彼が利用できる最も古い標本であったが、彼はさらに古い形態の存在を認識していたと述べている。[ 45 ]最初の5つのカテゴリーは、象形文字、直説法文字、複合表意文字、音意味複合文字、借用文字である。徐は第6のカテゴリーを転注(zhuǎnzhù、「反転して焦点を合わせ直した」)としているが、その定義は不明確であり、現代の学者によって一般的に無視されている。[ 46 ]
現代の学者たちは、『説文解字』で提示された理論には問題があり、徐氏が執筆していた当時と現在の両方において、中国語の文字の本質を十分に捉えきれていないという点で意見が一致している。 [ 47 ] 『説文解字』に体現されている伝統的な中国語の辞書学は、一部の文字について信憑性に欠ける語源を示唆している。[ 48 ]さらに、いくつかのカテゴリーは定義が曖昧であると考えられている。例えば、 「大」 (「大きい」)のような文字を象形文字に分類すべきか直説文字に分類すべきかは不明である。[ 34 ]しかし、「六字」モデルへの認識は文字リテラシーの一般的な要素として残っており、学生が文字を暗記するためのツールとしてよく利用されている。[ 49 ]

漢字の歴史における進化の最も大きな傾向は、文字の形(字形; zìxíng)、「個々の文字の外見」と書体(字体; zìtǐ ) 、「書体と書体の際立った特徴の全体的な変化、...ほとんどの場合、かなり明白でかなり大きな変化を指す」の両方における簡略化である。[50] 書体が秩序正しく次々と現れ、前の書体を置き換えるという伝統的な考え方は、後の研究や考古学的調査によって否定されている。実際には、書体は徐々に進化し、特定の地域内ではしばしば複数の異なる書体が共存していた。[ 51 ]
中国の古典のいくつかは、文字の発明以前に記録を残すために結び紐が使われていたことを示している。 [ 52 ]この慣習に言及している作品には、『老子道徳経』第80章[ B ]や『易経』の「西慈 二」注釈[ C ]などがある。ある伝承によれば、漢字は紀元前3千年紀に伝説の黄帝の書記官である蒼頡によって発明された。蒼頡は、動物の足跡、風景、空の星の研究からインスピレーションを得て、結び紐の限界に不満を抱き、字(zì)と呼ばれる記号を発明したと言われている。これらの最初の文字が作られた日、空から穀物が降ってきた。その夜、人々は人間を騙すことができなくなったことを嘆く幽霊や悪魔の泣き声を聞いた。[ 53 ] [ 54 ]
黄河流域の賈湖(紀元前6500年頃)、大地湾と大母地(紀元前6千年紀)、半坡(紀元前5千年紀)など、新石器時代の集落跡から、図や絵のコレクションが発見されている。各遺跡のシンボルは遺物に刻まれたり描かれたりしており、一つずつ出現し、より大きな文脈を示すものは何もない。邱氏は「これらがすでに言語の記録に使われていたと断言する根拠は全くない」と結論づけている。[ 55 ]山東省の後期新石器時代の大汶口文化(紀元前4300年頃~紀元前2600年頃)で使用された記号との歴史的な関連性は古文書学者によって可能性が指摘されており、邱氏は「原始的な文字として断定的に扱うことはできないが、中国でこれまでに発見された古代の象形文字に最もよく似た記号である…間違いなく原始的な文字の先駆けと見なすことができる」と結論付けている。[ 56 ]
現存する最古の中国語の文字は、殷王朝末期(紀元前1250年頃~ 1050年頃)に作成された碑文群であり、最も古い例は武丁の治世の紀元前1250年から1200年の間に作成されたものである。[ 57 ]これらの碑文の多くは甲骨(通常は牛の肩甲骨または亀の腹甲)に刻まれ、殷王室が行った公式の占いを記録した。同時期に、関連性はあるものの異なる様式の碑文が儀式用の青銅器にも刻まれていた。この甲骨文字(甲骨文; jiǎgǔwén)は、薬用として「龍骨」として販売されていた標本が発見され、そこに刻まれた記号が初期の文字の形であると特定された後、1899年に初めて記録された。 1928年までに、骨の出所は河南省安陽近郊の村であることが判明した。そこは殷王朝最後の都である殷の遺跡であり、 1928年から1937年にかけて中央研究院の李吉率いるチームによって発掘された。 [ 58 ]現在までに、 15万個の甲骨の破片が発見されている。[ 59 ]
甲骨文字は、王家の祖先の霊と交信するために行われた占いを記録した。文字の長さは、短いものでは数文字、長いものでは数十文字に及ぶ。殷王は肩甲骨占いによって祖先と交信し、王家のこと、軍事的成功、天候などの事柄について尋ねた。文字は、熱にさらされてひび割れる前と後に占いの材料自体に刻まれ、一般的に、ひび割れから解釈された質問と答えの記録が含まれている。[ 60 ] [ 61 ]一部の甲骨には、筆でインクを付けてから筆で文字を刻んだものがあり、この証拠は、後の書家が使用した慣習的な筆順がこの時点ですでに多くの文字について確立されていたことを示している。[ 62 ]
甲骨文字は、後の中国語の書き言葉の直接の祖先である。最も古い既知の碑文はすでに高度に発達した文字体系を示しており、 紀元前2千年紀後半より前に最初に出現したことを示唆している。中国語の書き言葉は公式の占いで初めて確認されているが、殷王朝時代には他の目的にも文字が使われていたと広く信じられている。しかし、他の文脈で使われた媒体(おそらく竹簡や木簡)は青銅器や甲骨文字よりも耐久性が低く、保存されていない。[ 63 ]
殷王朝の頃から、甲骨文字は簡略化された形で存在し、竹書に用いられた別の文字体系や、氏族の紋章によく用いられた精緻な絵文字体系と並んで存在していた。これらの文字体系は金文(jīnwén)として保存されており、粘土の型にスタイラスを用いて銘文が刻まれ、その型を用いて儀式用の青銅器が鋳造された。[ 65 ]これらの技法の違いにより、文字の形は一般的に甲骨文字に比べて角ばった印象が少なくなった。[ 66 ]
これらの青銅器碑文の研究により、主流の書体は殷王朝後期にゆっくりと段階的に進化し、周王朝(紀元前1046年頃~ 256年)にも継続し、秦の周国で小篆(xiǎozhuàn )として知られる形になったことが明らかになった。 [ 67 ] [ 68 ]周王朝後期に使用されていた他の書体には、鳥虫書(niǎochóngshū)や秦以外の国で使用されていた地域的な書体がある。これらの書体の例は『説文解子』の異体字として保存されている。[ 69 ]歴史的には、周の書体はまとめて大篆(dàzhuàn )として知られていたが、邱は正確さに欠けるためこの用語の使用を控えた。[ 70 ]
紀元前221年に秦が他の中国諸国を征服し、秦王朝を建国した後、李斯宰 相の指揮の下、秦小篆が全国での使用のために標準化された。[ 71 ]秦の書記は小篆のみを使用し、後の書体は漢代初期に突然発明されたと伝統的に考えられていた。しかし、秦の書記は複数の書体を使用しており、直線的な俗体も統一戦争以前の数世紀にわたって秦で使用されていた。この書体の人気は、文字がより広く普及するにつれて高まった。[ 72 ]
戦国時代(紀元前475年頃~紀元前221年)までに、秦で発展した俗字を基にした未熟な書体(隶书;隸書; lìshū )が出現し、しばしば「初期書体」または「原書体」と呼ばれた。 [ 73 ]原書体は徐々に進化し、漢王朝(紀元前202年~紀元220年)までに、八分(bāfēn)とも呼ばれる成熟した形に達した。20世紀後半に発見された竹簡は、この成熟が漢の武帝(在位:紀元前141年~紀元前87年)の治世中に完了したことを示している。隶変(libian ;隸變)と呼ばれるこの過程には、文字の形が変化して簡略化され、多くの構成要素が統合、置換、または省略された。その結果、構成要素自体も、より少なく、より直線的で、より明確な線を使用するように標準化された。その結果、書道書体は、篆書体に見られるような絵画的な特徴をほとんど失っている。[ 74 ]
後漢時代中期( 西暦25~220年)頃、簡略化され読みやすい書体が現れ、邱はこれを「新隶体(新隸體、xīnlìtǐ )」と呼んだ。[ 75 ]漢代末期には、これが書記が使用する主要な書体となったが、石碑などの正式な作品には依然として書体が使用されていた。邱は新隶体を、書体と正書体の中間的な形態であり、三国時代(西暦220~280年)以降も使用され続けたと述べている。[ 76 ]
草書体(草书;草書; cǎoshū)は紀元前24年には既に使われており 、秦で生まれた俗語の要素と流れるような草書体の筆致を融合させたものでした。晋王朝(266~420年)の時代には、漢の草書体は章草(zhāngcǎo ; 「整然とした草書体」)として知られるようになり、英語では「clerical cursive」、「ancient cursive」、「draft cursive」などと呼ばれることもあります。この名前は、晋の時代に初めて登場し、半草書体や楷書体の影響を受けた後の形態である今草(jīncǎo ; 「現代の草書体」)よりも、この書体がより整然としていると考えられていたことに由来すると考える人もいます。この後期の形式は、王羲之(4世紀頃に活躍)のような人物の作品に代表され、王羲之は中国史上最も重要な書家とみなされることが多い。[ 77 ] [ 78 ]
半草書体(行書; xíngshū ; 「走る書体」 )の初期形態は後漢時代に確認でき、その発展は新聖職者の草書体から始まった。劉徳勝(劉徳勝; 2世紀頃活躍)は伝統的に半草書体の発明者として認められているが、このような功績はしばしば、その書体の初期の達人を指し示すものであり、初期の実践者を指すものではない。後の分析では、半草書体は劉の発明ではなく、大衆的な起源を持つことが示唆されている。[ 79 ]半草書体は、形式的な技法や構成の規則なしに、聖職者の書体がより速く書かれた結果の一部であると特徴づけることができる。聖職者の書体では個別の画となるものが、しばしば一体となって流れるように書かれている。半草書体は現代の筆記体で一般的に採用されている。[ 80 ]

楷書(楷书;楷書; kǎishū)は、書道体と草書体を基にした書体で、文字の書き方や印刷に用いられる主要な書体である。[ 81 ]その革新は、曹魏(現存220~266年)に生きた書家、鍾瑶に伝統的に帰せられており、彼はしばしば「楷書の父」と呼ばれている。[ 82 ]現存する最古の楷書は、鍾瑶の作品の写本であり、少なくとも1つの王羲之による写本も含まれている。楷書の特徴としては、横画の終わりに用いられる「頓」(dùn )技法や、下向き右向きの斜画の太い尾などが挙げられる。楷書は、王羲之とその息子、王献之の手によって、東晋時代(317~420年)にさらに発展した。[ 83 ]しかし、晋時代のほとんどの作家は、日常の文章では引き続き新書記体や半草書体を使用していた。楷書が主流になったのは、南北年間(420~589年)になってからである。 [ 84 ]隋王朝(581~618年)に確立された官吏登用のための科挙制度では、受験者は楷書体を用いた文語体で書くことが求められ、これが後の中国史を通じて両方の書体が普及する一因となった。[ 85 ]
テキストの各文字は、割り当てられた均一な正方形の中に書かれます。篆書から楷書への進化の一環として、文字の構成要素は、個別の画の連続として規則化されました(笔画;筆畫; bǐhuà)。[ 86 ]画は、手書きの基本単位と文字構成の基本単位の両方と考えることができます。楷書と楷書では、個々の画は、その技法と文字機能に応じて、伝統的に8つのカテゴリのいずれかに属します。永八原則として知られるものの中で、書家は、各タイプの1画で書くことができる文字永(yǒng ; '永遠' )を使用して技法を練習します。 [ 87 ]通常の筆記では、永は現在、8画ではなく5画で書かれ、5つの基本画タイプのシステムが分析で一般的に使用され、特定の複合画は、単一の動作で行われる基本画のシーケンスとして扱われます。[ 88 ]
文字は予測可能な視覚パターンに従って構成されます。一部の構成要素は、文字内の特定の位置を占めるときに独特の結合形を持ちます。たとえば、⼑(「ナイフ」)の構成要素は、文字の右側では刂として現れますが、文字の上部では⺈として現れます。 [ 89 ]構成要素が文字内で描かれる順序は固定されています。構成要素の画を描く順序も大部分は固定されていますが、いくつかの異なる基準によって異なる場合があります。[ 90 ] [ 91 ]これは実際にはいくつかの経験則でまとめられており、文字は一般的に左から右、次に上から下に組み立てられ、「囲む」構成要素は囲む構成要素より先に始まり、囲む構成要素より後に閉じられます。[ 92 ]たとえば、永は次の順序で描かれます。


文字の歴史の中で、異体字(異体字、異体字、yìtǐzì)はいくつかの過程を経て出現する。異体は構造が異なるが、同じ形態素を表しており、そのため、同じ基底文字の事例とみなすことができる。これは、視覚的に異なる二階建ての| a |と一階建ての| ɑ |がどちらもラテン文字⟨ A ⟩を表すのと似ている。異体は、美的理由、手書きを容易にするため、または書き手が文字の形の誤りだと認識したものを修正するためにも出現する。[ 93 ]個々の構成要素は、視覚的、音韻的、または意味的に類似した代替物に置き換えられることがある。[ 94 ]文字の構造とスタイルの境界、つまり、形が異なる文字を表しているのか、それとも単に同じ文字の異体字なのかは、しばしば些細なことではなく、不明瞭である。[ 95 ]
例えば、秦王朝以前は、「明るい」という意味の漢字は明または朙と書かれており、左側に日(「太陽」)または囧(「窓」)、右側に月(「月」)が書かれていました。秦王朝が中国全土で小篆書体を標準化する計画の一環として、朙の形が推奨されました。一部の書記はこれを無視し、明と書き続けました。しかし、朙の使用が増加すると、左側に目(「目」)がある第3の異形である眀が普及しました。これはおそらく朙の短縮形から派生したものです。最終的に、明が漢字の標準形となりました。[ 96 ]
最古の碑文から20世紀まで、テキストは一般的に縦書きで、文字は上から下へ右から左へ列状に書かれていました。単語の境界は通常、スペースで示されませんでした。文字を左から右へ上から下へ行状に書く横書きの方向は、西洋の影響により20世紀になって初めて中国語圏で主流になりました。[ 97 ]中国本土以外の多くの出版物では、伝統的な縦書きの方向が引き続き使用されています。[ 98 ]西洋の影響により、19世紀と20世紀には印刷物で句読点が広く採用されるようになりました。それ以前は、文脈が読者を導くのに十分であると考えられていました。これは、文字はより離散的な形状のため、スペースや句読点なしで書かれた場合でもアルファベットよりも読みやすいためです。 [ 99 ]

最も古い中国語の文字は、骨に彫られたり、儀式用の青銅器を鋳造するために使用された粘土の型にスタイラスで印が付けられたりした。文字は石に刻まれたり、絹、木、竹の切れ端に墨で書かれたりもした。筆記媒体として紙が発明されたの は西暦1世紀で、伝統的に蔡倫の功績とされている。[ 100 ]文字を書くことができる書体(書体)は数多くあり、篆書体や篆書体などの歴史的な形態も含まれる。中国語圏で使用されている書体のほとんどは中国で生まれたものだが、地域的な違いが見られる場合もある。中国以外で作られた書体は、その使用が地域限定的である傾向があり、これには日本の江戸文字やベトナムのlệnh thư文字が含まれる。[ 101 ]

書道は伝統的に中国の学者が習得すべき四大芸術の一つであり、思想や教えを表現する巧みな手段と考えられていました。中国の書道では、通常、墨と筆を使って文字を書きます。厳密な規則性は求められず、文字の形を強調することで様々な美的効果を生み出すことができます。[ 102 ]書道の美に関する伝統的な理想は、東アジア固有のより広範な哲学的概念と結びついていることがよくあります。例えば、美学は陰陽の枠組みを用いて概念化することができ、書道家は、速く書くかゆっくり書くか、墨を濃く塗るか薄く塗るか、対称的な形で書くか非対称的な形で書くか、具体的な概念を表す文字か抽象的な概念を表す文字かといった、相互に強化し合う多くの二元性の両極端のバランスをとります。[ 103 ]

木版印刷は6世紀から9世紀にかけて中国で発明され、[ 104 ]続いて11世紀に畢勝によって活版印刷が発明されました。 [ 105 ]明朝(1368~1644年)と清朝(1644~1912年)における印刷の使用の増加は、文字の形の大幅な標準化につながり、これは20世紀の後の文字改革の先駆けとなりました。 1716年の康熙字典に代表されるこの印刷正書法は、後に「古い文字の形」と呼ばれるようになりました。 [ 106 ]印刷された中国語の文字はさまざまな書体 を使用することがあり、[ 107 ]使用されている書体には大きく分けて4つの種類があります。[ 108 ]
ファックス機や中国語文字に適したビットマップディスプレイを備えたコンピュータが普及する以前は、電信機、タイプライター、コンピュータ端末などの最初のテキストベースの通信機器やワードプロセッシング機器はアルファベットのみをサポートし、モールス信号やASCIIなどのアルファベットテキストエンコーディングのみを使用していました。これらの技術を、数千もの異なる文字を使用する書き言葉のシステムに適合させることは容易ではありませんでした。[ 109 ] [ 110 ]

中国語の文字は、主に標準キーボードを使用してコンピュータに入力されます。多くの入力方法(IME)は音声入力であり、タイピストは北京語の場合はピンインやボポモフォ、広東語の場合は粤拼、日本語の場合はヘボン式などの方式に従って文字を入力します。たとえば、香港(' Hong Kong ' )xiang1gang3はピンインを使用して入力することも、粤拼を使用して入力することもできますhoeng1gong2。[ 111 ]
文字入力方法は、文字の形状と既存の手書き規則を使用して各文字に固有のコードを割り当て、入力速度を向上させる可能性のある、フォームベースの入力方法もあります。一般的なフォームベースの入力方法には、中国本土のWubiと、台湾と香港のCangjie (文字の発明者とされる神話上の人物にちなんで名付けられました)があります。 [ 111 ]多くの場合、予測可能な規則に従って、エンコードから不要な部分が省略されます。たとえば、疆(' border ' )は、 Cangjie方式を使用してとしてエンコードされNGMWM、これはコンポーネントに対応します。[ 112 ]弓土一田一
文脈上の制約は、候補文字の選択を改善するために使用できます。声調を無視すると、知道と直刀は両方とも と転写されますzhidao。システムは、文脈に基づいて、どちらの候補が最初に現れるかを優先する場合があります。[ 113 ]
中国語の文字には、普及以前に特別なテキストエンコーディングが導入されていましたが、Unicode 標準は世界中で主流のテキストエンコーディングです。[ 114 ] Unicode コンソーシアムの理念によれば、標準では各文字に番号が割り当てられますが、その外観や使用される特定のアログラフを指定するかどうかは、テキストをレンダリングするエンジンの選択です。[ E ] Unicode の基本多言語面(BMP) は、標準の 2 16 個の最小コードポイントを表します。これらのうち、20,992文字(または32 %)は、中国語の各文字体系で使用される文字を含むCJK統一漢字に割り当てられています。2025年に公開されたバージョン17.0の時点で、Unicodeは合計で102,998文字。[ F ]
文字は、古中国語として知られる中国語の歴史段階で初めて出現しました。ほとんどの文字は、元々独立した古中国語の単語として機能していた形態素に対応しています。[ 115 ]古典中国語は、紀元前5世紀頃から紀元後2世紀頃までの中国文学の古典作品で使用された中国語の書き言葉の形式です。[ 116 ]この言語の形式は、後の著者が話していた言語から乖離し始めたにもかかわらず、模倣されました。この後の形式は文語中国語と呼ばれ、20世紀まで中国で支配的な書き言葉であり続けました。中国語圏でのその使用は、前近代ヨーロッパにおけるラテン語の使用と大まかに類似していました。 [ 117 ]文語中国語は時間の経過とともに静的ではありませんでしたが、話し言葉の古中国語の多くの特性を保持していました。地域の話し言葉の口語に影響され、テキストは地域によって異なる文学的および口語的な読み方を使用して声に出して読まれました。 [ 118 ]時が経つにつれ、音の融合によって、より多くの単語が同音異義語になったため、日常会話に曖昧さが生じました。この曖昧さは、多くの場合、多音節の複合語の導入によって軽減されました。[ 119 ]これらは、現代中国語の語彙の大部分を構成しています。[ 120 ] [ 121 ]
時が経つにつれ、文語中国語の使用はベトナム、韓国、日本を含む近隣諸国に広まった。中国文化の他の側面とともに、現地のエリートは記録、歴史、公式の通信のために文字を採用した。[ 122 ]後者2つが共通の祖先を持つという一部の言語学者の仮説を除けば、中国語、ベトナム語、韓国語、日本語はそれぞれ異なる語族に属し、[ 123 ]互いに異なる機能を持つ傾向がある。非中国語話者が文語中国語のテキストを母語で解釈できるように読解システムが考案されたが、この現象は、二言語併用の一形態、注釈による読解、[ 124 ]または中国語への翻訳と中国語からの翻訳のプロセスとして様々に説明されている。アルファベットや音節文字を使用して書く他の伝統と比較すると、この文脈で発展した文学文化は特定の話し言葉に直接結びついていなかった。これは、言語間の交流現象であるブラシトークによって例示される。ブラシトークでは、相互の読み書き能力によって、異なる言語を話す人々が対面での会話を行うことが可能になった。[ 125 ] [ 126 ]
文語中国語の導入後、漢字は後に、中国語圏全体で話されている多くの非中国語の言語を表記するために適応されました。これらの新しい表記体系は、各言語が中国語から借用した多数の借用語と、中国語から借用した語彙の両方を表記するために漢字を使用しました。これらの借用語はまとめて「漢語語彙」と呼ばれます。漢字には、固有読み、漢語読み、またはその両方がある場合があります。[ 127 ]中国語圏全体で漢語語彙を比較することは、中期中国語の音韻論の再構築に役立っています。[ 128 ]文語中国語は、紀元前111年に始まった中国の千年統治の間、ベトナムで使用されました 。15世紀までに、ベトナム語を表記するために漢字を適応させたチュノム と呼ばれる体系が完全に成熟しました。[ 129 ]紀元前2世紀は、朝鮮に文字が導入された最も早い時期です。国内で現存する最古の写本は西暦5世紀初頭に遡る。また、5世紀には文字が朝鮮から日本に伝わった。[ 130 ] 6世紀までには、漢字は朝鮮語と日本語の両方の表記に使われるようになった。[ 131 ] 20世紀後半までには、漢字はベトナム語と韓国語の表記用に考案されたアルファベットにほぼ置き換えられた。そのため、中国語以外の主要な言語で、漢字を使って表記されるのは日本語だけとなった。[ 132 ]

古典中国語の単語は一般的に一文字の長さでした。[ 134 ]古典中国語のテキストで使用される語彙の推定25~30%は二文字の単語で構成されています。[ 135 ]時が経つにつれて、同音異義語の数を増やす音韻変化によって、中国語の口語に多音節の語彙が導入されました。 [ 136 ]古典期以降の中国語の単語形成で最も一般的なプロセスは、既存の単語の複合語を作成することです。単語は、単語に接辞を付けたり、畳語にしたり、他の言語から単語を借用したりすることによっても作成されました。[ 137 ]多音節の単語は一般的に音節ごとに一文字で書かれますが、省略形が使用されることもあります。[ 138 ]例えば、二十( èrshí ; ' 20 ' )は縮約形の廿と書かれることがあります。[ 139 ]
時として、異なる形態素が同じ形の文字で表されることがあります。例えば、「行」は「道」(xíng)または「列」(háng)の拡張された意味を表す可能性があります。これらの形態素は、発音は異なるものの同じ文字で表記される同族語です。しかし、邱は意味拡張以外のプロセスによって生じる、同じ形でありながら意味が異なる文字を説明するために同形異義語という用語を留保しました。同形異義語の例として「铊;鉈」があり、これは元々「製鉄所で使用される重さ」(tuó)を意味していました。20世紀に、この文字は「タリウム」(tā)という意味で再び作られました。これらの文字はどちらも、意味要素として⾦(「金」)、音要素として它を持つ音意味複合語ですが、それぞれが表す単語は関連していません。[ 140 ]
標準的な中国語の書き言葉では使われていないが、他の話し言葉の語彙を反映した「方言文字」(方言字; fāngyánzì)が数多く存在する。標準中国語以外の変種に基づく正書法の最も完全な例は、書き言葉の広東語である。一般的な広東語の文字は冇(mou5 ; 「持っていない」)で、有(jau5 ; 「持っている」)から2画を取り除いて作られる。[ 141 ]明らかな同族語が存在する場合、中国語の方言でこれまで書かれていなかった単語を標準文字で転写するのが一般的である。不規則な音の変化、意味のずれ、または中国語以外の言語に由来するなどの要因により明らかな同族語が存在しない場合、単語を転写するために文字が借用または発明されることが多い。これはその場しのぎの場合もあれば、既存の原則に従う場合もある。[ 142 ]これらの新しい文字は一般的に音と意味の複合語である。[ 143 ]
日本語では、中国語の文字は漢字と呼ばれます。奈良時代(710~794年)には、漢字(日本語では文語体)の読み手と書き手は、訓読と呼ばれる読み方と注釈の体系を利用し始めました。日本語話者は、読む際に文語体の構文と語彙を日本語の同等の表現に合うように調整しました。書く際には基本的にこの過程の逆が行われ、通常の文語体が生まれました。[ 144 ]日本語に書き写す際には、漢字は中国語から借用された漢字と、それに対応する日本語固有の同義語の両方を表すために使用されました。ほとんどの漢字は両方の借用過程を経たため、結果として漢字の読み方と漢字固有の読み方の両方があり、それぞれ音読みと訓読みと呼ばれています。さらに、漢字はどちらの読み方にも複数の読み方を持つ場合があります。異なる種類の音読みが、異なる時期に中国語の異なる方言から日本語に借用されました。[ 145 ]
日本語の表記体系は混合文字であり、形態素ではなくモーラと呼ばれる音節を表すために仮名と呼ばれる音節文字も取り入れています。明治時代(1868~1912年)以前は、万用仮名と呼ばれる体系で、特定の漢字を用いて音価を表していました。9世紀以降、特定の万用仮名が簡略化され、ひらがなとカタカナという2つの異なる音節文字が作られ、徐々に以前の表記法に取って代わりました。現代日本語では、ほとんどの語幹を表すのに漢字が使われていますが、文法的な接辞、助詞、外来語には一般的に仮名が使われています。ひらがなとカタカナの形は、簡略化の方法が異なるため、視覚的に区別されます。カタカナは各万葉仮名のより小さな構成要素から派生したのに対し、ひらがなは万葉仮名の草書体全体から派生しました。さらに、一部のモーラのひらがなとカタカナは、異なる万葉仮名から派生しました。[ 146 ]日本語で使用するために考案された文字は国字と呼ばれます。国字を作成するために使用された方法は、中国語由来の文字で使用される方法と同じですが、ほとんどは表意文字の複合です。たとえば、峠(とげ)は、山(山)、上(上)、下(下)からなる複合国字です。[ 147 ]
中国語の表記に使われる文字は単音節だが、多くの漢字は複数の音節の読み方を持つ。例えば、漢字「刀」は、本来の訓読みは「katana」である。文脈によっては、中国語からの借用語「日本刀(にほんとう)」のように、音読みの「とう」で読むこともあり、その発音は借用当時の中国語の発音に対応する。カタカナが広く採用される以前は、借用語は通常、その音節に対応する音読みを持つ無関係な漢字で表記されていた。こうした表記は当て字と呼ばれ、例えば「亜米利加( Amerika )」は「America」の当て字表記であり、現在は「アメリカ」と表記されている。発音のためだけに用いられる万葉仮名とは異なり、当て字は依然として特定の日本語の単語に対応していた。一部は現在も使用されており、常用漢字の公式リストには106の当て字読みが含まれている。[ 148 ]

韓国語では、漢字は「ハンジャ」と呼ばれます。文語中国語は紀元前2世紀にはすでに韓国で書かれていた可能性があります 。韓国の三国時代( 紀元前57年~紀元後668年)には、漢字は、主に漢語の語彙を用いた朝鮮語文学の一形態である「イドゥ」を書くためにも使用されました。高麗時代(918年~1392年)には、韓国の作家は文語中国語の発音表記体系である「クギョル」を開発しました。これは日本の「クンドク」に相当しますが、広く使用されるようになったのは朝鮮時代後期(1392年~1897年)になってからです。[ 149 ]ハングル文字は1443年に朝鮮王朝の世宗大王によって発明されましたが、韓国の文人たちには採用されず、19世紀後半まで文語中国語の注釈にのみ使用されるにとどまりました。[ 150 ]
韓国語の語彙の多くは中国語からの借用語で構成されており、特に専門用語や学術用語にその傾向が顕著である。[ 151 ]漢字は通常、この漢語語彙の表記にのみ用いられていたが、口語的な読み方が用いられたという証拠もある。[ 128 ]他の口語体と比較すると、韓国語の単語を表記するために考案された文字はごくわずかであり、これらは国字と呼ばれる。[ 152 ] 19世紀後半から20世紀初頭にかけて、韓国語はハングルと漢字の混合文字、またはハングルのみを用いて表記されていた。[ 153 ] 1945年に大日本帝国による朝鮮の占領が終結すると、国語と文化のより広範な「浄化運動」の一環として、国中で漢字をハングルに完全に置き換えることが提唱された。[ 154 ]しかし、韓国語の話し言葉には声調がないため、ハングル表記が同じ同音異義語の漢字語が多数存在します。例えば、기사 ( gisa ) の音声辞書のエントリには 30 種類以上のエントリがあります。この曖昧さは、歴史的には関連する漢字も併記することで解消されてきました。漢字は今でも漢字語の語彙に使われることがありますが、韓国語の固有語が漢字で書かれることははるかに稀です。[ 155 ]韓国の学習者は新しい漢字を学ぶ際、それぞれの漢字を漢字の発音と韓国語の同義語の両方と関連付けるように指導されます。[ 156 ]例:

ベトナム語では、漢字はchữ Hán ( 𡨸漢)、chữ Nho ( 𡨸儒、「儒教の文字」)、またはHán tự (漢字) と呼ばれます。 文語中国語は、近代までベトナムのすべての正式な文書に使用され、 1010 年に初めて公的な地位を獲得しました。 [ 157 ]ベトナムの著者が書いた文語中国語は、10 世紀後半に初めて確認されていますが、現地での書き方の習慣は数世紀も前からあったと考えられます。[ 158 ] chữ Nôm ( 𡨸喃)と呼ばれるベトナム語の文字は、1209 年に仏塔の跡地に作られた碑文で初めて確認されています。[ 159 ]成熟したchữ Nômの文字は、おそらく 13 世紀までに出現し、最初はベトナムの民話の記録に使用されました。チュノム文字の中には、ベトナム語の発音音節に対応する音意味複合語があります。[ 160 ]中国には同等の技術がない別の手法として、2つの音素要素を使用してチュノム複合語が作成されました。これは、ベトナム語の音韻体系には中国語にはない子音クラスターが含まれており、そのため借用文字の音価では近似が不十分だったためです。複合語は、クラスターを指定するために2つの異なる子音を持つ要素を使用しました。たとえば、𢁋 ( blăng ; [ d ] 「月」) は巴( ba )と陵( lăng )の複合語として作成されました。[ 162 ]体系として、チュノムは非常に複雑で、ベトナム人の識字率は5%を超えることはありませんでした。[ 163 ]文語中国語とチュノムはどちらもフランス植民地時代に使用されなくなり、徐々にラテン文字に基づくベトナム語アルファベットに置き換えられました。 1954年の植民地支配の終焉後、ベトナム語アルファベットはベトナムにおける唯一の公式な文字体系となり、ベトナム語メディアでのみ使用されている。[ 164 ]
中国南部および南西部の少数民族言語のいくつかは、借用文字と現地で作成された文字の両方を使用した文字体系で書かれてきました。これらのうち最もよく記録されているのは、広西チワン族自治区のチワン族語の鑼字です。その初期の発展についてはほとんど知られていませんが、チワン族の口語表記の伝統は、おそらく唐王朝(618~907年)に初めて出現しました。現代の研究では、鑼字は、地域的な特徴を維持しながら互いに影響し合ってきた地域的伝統のネットワークであると特徴づけられています。[ 165 ]ベトナム語と同様に、チワン族の発明文字の中には、子音クラスターを主に記述することを目的としたものではないものの、表音と表音を組み合わせたものがあります。[ 166 ]中国政府はラテン文字に基づくチワン族アルファベットへの置き換えを奨励していますが、鑼字は依然として使用されています。[ 167 ]歴史的に漢字で書かれてきた中国の他の非シナ語には、ミャオ語、ヤオ語、ブイ語、バイ語、ハニ語などがあります。これらは現在、それぞれの言語で使用するために設計されたラテン文字を基にしたアルファベットで表記されています。[ 168 ]

10 世紀から 13 世紀にかけて、中国北部の非漢民族によって建国された王朝も、漢字に触発された独自の文字体系を自らの言語用に作成したが、漢字を直接使用することはなかった。これには契丹大文字、契丹小文字、タングート文字、女真文字などがある。[ 169 ]これは他の文脈でも起こっている。女書はヤオ族の女性が湘南吐話を書くために使用した文字体系であり、[ 170 ]ボポモフォ(注音記号;注音符號; zhùyīn fúhào)は標準中国語の音を表すために 1907 年に初めて考案された半音節文字である。 [ 171 ] [ 172 ]どちらも漢字から図式的に派生した形を使用している。中国国内には、一部の文字を借用しているものの、それ以外は異なる文字体系が他にもあり、ナシ語の表記に用いられるゲバ文字、スイ語の文字、イ族の文字、リス語の文字などが挙げられる。[ 169 ]
中国語の文字は、中国語以外の言語の音を表記するために、音韻的に再利用されてきた。例えば、中世から現存する13世紀の『モンゴル秘史』の唯一の写本では、モンゴル語を表記するためにこのような文字が使われている。[ 173 ]
文字で書かれた言語の読み書き能力を習得するには、数千もの異なる文字を暗記する必要があるが、これは表音文字で使用される文字の数が比較的少ないこととは対照的である。[ 174 ]歴史的に、文字の読み書き能力は、6世紀の『千字経』や13世紀の『三字経』[ 175 ]、宋代の『百家姓』[ 176 ]などの中国語入門書や姓辞典を通して習得されることが多かった。中国語の読み書き能力に関する研究によると、読み書き能力のある人は一般的に3,000字から4,000字の語彙を活発に使いこなしており、文学や歴史などの分野の専門家の場合は、5,000字から6,000字になる可能性がある。[ 177 ]

中国本土、台湾、香港、日本、韓国の資料の分析によると、現代の語彙に含まれる文字の総数は約15,000 . [ 178 ]中国語の漢字を索引付けし、辞書に並べるための方法は数十種類考案されているが、広く普及したものは比較的少ない。漢字は、意味、視覚的構造、発音に基づく方法に従って並べられることがある。[ 179 ]
『爾雅』(紀元前3世紀 頃)は、漢字の意味に基づいて中国語の語彙を19のセクションに整理し、そのうち3つは日常語彙を扱い、残りの16はそれぞれ特定のトピックに関連する専門用語に充てられた。[ 180 ]『説文解子』(紀元100 年頃)は、最終的に後の漢字辞典で主流となる整理方法を導入した。この方法では、漢字は部首(bùshǒu、「セクションの見出し」)と呼ばれる視覚的に目立つ特定の要素に従ってグループ化される。『説文解子』は540の部首のシステムを使用したが、その後の辞典では一般的にそれより少ない部首が使用されている。[ 181 ] 214の康熙部首のセットは『康熙辞典』 (1716年)によって普及したが、元々はそれ以前の『字会』(1615年)に登場した。[ 182 ]漢字辞典は歴史的に部首と画数による分類で索引付けされており、漢字は部首ごとにグループ化され、各グループ内で画数ごとにソートされています。現代の辞典の中には、漢字のエントリーをピンイン表記に従ってアルファベット順に並べ、伝統的な部首に基づく索引も提供しているものがあります。[ 183 ]
中国語のローマ字表記システムが発明される以前は、文字の発音は韻律辞典によって伝えられていました。これらの辞典では、反切(逆切り)方式が用いられ、各項目には、問題の文字と同じ頭音を持つ一般的な文字と、同じ末音を持つ一般的な文字が並んで記載されていました。[ 184 ]
神経言語学者は、機能的磁気共鳴画像法(fMRI)を用いて、識字能力に関連する脳活動を研究してきた。音声体系と比較して、文字による読み書きには、視覚処理に関連する領域を含む、脳のより多くの領域が関与する。[ 185 ]文字の識字に必要な記憶レベルは高いが、文字の大部分を占める複合語の音韻的要素と意味的要素の識別も、読解において重要な役割を果たす。特定の文字の認識の容易さは、その構成要素の位置の規則性、および特定の音声を示す音韻的要素の信頼性によって影響を受ける。[ 186 ]さらに、中国語には同音異義語が多く、文字と音声の対応関係がより不規則であることから、中国語の識字能力を持つ話者にとって、正書法の知識が音声認識においてより大きな役割を果たしていることが示唆されている。[ 187 ]
文字ベースの言語の読者における発達性ディスレクシアは、独立した視空間障害と音韻障害が同時に発生することを伴うようです。これは、音声表記法で経験されるディスレクシアとは異なる現象であると思われます。音声表記法のディスレクシアは、前述の障害のうちの1つだけが原因で発生する可能性があります。[ 188 ]

文字の形、筆順、発音など、文字の使用を改革し標準化しようとする試みは、歴史を通じて各国で行われてきた。1950年代から1960年代にかけて、中国本土では数千の簡体字が標準化され採用されたが、そのほとんどは既に一般的な異体字として存在していたか、構成要素を体系的に簡略化することによって作成されたものである。[ 190 ]第二次世界大戦後、日本政府も数百の文字を簡略化したが、その中には中国で採用されたものとは異なる簡略化も含まれている。[ 191 ]簡略化されていない正統的な文字は、繁体字と呼ばれる。中国語圏の政治体では、中国本土、マレーシア、シンガポールは簡体字を使用し、台湾、香港、マカオは繁体字を使用している。[ 192 ]一般的に、中国語話者と日本語話者は、3つの標準の文字すべてを正しく識別できる。[ 193 ]
20世紀以前の改革は概して保守的で、簡体字の使用を減らすことを目指していた。[ 194 ] 19世紀後半から20世紀初頭にかけて、中国の知識人の間で、中国語の文字体系と国民的な話し言葉の欠如の両方が、国の近代化の成功に必要な識字率の向上と相互理解の実現を阻害する深刻な障害であると考える人が増えていった。多くの人が、文語中国語をより話し言葉に近い書き言葉に置き換えること、文字の形式を大幅に簡略化すること、あるいは特定の話し言葉に合わせたアルファベットで文字を完全に置き換えることを提唱し始めた。1909年、教育者で言語学者の魯飛奎が、教育における簡体字の採用を初めて正式に提案した。[ 195 ]
1911年、辛亥革命により清朝が倒され、翌年には中華民国が樹立された。中華民国初期(1912年~1949年)は、社会政治的な不満の高まりが特徴で、1919年の五四運動へと発展し、その後数十年にわたり文語中国語が口語中国語に取って代わられるきっかけとなった。この口語中国語は、対応する話し言葉の標準中国語と並んで、魯迅や胡適などの知識人や作家によって推進された。[ 196 ]これは北京方言の北京語[ 197 ]と、西遊記(1592年頃)や紅楼夢(18世紀半ば)などの古典小説を含む、それまでの数世紀にわたって書かれた口語文学の既存の体系に基づいていた。[ 198 ]この頃、漢字の簡略化と表音表記については、与党である国民党(KMT)と対立する中国共産党(CCP)の両方で議論されていた。1935年、共和政府は北京大学の銭宣通教授がまとめた324字からなる最初の公式簡体字リストを発表した。しかし、党内の強い反対により、このリストは1936年に撤回された。[ 199 ]


中国における文字改革プロジェクトは最終的に共産党に引き継がれ、 1949年の中華人民共和国建国宣言後、その作業が再開された。1951年、周恩来首相は文字改革委員会の設置を命じ、その小委員会は簡体字化とアルファベット化の両方を調査することになった。簡体字化小委員会は翌年、簡体字の調査と照合を開始し[ 200 ] 、最終的に1956年に簡体字と構成要素の草案を発表した。1958年、周恩来は、同年先に導入された漢語ピンインによる漢字の置き換えではなく、簡体字化に重点を置くという政府の意向を発表した[ 201 ] 。 1956年の草案は、改訂されたリストによってほぼ承認された。1964年に公布された2235文字。 [ 202 ]これらの文字の大部分は、慣習的な略字や画数の少ない古代の形から取られたものである。 [ 203 ]委員会はまた、いくつかの形を統合することによって、使用されている文字の総数を削減しようとした。 [ 203 ]例えば、雲(「雲」)は甲骨文字では云と書かれていた。より単純な形は「言う」という意味の借字として使用され続けたが、元の「雲」の意味では、意味的な⾬(「雨」)要素を追加した形に置き換えられた。これら2つの文字の簡体字は云に統合された。 [ 204 ]
1977年に第二版の簡体字が公布されたが、国民の反応は悪く、すぐに公式な使用から外れた。最終的に1986年に正式に廃止された。[ 205 ]第二版の簡体字が不評だった大きな理由は、第一版の大部分を占めていた馴染みのある異体字とは対照的に、ほとんどが全く新しい形だったからである。[ 206 ]第二版の廃止により、さらなる文字簡体化に向けた取り組みはほぼ終結した。[ 207 ] 1988年に『現代中国語一般使用文字表』が出版され、簡体字と非簡体字合わせて7000字。これらのうち半分は、改訂版「現代中国語でよく使われる文字一覧」にも含まれており、2500の一般的な文字とあまり一般的でない文字1000 字。[ 208 ] 2013 年に、 1988 年のリストの改訂版として、よく使われる標準中国語文字のリストが発行されました。これには合計 1000 字が含まれています。8105文字。[ 209 ]

第二次世界大戦後、日本政府は独自の正書法改革プログラムを実施しました。一部の文字には新字体と呼ばれる簡略化された形が割り当てられ、古い形は旧字体とされました。異なる異体形の不統一な使用は推奨されず、各学年で生徒に教える文字のリストが作成されました。その最初のものは1850文字の東洋漢字リストは1946年に出版され、後に1945文字の常用漢字リストは1981年に作成されました。2010年には常用漢字が拡張され、合計で2136文字。[ 210 ] [ 211 ]日本政府は、名前に使用できる文字を常用漢字と、歴史的に名前に広く使われている人名用漢字983字のリストに限定している。[ 212 ] [ 213 ]
韓国では漢字が日本で使われているほどではないものの、現在でも漢字が使われています。一般的に、日常的な場面ではハングルのみを使用する傾向が見られます。[ 214 ]地名、新聞、同音異義語の区別などには漢字が使われています。また、書道にも使われています。教育における漢字の使用は政治的に議論の的となっており、カリキュラムにおける漢字の重要性に関する公式方針は、韓国の独立以来、揺れ動いてきました。[ 215 ] [ 216 ]漢字の完全廃止を支持する人もいれば、1970年代や1980年代に見られたレベルまで使用を増やすことを提唱する人もいます。現在、7年生から12年生の生徒は、簡単な認識と新聞を読むのに十分な識字能力の習得に重点を置いて指導を受けています。[ 150 ]韓国教育省は1972年に「教育用基本漢字」を出版し、中学生が学習することを目的とした1800文字。 [ 217 ] 1991年、韓国最高裁判所は人名用漢字表(人名用漢字;Inmyeong-yong Hanja )を公表し、当初は2854文字。[ 218 ]このリストはその後何度か拡張されており、2022年現在これには以下が含まれます8319文字。[ 219 ]
建国後、北朝鮮政府は標準的な表記における漢字の使用を排除しようと努め、1949年までに北朝鮮の出版物では漢字はほぼ完全にハングルに置き換えられた。[ 220 ]漢字は表記ではほとんど使われなくなったものの、北朝鮮の教育において重要な部分を占めている。1971年の大学の歴史学科の教科書には、3323種類の文字があり、1990年代の北朝鮮の小学生は依然として2000文字。[ 221 ] 2013年の教科書は、中等教育における漢字の使用を統合しているようだ。[ 222 ]北朝鮮の生徒は、約2000文字を学習していると推定されている。大学卒業までに3000字の漢字を習得する。 [ 223 ]
台湾の教育部が1982年に発行した「共通国語標準形一覧表」には、4808の伝統的な文字。[ 224 ]教育部は台湾語と客家語で使用される文字の辞書も編纂している。[ G ]
シンガポール教育省は3回連続で簡略化を公布した。1969年の第1ラウンドでは502の簡略化文字が、1974年の第2ラウンドでは簡体字は2287文字あり、そのうち49文字は中華人民共和国のものとは異なり、1976年の最終段階で最終的に削除されました。1993年、シンガポールは1986年に中国本土で行われた改訂を採用しました。[ 225 ]
香港教育人材局の「よく使われる中国語文字の字形一覧」には、小学校および中学校教育で使用される伝統的な文字は4762文字である。 [ 226 ]