| 倉頡入力方式 | |||||||||||||||||||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
![]() 「倉頡輸入法」(倉頡法)の繁体字表記 | |||||||||||||||||||||||||||
| 繁体字中国語 | 倉頡輸入法 | ||||||||||||||||||||||||||
| 中国語(簡体字) | 颉输入法 | ||||||||||||||||||||||||||
| |||||||||||||||||||||||||||
倉頡入力方式(Tsang-chieh入力方式、Changjie、Cang Jie、Changjei [1]またはChongkitとも呼ばれる)は、標準的なコンピュータキーボードを使用してコンピュータに中国語の文字を入力するシステムです。ファイル名などでは、Cangjieという名前はcjと省略されることがあります。
この入力方式は1976年に朱鳳凰によって発明され、台湾の元国防大臣である蒋衛国の提案により、中国語の表記体系を発明した伝説上の人物、蒼頡にちなんで名付けられました。朱鳳凰は、この方式は中国の文化遺産に属するべきだと考え、1982年に蒼頡の特許をリリースしました。[2]そのため、蒼頡はオープンソースソフトウェアとなり、繁体字中国語をサポートするすべてのコンピュータシステムに搭載されており、簡体字中国語の文字セットと互換性があるように拡張されています。

倉頡はQWERTYキーボードを使用する最初の中国語入力方式です。ChuはQWERTYキーボードが国際標準になったことを知り、中国語入力はQWERTYキーボードに基づく必要があると考えました。[3]その他の初期の方式では、数字キーのみを使用する四隅方式を除き、40〜2400個のキーを備えた大型キーボードが使用されています。
拼音入力方式とは異なり、倉頡は文字のグラフィカルな側面に基づいています。各グラフィカル ユニットは「部首」と呼ばれ (康熙部首と混同しないでください)、合計 24 個の基本文字コンポーネントによって親付けされ、それぞれが標準QWERTYキーボードの特定の文字キーにマップされます。追加の「難しい文字」機能は、X キーにマップされます。キーは、学習と記憶を容易にするために 4 つのグループに分類されます。中国語の文字へのコードの割り当ては、文字を構成する「部首」を分離することによって行われます。
概要
キーと「ラジカル」
倉頡の基本的な文字構成要素は「部首」(字根)または「文字」(字母)と呼ばれます。部首は 24 個ですが、キーは 26 個あります。24 個の部首(基本 字形)は、約 76 個の補助字形(輔助字形)に関連付けられており、多くの場合、補助字形は基本字形の構成要素の回転または転置バージョンです。たとえば、文字 A(日)は、それ自体、わずかに幅広の「曰」、またはそれ自体の 90 度回転のいずれかを表すことができます。(以下に挙げたものよりも完全な 76 個の転置と回転の説明については、中国語 Wikibooks の倉頡の項目を参照してください。)
24 個のキーは 4 つのグループに分かれています。
- 哲学グループ — 文字「A」から「G」に対応し、太陽、月、五大元素を表します。
- ストロークグループ - 文字「H」から「N」に対応し、短く繊細なストロークを表します。
- 身体関連グループ - 文字「O」から「R」に対応し、人体のさまざまな部分を表します。
- 図形グループ - 文字「S」から「Y」に対応し、複雑で囲まれた文字の形を表します。
倉頡法の各バージョンでは、倉頡部首の補助形が若干異なります。そのため、倉頡法の異なるバージョンが完全に互換性がない理由の 1 つとなっています。
朱鳳凰は、文字の特性に応じていくつかの文字に別名を与えています。たとえば、H (竹) は斜とも呼ばれ、これは傾斜を意味します。名前は韻を踏んでおり、学習者が文字を暗記するのに役立ちます。各グループは一列に並んでいます (最後の文字の音は括弧内に記載されています)。
- 日月 金木水火土; tǔ
- 斜 點交 叉鸱橫鈎; gōu
- 人心 手口
- 側 並 仰紐 方 卜; bǔ
キーボードレイアウト

基本ルール
タイピストは、文字を分析して倉頡コードに到達する方法を定義する いくつかの分解規則 (拆字規則) に精通している必要があります。
- 分解の方向: 左から右、上から下、外側から内側
- 幾何学的に接続された形式:4つの倉頡コード、すなわち第1、第2、第3、最後のコードを取る
- 2 つのサブフォームに分解できる幾何学的に接続されていないフォーム (例:你): 分解規則の方向に従って、幾何学的に接続された 2 つのサブフォーム (つまり、人および尔) を識別し、最初のサブフォームの最初と最後のコードと、2 番目のサブフォームの最初、2 番目、最後のコードを取得します。
- 幾何学的につながっていないフォームで、複数のサブフォームに分解できるもの(例:謝):分解規則の方向に従って、最初の幾何学的につながったサブフォーム(すなわち、言)を特定し、そのフォームの最初と最後のコードを取得します。次に、残り(すなわち、射)をサブフォーム(すなわち、身と寸)に分解し、最初のサブフォームの最初と最後のコードと、最後のサブフォームの最後のコードを取得します。
ルールはさまざまな原則に従います:
- 簡潔性(精簡) - 複数の分解方法が可能な場合は、より短い分解が正しいとみなされます。
- 完全性(完整) - 同じ長さのコードで複数の分解方法が可能な場合、より複雑な形式を最初に識別する方法が正しい分解です。
- 部首の形の反映(字型特徵) - 分解は部首の形を反映する必要があります。つまり、(a) 同じコードを 2 回以上使用することは可能な限り避け、(b) 文字の形は形の角で「カット」しないでください。
- コード
の省略
- 部分省略- 完全な分解におけるコード数が許可されたコード数を超える場合、余分なコードは無視されます。
- 包含省略- 分解する文字の一部が囲み文字である場合に、囲み部分の形状のみを分解し、囲み文字を省略する。
例
- 車; chē ; '乗り物'
- この文字は幾何学的に連結されており、単一の垂直構造で構成されているため、上から下の順に最初の、2番目、最後の蒼頡コードを取ります。
- したがって、 Cangjie コードは十田十 (JWJ) となり、 この例のコードの基本形状に対応します。
- 謝; xiè ; 「感謝する」、「枯れる」
- この文字は、水平に並べられた幾何学的につながっていない部分で構成されています。最初の分解では、これを「言」と「射」の2 つの部分として扱います。
- 最初の部分「言」は、幾何学的に上から下までつながっていません。最初の部分(亠、卜Yの補助形)と最後の部分(口、口Rの基本形)を取って、卜口(YR)に到達します。
- 2 番目の部分も幾何学的につながっておらず、水平に配置されています。2 つの部分は身と寸法です。
- この2番目の部分の最初の部分である身には、最初と最後のコードを使用します。どちらも斜めなのでHです。したがって、最初と最後のコードは竹竹 (HH)です。
- 元の2番目の部分である寸については、最後の部分のみを取ります。これは幾何学的につながっておらず、2つの部分で構成されているため、最初の部分は外側の形状で、2番目の部分は中央の点です。点はIなので、最後のコードは戈(I)です。
- したがって、滄街コードは卜口(YR)竹竹(HH)戈( I )、または卜口竹竹戈(YRHHI)となります。
- 謝(謝の簡体字)
- この例は、最初の部分が「讠」であることを除いて、上の例と同じです。最初と最後のコードは「戈(I)」と「女(V)」です。
- 上記の例と同じ手順を繰り返すと、戈女 ( IV)竹竹 (HH)戈( I )、または戈女竹竹戈(IVHHI)が得られます。
例外
一部のフォームは、ルールでこのように分解すべきとされているかどうかに関係なく、常に同じ方法で分解されます。このような例外の数は少ないです。
いくつかのフォームは分解できません。それらはCangjieキーボードの難キーであるXで表されます。 [4]
初期の開発
当初、Cangjie 入力方式は、任意の文字セットの文字を生成することを意図していませんでした。代わりに、Cangjie 入力規則と Cangjieコントローラ ボードで構成される統合システムの一部でした。このコントローラ ボードには、文字出力時にApple IIの高解像度グラフィック モードを使用して、Cangjie コードから中国語の文字を動的に生成する文字生成 ファームウェアが含まれています。Cangjie ユーザー マニュアルの序文で、Chu Bong-Foo は1982 年に次のように書いています。
[翻訳中]
出力に関して言えば、出力と入力は実際には統合された全体を形成しており、2つの異なる機能に教条的に分離する理由はありません。…これは実際に必要です。…
この初期のシステムでは、たとえばユーザーが中国語の文字「文」を取得するために「yk」と入力すると、Cangjie コードは文字エンコードに変換されず、実際の文字列「yk」が保存されます。各文字の Cangjie コード (1 から 5 個の小文字とスペースの文字列) は、その特定の文字のエンコード でした。
この初期のシステムの特別な「特徴」は、ランダムな小文字の単語を送信すると、文字ジェネレータが倉頡分解規則に従って中国語の文字を生成しようとすることです。このため、奇妙で未知の文字が現れることがあります。この意図しない機能である「文字の自動生成」はマニュアルに記載されており、システムが処理できる 15,000 文字のうち 10,000 文字以上を生成する役割を果たしています。新しい文字の作成を連想させる倉頡という名前は、まさにこの初期の倉頡にぴったりでした。
統合文字ジェネレーターの存在は、分解衝突の曖昧さを解消するために使用される「X」キーの存在の歴史的必要性も説明しています。コードが「出力される」ときに文字が「選択される」ため、表示できるすべての文字は実際には一意の蒼頡分解を持っている必要があります。ランダムなテキスト ファイルが表示されるときにシステムが候補文字の選択肢を提供することは意味がなく、実用的ではありません。ユーザーはどの候補が正しいかわからないためです。
問題
倉頡は、中国のコンピューターの利用を促進するために、使いやすいシステムとして設計されました。しかし、多くのユーザーは、説明が不十分なために多くの問題が生じ、倉頡の習得と使用が難しいと感じています。[引用が必要]
認識された困難
- 倉頡を使って入力するには、部首の名前と助字の両方の知識が必要です。コンピューター ユーザーのモニターに、倉頡の部首と助字の表が貼り付けられているのをよく見かけます。
- また、分解ルールにも精通している必要があります。分解ルールを知らないと、意図した文字を入力するのが難しくなります。
- ユーザーは、書き方を忘れてしまった文字を入力することができません (音声ベース以外のすべての入力方法で問題になります)。
十分に練習すれば、ユーザーは上記の問題を克服できます。典型的なタッチタイピストは、補助図形のリストや分解規則を覚えるのが難しいにもかかわらず、Cangjie を使用して 1 分あたり 25 文字 (cpm) 以上の速度で中国語を入力できます。経験豊富な Cangjie タイピストは、60 cpm から 200 cpm を超えるタイピング速度を達成できると言われています。[引用が必要]
1990年に台東の龍田小学校で教師を務めた陳民正氏によると、児童の平均的なタイピング速度は1分間に90語で、中には1分間に130語以上に達する児童もいたという。[5] [より正確な情報源が必要]
実装上の制限
文字の分解は、あらかじめ定義された「標準字形」のセットに依存します。しかし、倉頡にはさまざまな国でさまざまなバリエーションがあるため、倉頡の特定の文字の標準字形は、ユーザーが以前に学習したものと必ずしも同じではありません。倉頡を学習するには、倉頡自体だけでなく、一部の文字のなじみのない標準字形も学習する必要があります。倉頡入力方式エディター(IME) は、ユーザーに間違いがあることを通知する (通常はビープ音で) ことを除き、分解の間違いを処理しません。しかし、倉頡はもともと、文字の異なる異体に異なるコードを割り当てるように設計されています。たとえば、Windows で提供されている倉頡では、產のコードは YHHQM ですが、これはこの文字の形状ではなく、別の異体である産に対応しています。これは、Windows での倉頡の実装に起因する問題です。本来の蒼頡では、產はYKMHM(最初の部分は文)で、産はYHHQM(最初の部分は产)です。
句読点は幾何学的に分解されるのではなく、ZX で始まり、その後にBig5コードの文字の順序に関連する 3 文字の文字列が続く定義済みのコードが与えられます (このコード セットは、Windows 95 の繁体字中国語版の蒼頡に追加されました。Windows 3.1 の蒼頡には句読点のコード セットがありませんでした)。蒼頡で句読点を入力することは、暗記するか、適当に入力するかのいずれかを必要とする、面倒な作業になります。ただし、これは、最新のシステムでは画面上の仮想キーボードにアクセスすることで解決されます (Windows では、Ctrl + Alt + カンマ キーを押すとアクティブになります)。
よくある間違いとしては、代替コードとして考慮されないことが挙げられます。たとえば、「方」を上から下に分解して YHS とせず、筆順に従って YSH と入力すると、Cangjie は「方」という文字を選択肢として 返しません。
倉頡はQWERTYキーボードの26個のキーすべてを必要とするため、 12個のキーパッドしかないフィーチャーフォンでは中国語の文字を入力するのに使用できません。代わりに、注音、5ストローク(モトローラでは9ストローク)、Q9入力方式などの代替入力方法が使用されます。
バージョン
倉頡入力方式は、一般的に 5 世代 (英語では一般に「バージョン」と呼ばれます) を経てきたと言われていますが、各世代は互いにわずかに互換性がありません。現在、バージョン 3 (第三代倉頡) が最も一般的で、Microsoft Windowsでネイティブにサポートされています。バージョン 5 (第五代倉頡) は、Free Cangjie IME でサポートされており、以前はSCIMでサポートされていた唯一の倉頡でしたが、かなり少数派の方式であり、 iOSでサポートされています。
Apple II の Zero One カードでサポートされていた初期の Cangjie システムはバージョン 2 であり、バージョン 1 はリリースされませんでした。
クラシック Mac OSでサポートされている Cangjie 入力方式は、バージョン 3 とバージョン 5 の両方に似ています。
バージョン 5 は、オリジナルの蒼頡入力方法と同様に、Chu 氏によって直接作成されました。彼は、バージョン 5 (当初はバージョン 6 になる予定でした) のリリースによって、「蒼頡入力方法の 10 を超えるバージョン」(異なるベンダーによって作成された、わずかに互換性のないバージョン) がなくなることを期待していました。
バージョン 6 はまだ一般にはリリースされていませんが、あらゆる歴史的な中国語テキストを正確に保存できるデータベースを作成するために使用されています。
バリエーション
最近のほとんどの Cangjie入力方式エディター(IME) の実装では、さまざまな便利な機能が提供されています。
- 一部の IME では、入力したコードで始まるすべての文字がリストされます。たとえば、「A」と入力すると、システムは Cangjie コードが A で始まるすべての文字を表示するので、画面に正しい文字があればそれを選択できます。もう一度「A」と入力すると、リストが短縮され、コードが AA で始まるすべての文字が表示されます。このような実装の例としては、Mac OS Xの IMEやSmart Common Input Method (SCIM) などがあります。
- 一部の IME では、1 つ以上のワイルドカードキー (通常は * および/または ? ですが、常にそうであるとは限りません) が提供され、ユーザーはこれを使用して、Cangjie コードの一部を省略できます。システムは、ユーザーが選択できる一致する文字の一覧を表示します。例としては、X ウィンドウ Chinese INput XIM サーバー (xcin)、Smart Common Input Method (SCIM)、Founder Group (北京大学) の組版システムの IME などがあります。Microsoft Windows の標準 "Changjie" IME では、* を中間の文字の代わりに使用できます (実質的には、簡体字の Cangjieエントリに縮小されます)。一方、"New Changjie" IME では、最初の文字を除く任意の場所で * をワイルドカードとして使用できます。
- 一部の IME には「省略」機能があり、不可能な倉頡コードを複数の文字の倉頡コードの省略形として解釈します。これにより、より少ないキーでより多くの文字を入力できます。例として、Smart Common Input Method (SCIM) があります。
- 一部の IME には「連想」(聯想lianxiang) 機能があり、システムが次に入力する内容を予測し、ユーザーが入力した内容に関連付けられた文字やフレーズのリストを提供します。例としては、Microsoft の「Changjie」IME があります。
- 一部の IME では、文字の使用頻度 (ユーザーがその文字を入力した頻度) に応じて、候補文字のリストの表示方法が異なります。例としては、NJStar 中国語ワードプロセッサの Cangjie IME があります。
ワイルドカード キー以外にも、これらの機能の多くは一般ユーザーには便利ですが、Cangjie IME を予測不可能にするため、タッチ タイピング ユーザーには適していません。
蒼頡を何らかの方法で「簡素化」しようとするさまざまな試みもありました。
- 簡体字の倉頡はquick、簡易; jiǎnyìまたは速成; sùchéngとも呼ばれ、倉頡と同じ部首、補助形、分解規則、および短い例外リストを持ちますが、倉頡で 2 つ以上のコードが必要な場合は、最初と最後のコードのみが使用されます。
アプリケーション
多くの研究者が漢字を主要な構成要素に分解する方法について議論し、その分解システムに基づいたアプリケーションの構築を試みてきました。この考え方は漢字の遺伝子の研究と呼ぶことができます。倉頡コードはそのような取り組みの基礎を提供します。台湾の中央研究院[6]と上海交通大学[7]も同様のプロジェクトを行っています。
分解文字の使用の直接的な応用の1つは、異なる漢字間の類似性を計算する可能性です。[8]倉頡入力方式は、この種の応用の良い出発点を提供します。漢字1文字あたりのコード制限を5つに緩和し、より詳細な倉頡コードを採用することで、視覚的に類似した文字を計算で見つけることができます。これを発音情報と統合することで、コンピューターによる漢字学習が可能になります。[9]
参照
- コンピュータの中国語入力方法
- キーボードレイアウト
- 中国語Wikibooksのより完全な入力形状の表
- OpenVanilla – Mac OS X で Cangjie を使用するための機能を提供するフレームワーク。
注記
- 台北:チュワ!台湾株式会社 (全華科技圖書公司).倉頡中文資訊碼 :倉頡字母、部首、注音三用檢字對照[滄街の中国語情報コード: 滄街部首、康熙部首、注音をキーとしたインデックス付き]。出版番号 023479 — これは、Cangjie コントローラ カードを備えた初期の Cangjie システムのユーザー マニュアルです。
- 「倉頡字母中文輸入法」というタイトルのセクションの最初のページの最後から 2 番目の段落には、次のように書かれています。
【訳】
問題ありません。部首の欠点を補う助動詞もあります。助動詞は部首の形が変化したものであるため、覚えやすいです。 - 同じセクションの5ページ目の最後の段落には、
【訳】
本書に付属する辞書は、教育部が公布した標準常用漢字4800字を基本に作成されており、これに自動生成した文字を加えると、その文字数は約15,000字(康熙字典を基準に)となる。
- 「倉頡字母中文輸入法」というタイトルのセクションの最初のページの最後から 2 番目の段落には、次のように書かれています。
- この記事の情報の一部は、中国語版Wikipediaの同等の記事から引用したものです。
- 分解ルールは、http://www.chinesecj.com/ の「Friend of Cangjie — Malaysia」Web サイトから取得されています。このサイトでは、熟練したタイピストのタイピング速度も提供されており、Microsoft Windows 用の Cangjie メソッド バージョン 5 のソフトウェアも提供されています。
- Cangjie の「エラーを許容しない」特性に関する具体的な参照を見つけるのは難しいかもしれません。https://web.archive.org/web/20050206223713/http://www.array.com.tw/keytool/compete.htm の表は、この事実を述べている外部参照の 1 つです。
- Input.foruto.com には、その記事の著者が見た蒼頡入力方式の簡単な歴史が掲載されています。記事ではバージョン 1 と 2 が明確に識別されています。
- Cbflabs.com には、Changjie 入力方式だけでなく、中国語コンピューティング全般に関する Chu Bong-Foo による多数の記事が掲載されています。Cangjie 入力方式のバージョン 5 と 6 (現在は 5 と呼ばれています) が明確に識別されています。
参考文献
- ^ ETen Chinese Systemでファイル名として使用されるスペル。
- ^ Chu, Chyi-Hwa (朱麒華) (2012 年 2 月 1 日)。 「教育科技的專利與の普及」。国立教育研究アカデミーの電子ニュースレター(中国語)。 2022年8月25日のオリジナルからアーカイブ。2022 年12 月 14 日に取得。
- ^ Chu Bong-foo (朱邦復)。 "智慧之旅".開放文學(繁体字中国語)。 2017 年 10 月 19 日のオリジナルからアーカイブ。2017 年6 月 8 日に取得。
- ^ “倉頡取規則及及方法” [倉頡コード検索規則と方法].倉潔の友達(中国語)。 1997 ~ 2002 年。 2019 年 1 月 1 日のオリジナルからアーカイブ。2020 年10 月 2 日に取得。
- ^ https://www.chinesecj.com/forum/forum.php?mod=attachment&aid=MTIwNnw1MjMxNmQwMXwxNjg2OTYyNTE4fDB8MTUwMjQ%3D 58 ページ
- ^ 「漢字構形資料庫」[中国語文書処理研究室]。 2013年。2020年7月27日時点のオリジナルよりアーカイブ。2020年10月2日閲覧。
- ^ 上海交通大學漢字編碼組,上海漢語拼音文字研究組編著。漢字情報字典。北京市科學出版社、1988。
- ^ 宋柔,林民,葛詩利。
- ^ Liu, Chao-Lin; Lai, Min-Hua; Tien, Kan-Wen; Chuang, Yi-Hsuan; Wu, Shih-Hung; Lee, Chia-Ying (2011). 「誤った中国語単語における視覚的および音韻的に類似した文字: 分析、識別、およびアプリケーション」ACM Transactions on Asian Language Information Processing . 10 (2): 1–39. doi :10.1145/1967293.1967297. S2CID 7288710.
外部リンク
- オンライン倉街入力方法 網上倉頡輸入法
- 香港中文大学人文科学コンピューティング研究センターの中国語文字データベース: 広東語方言に従って音韻的に曖昧さを解消した語形付き: 中国語の五大文字 (レベル 1 の漢字 5401 文字とレベル 2 の漢字 7652 文字) 全体と、7 つの追加の ETen 漢字を網羅した中国語文字データベース。データベース内の各文字には、Cangjie 入力コードが表示されます。注: このデータベースには、香港補足文字セット (HKSCS - 2001) は含まれていません。
- Mingzhu ジェネレータ(中国語) : Chu Bong Foo のページ。実行ファイル、ソースコード、および手順が含まれています。Mingzhuは、 MS Windows で実行される Canjie 文字ジェネレータです。
- 倉頡の友: 倉頡の参考資料であり、さまざまなオペレーティングシステム用の倉頡5と、簡体字を入力するための倉頡の補足入力コードリストをダウンロードできる場所です。
- CjExplorer: 倉頡を学習するためのツール。ツールの実行中、強調表示された漢字の倉頡コードが表示されます。
- 倉頡法の概要: 倉頡法のルールと方法を学ぶための英語話者向けリソース

