文字鏡(もじききょう)中国語、日本語、韓国語、ベトナム語のチュノム、その他の中国の歴史的な表意文字体系で使用される文字の完全な索引を提供するために作成された文字符号化方式です。文字鏡研究会(もじききょうけんきょうかい)は、文字セットを出版し、それに付随するコンピュータソフトウェアとTrueTypeコンピュータフォントも出版しました。石川忠久(石川忠久)が会長を務める文字鏡研究会[1]は、当初、文字セットと関連ソフトウェアおよびデータを紀伊國屋書店で販売されるCD-ROMに再配布しました[ 2 ]。
1996年に構想され[ 3 ] 、 CD-ROMの最初のバージョンは1997年7月にリリースされた[ 4 ]。文字鏡研究所は一時期、「文字鏡WEB」と呼ばれるウェブ購読サービスも提供しており、こちらはより最新の文字が掲載されていた[ 5 ] 。
2006年9月現在 文字京は174,975文字を符号化した。[ 6 ]そのうち150,366文字(約86%)は、拡張中国語・日本語・韓国語・ベトナム語(CJKV)[注2 ]ファミリーに属していた。[ 5 ]文字京の多くは、の文字は廃止または不明瞭とみなされ、最も広く使用されている国際的なテキストエンコード標準であるUnicodeを含む他の文字セットではエンコードされません。
元々は有料の独自ソフトウェア製品であったが、2015年から、開発者の1人である古家時雄氏がその年に亡くなったことを記念して、 Mojikyō Instituteは最新リリースをフリーウェアとしてインターネットアーカイブにアップロードし始めた。 [ 7 ] [ 3 ] 2018年12月15日、バージョン4.0がリリースされた。翌日、石川氏は、古家氏がいなくなった今、これがMojikyōの最終リリースになると発表した。[ 3 ]
文字体系は、中国語、日本語、韓国語の文字体系、およびベトナム語のチュノム表意文字で使用される文字の完全な索引を提供するために作成されました。また、甲骨文字、篆書、サンスクリット語(シッダ)などの古代文字の多数の文字もエンコードしています。多くの文字については、文字体系がそれらをエンコードする唯一の文字体系であり、そのデータはしばしばUnicode提案の出発点として使用されます。[ 8 ] [ 9 ]しかし、文字体系はエンコードに関してUnicodeよりもはるかに緩い基準を持っているため、文字体系には疑わしい、あるいは意図せず架空の起源を持つエンコードされたグリフが多数存在します。[ 10 ] [ 11 ]そのため、Unicodeに追加されるのに適した非Unicode文字は多数ありますが、それぞれに要求される証拠の基準が異なるため、すべてがUnicode文字になるわけではありません。
文字鏡フォントは、 ZIP ファイルに含まれるTrueType フォントで、それぞれ約 2 ~ 5メガバイトです。フォントによって含まれる文字数が異なります。また、グラフィカルな文字マップを実装するWindows 実行ファイル「文字鏡MAP」(MOCHRMAP.EXE)も含まれています。[注 3 ] [注 4 ] MOCHRMAP.EXEを使用すると、ユーザーは文字鏡フォントを閲覧し、キーボードで入力する代わりに文字をコピーして貼り付けることができます。通常の Windows 文字マップや、 TrueType フォントをサポートするKCharSelectとは異なり、MOCHRMAP.EXE は要求された文字の番号付き文字鏡エンコーディングスロットを表示します。[ 12 ] MOCHRMAP.EXEを動作させるには、すべての文字鏡フォントがインストールされている必要があります。[注 5 ]
文字表記でエンコードされた文字を参照する場合、 Unicodeで使用されるU+XXXX形式と同様に、MXXXXXX形式がよく使用されます[ 13 ] 。ただし、このように表示される文字表記は10進数であるのに対し、UnicodeのU+表記は16進数であるという違いがあります。
ユニコードの初期の頃から、文字体系は標準に影響を与え、また標準から影響を受けてきました。文字体系に由来するグリフは、ユニコードのすべての CJK ブロックの維持を担当する表意文字報告グループ(IRG) [注 6 ]への提案に初めて登場しました[ 14 ] [ 15 ] 2002 年 4 月 18 日[ 16 ] 2007 年 5 月、文字体系は最終的に成功した一連のタングート文字をユニコードにエンコードするための提案において小さな役割を果たしました[ 17 ] [注 7 ] 2002 年 10 月までに、文字体系はすでにそのエンコード内に 6,000 のタングート文字を持っていました[ 6 ] 。
Unicode 標準の Unihan データベースでは、文字鏡を「Japanese KOKUJI Collection」 (日本国字集)、[ 18 ]略称「JK」と呼んでいます。[ 19 ] [ 20 ]たとえば、U+2B679 𫙹 CJK UNIFIED IDEOGRAPH-2B679 [注 8 ]日本語ではburizādo (ブリザード、文字通り「吹雪」 )と読まれる表意文字は、JK-66038 と同等の J-Source [注 9 ]を持っています。 JK 接頭辞 J-Source を持つすべての Unicode 文字は、Mojikyoに由来します。[ 21 ] [注 10 ]文字エンコーディングと東アジア言語の専門家であるケン・ルンデ氏によると、Unicode 13.0 の時点で、Unicode の 782 の表意文字が文字体系に由来しており、 CJK 統合表意文字拡張 C (367 文字) とCJK 統合表意文字拡張 E (415 文字) の2 つのブロックにほぼ均等に分かれている。[ 20 ] [ 22 ]文字体系に由来するすべての Unicode 文字(JK 接頭辞 J ソース) が、文字体系フォントと同じ代表グリフをコードチャートに持っているわけではない。[注 11 ]文字体系研究所が割り当てた形状が間違っていることが調査で判明したため、一部の文字は最終的なエンコード前に形状が変更された。[ 11 ] [注 12 ]
2006年9月現在 174,975 文字がエンコードされました。[ 6 ]そのうち 150,366 文字は拡張CJKV [注 2 ]ファミリーに属していました。[ 5 ]エンコードされた文字の多くは廃止されたか、その他の理由で不明瞭であり、国際標準の Unicode を含む他の文字セットではエンコードされていません。各文字には固有の番号があり、文字はブロックに整理されています。
文字体系では、 CJKVの文字を康熙時代の伝統的な部首に基づいて異なるブロックに分類します。特に文字数の多い一般的な部首、例えば9番(人)や162番( ⻌)などは、さらに画順によって分割されます。 [注13 ]
Unicodeとは異なり、文字体系は意図的に漢字の統一を避けています。Unicodeのように、エンコードのコンパクト化を試みたり、U+FFFF以下のすべての一般的な文字をまとめる試みは行われていません。
一方、UnicodeはCJKをその一般的さに基づいてブロックに分類します。最も一般的なものは一般的に基本多言語面に配置され、[注12 ]まれなものや不明瞭なものは補助面に配置されます。
Mojikyōは制限付きライセンスに基づくプロプライエタリソフトウェアです。当初、Mojikyō Instituteは文字データの使用を阻止しようとし、文字セットとの変換テーブルを公開する者を脅迫しました。2010年7月、Mojikyō Instituteは、少なくとも1人の日本人ユーザーが変換テーブルを公開したり、 Mojikyōでエンコードされた文字をUnicodeや他の文字セットに変換したりするのを阻止するための法的努力を放棄しました。 [ 23 ]単なるデータ(文字の形状を含む場合もある)は、独創性の基準を満たさないため、多くの法域で共有財産とみなされています。 [注14 ]
しかし、この歴史的経緯から、GlyphWikiは2020年以降、文字データの掲載を禁止した。 [ 24 ]
{{cite web}}: CS1 maint: url-status (リンク)文字鏡研究会の関係者に聞いたところ、オランダから提案されたWG2 N36981には文字鏡のフォントが使用されているが、文字鏡研究会は関与しておらず、内容提案についても疑問があるとのことであった。文字教研究所自体はこの提案には関与していない。さらに、その提案の内容の一部については疑問を抱いている。]
ただし、拡張Cの標準化作業が8年間の長期期間、また事後的に用例が必須とされたため、正式に公開された拡張C漢字の典拠は初期の典拠とはかなり異なるものとなっている。 [ CJK Unified Ideographs Extension Cの標準化の取り組みには 8 年という長い年月がかかり、エンコード後に漢字の例が要求されてきたため、正式に公布された Extension C の漢字標準は元の標準とはかなり異なります。例えば、日本政府は当初、文字体系研究所が選定した約1000字の漢字を申請しました。[…] 漢字の検証は文字体系研究所とは独立して行われたため、文字の形は文字体系研究所の同じコードポイントのバージョンから変更されることがよくありました。]
-Japan_C1
今昔文字鏡およびその関連製品、データは、そのライセンス上グリフウィキには配置することができませ
ん
。そのため、上記の GlyphWiki ライセンスと互換性がありません。 GlyphWiki にデータを入力する際には、
文字協の
エンコーディング スロットの番号、
文字協
の
フォント内のグリフ自体の外観、あるいは
文字協
製品を参照することによって収集されたと判断できるいかなる情報も
使用することはできません。
文字京
データは絶対に受け入れられません
。ご協力お願い致します。】
kIRG_JSource