幽霊文字(ゆうれいもじ)は、日本工業規格JIS X 0208に誤って記載されている漢字である。6,355字のうち 12 字が幽霊文字である 。
概要

1978年、通商産業省はJIS C 6226(後のJIS X 0208 )規格を制定した。この規格では、6349文字がJIS第1水準および第2水準の漢字として定義された。この漢字セットは「JIS基本漢字」と呼ばれている。このとき、次の4つの漢字リストがソースとして使用されました。[1] :269f
- 標準コード用漢字表(案):情報処理学会漢字コード委員会(1971)
- 国土行政区総覧:日本地理学会(1972年)
- 日本生命姓名表:日本生命(1973年、現存せず)
- 行政情報処理基本漢字:行政管理庁(1975年)
制定当時、各文字の典拠は明確に示されておらず、意味や使用例が不明な文字もあると指摘されていた。「幽霊文字」という用語は「幽霊語」から作られた造語で、辞書には載っているが実用性のない単語を意味する。[2]最も一般的な例は「妛」と「彁」である。これらの文字は、古代中国の漢字書を網羅した康熙字典や大漢和辞典には記載されていない。
1997年、芝野浩二委員長と国立国語研究所の笹原弘之氏を中心とする改訂標準起草委員会が、1978年の標準起草の際に参考にされた文献を調査した。その結果、幽霊文字とされていた文字の多くが、実は地名に使われる漢字であることが判明した。
調査によれば、1978年規格の起草に先立ち、行政管理庁は1974年に上記1~3を含む8つの漢字表「行政情報処理用標準漢字選定のための漢字の使用頻度と対応分析結果」を作成し、漢字とその原典の一覧を添付していた。当時のJIS基本漢字選定に当たっては、原典ではなくこの対応分析の結果が参考にされた。このうち、国土行政区分総覧や日本生命保険相互会社人名用漢字表を参考にしたものには、幽霊字が多く含まれていることが判明した。特に人名用漢字表は、第1次規格の起草時点で原典がなく、内容が不十分であるとの指摘があった。[3]
この結果を受けて、標準改訂委員会では、1972年版の『国土の行政区分総覧』を校正履歴から復元し、同書に登場するすべての漢字を全ページと照らし合わせて用例を確認した。また、現在は存在しない『人名用漢字表』の代わりとして、 NTTと電電公社の電話帳データベースの比較研究や、古今東西の漢字本30冊以上の調査など、徹底した文献調査を行った。
12字は未確認。3字は誤字と思われる。偶然かもしれないが、8字は日本古語辞典や中国古語辞典に掲載されていた。「彁」については、具体的な出典は見つかっていない。[1] : 269f
ゴースト文字はすでにUnicodeなどの国際標準に採用されており、これらの標準を変更すると互換性の問題が発生する可能性があり、ゴースト文字を変更または削除することは事実上不可能になります。
ゴーストキャラクター一覧
前述の笹原弘之らによる調査結果は、JIS X 0208:1997の附属書7「区の位置の詳細説明」にまとめられているが、ここではその一部を抜粋する。
JIS X 0208:1997 では、諸橋大漢和辞典や角川新字源に掲載されていない文字を中心に、出典が判明している 72 字の出典の詳細をまとめています。ただし、原典で誤字であることが判明した文字も含まれています。
JIS X 0208:1997の附属書7に「出典元」として付記されている区切り文字の一覧には72文字が記載されているが、詳細本文には「鰛(82-60)」は記載されておらず、71文字しかない。
不明な情報源
JIS X 0208:1997 では、以下の表の 12 文字を「出典不明」、「不明」、「識別不能」として扱います。これは、前述の 4 つの漢字リストのどれが文字の出典であるかが不明であるためです。
幽霊文字は「存在しない漢字」なので、「便宜上」読み方を付しています。
誤字の可能性あり
権限が不明な文字の一部は、標準の作成者によって誤って書かれたものと考えられています。
- 「壥」が誤記されたのは、「壥」と似た漢字「㕓」がJIS基本漢字に含まれていないためと考えられます。また、「㕓」はJIS X 0213にも含まれていません。
- 「妛」が誤記されたのは、「妛」と似た字形の「𡚴」がJIS基本漢字に含まれていないためである可能性がある。この資料の出典である国土行政区索引には、版下作成時に異なる字体を切り貼りしてできたと思われる影のような印刷痕がオーバーレイ上に残っており、これを誤って横画と転写したものと推測される。[1] : 288, 289f, 292 [35]
- 「椦」と似た漢字「橳」がJIS基本漢字に含まれていないため、「椦」が誤記された可能性があります。
辞書での扱い
規格制定以来、辞書編纂の方針として、JIS基本漢字はすべて収録されていることを前提とした字典を刊行してきた。幽霊字については、過去の資料を参照することができない。そのため、辞書や個々の字によって以下のように扱いが異なっていた。
臨時の読書課題
JIS基本漢字を実装した機器では、漢字に音読みが割り当てられていることが多い。辞書の中には、このような仮の読みも掲載されているものがある。笹原弘之は、これらの読みは、電子情報技術産業協会(1982年)の研究報告や、 NEC(1982年)と日本IBM (1983年)の刊行物に基づいて付けられた可能性があると指摘している。[36]
類似文字のバリエーションとしてみなされる
「駲」を「馴」の変形[37]、「軅」を「軈」の変形[38]とする説もある。これらの文献のいずれも出典を示していない。
「妛」という文字は、非常によく似た文字「𡚴」(上の「山」が「屮」になっている)の誤字である可能性があり、『大漢和辞典』と『康熙辞典』に掲載されている。[39]これは、JIS X 0208:1997の調査でも、権威ある情報源との暗黙的な統合の例とともに紹介されている。これら2つの文字は、 Unicodeでも同じコードポイントに統合されている。
個人の解釈
「竜」は「龍」の異体字であるため、「槞」は「櫳」の異体字であるという解釈もあります。[28]一部の辞書では、「鵈」=「耳」+「鳥」をトビの文字とみなしています。[40]
不明と説明
上記の研究結果が発表された後、これらの内容は辞書に一般的に採用されました。大漢和辞典は2000年に補訂版を出版し、垈、垉、岾、橸、汢、粭、糘、膤、軅、鵈の文字を収録しました。[41]また、角川の 『新字源』は2017年に改訂され、幽霊文字を含むJIS規格の第1から第4までのすべての文字を収録しました。[42]
キャラクターの遺体
東アジア諸国では古くから漢字が使用され、主に手書きで伝承されてきたため、国によって、あるいは国内でも微妙に書き方が異なる文字、いわゆる異体字が生まれてきた。Unicodeでは全ての異体字を採用したわけではなく、微妙に異なる文字も包括して登録した。[44]
一方、漢字の単純な部分を組み合わせて別の文字を作ることも、さまざまな国や地域で行われてきました。その結果、偶然にも、同じ漢字が異なる国で異なる意味(時には同一の意味)を持って発明されることがあります。[45]
前述のように、日本語の妛という誤字は、もともとは「山」と「女」を組み合わせた「𡚴」に偶然「一」が挟まっただけの字だったと推測される。一方、中国には「屮」「一」「女」を組み合わせた「妛」という漢字があり、これも「媸」の異体字である。しかし、ユニコードでは、日本に本来存在しない「妛」が、偶然「妛」と似ているという理由で包含された。[ 44 ]また、間違いである日本語の「妛」がユニコード文字として登録された。[46]
また、日本語の閠(下は「玉」)は「閏(下は「王」)」の誤字だと考えられている。(15世紀の日本の『和国篇』の16世紀の写本にも「閠」の字があるが、これは唯一の例である。)一方、中国の漢字「閠」は「閏」の一種の異体字であり、誤字ではない。[31]これもUnicodeで統一された。[43]
日本語の幽霊字「岾」は禿山を意味する国字(日本独特の漢字)であり、もともと「岵」の誤記であったと考える者もいる。しかし、韓国ではこの字は峠を意味する漢字として作られた。[47]これもUnicodeで統一された。[43]
現代の使用
規格が発行されて以来、ゴースト文字の例が登場し、広く使用されるようになりました。
日本の神社の副支配人の称号である「祢宜」は、「袮宜」(正しい表示の代わりに衣部首を使用)と誤用される場合があります。場合によっては、日本の姓「栩谷」が誤用される「挧谷」(正しい木の代わりに手部首を使用)。[1] : 292, 304 日本の民俗学者丹羽基次は著書の中で「妛芸凡」(アキオシ)という姓を紹介した。 [2] [48]
朝日新聞のデータベースには、1923 年 2 月 23 日号の朝日新聞に「埼玉自彊たが、デジタル化された際に誤って「埼玉自彁会」と表記されていました。現在は修正されています。 [49]
フィクションでの使用例
日本の特撮テレビシリーズ『五星戦隊ダイレンジャー』には、「嘉挧」というキャラクターが登場する。この名前は古代中国の政治家である賈詡に由来しているが、「詡」という文字はJIS X 0208に登録されていないため、幽霊文字に置き換えられている。
日本の推理作家読坂裕二の小説『5A73』は、被害者の体に「暃」という幽霊文字が書かれた一連の殺人事件から始まる。[50]
音楽ゲームBeatmania IIDXには、ゴーストキャラクターを使用した「閠槞彁の願い」という曲が収録されています。この曲のコメントによると、その発音は「人間には発音できない」もので、幽霊文字の当て字読みである「ぎょく驚のねがい」と仮称されているとのこと。 [51]
Unicodeでの類似例
UnicodeのCJK統合漢字にも、収録の経緯が不明な文字があり、同様に「ゴースト文字」と呼ばれることもある。例えば、CCITT中国語基本文字セットに収録されていたためUnicodeにも登録された「螀」(U+8780)は、出典を十分に確認せずに採用された誤植である可能性が指摘されている。[52]
U+237C ⍼ 下向きジグザグ矢印付き直角は、 1972 年にMonotype Imagingによって数学セットに追加されましたが、理由は不明です。その後、Unicode に含まれています。
Unicode 1.0のCJK互換ブロックには、カタカナで書かれた日本語の「バーツ」の四角形バージョンがあります。[53]日本語の「バーツ」はバーツ( bā tsu )です。しかし、参照グリフ⟨㌬⟩と文字名はパーツ( pā tsu 、英語の「parts」から)に対応しています。[ 53 ] CJKコードポイントU+332C ㌬ SQUARE PAATUは、標準のその後のバージョンで「誤った未使用の表現」として文書化されており、ユーザーは代わりにU+0E3F฿THAI CURRENCY SYMBOL BAHTを使用するように指示されています。[54]その結果、このコードポイントに対応するコンテンツを持つコンピュータフォントはごくわずかであり、その使用は推奨されていません。[53]
参考文献
- ^ ABCD 7ビット及び8ビットの2バイト情報交換用記号化漢字セット[ 7ビットおよび8ビット2バイト情報交換符号化漢字セット] (日本語).日本規格協会. 1997.
- ^ ab 笹原宏之 (笹原宏之) (2007). 国字の位相と展開『国字の変遷』三省堂、212、788頁。ISBN 978-4-385-36263-2。
- ^ 笹原宏之 (笹原宏之) (2019 年 4 月 9 日)。 第9回 民間の名字ランキング ——日本に多い名字とは?(4) [Vol. 9: 民間の名字ランキング~日本で一番多い名字は? (4)】。大修館。 2023 年9 月 3 日に取得。
- ^ 笹原2007、780頁。
- ^ 笹原2007、781頁。
- ^ 笹原2007、789頁。
- ^ 笹原2007、826頁。
- ^ 笹原2007、133頁。
- ^ 笹原2007、799頁。
- ^ 笹原2007、827頁。
- ^ 笹原2007、801頁。
- ^ 笹原2007、803頁。
- ^ 笹原2007、804頁。
- ^ 笹原2007、805頁。
- ^ 笹原2007、808頁。
- ^ 笹原2007、810頁。
- ^ 笹原2007、811頁。
- ^ 笹原2007、834頁。
- ^ 笹原2007、835頁。
- ^ 笹原2007、836頁。
- ^ 笹原2007、837頁。
- ^ 笹原2007、786頁。
- ^ 笹原2007、137頁。
- ^ 笹原2007、138頁。
- ^ 笹原2007、130頁。
- ^ 笹原2007、140頁。
- ^ 笹原2007、797頁。
- ^ 笹原2007、798頁。
- ^ 笹原2007、839頁。
- ^ 笹原2007、143頁。
- ^ 笹原2007、124頁。
- ^ 笹原2007、125頁。
- ^ 笹原2007、830頁。
- ^ 笹原2007、831頁。
- ^ 笹原宏之 (笹原宏之) (2006). 日本の漢字[日本の漢字]。岩波新書。岩波書店。 p. 82.ISBN 4-00-430991-3。
- ^ 比留間直和 (比留間直和) (2011 年 8 月 22 日)。 幽霊文字の読み、どこから — 変換辞書のはなし5 [幽霊文字はどこから来たの?].朝日新聞社(日本語)2023 年9 月 24 日に取得。
- ^ 戸川芳郎 (戸川芳雄) (2016). 漢辞海(日本語)(第4版)。三省堂。ISBN 978-438-5-14048-3。
- ^ 鎌田正、米山寅太郎 (鎌田正 & 米山寅太郎) (2011). 新漢語林(日本語)(第2版)。大修館書店。ISBN 978-446-9-03163-8。
- ^ 新村出(1998).広辞苑(第5版)。岩波書店。ISBN 978-400-0-80111-9。
- ^ 笹原2007、812頁。
- ^ “文字情報基盤検索システム / 垈” [文字情報基盤検索システム / 垈]. 文字情報技術推進協議会2024 年6 月 30 日に取得。
- ^ “全面改訂で『新字源』のここが進化” かつ書店。 2024 年 4 月 16 日のオリジナルからアーカイブ。2024 年6 月 30 日に取得。
- ^ abc "ISO/IEC 10646:2003 (E)" (PDF) . 2024年6月27日閲覧。
- ^ ab 池田、松寿 (2003 年 10 月 1 日)。 『篆隷万象名データベースの改訂版』(PDF)。JAET のジャーナル。4 : 4–11 。2024 年6 月 29 日に取得。
- ^ 笹原裕之 (2019年3月25日). "字体に偶然の一致 : 「JIS X0208」と他の文献における字体の「暗合」と「衝突」"紛争""。].日本語科学。1 : 7–24 。2024 年6 月 29 日に取得。
- ^ 「Unicode 標準 / バージョン 15.1.0 部首・画数索引」(PDF) . Unicode, Inc. 2023 . 2024 年6 月 29 日閲覧。
- ^ 笹原2007年、790頁。
- ^ 丹羽基二 (丹羽基二) (1998). 苗字のはなし2『名字の無い人 2』 芳文館 p. 165. ISBN 978-4-990-05847-0。
- ^ 比留間直和 (比留間直和) (2011 年 9 月 5 日)。 大正十二年の幽霊文字 [1923年の幽霊文字] 2023 年9 月 10 日に取得。
- ^ 詠坂雄二 (よみさかゆうじ) (2022). 5A73(日本語)。光文社。ISBN 9784334914745。
- ^ "E-amusement" 閠槞彁の願い。ビートマニアIIDX 28 BISTROVER 2023 年9 月 10 日に取得。
- ^ 安岡光一;安岡素子(1997)。 「唡」はなぜJIS X 0221に含まれているのか —Unicode幽霊文字研究— [「唡」はなぜJIS X 0221に含まれているのか?] (PDF )情報処理学会.
- ^ abc Lunde, Ken (2016年3月26日). 「CJK Type | CJK Fonts, Character Sets & Encodings. All CJK. All of the time」. Adobe Inc. 2016年6月29日時点のオリジナルよりアーカイブ。
- ^ 「CJK 互換性 3300–33FF」(PDF)。Unicode標準、バージョン 15.1。p. 3327–334C。
