現代の日本語表記体系(日本語の表記体系、Nihongo no hyōki taikei)は、採用された漢字と、草書体/漢字の構成要素から発展した仮名の組み合わせを使用しています。現代の仮名は、 主に日本語固有の単語や文法要素に使用されるひらがなと、主に外国人名、外来語、擬音語、科学用語、そして時には強調に使用されるカタカナの2つの音節文字から構成されています。書かれた日本語の文章のほぼすべては、漢字と仮名が混在しています。このように文字体系が混在していることに加え、使用可能な漢字の数が膨大であるため、日本語の表記体系は現在使用されているものの中で最も複雑なものの1つと考えられています。[ 1 ] [ 2 ] [ 3 ]
数千字の漢字が日常的に使用されており、そのほとんどは伝統的な中国語の漢字に由来する。日本独自の漢字は「和製漢字」と呼ばれ、「国字」とも呼ばれる。各文字には固有の意味(または意味の範囲)があり、ほとんどの文字には複数の読み方があり、どの読み方を選択するかは文脈によって決まる。 2010年現在、常用漢字は2,136字あり[ 4 ]、日本の小学生は6年生を卒業するまでに1,026字(教育漢字)を習得する必要がある。漢字の総数は5万字をはるかに超えるが、これには歴史的な文献にのみ存在し、現代日本語では使用されていない数万字が含まれる。漢字を書くことは複雑だが、漢字のない現代日本語のテキストはまれである。それらのほとんどは、幼い子供は漢字をあまり知らない傾向があるため、児童書であるか、あるいはハードウェアとソフトウェアのグラフィックと計算の両方の制限により漢字のような複雑な文字を表示できなかったコンピューター、フィーチャーフォン、ビデオゲームなどの初期の電子機器である。
現代のかなの使用法では、ひらがなとカタカナの音節文字はそれぞれ、基本文字が46文字(五十音を使って整理できる)、発音記号を含めると71文字で構成されています。1つか2つの小さな例外を除いて、日本語の異なる音(つまり、異なる音節、厳密にはモーラ)は、それぞれの音節文字の1文字に対応しています。漢字とは異なり、かな文字の唯一の機能は発音を転写することであり、単語を形成した後で初めて意味を伝えることができます。ひらがなとカタカナはどちらも、奈良時代に中期中国語の発音を用いて音訳するために借用された中国語の文字である万葉仮名から派生していますが、その形は簡略化/変更され、もはや視覚的にその文字言語的起源が明らかではないほどになっています。
程度は低いものの、現代の日本語の書き言葉では、例えば「BC/AD」、「am/pm」、「FBI」、「CD 」などのように、ラテン文字の頭字語も使用されています。ローマ字表記の日本語は、かなをまだ習得していない外国人日本語学習者や、ネイティブスピーカーがコンピュータに入力する際に最もよく使用されます。
漢字は中国語の文字(1946年以降は新字体と簡略化)から取られた表意文字で、日本語の表記に使用されます。
考古学的証拠から、日本人が中国の文字に初めて触れたのは西暦1世紀、弥生時代後期であったことが分かっている。しかし、当時の日本人は文字をほとんど理解していなかったと考えられ、文字が日本でより広く普及するようになった西暦5世紀の古墳時代まで、識字率は比較的低いままであった。
漢字は、日本語固有の、あるいは(歴史的には)中国語由来のほとんどの内容語を表記するために使用され、以下のようなものが含まれます。
日本語の中には、単語の具体的な用法によって異なる漢字で表記されるものがあります。例えば、 「治す」という単語は、人を治す場合は「治す」と書き、物を修理する場合は「治す」と書きます。
ほとんどの漢字には複数の読み方(または「読み」)があり、よく使われる漢字の中には多くの読み方を持つものもあります。これらは大きく分けて音読みと訓読みに分類されます。音読みは、漢字が日本語に取り入れられた当時の中国語の発音に近い読み方で、訓読みは漢字の意味に対応する日本語の単語の読み方です。しかし、明日(あした)や大人(おとな)のように、語句を構成する個々の漢字の音読みにも訓読みにも対応しない読み方を持つ漢字もあります。
珍しいまたは標準外の漢字の読み方は、ふりがなを使用して補われる場合があります。漢字熟語には、文体上の理由から任意の読みが与えられることがあります。たとえば、夏目漱石の『夢十夜』の第 5 夜では、 「接続って」は動詞「つながる」の動名詞-te形である「つながって」に使用されており、通常は「つながって」または「つながって」と書きます。 「接続」を意味する「接続」という言葉は、通常「せつぞく」と発音されます。
仮名(かな)は、日本語の表記体系で使用される音節文字の一種です。この用語は元々「仮の名前」または「借用した名前」を意味します。現代では、仮名は主にひらがなとカタカナに分けられますが、歴史的には万葉仮名やそう仮名などの他の形式も含まれていました。すべての種類の仮名は、最終的には漢字に由来します。仮名は漢字の本来の音価を借用し、それらの文字の簡略化された形や構成要素から発展したものです。
歴史的に見ると、ひらがなとカタカナの間には厳密な機能的な区別はありませんでした。テキストは、役割分担を固定することなく、漢字とどちらかの仮名のみを組み合わせて書くことができました。この状況は、第二次世界大戦後の言語改革によって変化しました。この改革により、西洋のアルファベットにおける小文字と大文字の区別に匹敵する、2つの音節文字の機能的な区別が確立されました。現代日本語では、仮名の発音と表記は、現代仮名使用法と呼ばれる体系によって規定されています。
平仮名は、平安時代(794年~1185年)に読み書きができる人々の間で最も広く使われていた漢字を、草書体を用いて簡略化した書体として誕生しました。現在の平仮名の主な創始者は、日本の宮廷の女性たちであり、彼女たちは個人的なやり取りや、 『源氏物語』などの文学作品の執筆にこの書体を用いました。
ひらがなは、以下のものを書くのに使われます。
また、一般的な漢字表記を持つ単語を、著者の好みに応じてひらがなで表記する柔軟性もあります(日本語の単語はすべて、通常は漢字で表記される場合でも、ひらがなまたはカタカナで完全に表記できます)。一部の単語は口語的にひらがなで表記され、漢字で表記するとよりフォーマルなトーンになる一方、ひらがなではより柔らかい、またはより感情的な印象を与える場合があります。[ 5 ]例えば、「かわいい」に相当する日本語の単語「kawaii 」は、かわいいのように完全にひらがなで表記することも、かわいいのように漢字で表記することもできます。
通常は漢字を使用して書かれる一部の語彙項目は、特定の文脈では文法化され、代わりにひらがなで書かれます。たとえば、動詞「見る」の語根は通常、 「見る」の部分を漢字「見る」で書きます。ただし、「試してみる」のように「試してみる」のように補助動詞として使用する場合は、食べてみる( tabete miru 、「食べて見てみる」)のように、動詞全体がひらがなで書くのが一般的です。
カタカナ(片仮名)は、平安時代の9世紀頃に、仏教僧が漢字から派生した音節文字を作り、漢字の一部を速記のように用いて読みやすくした際に。この体系の起源は、僧侶の空海に帰せられている。
カタカナは、以下のものを書くのに使われます。
カタカナは、言葉が外国語のアクセントやその他通常とは異なるアクセントで話されているという印象を与えるためにも使用できます。例えば、ロボットの話し方などです。
日本人がラテン文字に初めて触れたのは16世紀、室町時代、日本列島を訪れた最初のヨーロッパ人であるポルトガル人航海士との接触の時であった。初期の日本語ローマ字表記法はポルトガル語の正書法に基づいており、1548年頃に安次郎という名の日本人カトリック教徒によって開発された。
ラテン文字は、以下のものを書くために使用されます。
アラビア数字(伝統的な漢字数字とは対照的に)は、特に数量を示すのではなく、電話番号、シリアル番号、住所などの番号を付ける場合に、横書きのテキストで数字を書く際によく使用されます。アラビア数字は、おそらくラテン文字とほぼ同時期の16世紀、室町時代に日本に導入されました。最初の接触はポルトガルの航海士によるものでした。これらの数字はヨーロッパで生まれたものではなく、ポルトガル人がイベリア半島をアラブ人が占領していた時代に受け継いだものです。
現代では、IME(入力メソッドエディタ)などの日本語キーボードは、デフォルトでUnicodeアラビア数字の全角数字「1」を使用するように設定されているが、実際の使用では、特に数量を表す場合など、一般的な半角数字「1 」が使われることが多い。全角数字は、見た目の美しさのために間隔を空ける目的で使用されることもある。
変体仮名(ヘンタイガナ)は、明治維新によって廃れた古風な仮名の一種で、食品(特にそば)などに古風な雰囲気を出すために使われることがある。
熟字訓とは、漢字を用いて単語の意味を表すものの、その発音は構成要素となる漢字の通常の読みとは全く関係のない表記法である。逆に、当て字とは、複合語の音を表すように見える漢字を用いる表記法であり、概念的には単語の意味とは全く関係がない。
日本語の文章は通常、漢字(赤)、ひらがな(紫)、カタカナ(オレンジ)の3つの文字体系を組み合わせて書かれ、限られた場合ではラテン文字(緑)やアラビア数字(黒)も含まれる。
同じテキストをラテン文字(ローマ字)に翻字することもできますが、これは通常、外国語話者の便宜のためにのみ行われます。
英語に翻訳すると、次のようになります。
現代日本語のすべての単語は、ひらがな、カタカナ、ローマ字を使用して書くことができますが、漢字を使用できるのは一部だけです。専用の漢字がない単語でも、あて字(万葉仮名の「から=可良」)または熟字訓(「レールガン」を表すために使用されている超電磁砲)のタイトルのように、漢字で書くことができます。
まれではあるが、同じ単語の中に3つの文字体系すべてを用いる単語も存在する。例えば、「くノ一」という言葉は、ひらがな、カタカナ、漢字の順に使われている。これら3文字を同じ漢字の「四角」の中に収めると、「女」という漢字になると言われている。また、「消しゴム」もその例で、漢字、ひらがな、カタカナ2文字の順に使われている。
1993年の日本の新聞「朝日新聞」のコーパス(約5660万トークン)の統計分析により、次のことが明らかになった。 [ 7 ]
日本語の語順(単語の並び順)は、漢字ではなく、単語の発音を表す仮名に基づいている。仮名は、一般的に普及している五十音順と、昔ながらのいろは順の2つの方法で並べられる。漢字辞典は通常、部首方式で並べられているが、 SKIPなどの他の方式も存在する。

日本語は伝統的に縦書きと呼ばれる形式で書かれ、これは中国の伝統的な書き方から受け継がれたものです。縦書きでは、文字は上から下へ、右から左へと縦一列に書かれます。各列の一番下まで読み終えると、読者はその列の左隣の列の一番上から読み進めます。
現代日本語には、横書きと呼ばれる別の書き方も存在します。この書き方は、英語と同様に横書きで、左から右に読みます。
立書きで印刷された本は背表紙が右側を向いて開き、横書きで印刷された本は背表紙が左側を向いて開きます。[ 8 ]
日本語は通常、単語の間にスペースを入れずに書かれ、テキストは単語の境界に関係なく、ある行から次の行に折り返すことができます。この規則はもともと中国語の文章をモデルとしており、各文字は基本的にそれ自体が単語であるため、スペースは不要です (ただし、複合語は一般的です)。ただし、かなが含まれるテキストでは、日本語の読者は意味の理解に基づいて単語の区切りがどこにあるのかを理解する必要があります。たとえば、「あなたはお母さんにそっくりね。」は、精神的には「あなた/は/お母さん/ に/そっくり/ね。」と分割する必要があります。ローマ字では、項目を2 つの単語として音訳すべきか、それとも 1 つの単語として訳すべきかが曖昧になる場合があります。たとえば、愛する("to love") は、愛( ai ; " love ")とする( suru ; [ここに動詞形成接尾語])で構成され、 aisuruまたはai suruとさまざまに音訳されます。助詞は、所有助詞の君の犬のように、前の用語と結合される ( kimino inu ) か、別の単語 ( kimi no inu ) として書かれることがあります。
馴染みのない外国語の複合語(通常はカタカナで音訳される)は、日本語の読者の便宜を図るため、 「中黒」と呼ばれる句読点で区切られることがある。例えば、ビル・ゲイツ(Biru Geitsu ; Bill Gates) 。この句読点は、特に漢字が連続して並んでいる場合など、解釈に混乱や曖昧さが生じる可能性がある場合や、特に人名のフルネームなど、日本語の単語を区切るためにも時折用いられる。
日本語のピリオド()とコンマ()は、英語のピリオドとコンマと同様の目的で使用されますが、コンマの使用法は英語の場合よりも柔軟です。日本語の文でコンマを挿入する位置に関する明確な基準はありません。[ 9 ]疑問符(?)は、伝統的な日本語やフォーマルな日本語では使用されませんが、インフォーマルな文章や、発言が疑問として発せられたことが明確でない可能性のある会話の書き起こしで使用されることがあります。感嘆符(!)は、インフォーマルな文章に限定されます。コロンとセミコロンは使用できますが、通常のテキストでは一般的ではありません。引用符は「 ... 」と書き、入れ子引用符は『 ... 』と書きます。いくつかの括弧のスタイルとダッシュが使用できます。
日本が初めて漢字に触れたのは、紀元1世紀に漢の光武帝が西暦57年に日本の使節に贈ったとされる那王の金印章であった可能性がある。 [ 10 ]しかし、日本人が西暦4世紀より前に中国語の文字を 読めるようになったとは考えにくい。 [ 10 ]
当初、中国語の文字は日本語の表記には使われませんでした。識字能力とは、口語日本語ではなく、古典中国語の流暢さを意味していたからです。やがて漢文と呼ばれる体系が発展しました。この体系は文法が古典中国語に非常によく似ており、漢字を使用し、発音記号を使って日本語訳を暗示していました。7世紀半ばから8世紀半ばにかけての非公式な木簡は、古典中国語と古日本語漢文の両方で書かれており、 7世紀後半には識字能力が広く普及していたことを示唆しています。[ 11 ] [ 12 ]現存する日本最古の歴史書である古事記は、712年以前に編纂され、漢文で書かれています。今日でも、日本の高校や一部の中学校では、カリキュラムの一部として漢文を教えています。
日本語の書き言葉には、万葉仮名が開発されるまで本格的な文字体系は存在しませんでした。万葉仮名は漢字を意味ではなく音価(中国語の読みから派生)に基づいて採用したものです。万葉仮名は当初、万葉集のように詩を記録するために使用され、万葉集は759年以前に編纂され、そこからその名前が付けられました。万葉仮名は百済に由来するという学者もいますが、この仮説は日本の主流派学者によって否定されています。[ 13 ] [ 14 ]現代の仮名、すなわちひらがなとカタカナは、万葉仮名を簡略化および体系化したものです。
中国から日本に流入した多くの語句や概念には、日本語に固有の相当語がなかったため、多くの語句が中国語の発音と似た形で直接日本語に入り込んだ。この中国語由来の読み方は音読みと呼ばれ、この語彙全体は英語では「Sino-Japanese」、日本語では「 kango 」と呼ばれる。同時に、日本語には既に多くの借用語に対応する語句が存在していた。著者はこれらの語句を表すために漢字をますます用いるようになった。この日本語由来の読み方は訓読みと呼ばれる。漢字には音読みと訓読みが全くない場合もあれば、1つ、あるいは複数ある場合もある。動詞や形容詞には、漢字の語頭に送り仮名を付けて活用を表し、特定の漢字の読み方を明確にする。同じ漢字でも、語句によっては複数の読み方ができる場合がある。例えば、「行」という文字は「行く」の最初の音節「い」 、そして「運ぶ」の最初の3音節「おこな」 、複合語「行列」の「行」、そして「銀行」の「こう」、そして「行灯」の「あん」と読みます。
一部の言語学者は、日本語における中国語由来の語彙の借用を、ノルマン征服期に英語に流入したロマンス語の語彙に例えている。英語と同様に、日本語にも中国語由来の単語と日本語固有の単語の両方を含む、起源の異なる同義語が多数存在する。中国語由来の日本語は、英語におけるラテン語由来の単語がしばしばより高い水準を示すのと同様に、よりフォーマルまたは文学的であると見なされることが多い。
19世紀の明治時代の重要な改革は、当初は日本語の表記体系に影響を与えなかった。しかし、教育改革による識字率の向上、他言語からの借用語や新造語の大量流入、そして影響力のある言文一致運動などの最終的な成功により、日本語はそれまで用いられていた歴史的・古典的なスタイルではなく、口語的な形式で書かれるようになったため、言語自体が変化していった。日本語の書き言葉の難しさは議論の的となり、19世紀後半には漢字の使用数を制限する提案がいくつかあった。さらに、非日本語のテキストに触れることで、日本語をすべて仮名やローマ字で書くという提案もなされたが、これは実現しなかった。この時期には、西洋式の句読点が日本語の表記に導入された。[ 15 ]
1900年、文部省は日本語の読み書き教育の過程を改善することを目的とした3つの改革を導入した。
これらのうち最初の2つは概ね受け入れられたが、3つ目は特に保守派によって激しく議論され、 1908年に撤回された。[ 16 ]
1900年の改革が部分的に失敗に終わったことと、日本におけるナショナリズムの高まりが相まって、文字体系のさらなる大幅な改革は事実上不可能となった。第二次世界大戦前には、漢字の使用数を制限する提案が数多くなされ、いくつかの新聞社は自主的に漢字の使用を制限し、ふりがなの使用を増やしたが、これらは公式には支持されず、多くの反対に遭った。しかし、成功した改革の一つはひらがなの標準化であり、これは日本語のモーラを書き表す可能性をモーラごとに1文字のひらがなのみに制限し、それまで使用されていた他のひらがなをすべて変体仮名と呼び、日常的に使用しなくなった。[ 17 ]
第二次世界大戦直後の時期には、文字体系の急速かつ大幅な改革が行われた。これは占領当局の影響も一因であったが、教育制度の支配から伝統主義者が排除されたことが大きな要因であり、それまで停滞していた改訂作業が進展した。主な改革内容は以下のとおりである。
ある段階では、占領軍の顧問がローマ字への全面的な転換を提案したが、他の専門家の賛同を得られず、実行に移されなかった。[ 18 ]
さらに、右から左への横書きの慣習は、一般的に左から右への書き方に置き換えられました。右から左への順序は、横書きそのものではなく、一列一文字の縦書きの特殊なケースとみなされ、看板などの一行のテキストに使用されました(例:東京駅の駅名標は、右から左に読むと「駅京東」とあります)。 [ 8 ]戦後の改革は、一部の制限が緩和されたものの、ほとんどが存続しています。1981年に東洋漢字が1,945字の常用漢字(東洋漢字の修正版)に置き換えられた際、「制限」から「推奨」に変更され、一般的に教育当局はさらなる文字改革にあまり積極的ではなくなりました。[ 19 ] 2004年に、法務省が個人名に使用するために管理している人名用漢字が大幅に拡大された。常用漢字リストはその後、2010年に2,136文字に拡張された。[ 4 ]
日本語をローマ字で表記する方法はいくつかあります。英語話者向けに考案されたヘボン式ローマ字表記法は、日本国内外で広く使われている事実上の標準です。訓令式は日本語の音韻体系によりよく対応しています。訓令式では「ち」を「ti」と表記するのに対し、ヘボン式では「chi」と表記するなど、ローマ字表記には違いがあります。[ 20 ]他のローマ字表記法には、日本式、JSL、和プロローマ字などがあります。