カタカナ(片仮名,カタカナ; IPA: [ katakana, katakana ] )は、日本語の 50音節 であり、ひらがな、[ 2 ]漢字、場合によってはラテン文字(ローマ字として知られる)とともに日本語の表記体系の 1 つの構成要素です。
カタカナという言葉は「断片的な仮名」を意味し、カタカナ文字はより複雑な漢字の構成要素または断片から派生しています。カタカナとひらがなはどちらも仮名体系です。1つか2つの小さな例外を除いて、日本語の各音節(厳密にはモーラ)は、それぞれの体系で1つの文字または仮名で表されます。各仮名は、「a」(カタカナア)のような母音、子音の後に母音が続く「ka」(カタカナカ)のような母音、または文脈によっては英語のm、n、ng([ ŋ ] )のように、あるいはポルトガル語やガリシア語の鼻母音のように聞こえる鼻音「 n 」 (カタカナン)のいずれかを表します。[ 3 ]
漢字で表せない日本語の単語や文法的な活用を表すのに使われるひらがなとは対照的に、カタカナは英語のイタリック体のように使われます。具体的には、外国語の単語を日本語に転写したり、外来語(総称して外来語)を表記したり、強調したり、擬音語を表したり、技術用語や科学用語、植物、動物、鉱物、そしてしばしば日本の企業名を表すのに使われます。
カタカナは、日本の仏教僧が中国語のテキストを日本語に音訳したことから発展した。 [ 4 ]
カタカナの文字体系は、機能記号や発音記号を除いて、全部で48文字から構成されています。
これらは、隣の表に示すように、5 × 10 のグリッド (五十音、五十音、文字通り「50 音」) として考えられます。読みア ( a )、イ ( i )、ウ ( u )、エ( e )、オ ( o )、カ ( ka )、キ (キ)、ク (ク)、ケ ( ケ)、コ(コ)などです。 の上。五十音は、サンスクリット語の習慣から母音と子音の順序を継承しています。以前はデフォルトのケースであった縦書きテキストのコンテキストでは、グリッドは通常 10 列 x 5 行として表示され、右側に母音、上部にア ( a ) が配置されます。同じ行または列にあるカタカナグリフは、共通のグラフィック特性を共有しません。予想される音節文字のうち、 yi、ye、wuの3つは、異なる文字で独自に使用されていた可能性はあるが、どの言語でも慣習化されることはなく、現代日本語には全く存在しない。
50音表には、鼻音の「ン」(n)という文字が追加されることがよくあります。これは様々な位置に現れますが、最も多いのは「N」の記号の隣、あるいは多くの「む」の変体仮名の一つから派生したため、「う」の列の下です。また、母音の行や「あ」の列に追加されることもあります。ここでは、独立した表として示しています。
日本語の文字体系には、基本文字の右上部に配置される2つの発音記号が含まれており、音節の最初の音を変化させます。濁点と呼ばれる二重の点は、主要な変化を示し、多くの場合、子音の有声化を示します。k → g、s → z、t → d、h → b。例えば、カ ( ka )はガ ( ga )になります。二次的な変化は、可能な場合は円形の半濁点で示されます。h → p 。例えば、ハ ( ha )はパ ( pa )になります。発音記号は1000年以上前から使用されていますが、日本語の表記体系で必須となったのは20世紀後半になってからです。正式な表記体系ではその適用は厳しく制限されていますが、学術的な転写ではより広範囲に及ぶ場合があります。
さらに、一部の文字は、通常のサイズの仮名や漢字の後に小さいサイズで印刷されると読み方が異なります(下記参照)が、これは二院制のケースではありません。
五十音表のレイアウトは、かな音節文字が常に同じ単一の子音の後に母音が続く形で発音されるという体系的な見方を促進しますが、これは厳密には当てはまりません(そしてこれまでも当てはまりませんでした)。日本語のローマ字表記の既存の方式は、文字体系の体系性に基づいているもの(例:nihon-shikiチチ)か、一般的な日本語のかなの発音に西洋の表記法(通常は英語の表記法)を適用したもの(例:ヘボン式表記法:shikiチチ)のいずれかです。しかし、どちらの方法も、子音に基づくカタカナ文字の多く、特に通常「う」で終わる文字は、母音が無声でほとんど知覚できないコーダ位置でも使用できるという事実を隠しています。
上記で説明した48のカタカナ音節文字のうち、現代日本語で使用されているのは46のみであり、そのうちの1つは一度しか使用されていない。
カタカナの「や」 「ゆ」「よ」(それぞれ「ャ」「ュ」「ョ」)の小さいバージョンを「い」で終わるカタカナに加えることができます。これにより、「い」の母音は「あ」「う」「お」への半母音変化(口蓋化)を起こします。例:キャ(き+や)/kja/。この小さな「や」のカタカナを加えることを「ゆん」と呼びます。
左音(そくおん)と呼ばれる文字は、小さな「つ」と見た目は同じで、続く子音が重子音(二重子音)であることを示します。これはローマ字では、左音の後に続く子音を二重にすることで表されます。日本語では、これは発音上の重要な区別です。例えば、「サカサカ」と「サッカサッカ」を比較してみてください。重子音は、外来語の音訳でよく見られます。例えば、英語の「bed」は「ベッド」と表記されます。左音は、発話の最後に現れることもあり、その場合は声門閉鎖音を表します。ただし、「な」「に」 「ぬ」「ね」「の」音節の子音を二重にするために使うことはできません。これらの子音を二重にするには、単数形の「ン」を音節の前に付けます。左音は、非母語の音を近似するためにも使用できます。例えば、「バッハ」は「バッハ」と書きます。マッハとしてマッハ( Mahha )。
カタカナとひらがなは通常、固有語の長母音を2つ目の母音かなを加えて表記します。しかし、外来語では、カタカナは代わりに長母音記号(ちょうおんぷ)と呼ばれる母音延長記号を用います。これは、横書きの場合は横、縦書きの場合は縦に、文字の方向に沿って短い線(ー)を付けるものです。例えば、「メール」は英語の「mail」から借用した外来語で、ーは「e」を長母音化しています。ただし、「ローソク(rōsoku)」や「ケータイ(kētai)」のように、カタカナで書かれた日本語でも長母音記号が使われる例外もあります。
標準反復記号と有声反復記号は、それぞれカタカナで「ヽ」と「ヾ」と書きます。
5 つの母音かなの小さいバージョンは、末尾の音 (ハァハア、ネェネ) を表すために使用されることがあります。より多くの場合、標準のカタカナでは表記できない音節 (またはモーラ) を日本語に書き写すために、ヨーンのような拡張二重文字としてカタカナで使用されます。これは、チェンジチェンジ(「変化」) のチェ ( che )、ファミリーファミリ(「家族」)のファ ( fa )、ウィキペディアウィキペディアのウィ ( wi ) とディ ( di ) などの外来語を書き写す場合に特によく見られます。完全なリストについては以下を参照してください。

現代日本語では、カタカナは外国語の単語や外来語(歴史的に中国語から輸入された単語を除く)の転写に最もよく使用され、「外来語」と呼ばれます。[ 6 ]たとえば、「アイスクリーム」はIce Cream (アイスクリーム)と書きます。同様に、カタカナは通常、国名、外国の地名、外国の人名に使用されます。たとえば、米国は通常、当て字漢字表記の「亜米利加( America ) 」ではなく、「アメリカ( America ) 」と呼ばれます。
カタカナは擬音語にも使われます[ 6 ]。擬音語とは、音を表す言葉のことです。例えば、ピンポン(ピンポン)は、ドアベルの「ディンドン」という音を表します。
動物や植物の種名、鉱物名などの技術用語や科学用語も、一般的にカタカナで表記されます。[ 7 ]種としてのHomo sapiensは、漢字の人ではなく、ヒト( hito )と表記されます。
カタカナは、日本の会社名の表記によく使われますが、常に使われるわけではありません。例えば、鈴木はスズキ、トヨタはトヨタと書きます。これらは一般的な姓であり、鈴木は日本で2番目に多い姓であるため[ 8 ] 、カタカナを使うことで、書面で会社名と姓を区別するのに役立ちます。カタカナは、看板、広告、広告板(つまり、ビルボード)によく使われます。例えば、ココ(ここ)、ゴミ(ゴミ)、メガネ(メガネ)などです。書き手が文中で強調したい単語も、ヨーロッパの言語でイタリック体を使うのと同じように、カタカナで書かれることがあります[ 6 ] 。
第二次世界大戦前の公文書では、現代の日本語の文章でひらがなと漢字が混在しているのと同様に、カタカナと漢字が混在しており、送り仮名や「は」や「お」などの助詞にカタカナが使われていました。
カタカナは、1988年以前の日本では電報にも使われており、1980年代にはマルチバイト文字が導入される以前からコンピュータシステムでも使われていた。当時のほとんどのコンピュータは、出力に漢字やひらがなの代わりにカタカナを使用していた。
古代中国語から借用された単語は通常漢字で表記されるが、現代中国語の諸方言から直接借用された単語はカタカナで表記される。
非常に一般的な中国語の外来語である「ラーメン」は、カタカナで「ラーメン」と表記されますが、漢字「拉麺」で表記されることはほとんどありません。
まれに、カタカナで書かれた単語から漢字が作られるケースもあります。例えば、「コーヒーkōhī」(コーヒー)は、代わりに「珈琲」と書くこともできます。このような漢字表記は、コーヒーメーカーや喫茶店が目新しさを狙って時折用いることがあります。
漢字辞典では、漢字の音読み(中国語由来の読み方)を示すためにカタカナが用いられます。例えば、漢字「人」には、日本語の読み方であるひらがなで「ひとひと」(人)と、中国語由来の読み方であるカタカナで「ジンジン」(人々の集団を表す)があります。また、ローマ字で書かれた単語の発音を示す振り仮名として、ひらがなの代わりにカタカナが用いられることもあります。あるいは、意味を表すために漢字で表記されているものの、本来の発音で読まれることを意図した外来語にも、振り仮名としてカタカナが用いられることがあります。

カタカナは、外国語やその他の通常とは異なるアクセントで話されている単語を示すためにも使用されることがあります。たとえば、漫画では、外国人のキャラクターやロボットの話し言葉は、より一般的なひらがなの「こんにちは」ではなく、コンニチワ(konnichiwa)で表されることがあります。一部の日本人の個人名はカタカナで書かれています。これは過去にはより一般的であったため、高齢の女性はカタカナの名前を持っていることがよくあります。これは、多くの貧しく読み書きのできない親が学者に娘に漢字で名前をつけてもらう費用を払いたくなかった明治時代と大正時代の女性の間で特に一般的でした。 [ 9 ]カタカナは、キャラクターが外国語を話していることを示すためにも使用され、カタカナで表示されているのは、その単語の日本語の「翻訳」にすぎません。
頻繁に使用される単語の一部は、くだけた会話調の雰囲気を伝えるために、ダイアログ内でカタカナで書かれる場合もあります。例としては、マンガ、アイツァイツ、バカバカなどがあります。
読みにくい漢字を含む単語は、カタカナで表記されることがあります(ひらがなもこの目的で使用されます)。この現象は、医学用語でよく見られます。例えば、「皮膚科」という単語では、2番目の漢字である「阜」が読みにくいとされているため、 「皮膚科」は一般的に「皮フ科」または「ヒフ科」と表記され、漢字とカタカナが混在しています。同様に、 「癌」のような読みにくい漢字も、カタカナやひらがなで表記されることがよくあります。
カタカナは、尺八の東山流や、箏、三味線、尺八による三曲アンサンブルなど、伝統的な音楽記譜法にも用いられます。
日本語を外国語として教える教師の中には、「生徒がひらがなで文章を難なく読み書きできるようになり、規則も理解してからカタカナを導入する」人もいます。 [ 10 ]ひらがなを学んだ生徒のほとんどは、カタカナを覚えるのも「それほど難しくない」のです。[ 11 ]他の教師は、カタカナは外来語とともに使われるため、最初にカタカナを導入します。これにより、生徒は意味のある単語とともにかなを読み書きする練習をする機会を得ます。これは、影響力のあるアメリカの言語学者エレノア・ハーツ・ジョーデンが『Japanese: The Written Language 』( 『Japanese: The Spoken Language 』と並行)で採用したアプローチです。[ 12 ]

カタカナは、日本の言語学者がアイヌ語を表記する際によく使用されます。アイヌ語のカタカナでは、音節の最後に来る子音は、その最後の子音に対応するカタカナの小さいバージョンで表され、その後に母音が続きます(どの母音かは、アイヌ語の表 § アイヌ語の特殊カタカナを参照してください)。たとえば、アイヌ語の単語up は、ウㇷ゚(ウプ[ uの後に小さなpu ])で表されます。アイヌ語では、3 つの半濁点修正カタカナ、セ゚( [tse] ) とツ゚またはト゚( [tu̜] ) も使用されます。Unicode には、アイヌ語をサポートするためにカタカナ音声拡張ブロック ( U+31F0–U+31FF ) が存在します。これらの文字はアイヌ語のみに使用されます。
台湾仮名(タイ
ヲァヌギ
イカ
ア
ビェン
)は、かつて台湾が日本の統治下にあった時代に台湾語(閩南語)を表記するために用いられた、カタカナをベースとした表記体系です。日本語のふりがなや中国語のピンインのように、漢字の発音記号として機能しました。客家語や台湾語など、台湾の他の言語にも同様の表記体系が存在しました。
日本語やアイヌ語とは異なり、台湾の仮名はボポモフォに似た方法論を使用しており、仮名は頭文字、母音中間音、子音終止音として機能し、声調記号でマークされています。最初のかなの下の点は有気子音を表し、重ねバーが付いたチ、ツ、サ、セ、ソ、ウ、オは台湾語のみにある音を表します。
沖縄語の発音表記には、ひらがなに拡張音を加えた他の様々な表記法とは異なり、カタカナが用いられています。この表記法は琉球大学沖縄言語学研究センターによって考案されました。多くの拡張音や「よーん」を用いて、沖縄語特有の多くの非日本語的な音を表しています。
これは、日本語で使用するカタカナとそのヘボン式ローマ字表記、およびIPA表記の概略表です。濁点または半濁点付きのカタカナは、濁点のない五十音の後に続きます。
しシ、ツツ 、ソソ、んんという文字は、傾きと筆画の形を除けば、印刷ではよく似ています。これらの傾きと形の違いは、墨で書くとより顕著になります。
注記
5つの母音仮名を小さくしたものを用いて、主に他言語の単語の音を表すために、多くの二重字が考案されてきた。
オレンジ色の背景の二重音字は、外来語や外国の地名や人名に一般的に使用されるもので、青色の背景の二重音字は、外国語の音をより正確に音訳するために使用され、どちらも文部科学省によって提案されています。[ 13 ]黄色の背景のカタカナの組み合わせは、米国規格協会[ 14 ]と英国規格協会によって、使用可能な用途として提案されています。[ 15 ]紫色の背景のものは、1974 年版の兵順式フォーマットに登場します。[ 16 ]
発音はヘボン式ローマ字表記で示されています。


カタカナは、9世紀(平安時代初期)に奈良の仏教僧によって、インドの文献や美術作品を音訳するために、万葉仮名の一部を略記法として用いて開発された。そのため、この仮名は「片」(部分的な、断片的な)と呼ばれる。例えば、「カ」(ka)は「増」 (ka;文字通りには「増加」を意味するが、この本来の意味は仮名には当てはまらない)の左側から取られている。隣の表は各カタカナの起源を示している。元の漢字(万葉仮名として使用されていた)の赤い印が、最終的にそれぞれの対応する記号になった。[ 19 ]
カタカナには異形があります。例えば、
(ネ)と
(ヰ)です。[ 20 ]しかし、カタカナの異形はひらがなよりも少ないです。カタカナの万葉仮名の選択は早い段階で安定し、1900年の文字体系の標準化よりもずっと前に、ごく少数の例外を除いて、曖昧さのない音素表記法(音ごとに1つの記号)を確立しました。[ 21 ]
以下の表は、各カタカナ文字の書き方を示しています。文字は、それを構成する音ごとに整理された伝統的な形式で配置されています。数字と矢印は、それぞれ筆順と方向を示しています。

日本語テキスト用のフォントやUnicodeの包括的なフォント(Arial Unicode MSなど)に加えて、中国語(MS Songなど)や韓国語(Batangなど)用のフォントの多くにもカタカナが含まれています。
カタカナには、通常の全角表示の他に、半角表示という2つ目の表示形式があります。半角表示は元々 、 JIS X 0201エンコーディングに関連付けられていました。標準では表示形式は規定されていませんが、実際には当時のコンピュータ機器で簡単に実装できるように、ローマ字と同じピクセルの長方形に収まるように設計されていました。このスペースは、日本語の文字が伝統的に占める正方形のスペースよりも狭いため、「半角」という名前が付けられました。この方式では、発音記号(濁点と半濁点)は別の文字として扱われます。当初、半角カタカナは、JIS X 0201 と同様に、当時のコンピュータ技術の能力に合わせて、それぞれ1バイトで表現されていました。
1970年代後半、カタカナ、ひらがな、漢字を含む日本語の全文字をサポートするために、 JIS X 0208などの2バイト文字セットが導入されました。これらの文字セットの表示形式は、ほぼ正方形のピクセル配列に収まるように設計されていたため、「全角」と呼ばれています。後方互換性のために、Unicodeなどの最新のマルチバイト符号化方式では、半角カタカナを別途サポートする機能が引き続き提供されており、通常の(全角)カタカナとして表示される文字ブロックと、半角カタカナとして表示される文字ブロックの2つが用意されています。
半角カタカナは、しばしば時代遅れと言われるものの、多くのシステムやエンコーディングで依然として使用されています。例えば、ミニディスクのタイトルはASCIIまたは半角カタカナでしか入力できず、半角カタカナはコンピュータ化されたレジの表示、店舗のレシート、日本のデジタルテレビやDVDの字幕などで一般的に使用されています。EUC -JP、Unicode、Shift JISなどのいくつかの一般的な日本語エンコーディングには、全角カタカナコードに加えて半角カタカナコードも含まれています。対照的に、ISO-2022-JPには半角カタカナは含まれておらず、主にSMTPやNNTPで使用されています。
カタカナは、1991年10月にバージョン1.0がリリースされた際に、Unicode規格に追加されました。
全角カタカナのUnicodeブロックはU+30A0~U+30FFです。
このブロックには、カタカナとともに、中黒の単語区切り点、ちょうおんの母音拡張記号、カタカナの繰り返し記号、および縦書きで時折使用されるコトの合字がエンコードされています。
Unicodeには、通常の全角カタカナの半角形も存在します。これらは、半角形と全角形ブロック(U+FF00~U+FFEF)(例えば、ラテン文字の全角形も含まれる)内にエンコードされており、U+FF65からU+FF9Fまでとなっています(U+FF61~U+FF64は半角句読点です)。このブロックには、半角濁点と半濁点も含まれています。これらの文字の全角形は、ひらがなブロックにあります。
丸で囲まれたカタカナは、囲まれたCJK文字と月のブロック(U+3200~U+32FF)のコードポイントU+32D0~U+32FEです。丸で囲まれたン(n)は含まれません。
アイヌ語やその他の言語の音声表記のためのカタカナの拡張機能は、2002年3月にバージョン3.2がリリースされた際にUnicode規格に追加されました。
カタカナの音声拡張のUnicodeブロックはU+31F0~U+31FFです。
日本語の仮名文字の歴史的形態や異体字は、2010年10月にバージョン6.0がリリースされた際にUnicode規格に追加されました。
かな補足のUnicodeブロックはU+1B000~U+1B0FFです。
小かな拡張のUnicodeブロックはU+1B130~U+1B16Fです。
Kana Extended-A UnicodeブロックはU+1B100~1B12Fです。このブロックには、変体仮名(非標準ひらがな)と歴史的な仮名文字が含まれています。
Kana Extended-B UnicodeブロックはU+1AFF0~1AFFFです。このブロックには、もともと日本の言語学者が台湾語を表記するために作成した、台湾仮名として知られる仮名が含まれています。
CJK互換性ブロックには、U+3330-3357の範囲に、通常は測定単位または外来語の略語であるカタカナ単語の四角形バージョンが含まれています。
他のUnicodeブロックにおけるカタカナ:
さらに、Unicode 17.0以降、カタカナブロックに合成済みの記号がないにもかかわらず、以下の組み合わせシーケンスが明示的に命名されています。フォントデザイナーは、これらの合成グリフの表示を最適化したい場合があります。これらのうちいくつかは主にアイヌ語の表記に使用され、その他は日本語で「ビダクオン」と呼ばれます。U+309A「半濁点」とのその他の任意の組み合わせも可能です。