音節化(/ sɪˌlæbɪfɪˈkeɪʃən /)または音節分割( / sɪˌlæbɪˈkeɪʃən / )、別名ハイフネーションは、単語を音節に分割することであり、これは話されたり、書かれたり[ 1 ]、手話で表現されたり[ 2 ]する。
英語の正書法では、音節への区切りは通常ハイフンで示され(例:syl-la-ble)、国際音声記号で実際に発音される音節を転写する場合はピリオドで示されます(例:[ˈsɪl.ə.bᵊɫ])。表示上の目的で、タイポグラファーは、中点(Unicode文字U+00B7、例:syl·la·ble)、特殊な「ハイフネーションポイント」(U+2027、例:syl‧la‧ble)、またはスペース(例:syl la ble)を使用する場合があります。
行末では、単語が行に収まらない場合、または次の行に移動すると最初の行が他の行よりも著しく短くなる場合、単語は慣習的に「音節」と呼ばれる部分に分割されます。これは、非常に長い単語や新聞の狭い欄で特に問題となることがあります。ワープロソフトによって文字揃え処理が自動化されたため、短い単語の音節分割は不要になることが多くなりました。
一部の言語では、発音される音節が書き言葉における音節分けの基礎となる。しかし、現代英語の綴りでは音と文字の対応関係が弱いためか、英語の書き言葉における音節分けは、音声学的原理ではなく、語源的原理や形態論的原理に大きく基づいている。例えば、現代英語の正しい音節分けに従って「learning」を「lear-ning」と音節分けすることはできない。行末に「lear-」だけを見ると、二重音字「ea」は様々な音価を持つため、読者が単語を誤って発音してしまう可能性がある。英語の正書法の歴史は、こうした現象を説明するものである。
したがって、英語の書き言葉における音節区分は、音韻論的(形態論的とは対照的に)単位という言語学的概念に対応しない「音節」の概念を扱っている。
その結果、英語を母語とする人のほとんどでさえ、辞書を参照したりワープロソフトを使ったりせずに、確立された規則に従って単語を音節に分けることはできません。学校でも、この件に関して辞書を参照するようにという以上のアドバイスはほとんど提供されません。さらに、イギリス英語とアメリカ英語の音節分けには違いがあり、同じ英語の辞書間でも違いがあります。
フィンランド語、イタリア語、ポルトガル語、日本語(ローマ字表記)、韓国語(ローマ字表記)など、音韻的に綴られる言語では、原則として、一般的な規則のみを用いて、既存の単語や新しく作られた単語を正しく音節に分割することができます。フィンランドでは、子どもたちはまず、正しい音節分割を確実にできるようになるまで、すべての単語にハイフンを付けるように教えられ、その後、ハイフンを省略できるようになります。
ハイフネーションアルゴリズムとは、単語をハイフンで2行に分割できる箇所を決定する一連の規則、特にコンピュータプログラムに実装するためにコード化された規則のことです。例えば、ハイフネーションアルゴリズムは、impeachment をimpeach-mentまたはim-peachmentに分割することはできるが、 impe-achmentには分割できないと決定するかもしれません。
単語の区切り方の規則が複雑な理由の一つは、英語の異なる方言によってハイフネーションの仕方が異なる傾向があることです。アメリカ英語は音に基づいて判断する傾向がありますが、イギリス英語は単語の語源に着目してから音を考慮する傾向があります。[ 3 ]また、例外も多数存在するため、事態はさらに複雑になります。[ 3 ]いくつかのガイドラインは、Major Keary 氏の記事「ハイフネーションについて – 衒学の無秩序」に記載されています。[ 3 ]
ハイフネーションのアルゴリズム的手法の中で、 TeX組版システムに実装されているものが広く使われている。ドナルド・クヌース著『コンピュータと組版』の最初の2巻とフランクリン・マーク・リャンの博士論文に詳細に記述されている。[ 4 ]リャンの研究の目的は、アルゴリズムをできるだけ正確にし、例外を最小限に抑えることだった。
ルールベースのパターンを識別することに加えて、アルゴリズム的手法では、パターンでは生成されない十分に重要な単語のハイフネーションに対して、ハードコードされた単語ごとの例外が含まれることがよくあります。[ 5 ]オリジナルの TeX ハイフネーション アルゴリズムでは、約 300 語の例外リストが使用されていました。[ 6 ] TeX82では、このリストに 1000 語以上が追加されました。[ 7 ] Knuth のPlain TeXのアメリカ英語のハイフネーション パターンでは、例外リストには 14 語しか含まれていません。[ 8 ] [ 9 ]
TeX ハイフネーション アルゴリズムの移植版は、 Haskell、JavaScript、Perl、PostScript、Python、Ruby、C#などの複数のプログラミング言語のライブラリとして利用可能であり、TeX ではコマンドを使用してログにハイフンを表示させることができます\showhyphens。
LaTeXでは、ハイフネーション補正はユーザーが以下の方法で追加できます。
\hyphenation{単語}この\hyphenationコマンドは、単語がスペースで区切られた単語のリストであり、各ハイフネーションポイントが-文字で示される単語のリストである、許可されたハイフネーションポイントを宣言します。たとえば、
\hyphenation{fortran er-go-no-mic}現在の職務では「fortran」はハイフンで区切ってはならないこと、また「ergonomic」をハイフンで区切る必要がある場合は、指定されたいずれかの箇所で区切ることを宣言する。[ 10 ]
しかし、いくつかの制限があります。たとえば、標準コマンドはデフォルトではASCII\hyphenation文字のみを受け入れるため、多くの言語で非常に一般的な非ASCII文字( ä、é、çなど)を含む単語のハイフネーションを修正するために使用することはできません。ただし、簡単な回避策があります。[ 11 ] [ 12 ]
\hyphenation{ % このリストには一切変更を加えないでください! --- DEK 仲間 関係者 偏角 義務的な 慈善的 現在 プレゼント プロジェクト プロジェクト 相互主義 再認識 改革 報復 テーブル } Plain TeX は、パターン辞書と初期例外辞書を設定する hyphen.tex というファイルを入力として受け取ります。[...] 最初の 13 個の例外は、TeX が誤ったハイフンを挿入するのを防ぎます。たとえば、「pro-ject」や「pre-sent」は、「re-cord」のような単語で、文脈を知らないとハイフンを付けられません。もう 1 つの例外「ta-ble」は、Plain TeX が英語で最もよく使われる約 700 語を完全にハイフンでつなぐという主張を満たすためだけに含まれています。