Loading article…
Cork ( T1またはECとも呼ばれる)エンコーディングは、フォントのグリフをエンコードするために使用される文字エンコーディングです。[1]これは、アイルランドの都市Corkにちなんで名付けられました。1990年のTeXユーザーグループ(TUG)カンファレンスで、LaTeXの新しいエンコーディングが導入されました。[1]ラテンアルファベットを使用するほとんどの西ヨーロッパおよび東ヨーロッパ言語をサポートする256文字が含まれています。[2]
詳細
8ビットTeXエンジンでは、フォントエンコーディングは、このエンコーディングが最も一般的に使用されるハイフネーションパターンのエンコーディングと一致する必要があります。 [3] LaTeXでは を使用してこのエンコーディングに切り替えることができます\usepackage[T1]{fontenc}が、ConTeXt MkIIではこれが既にデフォルトのエンコーディングになっています。XeTeXやLuaTeXなどの最新のエンジンでは、Unicodeが完全にサポートされており、8ビットフォントエンコーディングは廃止されています。
文字セット
注記
- 表内の文字の下の 16 進数値は Unicode 文字コードです。
- 最初の 12 文字は結合文字としてよく使用されます。
- ^ 0x17はCorkエンコーディングでは「複合語マーク」(CWM)と呼ばれており、この規格の革新です。これは、たとえばドイツ語で複合語の境界に美的な合字を許さないために複合語を区切る目に見えない文字です。[2]これは、ほぼ同じ時期に定義されたUnicodeの「ゼロ幅スペース」(ZWSP、U+200B)にマッピングされており、その目的は同一ではないにしても似ています。
- ^ 0x18は「小文字のo」で、パーセント記号(%)から‰または‱ (または任意の小さい数値)を作成するために使用されます。[2]
- ^ ab ドットのない iとドットのない j は、マクロン (ī) 付きの i のようなアクセント付きの異形を作成するために使用できます。
- ^ 0x7F はハイフネーション文字であり、 Unicode で定義されているソフトハイフン(SHY) ではありません。
- ^ 0xD0 はEth (Ð, U+00D0) としても、ストローク付きの D (Đ, U+0110) としても使用されますが、場合によっては問題が発生する可能性があります (PDF からのテキストのコピー、ハイフネーションなど)
- ^ 0xDF には SS (2 つの文字S ) が含まれています。これにより、TeX はドイツ語の小文字ß を大文字に自動的に変換できます。
サポートされている言語
エンコーディングは、ラテン アルファベットで記述されたほとんどのヨーロッパ言語をサポートします。注目すべき例外は次のとおりです。
サポートがやや最適ではない言語には次のものがあります:
- ガリシア語、ポルトガル語、スペイン語–小文字の「a」と「o」の上付き文字ではない文字「ª」と「º」がないため(上付き文字は細くなります)、下線が引かれることが多い。
- クロアチア語、ボスニア語、セルビア語- Đのスロットを共有しているため
- トルコ語–点のない「i」は他の言語とは異なる大文字と小文字の組み合わせを持つため
参考文献
- ^ ab Petrlik, Lukas (1996-06-19). 「チェコ語とスロバキア語の文字エンコードの混乱の説明」. cs-encodings-faq . 1.10. 2016-06-21 にオリジナルからアーカイブ。2016-06-21に取得。
- ^ abc ファーガソン、マイケル(1990)、「多言語活動に関する報告書」(PDF)、TUGボート、11(4):514–516
- ^ TeX ハイフネーションパターン
外部リンク
- エンコードファイル
- LaTeX のエンコーディングの概要
