ベータ コードは、ASCII文字のみを使用して、古代ギリシャ語のテキスト (およびその他の古代言語)に見られる文字、アクセント、書式を表す方法でした。その目的は、ギリシャ語のアルファベットを単にローマ字化するだけでなく、書式や珍しい文字や特異な文字を含むさまざまなソース テキストを忠実に表現することでした。ほとんどのアプリケーションでは、Unicode によって廃止されました。
ベータコードは、1970年代後半にDavid W. Packardによって開発され、1981年にThesaurus Linguae Graecaeに採用されました。これは、ポリトニック ギリシャ語をエンコードするための標準となり、 Perseusプロジェクト、Packard Humanities Institute、Dukeコレクションのドキュメンタリーパピルス、コーネル大学とオハイオ州立大学のギリシャ碑文学プロジェクトなど、他の多くのプロジェクトでも使用されました。ベータコードは、表示用にさまざまなシステム、最も有名なのはUnicodeに簡単に変換できます。[1]これらのプロジェクトのほとんどは、それ以来データをUnicodeに変換しています。たとえば、Perseusはもともとすべての古代ギリシャ語のテキストをBetaコードを使用してエンコードしていましたが、[2]現在はUnicodeとしてリリースしています。
エンコーディング
ギリシャ語アルファベット
注記
- 大文字のラテン文字の代わりに、小文字のラテン文字も使用できます (例: α の場合は a、Α の場合は *a)。
- TLG ベータ コード マニュアルでは、ギリシャ文字を表すために大文字の ASCII 文字を使用しています。バリアント ( Perseus プロジェクトで使用) では、代わりに小文字の ASCII 文字を使用しています。どちらの場合も、装飾のない ASCII 文字は小文字のギリシャ文字を表し、大文字のギリシャ文字を示すにはアスタリスクを追加する必要があります。
- 一般的に、ギリシャ語のシグマを表すエンコード文字S は1 つで十分です。これは、単語の末尾または句読点が続く場合は最後のシグマとして解釈され、その他の位置では中間のシグマとして解釈されます。この自動的な曖昧さ回避が正しくない場合は、特定のコードS1およびS2を使用できます。
- いくつかの表現では、最終シグマにJ を使用し、中間シグマにS を使用します。ただし、 J はMorpheus や uni2beta などの多くのアプリケーションではサポート/出力されません。
句読点
文字 ' は、アポストロフィをエンコードするためと、母音に韻律的なブレーブを追加するための両方に使用されます。アポストロフィはギリシャ語では省略にのみ使用され、通常は子音の後に出現するため、意図は明確です。
アクセントと発音区別符号
これらは通常、上記の例のように接尾辞演算子ですが、大文字の単語の場合、アクセントは * と文字の間に来ます。ドキュメントでは、アクセントの必須または標準的な順序は定義されていません。一部のデータソースでは、通常、ブリージングは声調アクセントの前に見られ、[3]ある実装では、ブリージング、アクセント、イオタ下付き文字の標準的な順序が定義されています。[4]一部の実装では、アクセントの順序によって、Unicode に変換した後の結合文字の配置が決まります。[5]多くの実装では、マクロ化は実装されていません。
参考文献
- ^ TLG プロジェクトによって、ベータ版から Unicode へのリファレンス ガイドが開発されました (http://www.tlg.uci.edu/encoding/quickbeta.pdf)
- ^ 「Perseus ヘルプおよび情報センター」www.perseus.tufts.edu . 2022 年 12 月 26 日閲覧。
- ^ Crane、Morpheus ステムライブラリ、https://github.com/perseusdl/morpheus
- ^ 「Beta-code-rb/Vendor/Beta-code-json at master · perseids-tools/Beta-code-rb」。GitHub。
- ^ Paul Hardy、beta2uni ユーティリティ
外部リンク
- TLG ベータ コードの概要
- TLG ベータ コード マニュアル
- Mac OS X 用 Sophokeys ポリトニック ギリシャ語
- ベータコードから Unicode への変換ツールとベータコードからポリトニックギリシャ語への変換ツール
