初期中期英語言語アトラス( LAEME)は、初期中期英語(1150~1325年)の歴史的方言をデジタルで収集し、コーパスに基づいて作成した資料です。LAEMEは、検索可能なタグ付きテキストコーパス(CTT)、出典索引、およびテキストの方言的特徴の分布を示すドットマップを組み合わせて構成されています。LAEMEはエディンバラ大学のマーガレット・レインが主導し、ケープタウン大学のロジャー・ラス、およびエディンバラ大学のキース・ウィリアムソン、ヴァシリス・カライスコス、カリフォルニア大学ロサンゼルス校のシェリーリン・ブランショーによるウェブスクリプトが収録されています。
1987年に、LAEMEの親プロジェクトである『後期中世英語言語アトラス』(LALME)[ 1 ]の出版の翌年に始まったLAEMEは、LALMEのために開発された中世方言の方法論に基づいて構築されていますが、コーパス言語学の方法を採用することでLALMEとは一線を画しています。現在の形では、こうした方法には、厳選された包括的な初期中期英語コーパスの語彙文法タグ付けが含まれており、進行中のプロジェクトではこれに構文解析を追加する予定です(『初期中期英語構文解析済み言語アトラス P-LAEME』を参照)。[ 2 ] 完全にタグ付けされ、構文的に注釈が付けられたコーパスへの一般公開は、急速な言語変化と現存するテキストの不足によって特徴づけられる時代について、音韻論、語彙文法、意味論、語用論、そして方言の研究に前例のない範囲を提供するはずです。語彙レベルでは、物語語源コーパス(CoNE、バージョン1.1、2013)によってさらに範囲が拡大される。[ 3 ] CoNEはLAEMEのタグ付きテキストコーパス(CTT)から変化コーパス(CC)を派生させ、特殊コードで注釈された語彙形式の相対的な年代順を示す。CoNEの物語語源は同族語による意味の遡及ではなく、時間の経過に伴う語形の過程の物語に基づいている。[ 4 ]
近代言語学の出現以前、中世の文献学者は文学言語に基づいて言語変異のパターンを記述しようと試みていた。しかし、文学言語は日常の文書言語よりも模倣的、古風、あるいは混成的である可能性が高く、このアプローチには重大な問題があった。文学的伝統に基づいて書かれたテキストや文学作品から写されたテキストは、特定の時代の方言の特徴の分布を再構築するのに理想的ではない。とはいえ、最も有名な中英語の例を挙げると、J・R・R・トールキンはキャサリン・グループ(「B」)とアンクレネ・ウィッセ(「A」)の写本を比較することで、 AB文学方言を推測することができた。トールキンは古英語と古ノルド語に関する自身の知識を駆使し、何千もの動詞を手作業で数え、分類しながら、13世紀まで古英語の要素を保持していた北西ヘレフォードシャーに局地的な地域的文学標準を主張した。彼の集大成となる言語学論文「Ancrene Wisse and Hali Meiðhad」(1929年)は、「英語言語学の偉大な勝利の一つ」とも「言語学の最後のあがき」とも呼ばれている。[ 5 ]
この先駆的な研究の後、10年間、中英語方言研究は世代的な休止期間に入った。1952年に初期段階を迎えたLALMEが次の段階を切り開いた。写字生の標準化を強く主張する議論に後押しされ、歴史方言学者は写字生の忠実性の不均一性に制約されなくなった。中世方言研究は、写字生自身の言語への写字生の翻訳の相対的な一貫性に依拠しつつ、原典と写字生を区別する技術を開発するようになった。LALME の編纂者の一人であるアンガス・マッキントッシュは、「写本された中英語テキストのほとんどは…方言的に均質な言語で書かれていた」[ 6 ]と観察し、写字生が模範言語を地域変種に変換したことを示唆した。しかし、写字生はしばしば遠く離れた場所から写字センターに旅していたため、そのような変種は作成地の地理的領域を反映していない可能性があるという問題がある。こうした問題や、写字の多様性(例えば、literam、つまり文字通りの写字と、mischsprache、つまり混合言語の写字)から生じるその他の問題により、方言領域を固定するための明確な地域由来のテキストが重視されるようになった。こうした固定テキスト(多くの場合、書簡や法律文書)は、LALME の適合技術の基礎となっている。LALME の別の編纂者であるマイケル・ベンスキンは、適合技術を「馴染みのないアクセントがアクセントの連続体のどこに属しているかを発見する機械的な手段」と説明している。[ 7 ]これは、起源が不明なテキストの単語形式を、固定マトリックスで確認されている同様の形式と比較することによって行われる。この比較は、「アクセントの個々の要素が属していない 領域を段階的に排除することに依存する」[ 7 ] 。 このように比較されるのは、頻繁に確認されている特定の方言的顕著性の項目のみである。 LALMEの場合、これらの項目はテキスト形式のアンケートを通じて収集され、後に言語プロファイル(LP)に変換されました。[ 8 ] LAEMEの場合、比較的少数で断片的なテキストから求められる言語情報の量が膨大になるため、アンケートは実用的ではないと判断されました。代わりに、LAEMEはコーパスのデジタル化を選択しました。
LAEME が対象とする期間は、文法と音韻論的に非常に興味深い。なぜなら、この言語は古英語から広範囲にわたる屈折の喪失を経験していたが、その速度は地域によって異なっていたからである。音韻カテゴリーと屈折パラダイム内の変異は、方言と基本文法の両方において重要な意味を持つ。音韻的に変化する文字yogh、thorn、edhの出現した正書法は、この言語におけるその他の変化を示している。この期間の筆記者は、文字による書き写しと混合言語による書き写しを相対的に高く好んでおり、その結果、後の時代と比較して複合テキストの割合が高くなっている。古い模範形式が翻訳テキストで変更されずに残る遺存使用と、模範形式が筆記者の慣れのために維持される制約された選択は、方言の識別においてさらなる問題を引き起こす。[ 6 ]この時代の研究者は、テキストの大部分がラテン語またはフランス語で書かれていることから、テキストと音声のダイグロシアが 顕著であることも考慮に入れなければならない。 LAEMEのアンカーマトリックスは薄く断片的であるため、方言の適合は修正の対象となる情報に基づいた近似値である。LAEMEのテキストは全体的に地理的にも時間的にも不均一で、最初の半世紀と北部方言全般については極めて疎であり、南部方言と後半の半世紀にかけてははるかに密であり、そこでLALMEと重なり始める。[ 6 ]
上記の複雑さと難しさから、LAEMEの設計者は、ユーザーの研究ニーズに応じて検索および比較できる、語彙文法的にタグ付けされたテキストのデジタル化されたコーパスを中心にアトラスを構築することを余儀なくされました。アンケートの回答から言語プロファイルを作成する代わりに、テキスト辞書(各テキスト言語の分類学的目録)は、タグ付けされたテキストから派生しています。[ 9 ] 独立した検索機能により、学者や研究者が独自の形式およびタグ辞書、特徴マップ、およびコンコーダンスを作成できるため、LAEMEの使用は分野を超えて拡大します。LAEMEは、一般向けに多機能な言語ツールのスイートを提供することで、方言リソースとしての役割を超えています。この汎用性は、アンガス・マッキントッシュのLAEMEに対する進歩的なビジョンと一致しており、彼はLAEMEを「主に言語学に関心のある人よりも、中世イングランドの文学、文化、社会構造に関心のある人に利益をもたらす可能性が高い」と考えていました。[ 10 ]
多機能な LAEME ツールの例として、コンコーダンスがあります。ユーザーは、まずタグの種類 (接尾辞、文法語、活用、語彙) を選択し、検索文字列を入力し、次に位置制限 (先頭、中間、末尾) を入力します。この検索の後には、ユーザーが郡、検索文字列の前後の単語数、およびソート パラメーター (形式、タグ、日付、ファイル) を指定できるフィルター セットがあります。最後に、ユーザーは検索によって生成された特定のタグ付き形式を選択できます。結果として得られるコンコーダンスのエントリは、写本の説明と対応するテキスト辞書にリンクしています。[ 11 ] ユーザーは、複数のファイル 形式で利用可能なコード化されたソースにインデックス付けされた項目の文脈付きインスタンスを表示できます。同様のプロセスを使用して、頻度カウント付きのタグ辞書と形式辞書を作成したり、特徴マップを生成したりできます。
{{cite web}}: CS1 maint: 複数の名前: 著者リスト (リンク)