Loading article…
言語受容性コーパス(CoLA)は、大規模言語モデルを含む人工ニューラルネットワークが文章の文法的正しさを判断する能力を評価するためのベンチマークとして機能することを主な目的とするデータセットです。これは、出版された言語学文献からの10,657の英語の文章で構成されており、手動で文法的または非文法的にラベル付けされています。[1]
公開版
公開されている CoLA のバージョンには、トレーニング セットと開発セットに属する 9,594 の文が含まれています。保留テスト セット用に予約されている 1,063 の文は除外されています。
外部リンク
- Warstadt、Alex。「CoLA - 言語受容性コーパス」。
参考文献
