データセット: Snli

term_id: datasetsnli

Category: basic_concepts

Definition

SNLIは、50万件以上のラベル付き文ペアを含むベンチマークデータセットで、「含意(entailment)」「矛盾(contradiction)」「中立(neutral)」の3つのクラスで注釈が付けられています。これは自然言語推論の研究を推進するために作成されました。

Summary

Stanford Natural Language Inference Corpus(SNLI)は、英語の文ペアと、人間が記述したテキストの含意ラベルを備えた大規模データセットです。

Key Concepts

  • 自然言語推論
  • テキスト含意
  • 文ペア
  • ベンチマーク

Use Cases

  • 意味的類似性モデルの評価
  • NLI分類器の訓練
  • 自然言語処理における論理推論の研究