Dataset:Snli

term_id: datasetsnli

Category: basic_concepts

Definition

SNLI je benchmarková sada dat obsahující více než 500 000 označených dvojic vět anotovaných třemi třídami: odvození (entailment), spor (contradiction) a neutrální vztah. Byla vytvořena k podpoře výzkumu v oblasti přirozeného jazyka, zejména v porozumění sémantickým vztahům mezi větami.

Summary

Stanford Natural Language Inference Corpus, rozsáhlá sada dat anglických vět spárovaných s lidsky napsanými štítky textuálního odvození.

Key Concepts

  • Inferece přirozeného jazyka (NLI)
  • Textuální odvození
  • Párové věty
  • Benchmark

Use Cases

  • Vyhodnocování modelů sémantické podobnosti
  • Trénování klasifikátorů NLI
  • Výzkum logického usuzování v NLP