Dataset:Snli
term_id: datasetsnli
Category: basic_concepts
Definition
SNLI je benchmarková sada dat obsahující více než 500 000 označených dvojic vět anotovaných třemi třídami: odvození (entailment), spor (contradiction) a neutrální vztah. Byla vytvořena k podpoře výzkumu v oblasti přirozeného jazyka, zejména v porozumění sémantickým vztahům mezi větami.
Summary
Stanford Natural Language Inference Corpus, rozsáhlá sada dat anglických vět spárovaných s lidsky napsanými štítky textuálního odvození.
Key Concepts
- Inferece přirozeného jazyka (NLI)
- Textuální odvození
- Párové věty
- Benchmark
Use Cases
- Vyhodnocování modelů sémantické podobnosti
- Trénování klasifikátorů NLI
- Výzkum logického usuzování v NLP