Dataset:Snli
term_id: datasetsnli
Category: basic_concepts
Definition
SNLI is een benchmarkdataset met meer dan 500.000 gelabelde zinparen, geannoteerd met drie klassen: implicatie (entailment), contradictie en neutraal. Het is gemaakt om onderzoek in natuurlijke taalverwerking vooruit te helpen.
Summary
Stanford Natural Language Inference Corpus, een grote dataset van Engelse zinnen gepaard met door mensen geschreven labels voor tekstuele implicatie.
Key Concepts
- Natuurlijke Taalinferentie
- Tekstuele Implicatie
- Zinparen
- Benchmark
Use Cases
- Het evalueren van modellen voor semantische gelijkheid
- Het trainen van NLI-classificators
- Onderzoek naar logisch redeneren in NLP