Dataset:Snli

term_id: datasetsnli

Category: basic_concepts

Definition

SNLI is een benchmarkdataset met meer dan 500.000 gelabelde zinparen, geannoteerd met drie klassen: implicatie (entailment), contradictie en neutraal. Het is gemaakt om onderzoek in natuurlijke taalverwerking vooruit te helpen.

Summary

Stanford Natural Language Inference Corpus, een grote dataset van Engelse zinnen gepaard met door mensen geschreven labels voor tekstuele implicatie.

Key Concepts

  • Natuurlijke Taalinferentie
  • Tekstuele Implicatie
  • Zinparen
  • Benchmark

Use Cases

  • Het evalueren van modellen voor semantische gelijkheid
  • Het trainen van NLI-classificators
  • Onderzoek naar logisch redeneren in NLP