Dataset:Snli

term_id: datasetsnli

Category: basic_concepts

Definition

SNLI är ett benchmark-dataset som innehåller över 500 000 märkta meningspar annoterade med tre klasser: entalitet, motsägelse och neutral. Det skapades för att främja forskning inom naturligt språk

Summary

Stanford Natural Language Inference Corpus, en stor datamängd av engelska meningar parade med mänskligt skrivna etiketter för textuell entalitet.

Key Concepts

  • Naturlig språkinferens
  • Textuell entalitet
  • Meningspar
  • Benchmark

Use Cases

  • Utvärdering av modeller för semantisk likhet
  • Träning av NLI-klassificerare
  • Forskning om logiskt resonemang inom NLP