Dataset:Snli

term_id: datasetsnli

Category: basic_concepts

Definition

SNLI er et benchmark-datasett som inneholder over 500 000 merkede setningspar annotert med tre klasser: implikasjon, motsetning og nøytral. Det ble laget for å fremme forskning i naturlig språkbehandling

Summary

Stanford Natural Language Inference Corpus, et stort datasett med engelske setninger parret med menneskeskrevne etiketter for tekstuell implikasjon.

Key Concepts

  • Naturlig språklig inferens
  • Tekstuell implikasjon
  • Setningspar
  • Benchmark

Use Cases

  • Vurdering av modeller for semantisk likhet
  • Trening av NLI-klassifikatorer
  • Forskning på logisk resonnement i NLP