Dataset:Snli

term_id: datasetsnli

Category: basic_concepts

Definition

SNLI er et benchmarkdatasæt, der indeholder over 500.000 mærkede sætningspar annoteret med tre klasser: implikation, modsigelse og neutral. Det blev oprettet for at fremme forskning i naturlig sprogbehandling

Summary

Stanford Natural Language Inference Corpus, et stort datasæt af engelske sætninger parret med menneskeskrevne etiketter for tekstuel implikation.

Key Concepts

  • Naturlig sproginferens
  • Tekstuel implikation
  • Sætningspar
  • Benchmark

Use Cases

  • Vurdering af modeller til semantisk lighed
  • Træning af NLI-klassifikatorer
  • Forskning i logisk ræsonnement inden for NLP