Dataset:Snli
term_id: datasetsnli
Category: basic_concepts
Definition
SNLI er et benchmarkdatasæt, der indeholder over 500.000 mærkede sætningspar annoteret med tre klasser: implikation, modsigelse og neutral. Det blev oprettet for at fremme forskning i naturlig sprogbehandling
Summary
Stanford Natural Language Inference Corpus, et stort datasæt af engelske sætninger parret med menneskeskrevne etiketter for tekstuel implikation.
Key Concepts
- Naturlig sproginferens
- Tekstuel implikation
- Sætningspar
- Benchmark
Use Cases
- Vurdering af modeller til semantisk lighed
- Træning af NLI-klassifikatorer
- Forskning i logisk ræsonnement inden for NLP