Zbiór danych: SNLI
term_id: datasetsnli
Category: basic_concepts
Definition
SNLI to zbiór danych referencyjnych zawierający ponad 500 000 oznaczonych par zdań, skategoryzowanych w trzech klasach: entajlment (wnioskowanie), sprzeczność i neutralność. Został stworzony, aby wesprzeć badania nad rozumieniem semantycznym w przetwarzaniu języka naturalnego.
Summary
Stanford Natural Language Inference Corpus, duży zbiór danych zdań angielskich sparowanych z etykietami wnioskowania tekstowego napisanymi przez ludzi.
Key Concepts
- Wnioskowanie w języku naturalnym
- Entajlment tekstowy
- Pary zdań
- Zbiór referencyjny (Benchmark)
Use Cases
- Ewaluacja modeli podobieństwa semantycznego
- Trenowanie klasyfikatorów wnioskowania (NLI)
- Badania nad rozumowaniem logicznym w NLP