Zbiór danych: SNLI

term_id: datasetsnli

Category: basic_concepts

Definition

SNLI to zbiór danych referencyjnych zawierający ponad 500 000 oznaczonych par zdań, skategoryzowanych w trzech klasach: entajlment (wnioskowanie), sprzeczność i neutralność. Został stworzony, aby wesprzeć badania nad rozumieniem semantycznym w przetwarzaniu języka naturalnego.

Summary

Stanford Natural Language Inference Corpus, duży zbiór danych zdań angielskich sparowanych z etykietami wnioskowania tekstowego napisanymi przez ludzi.

Key Concepts

  • Wnioskowanie w języku naturalnym
  • Entajlment tekstowy
  • Pary zdań
  • Zbiór referencyjny (Benchmark)

Use Cases

  • Ewaluacja modeli podobieństwa semantycznego
  • Trenowanie klasyfikatorów wnioskowania (NLI)
  • Badania nad rozumowaniem logicznym w NLP