Datasetti: Snli

term_id: datasetsnli

Category: basic_concepts

Definition

SNLI on benchmark-tietojoukko, joka sisältää yli 500 000 merkittyä lauseparia, jotka on annotoitu kolmella luokalla: entaileminta (päättely), ristiriita ja neutraali. Se on luotu edistämään luonnollisen kielen käsittelyn tutkimusta.

Summary

Stanford Natural Language Inference Corpus, suuri englanninkielisten lauseparien tietojoukko, jossa on ihmisten kirjoittamia tekstuaalisia päättelymerkintöjä.

Key Concepts

  • Luonnollisen kielen päättely (NLI)
  • Tekstuaalinen entaileminta
  • Lauseparit
  • Benchmark

Use Cases

  • Semanttisen samankaltaisuuden mallien arviointi
  • NLI-luokittelijoiden koulutus
  • Loogisen päättelyn tutkiminen NLP:ssä