Dataset:Multi Nli

term_id: datasetmulti_nli

Category: basic_concepts

Definition

MultiNLI is een crowdsourced corpus beschikbaar via de GLUE-benchmark, ontworpen om natuurlijke taalinferentie (NLI) te evalueren over verschillende genres van gesproken en geschreven tekst. Het biedt premisse-hypothese paren om te bepalen of een hypothese volgt uit, tegengesteld is aan of onafhankelijk is van de premisse.

Summary

Multi-Genre Natural Language Inference Corpus, een grote dataset met miljoenen menselijk geschreven Engelse zinnen met gouden menselijke annotaties voor tekstuele entailedheid.

Key Concepts

  • Natuurlijke Taalinferentie
  • Tekstuele Entailedheid
  • GLUE Benchmark
  • Semantische Similariteit

Use Cases

  • Evalueren van semantisch begrip
  • Trainen van NLI-modellen
  • Generalisatietesten over verschillende genres