Dataset:Multi Nli

term_id: datasetmulti_nli

Category: basic_concepts

Definition

MultiNLI är en korpus insamlad via folkröstning (crowdsourcing) som finns tillgänglig genom GLUE-benchmarken. Den är utformad för att utvärdera naturlig språkinferens (NLI) över olika genrer av talat och skrivet språk, och tillhandahåller premisser och hypoteser.

Summary

Multi-Genre Natural Language Inference Corpus, en stor datamängd med miljoner mänskligt skrivna engelska meningar med manuella annoteringar för textuell entalitet.

Key Concepts

  • Naturlig språkinferens
  • Textuell entalitet
  • GLUE-benchmark
  • Semantisk likhet

Use Cases

  • Utvärdering av semantisk förståelse
  • Träning av NLI-modeller
  • Test av generalisering över olika genrer