Dataset:Multi Nli

term_id: datasetmulti_nli

Category: basic_concepts

Definition

MultiNLI je korpus shromážděný pomocí crowdsourcingu dostupný prostřednictvím benchmarku GLUE, navržený k vyhodnocování přirozeného jazykového usuzování (NLI) napříč různými žánry mluveného i psaného textu. Poskytuje dvojice premisa-hypotéza.

Summary

Korpus přirozeného jazykového usuzování napříč žánry, rozsáhlý dataset obsahující miliony lidsky psaných anglických vět se zlatými annotacemi pro textovou implikaci.

Key Concepts

  • Přirozené jazykové usuzování
  • Textová implikace
  • Benchmark GLUE
  • Sémantická podobnost

Use Cases

  • Vyhodnocování sémantického porozumění
  • Trénování modelů pro NLI
  • Testování generalizace napříč žánry