Dataset:Multi Nli

term_id: datasetmulti_nli

Category: basic_concepts

Definition

MultiNLI este un corpus colectat prin muncă colaborativă (crowdsourcing), disponibil prin benchmark-ul GLUE, conceput pentru a evalua inferența în limbajul natural (NLI) pe diverse genuri de text vorbit și scris. Oferă perechi de premise și ipoteze, etichetate ca entailed (implicat), neutral (neutru) sau contradicție (contradicție), permițând modelelor să învețe relațiile semantice complexe între enunțuri.

Summary

Corpusul Multi-Genre de Inferență Limbaj Natural, un set de date mare care conține milioane de propoziții scrise de oameni în limba engleză, cu annotații umane de referință pentru implicarea textuală.

Key Concepts

  • Inferența în limbajul natural
  • Implicarea textuală
  • Benchmark-ul GLUE
  • Similaritatea semantică

Use Cases

  • Evaluarea înțelegerii semantice
  • Antrenarea modelelor NLI
  • Testarea generalizării pe diferite genuri de text