Dataset:Multi Nli
term_id: datasetmulti_nli
Category: basic_concepts
Definition
MultiNLI este un corpus colectat prin muncă colaborativă (crowdsourcing), disponibil prin benchmark-ul GLUE, conceput pentru a evalua inferența în limbajul natural (NLI) pe diverse genuri de text vorbit și scris. Oferă perechi de premise și ipoteze, etichetate ca entailed (implicat), neutral (neutru) sau contradicție (contradicție), permițând modelelor să învețe relațiile semantice complexe între enunțuri.
Summary
Corpusul Multi-Genre de Inferență Limbaj Natural, un set de date mare care conține milioane de propoziții scrise de oameni în limba engleză, cu annotații umane de referință pentru implicarea textuală.
Key Concepts
- Inferența în limbajul natural
- Implicarea textuală
- Benchmark-ul GLUE
- Similaritatea semantică
Use Cases
- Evaluarea înțelegerii semantice
- Antrenarea modelelor NLI
- Testarea generalizării pe diferite genuri de text