Zbiór danych: Multi Nli
term_id: datasetmulti_nli
Category: basic_concepts
Definition
MultiNLI to zbiór danych pozyskany metodą tłumaczenia społecznościowego (crowdsourcing), dostępny poprzez benchmark GLUE, zaprojektowany do oceny wnioskowania w języku naturalnym (NLI) w różnych gatunkach tekstu mówionego i pisanego. Zapewnia pary przesłanek i hipotez do oceny, czy hipoteza wynika z przesłanki, jej zaprzeczeniem jest, czy też nie ma z nią związku.
Summary
Multi-Genre Natural Language Inference Corpus, duży zbiór danych zawierający miliony ludzko napisanych zdań w języku angielskim ze złotymi etykietami ludzkimi dla wnioskowania tekstowego.
Key Concepts
- Wnioskowanie w języku naturalnym
- Wynikanie tekstowe
- Benchmark GLUE
- Podobieństwo semantyczne
Use Cases
- Ocena zrozumienia semantycznego
- Trenowanie modeli wnioskowania (NLI)
- Testowanie uogólniania across różne gatunki tekstu