Zbiór danych: Multi Nli

term_id: datasetmulti_nli

Category: basic_concepts

Definition

MultiNLI to zbiór danych pozyskany metodą tłumaczenia społecznościowego (crowdsourcing), dostępny poprzez benchmark GLUE, zaprojektowany do oceny wnioskowania w języku naturalnym (NLI) w różnych gatunkach tekstu mówionego i pisanego. Zapewnia pary przesłanek i hipotez do oceny, czy hipoteza wynika z przesłanki, jej zaprzeczeniem jest, czy też nie ma z nią związku.

Summary

Multi-Genre Natural Language Inference Corpus, duży zbiór danych zawierający miliony ludzko napisanych zdań w języku angielskim ze złotymi etykietami ludzkimi dla wnioskowania tekstowego.

Key Concepts

  • Wnioskowanie w języku naturalnym
  • Wynikanie tekstowe
  • Benchmark GLUE
  • Podobieństwo semantyczne

Use Cases

  • Ocena zrozumienia semantycznego
  • Trenowanie modeli wnioskowania (NLI)
  • Testowanie uogólniania across różne gatunki tekstu