Dataset:Ms Marco

term_id: datasetms_marco

Category: basic_concepts

Definition

MS MARCO (Microsoft Machine Reading Comprehension) je široce používaný dataset v oblasti zpracování přirozeného jazyka, zejména pro informační vyhledávání a odpovídání na otázky. Skládá se z anonymizovaných vyhledávacích dotazů uživatelů Google a relevantních úryvků z dokumentů.

Summary

Dataset Microsoft Machine Reading Comprehension, rozsáhlá sbírka skutečných vyhledávacích dotazů a příslušných úryvků dokumentů používaná pro trénování systémů informačního vyhledávání.

Key Concepts

  • Informační vyhledávání
  • Řazení úryvků (Passage Ranking)
  • Vyhledávací dotazy
  • Strojové čtení s porozuměním

Use Cases

  • Trénování vyhledávačů
  • Vývoj systémů pro odpovídání na otázky
  • Benchmarkové hodnocení modelů pro vyhledávání