Dataset:Ms Marco
term_id: datasetms_marco
Category: basic_concepts
Definition
MS MARCO (Microsoft Machine Reading Comprehension) je široce používaný dataset v oblasti zpracování přirozeného jazyka, zejména pro informační vyhledávání a odpovídání na otázky. Skládá se z anonymizovaných vyhledávacích dotazů uživatelů Google a relevantních úryvků z dokumentů.
Summary
Dataset Microsoft Machine Reading Comprehension, rozsáhlá sbírka skutečných vyhledávacích dotazů a příslušných úryvků dokumentů používaná pro trénování systémů informačního vyhledávání.
Key Concepts
- Informační vyhledávání
- Řazení úryvků (Passage Ranking)
- Vyhledávací dotazy
- Strojové čtení s porozuměním
Use Cases
- Trénování vyhledávačů
- Vývoj systémů pro odpovídání na otázky
- Benchmarkové hodnocení modelů pro vyhledávání