Zbiór danych: Ms Marco
term_id: datasetms_marco
Category: basic_concepts
Definition
MS MARCO (Microsoft Machine Reading Comprehension) to szeroko wykorzystywany zbiór danych w przetwarzaniu języka naturalnego, szczególnie w obszarze wyszukiwania informacji i odpowiadania na pytania. Składa się z anonimizowanych zapytań wyszukiwania oraz powiązanych z nimi fragmentów dokumentów, co czyni go kluczowym zasobem do trenowania modeli rankingu pasażów.
Summary
Microsoft Machine Reading Comprehension Dataset, duży zbiór rzeczywistych zapytań wyszukiwania i odpowiednich fragmentów dokumentów używany do trenowania systemów wyszukiwania informacji.
Key Concepts
- Wyszukiwanie informacji
- Ranking pasażów
- Zapytania wyszukiwania
- Maszynowe rozumienie tekstu
Use Cases
- Trenowanie silników wyszukiwania
- Rozwijanie systemów odpowiadania na pytania
- Benchmarkowanie modeli wyszukiwania