Zbiór danych: Ms Marco

term_id: datasetms_marco

Category: basic_concepts

Definition

MS MARCO (Microsoft Machine Reading Comprehension) to szeroko wykorzystywany zbiór danych w przetwarzaniu języka naturalnego, szczególnie w obszarze wyszukiwania informacji i odpowiadania na pytania. Składa się z anonimizowanych zapytań wyszukiwania oraz powiązanych z nimi fragmentów dokumentów, co czyni go kluczowym zasobem do trenowania modeli rankingu pasażów.

Summary

Microsoft Machine Reading Comprehension Dataset, duży zbiór rzeczywistych zapytań wyszukiwania i odpowiednich fragmentów dokumentów używany do trenowania systemów wyszukiwania informacji.

Key Concepts

  • Wyszukiwanie informacji
  • Ranking pasażów
  • Zapytania wyszukiwania
  • Maszynowe rozumienie tekstu

Use Cases

  • Trenowanie silników wyszukiwania
  • Rozwijanie systemów odpowiadania na pytania
  • Benchmarkowanie modeli wyszukiwania