Dataset:Ms Marco

term_id: datasetms_marco

Category: basic_concepts

Definition

MS MARCO (Microsoft Machine Reading Comprehension) is een veelgebruikte dataset in de natuurlijke taalverwerking, met name voor informatieretrieval en vraag-antwoord-systemen. De dataset bestaat uit geanonimiseerde zoekopdrachten van Google gekoppeld aan relevante documentfragmenten.

Summary

Microsoft Machine Reading Comprehension Dataset, een grootschalige verzameling van echte zoekopdrachten en relevante documentfragmenten die worden gebruikt voor het trainen van informatieretrievalsystemen.

Key Concepts

  • Informatieretrieval
  • Fragmentrangschikking
  • Zoekopdrachten
  • Machine Reading Comprehension

Use Cases

  • Het trainen van zoekmachines
  • Ontwikkelen van vraag-antwoord-systemen
  • Benchmarken van retrievemodels