Dataset:Ms Marco
term_id: datasetms_marco
Category: basic_concepts
Definition
MS MARCO (Microsoft Machine Reading Comprehension) is een veelgebruikte dataset in de natuurlijke taalverwerking, met name voor informatieretrieval en vraag-antwoord-systemen. De dataset bestaat uit geanonimiseerde zoekopdrachten van Google gekoppeld aan relevante documentfragmenten.
Summary
Microsoft Machine Reading Comprehension Dataset, een grootschalige verzameling van echte zoekopdrachten en relevante documentfragmenten die worden gebruikt voor het trainen van informatieretrievalsystemen.
Key Concepts
- Informatieretrieval
- Fragmentrangschikking
- Zoekopdrachten
- Machine Reading Comprehension
Use Cases
- Het trainen van zoekmachines
- Ontwikkelen van vraag-antwoord-systemen
- Benchmarken van retrievemodels