Dataset:Ms Marco

term_id: datasetms_marco

Category: basic_concepts

Definition

MS MARCO (Microsoft Machine Reading Comprehension) ist ein weit verbreiteter Datensatz im Bereich des Natural Language Processing, insbesondere für Information Retrieval und Question Answering. Er besteht aus anonymisierten Such

Summary

Microsoft Machine Reading Comprehension Dataset, eine umfangreiche Sammlung echter Suchanfragen und relevanter Dokumentausschnitte, die zum Training von Information-Retrieval-Systemen verwendet wird.

Key Concepts

  • Information Retrieval
  • Passage Ranking
  • Suchanfragen
  • Maschinelles Leseverständnis

Use Cases

  • Training von Suchmaschinen
  • Entwicklung von Frage-Antwort-Systemen
  • Benchmarking von Retrieval-Modellen