Datasæt: Ms Marco

term_id: datasetms_marco

Category: basic_concepts

Definition

MS MARCO (Microsoft Machine Reading Comprehension) er et bredt anvendt datasæt inden for naturlig sprogbehandling, især til informationshentning og spørgsmål-svar-systemer. Det består af anonymiserede søgeforespørgsler.

Summary

Microsoft Machine Reading Comprehension Dataset, et omfattende samling af reelle søgeforespørgsler og relevante dokumentudsnit, der bruges til træning af informationshentesystemer.

Key Concepts

  • Informatonshentning
  • Rangering af Udsnit
  • Søgeforespørgsler
  • Maskinlæsningssforståelse

Use Cases

  • Træning af søgemaskiner
  • Udvikling af spørgsmål-svar-systemer
  • Benchmarking af hente modeller