Dataset:Ms Marco

term_id: datasetms_marco

Category: basic_concepts

Definition

MS MARCO (Microsoft Machine Reading Comprehension) è un dataset ampiamente utilizzato nell’elaborazione del linguaggio naturale, in particolare per il recupero delle informazioni e la risposta alle domande. È composto da query di ricerca anonimizzate e dai relativi documenti.

Summary

Microsoft Machine Reading Comprehension Dataset, una raccolta su larga scala di query di ricerca reali e passaggi di documenti pertinenti utilizzati per addestrare sistemi di recupero delle informazioni.

Key Concepts

  • Recupero delle Informazioni
  • Classificazione dei Passaggi (Passage Ranking)
  • Query di Ricerca
  • Comprensione della Lettura Automatica

Use Cases

  • Addestramento di motori di ricerca
  • Sviluppo di sistemi di risposta alle domande
  • Benchmarking dei modelli di recupero