Dataset:Ms Marco
term_id: datasetms_marco
Category: basic_concepts
Definition
MS MARCO (Microsoft Machine Reading Comprehension) è un dataset ampiamente utilizzato nell’elaborazione del linguaggio naturale, in particolare per il recupero delle informazioni e la risposta alle domande. È composto da query di ricerca anonimizzate e dai relativi documenti.
Summary
Microsoft Machine Reading Comprehension Dataset, una raccolta su larga scala di query di ricerca reali e passaggi di documenti pertinenti utilizzati per addestrare sistemi di recupero delle informazioni.
Key Concepts
- Recupero delle Informazioni
- Classificazione dei Passaggi (Passage Ranking)
- Query di Ricerca
- Comprensione della Lettura Automatica
Use Cases
- Addestramento di motori di ricerca
- Sviluppo di sistemi di risposta alle domande
- Benchmarking dei modelli di recupero