Dataset:Embedding Data/Wikianswers
term_id: datasetembedding_datawikianswers
Category: training_techniques
Definition
Deze dataset bevat miljoenen vraag-antwoordparen die zijn gescraped van het inmiddels opgeheven WikiAnswers-platform. Het wordt voornamelijk gebruikt voor het trainen van modellen voor dense passage retrieval en semantische matching. Door gebruik te maken van
Summary
Een dataset met vraag-antwoordparen van WikiAnswers, gebruikt voor het trainen van modellen om intentie en semantische equivalentie te begrijpen.
Key Concepts
- Vraag-Antwoordsystemen
- Semantische Matching
- Intentherkenning
- QA-paren
Use Cases
- Het trainen van QA-bots
- Optimalisatie van semantisch zoeken
- Technieken voor query-expansie