Набор данных: Векторные представления текста / Wikianswers
term_id: datasetembedding_datawikianswers
Category: training_techniques
Definition
Этот набор данных содержит миллионы пар вопросов и ответов, собранных с ныне несуществующей платформы WikiAnswers. Он в основном используется для обучения моделей плотного поиска отрывков (dense passage retrieval) и семантического сопоставления. Используя
Summary
Набор данных, содержащий пары вопросов и ответов с платформы WikiAnswers, используемый для обучения моделей пониманию намерений и семантического эквивалента.
Key Concepts
- Вопросно-ответные системы (QA)
- Семантическое сопоставление
- Распознавание намерений
- Пары вопрос-ответ
Use Cases
- Обучение QA-ботов
- Оптимизация семантического поиска
- Методы расширения запросов