Набор данных: Векторные представления текста / Wikianswers

term_id: datasetembedding_datawikianswers

Category: training_techniques

Definition

Этот набор данных содержит миллионы пар вопросов и ответов, собранных с ныне несуществующей платформы WikiAnswers. Он в основном используется для обучения моделей плотного поиска отрывков (dense passage retrieval) и семантического сопоставления. Используя

Summary

Набор данных, содержащий пары вопросов и ответов с платформы WikiAnswers, используемый для обучения моделей пониманию намерений и семантического эквивалента.

Key Concepts

  • Вопросно-ответные системы (QA)
  • Семантическое сопоставление
  • Распознавание намерений
  • Пары вопрос-ответ

Use Cases

  • Обучение QA-ботов
  • Оптимизация семантического поиска
  • Методы расширения запросов