Набор данных: Векторные представления текста / Specter
term_id: datasetembedding_dataspecter
Category: training_techniques
Definition
Набор данных Specter создан на основе обширной коллекции статей по компьютерным наукам, используя сети цитирования для создания сигналов для обучения с учителем. Он сопоставляет аннотации с цитирующими их статьями для
Summary
Крупномасштабный набор данных на основе публикаций и цитирований в области компьютерных наук, разработанный для обучения моделей эмбеддингов научных статей.
Key Concepts
- Сети цитирования
- NLP в академической среде
- Эмбеддинги с учителем
- Сходство статей
Use Cases
- Рекомендация исследовательских статей
- Автоматический анализ цитирования
- Поиск по научной литературе