Dataset: Embedding Data/Specter

term_id: datasetembedding_dataspecter

Category: training_techniques

Definition

Il dataset Specter è costruito a partire da una vasta collezione di articoli di Informatica, utilizzando le reti di citazione per creare segnali di apprendimento supervisionato. Accoppia gli abstract con gli articoli che li citano per

Summary

Un dataset su larga scala basato su pubblicazioni e citazioni nel campo dell’Informatica, progettato per addestrare modelli di embedding per articoli accademici.

Key Concepts

  • Reti di Citazione
  • NLP Accademico
  • Embedding Supervisionati
  • Similarità tra Articoli

Use Cases

  • Raccomandazione di articoli di ricerca
  • Analisi automatizzata delle citazioni
  • Ricerca nella letteratura scientifica