Dataset:Embedding Data/Specter

term_id: datasetembedding_dataspecter

Category: training_techniques

Definition

De Specter-dataset is opgebouwd uit een enorme verzameling informaticapapers, waarbij gebruik wordt gemaakt van citatienetwerken om supervisieerde leersignalen te creëren. Het koppelt abstracten aan citerende papers om

Summary

Een dataset op grote schaal gebaseerd op publicaties en citaten uit de informatica, ontworpen voor het trainen van modellen voor het embedden van academische papers.

Key Concepts

  • Citatienetwerken
  • Academische NLP
  • Supervisieerde Embeddings
  • Papergelijkenis

Use Cases

  • Aanbeveling van onderzoeksartikelen
  • Geautomatiseerde citatenanalyse
  • Zoeken in wetenschappelijke literatuur