Dataset:Embedding Data/Specter
term_id: datasetembedding_dataspecter
Category: training_techniques
Definition
De Specter-dataset is opgebouwd uit een enorme verzameling informaticapapers, waarbij gebruik wordt gemaakt van citatienetwerken om supervisieerde leersignalen te creëren. Het koppelt abstracten aan citerende papers om
Summary
Een dataset op grote schaal gebaseerd op publicaties en citaten uit de informatica, ontworpen voor het trainen van modellen voor het embedden van academische papers.
Key Concepts
- Citatienetwerken
- Academische NLP
- Supervisieerde Embeddings
- Papergelijkenis
Use Cases
- Aanbeveling van onderzoeksartikelen
- Geautomatiseerde citatenanalyse
- Zoeken in wetenschappelijke literatuur