Dataset: TriviaQA
Definition
TriviaQA är en datamängd utformad för frågebesvarande inom öppna domäner, med över en …
Terms tagged with Datasets
TriviaQA är en datamängd utformad för frågebesvarande inom öppna domäner, med över en …
WikiHow-datasettet består av cirka 60 000 hur-till-artiklar insamlade från webbplatsen …
Wikipedia är en av de största och mest omfattande samlingarna av mänsklig kunskap …
Datamängden Yahoo Answers Topics är en delmängd av det större arkivet Yahoo Answers, med …
Helpsteer2 är en kuraterad datamängd släppt av NVIDIA som innehåller parvisa jämförelser …
S2ORC är ett omfattande korpus av vetenskapliga artiklar härlett från Semantic Scholar. …
Denna datamängd består av meningar och stycken extraherade från Simple English Wikipedia, …
Denna datamängd innehåller miljoner fråga-svar-par skrapade från den nu nedlagda …
Altlex-datasetet består av meningar som delar samma underliggande betydelse men använder …
Flickr30K Captions är ett brett använt benchmark-dataset bestående av 31 783 bilder, var …
PAQ-datasetet (Pseudo-Answer Quality) innehåller miljontals automatiskt genererade …
Quora Question Pairs (QQP) är ett binärt klassificeringsdataset som innehåller över 400 …
Dataset för meningskomprimering består av par där den målmening som är en förkortad …
The Stack Dedup är en specialiserad delmängd av The Stack, ett massivt arkiv med öppen …
BookCorpus är en samling texter från över 10 000 opublicerade böcker, insamlade från …
ELI5 (Explain Like I’m Five) är ett dataset härlett från Reddit-communityt med …
AZFinText är ett annoterat corpus i stor skala som specifikt har skapats för analys av …