Dataset: TriviaQA
Definition
TriviaQA er et datasett designet for åpen domene-spørsmålsbesvarelse, med over en million …
Terms tagged with Datasets
TriviaQA er et datasett designet for åpen domene-spørsmålsbesvarelse, med over en million …
WikiHow-datasettet består av omtrent 60 000 hvordan-artikler samlet inn fra …
Wikipedia er en av de største og mest omfattende samlingene av menneskelig kunnskap …
Datasettet Yahoo Answers Topics er en delmengde av den større Yahoo Answers-arkivet, med …
Helpsteer2 er et kuratert datasett lansert av NVIDIA som inneholder parvise …
S2ORC er et omfattende korpus av vitenskapelige artikler hentet fra Semantic Scholar. Det …
Dette datasettet består av setninger og avsnitt hentet fra Simple English Wikipedia, en …
Dette datasettet inneholder millioner av spørsmål-svar-par som er skrapet fra den nå …
Altlex-datasettet består av setningspar som deler samme underliggende betydning, men …
Flickr30K Captions er et mye brukt benchmark-datasett som består av 31 783 bilder, der …
PAQ-datasettet (Pseudo-Answer Quality) inneholder millioner av automatisk genererte …
Quora Question Pairs (QQP) er et binært klassifiseringsdatasett som inneholder over 400 …
Datasett for setningskomprimering består av par der målsetningen er en forkortet versjon …
The Stack Dedup er et spesialisert delmengde av The Stack, et massivt arkiv med åpen …
BookCorpus er en samling tekster fra over 10 000 upubliserte bøker, skrapet fra …
ELI5 (Explain Like I’m Five) er et datasett hentet fra Reddit-samfunnet med samme …
AZFinText er et stort, annotert korpus spesielt kuratert for analyse av kinesisk …