Datasæt: Trivia QA
Definition
TriviaQA er et datasæt designet til open-domain spørgsmålssvarende, med over en million …
Terms tagged with Datasets
TriviaQA er et datasæt designet til open-domain spørgsmålssvarende, med over en million …
WikiHow-datasættet består af cirka 60.000 ‘how-to’-artikler indsamlet fra …
Wikipedia er en af de største og mest omfattende samlinger af menneskelig viden …
Yahoo Answers Topics-datasættet er et undersæt af det større Yahoo Answers-arkiv, der …
Helpsteer2 er et kurateret datasæt udgivet af NVIDIA, der indeholder parvise …
S2ORC er et omfattende korpus af videnskabelige artikler afledt fra Semantic Scholar. Det …
Dette datasæt består af sætninger og afsnit udtrukket fra Simple English Wikipedia, en …
Dette datasæt indeholder millioner af spørgsmål-svar-par, der er scrapet fra den nu …
Altlex-datasættet består af sætningspar, der deler den samme underliggende betydning, men …
Flickr30K-billedtekster er et bredt anvendt benchmark-datasæt, der omfatter 31.783 …
PAQ-datasættet (Pseudo-Answer Quality) indeholder millioner af automatisk genererede …
Quora Question Pairs (QQP) er et binært klassificeringsdatasæt, der indeholder over …
Datasæt for sætningskomprimering består af par, hvor målsætningen er en forkortet version …
The Stack Dedup er en specialiseret delmængde af The Stack, et massivt lager af open …
BookCorpus er en samling af tekster fra over 10.000 upublicerede bøger, der er udtrukket …
ELI5 (Explain Like I’m Five) er et datasæt afledt af Reddit-fællesskabet med samme …
AZFinText er et stort, annoteret korpus specifikt udvalgt til analyse af kinesisk …