Tekstklassificering
Definition
Tekstklassificering er en opgave inden for overvåget læring, hvor algoritmer tildeler …
Terms tagged with NLP
Tekstklassificering er en opgave inden for overvåget læring, hvor algoritmer tildeler …
Sekvensmærkning involverer at forudsige en kategorisk etiket for hvert token i en givet …
Semantisk foldning refererer til processen med at komprimere komplekse, højdimensionale …
Sentence Transformers er udvidelser af traditionelle Transformer-modeller (som BERT), der …
Sætningssimilaritet måler graden af semantisk overlap mellem to forskellige sætninger. …
Den går ud over syntaktisk struktur til at fortolke den faktiske hensigt og betydning af …
Qwen3.5 betegner en specifik udgivelse i Qwen-linjen udviklet af Alibaba Cloud. Denne …
Qwen repræsenterer en familie af avancerede store sprogmodeller skabt af Alibaba Groups …
Pythia er en serie af open-source store sprogmodeller (LLM’er) skabt af EleutherAI, …
Dette begreb omfatter de kommercielle og forskningsprodukter, der er skabt af OpenAI, et …
En pædagogisk agent er en softwarekomponent, ofte inkarneret som en virtuel karakter, der …
Omformulering inden for Natural Language Processing involverer generering af alternative …
P-Tuning (Prompt Tuning) er en teknik designet til at tilpasse store fortrænede …
Optisk tegngenkendelse (OCR) bruger billedbehandlings- og mønstergenkendelsesalgoritmer …
Identifikation af modersmål (NLI) er et underfelt inden for naturlig sprogbehandling, der …
Multilinguale modeller er designet til at håndtere mangfoldige sproglige input uden at …
Maskegenerering indebærer produktion af rumlige eller tidsmæssige masker, der bestemmer, …
Dette felt kombinerer teknikker inden for maskinlæring med naturlig sprogbehandling og …
I konteksten af moderne AI-terminologi betegner Lyra ofte specialiserede AI-systemer …
MAUVE er et statistisk mål designet til at vurdere, hvor tæt outputtet fra en generativ …
Lang kontekst refererer til kapaciteten hos transformer-baserede modeller til at håndtere …
Forankret i talehandelteori og pragmatik understreger dette perspektiv, hvordan ytringer …
LLM som dommer er en evalueringsparadigme, hvor en stor sprogmodel fungerer som en …
Metoder til vidensgraf-indlejring, såsom TransE eller DistMult, transformerer diskrete …
Intelligent ordgenkendelse refererer til avancerede teknologier til optisk …
Generative Pre-trained Transformer 2 (GPT-2) er en autoregressiv sprogmodel, der bruger …
GPT-5.6 refererer til en spekulativ eller forestående version i slægten af OpenAI’s …
Fyld maske er et grundlæggende prætræningsmål, der bruges i transformer-baserede modeller …
ExBERT giver fortolkbarhed for BERT-transformermodellen ved at analysere vigtigheden af …
Dokumentklassificering er en grundlæggende opgave inden for naturlig sprogbehandling, …
ELMo genererer kontekstsensitive ordembeddings ved at behandle inputtekst gennem en …
TriviaQA er et datasæt designet til open-domain spørgsmålssvarende, med over en million …
WikiHow-datasættet består af cirka 60.000 ‘how-to’-artikler indsamlet fra …
Wikipedia er en af de største og mest omfattende samlinger af menneskelig viden …
Yahoo Answers Topics-datasættet er et undersæt af det større Yahoo Answers-arkiv, der …
S2ORC er et omfattende korpus af videnskabelige artikler afledt fra Semantic Scholar. Det …
Altlex-datasættet består af sætningspar, der deler den samme underliggende betydning, men …
Quora Question Pairs (QQP) er et binært klassificeringsdatasæt, der indeholder over …
Datasæt for sætningskomprimering består af par, hvor målsætningen er en forkortet version …
BookCorpus er en samling af tekster fra over 10.000 upublicerede bøger, der er udtrukket …
Vilkårlige Tilfeldige Felter (CRF’er) er en klasse af diskriminerende modeller, der …
Computational humor studerer, hvordan maskiner kan producere eller fortolke jokes, …
Almindelig viden refererer til den enorme mængde implicit information om hverdagsliv, …
This concept focuses on the manipulation of text where the fundamental unit of …
Selvom det historisk refererer til Benjamin Blooms pædagogiske taksonomi, betegner det i …
BERT er en transformer-baseret maskinlæringsmetode til fortræning af naturlig …
Denne teknik til naturlig sprogbehandling repræsenterer tekst som en multimsængde af ord …
Automatiserede medicinske skribenter bruger naturlig sprogbehandling og talegenkendelse …
Begrebet ASR-complete indikerer, at et automatisk talegenkendelsessystem har nået en …
Visionssprogsmodeller, ofte omtalt som multimodale store sprogmodeller (MLLM’er), …
Oversættelse inden for AI refererer til neuronal maskinoversættelse, hvor …
Tekstsammendrag reducerer store mængder tekst til kortere versioner uden at miste kritisk …
Semantisk søgning fortolker hensigten og den kontekstuelle betydning bag en forespørgsel, …
Da transformer-modeller behandler alle tokens parallelt i stedet for sekventielt som …
Question Answering (QA) involverer hentning eller generering af nøjagtige svar på …
Navngiven enhedsgenkendelse (NER) er en delopgave inden for informationsudtrækning, der …
Disse modeller kortlægger højdimensionelle data til et lavdimensionelt kontinuert …
I sekvens-til-sekvens-modeller tager decoderen den kontekstvektor, der er produceret af …
Byte Pair Encoding (BPE) er en datakomprimeringsteknik, der er tilpasset naturlig …
Selvstyret læring er en delmængde af maskinlæring, hvor supervisionsignalet udledes …
Few-shot-læring gør det muligt for maskinlæringsmodeller at generalisere fra meget …
Introduceret i artiklen ‘Attention Is All You Need’, revolutionerede …
Tokens er de fundamentale byggesten i inputdata inden for NLP (Natural Language …
Tokenisering er et kritisk forbehandlingsstep inden for naturlig sprogbehandling (NLP), …
Semantisk analyse inden for AI fokuserer på at forstå den underliggende mening af inputs …
En prompt fungerer som den primære grænseflade til interaktion med store sprogmodeller og …
For-træning er en grundlæggende teknik inden for dyb læring, hvor en model lærer brede …
I digitale kommunikations- og AI-datakontekster refererer et ‘indlæg’ til en …
Naturlig sprogbehandling (NLP) er et underfelt inden for kunstig intelligens, der …
Multi-Head Attention udvider den standard opmærksomhedsmechanisme ved at køre den flere …
I sammenhæng med AI beskriver ’lang’ ofte evnen til at behandle omfattende …
Store sprogmodeller (LLM’er) er avancerede kunstige intelligenssystemer baseret på …
Selvom det ikke er et teknisk AI-algoritmeterm, er ‘i stedet’ afgørende inden …
Hierarkiske AI-systemer organiserer information eller kontrol i en træ-lignende struktur …
Inden for kunstig intelligens refererer generering til modellers evne, især Generative …
Inden for naturlig sprogbehandling er kontekst afgørende for at opløse tvetydigheder, …
Indlejringer er tætte vektorrepræsentationer af data, hvor semantiske relationer bevares …
En opmærksomheds mekanisme giver en model mulighed for dynamisk at vægte betydningen af …