Jonojen merkitseminen
Definition
Jonojen merkitsemisessä ennustetaan kategorinen luokka jokaiselle syötejonon tokenille, …
Terms tagged with NLP
Jonojen merkitsemisessä ennustetaan kategorinen luokka jokaiselle syötejonon tokenille, …
Lause-transformerit ovat perinteisten Transformer-mallien (kuten BERT) laajennoksia, …
Lauseiden samankaltaisuus mittaa kahden eri lauseen semanttista päällekkäisyyttä. Se …
Semanttinen taittaminen viittaa prosessiin, jossa monimutkaisia, korkeadimensioisia …
Se menee syntaktisen rakenteen yli tulkitsemalla kieliannostulojen todellista aikomusta …
Qwen3.5 tarkoittaa tiettyä julkaisua Alibaba Cloudin kehittämässä Qwen-sukupolvessa. Tämä …
Qwen edustaa Alibaba Groupin Tongyi Labin luomia edistyneitä suurten kielimalleja. Se …
Pythia on EleutherAI:n luoma avoimen lähdekoodin suuria kielimalleja (LLM) koskeva sarja, …
Tämä termi kattaa OpenAin, johtavan tekoälytutkimuslaboratorion, luomat kaupalliset ja …
Pedagoginen agenssi on ohjelmistokomponentti, joka on usein hahmottunut virtuaalihahmona …
Parafraasi luonnollisen kielen käsittelyssä (NLP) tarkoittaa syötteeksi annetulle …
P-Tuning (Prompt Tuning) on tekniikka, joka on suunniteltu mukauttamaan suuria …
Optinen merkkien tunnistus (OCR) käyttää kuvankäsittely- ja kuvioiden …
Emäkielen tunnistus (NLI) on luonnollen kielen käsittelyn alatekijä, joka keskittyy …
Monikielisiä malleja on suunniteltu käsittelemään monipuolisia kielellisiä syötteitä …
Maskin luominen sisältää tilallisten tai aikasaikaisten maskien tuottamisen, jotka …
Tämä ala yhdistää koneoppimistekniikat luonnollen kielen käsittelyyn ja datankaivamiseen …
Nykytekoälyterminologiassa Lyra tarkoittaa usein erikoistuneita tekoälijärjestelmiä, …
MAUVE on tilastollinen mittari, joka on suunniteltu arvioimaan, kuinka hyvin …
Pitkä konteksti viittaa muuntajapohjaisten mallien kapasiteettiin käsitellä laajoja …
Tämä näkökulma perustuu puhetapausteoriaan ja pragmaattiseen lingvistiikkaan, ja se …
LLM-tuomari on arviointiparadigma, jossa suuri kielimalli toimii automaattisena …
Tietokaavion upotusmenetelmät, kuten TransE tai DistMult, muuntavat diskreetit …
Älykäs tekstintunnistus viittaa edistyneisiin optisten merkkien tunnistus (OCR) …
Generative Pre-trained Transformer 2 (GPT-2) on autoregressiivinen kielimalli, joka …
GPT-5.6 viittaa spekulatiiviseen tai tulevaan versioon OpenAI:n suurten kielimallien …
Maski täyttö on perustavanlaatuinen esikoulutustavoite, jota käytetään muuntajiin …
ExBERT tarjoaa tulkitsemiskyvyn BERT-transformaattorimallille analysoimalla yksittäisten …
Asiakirjojen luokittelu on perustavanlaatuinen luonnollisen kielen käsittelyn tehtävä, …
ELMo luo kontekstiherkkiä sanaembeddingejä prosessoimalla syötekstin kaksisuuntaisen …
TriviaQA on aineisto, joka on suunniteltu avoimen alueen kysymyksiin vastaamiseen, ja …
WikiHow-aineisto koostuu noin 60 000 ohje-artikkelista, jotka on kerätty …
Wikipedia on yksi maailman suurimmista ja kattavimmista ihmiskunnan tiedon kokoelmista …
Yahoo Answers Topics -aineisto on osa laajempaa Yahoo Answers -arkistoa, keskittyen …
S2ORC on kattava kokoelma tieteellisiä artikkeleita Semantic Scholarista. Se sisältää …
Altlex-tietosarja koostuu lausepareista, joilla on sama perusmerkitys mutta jotka …
Lausepurkutietosarjat koostuvat pareista, joissa kohdelause on lähtölauseen lyhennetty …
Quora Question Pairs (QQP) on binäärinen luokittelutietosarja, joka sisältää yli 400 000 …
BookCorpus on kokoelma tekstejä yli 10 000 julkaisemattomasta kirjasta, joka on kerätty …
Ehtomat satunnaiskentät (CRF) ovat diskriminatiivisia malleja, joita käytetään yleisesti …
Laskennallinen huumori tutkii, miten koneet voivat tuottaa tai tulkita vitskejä, …
Terveen järjen tieto viittaa valtavaan määrään implisiittistä tietoa arkielämästä, …
Tämä käsite keskittyy tekstin manipulointiin, jossa laskennan perusyksikkö on yksi …
Vaikka historiallisesti se viittaa Benjamin Bloomin koulutustaksonomiaan, nykyaikaisissa …
BERT on Googlen kehittämä luonnollisen kielen käsittelyn (NLP) esikoulutusmenetelmä, joka …
Tämä luonnollen kielen käsittelyn tekniikka esittää tekstin sanan monijoukkona, …
Automaattiset lääketieteelliset sihteerit hyödyntävät luonnollisen kielen käsittelyä ja …
Termi ASR-complete tarkoittaa, että automaattinen puheentunnistusjärjestelmä on …
Visuaalisen kielen mallit, joita kutsutaan usein monimuotoisiksi suuriksi kielimalleiksi …
Tekoälyn käännös viittaa neuronaaliseen konekäännökseen, jossa syvät oppimismallit …
Tekstin tiivistäminen supistaa suuret tekstimäärät lyhyempiin versioihin menettämättä …
Semanttinen haku tulkitsee kyselyn tarkoituksen ja kontekstuaalisen merkityksen …
Kysymysten vastaus (QA) sisältää tarkkojen vastausten hakemisen tai generoimisen …
Koska muuntajat käsittelevät kaikki tokenit rinnakkain eivätkä peräkkäin kuten …
Nimien tunnistaminen (NER) on tietojen erottelualatehtävä, joka paikantaa tekstin nimetyt …
Nämä mallit kartoittavat korkeadimensioista dataa alemmadimensioiseen jatkuvaan …
Sekvenssi-sekvenssi-malleissa de-kooderi ottaa vastaan kooderilta tuotetun …
Byte Pair Encoding (BPE) on tietojen pakkaustekniikka, joka on sovellettu luonnollisen …
Itsenäinen valvottu oppiminen on osa koneoppimista, jossa valvontasignaali johdetaan …
Vähän esimerkkejä sisältävä oppiminen (few-shot learning) mahdollistaa koneoppimismallien …
Muunninarkkitehtuuri, joka esiteltiin artikkelissa “Attention Is All You …
Tokenit ovat NLP:n syötteen perusrakennuspalikoita, jotka edustavat yleensä sanoja, …
Tokenisointi on kriittinen esikäsittelyvaihe luonnollisen kielentarkastelun (NLP) …
Semanttinen analyysi tekevässä älykkyydessä keskittyy syötteiden taustalla olevan …
Kehote toimii ensisijaisena rajapintana vuorovaikutuksessa suurten kielimallien (LLM) ja …
Esikoulutus on syväoppimisen perustekniikka, jossa malli oppii laajoja piirteitä ja …
Digitaalisessa viestinnässä ja tekoälyn datayhteyksissä ‘viesti’ viittaa …
Luonnollisen kielen käsittely (NLP) on tekoälyn ala, joka yhdistää laskennallista …
Moni-Head Attention laajentaa vakiintunutta attention-mekanismia suorittamalla sen useita …
Tekoälyn kontekstissa ‘pitkä’ kuvaa usein kykyä käsitellä laajoja syötteitä, …
Suuret kielimallit (LLM) ovat kehittyneitä tekoälyjärjestelmiä, jotka perustuvat …
Vaikka ‘vaihtoehtoisesti’ ei ole tekninen tekoälyalgoritmi, se on ratkaisevan …
Hierarkkiset tekoälyjärjestelmät organisoivat tiedon tai ohjauksen puumaiseen …
Tekoälyssä generointi viittaa mallien, erityisesti Generatiivisten vastustajaverkostojen …
Luonnollisen kielen käsittelyssä konteksti on ratkaisevan tärkeää epäselvyyksien …
Upotukset ovat tiheitä vektoriesityksiä datasta, joissa semanttiset suhteet säilyvät …
Huomiomekanismi mahdollistaa mallille painottaa eri elementtien merkitystä …