Etichetarea secvențelor
Definition
Etichetarea secvențelor implică predicția unei etichete categorice pentru fiecare token …
Terms tagged with NLP
Etichetarea secvențelor implică predicția unei etichete categorice pentru fiecare token …
Îndoirea semantică se referă la procesul de comprimare a încorporărilor vectoriale …
Similaritatea propozițiilor măsoară gradul de suprapunere semantică dintre două …
Transformatorii de propoziții sunt extensii ale modelelor tradiționale Transformer (cum …
Aceasta depășește structura sintactică pentru a interpreta intenția și semnificația reală …
Qwen3.5 denotă o lansare specifică în linia Qwen, dezvoltată de Alibaba Cloud. Această …
Qwen reprezintă o familie de modele lingvistice mari avansate create de Tongyi Lab din …
Pythia este o serie de modele lingvistice mari (LLM) open-source create de EleutherAI, …
Acest termen cuprinde produsele comerciale și de cercetare create de OpenAI, un laborator …
Un agent pedagogic este un component software, adesea reprezentat sub forma unui personaj …
Parafrazarea în Procesarea Limbajului Natural implică generarea unor expresii alternative …
P-Tuning (Prompt Tuning) este o tehnică concepută pentru a adapta modelele lingvistice …
Recunoașterea Optică a Caracterelor (OCR) utilizează algoritmi de procesare a imaginilor …
Identificarea limbii materne (NLI) este un subdomeniu al procesării limbajului natural …
Modelele multilingve sunt concepute pentru a gestiona intrări lingvistice diverse fără a …
Generarea de măști implică producerea de măști spațiale sau temporale care determină care …
Acest domeniu combină tehnicile de învățare automată cu procesarea limbajului natural și …
În contextul terminologiei moderne IA, Lyra denotă adesea sisteme IA specializate axate …
MAUVE este o măsurătoare statistică concepută pentru a evalua cât de apropiat este …
Contextul lung se referă la capacitatea modelelor bazate pe transformere de a gestiona …
Înrădăcinată în teoria actului de vorbire și în pragmatică, această perspectivă …
Abordarea „LLM ca Judecător” este un paradigmă de evaluare în care un model lingvistic …
Metodele de încorporare a grafurilor de cunoștințe, cum ar fi TransE sau DistMult, …
Recunoașterea inteligentă a cuvintelor se referă la tehnologii avansate de recunoaștere …
Generative Pre-trained Transformer 2 (GPT-2) este un model de limbaj autoregresiv care …
GPT-5.6 se referă la o versiune speculativă sau viitoare în linia Modelelor Linguistice …
Umplerea măștii este un obiectiv fundamental de pre-antrenare utilizat în modelele bazate …
ExBERT oferă interpretabilitate modelului transformator BERT analizând importanța …
Clasificarea documentelor este o sarcină fundamentală de procesare a limbajului natural …
ELMo generează încorporări de cuvinte sensibile la context procesând textul de intrare …
TriviaQA este un set de date conceput pentru răspunsul la întrebări în domeniu deschis, …
Setul de date WikiHow constă în aproximativ 60.000 de articole de tip „cum se face” …
Wikipedia este una dintre cele mai mari și cuprinzătoare colecții de cunoștințe umane …
Setul de date Yahoo Answers Topics este un subset al arhivei mai mari Yahoo Answers, …
S2ORC este un corpus cuprinzător de articole științifice derivat din Semantic Scholar. …
Setul de date Altlex constă în perechi de propoziții care împărtășesc același sens …
Quora Question Pairs (QQP) este un set de date de clasificare binară care conține peste …
Seturile de date de compresie a propozițiilor constau în perechi unde propoziția țintă …
BookCorpus este o colecție de texte provenite din peste 10.000 de cărți nepublicate, …
Câmpurile aleatoare condiționate (CRF) sunt o clasă de modele discriminative utilizate …
Umorul computațional studiază modul în care mașinile pot produce sau interpreta glume, …
Cunoașterea de bun-simț se referă la cantitatea vastă de informații implicite despre …
Acest concept se concentrează pe manipularea textului unde unitatea fundamentală de …
Deși istoric se referea la taxonomia educațională a lui Benjamin Bloom, în contextele …
BERT este o tehnică de învățare automată bazată pe transformatori pentru preantrenarea în …
Această tehnică de procesare a limbajului natural reprezintă textul ca un multiset de …
Scribii medicali automatizați utilizează tehnologii de procesare a limbajului natural și …
Termenul ASR-complet indică faptul că un sistem de Recunoaștere Automată a Vorbirii a …
Modelele de limbă vizuală, adesea referite ca Modele Linguistice Mari Multimodale …
Traducerea în IA se referă la traducerea automată neuronală, unde modelele de învățare …
Rezumatul textual reduce volumele mari de text în versiuni mai scurte fără a pierde …
Căutarea semantică interpretează intenția și semnificația contextuală din spatele unei …
Deoarece Transformer-urile procesează toate tokenurile în paralel, spre deosebire de …
Răspunsul la Întrebări (QA) implică recuperarea sau generarea de răspunsuri accurate la …
Recunoașterea Entităților Numite (NER) este un sub-sarcină a extragerii informațiilor …
Aceste modele mapează datele cu dimensiuni mari într-un spațiu vectorial continuu de …
În modelele secvență-la-secvență, decodorul preia vectorul de context produs de encodor …
Codificarea perechilor de octeți (BPE) este o tehnică de compresie a datelor adaptată …
Învățarea auto-supervizată este un subdomeniu al învățării automate în care semnalul de …
Învățarea few-shot permite modelelor de învățare automată să generalizeze din date foarte …
Introdus în lucrarea ‘Attention Is All You Need’, arhitectura Transformer a …
Tokenurile sunt blocurile fundamentale de construcție ale datelor de intrare în PNL …
Tokenizarea este un pas critic de preprocesare în Procesarea Limbajului Natural (PNL/NLP) …
Analiza semantică în IA se concentrează pe înțelegerea semnificației subiacente a …
Un prompt servește ca interfață principală pentru interacțiunea cu modelele lingvistice …
În comunicarea digitală și contextele de date AI, un ‘post’ se referă la o …
Pre-antrenarea este o tehnică fundamentală în învățarea profundă, unde un model învață …
Procesarea limbajului natural (NLP) este un subdomeniu al inteligenței artificiale care …
Atenția Multi-Cap extinde mecanismul standard de atenție rulându-l de mai multe ori în …
În contextul IA, termenul „lung” descrie adesea capacitatea de a procesa intrări …
Modelele Lingvistice Mari (LLM) sunt sisteme avansate de inteligență artificială bazate …
Deși nu este un termen tehnic algoritmic specific AI, „în schimb” este crucial în …
Sistemele de IA ierarhice organizează informația sau controlul într-o structură …
În inteligența artificială, generarea se referă la capacitatea modelelor, în special a …
În procesarea limbajului natural, contextul este crucial pentru rezolvarea …
Încorporările sunt reprezentări vectoriale dense ale datelor, unde relațiile semantice …
Un mecanism de atenție permite unui model să evalueze dinamic importanța diferitelor …