Detekce toxickosti
Definition
Detekce toxickosti využívá techniky zpracování přirozeného jazyka k analýze vstupního …
Terms tagged with NLP
Detekce toxickosti využívá techniky zpracování přirozeného jazyka k analýze vstupního …
Toxickost v AI se vztahuje ke generování nebo šíření obsahu, který je nedůstojný, …
Generování textu je základním aplikačním paradigmou v zpracování přirozeného jazyka, kde …
Klasifikace textu je úloha supervizovaného učení, kde algoritmy přiřazují předdefinované …
Označování sekvencí zahrnuje predikci kategorického štítku pro každý token v dané vstupní …
Podobnost vět měří stupeň sémantického překryvu mezi dvěma odlišnými větami. Jde nad …
Semantické skládání označuje proces komprese komplexních vektorových vložení vysoké …
Transformery pro věty jsou rozšířením tradičních modelů Transformer (jako je BERT), které …
Jde nad syntaktickou strukturu k interpretaci skutečného záměru a významu vstupů jazyka. …
Qwen3.5 označuje specifické vydání v linii modelů Qwen vyvinuté společností Alibaba …
Qwen představuje rodinu pokročilých velkých jazykových modelů vytvořenou laboratoří …
Pythia je série open-source velkých jazykových modelů (LLM) vytvořená organizací …
Tento termín zahrnuje komerční a výzkumné produkty vytvořené společností OpenAI, přední …
Pedagogický agent je softwarová součást, často ztělesněná jako virtuální postava, která …
Parafrazování v oblasti zpracování přirozeného jazyka zahrnuje generování alternativních …
P-Tuning (Prompt Tuning) je technika navržená pro přizpůsobení velkých předtrénovaných …
Optické rozpoznávání znaků (OCR) používá algoritmy zpracování obrazu a rozpoznávání vzorů …
Identifikace mateřského jazyka (NLI) je pododvětví zpracování přirozeného jazyka, které …
Vícejazyčné modely jsou navrženy tak, aby zvládaly rozmanité jazykové vstupy bez nutnosti …
Generování masek zahrnuje vytváření prostorových nebo časových masek, které určují, které …
Toto obor kombinuje techniky strojového učení s zpracováním přirozeného jazyka a těžbou …
V kontextu moderní terminologie AI často Lyra označuje specializované systémy zaměřené na …
MAUVE je statistická míra navržená k posouzení toho, jak velmi se výstup generativního …
Dlouhé kontexty označují kapacitu modelů založených na architektuře transformátoru …
Tato perspektiva vychází z teorie mluvních aktů a pragmatiky a zdůrazňuje, jak výroky …
Paradigma „LLM jako soudce“ (LLM-as-a-Judge) využívá velký jazykový model jako …
Metody vkládání znalostních grafů, jako jsou TransE nebo DistMult, transformují diskrétní …
Inteligentní rozpoznávání slov se týká pokročilých technologií optického rozpoznávání …
Generativní předtrénovaný transformátor 2 (GPT-2) je autoregresní jazykový model, který …
GPT-5.6 označuje spekulativní nebo nadcházející verzi v linii velkých jazykových modelů …
Vyplnění masky je základním cílem předvýcviku používaným v modelech založených na …
ExBERT poskytuje interpretovatelnost modelu BERT (transformeru) analýzou důležitosti …
ELMo generuje kontextově citlivá slovní vložení zpracováním vstupního textu …
Klasifikace dokumentů je základní úlohou zpracování přirozeného jazyka, při které …
TriviaQA je datová sada navržená pro odpovědi na otázky v otevřené doméně, která obsahuje …
Datová sada WikiHow se skládá z přibližně 60 000 návodů shromážděných z webové stránky …
Wikipedie je jedním z největších a nejpřehlednějších souborů lidských znalostí dostupných …
Datová sada Yahoo Answers Topics je podsborem většího archivu Yahoo Answers, zaměřujícím …
S2ORC je komplexní korpus vědeckých článků odvozený ze Semantic Scholaru. Obsahuje plný …
Datová sada Altlex se skládá z dvojic vět, které sdílejí stejný základní význam, ale …
Quora Question Pairs (QQP) je datová sada pro binární klasifikaci obsahující více než 400 …
Datové sady pro kompresi vět se skládají z dvojic, kde cílová věta je zkrácenou verzí …
BookCorpus je sbírka textů z více než 10 000 nepublikovaných knih stažených z internetu. …
Podmíněná náhodná pole (CRF) jsou třídou diskriminačních modelů běžně používaných v …
Výpočetní humor zkoumá, jak stroje mohou produkovat nebo interpretovat vtipy, slovní …
Zdravý rozum se týká obrovského množství implicitních informací o každodenním životě, …
Tento koncept se zaměřuje na manipulaci s textem, kde základní jednotkou výpočtu je jeden …
Ačkoli historicky odkazuje na vzdělávací taxonomii Benjamina Bloomse, v moderních …
BERT je technika strojového učení založená na transformerech pro předtrénování v oblasti …
Tato technika zpracování přirozeného jazyka reprezentuje text jako množinu slov, aniž by …
Automatizovaní lékařští sekretáři využívají zpracování přirozeného jazyka a technologie …
Termín ASR-complete znamená, že systém automatického rozpoznávání řeči dosáhl úrovně …
Modely jazyka a vize, často označované jako multimodální velké jazykové modely (MLLM), …
Překlad v AI se týká neuronového strojového překladu, kde hluboké učebné modely mapují …
Shrnování textu redukuje velké objemy textu na kratší verze bez ztráty kritického …
Sémantické vyhledávání interpretuje záměr a kontextuální význam dotazu, jde nad rámec …
Odpovídání na otázky (QA) zahrnuje získávání nebo generování přesných odpovědí na dotazy …
Protože modely transformer zpracovávají všechny tokeny paralelně, nikoli sekvenčně jako …
Rozpoznávání jmenovitých entit (NER) je podúlohou extrakce informací, která lokalizuje a …
Tyto modely mapují data s vysokou dimenzionalitou do nižšího dimenzionálního spojitého …
V modelech sekvenční na sekvenční převod (sequence-to-sequence) decodér přijímá …
Kódování párových bajtů (BPE) je technika komprese dat upravená pro zpracování …
Sebeřízené učení je podskupinou strojového učení, kde supervizní signál je odvozen …
Učení s malým počtem ukázek umožňuje modelům strojového učení zobecňovat z velmi …
Zavedená v článku ‘Attention Is All You Need’, architektura Transformátoru …
Tokeny jsou základními stavebními kameny vstupních dat v NLP, typicky reprezentující …
Tokenizace je kritický krok předzpracování v zpracování přirozeného jazyka (NLP), který …
Sémantická analýza v AI se zaměřuje na porozumění základnímu významu vstupů spíše než …
Podnět slouží jako hlavní rozhraní pro interakci s velkými jazykovými modely a dalšími …
Předvýcvik je základní technika v hlubokém učení, kde se model učí široké rysy a vzory z …
V kontextu digitální komunikace a dat AI se ‘příspěvek’ týká diskrétní …
Zpracování přirozeného jazyka (NLP) je podoborem umělé inteligence, který kombinuje …
Multi-Head Attention rozšiřuje standardní mechanismus pozornosti tím, že jej spouští …
V kontextu AI „dlouhé“ často popisuje schopnost zpracovávat rozsáhlé vstupy, jako jsou …
Velké jazykové modely (LLM) jsou pokročilé systémy umělé inteligence založené na …
Ačkoli není technickým algoritmem pro AI, výraz ‘místo toho’ je klíčový při …
Hierarchické systémy AI organizují informace nebo kontrolu do stromovité struktury …
V umělé inteligenci generace označuje schopnost modelů, zejména Generativních …
V zpracování přirozeného jazyka je kontext klíčový pro řešení nejednoznačnosti, například …
Vnoření jsou husté vektorové reprezentace dat, kde jsou sémantické vztahy zachovány v …
Mechanismus pozornosti umožňuje modelu dynamicky vážit význam různých prvků ve vstupní …