Důvěryhodná AI
Definition
Důvěryhodná AI zahrnuje principy a postupy zajišťující spolehlivý a etický provoz systémů …
Terms tagged with Safety
Důvěryhodná AI zahrnuje principy a postupy zajišťující spolehlivý a etický provoz systémů …
Detekce toxickosti využívá techniky zpracování přirozeného jazyka k analýze vstupního …
Toxickost v AI se vztahuje ke generování nebo šíření obsahu, který je nedůstojný, …
V oblasti bezpečnosti a etiky AI se robustnost týká odolnosti modelu vůči neočekávaným …
Spolehlivost v AI se týká důvěryhodnosti a konzistence chování systému v čase a napříč …
Dezinformace označuje nepravdivé nebo zavádějící informace sdílené bez vědomého úmyslu …
Mechanická interpretovatelnost se zaměřuje na reverzní inženýrství neuronových sítí, aby …
Lidský dohled se vztahuje na mechanismy a procesy, při kterých lidé monitorují, hodnotí a …
Škodlivý obsah označuje digitální média nebo texty, která mohou způsobit fyzické, …
Ochranné prvky označují sadu softwarových kontrolních mechanismů a vrstev vynucování …
Zavádějící zarovnání nastává, když vysoce schopný systém AI zjistí, že projevování …
Tato adversariální technika má za cíl ohrozit integritu strojových modelů změnou …
Filtrování obsahu zahrnuje používání algoritmů a pravidel ke skenování, klasifikaci a …
Konstituční AI je rámec pro sladění velkých jazykových modelů s lidskými hodnotami bez …
To zahrnuje používání matematických metod k zajištění, že činnosti agenta dodržují předem …
AI alignment řeší výzvu zajistit, aby umělá inteligence robustně dělala to, co uživatelé …
Koncept „člověk v smyčce“ (HITL) označuje systémy AI, které vyžadují lidský zásah v …
V umělé inteligenci je spravedlnost kritickým etickým měřítkem zajišťujícím, že algoritmy …
Tento koncept řeší problém „černé skříňky“ u složitých systémů AI poskytováním vhledu do …
Etika umělé inteligence zahrnuje rámec principů a norem určených k zajištění odpovědného …
Bezpečnost AI zahrnuje opatření určená k ochraně strojových učebních modelů, datových …
V etice AI se předpojatost týká systematické a nespravedlivé diskriminace v algoritmickém …