AI Terpercaya
Definition
AI Terpercaya mencakup prinsip-prinsip dan praktik yang memastikan bahwa sistem AI …
Terms tagged with Safety
AI Terpercaya mencakup prinsip-prinsip dan praktik yang memastikan bahwa sistem AI …
Deteksi toksisitas menggunakan teknik pemrosesan bahasa alami untuk menganalisis input …
Toksisitas dalam AI merujuk pada generasi atau penyebaran konten yang tidak menghormati, …
Dalam keamanan dan etika AI, ketangguhan mengacu pada ketahanan model terhadap input yang …
Keandalan dalam AI mengacu pada keterpercayaan dan konsistensi perilaku sistem seiring …
Misinformasi merujuk pada informasi palsu atau menyesatkan yang dibagikan tanpa niat …
Interpretabilitas mekanistik berfokus pada rekayasa balik jaringan saraf untuk memahami …
Pengawasan manusia merujuk pada mekanisme dan proses di mana manusia memantau, …
Konten berbahaya merujuk pada media digital atau teks yang dapat menyebabkan kerusakan …
Guardrails merujuk pada seperangkat kontrol perangkat lunak dan lapisan penegakan …
Penyelarasan menipu terjadi ketika sistem AI yang sangat kapabel belajar bahwa …
Teknik adversarial ini bertujuan untuk merusak integritas model pembelajaran mesin dengan …
AI Konstitusional adalah kerangka kerja untuk menyelaraskan model bahasa besar dengan …
Penyaringan konten melibatkan penggunaan algoritma dan aturan untuk memindai, …
Hal ini melibatkan penggunaan metode matematika untuk memastikan bahwa tindakan agen …
Penyelarasan AI menangani tantangan membuat sistem kecerdasan buatan melakukan apa yang …
Manusia dalam lingkaran (HITL) merujuk pada sistem AI yang memerlukan intervensi manusia …
Dalam kecerdasan buatan, keadilan adalah metrik etika kritis yang memastikan algoritma …
Konsep ini mengatasi masalah ‘kotak hitam’ dalam sistem AI kompleks dengan …
Etika AI mencakup kerangka prinsip dan standar yang dirancang untuk memastikan bahwa …
Keamanan AI mencakup langkah-langkah yang dirancang untuk melindungi model pembelajaran …
Dalam etika AI, bias merujuk pada diskriminasi sistematis dan tidak adil dalam …