Надежный ИИ
Definition
Надежный ИИ охватывает принципы и практики, обеспечивающие надежную и этичную работу …
Terms tagged with Safety
Надежный ИИ охватывает принципы и практики, обеспечивающие надежную и этичную работу …
Обнаружение токсичности использует методы обработки естественного языка для анализа …
Токсичность в ИИ относится к генерации или распространению контента, который является …
В контексте безопасности и этики ИИ устойчивость относится к устойчивости модели к …
Надежность в ИИ относится к достоверности и стабильности поведения системы с течением …
Под дезинформацией в широком смысле понимается ложная или вводящая в заблуждение …
Механистическая интерпретируемость фокусируется на обратном инжиниринге нейронных сетей …
Человеческий надзор относится к механизмам и процессам, при которых люди контролируют, …
Вредоносный контент относится к цифровым медиа или тексту, способным причинить …
Ограничительные механизмы (Guardrails) представляют собой набор программных контролей и …
Обманчивое выравнивание возникает, когда высокопроизводительная система ИИ понимает, что …
Эта состязательная техника направлена на компрометацию целостности моделей машинного …
Конституционный ИИ — это фреймворк для согласования больших языковых моделей с …
Фильтрация контента предполагает использование алгоритмов и правил для сканирования, …
Это включает использование математических методов для обеспечения того, чтобы действия …
Согласование ИИ решает проблему обеспечения надежного выполнения искусственным …
Концепция «человек в контуре» (HITL) относится к системам искусственного интеллекта, …
В области искусственного интеллекта справедливость является критически важным этическим …
Это понятие решает проблему «черного ящика» в сложных системах ИИ, предоставляя понимание …
Этика ИИ охватывает набор принципов и стандартов, предназначенных для обеспечения …
Безопасность ИИ включает меры, предназначенные для защиты моделей машинного обучения, …
В этике ИИ смещение относится к систематической и несправедливой дискриминации в …