AI 안전성

term_id: ai_safety

Category: ethics_safety

Definition

AI 안전성은 자율 시스템이 인간에게 유익하고 해롭지 않게 행동하도록 보장하기 위한 연구와 실천을 포괄합니다. 이 분야는 편향(Bias), 허위 정보 확산, 보안 취약점 등 다양한 위험 요소를 다루며, 시스템의 견고성(Robustness), 위험 평가(Risk assessment), 실패 시 안전 장치(Fail-safes), 투명성(Transparency) 등을 확보함으로써 AI 기술의 신뢰성과 사회적 수용성을 높이는 것을 목표로 합니다.

Summary

고도화된 인공지능 시스템으로 인한 의도치 않은 유해한 결과를 방지하는 데 중점을 둔 연구 분야.

Key Concepts

  • 견고성(Robustness)
  • 위험 평가(Risk assessment)
  • 실패 시 안전 장치(Fail-safes)
  • 투명성(Transparency)

Use Cases

  • 자율주행차 규제 및 안전 기준 수립
  • 의료 진단 도구 검증
  • 금융 사기 탐지 시스템의 신뢰성 확보