AI 안전성
term_id: ai_safety
Category: ethics_safety
Definition
AI 안전성은 자율 시스템이 인간에게 유익하고 해롭지 않게 행동하도록 보장하기 위한 연구와 실천을 포괄합니다. 이 분야는 편향(Bias), 허위 정보 확산, 보안 취약점 등 다양한 위험 요소를 다루며, 시스템의 견고성(Robustness), 위험 평가(Risk assessment), 실패 시 안전 장치(Fail-safes), 투명성(Transparency) 등을 확보함으로써 AI 기술의 신뢰성과 사회적 수용성을 높이는 것을 목표로 합니다.
Summary
고도화된 인공지능 시스템으로 인한 의도치 않은 유해한 결과를 방지하는 데 중점을 둔 연구 분야.
Key Concepts
- 견고성(Robustness)
- 위험 평가(Risk assessment)
- 실패 시 안전 장치(Fail-safes)
- 투명성(Transparency)
Use Cases
- 자율주행차 규제 및 안전 기준 수립
- 의료 진단 도구 검증
- 금융 사기 탐지 시스템의 신뢰성 확보