해석 가능성 (Interpretability)
term_id: interpretability
Category: ethics_safety
Definition
해석 가능성(또는 설명 가능성)은 AI 모델의 내부 작동 방식과 의사결정 과정을 인간이 투명하게 이해할 수 있도록 하는 것을 포함합니다. 이는 모델 디버깅, 편향 감지, 규제 준수 및 사용자 신뢰 구축에 필수적입니다. 블랙박스 모델의 한계를 극복하고 AI의 결정을 신뢰할 수 있게 만드는 핵심 개념입니다.
Summary
인간이 AI 모델이 내린 결정의 원인을 이해할 수 있는 정도.
Key Concepts
- 설명 가능한 AI (XAI)
- 투명성
- 특징 중요도
- 신뢰
Use Cases
- 대출 승인 이유 설명
- 의료 치료 권장 사항 근거 제시
- 채용 알고리즘의 편향 감사