해석 가능성 (Interpretability)

term_id: interpretability

Category: ethics_safety

Definition

해석 가능성(또는 설명 가능성)은 AI 모델의 내부 작동 방식과 의사결정 과정을 인간이 투명하게 이해할 수 있도록 하는 것을 포함합니다. 이는 모델 디버깅, 편향 감지, 규제 준수 및 사용자 신뢰 구축에 필수적입니다. 블랙박스 모델의 한계를 극복하고 AI의 결정을 신뢰할 수 있게 만드는 핵심 개념입니다.

Summary

인간이 AI 모델이 내린 결정의 원인을 이해할 수 있는 정도.

Key Concepts

  • 설명 가능한 AI (XAI)
  • 투명성
  • 특징 중요도
  • 신뢰

Use Cases

  • 대출 승인 이유 설명
  • 의료 치료 권장 사항 근거 제시
  • 채용 알고리즘의 편향 감사