可解释性

term_id: interpretability

Category: ethics_safety

Definition

可解释性(或称可解释性)涉及使 AI 模型的内部工作原理和决策过程对人类透明且易于理解。这对于调试、确保公平性以及建立用户信任至关重要。

Summary

人类理解 AI 模型做出决策原因的程度。

Key Concepts

  • 可解释 AI (XAI)
  • 透明度
  • 特征重要性
  • 信任

Use Cases

  • 贷款审批理由说明
  • 医疗治疗建议
  • 招聘算法中的偏见审计