Interpreteerbaarheid

term_id: interpretability

Category: ethics_safety

Definition

Interpreteerbaarheid, of uitlegbaarheid, houdt in dat de interne werking en besluitvormingsprocessen van AI-modellen transparant en begrijpelijk worden gemaakt voor mensen. Dit is cruciaal voor foutopsporing, het waarborgen van eerlijkheid en het bouwen van vertrouwen.

Summary

De mate waarin een mens de oorzaak van een beslissing kan begrijpen die door een AI-model is genomen.

Key Concepts

  • Uitlegbare AI (XAI)
  • Transparantie
  • Belangrijkheid van kenmerken
  • Vertrouwen

Use Cases

  • Onderbouwing van leninggoedkeuringen
  • Aanbevelingen voor medische behandelingen
  • Audits op bias in aanstellingsalgoritmen