Slovník výrazov AI/Vysvetliteľnosť a interpretácia

Vysvetliteľnosť a interpretácia

dodatočné vysvetlenie

Anglický výraz post-hoc explanation

základnéheslo č. 11585 otázok a odpovedí2 odborné zdroje

Presná definícia

Čo znamená dodatočné vysvetlenie?

Dodatočné vysvetlenie je interpretácia vytvorená po natrénovaní modelu, ktorá približuje jeho správanie bez toho, aby bola súčasťou pôvodného rozhodovacieho mechanizmu. Môže byť lokálna alebo globálna a musí sa testovať na vernosť.

Skúsenosť a kontext

Ako sa pojem používa v praxi

Tím k neurónovej sieti vytvorí SHAP atribúcie a kontrafaktuály, potom ich porovná pri opakovaných behoch a zásahoch do vstupu. Používateľovi jasne označí, že ide o odhad správania.

Overiteľnosť

Odborné zdroje

  1. Molnar - Interpretable Machine Learningchristophm.github.io
  2. Ribeiro, Singh & Guestrin - Why Should I Trust You? Explaining the Predictions of Any Classifierdoi.org

Praktické odpovede

Často kladené otázky

Čo presne znamená dodatočné vysvetlenie?

Dodatočné vysvetlenie je interpretácia vytvorená po natrénovaní modelu, ktorá približuje jeho správanie bez toho, aby bola súčasťou pôvodného rozhodovacieho mechanizmu.

Kedy sa dodatočné vysvetlenie používa?

Tím k neurónovej sieti vytvorí SHAP atribúcie a kontrafaktuály, potom ich porovná pri opakovaných behoch a zásahoch do vstupu.

Od čoho treba dodatočné vysvetlenie odlíšiť?

Intrinsically interpretable model vysvetľuje vlastným mechanizmom; post-hoc metóda vytvára dodatočnú reprezentáciu.

Ako sa dodatočné vysvetlenie kontroluje?

Kontroluje sa fidelity, stabilita, citlivosť na baseline, zhoda viacerých metód a používateľské pochopenie hraníc.

Aké obmedzenie má dodatočné vysvetlenie?

Post-hoc príbeh môže byť presvedčivý, hoci zodpovedá iba lokálnemu približeniu a nie skutočnej príčine predikcie.