Slovník výrazov AI/Vysvetliteľnosť a interpretácia

Vysvetliteľnosť a interpretácia

vnútorná interpretovateľnosť

Anglický výraz intrinsic interpretability

základnéheslo č. 11595 otázok a odpovedí2 odborné zdroje

Presná definícia

Čo znamená vnútorná interpretovateľnosť?

Vnútorná interpretovateľnosť je pochopiteľnosť, ktorá vyplýva priamo zo štruktúry modelu, napríklad z krátkeho stromu, pravidiel alebo riedkej aditívnej funkcie. Výstup možno vysvetliť tým istým mechanizmom, ktorý ho vypočítal.

Skúsenosť a kontext

Ako sa pojem používa v praxi

Tím zvolí monotónny aditívny model, pretože odborník musí overiť celý vzťah a jednotlivé príspevky. Zložitosť obmedzí vopred a porovná výkon s komplexnejším kandidátom.

Overiteľnosť

Odborné zdroje

  1. Molnar - Interpretable Machine Learningchristophm.github.io
  2. NIST - Four Principles of Explainable Artificial Intelligencedoi.org

Praktické odpovede

Často kladené otázky

Čo presne znamená vnútorná interpretovateľnosť?

Vnútorná interpretovateľnosť je pochopiteľnosť, ktorá vyplýva priamo zo štruktúry modelu, napríklad z krátkeho stromu, pravidiel alebo riedkej aditívnej funkcie.

Kedy sa vnútorná interpretovateľnosť používa?

Tím zvolí monotónny aditívny model, pretože odborník musí overiť celý vzťah a jednotlivé príspevky.

Od čoho treba vnútorná interpretovateľnosť odlíšiť?

Post-hoc vysvetlenie približuje iný model; intrinsic interpretability je vlastnosť samotného rozhodovacieho výpočtu.

Ako sa vnútorná interpretovateľnosť kontroluje?

Overí sa úplnosť zobrazeného mechanizmu, zložitosť, interakcie, stabilita, vernosť implementácie a pochopenie používateľom.

Aké obmedzenie má vnútorná interpretovateľnosť?

Aj intrinsicky čitateľný model sa stane neprehľadným pri stovkách pravidiel a jeho príznaky môžu byť významovo nejasné.