Slovník výrazov AI/Učenie bez učiteľa

Učenie bez učiteľa

t-SNE

Anglický výraz t-SNE

pokročiléheslo č. 1815 otázok a odpovedí2 odborné zdroje

Presná definícia

Čo znamená t-SNE?

t-SNE je nelineárna vizualizačná metóda, ktorá prevádza párové susedské podobnosti vo vysokom rozmere na podobnosti v nízkom rozmere a minimalizuje ich KL divergenciu. Studentovo t-rozdelenie vo výstupe obmedzuje crowding problem. Metóda uprednostňuje lokálne susedstvá; vzdialenosť medzi oddelenými ostrovmi ani ich plocha nemá spoľahlivý globálny význam.

Skúsenosť a kontext

Ako sa pojem používa v praxi

Pred zobrazením embeddingov sa často odstráni šum pomocou PCA a následne sa t-SNE spustí s viacerými seedmi a perplexitami. Perplexita približne riadi veľkosť susedstva, no musí byť menšia než počet príkladov a jej účinok závisí od dát. Farby podľa známych štítkov sa pridajú až po výpočte, ak nemajú ovplyvniť metódu. Stabilné lokálne susedstvá sú presvedčivejšie než tvar jedného obrázka. Hustotu, veľkosť zhlukov a vzdialenosť ostrovov nemožno porovnávať bez osobitnej validácie v pôvodnom priestore.

Overiteľnosť

Odborné zdroje

  1. van der Maaten & Hinton · t-SNEjmlr.org
  2. scikit-learn · Manifold learningscikit-learn.org

Praktické odpovede

Často kladené otázky

Čo približne riadi perplexita?

Efektívny počet susedov, ktorým metóda venuje lokálnu pozornosť.

Možno porovnať medzery medzi ostrovmi?

Nie spoľahlivo; cieľ zdôrazňuje lokálne podobnosti.

Znamená väčší ostrov viac dát alebo variance?

Nie automaticky. Plochu môže výrazne meniť optimalizácia.

Prečo skúšať viac seedov?

Nelineárna optimalizácia môže vytvoriť rozdielne rozloženia.

Má klasický t-SNE prirodzený transform pre nové body?

Nie. Treba parametrickú alebo aproximačnú rozširujúcu metódu.