Presná definícia
Čo znamená akustický model?
Akustický model v rozpoznávaní reči odhaduje vzťah medzi zvukovými rámcami a jazykovými jednotkami, ako fonémy, stavy HMM alebo podslovné tokeny. Moderný end-to-end model môže túto funkciu zlúčiť s ďalšími časťami. Neurčuje sám pravdepodobnosť slovných sekvencií podľa jazyka.
Skúsenosť a kontext
Ako sa pojem používa v praxi
ASR pre slovenčinu dolaďuje akustický enkóder na povolených nahrávkach z cieľových mikrofónov. Test je oddelený podľa hovoriacich a relácií a reportuje WER pre hluk, región a dĺžku. Doménové názvy sa riešia aj lexikónom či dekóderom, nie iba akustikou.
Overiteľnosť
Odborné zdroje
Praktické odpovede
Často kladené otázky
Ako funguje akustický model?
Sieť mapuje sekvenciu akustických príznakov na rámcové alebo tokenové skóre, ktoré dekóder časovo zarovná s kandidátnym textom.
Kedy má akustický model praktický význam?
ASR pre slovenčinu dolaďuje akustický enkóder na povolených nahrávkach z cieľových mikrofónov.
S čím si pojem nezamieňať?
Language model hodnotí pravdepodobnosť textovej sekvencie; acoustic model hodnotí, ako dobre sekvencia vysvetľuje zvuk.
Ako sa výsledok kontroluje?
Meria sa WER/CER celej pipeline, frame alebo token loss, kalibrácia, robustnosť kanála a prenos medzi hovoriacimi.
Na čo si dať pozor?
Model sa môže naučiť zariadenie alebo prostredie a pri novom kanáli zlyhať, hoci jazykové pravidlá zostávajú rovnaké.
Prihlásiť / registrovať