Reč a zvuk

separácia zdrojov

Anglický výraz source separation

základnéheslo č. 7685 otázok a odpovedí2 odborné zdroje

Presná definícia

Čo znamená separácia zdrojov?

Separácia zdrojov rozkladá pozorovanú zmes na signály prislúchajúce jednotlivým zdrojom, napríklad hlasom alebo nástrojom. Môže využívať tréningové dáta, priestor viacerých mikrofónov alebo podmienku cieľového zdroja. Poradie výstupných kanálov býva bez ďalšieho pravidla zameniteľné.

Skúsenosť a kontext

Ako sa pojem používa v praxi

Prepis porady najprv oddelí prekrývajúcich sa hovoriacich a každý kanál pošle do ASR. Systém zachová pôvodnú zmes a označí neisté prekrývanie. Eval používa SI-SDR aj WER, pretože akusticky lepší kanál nemusí obsahovať správne slová bez artefaktov.

Overiteľnosť

Odborné zdroje

  1. Conv-TasNet: Surpassing Ideal Time-Frequency Magnitude Masking for Speech Separationarxiv.org
  2. Independent Component Analysis: Algorithms and Applicationscs.helsinki.fi

Praktické odpovede

Často kladené otázky

Ako funguje separácia zdrojov?

Model odhaduje masku alebo priamo časový priebeh každého zdroja a trénuje sa s permutation-invariant cieľom proti referenciám.

Kedy má separácia zdrojov praktický význam?

Prepis porady najprv oddelí prekrývajúcich sa hovoriacich a každý kanál pošle do ASR.

S čím si pojem nezamieňať?

Speech enhancement môže vytvoriť jeden čistejší cieľ; source separation vracia viac samostatných zdrojových kanálov.

Ako sa výsledok kontroluje?

Hodnotí sa SI-SDR improvement, interference suppression, artefakty, permutation alignment, WER a zlyhanie pri inom počte zdrojov.

Na čo si dať pozor?

Podobné a súčasné hlasy sa môžu pomiešať medzi kanálmi a systém môže vynechať tichší zdroj alebo rozdeliť jeden hlas.