Dáta pre AI

zvukový dataset

Anglický výraz audio dataset

pokročiléheslo č. 9315 otázok a odpovedí2 odborné zdroje

Presná definícia

Čo znamená zvukový dataset?

Zvukový dataset je kolekcia nahrávok s definovanou vzorkovacou frekvenciou, počtom kanálov, pôvodom, licenciou a časovými alebo klipovými anotáciami. Pri delení sa musí rešpektovať hovoriaci, zariadenie či nahrávacia relácia, inak model rozpoznáva zdroj namiesto javu.

Skúsenosť a kontext

Ako sa pojem používa v praxi

Call centrum pripraví nahrávky pre rozpoznávanie reči a všetky hovory jedného hovoriaceho drží v rovnakej časti. Sleduje hluk, kodek, jazyk, zariadenie a odstráni alebo chráni citlivé údaje.

Overiteľnosť

Odborné zdroje

  1. Gemmeke et al. - Audio Set: An ontology and human-labeled dataset for audio eventsresearch.google
  2. Gebru et al. - Datasheets for Datasetsarxiv.org

Praktické odpovede

Často kladené otázky

Ako funguje zvukový dataset?

Dekodér prevedie vlnu na vzorky alebo spektrálnu reprezentáciu a pripojí časovo zarovnané značky.

Kedy má zvukový dataset praktický význam?

Call centrum pripraví nahrávky pre rozpoznávanie reči a všetky hovory jedného hovoriaceho drží v rovnakej časti.

S čím si pojem nezamieňať?

Zvukový dataset obsahuje surový alebo odvodený akustický signál; textový prepis je samostatná, zarovnaná modalita.

Ako sa výsledok kontroluje?

Kontroluje sa kvalita signálu, clipping, vzorkovanie, dĺžky, hovoriaci, prostredie, presnosť časových značiek a únik relácií.

Na čo si dať pozor?

Nahrávacie zariadenie či miestnosť môže byť skratkou pre triedu a zlyhať pri inom mikrofóne.