AI knihovna zdarma

Audio AI průvodciNavždy zdarma.

117 Průvodci v jednoduché angličtině, strukturované výukové programy a otevřená knihovna – vytvořené nezávislou neziskovou organizací 501(c)(3), takže moderní umělé inteligenci může porozumět každý.

117Zdarma průvodci
1Tématické stopy
~2 minPodle průvodce
~4hDoba čtení

Začněte zde

Pět Kurzy založené na výsledcích

Každý kurz obsahuje explicitní výsledky, namapované kompetence, cvičné aktivity a aplikovaný závěrečný projekt.

Tématické stopy

Procházet podle stopy

Skočte do oblasti, na které vám záleží. Každá trať má několik jednoduchých anglických průvodců.

Plná knihovna

Všichni průvodci

117 z 1019 zobrazena vodítka. Filtrujte podle skladby nebo vyhledávání výše.

Audio AI

Separace stonku spleeter

Spleeter je open-source nástroj od Deezeru, který pomocí hlubokého učení rozděluje hotovou skladbu na samostatné stopy (zpěv, bicí, basa a další).

2 min přečtenoPřečtěte si
Audio AI

CREPE Odhad výšky tónu

CREPE je model hlubokého učení, který odhaduje základní frekvenci (výšku) monofonního zvukového signálu přímo z jeho surového tvaru vlny.

2 min přečtenoPřečtěte si
Audio AI

Metriky kvality řeči PESQ a STOI

PESQ a STOI jsou standardní objektivní metriky, které hodnotí, jak dobře zpracované zvuky řeči a jak jsou srozumitelné, aniž by potřebovaly lidské posluchače.

2 min přečtenoPřečtěte si
Audio AI

Source-Filter Vocoding a WORLD

Vokodér je nástroj, který rozděluje řeč na její stavební kameny a přestavuje ji.

2 min přečtenoPřečtěte si
Audio AI

Hodnocení průměrného skóre názoru

Mean Opinion Score (MOS) je průměrné hodnocení od lidských posluchačů od 1 do 5, které měří, jak dobře syntetizovaný nebo přenášený zvuk zní.

2 min přečtenoPřečtěte si
Audio AI

Constant-Q Transform pro zvuk

Transformace Constant-Q (CQT) je frekvenční analýza, která používá logaritmicky rozmístěné přihrádky přizpůsobené hudební výšce namísto rovnoměrně rozmístěných přihrádek…

2 min přečtenoPřečtěte si
Audio AI

Funkce filtrační banky a PLP

Funkce Filterbank a Perceptual Linear Prediction (PLP) jsou způsoby, jak shrnout řečový signál do kompaktních, percepčně smysluplných čísel, která...

2 min přečtenoPřečtěte si
Audio AI

StyleTTS 2 Styl Diffusion

StyleTTS 2 je model převodu textu na řeč, který zachází se „stylem“ hlasu – prozódií, emocemi a zabarvením reproduktoru – jako s náhodnou proměnnou vzorkovanou pomocí modelu difúze…

2 min přečtenoPřečtěte si
Audio AI

FastPitch TTS s ovladatelným roztečí

FastPitch je rychlý, neautoregresivní model převodu textu na řeč, který explicitně předpovídá výšku (základní frekvenci) každého vstupního tokenu, což vám umožňuje…

2 min přečtenoPřečtěte si
Audio AI

Voicebox Flow-Matching Speech Generation

Voicebox je textově řízený model generování řeči společnosti Meta trénovaný s cílem přizpůsobení toku, aby „vyplnil“ maskovaný zvuk a umožnil jednomu modelu dělat hlas s nulovým záběrem…

2 min přečtenoPřečtěte si
Audio AI

Výzva k potlačení hlubokého hluku

Deep Noise Suppression (DNS) Challenge je Microsoft soutěž, která nutí výzkumníky k budování neuronových sítí, které odstraňují šum na pozadí…

2 min přečtenoPřečtěte si
Audio AI

Spektrální odečítání a Wienerova filtrace

Spektrální odečítání a Wienerova filtrace jsou klasickými nástroji redukce šumu před hlubokým učením.

2 min přečtenoPřečtěte si

Dočetl jsi to? Dokaž to.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.

Audio AI AI Guides — Page 5 of 10 | AI Understanding