AI knihovna zdarma

Audio AI průvodciNavždy zdarma.

117 Průvodci v jednoduché angličtině, strukturované výukové programy a otevřená knihovna – vytvořené nezávislou neziskovou organizací 501(c)(3), takže moderní umělé inteligenci může porozumět každý.

117Zdarma průvodci
1Tématické stopy
~2 minPodle průvodce
~4hDoba čtení

Začněte zde

Pět Kurzy založené na výsledcích

Každý kurz obsahuje explicitní výsledky, namapované kompetence, cvičné aktivity a aplikovaný závěrečný projekt.

Tématické stopy

Procházet podle stopy

Skočte do oblasti, na které vám záleží. Každá trať má několik jednoduchých anglických průvodců.

Plná knihovna

Všichni průvodci

117 z 1019 zobrazena vodítka. Filtrujte podle skladby nebo vyhledávání výše.

Audio AI

Beamforming a mikrofonní pole

Beamforming využívá několik mikrofonů k poslechu ve zvoleném směru, zesiluje zvuk z cíle a zároveň potlačuje vše ostatní.

2 min přečtenoPřečtěte si
Audio AI

Rifuzní spektrogram Difúze

Riffusion je chytrý hack, který generuje hudbu tím, že zachází se zvukem jako s obrazem: dolaďuje obrazový model Stable Diffusion tak, aby maloval spektrogramy, pak…

2 min přečtenoPřečtěte si
Audio AI

MusicLM: Hierarchické sémantické a akustické tokeny

Zjistěte, jak Google MusicLM využívá hierarchické sémantické a akustické tokeny, SoundStream a MuLan k přeměně textových výzev na koherentní hudbu.

2 min přečtenoPřečtěte si
Audio AI

Noise2Noise vylepšení řeči

Noise2Noise je tréninkový trik, který umožňuje modelu naučit se odstraňovat šum, aniž by kdy viděl čistou referenci, tím, že se učí od párů různě hlučných…

2 min přečtenoPřečtěte si
Audio AI

Conv-TasNet Time-Domain Separation

Conv-TasNet je neuronová síť, která odděluje smíšený zvuk (jako když mluví dva lidé najednou) tím, že pracuje přímo na surovém zvukovém průběhu…

2 min přečtenoPřečtěte si
Audio AI

Dvoucestná separace RNN

Dual-Path RNN (DPRNN) je architektura separace zvuku, která rozděluje velmi dlouhou sekvenci zvukových funkcí na krátké překrývající se části a zpracovává je…

2 min přečtenoPřečtěte si
Audio AI

Open-Unmix Music Separation

Open-Unmix (UMX) je open-source systém hlubokého učení, který rozděluje skladbu na její části: zpěv, bicí, basa a další nástroje.

2 min přečtenoPřečtěte si
Audio AI

Zarovnání slov s časovým razítkem Whisper

Zarovnání slov šeptem připne každé přepsané slovo na přesný čas začátku a konce ve zvuku.

2 min přečtenoPřečtěte si
Audio AI

Hudební značkování pomocí Transformers

Označování hudby využívá modely transformátorů k poslechu skladby a předpovídání popisných štítků, jako je žánr, nálada, nástroje a tempo.

2 min přečtenoPřečtěte si
Audio AI

Detekce počátku ve zvuku

Detekce začátku najde přesné okamžiky, kdy tóny, údery nebo zvuky začínají ve zvukovém signálu.

2 min přečtenoPřečtěte si
Audio AI

Generativní vokodér MelGAN

MelGAN je plně konvoluční vokodér založený na GAN, který mění mel-spektrogramy na surové zvukové vlny v jediném rychlém průchodu vpřed.

2 min přečtenoPřečtěte si
Audio AI

UnivNet Multi-Resolution Vocoder

UnivNet je GAN vokodér, který posuzuje generovaný zvuk pomocí více spektrogramů vypočítaných v různých rozlišeních STFT, čímž zostřuje vysokofrekvenční detaily.

2 min přečtenoPřečtěte si

Dočetl jsi to? Dokaž to.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.

Audio AI AI Guides — Page 6 of 10 | AI Understanding