AI knihovna zdarma

Audio AI průvodciNavždy zdarma.

117 Průvodci v jednoduché angličtině, strukturované výukové programy a otevřená knihovna – vytvořené nezávislou neziskovou organizací 501(c)(3), takže moderní umělé inteligenci může porozumět každý.

117Zdarma průvodci
1Tématické stopy
~2 minPodle průvodce
~4hDoba čtení

Začněte zde

Pět Kurzy založené na výsledcích

Každý kurz obsahuje explicitní výsledky, namapované kompetence, cvičné aktivity a aplikovaný závěrečný projekt.

Tématické stopy

Procházet podle stopy

Skočte do oblasti, na které vám záleží. Každá trať má několik jednoduchých anglických průvodců.

Plná knihovna

Všichni průvodci

117 z 1019 zobrazena vodítka. Filtrujte podle skladby nebo vyhledávání výše.

Audio AI

Komprese zvuku EnCodec

EnCodec je vysoce věrný neurální zvukový kodek Meta společnosti Meta, který komprimuje řeč a hudbu při velmi nízkém datovém toku s kvalitou konkurující mnohem těžším formátům.

2 min přečtenoPřečtěte si
Audio AI

Kvantování zbytkového vektoru

Kvantování zbytkového vektoru (RVQ) je technika, která přeměňuje kontinuální audio vkládání na kompaktní hromadu diskrétních kódů opakovaným kvantováním…

2 min přečtenoPřečtěte si
Audio AI

ECAPA-TDNN Rozpoznávání reproduktorů

ECAPA-TDNN je architektura neuronové sítě, která přemění jakýkoli řečový klip na kompaktní „hlasový otisk“, který umožňuje strojům rozpoznat, kdo mluví.

2 min přečtenoPřečtěte si
Audio AI

Anti-Spoofing a ASVspoof reproduktorů

Anti-spoofing je obranná vrstva, která detekuje falešné nebo přehrané hlasy, které se snaží oklamat systémy hlasové autentizace.

2 min přečtenoPřečtěte si
Audio AI

Odšumování řeči pomocí RNNoise

RNNoise je malá, rychlá neuronová síť, která v reálném čase odstraňuje šum na pozadí z řeči.

2 min přečtenoPřečtěte si
Audio AI

Vkládání zvuku a učení reprezentace

Vložení zvuku mění zvuk na kompaktní numerické vektory, které zachycují význam, takže stroje mohou porovnávat, vyhledávat a klasifikovat zvuk tak, jak lidé rozpoznávají…

2 min přečtenoPřečtěte si
Audio AI

Zrušení akustické ozvěny

Akustické potlačení ozvěny (AEC) je technologie, která vám během hovoru zabrání odrážet se od vašeho vlastního hlasu.

2 min přečtenoPřečtěte si
Audio AI

Oddělení řeči a problém koktejlové párty

Oddělení řeči je úkolem oddělit jednotlivé hlasy od nahrávky, kde mluví několik lidí najednou.

2 min přečtenoPřečtěte si
Audio AI

Permutační invariantní trénink

Permutační invariantní trénink (PIT) je chytrý tréninkový trik, který umožňuje modelu oddělit více hlasů, aniž by se staral o to, do kterého výstupního slotu každý hlas zapadne…

2 min přečtenoPřečtěte si
Audio AI

Vyhledávání informací o hudbě

Music Information Retrieval (MIR) je obor, který učí počítače analyzovat, rozumět a vyhledávat hudbu ze zvukových signálů a partitur.

2 min přečtenoPřečtěte si
Audio AI

Oddělení hudebních zdrojů Demucs a HT-Demucs

Zjistěte, jak Demucs a HT-Demucs rozdělují hudbu na vokály a kmeny nástrojů pomocí modelování tvaru vlny, spektrogramu a transformátoru.

2 min přečtenoPřečtěte si
Audio AI

Rozpoznávání zvukových akordů

Rozpoznávání zvukových akordů je úkolem automatického označování akordů hraných v průběhu skladby přímo z jejího zvuku.

2 min přečtenoPřečtěte si

Dočetl jsi to? Dokaž to.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.