Ingyenes AI könyvtár

Audio AI útmutatókÖrökre ingyen.

117 egyszerű angol nyelvű útmutatók, strukturált tanulási útvonalak és nyílt könyvtár – egy független 501(c)(3) nonprofit szervezet építette, így bárki megértheti a modern AI-t.

117Ingyenes útmutatók
1Témasávok
~2 minÚtmutató szerint
~4hReading time

Kezdje itt

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Témasávok

Böngésszen szám szerint

Ugorjon be a számodra fontos területre. Minden számnak több egyszerű angol nyelvű útmutatója van.

Teljes könyvtár

Minden útmutató

117 -ból 1019 útmutatók láthatók. Szűrés sáv szerint vagy keresés fent.

Audio AI

Nyalábformáló és mikrofontömbök

A Beamforming több mikrofont használ a kiválasztott irányba történő hallgatáshoz, felerősítve a célpont hangját, miközben minden mást elnyom.

2 min olvasniOlvassa el
Audio AI

Riffúziós spektrogram diffúzió

A Riffusion egy okos hack, amely úgy generál zenét, hogy a hangot képként kezeli: finomhangolja a Stable Diffusion képmodellt, hogy spektrogramokat festsen, majd…

2 min olvasniOlvassa el
Audio AI

MusicLM: Hierarchikus szemantikai és akusztikus tokenek

Ismerje meg, hogyan használja a Google MusicLM hierarchikus szemantikai és akusztikus tokeneket, a SoundStream-et és a MuLant, hogy a szöveges felszólításokat koherens zenévé alakítsa.

2 min olvasniOlvassa el
Audio AI

Noise2Noise beszédjavítás

A Noise2Noise egy olyan képzési trükk, amely lehetővé teszi a modell számára, hogy megtanulja eltávolítani a zajt anélkül, hogy tiszta referenciát látna, azáltal, hogy tanul a különböző zajos pároktól…

2 min olvasniOlvassa el
Audio AI

Conv-TasNet idő-domain szétválasztás

A Conv-TasNet egy neurális hálózat, amely elválasztja a vegyes hangot (például két ember egyszerre beszél) azáltal, hogy közvetlenül a nyers hanghullámon dolgozik…

2 min olvasniOlvassa el
Audio AI

Kétútvonalas RNN elválasztás

A Dual-Path RNN (DPRNN) egy hangelválasztó architektúra, amely a hangfunkciók nagyon hosszú sorozatát osztja fel rövid, egymást átfedő darabokra, és dolgozza fel őket…

2 min olvasniOlvassa el
Audio AI

Open-Unmix zeneelválasztás

Az Open-Unmix (UMX) egy nyílt forráskódú mély tanulási rendszer, amely a dalt részekre bontja: ének, dob, basszusgitár és egyéb hangszerek.

2 min olvasniOlvassa el
Audio AI

Suttogó időbélyegzett szóigazítás

A suttogó szóigazítás minden átírt szót egy pontos kezdési és befejezési időponthoz rögzít a hangban.

2 min olvasniOlvassa el
Audio AI

Zene címkézés Transformers segítségével

A zenei címkézés transzformátormodelleket használ a dal meghallgatására, és olyan leíró címkék előrejelzésére, mint a műfaj, a hangulat, a hangszerek és a tempó.

2 min olvasniOlvassa el
Audio AI

Kezdeti észlelés hangban

A kezdésérzékelés pontosan megkeresi azokat a pillanatokat, amikor hangjegyek, ütemek vagy hangok kezdődnek egy hangjelben.

2 min olvasniOlvassa el
Audio AI

MelGAN Generatív Vocoder

A MelGAN egy teljesen konvolúciós GAN-alapú vocoder, amely egyetlen gyors előrelépéssel nyers hanghullámformává alakítja a mel-spektrogramokat.

2 min olvasniOlvassa el
Audio AI

UnivNet Multi-Resolution Vocoder

Az UnivNet egy GAN vokóder, amely a generált hangot több, különböző STFT felbontáson számított spektrogramok segítségével ítéli meg, élesítve a nagyfrekvenciás részleteket.

2 min olvasniOlvassa el

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.