Ingyenes AI könyvtár

Audio AI útmutatókÖrökre ingyen.

117 egyszerű angol nyelvű útmutatók, strukturált tanulási útvonalak és nyílt könyvtár – egy független 501(c)(3) nonprofit szervezet építette, így bárki megértheti a modern AI-t.

117Ingyenes útmutatók
1Témasávok
~2 minÚtmutató szerint
~4hReading time

Kezdje itt

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Témasávok

Böngésszen szám szerint

Ugorjon be a számodra fontos területre. Minden számnak több egyszerű angol nyelvű útmutatója van.

Teljes könyvtár

Minden útmutató

117 -ból 1019 útmutatók láthatók. Szűrés sáv szerint vagy keresés fent.

Audio AI

Spleeter szár szétválasztása

A Spleeter a Deezer nyílt forráskódú eszköze, amely a kész dalt külön sávokra (ének, dob, basszusgitár stb.) osztja fel mély tanulással.

2 min olvasniOlvassa el
Audio AI

KREPE hangmagasság becslés

A CREPE egy mély tanulási modell, amely a monofonikus audiojel alapfrekvenciáját (hangmagasságát) közvetlenül annak nyers hullámformájából becsüli meg.

2 min olvasniOlvassa el
Audio AI

PESQ és STOI beszédminőségi mérőszámok

A PESQ és a STOI szabványos objektív mérőszámok, amelyek emberi hallgatóság nélkül értékelik, hogy a feldolgozott beszéd milyen jól hangzik és mennyire érthető.

2 min olvasniOlvassa el
Audio AI

Source-Filter Vocoding and WORLD

A vocoder egy olyan eszköz, amely a beszédet építőelemekre szedi, és újraépíti.

2 min olvasniOlvassa el
Audio AI

Átlagos vélemény pontszám értékelése

A Mean Opinion Score (MOS) egy 1-től 5-ig terjedő átlagos értékelés az emberi hallgatóktól, amely azt méri, hogy a szintetizált vagy továbbított hang milyen jól hangzik.

2 min olvasniOlvassa el
Audio AI

Constant-Q Transform for Audio

A Constant-Q Transform (CQT) egy frekvenciaelemzés, amely a zenei hangmagassághoz igazított logaritmikus térközű bineket használ az egyenletes távolságú binok helyett...

2 min olvasniOlvassa el
Audio AI

Filterbank és PLP funkciók

A Filterbank és a Perceptual Linear Prediction (PLP) funkciók segítségével a beszédjeleket kompakt, érzékelhetően értelmes számokká lehet összefoglalni, amelyek gépi...

2 min olvasniOlvassa el
Audio AI

StyleTTS 2 Style Diffusion

A StyleTTS 2 egy szöveg-beszédmodell, amely a hang stílusát – prozódiát, érzelmet és hangszóró hangszínt – egy diffúziós modellel mintavételezett véletlen változóként kezeli…

2 min olvasniOlvassa el
Audio AI

FastPitch hangmagasság-vezérelhető TTS

A FastPitch egy gyors, nem autoregresszív szövegfelolvasó modell, amely explicit módon megjósolja minden beviteli token hangmagasságát (alapfrekvenciáját), lehetővé téve, hogy…

2 min olvasniOlvassa el
Audio AI

Voicebox Flow-Matching Speech Generation

A Voicebox a Meta szövegvezérelt beszédgenerálási modellje, amely egy folyamat-illesztési céllal van kiképezve a maszkolt hang „kitöltésére”, lehetővé téve az egyik modellnek, hogy nulla hangot adjon…

2 min olvasniOlvassa el
Audio AI

Mély zajelnyomási kihívás

A Deep Noise Suppression (DNS) Challenge egy Microsoft által lebonyolított verseny, amely arra készteti a kutatókat, hogy olyan neurális hálózatokat építsenek, amelyek eltávolítják a háttérzajt…

2 min olvasniOlvassa el
Audio AI

Spektrális kivonás és Wiener-szűrés

A spektrális kivonás és a Wiener-szűrés a zajcsökkentés klasszikus, mélytanulás előtti igáslovai.

2 min olvasniOlvassa el

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.