Gratis AI-bibliotheek

Audio-AI gidsenVoor altijd gratis.

117 duidelijke Engelse handleidingen, gestructureerde leertrajecten en een open bibliotheek – gebouwd door een onafhankelijke 501(c)(3) non-profitorganisatie, zodat iedereen de moderne AI kan begrijpen.

117Gratis gidsen
1Onderwerptracks
~2 minPer gids
~4hReading time

Begin hier

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Onderwerptracks

Blader op nummer

Spring naar het gebied waar u om geeft. Elke track heeft meerdere duidelijke Engelse gidsen.

Volledige bibliotheek

Alle gidsen

117 van 1019 gidsen getoond. Filter op nummer of zoek hierboven.

Audio-AI

Spleeter-stamscheiding

Spleeter is een open-sourcetool van Deezer die een voltooid nummer opsplitst in afzonderlijke tracks (zang, drums, bas en meer) met behulp van deep learning.

2 min gelezenLees
Audio-AI

CREPE-pitchschatting

CREPE is een deep-learning model dat de fundamentele frequentie (toonhoogte) van een monofoon audiosignaal rechtstreeks schat op basis van de ruwe golfvorm.

2 min gelezenLees
Audio-AI

PESQ- en STOI-statistieken voor spraakkwaliteit

PESQ en STOI zijn standaard objectieve maatstaven die beoordelen hoe goed verwerkte spraak klinkt en hoe begrijpelijk deze is, zonder dat er menselijke luisteraars nodig zijn.

2 min gelezenLees
Audio-AI

Bronfilter Vocodering en WERELD

Een vocoder is een hulpmiddel dat spraak opsplitst in zijn bouwstenen en deze opnieuw opbouwt.

2 min gelezenLees
Audio-AI

Evaluatie van de gemiddelde opiniescore

Mean Opinion Score (MOS) is een gemiddelde beoordeling van 1 tot 5 van menselijke luisteraars die meet hoe goed gesynthetiseerde of verzonden audio klinkt.

2 min gelezenLees
Audio-AI

Constant-Q-transformatie voor audio

De Constant-Q Transform (CQT) is een frequentieanalyse die logaritmisch verdeelde bakken gebruikt die zijn afgestemd op de muzikale toonhoogte, in plaats van de gelijkmatig verdeelde bakken...

2 min gelezenLees
Audio-AI

Filterbank- en PLP-functies

Filterbank- en Perceptual Linear Prediction (PLP)-functies zijn manieren om een ​​spraaksignaal samen te vatten in compacte, perceptueel betekenisvolle getallen die machinale…

2 min gelezenLees
Audio-AI

StyleTTS 2 Stijlverspreiding

StyleTTS 2 is een tekst-naar-spraakmodel dat de 'stemstijl' (prosodie, emotie en sprekertimbre) behandelt als een willekeurige variabele, bemonsterd met een diffusiemodel...

2 min gelezenLees
Audio-AI

FastPitch pitch-controleerbare TTS

FastPitch is een snel, niet-autoregressief tekst-naar-spraakmodel dat expliciet de toonhoogte (fundamentele frequentie) van elk invoertoken voorspelt, zodat u...

2 min gelezenLees
Audio-AI

Voicebox Flow-Matchende spraakgeneratie

Voicebox is het tekstgestuurde spraakgeneratiemodel van Meta, getraind met een flow-matching-doelstelling om gemaskeerde audio 'in te vullen', waardoor één model zero-shot stem kan doen...

2 min gelezenLees
Audio-AI

Uitdaging voor diepe ruisonderdrukking

De Deep Noise Suppression (DNS) Challenge is een Microsoft-wedstrijd die onderzoekers ertoe aanzet neurale netwerken te bouwen die achtergrondgeluiden verwijderen...

2 min gelezenLees
Audio-AI

Spectrale aftrekking en Wiener-filtering

Spectrale aftrekking en Wiener-filtering zijn de klassieke, pre-deep-learning werkpaarden van ruisonderdrukking.

2 min gelezenLees

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.

Audio AI AI Guides — Page 5 of 10 | AI Understanding