Gratis AI-bibliotheek

Audio-AI gidsenVoor altijd gratis.

117 duidelijke Engelse handleidingen, gestructureerde leertrajecten en een open bibliotheek – gebouwd door een onafhankelijke 501(c)(3) non-profitorganisatie, zodat iedereen de moderne AI kan begrijpen.

117Gratis gidsen
1Onderwerptracks
~2 minPer gids
~4hReading time

Begin hier

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Onderwerptracks

Blader op nummer

Spring naar het gebied waar u om geeft. Elke track heeft meerdere duidelijke Engelse gidsen.

Volledige bibliotheek

Alle gidsen

117 van 1019 gidsen getoond. Filter op nummer of zoek hierboven.

Audio-AI

Beamforming en microfoonarrays

Beamforming maakt gebruik van meerdere microfoons om in een gekozen richting te luisteren, waarbij het geluid van een doel wordt versterkt en al het andere wordt onderdrukt.

2 min gelezenLees
Audio-AI

Riffusie Spectrogram Diffusie

Riffusion is een slimme hack die muziek genereert door geluid als een beeld te behandelen: het verfijnt het Stable Diffusion-beeldmodel om spectrogrammen te schilderen, en vervolgens...

2 min gelezenLees
Audio-AI

MusicLM: hiërarchische semantische en akoestische tokens

Ontdek hoe Google MusicLM hiërarchische semantische en akoestische tokens, SoundStream en MuLan gebruikt om tekstaanwijzingen om te zetten in samenhangende muziek.

2 min gelezenLees
Audio-AI

Noise2Noise Spraakverbetering

Noise2Noise is een trainingstruc waarmee een model kan leren ruis te verwijderen zonder ooit een zuivere referentie te zien, door te leren van paren met verschillende ruis...

2 min gelezenLees
Audio-AI

Conv-TasNet tijd-domeinscheiding

Conv-TasNet is een neuraal netwerk dat gemengde audio (zoals twee mensen tegelijk praten) scheidt door rechtstreeks op de ruwe geluidsgolfvorm te werken...

2 min gelezenLees
Audio-AI

Dual-Path RNN-scheiding

Dual-Path RNN (DPRNN) is een audioscheidingsarchitectuur die een zeer lange reeks audiofuncties opsplitst in korte, overlappende stukken en deze verwerkt...

2 min gelezenLees
Audio-AI

Open-Unmix muziekscheiding

Open-Unmix (UMX) is een open-source deep learning-systeem dat een nummer in zijn delen opsplitst: zang, drums, bas en andere instrumenten.

2 min gelezenLees
Audio-AI

Fluister tijdstempel Woorduitlijning

Fluisterwoorduitlijning zet elk getranscribeerd woord vast op een exacte begin- en eindtijd in de audio.

2 min gelezenLees
Audio-AI

Muziek taggen met Transformers

Muziektagging maakt gebruik van transformermodellen om naar een nummer te luisteren en beschrijvende labels zoals genre, stemming, instrumenten en tempo te voorspellen.

2 min gelezenLees
Audio-AI

Aanvangsdetectie in audio

Onset-detectie vindt de precieze momenten waarop noten, tellen of geluiden in een audiosignaal beginnen.

2 min gelezenLees
Audio-AI

MelGAN generatieve vocoder

MelGAN is een volledig convolutionele, op GAN gebaseerde vocoder die mel-spectrogrammen in één enkele snelle doorgang omzet in ruwe audiogolfvormen.

2 min gelezenLees
Audio-AI

UnivNet Vocoder met meerdere resoluties

UnivNet is een GAN-vocoder die gegenereerde audio beoordeelt met behulp van meerdere spectrogrammen berekend met verschillende STFT-resoluties, waardoor hoogfrequente details worden verscherpt.

2 min gelezenLees

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.