Gratis AI-bibliotheek

Audio-AI gidsenVoor altijd gratis.

117 duidelijke Engelse handleidingen, gestructureerde leertrajecten en een open bibliotheek – gebouwd door een onafhankelijke 501(c)(3) non-profitorganisatie, zodat iedereen de moderne AI kan begrijpen.

117Gratis gidsen
1Onderwerptracks
~2 minPer gids
~4hReading time

Begin hier

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Onderwerptracks

Blader op nummer

Spring naar het gebied waar u om geeft. Elke track heeft meerdere duidelijke Engelse gidsen.

Volledige bibliotheek

Alle gidsen

117 van 1019 gidsen getoond. Filter op nummer of zoek hierboven.

Audio-AI

DiffWave Diffusie Vocoder

DiffWave is een op diffusie gebaseerde vocoder die audio synthetiseert door willekeurige ruis iteratief te denoseren tot een golfvorm, geconditioneerd op een mel-spectrogram.

2 min gelezenLees
Audio-AI

Bark generatief audiomodel

Bark is een open-source tekst-naar-audiomodel van Suno dat niet alleen spraak, maar ook gelach, zuchten, muziek en geluidseffecten rechtstreeks uit tekstprompts genereert.

2 min gelezenLees
Audio-AI

Schildpad TTS autoregressieve synthese

Tortoise TTS is een open-source tekst-naar-spraaksysteem dat wordt gewaardeerd vanwege de ongewoon natuurlijke, emotioneel rijke stemmen en het krachtig klonen van stemmen vanuit slechts een paar korte...

2 min gelezenLees
Audio-AI

XTTS Cross-Lingual stemklonen

XTTS is het meertalige tekst-naar-spraakmodel van Coqui dat een stem uit een korte clip kan klonen en vervolgens in veel verschillende talen kan spreken met behoud van...

2 min gelezenLees
Audio-AI

SoundStorm parallelle audiogeneratie

SoundStorm is een Google model voor het genereren van audio dat spraak en geluid parallel produceert in plaats van één token tegelijk, waardoor audiosynthese van hoge kwaliteit...

2 min gelezenLees
Audio-AI

AudioGen tekst-naar-audio-synthese

AudioGen is een Meta model dat tekstbeschrijvingen omzet in realistische omgevingsgeluiden en geluidseffecten, zoals 'blaffende honden terwijl vogels fluiten'.

2 min gelezenLees
Audio-AI

Stabiele latente audioverspreiding

Stable Audio is het tekst-naar-audiosysteem van Stability AI dat latente diffusie gebruikt om muziek en geluidseffecten te genereren, met expliciete controle over de cliplengte.

2 min gelezenLees
Audio-AI

Kaldi Spraakherkenningstoolkit

Kaldi is een gratis, open-source toolkit die het dominante onderzoeksplatform is geworden voor het bouwen van spraakherkenningssystemen.

2 min gelezenLees
Audio-AI

Wav2Letter Convolutionele ASR

Wav2Letter is een end-to-end spraakherkenningssysteem van Facebook AI dat alleen convolutionele neurale netwerken gebruikte, zonder herhaling.

2 min gelezenLees
Audio-AI

Jasper en QuartzNet ASR

Jasper en QuartzNet zijn NVIDIA's end-to-end convolutionele spraakherkenningsmodellen, waarbij QuartzNet een dramatisch kleiner, efficiënter herontwerp is...

2 min gelezenLees
Audio-AI

Verspreidingsmodellen voor audio

Diffusiemodellen genereren audio door te leren een stapsgewijs ruisproces om te keren, waarbij willekeurige ruis wordt omgezet in samenhangende spraak, muziek of geluidseffecten.

2 min gelezenLees
Audio-AI

Detectie van geluidsgebeurtenissen

Sound Event Detection (SED) identificeert welke geluiden voorkomen in een audiostream en precies wanneer ze beginnen en stoppen.

2 min gelezenLees

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.