Gratis AI-bibliotheek

Audio-AI gidsenVoor altijd gratis.

117 duidelijke Engelse handleidingen, gestructureerde leertrajecten en een open bibliotheek – gebouwd door een onafhankelijke 501(c)(3) non-profitorganisatie, zodat iedereen de moderne AI kan begrijpen.

117Gratis gidsen
1Onderwerptracks
~2 minPer gids
~4hReading time

Begin hier

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Onderwerptracks

Blader op nummer

Spring naar het gebied waar u om geeft. Elke track heeft meerdere duidelijke Engelse gidsen.

Volledige bibliotheek

Alle gidsen

117 van 1019 gidsen getoond. Filter op nummer of zoek hierboven.

Audio-AI

Zangstemsynthese

Singing Voice Synthesis (SVS) is AI die een geschreven melodie en tekst omzet in een volledig gezongen vocale uitvoering.

2 min gelezenLees
Audio-AI

AudioLM

AudioLM is een Google onderzoeksframework dat realistische audio (spraak- of pianomuziek) genereert door geluid als een taal te behandelen en dit te voorspellen als teken van...

2 min gelezenLees
Audio-AI

MuziekGen

MusicGen is het AI-model van Meta dat muziek genereert op basis van een tekstbeschrijving en optioneel een melodie die je neuriet of uploadt.

2 min gelezenLees
Audio-AI

Trefwoord spotten en wake-words

Keyword spotting is de altijd luisterende technologie waarmee een apparaat kan wachten op een enkele triggerzin zoals 'Hey Siri' of 'Alexa' voordat het springt...

2 min gelezenLees
Audio-AI

Geforceerde uitlijning

Geforceerde uitlijning lijnt automatisch een bekend transcript uit met de bijbehorende audio, waarbij precies wordt aangegeven wanneer elk woord of geluid begint en eindigt.

2 min gelezenLees
Audio-AI

Mel-spectrogrammen

Een mel-spectrogram is een beeld van geluid in de loop van de tijd, met een frequentie die zo is verdeeld als menselijke oren toonhoogte waarnemen.

2 min gelezenLees
Audio-AI

Connectionistische temporele classificatie

Connectionist Temporal Classification (CTC) is een verliesfunctie en decoderingsmethode waarmee neurale netwerken een lange audiosequentie in tekst kunnen omzetten zonder...

2 min gelezenLees
Audio-AI

RNN-transducermodellen

De RNN-Transducer (RNN-T) is een streamingvriendelijke architectuur voor spraakherkenning die de grootste zwakte van CTC oplost: het onvermogen om afhankelijkheden te modelleren...

2 min gelezenLees
Audio-AI

Conforme architectuur

De Conformer is een neuraal netwerkblok dat convolutie combineert met zelfaandacht, waarbij zowel fijnkorrelige lokale geluidspatronen als langeafstandscontext worden vastgelegd...

2 min gelezenLees

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.