Gratis AI-bibliotheek

Audio-AI gidsenVoor altijd gratis.

117 duidelijke Engelse handleidingen, gestructureerde leertrajecten en een open bibliotheek – gebouwd door een onafhankelijke 501(c)(3) non-profitorganisatie, zodat iedereen de moderne AI kan begrijpen.

117Gratis gidsen
1Onderwerptracks
~2 minPer gids
~4hReading time

Begin hier

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Onderwerptracks

Blader op nummer

Spring naar het gebied waar u om geeft. Elke track heeft meerdere duidelijke Engelse gidsen.

Volledige bibliotheek

Alle gidsen

117 van 1019 gidsen getoond. Filter op nummer of zoek hierboven.

Audio-AI

Audio-ondertiteling

Audio-ondertiteling genereert een zin in natuurlijke taal die de inhoud van een audiofragment beschrijft, zoals 'een treinhoorn schalt wanneer deze een overweg passeert.

2 min gelezenLees
Audio-AI

Fluisterspraakherkenning

Whisper is het open-source automatische spraakherkenningssysteem van OpenAI dat audio omzet in tekst in meer dan 90 talen.

2 min gelezenLees
Audio-AI

Wav2Vec 2.0

Wav2Vec 2.0 is Meta AI's zelfgestuurde spraakmodel dat krachtige audiorepresentaties leert van onbewerkte, ongelabelde opnames.

2 min gelezenLees
Audio-AI

HuBERT zelfgecontroleerde toespraak

HuBERT (Hidden-Unit BERT) is Meta AI's zelfbegeleide spraakmodel dat leert door geclusterde audio-eenheden voor gemaskeerde segmenten te voorspellen, in BERT-stijl.

2 min gelezenLees
Audio-AI

Neurale vocoders

Een neurale vocoder is een model dat een compacte akoestische representatie, meestal een mel-spectrogram, omzet in een daadwerkelijk hoorbare golfvorm.

2 min gelezenLees
Audio-AI

Neurale audiocodecs

Neurale audiocodecs maken gebruik van deep learning om geluid te comprimeren in kleine stromen van afzonderlijke tokens en dit met hoge betrouwbaarheid te reconstrueren.

2 min gelezenLees
Audio-AI

VAL-E- en Codec-taalmodellen

VALL-E herformuleerde tekst-naar-spraak als een taalmodelleringsprobleem over audiocodec-tokens, waardoor het klonen van stemmen vanaf slechts drie seconden van een sample mogelijk werd.

2 min gelezenLees
Audio-AI

OpenAI Fluister

Whisper is het open-source automatische spraakherkenningssysteem van OpenAI dat gesproken audio in tientallen talen transcribeert en vertaalt.

2 min gelezenLees
Audio-AI

Automatische muziektranscriptie

Automatic Music Transcription (AMT) zet een ruwe audio-opname van muziek om in een symbolische notatie zoals bladmuziek, MIDI of een pianorol.

2 min gelezenLees
Audio-AI

Beat- en tempo-tracking

Beat- en tempotracking is de taak om de constante hartslag in muziek te vinden: waar elke tel valt en hoe snel het nummer beweegt in beats per minuut (BPM).

2 min gelezenLees
Audio-AI

Audio-vingerafdrukken

Audio-fingerprinting creëert een compacte, ruisbestendige digitale handtekening van een geluid, zodat het later kan worden herkend, zelfs door achtergrondgeluiden heen...

2 min gelezenLees
Audio-AI

Jukebox

Jukebox is het neurale netwerk van OpenAI uit 2020 dat rauwe muziekaudio genereert - compleet met zangstemmen, instrumenten en zelfs songteksten in de stijl van specifieke...

2 min gelezenLees

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.

Audio AI AI Guides — Page 8 of 10 | AI Understanding