Free AI library

Audio AI guiderFree forever.

117 plain-English guides, structured learning paths, and an open library — built by an independent 501(c)(3) nonprofit so anyone can understand modern AI.

117Gratis guider
1Topic tracks
~2 minPer guide
~4hReading time

Start her

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Topic tracks

Browse by track

Jump into the area you care about. Every track has multiple plain-English guides.

Full library

All guides

117 av 1019 guides shown. Filter by track or search above.

Audio AI

EnCodec lydkomprimering

EnCodec er Metas high-fidelity nevrale lydkodek som komprimerer tale og musikk med svært lave bithastigheter med kvalitet som konkurrerer med langt tyngre formater.

2 min readLes
Audio AI

Restvektorkvantisering

Residual vector quantization (RVQ) er teknikken som gjør kontinuerlig lydinnbygging til en kompakt stabel med diskrete koder ved gjentatte kvantisering...

2 min readLes
Audio AI

ECAPA-TDNN høyttalergjenkjenning

ECAPA-TDNN er en nevral nettverksarkitektur som gjør et hvilket som helst taleklipp til en kompakt «stemmeavtrykk»-innbygging, som gjør det mulig for maskiner å fortelle hvem som snakker.

2 min readLes
Audio AI

Høyttaler Anti-spoofing og ASVspoof

Anti-spoofing er det defensive laget som oppdager falske eller gjenspilte stemmer som prøver å lure stemmeautentiseringssystemer.

2 min readLes
Audio AI

Speech Deoising med RNNoise

RNNoise er et lite, raskt nevralt nettverk som fjerner bakgrunnsstøy fra tale i sanntid.

2 min readLes
Audio AI

Lydinnbygging og representasjonslæring

Lydinnbygging gjør lyd til kompakte numeriske vektorer som fanger mening, slik at maskiner kan sammenligne, søke og klassifisere lyd slik mennesker gjenkjenner...

2 min readLes
Audio AI

Akustisk ekko kansellering

Acoustic Echo Cancellation (AEC) er teknologien som hindrer deg i å høre din egen stemme sprette tilbake under en samtale.

2 min readLes
Audio AI

Taleseparasjon og Cocktailparty-problemet

Taleseparasjon er oppgaven med å trekke individuelle stemmer fra et opptak der flere personer snakker samtidig.

2 min readLes
Audio AI

Permutasjonsinvariant trening

Permutation invariant training (PIT) er et smart treningstriks som lar en modell skille flere stemmer uten å bry seg om hvilket utgangsspor hver stemme lander...

2 min readLes
Audio AI

Innhenting av musikkinformasjon

Music Information Retrieval (MIR) er feltet som lærer datamaskiner å analysere, forstå og søke etter musikk fra lydsignaler og partiturer.

2 min readLes
Audio AI

Demucs og HT-Demucs musikkkildeseparasjon

Lær hvordan Demucs og HT-Demucs skiller musikk i vokal og instrumentstammer ved hjelp av bølgeform, spektrogram og transformatormodellering.

2 min readLes
Audio AI

Lydakkordgjenkjenning

Lydakkordgjenkjenning er oppgaven med å automatisk merke akkordene som spilles gjennom en sang direkte fra lyden.

2 min readLes

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.