Free AI library

Audio AI guiderFree forever.

117 plain-English guides, structured learning paths, and an open library — built by an independent 501(c)(3) nonprofit so anyone can understand modern AI.

117Gratis guider
1Topic tracks
~2 minPer guide
~4hReading time

Start her

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Topic tracks

Browse by track

Jump into the area you care about. Every track has multiple plain-English guides.

Full library

All guides

117 av 1019 guides shown. Filter by track or search above.

Audio AI

Lydteksting

Lydteksting genererer en setning på naturlig språk som beskriver innholdet i et lydklipp, for eksempel 'et toghorn smeller når det passerer en planovergang.

2 min readLes
Audio AI

Hviske talegjenkjenning

Whisper er OpenAIs åpen kildekode automatiske talegjenkjenningssystem som gjør lyd til tekst på tvers av 90+ språk.

2 min readLes
Audio AI

Wav2Vec 2.0

Wav2Vec 2.0 er Meta AIs selvovervåkede talemodell som lærer kraftige lydrepresentasjoner fra rå, umerkede opptak.

2 min readLes
Audio AI

HuBERT selvstyrt tale

HuBERT (Hidden-Unit BERT) er Meta AIs selvovervåkede talemodell som lærer ved å forutsi grupperte lydenheter for maskerte segmenter, BERT-stil.

2 min readLes
Audio AI

Nevrale vokodere

En nevral vokoder er en modell som gjør en kompakt akustisk representasjon, vanligvis et mel-spektrogram, til en faktisk hørbar bølgeform.

2 min readLes
Audio AI

Nevrale lydkodeker

Nevrale lydkodeker bruker dyp læring for å komprimere lyd til små strømmer av diskrete tokens og rekonstruere den med høy kvalitet.

2 min readLes
Audio AI

VAL-E og kodek språkmodeller

VALL-E omrammede tekst-til-tale som et språkmodelleringsproblem over lydkodek-tokens, noe som muliggjør stemmekloning fra bare tre sekunder av en prøve.

2 min readLes
Audio AI

OpenAI Hviske

Whisper er OpenAIs åpen kildekode automatiske talegjenkjenningssystem som transkriberer og oversetter talt lyd på tvers av dusinvis av språk.

2 min readLes
Audio AI

Automatisk musikktranskripsjon

Automatic Music Transcription (AMT) konverterer et rå lydopptak av musikk til en symbolsk notasjon som noter, MIDI eller en pianorull.

2 min readLes
Audio AI

Beat- og temposporing

Takt- og temposporing er oppgaven med å finne den jevne pulsen i musikk: hvor hvert slag faller og hvor raskt sangen beveger seg i slag per minutt (BPM).

2 min readLes
Audio AI

Lyd-fingeravtrykk

Lydfingeravtrykk skaper en kompakt, støybestandig digital signatur av en lyd, slik at den kan gjenkjennes senere, selv gjennom bakgrunnsstøy...

2 min readLes
Audio AI

Jukeboks

Jukebox er OpenAIs 2020 nevrale nettverk som genererer rå musikklyd – komplett med sangstemmer, instrumenter og til og med tekster i stil med spesifikke...

2 min readLes

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.