Bibliotecă AI gratuită

Audio AI ghiduriLiber pentru totdeauna.

117 ghiduri în limba engleză simplă, căi de învățare structurate și o bibliotecă deschisă – construită de o organizație nonprofit independentă 501(c)(3), astfel încât oricine să poată înțelege IA modernă.

117Ghiduri gratuite
1Piese de subiecte
~2 minPe ghid
~4hTimp de lectură

Începeți de aici

Cinci cursuri bazate pe rezultate

Fiecare curs include rezultate explicite, competențe mapate, activități de practică și o piatră de bază aplicată.

Piese de subiecte

Răsfoiți după piesă

Sari în zona de care îți pasă. Fiecare piesă are mai multe ghiduri în limba engleză simplă.

Bibliotecă completă

Toate ghidurile

117 de 1019 ghiduri prezentate. Filtrați după piesă sau căutați mai sus.

Audio AI

Subtitrări audio

Subtitrarea audio generează o propoziție în limbaj natural care descrie conținutul unui clip audio, cum ar fi „un claxon de tren sună când trece pe lângă o trecere la nivel”.

2 min citireCitiți
Audio AI

Recunoașterea vorbirii în șoaptă

Whisper este sistemul open source de recunoaștere automată a vorbirii al OpenAI, care transformă sunetul în text în peste 90 de limbi.

2 min citireCitiți
Audio AI

Wav2Vec 2.0

Wav2Vec 2.0 este modelul de vorbire auto-supravegheat al Meta AI care învață reprezentări audio puternice din înregistrări brute, fără etichete.

2 min citireCitiți
Audio AI

Discurs autosupravegheat HuBERT

HuBERT (Hidden-Unit BERT) este Meta modelul de vorbire auto-supravegheat al AI care învață prin predicția unităților audio grupate pentru segmente mascate, în stil BERT.

2 min citireCitiți
Audio AI

Vocodere neuronale

Un vocoder neural este un model care transformă o reprezentare acustică compactă, de obicei o spectrogramă mel, într-o formă de undă audibilă reală.

2 min citireCitiți
Audio AI

Codecuri audio neuronale

Codecurile audio neuronale folosesc învățarea profundă pentru a comprima sunetul în fluxuri minuscule de simboluri discrete și pentru a-l reconstrui cu fidelitate ridicată.

2 min citireCitiți
Audio AI

Modele de limbaj VALL-E și Codec

VALL-E a reîncadrat text-to-speech ca o problemă de modelare a limbii peste jetoane de codec audio, permițând clonarea vocii din doar trei secunde dintr-o probă.

2 min citireCitiți
Audio AI

OpenAI Şoaptă

Whisper este sistemul open source de recunoaștere automată a vorbirii al OpenAI, care transcrie și traduce audio vorbit în zeci de limbi.

2 min citireCitiți
Audio AI

Transcriere automată a muzicii

Automatic Music Transcription (AMT) convertește o înregistrare audio brută a muzicii într-o notație simbolică, cum ar fi partitura, MIDI sau un rol de pian.

2 min citireCitiți
Audio AI

Urmărirea ritmului și a tempoului

Urmărirea ritmului și a tempoului este sarcina de a găsi pulsul constant în muzică: unde cade fiecare ritm și cât de repede se mișcă melodia în bătăi pe minut (BPM).

2 min citireCitiți
Audio AI

Amprentare audio

Amprentarea audio creează o semnătură digitală compactă, rezistentă la zgomot, a unui sunet, astfel încât să poată fi recunoscut ulterior, chiar și prin zgomotul de fundal...

2 min citireCitiți
Audio AI

Tonomat

Jukebox este rețeaua neuronală 2020 a OpenAI care generează sunet muzical brut - complet cu voci cântătoare, instrumente și chiar versuri în stilul specific...

2 min citireCitiți

Ai terminat de citit? Demonstrează.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.

Audio AI AI Guides — Page 8 of 10 | AI Understanding