Fundații AI
Înțelegeți ce este AI, cum învață sistemele, unde eșuează și cum să judeci afirmațiile fără hype.
Bibliotecă AI gratuită
117 ghiduri în limba engleză simplă, căi de învățare structurate și o bibliotecă deschisă – construită de o organizație nonprofit independentă 501(c)(3), astfel încât oricine să poată înțelege IA modernă.
Începeți de aici
Fiecare curs include rezultate explicite, competențe mapate, activități de practică și o piatră de bază aplicată.
Înțelegeți ce este AI, cum învață sistemele, unde eșuează și cum să judeci afirmațiile fără hype.
Utilizați AI în mod productiv, protejând în același timp confidențialitatea, verificând rezultatele și păstrând responsabilitatea umană.
Evaluați cazurile de utilizare la locul de muncă, desfășurați piloți siguri, măsurați valoarea și comunicați schimbările în mod responsabil.
Analizați sistemele AI prin drepturi, echitate, guvernanță, siguranță și rezultate de interes public.
Înțelegeți modelele lingvistice, recuperarea, agenții, evaluarea, costurile și garanțiile de implementare prin proiectarea practică a sistemelor.
Piese de subiecte
Sari în zona de care îți pasă. Fiecare piesă are mai multe ghiduri în limba engleză simplă.
Bibliotecă completă
117 de 1019 ghiduri prezentate. Filtrați după piesă sau căutați mai sus.
Mimi este un codec audio neuronal care comprimă vorbirea într-un flux mic de jetoane discrete în timp real, astfel încât modelele AI să poată asculta și vorbi cu un nivel foarte scăzut...
Audio AIListen, Attend and Spell (LAS) este o rețea neuronală emblematică din 2015 care transcrie vorbirea direct în caractere, fără o pronunție construită manual...
Audio AISpecAugment este o metodă simplă, dar puternică de mărire a datelor, care maschează și deformează spectrograma vorbirii pentru a face modelele de recunoaștere mai robuste.
Audio AIEtichetarea automată a muzicii folosește învățarea automată pentru a asculta o melodie și pentru a atașa automat etichete descriptive precum genul, starea de spirit, instrumentele și tempo.
Audio AITransferul de timbru remodelează „culoarea tonului” audio, astfel încât un instrument să sune ca altul, transformând o melodie fredonată într-o vioară sau o linie de trompetă...
Audio AIClasificarea scenei acustice (ASC) antrenează mașinile pentru a recunoaște mediul în care a fost făcută o înregistrare, o stradă aglomerată, un parc liniștit, un tren, o cafenea...
Audio AINVIDIA Riva este un SDK accelerat de GPU pentru AI de vorbire de producție (ASR, TTS și traducere), în timp ce NeMo este setul de instrumente open-source pentru instruire și reglare fină...
Audio AIDeepSpeech este un model de recunoaștere a vorbirii de la capăt la capăt, introdus de Baidu în 2014, care mapează caracteristicile audio brute direct pe text utilizând un neuronal recurent...
Audio AIVectorii X sunt amprente numerice cu lungime fixă ale vocii unui vorbitor, produse de o rețea neuronală, folosite pentru a spune cine vorbește, indiferent de ceea ce spune.
Audio AIGlow-TTS este un model text-to-speech care învață să alinieze textul la vorbire singur folosind un truc inteligent de căutare, eliminând nevoia unui alinier separat.
Audio AIParallel WaveGAN este un vocoder neuronal rapid care transformă o spectrogramă mel într-o formă de undă audio brută folosind un GAN mic, generând toate mostrele simultan.
Audio AIWaveGlow este un vocoder neuronal bazat pe flux de la NVIDIA care sintetizează forme de undă de vorbire din spectrograme mel într-o singură trecere fără autoregresie.
Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.