Bibliotecă AI gratuită

Tehnic ghiduriLiber pentru totdeauna.

177 ghiduri în limba engleză simplă, căi de învățare structurate și o bibliotecă deschisă – construită de o organizație nonprofit independentă 501(c)(3), astfel încât oricine să poată înțelege IA modernă.

177Ghiduri gratuite
1Piese de subiecte
~2 minPe ghid
~6hTimp de lectură

Începeți de aici

Cinci cursuri bazate pe rezultate

Fiecare curs include rezultate explicite, competențe mapate, activități de practică și o piatră de bază aplicată.

Piese de subiecte

Răsfoiți după piesă

Sari în zona de care îți pasă. Fiecare piesă are mai multe ghiduri în limba engleză simplă.

Bibliotecă completă

Toate ghidurile

177 de 1019 ghiduri prezentate. Filtrați după piesă sau căutați mai sus.

Tehnic

Paralelismul secvenței și atenția inelului

Paralelismul secvenței împarte o singură secvență lungă de intrare în mai multe GPU-uri de-a lungul dimensiunii simbolului (timp), iar Ring Attention permite acelor GPU-uri să calculeze...

2 min citireCitiți
Tehnic

Compensații de calcul de activare

Recalcularea activării (gradient sau punct de control al activării) salvează memoria GPU în timpul antrenamentului, eliminând activările intermediare în trecerea înainte...

2 min citireCitiți
Tehnic

Optimizare relativă a politicii de grup

Group Relative Policy Optimization (GRPO) este o metodă de învățare-întărire pentru reglarea fină a modelelor lingvistice care judecă fiecare răspuns în raport cu un grup...

2 min citireCitiți
Tehnic

Normalizarea fluxurilor

Fluxurile de normalizare sunt modele generative care transformă zgomotul simplu (precum un gaussian) în date complexe printr-un lanț de inversabile, diferențiabile...

2 min citireCitiți
Tehnic

Modele bazate pe energie

Modelele bazate pe energie (EBM) învață o funcție scalară „energie” care atribuie valori scăzute datelor plauzibile și valori ridicate datelor neplauzibile, definind...

2 min citireCitiți
Tehnic

Descărcarea stării optimizatorului către CPU și NVMe

Un truc de economisire a memoriei care parcă evidența grea a antrenamentului (stări de optimizare, gradienți, uneori greutăți) în RAM CPU sau pe SSD-urile NVMe...

2 min citireCitiți
Tehnic

Partajarea punctelor de control și antrenamentul reluabil

Tehnici de salvare a stării de antrenament a unui model în bucăți (cioburi), astfel încât modelele gigantice să poată fi salvate și reîncărcate fără a se sufoca limitele de memorie sau de disc și așa...

2 min citireCitiți
Tehnic

Gestionarea și fragmentarea memoriei GPU

Cum cadrele AI alocă, reutilizează și recuperează memoria limitată pe un GPU și de ce golurile rămase (fragmentarea) pot cauza erori de lipsă de memorie chiar...

2 min citireCitiți
Tehnic

Partiționare GPU cu mai multe instanțe

Multi-Instance GPU (MIG) este o tehnologie NVIDIA care segmentează un singur GPU fizic în mai multe partiții hardware izolate.

2 min citireCitiți
Tehnic

Programare GPU și orchestrare cluster

Programarea GPU decide ce joburi rulează pe ce acceleratoare și când, în timp ce orchestrarea coordonează aceste joburi pe un întreg cluster de mașini.

2 min citireCitiți
Tehnic

Slurm pentru clustere de formare AI

Slurm este un manager de sarcină de lucru open-source care programează și rulează joburi pe clustere de calcul de înaltă performanță și a devenit o alegere implicită pentru AI mari...

2 min citireCitiți
Tehnic

Prompt pentru planificare și rezolvare

Solicitarea Planificare și rezolvare (PS) îi spune unui model de limbaj să elaboreze mai întâi un plan explicit și apoi să-l efectueze pas cu pas, reparând eșecurile care clar...

2 min citireCitiți

Ai terminat de citit? Demonstrează.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.