Bibliotecă AI gratuită

Tehnic ghiduriLiber pentru totdeauna.

177 ghiduri în limba engleză simplă, căi de învățare structurate și o bibliotecă deschisă – construită de o organizație nonprofit independentă 501(c)(3), astfel încât oricine să poată înțelege IA modernă.

177Ghiduri gratuite
1Piese de subiecte
~2 minPe ghid
~6hTimp de lectură

Începeți de aici

Cinci cursuri bazate pe rezultate

Fiecare curs include rezultate explicite, competențe mapate, activități de practică și o piatră de bază aplicată.

Piese de subiecte

Răsfoiți după piesă

Sari în zona de care îți pasă. Fiecare piesă are mai multe ghiduri în limba engleză simplă.

Bibliotecă completă

Toate ghidurile

177 de 1019 ghiduri prezentate. Filtrați după piesă sau căutați mai sus.

Tehnic

Streaming speculativ și predicție multi-token

Streamingul speculativ și predicția multi-token accelerează generarea modelului de limbă prin ghicirea mai multor jetoane viitoare simultan și verificându-le într-un singur...

2 min citireCitiți
Tehnic

BERTScore și evaluare semantică

BERTScore măsoară cât de bine se potrivește textul generat de mașină cu o referință comparând sensul, nu cuvintele exacte.

2 min citireCitiți
Tehnic

Atenție liniară și nuclee performer

Atenția liniară înlocuiește atenția softmax pătratică din Transformers cu un truc de matematică care se scalează liniar cu lungimea secvenței.

2 min citireCitiți
Tehnic

Extensia YRN și a lungimii contextului

YaRN (Yet another ROPE extension) este o tehnică eficientă pentru a extinde fereastra de context utilizabilă a unui model cu mult dincolo de ceea ce a fost antrenat.

2 min citireCitiți
Tehnic

Interpolare pozițională pentru context lung

Interpolarea pozițională (PI) este o tehnică simplă, influentă, care extinde fereastra de context a unui transformator prin stoarcerea de noi indici de poziție în intervalul...

2 min citireCitiți
Tehnic

Amestecul de experți LoRA

Mixture of LoRA Experts (MoLE) combină multe adaptoare mici, pregătite ieftin cu un router învățat, astfel încât un singur model de bază să se poată specializa în mod flexibil în...

2 min citireCitiți
Tehnic

Editări speculative pentru modelele de cod

Editările speculative fac ca editarea codului AI să se simtă instantanee, prezicând că cea mai mare parte a unui fișier va rămâne neschimbată și verificând doar părțile mici care diferă.

2 min citireCitiți
Tehnic

Inginerie de conducere și reprezentare a activării

Direcția de activare determină comportamentul unui model prin adăugarea sau scăderea directă a vectorilor în interiorul activărilor sale ascunse în timpul execuției, nefiind necesară reantrenarea.

2 min citireCitiți
Tehnic

Autoencodere rare pentru interpretabilitate

Autoencoderele rare (SAE) sunt un instrument care descompune activările interne încurcate ale unei rețele neuronale într-un set mult mai mare de mai curat...

2 min citireCitiți
Tehnic

Suprapunerea și polisemanticitatea în interpretabilitatea AI

Aflați suprapunerea și polisemanticitatea în interpretabilitatea AI: de ce modelele împachetează caracteristicile în direcții comune, de ce neuronii devin polisemantici...

2 min citireCitiți
Tehnic

Lens Logit și Lens Tuned

Lentila logit și lentila reglată sunt tehnici de interpretare care aruncă o privire la stările ascunse ale unui transformator strat cu strat pentru a vedea ce „gândește” modelul...

2 min citireCitiți
Tehnic

Stacks de antrenament DeepSpeed și Megatron

DeepSpeed (Microsoft) și Megatron-LM (NVIDIA) sunt stivele de software care creează modele de antrenament cu miliarde de parametri pe mii de GPU-uri...

2 min citireCitiți

Ai terminat de citit? Demonstrează.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.