Libreria AI gratuita

Tecnico guideLibero per sempre.

177 Guide in inglese semplice, percorsi di apprendimento strutturati e una libreria aperta, realizzati da un'organizzazione no profit 501(c)(3) indipendente in modo che chiunque possa comprendere l'intelligenza artificiale moderna.

177Guide gratuite
1Tracce di argomenti
~2 minPer guida
~6hTempo di lettura

Inizia qui

Cinque Corsi basati sui risultati

Ogni corso include risultati espliciti, competenze mappate, attività di pratica e un capstone applicato.

Tracce di argomenti

Sfoglia per traccia

Entra nell'area che ti interessa. Ogni traccia ha più guide in inglese semplice.

Libreria completa

Tutte le guide

177 di 1019 guide mostrate. Filtra per traccia o cerca sopra.

Tecnico

Streaming speculativo e previsione multi-token

Lo streaming speculativo e la previsione multi-token accelerano la generazione del modello linguistico indovinando diversi token futuri contemporaneamente e verificandoli in un unico...

2 minimo lettoLeggi
Tecnico

BERTScore e valutazione semantica

BERTScore misura quanto bene il testo generato dalla macchina corrisponde a un riferimento confrontando il significato, non le parole esatte.

2 minimo lettoLeggi
Tecnico

Attenzione lineare e nuclei dell'esecutore

L'attenzione lineare sostituisce l'attenzione softmax quadratica in Transformers con un trucco matematico che si adatta linearmente alla lunghezza della sequenza.

2 minimo lettoLeggi
Tecnico

YaRN ed estensione della lunghezza del contesto

YaRN (Yet another RoPE extensioN) è una tecnica efficiente per estendere la finestra di contesto utilizzabile di un modello ben oltre ciò su cui è stato addestrato.

2 minimo lettoLeggi
Tecnico

Interpolazione posizionale per contesto lungo

L'interpolazione posizionale (PI) è una tecnica semplice e influente che estende la finestra di contesto di un trasformatore inserendo nuovi indici di posizione nell'intervallo...

2 minimo lettoLeggi
Tecnico

Miscela di esperti LoRA

Mixture of LoRA Experts (MoLE) combina molti adattatori piccoli ed economici con un router appreso in modo che un singolo modello base possa specializzarsi in modo flessibile su...

2 minimo lettoLeggi
Tecnico

Modifiche speculative per modelli di codice

Le modifiche speculative rendono immediata la modifica del codice AI prevedendo che la maggior parte di un file rimarrà invariata e verificando solo le piccole parti che differiscono.

2 minimo lettoLeggi
Tecnico

Ingegneria dello sterzo e della rappresentazione dell'attivazione

Il controllo dell'attivazione modifica il comportamento di un modello aggiungendo o sottraendo direttamente i vettori all'interno delle sue attivazioni nascoste in fase di esecuzione, senza necessità di riqualificazione.

2 minimo lettoLeggi
Tecnico

Codificatori automatici sparsi per l'interpretabilità

Gli autocodificatori sparsi (SAE) sono uno strumento che separa le aggrovigliate attivazioni interne di una rete neurale in un insieme molto più ampio di più puliti...

2 minimo lettoLeggi
Tecnico

Sovrapposizione e polisemanticità nell'interpretabilità dell'intelligenza artificiale

Impara la sovrapposizione e la polisemanticità nell'interpretabilità dell'intelligenza artificiale: perché i modelli raggruppano le funzionalità in direzioni condivise, perché i neuroni diventano polisemantici...

2 minimo lettoLeggi
Tecnico

Obiettivo Logit e obiettivo ottimizzato

La lente logit e la lente sintonizzata sono tecniche di interpretabilità che sbirciano gli stati nascosti di un trasformatore strato dopo strato per vedere cosa sta "pensando" il modello...

2 minimo lettoLeggi
Tecnico

Stack di addestramento DeepSpeed ​​e Megatron

DeepSpeed ​​(Microsoft) e Megatron-LM (NVIDIA) sono gli stack software che creano modelli di training con miliardi di parametri su migliaia di GPU...

2 minimo lettoLeggi

Hai finito di leggere? Dimostralo.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.