Libreria AI gratuita

IA visiva guideLibero per sempre.

133 Guide in inglese semplice, percorsi di apprendimento strutturati e una libreria aperta, realizzati da un'organizzazione no profit 501(c)(3) indipendente in modo che chiunque possa comprendere l'intelligenza artificiale moderna.

133Guide gratuite
1Tracce di argomenti
~2 minPer guida
~4hTempo di lettura

Inizia qui

Cinque Corsi basati sui risultati

Ogni corso include risultati espliciti, competenze mappate, attività di pratica e un capstone applicato.

Tracce di argomenti

Sfoglia per traccia

Entra nell'area che ti interessa. Ogni traccia ha più guide in inglese semplice.

Libreria completa

Tutte le guide

133 di 1019 guide mostrate. Filtra per traccia o cerca sopra.

IA visiva

Armonizzazione e composizione delle immagini

L'armonizzazione delle immagini regola automaticamente un oggetto in primo piano incollato in modo che il colore, l'illuminazione e il tono corrispondano al nuovo sfondo, facendo sembrare reali i compositi.

2 minimo lettoLeggi
IA visiva

SDXL e diffusione in cascata

SDXL è il modello testo-immagine ad alta risoluzione di Stability AI che abbina un potente generatore di base a un raffinatore, mentre la diffusione a cascata concatena più...

2 minimo lettoLeggi
IA visiva

Generazione di terra GLIGEN

GLIGEN (Grounded-Language-to-Image Generation) ti consente di controllare esattamente dove appaiono gli oggetti in un'immagine generata alimentando i riquadri di delimitazione del modello...

2 minimo lettoLeggi
IA visiva

Adattatore T2I per il controllo della diffusione multicondizionale

Scopri l'adattatore T2I per il controllo della diffusione multicondizionale: come gestisce la diffusione stabile con bordi, profondità, posa e altre condizioni utilizzando un peso leggero...

2 minimo lettoLeggi
IA visiva

Inversione di testo nullo

L'inversione del testo nullo è una tecnica che ti consente di modificare una foto reale con un modello di diffusione basato sul testo come Stable Diffusion mantenendo tutto ciò che...

2 minimo lettoLeggi
IA visiva

Sintonizzazione multiconcetto di diffusione personalizzata

La diffusione personalizzata è un metodo di regolazione fine leggero che insegna a un modello da testo a immagine nuovi concetti personali, come il tuo cane o una sedia specifica, da solo...

2 minimo lettoLeggi
IA visiva

Miscelazione latente e interpolazione delle immagini

La fusione latente mescola le immagini combinando le loro rappresentazioni compresse all'interno dello spazio latente di un modello anziché calcolare la media dei pixel grezzi.

2 minimo lettoLeggi
IA visiva

Modelli di visione-linguaggio-azione per la robotica

I modelli Vision-Language-Action (VLA) sono grandi reti neurali che acquisiscono le immagini della telecamera più un'istruzione scritta e inviano direttamente i comandi del motore del robot.

2 minimo lettoLeggi
IA visiva

Politica di diffusione per il controllo dei robot

La politica di diffusione applica la stessa idea di denoising alla base dei generatori di immagini come Stable Diffusion al controllo del robot: invece di prevedere una singola azione successiva...

2 minimo lettoLeggi
IA visiva

Crea un video Testo in video

Make-A-Video è il sistema 2022 di Meta che trasforma un messaggio di testo in un breve video clip senza mai esercitarsi sulle coppie testo-video etichettate.

2 minimo lettoLeggi
IA visiva

Cascate video di immagini

Imagen Video è il sistema text-to-video 2022 di Google che crea una clip attraverso una cascata di sette modelli di diffusione, ciascuno aggiungendo più fotogrammi o più risoluzione.

2 minimo lettoLeggi
IA visiva

CogVideo e CogVideoX

CogVideo (2022) è stato il primo modello aperto da testo a video su larga scala e CogVideoX (2024) è il suo successore open source molto più capace di Tsinghua/Zhipu AI.

2 minimo lettoLeggi

Hai finito di leggere? Dimostralo.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.