Libreria AI gratuita

IA visiva guideLibero per sempre.

133 Guide in inglese semplice, percorsi di apprendimento strutturati e una libreria aperta, realizzati da un'organizzazione no profit 501(c)(3) indipendente in modo che chiunque possa comprendere l'intelligenza artificiale moderna.

133Guide gratuite
1Tracce di argomenti
~2 minPer guida
~4hTempo di lettura

Inizia qui

Cinque Corsi basati sui risultati

Ogni corso include risultati espliciti, competenze mappate, attività di pratica e un capstone applicato.

Tracce di argomenti

Sfoglia per traccia

Entra nell'area che ti interessa. Ogni traccia ha più guide in inglese semplice.

Libreria completa

Tutte le guide

133 di 1019 guide mostrate. Filtra per traccia o cerca sopra.

IA visiva

Pipeline da testo a 3D Magic3D

Magic3D è la risposta in due fasi di NVIDIA a DreamFusion, producendo più velocemente contenuti 3D ad alta risoluzione e dettagliati.

2 minimo lettoLeggi
IA visiva

Reti di denoising e deblurring

Le reti di denoising e deblurring sono modelli neurali che ripuliscono immagini rumorose o sfocate, recuperando dettagli nitidi da input disordinati.

2 minimo lettoLeggi
IA visiva

GFPGAN Restauro del viso

GFPGAN è un modello specializzato che ripristina foto di volti di bassa qualità, sfocate o vecchie in ritratti nitidi e realistici.

2 minimo lettoLeggi
IA visiva

CodeFormer Robusto recupero del volto

CodeFormer è un modello di ripristino del volto creato per gestire il degrado estremo, recuperando volti riconoscibili da input gravemente danneggiati, minuscoli o sfocati.

2 minimo lettoLeggi
IA visiva

Generatori in scala GigaGAN

GigaGAN è un GAN da miliardi di parametri che dimostra che le reti generative avversarie possono scalare fino alla generazione di testo in immagine, rivaleggiando con i modelli di diffusione...

2 minimo lettoLeggi
IA visiva

VQGAN e sintesi di immagini del codebook

VQGAN comprime le immagini in una griglia di token discreti estratti da un codice appreso, consentendo a un trasformatore di generare immagini allo stesso modo dei modelli linguistici...

2 minimo lettoLeggi
IA visiva

Decodifica token parallela MaskGIT

MaskGIT genera immagini prevedendo molti token contemporaneamente e compilando prima quelli più sicuri, sostituendo la lenta generazione da sinistra a destra...

2 minimo lettoLeggi
IA visiva

Diffusione della vista del romanzo da zero a 3

Zero-1-to-3 trasforma una singola foto di un oggetto in immagini di quello stesso oggetto visto da qualsiasi nuova angolazione, utilizzando un modello di diffusione condizionato dalla fotocamera...

2 minimo lettoLeggi
IA visiva

Rappresentazione 3D ibrida DMTet

DMTet (Deep Marching Tetrahedra) è una rappresentazione di forma 3D ibrida che combina una griglia tetraedrica deformabile con un campo di distanza segnato così neurale...

2 minimo lettoLeggi
IA visiva

Codifica hash NGP istantanea

Instant-NGP è la tecnica di NVIDIA che addestra i Neural Radiance Fields e altre primitive grafiche neurali in pochi secondi anziché in ore, memorizzando i dati apprendibili...

2 minimo lettoLeggi
IA visiva

DepthAnything Profondità monoculare

DepthAnything è un modello di base che stima la distanza di ogni pixel da una singola foto ordinaria, senza hardware speciale.

2 minimo lettoLeggi
IA visiva

Stima della profondità di diffusione della calendula

Marigold ripropone un modello di diffusione di generazione di immagini preaddestrato (Stable Diffusion) per prevedere mappe di profondità altamente dettagliate.

2 minimo lettoLeggi

Hai finito di leggere? Dimostralo.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.