Libreria AI gratuita

IA visiva guideLibero per sempre.

133 Guide in inglese semplice, percorsi di apprendimento strutturati e una libreria aperta, realizzati da un'organizzazione no profit 501(c)(3) indipendente in modo che chiunque possa comprendere l'intelligenza artificiale moderna.

133Guide gratuite
1Tracce di argomenti
~2 minPer guida
~4hTempo di lettura

Inizia qui

Cinque Corsi basati sui risultati

Ogni corso include risultati espliciti, competenze mappate, attività di pratica e un capstone applicato.

Tracce di argomenti

Sfoglia per traccia

Entra nell'area che ti interessa. Ogni traccia ha più guide in inglese semplice.

Libreria completa

Tutte le guide

133 di 1019 guide mostrate. Filtra per traccia o cerca sopra.

IA visiva

Riconoscimento ottico dei caratteri

Il riconoscimento ottico dei caratteri (OCR) trasforma le immagini di testo (documenti scansionati, foto di segnali, PDF) in testo modificabile e leggibile dalla macchina.

2 minimo lettoLeggi
IA visiva

Flusso ottico

Il flusso ottico stima il modo in cui ciascun pixel si muove tra fotogrammi video consecutivi, producendo una fitta mappa di vettori di movimento.

2 minimo lettoLeggi
IA visiva

Stima della profondità monoculare

La stima della profondità monoculare prevede la distanza di ogni pixel da una singola foto ordinaria: non sono necessari fotocamera stereo, lidar o sensore di profondità.

2 minimo lettoLeggi
IA visiva

Modelli di diffusione latente

I modelli di diffusione latente generano immagini eseguendo il processo di diffusione in uno spazio latente compresso anziché in pixel grezzi, riducendo così i costi di elaborazione.

2 minimo lettoLeggi
IA visiva

ControlNet

ControlNet è un componente aggiuntivo che fornisce ai modelli di generazione di immagini un controllo strutturale preciso, consentendoti di indirizzare l'output con bordi, pose, mappe di profondità o scarabocchi.

2 minimo lettoLeggi
IA visiva

Guida senza classificatore

La guida senza classificatore è la tecnica che fa sì che i modelli di diffusione seguano effettivamente il tuo suggerimento, scambiando una certa diversità con un'aderenza molto più forte.

2 minimo lettoLeggi
IA visiva

SLAM visivo

Visual SLAM consente a una telecamera in movimento di costruire una mappa di uno spazio sconosciuto e allo stesso tempo di tracciare la propria posizione all'interno di quella mappa.

2 minimo lettoLeggi
IA visiva

Sora e testo in video

Sora è il modello da testo a video di OpenAI che trasforma un messaggio scritto in un breve video clip ad alta risoluzione.

2 minimo lettoLeggi
IA visiva

Modelli di diffusione video

I modelli di diffusione video generano immagini in movimento trasformando gradualmente il rumore casuale in fotogrammi coerenti, estendendo l'idea di diffusione dalle immagini al tempo.

2 minimo lettoLeggi
IA visiva

Generazione da testo a 3D

La generazione da testo a 3D trasforma un messaggio scritto come "una poltrona in pelle vintage" in un modello 3D completo che puoi ruotare, illuminare e inserire in un gioco o in una scena.

2 minimo lettoLeggi
IA visiva

Rendering differenziabile

Il rendering differenziabile rende il processo di trasformazione di una scena 3D in un'immagine 2D completamente differenziabile, in modo da poter calcolare i gradienti dai pixel renderizzati...

2 minimo lettoLeggi
IA visiva

Architettura U-Net

U-Net è una rete neurale convoluzionale a forma di "U" che eccelle nel produrre output precisi al pixel, originariamente per la segmentazione delle immagini biomediche.

2 minimo lettoLeggi

Hai finito di leggere? Dimostralo.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.