Free AI library

Visuell AI guiderFree forever.

133 plain-English guides, structured learning paths, and an open library — built by an independent 501(c)(3) nonprofit so anyone can understand modern AI.

133Gratis guider
1Topic tracks
~2 minPer guide
~4hReading time

Börja här

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Topic tracks

Browse by track

Jump into the area you care about. Every track has multiple plain-English guides.

Full library

All guides

133 av 1019 guides shown. Filter by track or search above.

Visuell AI

Magic3D text-till-3D pipeline

Magic3D är NVIDIAs tvåstegssvar på DreamFusion, som producerar högre upplösning och mer detaljerat 3D-innehåll snabbare.

2 min readLäs
Visuell AI

Denoising och suddiga nätverk

Denoising och suddiga nätverk är neurala modeller som rensar upp brusiga eller suddiga bilder och återställer skarpa detaljer från röriga ingångar.

2 min readLäs
Visuell AI

GFPGAN Ansiktsrestaurering

GFPGAN är en specialiserad modell som återställer lågkvalitativa, suddiga eller gamla ansiktsfoton till skarpa, realistiska porträtt.

2 min readLäs
Visuell AI

CodeFormer Robust Face Recovery

CodeFormer är en ansiktsrestaureringsmodell byggd för att hantera extrem försämring och återställa igenkännbara ansikten från kraftigt skadade, små eller suddiga ingångar.

2 min readLäs
Visuell AI

GigaGAN skalade generatorer

GigaGAN är ett GAN med miljarder parametrar som bevisar att generativa kontradiktoriska nätverk kan skalas till text-till-bild-generering, konkurrerande spridningsmodeller...

2 min readLäs
Visuell AI

VQGAN och kodbok bildsyntes

VQGAN komprimerar bilder till ett rutnät av diskreta tokens hämtade från en inlärd kodbok, vilket låter en transformator generera bilder på samma sätt som språkmodeller...

2 min readLäs
Visuell AI

MaskGIT Parallell Token Decoding

MaskGIT genererar bilder genom att förutsäga många tokens på en gång och fylla i de mest säkra först, och ersätta långsam generation från vänster till höger...

2 min readLäs
Visuell AI

Noll-1-till-3 Novel View Diffusion

Noll-1-till-3 förvandlar ett enstaka foto av ett objekt till bilder av samma objekt sett från vilken ny vinkel som helst, med hjälp av en diffusionsmodell betingad på kameran...

2 min readLäs
Visuell AI

DMTet Hybrid 3D-representation

DMTet (Deep Marching Tetrahedra) är en hybrid 3D-formrepresentation som kombinerar ett deformerbart tetraedriskt rutnät med ett signerat avståndsfält så neuralt...

2 min readLäs
Visuell AI

Instant-NGP Hash-kodning

Instant-NGP är NVIDIAs teknik som tränar neurala strålningsfält och andra neurala grafikprimitiver på sekunder istället för timmar genom att lagra lärbara...

2 min readLäs
Visuell AI

DepthAnything Monokulärt djup

DepthAnything är en grundmodell som uppskattar hur långt bort varje pixel är från ett enda vanligt foto, utan någon speciell hårdvara.

2 min readLäs
Visuell AI

Ringblomma Diffusionsdjupuppskattning

Marigold använder en förtränad diffusionsmodell för bildgenerering (Stable Diffusion) för att förutsäga mycket detaljerade djupkartor.

2 min readLäs

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.

Visual AI AI Guides — Page 6 of 12 | AI Understanding