Free AI library

Visuell AI guiderFree forever.

133 plain-English guides, structured learning paths, and an open library — built by an independent 501(c)(3) nonprofit so anyone can understand modern AI.

133Gratis guider
1Topic tracks
~2 minPer guide
~4hReading time

Börja här

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Topic tracks

Browse by track

Jump into the area you care about. Every track has multiple plain-English guides.

Full library

All guides

133 av 1019 guides shown. Filter by track or search above.

Visuell AI

Videoförståelse

Video understanding analyzes visual and sometimes audio information across time.

2 min readLäs
Visuell AI

Multimodal sökning

Multimodal search retrieves information across forms such as text, images, audio, and video.

2 min readLäs
Visuell AI

Dokument AI

Document AI extracts and interprets information from files such as forms, reports, invoices, and scanned pages.

2 min readLäs
Visuell AI

Wasserstein GAN

Wasserstein GAN (WGAN) är en omdesign av GAN-träningsmålet som använder Wasserstein-distansen istället för den ursprungliga min-max-förlusten.

2 min readLäs
Visuell AI

Villkorliga GAN:er

Villkorliga GAN (cGAN) utökar vanliga GAN genom att mata in extra information, som en klassetikett eller text, till både generatorn och diskriminatorn.

2 min readLäs
Visuell AI

Pix2Pix bild-till-bild översättning

Pix2Pix är en villkorad GAN som lär sig att översätta en typ av bild till en annan, som att förvandla en skiss till ett foto eller en karta till en satellitvy.

2 min readLäs
Visuell AI

Färgläggning av bilder

Bildfärgning använder AI för att lägga till rimliga, realistiska färger till svartvita foton och film.

2 min readLäs
Visuell AI

Struktur från Motion

Structure from Motion (SfM) rekonstruerar 3D-scengeometri och kamerapositioner från en uppsättning överlappande 2D-bilder tagna från olika synvinklar.

2 min readLäs
Visuell AI

Multi-View stereo

Multi-View Stereo (MVS) tar många kalibrerade bilder av en scen och producerar en tät 3D-rekonstruktion genom att uppskatta djupet vid nästan varje pixel.

2 min readLäs
Visuell AI

DDPM och DDIM Samplers

DDPM och DDIM är två sätt att köra den omvända processen av en diffusionsmodell, förvandla slumpmässigt brus till en bild steg för steg.

2 min readLäs
Visuell AI

Poängbaserade generativa modeller

Poängbaserade generativa modeller skapar data genom att lära sig gradienten för datadistributionen - riktningen som får alla bullriga prov att se mer ut som verkliga...

2 min readLäs
Visuell AI

Fréchet startavstånd

Fréchet Inception Distance (FID) är standardmåttet för att bedöma hur realistisk och varierad en uppsättning genererade bilder är.

2 min readLäs

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.