Free AI library

Visual AI guiderFree forever.

133 plain-English guides, structured learning paths, and an open library — built by an independent 501(c)(3) nonprofit so anyone can understand modern AI.

133Gratis guider
1Topic tracks
~2 minPer guide
~4hReading time

Start her

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Topic tracks

Browse by track

Jump into the area you care about. Every track has multiple plain-English guides.

Full library

All guides

133 av 1019 guides shown. Filter by track or search above.

Visual AI

Optisk tegngjenkjenning

Optical Character Recognition (OCR) gjør bilder av tekst – skannede dokumenter, bilder av skilt, PDF-er – til maskinlesbar, redigerbar tekst.

2 min readLes
Visual AI

Optisk strømning

Optisk flyt estimerer hvordan hver piksel beveger seg mellom påfølgende videobilder, og produserer et tett kart over bevegelsesvektorer.

2 min readLes
Visual AI

Monokulær dybdeestimering

Monokulær dybdeestimering forutsier hvor langt unna hver piksel er fra et enkelt vanlig bilde – ingen stereokamera, lidar eller dybdesensor kreves.

2 min readLes
Visual AI

Latente diffusjonsmodeller

Latente diffusjonsmodeller genererer bilder ved å kjøre diffusjonsprosessen i et komprimert latent rom i stedet for råpiksler, noe som reduserer beregningskostnadene.

2 min readLes
Visual AI

ControlNet

ControlNet er et tillegg som gir bildegenereringsmodeller presis strukturell kontroll, slik at du kan styre produksjonen med kanter, positurer, dybdekart eller skriblerier.

2 min readLes
Visual AI

Klassifiseringsfri veiledning

Klassifiseringsfri veiledning er teknikken som gjør at diffusjonsmodeller faktisk følger oppfordringen din, og bytter litt mangfold for mye sterkere etterlevelse.

2 min readLes
Visual AI

Visuell SLAM

Visual SLAM lar et bevegelig kamera bygge et kart over et ukjent rom samtidig som det sporer sin egen posisjon inne på kartet.

2 min readLes
Visual AI

Sora og tekst-til-video

Sora er OpenAIs tekst-til-video-modell som gjør en skriftlig melding om til et kort videoklipp med høy oppløsning.

2 min readLes
Visual AI

Videodiffusjonsmodeller

Videodiffusjonsmodeller genererer bevegelige bilder ved gradvis å gjøre tilfeldig støy om til sammenhengende rammer, og utvide diffusjonsideen fra bilder til annen.

2 min readLes
Visual AI

Tekst-til-3D-generering

Tekst-til-3D-generering gjør en skriftlig melding som "en vintage skinnstol" til en full 3D-modell du kan rotere, tenne og slippe inn i et spill eller en scene.

2 min readLes
Visual AI

Differensierbar gjengivelse

Differensierbar gjengivelse gjør prosessen med å gjøre en 3D-scene til et 2D-bilde fullstendig differensierbar, slik at du kan beregne gradienter fra de gjengitte pikslene...

2 min readLes
Visual AI

U-Net arkitektur

U-Net er et konvolusjonelt nevralt nettverk formet som en "U" som utmerker seg ved å produsere pikselpresise utganger, opprinnelig for biomedisinsk bildesegmentering.

2 min readLes

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.