Free AI library

Visuell AI guiderFree forever.

133 plain-English guides, structured learning paths, and an open library — built by an independent 501(c)(3) nonprofit so anyone can understand modern AI.

133Gratis guider
1Topic tracks
~2 minPer guide
~4hReading time

Börja här

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Topic tracks

Browse by track

Jump into the area you care about. Every track has multiple plain-English guides.

Full library

All guides

133 av 1019 guides shown. Filter by track or search above.

Visuell AI

Optisk teckenigenkänning

Optical Character Recognition (OCR) förvandlar bilder av text — skannade dokument, foton av skyltar, PDF-filer — till maskinläsbar, redigerbar text.

2 min readLäs
Visuell AI

Optiskt flöde

Optiskt flöde uppskattar hur varje pixel rör sig mellan på varandra följande videorutor, vilket ger en tät karta av rörelsevektorer.

2 min readLäs
Visuell AI

Monokulär djupuppskattning

Monokulär djupuppskattning förutsäger hur långt borta varje pixel är från ett enda vanligt foto - ingen stereokamera, lidar eller djupsensor krävs.

2 min readLäs
Visuell AI

Latent diffusionsmodeller

Latenta diffusionsmodeller genererar bilder genom att köra diffusionsprocessen i ett komprimerat latent utrymme istället för råpixlar, vilket minskar beräkningskostnaderna.

2 min readLäs
Visuell AI

ControlNet

ControlNet är ett tillägg som ger bildgenererande modeller exakt strukturell kontroll, så att du kan styra utdata med kanter, poser, djupkartor eller klotter.

2 min readLäs
Visuell AI

Klassificeringsfri vägledning

Klassificeringsfri vägledning är tekniken som gör att diffusionsmodeller faktiskt följer din uppmaning och byter ut lite mångfald för mycket starkare efterlevnad.

2 min readLäs
Visuell AI

Visuell SLAM

Visual SLAM låter en rörlig kamera bygga en karta över ett okänt utrymme samtidigt som den spårar sin egen position inuti kartan.

2 min readLäs
Visuell AI

Sora och text-till-video

Sora är OpenAIs text-till-video-modell som förvandlar en skriftlig uppmaning till ett kort, högupplöst videoklipp.

2 min readLäs
Visuell AI

Videodiffusionsmodeller

Videodiffusionsmodeller genererar rörliga bilder genom att gradvis omvandla slumpmässigt brus till koherenta ramar, vilket utökar diffusionsidén från bilder till tid.

2 min readLäs
Visuell AI

Text-till-3D-generering

Text-till-3D-generering förvandlar en skriven prompt som "en vintage läderfåtölj" till en fullständig 3D-modell som du kan rotera, tända och släppa in i ett spel eller en scen.

2 min readLäs
Visuell AI

Differentierbar rendering

Differentierbar rendering gör processen att förvandla en 3D-scen till en 2D-bild helt differentierbar, så att du kan beräkna gradienter från de renderade pixlarna...

2 min readLäs
Visuell AI

U-Net arkitektur

U-Net är ett konvolutionellt neuralt nätverk format som ett "U" som utmärker sig för att producera pixelprecisa utdata, ursprungligen för biomedicinsk bildsegmentering.

2 min readLäs

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.