Free AI library

Visual AI guiderFree forever.

133 plain-English guides, structured learning paths, and an open library — built by an independent 501(c)(3) nonprofit so anyone can understand modern AI.

133Gratis guider
1Topic tracks
~2 minPer guide
~4hReading time

Start her

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Topic tracks

Browse by track

Jump into the area you care about. Every track has multiple plain-English guides.

Full library

All guides

133 av 1019 guides shown. Filter by track or search above.

Visual AI

Videoforståelse

Video understanding analyzes visual and sometimes audio information across time.

2 min readLes
Visual AI

Multimodalt søk

Multimodal search retrieves information across forms such as text, images, audio, and video.

2 min readLes
Visual AI

Dokument AI

Document AI extracts and interprets information from files such as forms, reports, invoices, and scanned pages.

2 min readLes
Visual AI

Wasserstein GAN

Wasserstein GAN (WGAN) er en redesign av GAN-treningsmålet som bruker Wasserstein-avstanden i stedet for det opprinnelige min-maks-tapet.

2 min readLes
Visual AI

Betingede GAN-er

Betingede GAN-er (cGAN-er) utvider vanlige GAN-er ved å mate ekstra informasjon, som en klasseetikett eller tekst, inn i både generatoren og diskriminatoren.

2 min readLes
Visual AI

Pix2Pix bilde-til-bilde-oversettelse

Pix2Pix er en betinget GAN som lærer å oversette en type bilder til en annen, for eksempel å gjøre en skisse til et bilde eller et kart til en satellittvisning.

2 min readLes
Visual AI

Bildefarging

Bildefarging bruker AI for å legge til plausible, realistiske farger til svart-hvitt-bilder og film.

2 min readLes
Visual AI

Struktur fra Motion

Structure from Motion (SfM) rekonstruerer 3D-scenegeometri og kameraposisjoner fra et sett med overlappende 2D-bilder tatt fra forskjellige synspunkter.

2 min readLes
Visual AI

Multi-View stereo

Multi-View Stereo (MVS) tar mange kalibrerte bilder av en scene og produserer en tett 3D-rekonstruksjon ved å estimere dybde ved nesten hver piksel.

2 min readLes
Visual AI

DDPM- og DDIM-samplere

DDPM og DDIM er to måter å kjøre den omvendte prosessen til en diffusjonsmodell på, ved å gjøre tilfeldig støy om til et bilde trinn for trinn.

2 min readLes
Visual AI

Score-baserte generative modeller

Poengbaserte generative modeller skaper data ved å lære gradienten til datadistribusjonen – retningen som får enhver støyende prøve til å se mer ut som ekte...

2 min readLes
Visual AI

Fréchet Begynnelsesavstand

Fréchet Inception Distance (FID) er standardverdien for å bedømme hvor realistisk og variert et sett med genererte bilder er.

2 min readLes

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.