Free AI library

Visuell AI guiderFree forever.

133 plain-English guides, structured learning paths, and an open library — built by an independent 501(c)(3) nonprofit so anyone can understand modern AI.

133Gratis guider
1Topic tracks
~2 minPer guide
~4hReading time

Börja här

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Topic tracks

Browse by track

Jump into the area you care about. Every track has multiple plain-English guides.

Full library

All guides

133 av 1019 guides shown. Filter by track or search above.

Visuell AI

Neurala strålningsfält

Neural Radiance Fields (NeRF) rekonstruerar en fullständig 3D-scen från en handfull vanliga foton, så att du kan flyga kameran till helt nya synpunkter.

2 min readLäs
Visuell AI

Gaussiskt stänk

Gaussisk stänk representerar en 3D-scen som miljontals små, färgade, halvtransparenta blobbar som kan renderas i realtid.

2 min readLäs
Visuell AI

Maskerade autokodare

Masked Autoencoders (MAE) är en självövervakad metod som lär en visionmodell att rekonstruera bilder efter att större delen av bilden har gömts.

2 min readLäs
Visuell AI

Bildtextning

Bildtextning är uppgiften att automatiskt generera en mening på naturligt språk som beskriver vad som finns i en bild.

2 min readLäs
Visuell AI

Svara på visuella frågor

Visual Question Answering (VQA) låter ett system besvara frågor på naturligt språk i fritt format om en bild, som "Hur många människor bär hattar?"

2 min readLäs
Visuell AI

YOLO Realtidsdetektering

YOLO (You Only Look Once) är en familj av objektdetekteringsmodeller som hittar och märker varje objekt i en bild med ett enda neuralt nätverkspass, tillräckligt snabbt...

2 min readLäs
Visuell AI

Panoptisk segmentering

Panoptisk segmentering ger varje enskild pixel i en bild en etikett, som förenar "vad är det här området" med "vilket specifikt objekt är detta.

2 min readLäs
Visuell AI

Mänsklig poseuppskattning

Mänsklig poseuppskattning upptäcker positionerna för kroppsleder, såsom armbågar, knän och axlar, för att bygga ett digitalt skelett av en person från bilder ...

2 min readLäs
Visuell AI

FLUX bildmodeller

FLUX är en familj av öppna text-till-bild-modeller från Black Forest Labs kända för skarpa detaljer, stark promptföljning och förvånansvärt exakt renderad text.

2 min readLäs
Visuell AI

Resterande nätverk

Residual Networks (ResNets) är djupa neurala nätverk som lägger till "hoppa över anslutningar" som låter lager lära sig små justeringar istället för fullständiga transformationer.

2 min readLäs
Visuell AI

Regionbaserade CNN

Regionbaserade CNN (R-CNN) är en familj av objektdetektorer som först föreslår kandidatregioner i en bild och sedan använder en CNN för att klassificera och exakt boxas...

2 min readLäs
Visuell AI

Swin Transformator

Swin Transformer är en vision Transformer som bearbetar bilder i förskjutna, hierarkiska fönster, vilket gör uppmärksamheten tillräckligt effektiv för att skala över ...

2 min readLäs

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.