Free AI library

Visuell AI guiderFree forever.

133 plain-English guides, structured learning paths, and an open library — built by an independent 501(c)(3) nonprofit so anyone can understand modern AI.

133Gratis guider
1Topic tracks
~2 minPer guide
~4hReading time

Börja här

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Topic tracks

Browse by track

Jump into the area you care about. Every track has multiple plain-English guides.

Full library

All guides

133 av 1019 guides shown. Filter by track or search above.

Visuell AI

LoRA-skjutreglage för bildredigering

LoRA-skjutreglage är små tilläggsmoduler som ger dig en kontinuerlig ratt för att trycka ett enda attribut i en bild uppåt eller nedåt, som ålder, leende eller rost, utan...

2 min readLäs
Visuell AI

InstructPix2Pix Instruktionsredigering

InstructPix2Pix låter dig redigera ett foto genom att skriva ett enkelt kommando som "gör det vinter" eller "förvandla katten till en hund", inga masker eller urvalsverktyg krävs.

2 min readLäs
Visuell AI

Korsuppmärksamhetsredigering med uppmaning till uppmaning

Prompt-to-Prompt redigerar en genererad bild genom att justera dess textprompt samtidigt som du återanvänder modellens interna uppmärksamhetskartor, så att byta ett ord...

2 min readLäs
Visuell AI

ESRGAN och GAN Super-Resolution

ESRGAN använder en generator-mot-diskriminator-tävling för att uppfinna realistiska detaljer vid uppskalning av bilder, som går längre än suddiga interpolering.

2 min readLäs
Visuell AI

Real-ESRGAN Praktisk restaurering

Real-ESRGAN utökar ESRGAN för att hantera de stökiga, okända nedbrytningarna av verkliga bilder snarare än ren syntetisk oskärpa.

2 min readLäs
Visuell AI

SwinIR Transformator restaurering

SwinIR tillämpar Swin Transformers skiftade fönsteruppmärksamhet på bildåterställningsuppgifter som superupplösning, försvagning och borttagning av JPEG-artefakter.

2 min readLäs
Visuell AI

Latenta konsistensmodeller

Latent Consistency Models (LCM) är en teknik som låter diffusionsbildgeneratorer producera högkvalitativa bilder i bara ett till fyra steg istället...

2 min readLäs
Visuell AI

Vision Transformers

Vision Transformers (ViTs) tillämpar transformatorarkitekturen som driver ChatGPT till bilder, och behandlar en bild som en sekvens av patchar istället för ett rutnät...

2 min readLäs
Visuell AI

Stable Diffusion

Stable Diffusion är en text-till-bild-modell med öppen källkod, släppt av Stability AI 2022, som genererar bilder genom att gradvis ta bort brus från en slumpmässig...

2 min readLäs
Visuell AI

Midjourney

Midjourney är en populär kommersiell text-till-bild-tjänst känd för sina slående, mycket estetiska resultat och dess ursprung som en Discord-bot.

2 min readLäs
Visuell AI

DALL-E

DALL-E är OpenAIs familj av text-till-bild-modeller som gör en skriftlig beskrivning till en originalbild.

2 min readLäs
Visuell AI

CLIP och Vision-Language Modeller

CLIP är en modell från OpenAI som lär sig att koppla samman bilder och text genom att placera båda i samma matematiska utrymme.

2 min readLäs

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.