Free AI library

Visual AI guiderFree forever.

133 plain-English guides, structured learning paths, and an open library — built by an independent 501(c)(3) nonprofit so anyone can understand modern AI.

133Gratis guider
1Topic tracks
~2 minPer guide
~4hReading time

Start her

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Topic tracks

Browse by track

Jump into the area you care about. Every track has multiple plain-English guides.

Full library

All guides

133 av 1019 guides shown. Filter by track or search above.

Visual AI

LoRA Sliders for bilderedigering

LoRA-glidebrytere er bittesmå tilleggsmoduler som gir deg en kontinuerlig dial for å skyve en enkelt egenskap til et bilde opp eller ned, som alder, smil eller rust, uten...

2 min readLes
Visual AI

InstructPix2Pix Instruksjonsredigering

InstructPix2Pix lar deg redigere et bilde ved å skrive en enkel kommando som "gjør det vinter" eller "gjør katten til en hund", ingen masker eller valgverktøy kreves.

2 min readLes
Visual AI

Spør-til-spør-redigering av kryssoppmerksomhet

Spør-til-spørring redigerer et generert bilde ved å justere tekstmeldingen mens du gjenbruker modellens interne oppmerksomhetskart, så du bytter ett ord...

2 min readLes
Visual AI

ESRGAN og GAN Super-Resolution

ESRGAN bruker en generator-versus-diskriminator-konkurranse for å finne opp realistiske detaljer ved oppskalering av bilder, som går utover uskarp interpolering.

2 min readLes
Visual AI

Real-ESRGAN praktisk restaurering

Real-ESRGAN utvider ESRGAN til å håndtere rotete, ukjente forringelser av bilder fra den virkelige verden i stedet for ren syntetisk uskarphet.

2 min readLes
Visual AI

SwinIR Transformator restaurering

SwinIR bruker Swin Transformers oppmerksomhet med forskjøvet vindu på bildegjenopprettingsoppgaver som superoppløsning, forvrengning og fjerning av JPEG-artefakter.

2 min readLes
Visual AI

Latente konsistensmodeller

Latent Consistency Models (LCM) er en teknikk som lar diffusjonsbildegeneratorer produsere bilder av høy kvalitet i bare ett til fire trinn i stedet...

2 min readLes
Visual AI

Visjon Transformers

Vision Transformers (ViTs) bruker transformatorarkitekturen som driver ChatGPT til bilder, og behandler et bilde som en sekvens av patcher i stedet for et rutenett...

2 min readLes
Visual AI

Stable Diffusion

Stable Diffusion er en åpen kildekode tekst-til-bilde-modell, utgitt av Stability AI i 2022, som genererer bilder ved å gradvis fjerne støy fra en tilfeldig ...

2 min readLes
Visual AI

Midjourney

Midjourney er en populær kommersiell tekst-til-bilde-tjeneste kjent for sine slående, svært estetiske resultater og sin opprinnelse som en Discord-bot.

2 min readLes
Visual AI

DALL-E

DALL-E er OpenAIs familie av tekst-til-bilde-modeller som gjør en skriftlig beskrivelse til et originalt bilde.

2 min readLes
Visual AI

CLIP og Vision-Language Modeller

CLIP er en modell fra OpenAI som lærer å koble bilder og tekst ved å plassere begge i samme matematiske rom.

2 min readLes

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.

Visual AI AI Guides — Page 8 of 12 | AI Understanding