Free AI library

Visual AI guiderFree forever.

133 plain-English guides, structured learning paths, and an open library — built by an independent 501(c)(3) nonprofit so anyone can understand modern AI.

133Gratis guider
1Topic tracks
~2 minPer guide
~4hReading time

Start her

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Topic tracks

Browse by track

Jump into the area you care about. Every track has multiple plain-English guides.

Full library

All guides

133 av 1019 guides shown. Filter by track or search above.

Visual AI

Bildeharmonisering og komposisjon

Bildeharmonisering justerer automatisk et innlimt forgrunnsobjekt slik at farge, lys og tone matcher den nye bakgrunnen, slik at kompositter ser ekte ut.

2 min readLes
Visual AI

SDXL og Cascaded Diffusion

SDXL er Stability AIs høyoppløselige tekst-til-bilde-modell som kobler en kraftig basegenerator med en raffinør, mens kaskadede diffusjonskjeder flere...

2 min readLes
Visual AI

GLIGEN jordet generasjon

GLIGEN (Grounded-Language-to-Image Generation) lar deg kontrollere nøyaktig hvor objekter vises i et generert bilde ved å mate modellens avgrensningsbokser...

2 min readLes
Visual AI

T2I-adapter for multi-betinget diffusjonskontroll

Lær T2I-adapter for multi-betinget diffusjonskontroll: hvordan den styrer stabil diffusjon med kanter, dybde, positur og andre forhold ved hjelp av en lett...

2 min readLes
Visual AI

Null-tekstinversjon

Null-tekstinversjon er en teknikk som lar deg redigere et ekte bilde med en tekstdrevet diffusjonsmodell som Stable Diffusion mens du beholder alt du...

2 min readLes
Visual AI

Tilpasset diffusjon multikonseptinnstilling

Custom Diffusion er en lett finjusteringsmetode som lærer en tekst-til-bilde-modell nye personlige konsepter, som hunden din eller en spesifikk stol, fra bare...

2 min readLes
Visual AI

Latent blanding og bildeinterpolering

Latent blanding blander bilder ved å kombinere deres komprimerte representasjoner inne i en modells latente plass i stedet for å beregne gjennomsnittet av råpiksler.

2 min readLes
Visual AI

Visjon-språk-handlingsmodeller for robotikk

Vision-Language-Action (VLA)-modeller er store nevrale nettverk som tar inn kamerabilder pluss en skriftlig instruksjon og sender ut robotmotorkommandoer direkte.

2 min readLes
Visual AI

Diffusjonspolicy for robotkontroll

Diffusjonspolicy bruker den samme nedlatende ideen bak bildegeneratorer som Stable Diffusion til robotkontroll: i stedet for å forutsi en enkelt neste handling...

2 min readLes
Visual AI

Lag-en-video tekst-til-video

Make-A-Video er Metas 2022-system som gjør en tekstmelding om til et kort videoklipp uten noen gang å trene på merkede tekst-video-par.

2 min readLes
Visual AI

Bilde Video Cascades

Imagen Video er Googles tekst-til-video-system fra 2022 som bygger et klipp gjennom en kaskade av syv diffusjonsmodeller, som hver legger til flere rammer eller mer oppløsning.

2 min readLes
Visual AI

CogVideo og CogVideoX

CogVideo (2022) var den første store åpne tekst-til-video-modellen, og CogVideoX (2024) er dens langt mer kapable åpen kildekode-etterfølger fra Tsinghua/Zhipu AI.

2 min readLes

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.