Ingyenes AI könyvtár

Vizuális AI útmutatókÖrökre ingyen.

133 egyszerű angol nyelvű útmutatók, strukturált tanulási útvonalak és nyílt könyvtár – egy független 501(c)(3) nonprofit szervezet építette, így bárki megértheti a modern AI-t.

133Ingyenes útmutatók
1Témasávok
~2 minÚtmutató szerint
~4hReading time

Kezdje itt

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Témasávok

Böngésszen szám szerint

Ugorjon be a számodra fontos területre. Minden számnak több egyszerű angol nyelvű útmutatója van.

Teljes könyvtár

Minden útmutató

133 -ból 1019 útmutatók láthatók. Szűrés sáv szerint vagy keresés fent.

Vizuális AI

Képharmonizáció és kompozíció

A képharmonizáció automatikusan beállítja a beillesztett előtér-objektumot, így annak színe, megvilágítása és tónusa illeszkedik az új háttérhez, így a kompozitok valósághűnek tűnnek.

2 min olvasniOlvassa el
Vizuális AI

SDXL és kaszkádos diffúzió

Az SDXL a Stability AI nagy felbontású szöveg-kép modellje, amely egy nagy teljesítményű alapgenerátort és egy finomítót párosít, miközben a lépcsőzetes diffúziós láncok több…

2 min olvasniOlvassa el
Vizuális AI

GLIGEN Grounded Generation

A GLIGEN (Grounded-Language-to-Image Generation) segítségével pontosan szabályozhatja, hogy az objektumok hol jelenjenek meg a generált képen a modellhatároló dobozok betáplálásával...

2 min olvasniOlvassa el
Vizuális AI

T2I-adapter többfeltételes diffúzióvezérléshez

Ismerje meg a T2I-adaptert a többfeltételes diffúzió szabályozásához: hogyan irányítja a stabil diffúziót élekkel, mélységgel, pózzal és egyéb feltételekkel egy könnyű súlyú…

2 min olvasniOlvassa el
Vizuális AI

Null-szöveg inverziója

A nulla szöveg inverziója egy olyan technika, amely lehetővé teszi valódi fénykép szerkesztését olyan szövegvezérelt diffúziós modellel, mint a Stable Diffusion, miközben mindent megőriz, amit…

2 min olvasniOlvassa el
Vizuális AI

Egyedi diffúziós többkoncepciós hangolás

A Custom Diffusion egy könnyű finomhangolási módszer, amely a szöveg-képmodellnek új személyes fogalmakat tanít meg, mint például a kutya vagy egy adott szék, egyszerűen…

2 min olvasniOlvassa el
Vizuális AI

Látens keverés és képinterpoláció

A látens keverés a nyers pixelek átlagolása helyett a képeket úgy keveri össze, hogy a tömörített reprezentációikat a modell látens terében kombinálja.

2 min olvasniOlvassa el
Vizuális AI

Látás-nyelv-cselekvés modellek robotikához

A Vision-Language-Action (VLA) modellek nagy neurális hálózatok, amelyek kameraképeket, valamint írásos utasításokat vesznek fel, és közvetlenül adják ki a robotmotoros parancsokat.

2 min olvasniOlvassa el
Vizuális AI

Diffúziós szabályzat a robotvezérléshez

A diffúziós politika ugyanazt a zajtalanító ötletet alkalmazza a képgenerátorok mögött, mint a Stable Diffusion a robotvezérlésben: ahelyett, hogy egyetlen következő műveletet jósolna meg…

2 min olvasniOlvassa el
Vizuális AI

Készítsen videót szövegből videóvá

A Make-A-Video a Meta 2022-es rendszere, amely a szöveges felszólítást rövid videoklippé alakítja anélkül, hogy a címkézett szöveg-videó párokat gyakorolná.

2 min olvasniOlvassa el
Vizuális AI

Imagen Video Cascades

Az Imagen Video a Google 2022-es szöveg-video rendszere, amely hét diffúziós modellből álló kaszkádon keresztül készít klipet, amelyek mindegyike több képkockát vagy nagyobb felbontást ad hozzá.

2 min olvasniOlvassa el
Vizuális AI

CogVideo és CogVideoX

A CogVideo (2022) volt az első nagyszabású nyílt szöveg-videó modell, a CogVideoX (2024) pedig a Tsinghua/Zhipu AI jóval nagyobb képességű nyílt forráskódú utódja.

2 min olvasniOlvassa el

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.

Visual AI AI Guides — Page 7 of 12 | AI Understanding