Ingyenes AI könyvtár

Vizuális AI útmutatókÖrökre ingyen.

133 egyszerű angol nyelvű útmutatók, strukturált tanulási útvonalak és nyílt könyvtár – egy független 501(c)(3) nonprofit szervezet építette, így bárki megértheti a modern AI-t.

133Ingyenes útmutatók
1Témasávok
~2 minÚtmutató szerint
~4hReading time

Kezdje itt

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Témasávok

Böngésszen szám szerint

Ugorjon be a számodra fontos területre. Minden számnak több egyszerű angol nyelvű útmutatója van.

Teljes könyvtár

Minden útmutató

133 -ból 1019 útmutatók láthatók. Szűrés sáv szerint vagy keresés fent.

Vizuális AI

Regénynézet szintézis

Az újszerű nézetszintézis fotorealisztikus képeket hoz létre egy jelenetről olyan nézőpontokból, amelyeket valójában soha nem fényképeztek le.

2 min olvasniOlvassa el
Vizuális AI

Muse maszkos generatív képalkotás

A Muse a Google szöveg-képmodellje, amely maszkolt képjelzők egyidejű kitöltésével állít elő képeket, így sokkal gyorsabb, mint a lépésről lépésre…

2 min olvasniOlvassa el
Vizuális AI

Parti Pathways Autoregresszív képalkotás

A Parti (Pathways Autoregressive Text-to-Image) képeket generál úgy, ahogy a nyelvi modellek mondatokat írnak: egy-egy képjelzőt, előre jelezve a következőt…

2 min olvasniOlvassa el
Vizuális AI

2. kép és Jutalomra hangolt diffúzió

Az Imagen 2 a Google fotorealisztikus diffúzió alapú szöveg-kép modellje, amelyet jutalomhangolással finomítottak, így a kimenetei jobban megfelelnek az emberek tényleges vágyának.

2 min olvasniOlvassa el
Vizuális AI

LaMa felbontású, robusztus festés

A LaMa (Large Mask inpainting) egy gyors, könnyű neurális hálózat, amely tisztán kitölti a kép hiányzó vagy eltávolított részeit, még akkor is, ha a lyuk hatalmas.

2 min olvasniOlvassa el
Vizuális AI

Stabil videó diffúzió

A Stable Video Diffusion (SVD) a Stability AI nyílt alapozó modellje, amely egyetlen állóképet rövid, simán mozgó videoklippé alakít.

2 min olvasniOlvassa el
Vizuális AI

Lumiere tér-idő videógenerálás

A Lumiere a Google Research egy szöveg-videó diffúziós modellje, amely egy tér-idő U-Net segítségével egy teljes videoklipet generál egyszerre.

2 min olvasniOlvassa el
Vizuális AI

Mip-NeRF és Anti-Aliased Radiance Fields

A Mip-NeRF kijavítja az elmosódott, szaggatott műtermékeket, amelyek az eredeti NeRF-et sújtják, amikor különböző távolságban vagy felbontásban jelenít meg jeleneteket.

2 min olvasniOlvassa el
Vizuális AI

Plenoxelek és Voxel sugárzási mezők

A Plenoxels megmutatta, hogy NeRF-minőségű eredményekkel rekonstruálhat egy 3D-s jelenetet neurális hálózat nélkül is – csak a színeket tároló voxelháló...

2 min olvasniOlvassa el
Vizuális AI

DUSt3R sűrű 3D rekonstrukció

A DUSt3R sűrű 3D geometriát rekonstruál néhány közönséges fényképből anélkül, hogy ismert kamerapozíciókat vagy kalibrálást igényelne.

2 min olvasniOlvassa el
Vizuális AI

Tune-A-Video One-Shot Editing

A Tune-A-Video finomhangolja az előre betanított szöveg-kép diffúziós modellt egyetlen videón, így újra szerkesztheti a klipet az új szöveges promptokból.

2 min olvasniOlvassa el
Vizuális AI

DreamFusion és Score desztillációs mintavétel

A DreamFusion 3D objektumokat generál szövegből úgy, hogy kritikusként 2D képdiffúziós modellt használ, és soha nem oktat semmilyen 3D adatra.

2 min olvasniOlvassa el

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.