Безплатна AI библиотека

Визуален AI водачиСвободен завинаги.

133 ръководства на обикновен английски език, структурирани пътеки за обучение и отворена библиотека — създадена от независима 501(c)(3) организация с нестопанска цел, така че всеки да може да разбере модерния AI.

133Безплатни ръководства
1Тематични песни
~2 minПо ръководство
~4hReading time

Започнете тук

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Тематични песни

Преглед по песен

Скочете в района, който ви интересува. Всяка песен има множество ръководства на обикновен английски.

Пълна библиотека

Всички ръководства

133 на 1019 показани ръководства. Филтрирайте по песен или потърсете по-горе.

Визуален AI

Magic3D Text-to-3D Pipeline

Magic3D е двуетапният отговор на NVIDIA на DreamFusion, произвеждащ по-бързо 3D съдържание с по-висока резолюция и по-детайлно съдържание.

2 мин. прочетеноПрочетете
Визуален AI

Отстраняване на шум и размазване на мрежи

Мрежите за премахване на шум и замъгляване са невронни модели, които почистват шумни или замъглени изображения, възстановявайки остри детайли от разхвърляни входове.

2 мин. прочетеноПрочетете
Визуален AI

GFPGAN възстановяване на лицето

GFPGAN е специализиран модел, който възстановява нискокачествени, замъглени или стари снимки на лица в резки, реалистични портрети.

2 мин. прочетеноПрочетете
Визуален AI

CodeFormer Robust Face Recovery

CodeFormer е модел за възстановяване на лица, създаден да се справя с екстремни деградации, възстановявайки разпознаваеми лица от силно повредени, малки или замъглени входове.

2 мин. прочетеноПрочетете
Визуален AI

GigaGAN мащабирани генератори

GigaGAN е GAN с милиард параметри, който доказва, че генеративните състезателни мрежи могат да се мащабират до генериране на текст към изображение, съперничейки на дифузионни модели...

2 мин. прочетеноПрочетете
Визуален AI

VQGAN и синтез на изображения на кодова книга

VQGAN компресира изображения в мрежа от отделни токени, извлечени от научена кодова книга, позволявайки на трансформатор да генерира изображения по същия начин, както езиковите модели...

2 мин. прочетеноПрочетете
Визуален AI

Parallel Token декодиране на MaskGIT

MaskGIT генерира изображения, като предсказва много токени наведнъж и първо попълва най-сигурните, заменяйки бавното генериране отляво надясно...

2 мин. прочетеноПрочетете
Визуален AI

Разпространение на нов изглед от нула 1 до 3

Zero-1-to-3 превръща една снимка на обект в изображения на същия обект, гледани от всеки нов ъгъл, използвайки модел на дифузия, кондициониран от камерата...

2 мин. прочетеноПрочетете
Визуален AI

Хибридно 3D представяне на DMTet

DMTet (Deep Marching Tetrahedra) е хибридно представяне на 3D форма, което съчетава деформируема тетраедрична решетка със знаково поле за разстояние, толкова неврално...

2 мин. прочетеноПрочетете
Визуален AI

Instant-NGP хеш кодиране

Instant-NGP е техниката на NVIDIA, която обучава невронни радиационни полета и други невронни графични примитиви за секунди вместо за часове, като съхранява обучаемите...

2 мин. прочетеноПрочетете
Визуален AI

DepthAnything Монокулярна дълбочина

DepthAnything е основен модел, който оценява колко далеч е всеки пиксел от една обикновена снимка, без специален хардуер.

2 мин. прочетеноПрочетете
Визуален AI

Оценка на дълбочината на дифузия на невен

Marigold пренасочва предварително обучен дифузионен модел за генериране на изображения (Stable Diffusion), за да предскаже много детайлни карти на дълбочината.

2 мин. прочетеноПрочетете

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.

Visual AI AI Guides — Page 6 of 12 | AI Understanding