Безплатна AI библиотека

Визуален AI водачиСвободен завинаги.

133 ръководства на обикновен английски език, структурирани пътеки за обучение и отворена библиотека — създадена от независима 501(c)(3) организация с нестопанска цел, така че всеки да може да разбере модерния AI.

133Безплатни ръководства
1Тематични песни
~2 minПо ръководство
~4hReading time

Започнете тук

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Тематични песни

Преглед по песен

Скочете в района, който ви интересува. Всяка песен има множество ръководства на обикновен английски.

Пълна библиотека

Всички ръководства

133 на 1019 показани ръководства. Филтрирайте по песен или потърсете по-горе.

Визуален AI

Синтез на нов изглед

Синтезът на нов изглед генерира фотореалистични изображения на сцена от гледни точки, които никога не са били фотографирани.

2 мин. прочетеноПрочетете
Визуален AI

Muse Masked Generative Imaging

Muse е модел текст-към-изображение от Google, който генерира картини чрез попълване на токени на маскирани изображения наведнъж, което го прави много по-бързо от стъпка по стъпка...

2 мин. прочетеноПрочетете
Визуален AI

Parti Pathways Авторегресивно изображение

Parti (Pathways Autoregressive Text-to-Image) генерира картини по начина, по който езиковите модели пишат изречения: един символ на изображение в даден момент, предвиждайки следващия...

2 мин. прочетеноПрочетете
Визуален AI

Imagen 2 и Reward-Tuned Diffusion

Imagen 2 е фотореалистичният модел текст-към-изображение, базиран на дифузия на Google, усъвършенстван с настройка на възнаграждението, така че резултатите му да съответстват по-добре на това, което хората действително искат.

2 мин. прочетеноПрочетете
Визуален AI

Разделителна способност LaMa-здраво боядисване

LaMa (Large Mask inpainting) е бърза, лека невронна мрежа, която запълва чисто липсващите или премахнати области на изображение, дори когато дупката е огромна.

2 мин. прочетеноПрочетете
Визуален AI

Стабилна видео дифузия

Stable Video Diffusion (SVD) е отвореният основен модел на Stability AI, който превръща едно неподвижно изображение в кратък, плавно движещ се видеоклип.

2 мин. прочетеноПрочетете
Визуален AI

Lumiere Space-Time Video Generation

Lumiere е модел за разпространение на текст към видео от Google Research, който генерира цял видеоклип наведнъж с помощта на пространствено-времева U-Net.

2 мин. прочетеноПрочетете
Визуален AI

Mip-NeRF и Anti-Aliased Radiance Fields

Mip-NeRF коригира замъглените, назъбени артефакти, които измъчват оригиналния NeRF, когато изобразявате сцени на различни разстояния или разделителни способности.

2 мин. прочетеноПрочетете
Визуален AI

Пленоксели и вокселни радиационни полета

Plenoxels показаха, че можете да реконструирате 3D сцена с резултати с NeRF качество без каквато и да е невронна мрежа - просто мрежа от воксели, съхраняващи цвят...

2 мин. прочетеноПрочетете
Визуален AI

DUSt3R плътна 3D реконструкция

DUSt3R реконструира плътна 3D геометрия от шепа обикновени снимки, без да се нуждае от известни позиции на камерата или калибриране.

2 мин. прочетеноПрочетете
Визуален AI

Tune-A-Video Еднократно редактиране

Tune-A-Video настройва фино предварително обучен модел на разпространение на текст към изображение върху единичен видеоклип, така че да може да редактира този клип от нови текстови подкани.

2 мин. прочетеноПрочетете
Визуален AI

Вземане на проби от DreamFusion и Score Destillation

DreamFusion генерира 3D обекти от текст, като използва модел на дифузия на 2D изображение като критик, без да тренира върху 3D данни.

2 мин. прочетеноПрочетете

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.