Безплатна AI библиотека

Визуален AI водачиСвободен завинаги.

133 ръководства на обикновен английски език, структурирани пътеки за обучение и отворена библиотека — създадена от независима 501(c)(3) организация с нестопанска цел, така че всеки да може да разбере модерния AI.

133Безплатни ръководства
1Тематични песни
~2 minПо ръководство
~4hReading time

Започнете тук

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Тематични песни

Преглед по песен

Скочете в района, който ви интересува. Всяка песен има множество ръководства на обикновен английски.

Пълна библиотека

Всички ръководства

133 на 1019 показани ръководства. Филтрирайте по песен или потърсете по-горе.

Визуален AI

LoRA плъзгачи за редактиране на изображения

Плъзгачите LoRA са малки допълнителни модули, които ви дават непрекъснато циферблат, за да натискате един атрибут на изображение нагоре или надолу, като възраст, усмивка или ръжда, без...

2 мин. прочетеноПрочетете
Визуален AI

Редактиране на инструкции на InstructPix2Pix

InstructPix2Pix ви позволява да редактирате снимка, като напишете проста команда като „направете я зимна“ или „превърнете котката в куче“, без да са необходими маски или инструменти за избор.

2 мин. прочетеноПрочетете
Визуален AI

Редактиране на кръстосано внимание от подкана към подкана

Prompt-to-Prompt редактира генерирано изображение, като променя текстовата му подкана, докато използва повторно вътрешните карти на вниманието на модела, така че промяната на размяна на една дума...

2 мин. прочетеноПрочетете
Визуален AI

ESRGAN и GAN Super-Resolution

ESRGAN използва състезание генератор срещу дискриминатор, за да измисли реалистични детайли при мащабиране на изображения, надхвърляйки замъглената интерполация.

2 мин. прочетеноПрочетете
Визуален AI

Практическа реставрация Real-ESRGAN

Real-ESRGAN разширява ESRGAN, за да се справи с разхвърляните, неизвестни деградации на снимки от реалния свят, вместо с чисто синтетично замъгляване.

2 мин. прочетеноПрочетете
Визуален AI

Възстановяване на SwinIR трансформатор

SwinIR прилага вниманието на преместения прозорец на Swin Transformer към задачи за възстановяване на изображения като супер разделителна способност, премахване на шума и отстраняване на JPEG артефакти.

2 мин. прочетеноПрочетете
Визуален AI

Модели на латентна консистенция

Моделите на латентна консистенция (LCM) са техника, която позволява на генераторите на дифузионни изображения да произвеждат висококачествени картини само с една до четири стъпки вместо...

2 мин. прочетеноПрочетете
Визуален AI

Визия Трансформърс

Vision Transformers (ViTs) прилага трансформаторната архитектура, която захранва ChatGPT към изображения, като третира картината като последователност от кръпки вместо решетка...

2 мин. прочетеноПрочетете
Визуален AI

Stable Diffusion

Stable Diffusion е модел с отворен код текст към изображение, пуснат от Stability AI през 2022 г., който генерира картини чрез постепенно премахване на шума от случаен...

2 мин. прочетеноПрочетете
Визуален AI

Midjourney

Midjourney е популярна търговска услуга за текст към изображение, известна със своите поразителни, високо естетични резултати и произхода си като бот на Discord.

2 мин. прочетеноПрочетете
Визуален AI

DALL-E

DALL-E е семейството на OpenAI от модели текст към изображение, които превръщат писмено описание в оригинална картина.

2 мин. прочетеноПрочетете
Визуален AI

CLIP и Vision-Language модели

CLIP е модел от OpenAI, който се научава да свързва изображения и текст, като поставя и двете в едно и също математическо пространство.

2 мин. прочетеноПрочетете

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.