Безплатна AI библиотека

Визуален AI водачиСвободен завинаги.

133 ръководства на обикновен английски език, структурирани пътеки за обучение и отворена библиотека — създадена от независима 501(c)(3) организация с нестопанска цел, така че всеки да може да разбере модерния AI.

133Безплатни ръководства
1Тематични песни
~2 minПо ръководство
~4hReading time

Започнете тук

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Тематични песни

Преглед по песен

Скочете в района, който ви интересува. Всяка песен има множество ръководства на обикновен английски.

Пълна библиотека

Всички ръководства

133 на 1019 показани ръководства. Филтрирайте по песен или потърсете по-горе.

Визуален AI

Хармонизиране и композиране на изображения

Хармонизирането на изображението автоматично настройва поставен обект на преден план, така че неговият цвят, осветление и тон да съответстват на новия фон, правейки композитите да изглеждат реални.

2 мин. прочетеноПрочетете
Визуален AI

SDXL и каскадна дифузия

SDXL е моделът за текст към изображение с висока разделителна способност на Stability AI, който съчетава мощен основен генератор с рафинер, докато каскадните дифузионни вериги множество...

2 мин. прочетеноПрочетете
Визуален AI

GLIGEN Заземено поколение

GLIGEN (Grounded-Language-to-Image Generation) ви позволява да контролирате точно къде се появяват обектите в генерирано изображение чрез захранване на ограничителните полета на модела...

2 мин. прочетеноПрочетете
Визуален AI

T2I-адаптер за многоусловен контрол на дифузията

Научете T2I-адаптер за многоусловен контрол на дифузията: как управлява стабилна дифузия с ръбове, дълбочина, поза и други условия, използвайки лек...

2 мин. прочетеноПрочетете
Визуален AI

Обръщане на нулев текст

Обръщането на нулев текст е техника, която ви позволява да редактирате истинска снимка с управляван от текст дифузионен модел като Stable Diffusion, като същевременно запазвате всичко, което...

2 мин. прочетеноПрочетете
Визуален AI

Custom Diffusion Multi-Concept Tuning

Custom Diffusion е лек метод за фина настройка, който обучава модел от текст към изображение на нови лични концепции, като вашето куче или конкретен стол, само от...

2 мин. прочетеноПрочетете
Визуален AI

Латентно смесване и интерполация на изображения

Латентното смесване смесва изображения чрез комбиниране на техните компресирани представяния в латентното пространство на модела, вместо да осреднява необработените пиксели.

2 мин. прочетеноПрочетете
Визуален AI

Визия-език-действие модели за роботика

Моделите Vision-Language-Action (VLA) са големи невронни мрежи, които приемат изображения от камера плюс писмена инструкция и директно извеждат двигателни команди на робота.

2 мин. прочетеноПрочетете
Визуален AI

Политика за разпространение за управление на роботи

Политиката за разпространение прилага същата идея за премахване на шума зад генераторите на изображения като Stable Diffusion към контрола на робота: вместо да предвижда едно следващо действие...

2 мин. прочетеноПрочетете
Визуален AI

Направете видео текст към видео

Make-A-Video е системата от 2022 г. на Meta, която превръща текстова подкана в кратък видеоклип, без изобщо да се обучава върху обозначени двойки текст-видео.

2 мин. прочетеноПрочетете
Визуален AI

Imagen Video Cascades

Imagen Video е системата за текст към видео на Google от 2022 г., която изгражда клип чрез каскада от седем дифузионни модела, като всеки добавя повече кадри или повече резолюция.

2 мин. прочетеноПрочетете
Визуален AI

CogVideo и CogVideoX

CogVideo (2022) беше първият широкомащабен отворен модел за конвертиране на текст към видео, а CogVideoX (2024) е неговият много по-способен наследник с отворен код от Tsinghua/Zhipu AI.

2 мин. прочетеноПрочетете

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.