Безплатна AI библиотека

Визуален AI водачиСвободен завинаги.

133 ръководства на обикновен английски език, структурирани пътеки за обучение и отворена библиотека — създадена от независима 501(c)(3) организация с нестопанска цел, така че всеки да може да разбере модерния AI.

133Безплатни ръководства
1Тематични песни
~2 minПо ръководство
~4hReading time

Започнете тук

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Тематични песни

Преглед по песен

Скочете в района, който ви интересува. Всяка песен има множество ръководства на обикновен английски.

Пълна библиотека

Всички ръководства

133 на 1019 показани ръководства. Филтрирайте по песен или потърсете по-горе.

Визуален AI

Оптично разпознаване на знаци

Оптичното разпознаване на знаци (OCR) превръща изображения на текст – сканирани документи, снимки на знаци, PDF файлове – в машинно четим, редактируем текст.

2 мин. прочетеноПрочетете
Визуален AI

Оптичен поток

Оптичният поток оценява как всеки пиксел се движи между последователни видео кадри, създавайки плътна карта на вектори на движение.

2 мин. прочетеноПрочетете
Визуален AI

Монокулярна оценка на дълбочината

Монокулярната оценка на дълбочината предсказва колко далеч е всеки пиксел от една обикновена снимка — не е необходима стерео камера, лидар или сензор за дълбочина.

2 мин. прочетеноПрочетете
Визуален AI

Модели на латентна дифузия

Моделите на латентна дифузия генерират изображения, като изпълняват процеса на дифузия в компресирано латентно пространство вместо необработени пиксели, намалявайки изчислителните разходи.

2 мин. прочетеноПрочетете
Визуален AI

ControlNet

ControlNet е добавка, която дава на моделите за генериране на изображения прецизен структурен контрол, като ви позволява да управлявате изхода с ръбове, пози, карти на дълбочина или драсканици.

2 мин. прочетеноПрочетете
Визуален AI

Насоки без класификатор

Насоките без класификатор са техниката, която кара дифузионните модели действително да следват вашата подкана, разменяйки известно разнообразие за много по-силно придържане.

2 мин. прочетеноПрочетете
Визуален AI

Визуален SLAM

Visual SLAM позволява на движеща се камера да изгради карта на неизвестно пространство, като същевременно проследява собствената си позиция в тази карта.

2 мин. прочетеноПрочетете
Визуален AI

Sora и Text-to-Video

Sora е моделът за текст към видео на OpenAI, който превръща писмена подкана в кратък видеоклип с висока разделителна способност.

2 мин. прочетеноПрочетете
Визуален AI

Модели на видео дифузия

Моделите за видео дифузия генерират движещи се изображения чрез постепенно превръщане на случаен шум в кохерентни кадри, разширявайки идеята за дифузия от картини към време.

2 мин. прочетеноПрочетете
Визуален AI

Генериране на текст към 3D

Генерирането на текст към 3D превръща писмена подкана като „ретро кожено кресло“ в пълен 3D модел, който можете да завъртите, осветите и пуснете в игра или сцена.

2 мин. прочетеноПрочетете
Визуален AI

Диференцируемо изобразяване

Диференцируемото изобразяване прави процеса на превръщане на 3D сцена в 2D изображение напълно диференциран, така че можете да изчислявате градиенти от изобразените пиксели...

2 мин. прочетеноПрочетете
Визуален AI

U-Net архитектура

U-Net е конволюционна невронна мрежа, оформена като „U“, която се отличава с извеждането на точни до пиксели резултати, първоначално за сегментиране на биомедицински изображения.

2 мин. прочетеноПрочетете

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.