Безплатна AI библиотека

Визуален AI водачиСвободен завинаги.

133 ръководства на обикновен английски език, структурирани пътеки за обучение и отворена библиотека — създадена от независима 501(c)(3) организация с нестопанска цел, така че всеки да може да разбере модерния AI.

133Безплатни ръководства
1Тематични песни
~2 minПо ръководство
~4hReading time

Започнете тук

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Тематични песни

Преглед по песен

Скочете в района, който ви интересува. Всяка песен има множество ръководства на обикновен английски.

Пълна библиотека

Всички ръководства

133 на 1019 показани ръководства. Филтрирайте по песен или потърсете по-горе.

Визуален AI

Видео разбирателство

Video understanding analyzes visual and sometimes audio information across time.

2 мин. прочетеноПрочетете
Визуален AI

Мултимодално търсене

Multimodal search retrieves information across forms such as text, images, audio, and video.

2 мин. прочетеноПрочетете
Визуален AI

Документ AI

Document AI extracts and interprets information from files such as forms, reports, invoices, and scanned pages.

2 мин. прочетеноПрочетете
Визуален AI

Wasserstein GAN

Wasserstein GAN (WGAN) е редизайн на обучителната цел на GAN, която използва разстоянието на Wasserstein вместо оригиналната мин-макс загуба.

2 мин. прочетеноПрочетете
Визуален AI

Условни GAN

Условните GAN (cGAN) разширяват обикновените GAN, като подават допълнителна информация, като етикет на клас или текст, както в генератора, така и в дискриминатора.

2 мин. прочетеноПрочетете
Визуален AI

Pix2Pix Превод от изображение към изображение

Pix2Pix е условен GAN, който се научава да превежда един тип изображение в друг, като например превръщане на скица в снимка или карта в сателитен изглед.

2 мин. прочетеноПрочетете
Визуален AI

Оцветяване на изображението

Оцветяването на изображения използва AI, за да добави правдоподобен, реалистичен цвят към черно-бели снимки и филми.

2 мин. прочетеноПрочетете
Визуален AI

Структура от движение

Structure from Motion (SfM) реконструира геометрията на 3D сцената и позициите на камерата от набор от припокриващи се 2D снимки, направени от различни гледни точки.

2 мин. прочетеноПрочетете
Визуален AI

Стерео с множество изгледи

Multi-View Stereo (MVS) прави много калибрирани снимки на сцена и произвежда плътна 3D реконструкция чрез оценка на дълбочината на почти всеки пиксел.

2 мин. прочетеноПрочетете
Визуален AI

DDPM и DDIM семплер

DDPM и DDIM са два начина за стартиране на обратния процес на модел на дифузия, превръщайки случаен шум в изображение стъпка по стъпка.

2 мин. прочетеноПрочетете
Визуален AI

Генеративни модели, базирани на резултати

Генеративните модели, базирани на резултати, създават данни, като изучават градиента на разпределението на данните - посоката, която прави всяка шумна проба да изглежда по-скоро като истинска...

2 мин. прочетеноПрочетете
Визуален AI

Начално разстояние на Fréchet

Началното разстояние на Fréchet (FID) е стандартният показател за преценка колко реалистичен и разнообразен е набор от генерирани изображения.

2 мин. прочетеноПрочетете

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.