Bezpłatna biblioteka AI

Wizualna sztuczna inteligencja przewodnikiZa darmo na zawsze.

133 przewodniki w prostym języku angielskim, ustrukturyzowane ścieżki edukacyjne i otwarta biblioteka — stworzone przez niezależną organizację non-profit 501(c)(3), aby każdy mógł zrozumieć współczesną sztuczną inteligencję.

133Bezpłatne przewodniki
1Ścieżki tematyczne
~2 minWedług przewodnika
~4hCzas czytania

Zacznij tutaj

Pięć Kursy oparte na wynikach

Każdy kurs zawiera wyraźne wyniki, zmapowane kompetencje, ćwiczenia oraz praktyczny projekt końcowy.

Ścieżki tematyczne

Przeglądaj według utworu

Wskocz w obszar, na którym Ci zależy. Do każdego utworu dołączono wiele przewodników w języku angielskim.

Pełna biblioteka

Wszystkie przewodniki

133 z 1019 pokazane przewodniki. Filtruj według utworu lub wyszukaj powyżej.

Wizualna sztuczna inteligencja

Zrozumienie wideo

Video understanding analyzes visual and sometimes audio information across time.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Wyszukiwanie multimodalne

Multimodal search retrieves information across forms such as text, images, audio, and video.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Dokumentuj sztuczną inteligencję

Document AI extracts and interprets information from files such as forms, reports, invoices, and scanned pages.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Wasserstein GAN

Wasserstein GAN (WGAN) to przeprojektowany cel treningowy GAN, który wykorzystuje odległość Wassersteina zamiast pierwotnej straty min-max.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Warunkowe sieci GAN

Warunkowe sieci GAN (cGAN) stanowią rozszerzenie zwykłych sieci GAN poprzez dostarczanie dodatkowych informacji, takich jak etykieta klasy lub tekst, zarówno do generatora, jak i dyskryminatora.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Tłumaczenie obrazu na obraz Pix2Pix

Pix2Pix to warunkowa sieć GAN, która uczy się tłumaczyć jeden typ obrazu na inny, na przykład zamieniając szkic na zdjęcie lub mapę na widok satelitarny.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Koloryzacja obrazu

Kolorowanie obrazu wykorzystuje sztuczną inteligencję, aby dodać wiarygodne, realistyczne kolory do czarno-białych zdjęć i filmów.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Struktura z ruchu

Struktura z ruchu (SfM) rekonstruuje geometrię sceny 3D i pozycje kamer na podstawie zestawu nakładających się zdjęć 2D wykonanych z różnych punktów widzenia.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Stereo z wieloma widokami

Multi-View Stereo (MVS) wykonuje wiele skalibrowanych zdjęć sceny i tworzy gęstą rekonstrukcję 3D poprzez ocenę głębi w prawie każdym pikselu.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Próbniki DDPM i DDIM

DDPM i DDIM to dwa sposoby przeprowadzenia odwrotnego procesu modelu dyfuzyjnego, polegającego na stopniowym przekształcaniu losowego szumu w obraz.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Modele generatywne oparte na wynikach

Modele generatywne oparte na wynikach tworzą dane, ucząc się gradientu rozkładu danych — kierunku, który sprawia, że ​​każda zaszumiona próbka wygląda bardziej jak rzeczywista…

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Odległość początkowa Frécheta

Odległość początkowa Frécheta (FID) to standardowa miara służąca do oceny realizmu i różnorodności zestawu wygenerowanych obrazów.

2 min. przeczytajPrzeczytaj

Skończyłeś czytać? Udowodnij to.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.