Bezpłatna biblioteka AI

Wizualna sztuczna inteligencja przewodnikiZa darmo na zawsze.

133 przewodniki w prostym języku angielskim, ustrukturyzowane ścieżki edukacyjne i otwarta biblioteka — stworzone przez niezależną organizację non-profit 501(c)(3), aby każdy mógł zrozumieć współczesną sztuczną inteligencję.

133Bezpłatne przewodniki
1Ścieżki tematyczne
~2 minWedług przewodnika
~4hCzas czytania

Zacznij tutaj

Pięć Kursy oparte na wynikach

Każdy kurs zawiera wyraźne wyniki, zmapowane kompetencje, ćwiczenia oraz praktyczny projekt końcowy.

Ścieżki tematyczne

Przeglądaj według utworu

Wskocz w obszar, na którym Ci zależy. Do każdego utworu dołączono wiele przewodników w języku angielskim.

Pełna biblioteka

Wszystkie przewodniki

133 z 1019 pokazane przewodniki. Filtruj według utworu lub wyszukaj powyżej.

Wizualna sztuczna inteligencja

Matowanie obrazu

Matowienie obrazu to sztuka wycinania obiektu ze zdjęcia za pomocą półprzezroczystych krawędzi o doskonałych pikselach — uchwycenia każdego delikatnego pasma włosów lub rozmycia ruchu.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Adapter IP do podpowiedzi obrazowych

IP-Adapter to lekki dodatek, który umożliwia modelom dyfuzji, takim jak Stable Diffusion, akceptowanie obrazu jako podpowiedzi, a nie tylko tekstu.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Obraz z tekstu na obraz

Imagen to system zamiany tekstu na obraz firmy Google, który zamienia pisemne opisy w fotorealistyczne obrazy.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Model dyfuzyjny GLIDE

GLIDE był wczesnym OpenAI modelem dyfuzji tekstu na obraz, który pokazywał podpowiedzi i „wskazówki bez klasyfikatorów”, co mogło pokonać wcześniejsze systemy oparte na GAN.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Utrata percepcji i LPIPS

Utrata percepcji mierzy, jak podobne dwa obrazy wyglądają dla ludzi, porównując cechy głębokiej sieci neuronowej zamiast surowych pikseli.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Architektura StyleGAN

StyleGAN to generatywna sieć kontradyktoryjna firmy NVIDIA, która tworzy uderzająco realistyczne twarze i obiekty poprzez wstrzyknięcie informacji o stylu do każdej warstwy.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Stopniowy rozwój GAN

Uprawa progresywna trenuje sieć GAN, zaczynając od małych rozdzielczości i stopniowo dodając warstwy, aby uzyskać obrazy o wysokiej rozdzielczości.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Generowanie ruchu AnimateDiff

AnimateDiff to technika, która dodaje ruch do istniejących modeli dyfuzji tekstu na obraz, takich jak Stable Diffusion, przekształcając generatory nieruchomych obrazów w krótkie filmy…

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

DETR Wykrywanie transformatora

DETR (DEtection TRansformer) przekształca wykrywanie obiektów w problem bezpośredniego przewidywania zbioru rozwiązywany za pomocą transformatora, eliminując ręcznie zaprojektowane kroki, takie jak kotwica…

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Wykrywanie obiektów w otwartym słownictwie

Wykrywanie obiektów przy użyciu otwartego słownika umożliwia modelowi znajdowanie i umieszczanie w ramkach obiektów opisanych dowolnym tekstem, w tym kategorii, których nigdy nie widział oznaczonych etykietami podczas uczenia.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Fotogrametria

Fotogrametria zamienia zwykłe nakładające się zdjęcia w dokładne modele 3D, mapy i pomiary.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Odometria wizualna

Odometria wizualna szacuje, w jaki sposób kamera porusza się po świecie, śledząc, jak obraz zmienia się klatka po klatce.

2 min. przeczytajPrzeczytaj

Skończyłeś czytać? Udowodnij to.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.