Bezpłatna biblioteka AI

Wizualna sztuczna inteligencja przewodnikiZa darmo na zawsze.

133 przewodniki w prostym języku angielskim, ustrukturyzowane ścieżki edukacyjne i otwarta biblioteka — stworzone przez niezależną organizację non-profit 501(c)(3), aby każdy mógł zrozumieć współczesną sztuczną inteligencję.

133Bezpłatne przewodniki
1Ścieżki tematyczne
~2 minWedług przewodnika
~4hCzas czytania

Zacznij tutaj

Pięć Kursy oparte na wynikach

Każdy kurs zawiera wyraźne wyniki, zmapowane kompetencje, ćwiczenia oraz praktyczny projekt końcowy.

Ścieżki tematyczne

Przeglądaj według utworu

Wskocz w obszar, na którym Ci zależy. Do każdego utworu dołączono wiele przewodników w języku angielskim.

Pełna biblioteka

Wszystkie przewodniki

133 z 1019 pokazane przewodniki. Filtruj według utworu lub wyszukaj powyżej.

Wizualna sztuczna inteligencja

Nowatorska synteza poglądów

Nowatorska synteza widoku generuje fotorealistyczne obrazy sceny z punktów widzenia, które nigdy nie były fotografowane.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Maskowane obrazowanie generatywne Muse

Muse to model zamiany tekstu na obraz firmy Google, który generuje obrazy poprzez jednoczesne wypełnienie tokenów zamaskowanych obrazów, dzięki czemu jest to znacznie szybsze niż krok po kroku…

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Obrazowanie autoregresyjne Parti Pathways

Parti (Pathways Autoregressive Text-to-Image) generuje obrazy w taki sam sposób, w jaki modele językowe piszą zdania: jeden znacznik obrazu na raz, przewidując następny…

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Obraz 2 i dyfuzja dostosowana do nagród

Imagen 2 to fotorealistyczny, oparty na dyfuzji model zamiany tekstu na obraz firmy Google, udoskonalony poprzez dostrojenie nagrody, dzięki czemu jego wyniki lepiej odpowiadają rzeczywistym oczekiwaniom ludzi.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Rozdzielczość LaMa - Solidne malowanie

LaMa (Large Mask inpainting) to szybka i lekka sieć neuronowa, która wypełnia brakujące lub usunięte obszary obrazu, nawet jeśli dziura jest ogromna.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Stabilna dyfuzja wideo

Stable Video Diffusion (SVD) to otwarty model Stability AI, który zamienia pojedynczy obraz w krótki, płynnie poruszający się klip wideo.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Generowanie wideo czasoprzestrzennego Lumiere

Lumiere to model rozprzestrzeniania tekstu na wideo opracowany przez firmę Google Research, który generuje od razu cały klip wideo przy użyciu sieci U-Net czasoprzestrzennej.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Pola promieniowania Mip-NeRF i antyaliasingu

Mip-NeRF naprawia rozmyte, postrzępione artefakty, które nękają oryginalny NeRF, gdy renderujesz sceny w różnych odległościach i rozdzielczościach.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Plenoxele i pola promieniowania wokseli

Plenoxels pokazał, że można zrekonstruować scenę 3D z jakością NeRF bez jakiejkolwiek sieci neuronowej — wystarczy siatka wokseli przechowujących kolor…

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

DUSt3R Gęsta rekonstrukcja 3D

DUSt3R rekonstruuje gęstą geometrię 3D z kilku zwykłych zdjęć bez konieczności znajomości pozycji aparatu lub kalibracji.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Jednorazowa edycja dostrojenia wideo

Tune-A-Video dostraja wstępnie wytrenowany model dyfuzji tekstu na obraz w pojedynczym filmie, dzięki czemu można go ponownie edytować na podstawie nowych podpowiedzi tekstowych.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

DreamFusion i punktacja próbek destylacyjnych

DreamFusion generuje obiekty 3D z tekstu, używając modelu dyfuzji obrazu 2D jako krytyka, nigdy nie trenując na żadnych danych 3D.

2 min. przeczytajPrzeczytaj

Skończyłeś czytać? Udowodnij to.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.