Bezpłatna biblioteka AI

Wizualna sztuczna inteligencja przewodnikiZa darmo na zawsze.

133 przewodniki w prostym języku angielskim, ustrukturyzowane ścieżki edukacyjne i otwarta biblioteka — stworzone przez niezależną organizację non-profit 501(c)(3), aby każdy mógł zrozumieć współczesną sztuczną inteligencję.

133Bezpłatne przewodniki
1Ścieżki tematyczne
~2 minWedług przewodnika
~4hCzas czytania

Zacznij tutaj

Pięć Kursy oparte na wynikach

Każdy kurs zawiera wyraźne wyniki, zmapowane kompetencje, ćwiczenia oraz praktyczny projekt końcowy.

Ścieżki tematyczne

Przeglądaj według utworu

Wskocz w obszar, na którym Ci zależy. Do każdego utworu dołączono wiele przewodników w języku angielskim.

Pełna biblioteka

Wszystkie przewodniki

133 z 1019 pokazane przewodniki. Filtruj według utworu lub wyszukaj powyżej.

Wizualna sztuczna inteligencja

Pola promieniowania neuronowego

Neural Radiance Fields (NeRF) rekonstruują pełną scenę 3D z kilku zwykłych zdjęć, pozwalając kamerze przenieść się do zupełnie nowych punktów widzenia.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Rozpryskiwanie Gaussa

Gaussian Splatting przedstawia scenę 3D w postaci milionów małych, kolorowych, półprzezroczystych plam, które można renderować w czasie rzeczywistym.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Zamaskowane autoenkodery

Maskowane autoenkodery (MAE) to samonadzorowana metoda, która uczy model widzenia rekonstruowania obrazów po ukryciu większości obrazu.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Podpisy obrazów

Podpisy do obrazów to zadanie polegające na automatycznym wygenerowaniu zdania w języku naturalnym opisującego to, co znajduje się na obrazku.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Wizualne odpowiadanie na pytania

Wizualne odpowiadanie na pytania (VQA) umożliwia systemowi odpowiadanie na dowolne pytania w języku naturalnym dotyczące obrazu, takie jak „Ile osób nosi kapelusze?”

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Wykrywanie w czasie rzeczywistym YOLO

YOLO (You Only Look Once) to rodzina modeli wykrywania obiektów, które znajdują i oznaczają każdy obiekt na obrazie za pomocą jednego przejścia sieci neuronowej, wystarczająco szybko…

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Segmentacja panoptyczna

Segmentacja panoptyczna nadaje każdemu pikselowi obrazu etykietę, jednocząc „co to jest ten region” z „który to konkretny obiekt”.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Oszacowanie pozycji człowieka

Oszacowanie pozycji człowieka wykrywa położenie stawów ciała, takich jak łokcie, kolana i ramiona, aby zbudować cyfrowy szkielet osoby na podstawie obrazów…

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Modele obrazu FLUX

FLUX to rodzina otwartych modeli zamiany tekstu na obraz z Black Forest Labs, znanych z ostrych szczegółów, szybkiego śledzenia i zaskakująco dokładnego renderowanego tekstu.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Sieci resztkowe

Sieci resztkowe (ResNets) to głębokie sieci neuronowe, które dodają „pomijanie połączeń”, umożliwiając warstwom uczenie się drobnych korekt zamiast pełnych transformacji.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

CNN regionalne

Sieci CNN oparte na regionach (R-CNN) to rodzina detektorów obiektów, które najpierw proponują kandydujące obszary na obrazie, a następnie wykorzystują CNN do klasyfikacji i precyzyjnego umieszczania w ramkach…

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Transformator świń

Swin Transformer to transformator wizyjny, który przetwarza obrazy w przesuniętych, hierarchicznych oknach, dzięki czemu uwaga jest wystarczająco wydajna, aby można ją było skalować…

2 min. przeczytajPrzeczytaj

Skończyłeś czytać? Udowodnij to.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.

Visual AI AI Guides — Page 9 of 12 | AI Understanding