Bezpłatna biblioteka AI

Wizualna sztuczna inteligencja przewodnikiZa darmo na zawsze.

133 przewodniki w prostym języku angielskim, ustrukturyzowane ścieżki edukacyjne i otwarta biblioteka — stworzone przez niezależną organizację non-profit 501(c)(3), aby każdy mógł zrozumieć współczesną sztuczną inteligencję.

133Bezpłatne przewodniki
1Ścieżki tematyczne
~2 minWedług przewodnika
~4hCzas czytania

Zacznij tutaj

Pięć Kursy oparte na wynikach

Każdy kurs zawiera wyraźne wyniki, zmapowane kompetencje, ćwiczenia oraz praktyczny projekt końcowy.

Ścieżki tematyczne

Przeglądaj według utworu

Wskocz w obszar, na którym Ci zależy. Do każdego utworu dołączono wiele przewodników w języku angielskim.

Pełna biblioteka

Wszystkie przewodniki

133 z 1019 pokazane przewodniki. Filtruj według utworu lub wyszukaj powyżej.

Wizualna sztuczna inteligencja

Tłumaczenie niesparowane CycleGAN

CycleGAN uczy się tłumaczyć obrazy pomiędzy dwiema dziedzinami wizualnymi (np. konie na zebry lub zdjęcia na obrazy) bez konieczności dopasowywania obrazów przed i po…

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Synteza obrazu semantycznego SPADE

SPADE (normalizacja adaptacyjna przestrzennie) zmienia prosty układ z etykietami, przypominający dziecięcą mapę do kolorowania przedstawiającą „niebo tu, trawa tam, drzewo tutaj”…

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Interaktywna edycja DragGAN

DragGAN pozwala edytować obraz dosłownie przeciągając punkty: złap miejsce i przeciągnij je do celu, a obraz realistycznie się deformuje, zmieniając pozę…

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Transformatory dyfuzyjne

Transformatory dyfuzyjne (DiT) zamieniają splotową sieć U-Net w sercu generatorów obrazu i wideo na szkielet transformatora.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Funkcja Sieci piramid

Sieci piramid obiektowych (FPN) umożliwiają detektorom wykrywanie obiektów o bardzo różnych rozmiarach poprzez tanie budowanie wieloskalowej „piramidy” cech.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Tłumienie inne niż maksymalne

Tłumienie niemaksymalne (NMS) to etap czyszczenia, który zamienia niechlujny stos nakładających się pól wykrywania w jedno schludne pudełko na obiekt.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Przestrzenne sieci transformatorowe

Przestrzenne sieci transformatorowe (STN) to moduły, których można się nauczyć, które pozwalają sieci neuronowej aktywnie wypaczać, obracać, przycinać lub przeskalowywać dane wejściowe, aby skupić się na tym, co…

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Szacowanie głębokości stereo

Oszacowanie głębi stereo pozwala określić, jak daleko znajdują się rzeczy, porównując dwa lekko przesunięte widoki z kamery, tak jak robi to dwoje oczu.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Przetwarzanie chmur punktów

Chmura punktów to zbiór punktów 3D (X, Y, Z), który oddaje kształt rzeczywistych obiektów i przestrzeni, często z czujników LiDAR lub głębokości.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Podpisane funkcje odległości

Funkcja odległości ze znakiem (SDF) opisuje kształt 3D, informując, dla dowolnego punktu w przestrzeni, jak daleko jest do najbliższej powierzchni, za pomocą znaku, który mówi…

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Odkształcalne zwoje

Odkształcalne sploty pozwalają sieci neuronowej naginać siatkę próbkowania tak, aby podążała za rzeczywistym kształtem obiektów, zamiast przeciskać je przez sztywne kwadratowe okno.

2 min. przeczytajPrzeczytaj
Wizualna sztuczna inteligencja

Samodestylacja DINO

DINO to metoda samonadzoru, która uczy transformatora wizyjnego rozumienia obrazów bez żadnych etykiet, poprzez samouczenie się sieci.

2 min. przeczytajPrzeczytaj

Skończyłeś czytać? Udowodnij to.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.