AI knihovna zdarma

Vizuální AI průvodciNavždy zdarma.

133 Průvodci v jednoduché angličtině, strukturované výukové programy a otevřená knihovna – vytvořené nezávislou neziskovou organizací 501(c)(3), takže moderní umělé inteligenci může porozumět každý.

133Zdarma průvodci
1Tématické stopy
~2 minPodle průvodce
~4hDoba čtení

Začněte zde

Pět Kurzy založené na výsledcích

Každý kurz obsahuje explicitní výsledky, namapované kompetence, cvičné aktivity a aplikovaný závěrečný projekt.

Tématické stopy

Procházet podle stopy

Skočte do oblasti, na které vám záleží. Každá trať má několik jednoduchých anglických průvodců.

Plná knihovna

Všichni průvodci

133 z 1019 zobrazena vodítka. Filtrujte podle skladby nebo vyhledávání výše.

Vizuální AI

Optické rozpoznávání znaků

Optické rozpoznávání znaků (OCR) mění obrázky textu – naskenované dokumenty, fotografie nápisů, PDF – na strojově čitelný a upravitelný text.

2 min přečtenoPřečtěte si
Vizuální AI

Optický tok

Optický tok odhaduje, jak se každý pixel pohybuje mezi po sobě jdoucími snímky videa, a vytváří hustou mapu pohybových vektorů.

2 min přečtenoPřečtěte si
Vizuální AI

Monokulární odhad hloubky

Monokulární odhad hloubky předpovídá, jak daleko je každý pixel od jedné běžné fotografie – není potřeba žádná stereo kamera, lidar ani hloubkový senzor.

2 min přečtenoPřečtěte si
Vizuální AI

Modely latentní difúze

Modely latentní difúze generují obrazy spuštěním procesu difúze v komprimovaném latentním prostoru namísto nezpracovaných pixelů, což snižuje náklady na výpočet.

2 min přečtenoPřečtěte si
Vizuální AI

ControlNet

ControlNet je doplněk, který poskytuje modelům pro generování obrázků přesnou strukturální kontrolu a umožňuje vám řídit výstup pomocí hran, pozic, hloubkových map nebo klikyháků.

2 min přečtenoPřečtěte si
Vizuální AI

Návod bez klasifikátoru

Navádění bez klasifikátoru je technika, díky které modely difúze skutečně následují vaši výzvu a vyměňují určitou rozmanitost za mnohem silnější přilnavost.

2 min přečtenoPřečtěte si
Vizuální AI

Vizuální SLAM

Visual SLAM umožňuje pohybující se kameře sestavit mapu neznámého prostoru a současně sledovat svou vlastní pozici uvnitř mapy.

2 min přečtenoPřečtěte si
Vizuální AI

Sora a převod textu na video

Sora je model OpenAI pro převod textu na video, který přemění písemnou výzvu na krátký videoklip ve vysokém rozlišení.

2 min přečtenoPřečtěte si
Vizuální AI

Modely šíření videa

Modely šíření videa generují pohyblivé obrázky postupným převáděním náhodného šumu do koherentních snímků, čímž se myšlenka šíření z obrázků na čas rozšiřuje.

2 min přečtenoPřečtěte si
Vizuální AI

Generování textu na 3D

Generování převodu textu do 3D promění písemnou výzvu jako „staré kožené křeslo“ na úplný 3D model, který můžete otáčet, osvětlovat a pouštět do hry nebo scény.

2 min přečtenoPřečtěte si
Vizuální AI

Diferencovatelné vykreslování

Díky diferenciovatelnému vykreslování je proces přeměny 3D scény na 2D obraz plně diferencovatelný, takže můžete vypočítat přechody z vykreslených pixelů…

2 min přečtenoPřečtěte si
Vizuální AI

Architektura U-Net

U-Net je konvoluční neuronová síť ve tvaru „U“, která vyniká v produkci výstupů s přesností na pixely, původně pro segmentaci biomedicínského obrazu.

2 min přečtenoPřečtěte si

Dočetl jsi to? Dokaž to.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.

Visual AI AI Guides — Page 10 of 12 | AI Understanding