Ingyenes AI könyvtár

Vizuális AI útmutatókÖrökre ingyen.

133 egyszerű angol nyelvű útmutatók, strukturált tanulási útvonalak és nyílt könyvtár – egy független 501(c)(3) nonprofit szervezet építette, így bárki megértheti a modern AI-t.

133Ingyenes útmutatók
1Témasávok
~2 minÚtmutató szerint
~4hReading time

Kezdje itt

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Témasávok

Böngésszen szám szerint

Ugorjon be a számodra fontos területre. Minden számnak több egyszerű angol nyelvű útmutatója van.

Teljes könyvtár

Minden útmutató

133 -ból 1019 útmutatók láthatók. Szűrés sáv szerint vagy keresés fent.

Vizuális AI

Optikai karakterfelismerés

Az optikai karakterfelismerés (OCR) a szöveg képeit – beolvasott dokumentumokat, jelképeket, PDF-eket – géppel olvasható, szerkeszthető szöveggé alakítja.

2 min olvasniOlvassa el
Vizuális AI

Optikai áramlás

Az optikai áramlás megbecsüli, hogy az egyes pixelek hogyan mozognak az egymást követő videokockák között, így a mozgásvektorok sűrű térképét állítják elő.

2 min olvasniOlvassa el
Vizuális AI

Monokuláris mélységbecslés

A monokuláris mélységbecslés megjósolja, hogy az egyes pixelek milyen távolságra vannak egyetlen közönséges fényképtől – nincs szükség sztereó kamerára, lidarra vagy mélységérzékelőre.

2 min olvasniOlvassa el
Vizuális AI

Látens diffúziós modellek

A látens diffúziós modellek úgy állítanak elő képeket, hogy a diffúziós folyamatot tömörített látens térben futtatják nyers pixelek helyett, csökkentve ezzel a számítási költségeket.

2 min olvasniOlvassa el
Vizuális AI

ControlNet

A ControlNet egy olyan kiegészítő, amely a képgeneráló modellek precíz szerkezeti vezérlését teszi lehetővé, lehetővé téve a kimenet élekkel, pózokkal, mélységtérképekkel vagy firkákkal történő irányítását.

2 min olvasniOlvassa el
Vizuális AI

Osztályozó nélküli útmutató

Az osztályozó nélküli útmutatás az a technika, amely arra készteti a diffúziós modelleket, hogy valóban követik az Ön utasításait, és némi változatossággal kereskednek a sokkal erősebb tapadás érdekében.

2 min olvasniOlvassa el
Vizuális AI

Vizuális SLAM

A Visual SLAM lehetővé teszi a mozgó kamera számára, hogy térképet készítsen egy ismeretlen térről, miközben egyidejűleg követi saját pozícióját azon a térképen.

2 min olvasniOlvassa el
Vizuális AI

Sora és Text-to-Video

A Sora a OpenAI szöveg-videó modellje, amely az írásos felszólítást rövid, nagy felbontású videoklippé alakítja.

2 min olvasniOlvassa el
Vizuális AI

Videó diffúziós modellek

A videodiffúziós modellek mozgóképeket generálnak úgy, hogy a véletlenszerű zajt fokozatosan koherens képkockákká alakítják, így a diffúziós ötletet képekről időre kiterjesztik.

2 min olvasniOlvassa el
Vizuális AI

Szöveg-3D generálás

A szövegből 3D-be történő generálás az olyan írásos felszólításokat, mint a „vintage bőrfotel”, teljes 3D-s modellré alakítja, amelyet elforgathat, megvilágíthat, és beleeshet egy játékba vagy jelenetbe.

2 min olvasniOlvassa el
Vizuális AI

Differenciálható renderelés

A differenciálható renderelés teljesen megkülönböztethetővé teszi a 3D-s jelenet 2D-s képpé alakításának folyamatát, így a megjelenített képpontokból gradienseket számolhat…

2 min olvasniOlvassa el
Vizuális AI

U-Net architektúra

Az U-Net egy „U” alakú konvolúciós neurális hálózat, amely kiválóan alkalmas pixelpontos kimenetek előállítására, eredetileg az orvosbiológiai képek szegmentálására.

2 min olvasniOlvassa el

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.