Ingyenes AI könyvtár

Vizuális AI útmutatókÖrökre ingyen.

133 egyszerű angol nyelvű útmutatók, strukturált tanulási útvonalak és nyílt könyvtár – egy független 501(c)(3) nonprofit szervezet építette, így bárki megértheti a modern AI-t.

133Ingyenes útmutatók
1Témasávok
~2 minÚtmutató szerint
~4hReading time

Kezdje itt

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Témasávok

Böngésszen szám szerint

Ugorjon be a számodra fontos területre. Minden számnak több egyszerű angol nyelvű útmutatója van.

Teljes könyvtár

Minden útmutató

133 -ból 1019 útmutatók láthatók. Szűrés sáv szerint vagy keresés fent.

Vizuális AI

Videó megértése

Video understanding analyzes visual and sometimes audio information across time.

2 min olvasniOlvassa el
Vizuális AI

Multimodális keresés

Multimodal search retrieves information across forms such as text, images, audio, and video.

2 min olvasniOlvassa el
Vizuális AI

AI dokumentum

Document AI extracts and interprets information from files such as forms, reports, invoices, and scanned pages.

2 min olvasniOlvassa el
Vizuális AI

Wasserstein GAN

A Wasserstein GAN (WGAN) a GAN edzési cél újratervezése, amely a Wasserstein távolságot használja az eredeti min-max veszteség helyett.

2 min olvasniOlvassa el
Vizuális AI

Feltételes GAN-ok

A feltételes GAN-ok (cGAN-ok) kiterjesztik a közönséges GAN-okat azáltal, hogy további információkat, például osztálycímkét vagy szöveget táplálnak be a generátorba és a megkülönböztetőbe.

2 min olvasniOlvassa el
Vizuális AI

Pix2Pix kép-kép fordítás

A Pix2Pix egy feltételes GAN, amely megtanulja lefordítani az egyik képtípust egy másikra, például egy vázlatot fotóvá vagy egy térképet műholdnézetté.

2 min olvasniOlvassa el
Vizuális AI

Képszínezés

A képszínezés mesterséges intelligencia segítségével hihető, valósághű színeket ad a fekete-fehér fényképekhez és filmekhez.

2 min olvasniOlvassa el
Vizuális AI

Struktúra mozgásból

A Mozgásból származó szerkezet (SfM) különböző nézőpontokból készült, egymást átfedő 2D-s fényképekből rekonstruálja a 3D-s jelenetgeometriát és a kamerapozíciókat.

2 min olvasniOlvassa el
Vizuális AI

Többnézetű sztereó

A Multi-View Stereo (MVS) sok kalibrált fényképet készít egy jelenetről, és sűrű 3D-s rekonstrukciót készít szinte minden pixel mélységének becslésével.

2 min olvasniOlvassa el
Vizuális AI

DDPM és DDIM mintavevők

A DDPM és a DDIM két módszer a diffúziós modell fordított folyamatának futtatására, lépésről lépésre képpé alakítva a véletlenszerű zajt.

2 min olvasniOlvassa el
Vizuális AI

Pontszámon alapuló generatív modellek

A pontszám alapú generatív modellek az adateloszlás gradiensének megtanulásával hoznak létre adatokat – azt az irányt, amely minden zajos mintát valósabbá tesz…

2 min olvasniOlvassa el
Vizuális AI

Fréchet kezdeti távolság

A Fréchet Inception Distance (FID) a szabványos mérőszám annak megítélésére, hogy a generált képek mennyire valósághűek és változatosak.

2 min olvasniOlvassa el

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.