Ingyenes AI könyvtár

Vizuális AI útmutatókÖrökre ingyen.

133 egyszerű angol nyelvű útmutatók, strukturált tanulási útvonalak és nyílt könyvtár – egy független 501(c)(3) nonprofit szervezet építette, így bárki megértheti a modern AI-t.

133Ingyenes útmutatók
1Témasávok
~2 minÚtmutató szerint
~4hReading time

Kezdje itt

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Témasávok

Böngésszen szám szerint

Ugorjon be a számodra fontos területre. Minden számnak több egyszerű angol nyelvű útmutatója van.

Teljes könyvtár

Minden útmutató

133 -ból 1019 útmutatók láthatók. Szűrés sáv szerint vagy keresés fent.

Vizuális AI

Neurális sugárzási mezők

A Neural Radiance Fields (NeRF) egy teljes 3D-s jelenetet rekonstruál néhány közönséges fényképből, lehetővé téve, hogy a fényképezőgépet vadonatúj nézőpontokba repítsen.

2 min olvasniOlvassa el
Vizuális AI

Gauss Splatting

A Gauss-splatting egy 3D-s jelenetet reprezentál milliónyi apró, színes, félig átlátszó foltként, amelyek valós időben renderelhetők.

2 min olvasniOlvassa el
Vizuális AI

Maszkos automatikus kódolók

A maszkolt autokódolók (MAE) egy önfelügyelt módszer, amely megtanítja a látásmodellnek, hogy rekonstruálja a képeket, miután a kép nagy részét elrejtették.

2 min olvasniOlvassa el
Vizuális AI

Képaláírás

A képaláírás az a feladata, hogy automatikusan generáljon egy természetes nyelvű mondatot, amely leírja, hogy mi van a képen.

2 min olvasniOlvassa el
Vizuális AI

Vizuális kérdésválasz

A Visual Question Answering (VQA) lehetővé teszi, hogy a rendszer megválaszolja a képpel kapcsolatos, szabad formájú természetes nyelvű kérdéseket, például: „Hány ember visel kalapot?

2 min olvasniOlvassa el
Vizuális AI

YOLO valós idejű észlelés

A YOLO (You Only Look Once) az objektumészlelési modellek családja, amely elég gyorsan megtalálja és megjelöli a képen lévő összes objektumot egyetlen neurális hálózati átlépéssel…

2 min olvasniOlvassa el
Vizuális AI

Panoptikus szegmentáció

A panoptikus szegmentáció a kép minden egyes pixelét címkével látja el, amely egyesíti a „mi ez a régió” és „melyik konkrét objektum ez”.

2 min olvasniOlvassa el
Vizuális AI

Emberi pózbecslés

Az emberi pózbecslés észleli a test ízületeinek helyzetét, például a könyököket, a térdeket és a vállakat, hogy képekből digitális csontvázat készítsen egy személyről…

2 min olvasniOlvassa el
Vizuális AI

FLUX képmodellek

A FLUX a Black Forest Labs nyitott szöveg-képmodelleinek családja, amely éles részletekről, erőteljes azonnali követésről és meglepően pontos renderelt szövegről ismert.

2 min olvasniOlvassa el
Vizuális AI

Maradék hálózatok

A maradék hálózatok (ResNets) mély neurális hálózatok, amelyek „kapcsolatok kihagyását” adják meg, lehetővé téve a rétegek számára, hogy a teljes átalakítások helyett kis módosításokat tanuljanak meg.

2 min olvasniOlvassa el
Vizuális AI

Régióalapú CNN-ek

A régióalapú CNN-ek (R-CNN-ek) az objektumdetektorok családja, amelyek először jelölt régiókat javasolnak a képen, majd CNN-t használnak az osztályozáshoz és a pontos behatároláshoz…

2 min olvasniOlvassa el
Vizuális AI

Swin Transzformátor

A Swin Transformer egy víziótranszformátor, amely eltolt, hierarchikus ablakokban dolgozza fel a képeket, így a figyelmet kellően hatékonnyá teszi ahhoz, hogy átméretezhető legyen…

2 min olvasniOlvassa el

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.