Bibliotecă AI gratuită

Inteligența vizuală AI ghiduriLiber pentru totdeauna.

133 ghiduri în limba engleză simplă, căi de învățare structurate și o bibliotecă deschisă – construită de o organizație nonprofit independentă 501(c)(3), astfel încât oricine să poată înțelege IA modernă.

133Ghiduri gratuite
1Piese de subiecte
~2 minPe ghid
~4hTimp de lectură

Începeți de aici

Cinci cursuri bazate pe rezultate

Fiecare curs include rezultate explicite, competențe mapate, activități de practică și o piatră de bază aplicată.

Piese de subiecte

Răsfoiți după piesă

Sari în zona de care îți pasă. Fiecare piesă are mai multe ghiduri în limba engleză simplă.

Bibliotecă completă

Toate ghidurile

133 de 1019 ghiduri prezentate. Filtrați după piesă sau căutați mai sus.

Inteligența vizuală AI

Conductă Magic3D Text-to-3D

Magic3D este răspunsul NVIDIA în două etape la DreamFusion, producând mai rapid conținut 3D de rezoluție mai mare și mai detaliat.

2 min citireCitiți
Inteligența vizuală AI

Eliminarea zgomotului și deblocarea rețelelor

Rețelele de eliminare a zgomotului și de estompare sunt modele neuronale care curăță imaginile zgomotoase sau neclare, recuperând detaliile clare din intrările dezordonate.

2 min citireCitiți
Inteligența vizuală AI

GFPGAN Restaurare facială

GFPGAN este un model specializat care restabilește fotografiile cu fețe de calitate scăzută, neclare sau vechi în portrete clare și realiste.

2 min citireCitiți
Inteligența vizuală AI

CodeFormer Robust Face Recovery

CodeFormer este un model de restaurare a feței construit pentru a face față degradării extreme, recuperând fețele recunoscute din intrări puternic deteriorate, minuscule sau neclare.

2 min citireCitiți
Inteligența vizuală AI

Generatoare la scară GigaGAN

GigaGAN este un GAN cu un miliard de parametri care demonstrează că rețelele adverse generative se pot scala la generarea text-to-image, rivalizând cu modelele de difuzie...

2 min citireCitiți
Inteligența vizuală AI

Sinteza imaginilor VQGAN și Codebook

VQGAN comprimă imaginile într-o grilă de jetoane discrete extrase dintr-o carte de coduri învățată, permițând unui transformator să genereze imagini în același mod în care modelează limbajul...

2 min citireCitiți
Inteligența vizuală AI

Decodarea paralelă a tokenurilor MaskGIT

MaskGIT generează imagini prin prezicerea mai multor jetoane simultan și completând mai întâi pe cele mai sigure, înlocuind generarea lentă de la stânga la dreapta...

2 min citireCitiți
Inteligența vizuală AI

Zero-1-to-3 Novel View Diffusion

Zero-1-to-3 transformă o singură fotografie a unui obiect în imagini ale aceluiași obiect văzute din orice unghi nou, folosind un model de difuzie condiționat de cameră...

2 min citireCitiți
Inteligența vizuală AI

Reprezentare 3D hibridă DMTet

DMTet (Deep Marching Tetrahedra) este o reprezentare hibridă a formei 3D care combină o grilă tetraedrică deformabilă cu un câmp de distanță semnat, astfel încât neural...

2 min citireCitiți
Inteligența vizuală AI

Codare hash NGP instantanee

Instant-NGP este tehnica NVIDIA care antrenează Neural Radiance Fields și alte elemente primitive de grafică neuronală în secunde în loc de ore, prin stocarea materialului de învățat...

2 min citireCitiți
Inteligența vizuală AI

DepthAnything Monocular Depth

DepthAnything este un model de bază care estimează cât de departe este fiecare pixel de o singură fotografie obișnuită, fără hardware special.

2 min citireCitiți
Inteligența vizuală AI

Estimarea adâncimii de difuzie a gălbenelelor

Marigold reutilizează un model de difuzie de generare de imagini preantrenată (difuziune stabilă) pentru a prezice hărți foarte detaliate de adâncime.

2 min citireCitiți

Ai terminat de citit? Demonstrează.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.