Bibliotecă AI gratuită

Inteligența vizuală AI ghiduriLiber pentru totdeauna.

133 ghiduri în limba engleză simplă, căi de învățare structurate și o bibliotecă deschisă – construită de o organizație nonprofit independentă 501(c)(3), astfel încât oricine să poată înțelege IA modernă.

133Ghiduri gratuite
1Piese de subiecte
~2 minPe ghid
~4hTimp de lectură

Începeți de aici

Cinci cursuri bazate pe rezultate

Fiecare curs include rezultate explicite, competențe mapate, activități de practică și o piatră de bază aplicată.

Piese de subiecte

Răsfoiți după piesă

Sari în zona de care îți pasă. Fiecare piesă are mai multe ghiduri în limba engleză simplă.

Bibliotecă completă

Toate ghidurile

133 de 1019 ghiduri prezentate. Filtrați după piesă sau căutați mai sus.

Inteligența vizuală AI

Recunoașterea optică a caracterelor

Recunoașterea optică a caracterelor (OCR) transformă imaginile textului — documente scanate, fotografii cu semne, PDF-uri — în text editabil, care poate fi citit de mașină.

2 min citireCitiți
Inteligența vizuală AI

Flux optic

Fluxul optic estimează modul în care fiecare pixel se mișcă între cadre video consecutive, producând o hartă densă a vectorilor de mișcare.

2 min citireCitiți
Inteligența vizuală AI

Estimarea adâncimii monoculare

Estimarea adâncimii monoculare prezice cât de departe este fiecare pixel de o singură fotografie obișnuită - nu este nevoie de cameră stereo, lidar sau senzor de adâncime.

2 min citireCitiți
Inteligența vizuală AI

Modele de difuzie latentă

Modelele de difuzie latentă generează imagini prin rularea procesului de difuzie într-un spațiu latent comprimat în loc de pixeli bruti, reducând costurile de calcul.

2 min citireCitiți
Inteligența vizuală AI

ControlNet

ControlNet este un supliment care oferă modelelor de generare de imagini un control structural precis, permițându-vă să direcționați rezultatul cu margini, ipostaze, hărți de adâncime sau mâzgăli.

2 min citireCitiți
Inteligența vizuală AI

Îndrumări fără clasificare

Îndrumarea fără clasificator este tehnica care face ca modelele de difuzie să urmeze de fapt solicitarea dvs., schimbând o anumită diversitate pentru o aderență mult mai puternică.

2 min citireCitiți
Inteligența vizuală AI

SLAM vizual

Visual SLAM permite unei camere în mișcare să construiască o hartă a unui spațiu necunoscut, urmărind simultan propria sa poziție în interiorul acelei hărți.

2 min citireCitiți
Inteligența vizuală AI

Sora și Text-to-Video

Sora este modelul text-to-video al OpenAI care transformă o solicitare scrisă într-un clip video scurt, de înaltă rezoluție.

2 min citireCitiți
Inteligența vizuală AI

Modele de difuzie video

Modelele de difuzie video generează imagini în mișcare transformând treptat zgomotul aleatoriu în cadre coerente, extinzând ideea de difuzie de la imagini la timp.

2 min citireCitiți
Inteligența vizuală AI

Generare text în 3D

Generarea text-to-3D transformă un mesaj scris, cum ar fi „un fotoliu din piele de epocă” într-un model 3D complet pe care îl puteți roti, lumina și arunca într-un joc sau într-o scenă.

2 min citireCitiți
Inteligența vizuală AI

Redare diferențiabilă

Redarea diferențiabilă face procesul de transformare a unei scene 3D într-o imagine 2D complet diferențiabilă, astfel încât să puteți calcula gradienți din pixelii randați...

2 min citireCitiți
Inteligența vizuală AI

Arhitectura U-Net

U-Net este o rețea neuronală convoluțională în formă de „U” care excelează în producerea de rezultate precise la pixeli, inițial pentru segmentarea imaginilor biomedicale.

2 min citireCitiți

Ai terminat de citit? Demonstrează.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.

Visual AI AI Guides — Page 10 of 12 | AI Understanding