Bibliotecă AI gratuită

Inteligența vizuală AI ghiduriLiber pentru totdeauna.

133 ghiduri în limba engleză simplă, căi de învățare structurate și o bibliotecă deschisă – construită de o organizație nonprofit independentă 501(c)(3), astfel încât oricine să poată înțelege IA modernă.

133Ghiduri gratuite
1Piese de subiecte
~2 minPe ghid
~4hTimp de lectură

Începeți de aici

Cinci cursuri bazate pe rezultate

Fiecare curs include rezultate explicite, competențe mapate, activități de practică și o piatră de bază aplicată.

Piese de subiecte

Răsfoiți după piesă

Sari în zona de care îți pasă. Fiecare piesă are mai multe ghiduri în limba engleză simplă.

Bibliotecă completă

Toate ghidurile

133 de 1019 ghiduri prezentate. Filtrați după piesă sau căutați mai sus.

Inteligența vizuală AI

Armonizarea și compunerea imaginii

Armonizarea imaginii ajustează automat un obiect din prim-plan lipit, astfel încât culoarea, iluminarea și tonul acestuia să se potrivească cu noul fundal, făcând compozitele să pară reale.

2 min citireCitiți
Inteligența vizuală AI

SDXL și difuzie în cascadă

SDXL este modelul de înaltă rezoluție text-to-image al Stability AI care îmbină un generator de bază puternic cu un rafinator, în timp ce lanțuri de difuzie în cascadă conectează mai multe...

2 min citireCitiți
Inteligența vizuală AI

GLIGEN Grounded Generation

GLIGEN (Grounded-Language-to-Image Generation) vă permite să controlați exact unde apar obiectele într-o imagine generată prin alimentarea casetelor de delimitare a modelului...

2 min citireCitiți
Inteligența vizuală AI

Adaptor T2I pentru controlul difuziei multicondiționale

Aflați adaptorul T2I pentru controlul difuziei multicondiționale: cum conduce Difuziunea stabilă cu margini, adâncime, poziție și alte condiții utilizând un dispozitiv ușor...

2 min citireCitiți
Inteligența vizuală AI

inversarea textului nul

Inversarea textului nul este o tehnică care vă permite să editați o fotografie reală cu un model de difuzie bazat pe text, cum ar fi Stable Diffusion, păstrând tot ce aveți...

2 min citireCitiți
Inteligența vizuală AI

Reglaj personalizat cu mai multe concepte de difuzie

Custom Diffusion este o metodă ușoară de reglare fină care învață un model text-to-image noi concepte personale, cum ar fi câinele dvs. sau un anumit scaun, de la doar...

2 min citireCitiți
Inteligența vizuală AI

Amestecare latentă și interpolare a imaginilor

Amestecarea latentă combină imaginile combinând reprezentările lor comprimate în spațiul latent al unui model, mai degrabă decât media pixelilor bruti.

2 min citireCitiți
Inteligența vizuală AI

Modele de viziune-limbaj-acțiune pentru robotică

Modelele Vision-Language-Action (VLA) sunt rețele neuronale mari care preiau imagini ale camerei plus o instrucțiune scrisă și transmit direct comenzile motorului robotului.

2 min citireCitiți
Inteligența vizuală AI

Politica de difuzare pentru controlul roboților

Politica de difuzare aplică aceeași idee de eliminare a zgomotului din spatele generatoarelor de imagini precum Stable Diffusion pentru controlul roboților: în loc să prezică o singură acțiune următoare...

2 min citireCitiți
Inteligența vizuală AI

Creați un videoclip Text-to-Video

Make-A-Video este sistemul Meta din 2022 care transformă o solicitare de text într-un scurt clip video fără să se antreneze vreodată cu privire la perechile text-video etichetate.

2 min citireCitiți
Inteligența vizuală AI

Imagine Video Cascades

Imagen Video este sistemul text-to-video 2022 al Google care creează un clip printr-o cascadă de șapte modele de difuzie, fiecare adăugând mai multe cadre sau mai multă rezoluție.

2 min citireCitiți
Inteligența vizuală AI

CogVideo și CogVideoX

CogVideo (2022) a fost primul model deschis la scară largă de tip text-to-video, iar CogVideoX (2024) este succesorul său cu sursă deschisă mult mai capabil de la Tsinghua/Zhipu AI.

2 min citireCitiți

Ai terminat de citit? Demonstrează.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.