Bibliotecă AI gratuită

Inteligența vizuală AI ghiduriLiber pentru totdeauna.

133 ghiduri în limba engleză simplă, căi de învățare structurate și o bibliotecă deschisă – construită de o organizație nonprofit independentă 501(c)(3), astfel încât oricine să poată înțelege IA modernă.

133Ghiduri gratuite
1Piese de subiecte
~2 minPe ghid
~4hTimp de lectură

Începeți de aici

Cinci cursuri bazate pe rezultate

Fiecare curs include rezultate explicite, competențe mapate, activități de practică și o piatră de bază aplicată.

Piese de subiecte

Răsfoiți după piesă

Sari în zona de care îți pasă. Fiecare piesă are mai multe ghiduri în limba engleză simplă.

Bibliotecă completă

Toate ghidurile

133 de 1019 ghiduri prezentate. Filtrați după piesă sau căutați mai sus.

Inteligența vizuală AI

Glisoare LoRA pentru editarea imaginilor

Glisoarele LoRA sunt module suplimentare mici care vă oferă un cadran continuu pentru a împinge un singur atribut al unei imagini în sus sau în jos, cum ar fi vârsta, zâmbetul sau rugina, fără...

2 min citireCitiți
Inteligența vizuală AI

Editarea instrucțiunilor InstructPix2Pix

InstructPix2Pix vă permite să editați o fotografie tastând o comandă simplă, cum ar fi „iarnă” sau „transforma pisica într-un câine”, fără măști sau instrumente de selecție.

2 min citireCitiți
Inteligența vizuală AI

Editare cu atenție încrucișată de la Solicitare la Solicitare

Prompt-to-Prompt editează o imagine generată modificând mesajul text în timp ce reutilizează hărțile de atenție interne ale modelului, astfel încât schimbând un singur cuvânt...

2 min citireCitiți
Inteligența vizuală AI

ESRGAN și GAN Super-Resolution

ESRGAN folosește un concurs generator-versus-discriminator pentru a inventa detalii realiste atunci când crește imaginile, depășind interpolarea neclară.

2 min citireCitiți
Inteligența vizuală AI

Real-ESRGAN Restaurare Practică

Real-ESRGAN extinde ESRGAN pentru a gestiona degradările dezordonate, necunoscute ale fotografiilor din lumea reală, mai degrabă decât neclaritatea sintetică curată.

2 min citireCitiți
Inteligența vizuală AI

Restaurare transformator SwinIR

SwinIR aplică atenția ferestrei deplasate a Swin Transformer sarcinilor de restaurare a imaginii, cum ar fi super-rezoluția, eliminarea zgomotului și eliminarea artefactelor JPEG.

2 min citireCitiți
Inteligența vizuală AI

Modele de consistență latentă

Modelele de consistență latentă (LCM) sunt o tehnică care permite generatorilor de imagini de difuzie să producă imagini de înaltă calitate în doar unul până la patru pași...

2 min citireCitiți
Inteligența vizuală AI

Transformatoare de vedere

Vision Transformers (ViTs) aplică arhitectura transformatorului care alimentează ChatGPT imaginilor, tratând o imagine ca o secvență de patch-uri în loc de o grilă...

2 min citireCitiți
Inteligența vizuală AI

Stable Diffusion

Stable Diffusion este un model open-source text-to-image, lansat de Stability AI în 2022, care generează imagini prin eliminarea treptată a zgomotului dintr-o...

2 min citireCitiți
Inteligența vizuală AI

Midjourney

Midjourney este un serviciu comercial popular de tip text-to-image, cunoscut pentru rezultatele sale uimitoare, extrem de estetice și originile sale ca robot Discord.

2 min citireCitiți
Inteligența vizuală AI

DALL-E

DALL-E este familia OpenAI de modele text-to-image care transformă o descriere scrisă într-o imagine originală.

2 min citireCitiți
Inteligența vizuală AI

Modele CLIP și Vision-Language

CLIP este un model de la OpenAI care învață să conecteze imagini și text prin plasarea pe ambele în același spațiu matematic.

2 min citireCitiți

Ai terminat de citit? Demonstrează.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.