Bibliothèque IA gratuite

IA visuelle GuidesLibre pour toujours.

133 des guides en anglais simple, des parcours d'apprentissage structurés et une bibliothèque ouverte — construits par une organisation à but non lucratif indépendante 501(c)(3) pour que tout le monde puisse comprendre l'IA moderne.

133Guides gratuits
1Pistes thématiques
~2 minPar guide
~4hTemps de lecture

Commencez ici

Cinq cours axés sur les résultats

Chaque cours comprend des résultats explicites, des compétences cartographiées, des activités pratiques et une synthèse appliquée.

Pistes thématiques

Parcourir par piste

Sautez dans la zone qui vous tient à cœur. Chaque piste comporte plusieurs guides en anglais simple.

Bibliothèque complète

Tous les guides

133 de 1019 guides illustrés. Filtrez par piste ou recherchez ci-dessus.

IA visuelle

Curseurs LoRA pour l'édition d'images

Les curseurs LoRA sont de minuscules modules complémentaires qui vous donnent un cadran continu pour pousser un seul attribut d'une image vers le haut ou vers le bas, comme l'âge, le sourire ou la rouille, sans…

2 lecture min.Lire
IA visuelle

Édition des instructions InstructPix2Pix

InstructPix2Pix vous permet de modifier une photo en tapant une commande simple comme « passer l'hiver » ou « transformer le chat en chien », aucun masque ni outil de sélection n'est requis.

2 lecture min.Lire
IA visuelle

Édition d'attention croisée d'invite à invite

Prompt-to-Prompt édite une image générée en modifiant son invite de texte tout en réutilisant les cartes d'attention internes du modèle, modifiant ainsi les échanges d'un mot…

2 lecture min.Lire
IA visuelle

Super-résolution ESRGAN et GAN

ESRGAN utilise un concours générateur contre discriminateur pour inventer des détails réalistes lors de la mise à l'échelle des images, allant au-delà de l'interpolation floue.

2 lecture min.Lire
IA visuelle

Restauration pratique Real-ESRGAN

Real-ESRGAN étend ESRGAN pour gérer les dégradations désordonnées et inconnues des photos du monde réel plutôt que le flou synthétique propre.

2 lecture min.Lire
IA visuelle

Restauration du transformateur SwinIR

SwinIR applique l'attention de la fenêtre décalée du Swin Transformer aux tâches de restauration d'images telles que la super-résolution, le débruitage et la suppression des artefacts JPEG.

2 lecture min.Lire
IA visuelle

Modèles de cohérence latente

Les modèles de cohérence latente (LCM) sont une technique qui permet aux générateurs d'images de diffusion de produire des images de haute qualité en seulement une à quatre étapes…

2 lecture min.Lire
IA visuelle

Transformateurs de vision

Les Vision Transformers (ViT) appliquent l'architecture de transformateur qui alimente ChatGPT aux images, traitant une image comme une séquence de correctifs au lieu d'une grille…

2 lecture min.Lire
IA visuelle

Stable Diffusion

Stable Diffusion est un modèle texte-image open source, publié par Stability AI en 2022, qui génère des images en supprimant progressivement le bruit d'un élément aléatoire…

2 lecture min.Lire
IA visuelle

Midjourney

Midjourney est un service commercial de texte-image populaire connu pour ses résultats saisissants et hautement esthétiques et ses origines en tant que robot Discord.

2 lecture min.Lire
IA visuelle

DALL-E

DALL-E est la famille de modèles texte-image de OpenAI qui transforme une description écrite en une image originale.

2 lecture min.Lire
IA visuelle

Modèles CLIP et Vision-Langage

CLIP est un modèle de OpenAI qui apprend à connecter des images et du texte en plaçant les deux dans le même espace mathématique.

2 lecture min.Lire

Vous avez fini de lire ? Prouvez-le.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.