Bibliothèque IA gratuite

IA visuelle GuidesLibre pour toujours.

133 des guides en anglais simple, des parcours d'apprentissage structurés et une bibliothèque ouverte — construits par une organisation à but non lucratif indépendante 501(c)(3) pour que tout le monde puisse comprendre l'IA moderne.

133Guides gratuits
1Pistes thématiques
~2 minPar guide
~4hTemps de lecture

Commencez ici

Cinq cours axés sur les résultats

Chaque cours comprend des résultats explicites, des compétences cartographiées, des activités pratiques et une synthèse appliquée.

Pistes thématiques

Parcourir par piste

Sautez dans la zone qui vous tient à cœur. Chaque piste comporte plusieurs guides en anglais simple.

Bibliothèque complète

Tous les guides

133 de 1019 guides illustrés. Filtrez par piste ou recherchez ci-dessus.

IA visuelle

Pipeline de texte en 3D Magic3D

Magic3D est la réponse en deux étapes de NVIDIA à DreamFusion, produisant plus rapidement du contenu 3D de plus haute résolution et plus détaillé.

2 lecture min.Lire
IA visuelle

Réseaux de débruitage et de floutage

Les réseaux de débruitage et de suppression du flou sont des modèles neuronaux qui nettoient les images bruyantes ou floues, récupérant ainsi les détails nets des entrées désordonnées.

2 lecture min.Lire
IA visuelle

Restauration du visage GFPGAN

GFPGAN est un modèle spécialisé qui restaure des photos de visages anciennes, floues ou de mauvaise qualité en portraits nets et réalistes.

2 lecture min.Lire
IA visuelle

Récupération de visage robuste CodeFormer

CodeFormer est un modèle de restauration de visage conçu pour gérer une dégradation extrême, récupérant des visages reconnaissables à partir d'entrées fortement endommagées, minuscules ou floues.

2 lecture min.Lire
IA visuelle

Générateurs à l'échelle GigaGAN

GigaGAN est un GAN à milliards de paramètres qui prouve que les réseaux adverses génératifs peuvent évoluer jusqu'à la génération de texte en image, rivalisant avec les modèles de diffusion…

2 lecture min.Lire
IA visuelle

Synthèse d'images VQGAN et Codebook

VQGAN compresse les images dans une grille de jetons discrets tirés d'un livre de codes appris, permettant à un transformateur de générer des images de la même manière que les modèles de langage…

2 lecture min.Lire
IA visuelle

Décodage des jetons parallèles MaskGIT

MaskGIT génère des images en prédisant plusieurs jetons à la fois et en remplissant d'abord les plus fiables, remplaçant ainsi la lente génération de gauche à droite…

2 lecture min.Lire
IA visuelle

Diffusion de nouvelles vues de zéro 1 à 3

Zero-1-to-3 transforme une seule photo d'un objet en images de ce même objet vu sous n'importe quel nouvel angle, en utilisant un modèle de diffusion conditionné par la caméra…

2 lecture min.Lire
IA visuelle

Représentation 3D hybride DMTet

DMTet (Deep Marching Tetrahedra) est une représentation de forme 3D hybride qui combine une grille tétraédrique déformable avec un champ de distance signé de manière neuronale…

2 lecture min.Lire
IA visuelle

Encodage de hachage NGP instantané

Instant-NGP est la technique de NVIDIA qui entraîne les champs de rayonnement neuronal et d'autres primitives graphiques neuronales en quelques secondes au lieu d'heures en stockant les éléments d'apprentissage…

2 lecture min.Lire
IA visuelle

ProfondeurAnything Profondeur monoculaire

DepthAnything est un modèle de base qui estime la distance entre chaque pixel et une seule photo ordinaire, sans matériel spécial.

2 lecture min.Lire
IA visuelle

Estimation de la profondeur de diffusion des soucis

Marigold réutilise un modèle de diffusion de génération d'images pré-entraîné (Stable Diffusion) pour prédire des cartes de profondeur très détaillées.

2 lecture min.Lire

Vous avez fini de lire ? Prouvez-le.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.