Bibliothèque IA gratuite

IA visuelle GuidesLibre pour toujours.

133 des guides en anglais simple, des parcours d'apprentissage structurés et une bibliothèque ouverte — construits par une organisation à but non lucratif indépendante 501(c)(3) pour que tout le monde puisse comprendre l'IA moderne.

133Guides gratuits
1Pistes thématiques
~2 minPar guide
~4hTemps de lecture

Commencez ici

Cinq cours axés sur les résultats

Chaque cours comprend des résultats explicites, des compétences cartographiées, des activités pratiques et une synthèse appliquée.

Pistes thématiques

Parcourir par piste

Sautez dans la zone qui vous tient à cœur. Chaque piste comporte plusieurs guides en anglais simple.

Bibliothèque complète

Tous les guides

133 de 1019 guides illustrés. Filtrez par piste ou recherchez ci-dessus.

IA visuelle

Synthèse de nouvelles vues

La nouvelle synthèse de vues génère des images photoréalistes d'une scène à partir de points de vue qui n'ont jamais été réellement photographiés.

2 lecture min.Lire
IA visuelle

Imagerie générative masquée Muse

Muse est un modèle de conversion texte-image de Google qui génère des images en remplissant des jetons d'image masquées d'un seul coup, ce qui le rend beaucoup plus rapide qu'une étape par étape…

2 lecture min.Lire
IA visuelle

Imagerie autorégressive Parti Pathways

Parti (Pathways Autoregressive Text-to-Image) génère des images de la même manière que les modèles de langage écrivent des phrases : un jeton d'image à la fois, prédisant le suivant…

2 lecture min.Lire
IA visuelle

Imagen 2 et diffusion optimisée pour les récompenses

Imagen 2 est le modèle texte-image photoréaliste basé sur la diffusion de Google, affiné avec un réglage des récompenses afin que ses sorties correspondent mieux à ce que les gens veulent réellement.

2 lecture min.Lire
IA visuelle

LaMa Résolution-Inpainting robuste

LaMa (Large Mask inpainting) est un réseau neuronal rapide et léger qui remplit proprement les régions manquantes ou supprimées d'une image, même lorsque le trou est énorme.

2 lecture min.Lire
IA visuelle

Diffusion vidéo stable

Stable Video Diffusion (SVD) est le modèle de base ouvert de Stability AI qui transforme une seule image fixe en un court clip vidéo au mouvement fluide.

2 lecture min.Lire
IA visuelle

Génération vidéo spatio-temporelle Lumière

Lumiere est un modèle de diffusion texte-vidéo de Google Research qui génère un clip vidéo entier à la fois à l'aide d'un U-Net spatio-temporel.

2 lecture min.Lire
IA visuelle

Mip-NeRF et champs de rayonnement anticrénelés

Mip-NeRF corrige les artefacts flous et irréguliers qui affectent le NeRF original lorsque vous effectuez le rendu de scènes à différentes distances ou résolutions.

2 lecture min.Lire
IA visuelle

Champs de rayonnement plénoxels et voxels

Plenoxels a montré que vous pouvez reconstruire une scène 3D avec des résultats de qualité NeRF sans aucun réseau neuronal – juste une grille de voxels stockant la couleur…

2 lecture min.Lire
IA visuelle

DUSt3R Reconstruction 3D dense

DUSt3R reconstruit une géométrie 3D dense à partir d'une poignée de photos ordinaires sans avoir besoin de positions de caméra ou d'étalonnage connus.

2 lecture min.Lire
IA visuelle

Montage One-Shot Tune-A-Video

Tune-A-Video affine un modèle de diffusion texte-image pré-entraîné sur une seule vidéo afin qu'il puisse rééditer ce clip à partir de nouvelles invites de texte.

2 lecture min.Lire
IA visuelle

Échantillonnage par distillation DreamFusion et Score

DreamFusion génère des objets 3D à partir de texte en utilisant un modèle de diffusion d'images 2D comme critique, sans jamais s'entraîner sur des données 3D.

2 lecture min.Lire

Vous avez fini de lire ? Prouvez-le.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.