Bibliothèque IA gratuite

IA visuelle GuidesLibre pour toujours.

133 des guides en anglais simple, des parcours d'apprentissage structurés et une bibliothèque ouverte — construits par une organisation à but non lucratif indépendante 501(c)(3) pour que tout le monde puisse comprendre l'IA moderne.

133Guides gratuits
1Pistes thématiques
~2 minPar guide
~4hTemps de lecture

Commencez ici

Cinq cours axés sur les résultats

Chaque cours comprend des résultats explicites, des compétences cartographiées, des activités pratiques et une synthèse appliquée.

Pistes thématiques

Parcourir par piste

Sautez dans la zone qui vous tient à cœur. Chaque piste comporte plusieurs guides en anglais simple.

Bibliothèque complète

Tous les guides

133 de 1019 guides illustrés. Filtrez par piste ou recherchez ci-dessus.

IA visuelle

Harmonisation et composition d'images

L'harmonisation de l'image ajuste automatiquement un objet collé au premier plan afin que sa couleur, son éclairage et son ton correspondent au nouvel arrière-plan, donnant ainsi un aspect réel aux composites.

2 lecture min.Lire
IA visuelle

SDXL et diffusion en cascade

SDXL est le modèle texte-image haute résolution de Stability AI qui associe un puissant générateur de base à un raffineur, tandis que des chaînes de diffusion en cascade sont multiples…

2 lecture min.Lire
IA visuelle

Génération mise à la terre GLIGEN

GLIGEN (Grounded-Language-to-Image Generation) vous permet de contrôler exactement où les objets apparaissent dans une image générée en alimentant les cadres de délimitation du modèle…

2 lecture min.Lire
IA visuelle

Adaptateur T2I pour le contrôle de diffusion multiconditionnel

Apprenez l'adaptateur T2I pour le contrôle de diffusion multiconditionnel : comment il gère la diffusion stable avec les bords, la profondeur, la pose et d'autres conditions à l'aide d'un poids léger…

2 lecture min.Lire
IA visuelle

Inversion de texte nul

L'inversion de texte nul est une technique qui vous permet de modifier une vraie photo avec un modèle de diffusion piloté par texte comme Stable Diffusion tout en conservant tout ce que vous…

2 lecture min.Lire
IA visuelle

Réglage multi-concept de diffusion personnalisé

La diffusion personnalisée est une méthode légère de réglage fin qui enseigne à un modèle texte-image de nouveaux concepts personnels, comme votre chien ou une chaise spécifique, à partir de seulement…

2 lecture min.Lire
IA visuelle

Mélange latent et interpolation d’images

La fusion latente mélange les images en combinant leurs représentations compressées dans l'espace latent d'un modèle plutôt qu'en faisant la moyenne des pixels bruts.

2 lecture min.Lire
IA visuelle

Modèles Vision-Langage-Action pour la robotique

Les modèles Vision-Langage-Action (VLA) sont de grands réseaux neuronaux qui enregistrent des images de caméra ainsi qu'une instruction écrite et émettent directement des commandes de moteur de robot.

2 lecture min.Lire
IA visuelle

Politique de diffusion du contrôle des robots

La politique de diffusion applique la même idée de débruitage derrière les générateurs d'images comme Stable Diffusion au contrôle des robots : au lieu de prédire une seule action suivante…

2 lecture min.Lire
IA visuelle

Créer une vidéo Text-to-Video

Make-A-Video est le système 2022 de Meta qui transforme une invite textuelle en un court clip vidéo sans jamais s'entraîner sur les paires texte-vidéo étiquetées.

2 lecture min.Lire
IA visuelle

Imagen Vidéo Cascades

Imagen Video est le système texte-vidéo 2022 de Google qui crée un clip à travers une cascade de sept modèles de diffusion, chacun ajoutant plus d'images ou plus de résolution.

2 lecture min.Lire
IA visuelle

CogVidéo et CogVidéoX

CogVideo (2022) a été le premier modèle texte-vidéo ouvert à grande échelle, et CogVideoX (2024) est son successeur open source bien plus performant de Tsinghua/Zhipu AI.

2 lecture min.Lire

Vous avez fini de lire ? Prouvez-le.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.