Bibliothèque IA gratuite

IA visuelle GuidesLibre pour toujours.

133 des guides en anglais simple, des parcours d'apprentissage structurés et une bibliothèque ouverte — construits par une organisation à but non lucratif indépendante 501(c)(3) pour que tout le monde puisse comprendre l'IA moderne.

133Guides gratuits
1Pistes thématiques
~2 minPar guide
~4hTemps de lecture

Commencez ici

Cinq cours axés sur les résultats

Chaque cours comprend des résultats explicites, des compétences cartographiées, des activités pratiques et une synthèse appliquée.

Pistes thématiques

Parcourir par piste

Sautez dans la zone qui vous tient à cœur. Chaque piste comporte plusieurs guides en anglais simple.

Bibliothèque complète

Tous les guides

133 de 1019 guides illustrés. Filtrez par piste ou recherchez ci-dessus.

IA visuelle

Compréhension de la vidéo

La compréhension vidéo analyse les informations visuelles et parfois sonores à travers le temps.

2 lecture min.Lire
IA visuelle

Recherche multimodale

Multimodal search retrieves information across forms such as text, images, audio, and video.

2 lecture min.Lire
IA visuelle

Documenter l'IA

Document AI extracts and interprets information from files such as forms, reports, invoices, and scanned pages.

2 lecture min.Lire
IA visuelle

Wasserstein GAN

Wasserstein GAN (WGAN) est une refonte de l'objectif d'entraînement GAN qui utilise la distance de Wasserstein au lieu de la perte min-max d'origine.

2 lecture min.Lire
IA visuelle

GAN conditionnels

Les GAN conditionnels (cGAN) étendent les GAN ordinaires en fournissant des informations supplémentaires, comme une étiquette de classe ou un texte, à la fois au générateur et au discriminateur.

2 lecture min.Lire
IA visuelle

Traduction d'image à image Pix2Pix

Pix2Pix est un GAN conditionnel qui apprend à traduire un type d'image en un autre, comme transformer un croquis en photo ou une carte en vue satellite.

2 lecture min.Lire
IA visuelle

Colorisation des images

La colorisation des images utilise l’IA pour ajouter des couleurs plausibles et réalistes aux photos et films en noir et blanc.

2 lecture min.Lire
IA visuelle

Structure à partir du mouvement

Structure from Motion (SfM) reconstruit la géométrie de la scène 3D et les positions de la caméra à partir d'un ensemble de photos 2D superposées prises depuis différents points de vue.

2 lecture min.Lire
IA visuelle

Stéréo multi-vues

Multi-View Stereo (MVS) prend de nombreuses photos calibrées d'une scène et produit une reconstruction 3D dense en estimant la profondeur de presque chaque pixel.

2 lecture min.Lire
IA visuelle

Échantillonneurs DDPM et DDIM

DDPM et DDIM sont deux façons d'exécuter le processus inverse d'un modèle de diffusion, transformant étape par étape le bruit aléatoire en image.

2 lecture min.Lire
IA visuelle

Modèles génératifs basés sur les scores

Les modèles génératifs basés sur les scores créent des données en apprenant le gradient de la distribution des données – la direction qui donne à tout échantillon bruyant une apparence plus réelle…

2 lecture min.Lire
IA visuelle

Distance de départ de Fréchet

La distance de création de Fréchet (FID) est la mesure standard pour juger du réalisme et de la diversité d'un ensemble d'images générées.

2 lecture min.Lire

Vous avez fini de lire ? Prouvez-le.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.