Bibliothèque IA gratuite

IA visuelle GuidesLibre pour toujours.

133 des guides en anglais simple, des parcours d'apprentissage structurés et une bibliothèque ouverte — construits par une organisation à but non lucratif indépendante 501(c)(3) pour que tout le monde puisse comprendre l'IA moderne.

133Guides gratuits
1Pistes thématiques
~2 minPar guide
~4hTemps de lecture

Commencez ici

Cinq cours axés sur les résultats

Chaque cours comprend des résultats explicites, des compétences cartographiées, des activités pratiques et une synthèse appliquée.

Pistes thématiques

Parcourir par piste

Sautez dans la zone qui vous tient à cœur. Chaque piste comporte plusieurs guides en anglais simple.

Bibliothèque complète

Tous les guides

133 de 1019 guides illustrés. Filtrez par piste ou recherchez ci-dessus.

IA visuelle

Champs de rayonnement neuronal

Les champs de radiance neuronale (NeRF) reconstruisent une scène entièrement en 3D à partir d'une poignée de photos ordinaires, vous permettant ainsi de piloter l'appareil photo vers de tout nouveaux points de vue.

2 lecture min.Lire
IA visuelle

Éclaboussures gaussiennes

Gaussian Splatting représente une scène 3D sous la forme de millions de petites taches colorées et semi-transparentes qui peuvent être restituées en temps réel.

2 lecture min.Lire
IA visuelle

Encodeurs automatiques masqués

Les auto-encodeurs masqués (MAE) sont une méthode auto-supervisée qui apprend à un modèle de vision à reconstruire des images une fois que la majeure partie de l'image a été masquée.

2 lecture min.Lire
IA visuelle

Sous-titrage des images

Le sous-titrage d’images consiste à générer automatiquement une phrase en langage naturel décrivant le contenu d’une image.

2 lecture min.Lire
IA visuelle

Réponse visuelle aux questions

La réponse visuelle aux questions (VQA) permet à un système de répondre à des questions libres en langage naturel sur une image, telles que « Combien de personnes portent des chapeaux ? »

2 lecture min.Lire
IA visuelle

Détection en temps réel YOLO

YOLO (You Only Look Once) est une famille de modèles de détection d'objets qui trouvent et étiquetent chaque objet d'une image avec un seul passage sur le réseau neuronal, assez rapidement…

2 lecture min.Lire
IA visuelle

Segmentation panoptique

La segmentation panoptique donne à chaque pixel d'une image une étiquette, unifiant « quelle est cette région » avec « de quel objet spécifique s'agit-il ».

2 lecture min.Lire
IA visuelle

Estimation de la pose humaine

L'estimation de la pose humaine détecte les positions des articulations du corps, telles que les coudes, les genoux et les épaules, pour construire un squelette numérique d'une personne à partir d'images…

2 lecture min.Lire
IA visuelle

Modèles d'images FLUX

FLUX est une famille de modèles texte-image ouverts de Black Forest Labs, connus pour leurs détails nets, leur suivi d'invites efficace et leur texte rendu étonnamment précis.

2 lecture min.Lire
IA visuelle

Réseaux résiduels

Les réseaux résiduels (ResNets) sont des réseaux de neurones profonds qui ajoutent des « connexions sautées » permettant aux couches d'apprendre de petits ajustements au lieu de transformations complètes.

2 lecture min.Lire
IA visuelle

CNN régionaux

Les CNN basés sur les régions (R-CNN) sont une famille de détecteurs d'objets qui proposent d'abord des régions candidates dans une image, puis utilisent un CNN pour classer et encadrer précisément…

2 lecture min.Lire
IA visuelle

Transformateur Swin

Le Swin Transformer est un transformateur de vision qui traite les images dans des fenêtres hiérarchiques décalées, rendant l'attention suffisamment efficace pour s'étendre à…

2 lecture min.Lire

Vous avez fini de lire ? Prouvez-le.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.