Bibliothèque IA gratuite

IA visuelle GuidesLibre pour toujours.

133 des guides en anglais simple, des parcours d'apprentissage structurés et une bibliothèque ouverte — construits par une organisation à but non lucratif indépendante 501(c)(3) pour que tout le monde puisse comprendre l'IA moderne.

133Guides gratuits
1Pistes thématiques
~2 minPar guide
~4hTemps de lecture

Commencez ici

Cinq cours axés sur les résultats

Chaque cours comprend des résultats explicites, des compétences cartographiées, des activités pratiques et une synthèse appliquée.

Pistes thématiques

Parcourir par piste

Sautez dans la zone qui vous tient à cœur. Chaque piste comporte plusieurs guides en anglais simple.

Bibliothèque complète

Tous les guides

133 de 1019 guides illustrés. Filtrez par piste ou recherchez ci-dessus.

IA visuelle

Reconnaissance optique de caractères

La reconnaissance optique de caractères (OCR) transforme les images de texte (documents numérisés, photos de panneaux, PDF) en texte lisible et modifiable par machine.

2 lecture min.Lire
IA visuelle

Flux optique

Le flux optique estime la façon dont chaque pixel se déplace entre des images vidéo consécutives, produisant une carte dense de vecteurs de mouvement.

2 lecture min.Lire
IA visuelle

Estimation de la profondeur monoculaire

L’estimation de la profondeur monoculaire prédit à quelle distance se trouve chaque pixel d’une seule photo ordinaire – aucune caméra stéréo, lidar ou capteur de profondeur n’est requis.

2 lecture min.Lire
IA visuelle

Modèles de diffusion latente

Les modèles de diffusion latente génèrent des images en exécutant le processus de diffusion dans un espace latent compressé au lieu de pixels bruts, réduisant ainsi les coûts de calcul.

2 lecture min.Lire
IA visuelle

ContrôleNet

ControlNet est un module complémentaire qui offre aux modèles de génération d'images un contrôle structurel précis, vous permettant d'orienter la sortie avec des bords, des poses, des cartes de profondeur ou des gribouillages.

2 lecture min.Lire
IA visuelle

Guide sans classificateur

Le guidage sans classificateur est la technique qui permet aux modèles de diffusion de suivre réellement votre invite, en échangeant une certaine diversité contre une adhésion beaucoup plus forte.

2 lecture min.Lire
IA visuelle

SLAM visuel

Visual SLAM permet à une caméra en mouvement de créer une carte d'un espace inconnu tout en suivant simultanément sa propre position à l'intérieur de cette carte.

2 lecture min.Lire
IA visuelle

Sora et synthèse texte-vidéo

Sora est le modèle texte-vidéo de OpenAI qui transforme une invite écrite en un court clip vidéo haute résolution.

2 lecture min.Lire
IA visuelle

Modèles de diffusion vidéo

Les modèles de diffusion vidéo génèrent des images animées en transformant progressivement le bruit aléatoire en images cohérentes, étendant ainsi l'idée de diffusion des images au temps.

2 lecture min.Lire
IA visuelle

Génération de texte en 3D

La génération texte en 3D transforme une invite écrite comme « un fauteuil en cuir vintage » en un modèle 3D complet que vous pouvez faire pivoter, éclairer et insérer dans un jeu ou une scène.

2 lecture min.Lire
IA visuelle

Rendu différenciable

Le rendu différenciable rend le processus de transformation d'une scène 3D en une image 2D entièrement différentiable, vous pouvez donc calculer les dégradés à partir des pixels rendus…

2 lecture min.Lire
IA visuelle

Architecture U-Net

U-Net est un réseau neuronal convolutif en forme de « U » qui excelle dans la production de sorties au pixel près, initialement destinées à la segmentation d'images biomédicales.

2 lecture min.Lire

Vous avez fini de lire ? Prouvez-le.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.