Fondements de l'IA
Comprenez ce qu'est l'IA, comment les systèmes apprennent, où ils échouent et comment juger les réclamations sans battage médiatique.
Bibliothèque IA gratuite
117 des guides en anglais simple, des parcours d'apprentissage structurés et une bibliothèque ouverte — construits par une organisation à but non lucratif indépendante 501(c)(3) pour que tout le monde puisse comprendre l'IA moderne.
Commencez ici
Chaque cours comprend des résultats explicites, des compétences cartographiées, des activités pratiques et une synthèse appliquée.
Comprenez ce qu'est l'IA, comment les systèmes apprennent, où ils échouent et comment juger les réclamations sans battage médiatique.
Utilisez l’IA de manière productive tout en protégeant la confidentialité, en vérifiant les résultats et en préservant la responsabilité humaine.
Évaluez les cas d'utilisation sur le lieu de travail, exécutez des projets pilotes sûrs, mesurez la valeur et communiquez les changements de manière responsable.
Analysez les systèmes d’IA en termes de droits, d’équité, de gouvernance, de sécurité et d’intérêt public.
Comprenez les modèles de langage, la récupération, les agents, l'évaluation, les coûts et les garanties de déploiement grâce à une conception de système pratique.
Pistes thématiques
Sautez dans la zone qui vous tient à cœur. Chaque piste comporte plusieurs guides en anglais simple.
Bibliothèque complète
117 de 1019 guides illustrés. Filtrez par piste ou recherchez ci-dessus.
Mimi est un codec audio neuronal qui compresse la parole en un minuscule flux de jetons discrets en temps réel, afin que les modèles d'IA puissent écouter et parler avec un débit très faible…
IA audioListen, Attend and Spell (LAS) est un réseau neuronal phare de 2015 qui transcrit la parole directement en caractères, sans prononciation manuelle…
IA audioSpecAugment est une méthode d'augmentation de données simple mais puissante qui masque et déforme le spectrogramme de la parole pour rendre les modèles de reconnaissance plus robustes.
IA audioLe marquage automatique de la musique utilise l'apprentissage automatique pour écouter une chanson et attacher automatiquement des étiquettes descriptives telles que le genre, l'ambiance, les instruments et le tempo.
IA audioLe transfert de timbre remodèle la « couleur sonore » de l'audio afin qu'un instrument sonne comme un autre, transformant une mélodie fredonnée en une ligne de violon ou de trompette…
IA audioLa classification de scènes acoustiques (ASC) entraîne les machines à reconnaître l’environnement dans lequel un enregistrement a été réalisé, une rue animée, un parc calme, un train, un café…
IA audioNVIDIA Riva est un SDK accéléré par GPU pour l'IA vocale de production (ASR, TTS et traduction), tandis que NeMo est la boîte à outils open source pour la formation et le réglage fin…
IA audioDeepSpeech est un modèle de reconnaissance vocale de bout en bout introduit par Baidu en 2014 qui mappe les fonctionnalités audio brutes directement au texte à l'aide d'un neurone récurrent…
IA audioLes vecteurs X sont des empreintes numériques de longueur fixe de la voix d'un locuteur produites par un réseau neuronal, utilisées pour savoir qui parle, indépendamment de ce qu'il dit.
IA audioGlow-TTS est un modèle de synthèse vocale qui apprend à aligner le texte sur la parole tout seul à l'aide d'une astuce de recherche intelligente, éliminant ainsi le besoin d'un aligneur séparé.
IA audioParallel WaveGAN est un vocodeur neuronal rapide qui transforme un spectrogramme Mel en une forme d'onde audio brute à l'aide d'un petit GAN, générant tous les échantillons à la fois.
IA audioWaveGlow est un vocodeur neuronal basé sur le flux de NVIDIA qui synthétise les formes d'onde vocales à partir de spectrogrammes Mel en un seul passage sans autorégression.
Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.