Bibliothèque IA gratuite

IA audio GuidesLibre pour toujours.

117 des guides en anglais simple, des parcours d'apprentissage structurés et une bibliothèque ouverte — construits par une organisation à but non lucratif indépendante 501(c)(3) pour que tout le monde puisse comprendre l'IA moderne.

117Guides gratuits
1Pistes thématiques
~2 minPar guide
~4hTemps de lecture

Commencez ici

Cinq cours axés sur les résultats

Chaque cours comprend des résultats explicites, des compétences cartographiées, des activités pratiques et une synthèse appliquée.

Pistes thématiques

Parcourir par piste

Sautez dans la zone qui vous tient à cœur. Chaque piste comporte plusieurs guides en anglais simple.

Bibliothèque complète

Tous les guides

117 de 1019 guides illustrés. Filtrez par piste ou recherchez ci-dessus.

IA audio

Compression audio EnCodec

EnCodec est le codec audio neuronal haute fidélité de Meta qui compresse la parole et la musique à des débits binaires très faibles avec une qualité rivalisant avec des formats bien plus lourds.

2 lecture min.Lire
IA audio

Quantification vectorielle résiduelle

La quantification vectorielle résiduelle (RVQ) est la technique qui transforme les intégrations audio continues en une pile compacte de codes discrets en quantifiant à plusieurs reprises…

2 lecture min.Lire
IA audio

Reconnaissance des locuteurs ECAPA-TDNN

ECAPA-TDNN est une architecture de réseau neuronal qui transforme n'importe quel clip vocal en une « empreinte vocale » compacte, permettant aux machines de savoir qui parle.

2 lecture min.Lire
IA audio

Anti-usurpation de haut-parleur et ASVspoof

L'anti-usurpation d'identité est la couche défensive qui détecte les voix fausses ou réécoutées tentant de tromper les systèmes d'authentification vocale.

2 lecture min.Lire
IA audio

Débruitage de la parole avec RNNoise

RNNoise est un petit réseau neuronal rapide qui supprime le bruit de fond de la parole en temps réel.

2 lecture min.Lire
IA audio

Intégrations audio et apprentissage de la représentation

Les intégrations audio transforment le son en vecteurs numériques compacts qui capturent le sens, afin que les machines puissent comparer, rechercher et classer l'audio comme les humains le reconnaissent…

2 lecture min.Lire
IA audio

Annulation de l'écho acoustique

L'annulation de l'écho acoustique (AEC) est la technologie qui vous empêche d'entendre votre propre voix rebondir pendant un appel.

2 lecture min.Lire
IA audio

Séparation de la parole et problème du cocktail

La séparation de la parole consiste à séparer les voix individuelles d'un enregistrement dans lequel plusieurs personnes parlent en même temps.

2 lecture min.Lire
IA audio

Formation invariante par permutation

L'entraînement invariant par permutation (PIT) est une astuce d'entraînement intelligente qui permet à un modèle de séparer plusieurs voix sans se soucier de l'emplacement de sortie de chaque voix...

2 lecture min.Lire
IA audio

Récupération d'informations musicales

La recherche d'informations musicales (MIR) est le domaine qui apprend aux ordinateurs à analyser, comprendre et rechercher de la musique à partir de signaux audio et de partitions.

2 lecture min.Lire
IA audio

Séparation des sources musicales Demucs et HT-Demucs

Découvrez comment Demucs et HT-Demucs séparent la musique en voix et tiges d'instruments à l'aide de la modélisation de formes d'onde, de spectrogrammes et de transformateurs.

2 lecture min.Lire
IA audio

Reconnaissance d'accords audio

La reconnaissance des accords audio consiste à étiqueter automatiquement les accords joués tout au long d'une chanson directement à partir de son audio.

2 lecture min.Lire

Vous avez fini de lire ? Prouvez-le.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.