Bibliothèque IA gratuite

IA audio GuidesLibre pour toujours.

117 des guides en anglais simple, des parcours d'apprentissage structurés et une bibliothèque ouverte — construits par une organisation à but non lucratif indépendante 501(c)(3) pour que tout le monde puisse comprendre l'IA moderne.

117Guides gratuits
1Pistes thématiques
~2 minPar guide
~4hTemps de lecture

Commencez ici

Cinq cours axés sur les résultats

Chaque cours comprend des résultats explicites, des compétences cartographiées, des activités pratiques et une synthèse appliquée.

Pistes thématiques

Parcourir par piste

Sautez dans la zone qui vous tient à cœur. Chaque piste comporte plusieurs guides en anglais simple.

Bibliothèque complète

Tous les guides

117 de 1019 guides illustrés. Filtrez par piste ou recherchez ci-dessus.

IA audio

Séparation des tiges de Spleeter

Spleeter est un outil open source de Deezer qui divise une chanson terminée en pistes distinctes (chant, batterie, basse, etc.) à l'aide du deep learning.

2 lecture min.Lire
IA audio

Estimation du pas de CREPE

CREPE est un modèle d'apprentissage en profondeur qui estime la fréquence fondamentale (hauteur) d'un signal audio monophonique directement à partir de sa forme d'onde brute.

2 lecture min.Lire
IA audio

Mesures de qualité vocale PESQ et STOI

PESQ et STOI sont des mesures objectives standard qui évaluent la qualité du traitement de la parole et sa compréhensibilité, sans avoir recours à des auditeurs humains.

2 lecture min.Lire
IA audio

Vocodage source-filtre et MONDE

Un vocodeur est un outil qui décompose la parole en ses éléments constitutifs et la reconstruit.

2 lecture min.Lire
IA audio

Évaluation du score d’opinion moyen

Le score d'opinion moyen (MOS) est une note moyenne de 1 à 5 donnée par des auditeurs humains qui mesure la qualité des sons audio synthétisés ou transmis.

2 lecture min.Lire
IA audio

Transformation Constant-Q pour l'audio

La transformation à Q constant (CQT) est une analyse de fréquence qui utilise des cases espacées de manière logarithmique et adaptées à la hauteur musicale, au lieu des cases régulièrement espacées…

2 lecture min.Lire
IA audio

Fonctionnalités de Filterbank et PLP

Les fonctionnalités Filterbank et Perceptual Linear Prediction (PLP) sont des moyens de résumer un signal vocal en nombres compacts et perceptuellement significatifs qui machine…

2 lecture min.Lire
IA audio

StyleTTS 2 Style Diffusion

StyleTTS 2 est un modèle de synthèse vocale qui traite le « style » de la voix – prosodie, émotion et timbre du locuteur – comme une variable aléatoire échantillonnée avec un modèle de diffusion…

2 lecture min.Lire
IA audio

TTS à pitch contrôlable FastPitch

FastPitch est un modèle de synthèse vocale rapide et non autorégressif qui prédit explicitement la hauteur (fréquence fondamentale) de chaque jeton d'entrée, vous permettant…

2 lecture min.Lire
IA audio

Génération vocale adaptée au flux de la boîte vocale

Voicebox est le modèle de génération vocale guidée par texte de Meta, entraîné avec un objectif de correspondance de flux pour « remplir » l'audio masqué, permettant à un modèle de faire une voix sans prise de vue…

2 lecture min.Lire
IA audio

Défi de suppression du bruit profond

Le Deep Noise Suppression (DNS) Challenge est un concours organisé par Microsoft qui pousse les chercheurs à construire des réseaux de neurones qui éliminent le bruit de fond…

2 lecture min.Lire
IA audio

Soustraction spectrale et filtrage Wiener

La soustraction spectrale et le filtrage Wiener sont les chevaux de bataille classiques de la réduction du bruit avant l'apprentissage profond.

2 lecture min.Lire

Vous avez fini de lire ? Prouvez-le.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.