Bibliothèque IA gratuite

IA audio GuidesLibre pour toujours.

117 des guides en anglais simple, des parcours d'apprentissage structurés et une bibliothèque ouverte — construits par une organisation à but non lucratif indépendante 501(c)(3) pour que tout le monde puisse comprendre l'IA moderne.

117Guides gratuits
1Pistes thématiques
~2 minPar guide
~4hTemps de lecture

Commencez ici

Cinq cours axés sur les résultats

Chaque cours comprend des résultats explicites, des compétences cartographiées, des activités pratiques et une synthèse appliquée.

Pistes thématiques

Parcourir par piste

Sautez dans la zone qui vous tient à cœur. Chaque piste comporte plusieurs guides en anglais simple.

Bibliothèque complète

Tous les guides

117 de 1019 guides illustrés. Filtrez par piste ou recherchez ci-dessus.

IA audio

Sous-titrage audio

Le sous-titrage audio génère une phrase en langage naturel décrivant le contenu d'un clip audio, par exemple « un klaxon de train retentit lorsqu'il passe un passage à niveau ».

2 lecture min.Lire
IA audio

Reconnaissance vocale chuchotée

Whisper est le système de reconnaissance vocale automatique open source de OpenAI qui transforme l'audio en texte dans plus de 90 langues.

2 lecture min.Lire
IA audio

Wav2Vec 2.0

Wav2Vec 2.0 est le modèle vocal auto-supervisé de Meta AI qui apprend de puissantes représentations audio à partir d'enregistrements bruts et sans étiquette.

2 lecture min.Lire
IA audio

Discours auto-supervisé HuBERT

HuBERT (Hidden-Unit BERT) est le modèle vocal auto-supervisé de Meta AI qui apprend en prédisant les unités audio regroupées pour les segments masqués, à la manière de BERT.

2 lecture min.Lire
IA audio

Vocodeurs neuronaux

Un vocodeur neuronal est un modèle qui transforme une représentation acoustique compacte, généralement un spectrogramme Mel, en une véritable forme d'onde audible.

2 lecture min.Lire
IA audio

Codecs audio neuronaux

Les codecs audio neuronaux utilisent l'apprentissage profond pour compresser le son en minuscules flux de jetons discrets et le reconstruire avec une haute fidélité.

2 lecture min.Lire
IA audio

Modèles de langage VALL-E et Codec

VALL-E a recadré la synthèse vocale comme un problème de modélisation du langage sur les jetons de codec audio, permettant le clonage vocal à partir de seulement trois secondes d'un échantillon.

2 lecture min.Lire
IA audio

OpenAI Murmure

Whisper est le système de reconnaissance vocale automatique open source de OpenAI qui transcrit et traduit l'audio parlé dans des dizaines de langues.

2 lecture min.Lire
IA audio

Transcription automatique de la musique

La transcription automatique de la musique (AMT) convertit un enregistrement audio brut de musique en une notation symbolique comme une partition, du MIDI ou un rouleau de piano.

2 lecture min.Lire
IA audio

Suivi du rythme et du tempo

Le suivi des battements et du tempo consiste à trouver le pouls constant de la musique : où tombe chaque battement et à quelle vitesse la chanson se déplace en battements par minute (BPM).

2 lecture min.Lire
IA audio

Empreinte digitale audio

L'empreinte audio crée une signature numérique compacte et résistante au bruit d'un son afin qu'il puisse être reconnu plus tard, même à travers le bruit de fond…

2 lecture min.Lire
IA audio

Juke-box

Jukebox est le réseau neuronal 2020 de OpenAI qui génère de l'audio musical brut, avec des voix chantées, des instruments et même des paroles dans le style de…

2 lecture min.Lire

Vous avez fini de lire ? Prouvez-le.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.