Bibliothèque IA gratuite

IA audio GuidesLibre pour toujours.

117 des guides en anglais simple, des parcours d'apprentissage structurés et une bibliothèque ouverte — construits par une organisation à but non lucratif indépendante 501(c)(3) pour que tout le monde puisse comprendre l'IA moderne.

117Guides gratuits
1Pistes thématiques
~2 minPar guide
~4hTemps de lecture

Commencez ici

Cinq cours axés sur les résultats

Chaque cours comprend des résultats explicites, des compétences cartographiées, des activités pratiques et une synthèse appliquée.

Pistes thématiques

Parcourir par piste

Sautez dans la zone qui vous tient à cœur. Chaque piste comporte plusieurs guides en anglais simple.

Bibliothèque complète

Tous les guides

117 de 1019 guides illustrés. Filtrez par piste ou recherchez ci-dessus.

IA audio

Suno et Udio

Suno et Udio sont les deux principaux générateurs de musique IA grand public qui transforment une courte invite de texte en une chanson complète, de qualité proche du studio, avec des voix…

2 lecture min.Lire
IA audio

Génération de musique symbolique

La génération de musique symbolique crée de la musique sous forme de notation structurée – notes, hauteurs, durées et timing (souvent au format MIDI) – plutôt que sous forme audio brute.

2 lecture min.Lire
IA audio

Coefficients cepstraux Mel-Fréquence

Les coefficients cepstraux de fréquence Mel (MFCC) sont un ensemble compact de nombres qui résument la forme du spectre de fréquences d'un son tel que les oreilles humaines le perçoivent…

2 lecture min.Lire
IA audio

WaveNet

WaveNet, introduit par DeepMind en 2016, était un réseau neuronal révolutionnaire qui génère de l'audio brut un échantillon à la fois, produisant une parole étonnamment naturelle…

2 lecture min.Lire
IA audio

Tacotron2

Tacotron 2 est un système de synthèse vocale de bout en bout de Google (2017) qui transforme le texte écrit directement en un spectrogramme mel, qu'un vocodeur neuronal convertit…

2 lecture min.Lire
IA audio

Détection des deepfakes audio

La détection des deepfakes audio est l'ensemble des techniques utilisées pour déterminer si un enregistrement vocal a été prononcé par un véritable humain ou synthétisé/cloné par l'IA.

2 lecture min.Lire
IA audio

Modélisation de la prosodie

La modélisation de la prosodie enseigne aux machines la mélodie de la parole, le rythme, la hauteur, l'accent et le rythme qui accompagnent les mots.

2 lecture min.Lire
IA audio

Synthèse vocale émotionnelle

La synthèse vocale émotionnelle génère des voix qui semblent heureuses, tristes, en colère ou calmes, non seulement intelligibles mais crédibles.

2 lecture min.Lire
IA audio

Conversion vocale

La conversion vocale transforme le discours enregistré d'une personne pour donner l'impression qu'il a été prononcé par quelqu'un d'autre, tout en conservant les mots et le timing d'origine.

2 lecture min.Lire
IA audio

Diarisation des haut-parleurs

La diarisation du locuteur répond à la question « qui a parlé quand ? » en divisant un enregistrement audio en segments étiquetés par identité du locuteur.

2 lecture min.Lire
IA audio

Vérification du haut-parleur

La vérification du locuteur confirme si une voix correspond à une identité revendiquée spécifique, agissant comme un mot de passe vocal.

2 lecture min.Lire
IA audio

Détection d'activité vocale

La détection d'activité vocale (VAD) décide, à chaque instant, si un signal audio contient de la parole humaine ou simplement du silence et du bruit.

2 lecture min.Lire

Vous avez fini de lire ? Prouvez-le.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.