Libreria AI gratuita

IA audio guideLibero per sempre.

117 Guide in inglese semplice, percorsi di apprendimento strutturati e una libreria aperta, realizzati da un'organizzazione no profit 501(c)(3) indipendente in modo che chiunque possa comprendere l'intelligenza artificiale moderna.

117Guide gratuite
1Tracce di argomenti
~2 minPer guida
~4hTempo di lettura

Inizia qui

Cinque Corsi basati sui risultati

Ogni corso include risultati espliciti, competenze mappate, attività di pratica e un capstone applicato.

Tracce di argomenti

Sfoglia per traccia

Entra nell'area che ti interessa. Ogni traccia ha più guide in inglese semplice.

Libreria completa

Tutte le guide

117 di 1019 guide mostrate. Filtra per traccia o cerca sopra.

IA audio

Suno e Udio

Suno e Udio sono i due principali generatori di musica AI consumer che trasformano un breve messaggio di testo in un brano completo, quasi di qualità da studio, completo di voce...

2 minimo lettoLeggi
IA audio

Generazione di musica simbolica

La generazione di musica simbolica crea musica come notazione strutturata - note, altezze, durate e tempi (spesso come MIDI) - piuttosto che come audio grezzo.

2 minimo lettoLeggi
IA audio

Coefficienti cepstral della frequenza Mel

I coefficienti cefalici di frequenza Mel (MFCC) sono un insieme compatto di numeri che riassumono la forma dello spettro di frequenze di un suono nel modo in cui l'orecchio umano percepisce...

2 minimo lettoLeggi
IA audio

WaveNet

WaveNet, introdotta da DeepMind nel 2016, è stata una rete neurale innovativa che genera audio grezzo un campione alla volta, producendo un parlato sorprendentemente naturale...

2 minimo lettoLeggi
IA audio

Tacotron 2

Tacotron 2 è un sistema di sintesi vocale end-to-end di Google (2017) che trasforma il testo scritto direttamente in uno spettrogramma mel, che un vocoder neurale converte...

2 minimo lettoLeggi
IA audio

Rilevamento deepfake audio

Il rilevamento dei deepfake audio è l'insieme di tecniche utilizzate per stabilire se una registrazione vocale è stata pronunciata da un essere umano reale o sintetizzata/clonata dall'intelligenza artificiale.

2 minimo lettoLeggi
IA audio

Modellazione della prosodia

La modellazione della prosodia insegna alle macchine la melodia del discorso, il ritmo, l'intonazione, l'accento e il ritmo che si sovrappongono alle parole.

2 minimo lettoLeggi
IA audio

Sintesi del discorso emotivo

La sintesi vocale emotiva genera voci che suonano felici, tristi, arrabbiate o calme, non solo intelligibili ma sentite in modo credibile.

2 minimo lettoLeggi
IA audio

Conversione vocale

La conversione vocale trasforma il discorso registrato di una persona in modo che sembri come se fosse stato pronunciato da qualcun altro, mantenendo le parole e i tempi originali.

2 minimo lettoLeggi
IA audio

Diarizzazione degli oratori

La diarizzazione del relatore risponde alla domanda "chi ha parlato quando?" suddividendo una registrazione audio in segmenti etichettati in base all'identità del parlante.

2 minimo lettoLeggi
IA audio

Verifica dell'oratore

La verifica dell'oratore conferma se una voce corrisponde a una specifica identità rivendicata, agendo come una password vocale.

2 minimo lettoLeggi
IA audio

Rilevamento dell'attività vocale

Il Voice Activity Detection (VAD) decide, momento per momento, se un segnale audio contiene parlato umano o solo silenzio e rumore.

2 minimo lettoLeggi

Hai finito di leggere? Dimostralo.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.