Libreria AI gratuita

IA audio guideLibero per sempre.

117 Guide in inglese semplice, percorsi di apprendimento strutturati e una libreria aperta, realizzati da un'organizzazione no profit 501(c)(3) indipendente in modo che chiunque possa comprendere l'intelligenza artificiale moderna.

117Guide gratuite
1Tracce di argomenti
~2 minPer guida
~4hTempo di lettura

Inizia qui

Cinque Corsi basati sui risultati

Ogni corso include risultati espliciti, competenze mappate, attività di pratica e un capstone applicato.

Tracce di argomenti

Sfoglia per traccia

Entra nell'area che ti interessa. Ogni traccia ha più guide in inglese semplice.

Libreria completa

Tutte le guide

117 di 1019 guide mostrate. Filtra per traccia o cerca sopra.

IA audio

Sottotitoli audio

I sottotitoli audio generano una frase in linguaggio naturale che descrive il contenuto di un clip audio, ad esempio "il clacson di un treno suona mentre supera un passaggio a livello".

2 minimo lettoLeggi
IA audio

Riconoscimento vocale sussurro

Whisper è il sistema di riconoscimento vocale automatico open source di OpenAI che trasforma l'audio in testo in oltre 90 lingue.

2 minimo lettoLeggi
IA audio

Wav2Vec 2.0

Wav2Vec 2.0 è il modello vocale auto-supervisionato di Meta AI che apprende potenti rappresentazioni audio da registrazioni grezze e senza etichetta.

2 minimo lettoLeggi
IA audio

HuBERT Discorso autosupervisionato

HuBERT (Hidden-Unit BERT) è il modello vocale autosupervisionato di Meta AI che apprende prevedendo unità audio in cluster per segmenti mascherati, in stile BERT.

2 minimo lettoLeggi
IA audio

Vocoder neurali

Un vocoder neurale è un modello che trasforma una rappresentazione acustica compatta, solitamente uno spettrogramma mel, in una vera forma d'onda udibile.

2 minimo lettoLeggi
IA audio

Codec audio neurali

I codec audio neurali utilizzano il deep learning per comprimere il suono in minuscoli flussi di token discreti e ricostruirlo con alta fedeltà.

2 minimo lettoLeggi
IA audio

Modelli linguistici VALL-E e Codec

VALL-E ha riformulato la sintesi vocale come un problema di modellazione del linguaggio sui token del codec audio, consentendo la clonazione della voce da soli tre secondi di un campione.

2 minimo lettoLeggi
IA audio

OpenAI Sussurra

Whisper è il sistema di riconoscimento vocale automatico open source di OpenAI che trascrive e traduce l'audio parlato in decine di lingue.

2 minimo lettoLeggi
IA audio

Trascrizione musicale automatica

La trascrizione musicale automatica (AMT) converte una registrazione audio grezza di musica in una notazione simbolica come spartiti, MIDI o un pianoforte.

2 minimo lettoLeggi
IA audio

Monitoraggio del battito e del tempo

Il monitoraggio del battito e del tempo è il compito di trovare il ritmo costante della musica: dove cade ogni battito e quanto velocemente si muove la canzone in battiti al minuto (BPM).

2 minimo lettoLeggi
IA audio

Impronta digitale audio

L'impronta digitale audio crea una firma digitale compatta e resistente al rumore di un suono in modo che possa essere riconosciuto successivamente, anche attraverso il rumore di fondo...

2 minimo lettoLeggi
IA audio

Juke-box

Jukebox è la rete neurale 2020 di OpenAI che genera audio musicale grezzo, completo di voci cantate, strumenti e persino testi nello stile di specifici...

2 minimo lettoLeggi

Hai finito di leggere? Dimostralo.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.