Libreria AI gratuita

IA audio guideLibero per sempre.

117 Guide in inglese semplice, percorsi di apprendimento strutturati e una libreria aperta, realizzati da un'organizzazione no profit 501(c)(3) indipendente in modo che chiunque possa comprendere l'intelligenza artificiale moderna.

117Guide gratuite
1Tracce di argomenti
~2 minPer guida
~4hTempo di lettura

Inizia qui

Cinque Corsi basati sui risultati

Ogni corso include risultati espliciti, competenze mappate, attività di pratica e un capstone applicato.

Tracce di argomenti

Sfoglia per traccia

Entra nell'area che ti interessa. Ogni traccia ha più guide in inglese semplice.

Libreria completa

Tutte le guide

117 di 1019 guide mostrate. Filtra per traccia o cerca sopra.

IA audio

Sintesi vocale del canto

Singing Voice Synthesis (SVS) è un'intelligenza artificiale che trasforma una melodia e un testo scritti in un'esecuzione vocale completamente cantata.

2 minimo lettoLeggi
IA audio

AudioLM

AudioLM è un framework di ricerca Google che genera audio realistico - parlato o musica per pianoforte - trattando il suono come un linguaggio e prevedendone il token...

2 minimo lettoLeggi
IA audio

MusicGen

MusicGen è il modello AI di Meta che genera musica da una descrizione testuale e, facoltativamente, da una melodia che canticchi o carichi.

2 minimo lettoLeggi
IA audio

Individuazione delle parole chiave e parole risvegliate

L'individuazione delle parole chiave è la tecnologia in ascolto costante che consente a un dispositivo di attendere una singola frase di attivazione come "Ehi Siri" o "Alexa" prima di scattare...

2 minimo lettoLeggi
IA audio

Allineamento forzato

L'allineamento forzato allinea automaticamente una trascrizione nota con il relativo audio, contrassegnando esattamente l'inizio e la fine di ogni parola o suono.

2 minimo lettoLeggi
IA audio

Spettrogrammi di Mel

Uno spettrogramma mel è un'immagine del suono nel tempo, con frequenze spaziate nel modo in cui l'orecchio umano percepisce l'altezza.

2 minimo lettoLeggi
IA audio

Classificazione temporale connessionista

La classificazione temporale connessionista (CTC) è una funzione di perdita e un metodo di decodifica che consente alle reti neurali di trasformare una lunga sequenza audio in testo senza...

2 minimo lettoLeggi
IA audio

Modelli di trasduttori RNN

L'RNN-Transducer (RNN-T) è un'architettura di riconoscimento vocale ottimizzata per lo streaming che risolve il più grande punto debole di CTC: la sua incapacità di modellare le dipendenze...

2 minimo lettoLeggi
IA audio

Architettura conforme

Il Conformer è un blocco di rete neurale che fonde la convoluzione con l'attenzione al sé, catturando sia modelli sonori locali a grana fine che contesto a lungo raggio...

2 minimo lettoLeggi

Hai finito di leggere? Dimostralo.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.