Libreria AI gratuita

IA audio guideLibero per sempre.

117 Guide in inglese semplice, percorsi di apprendimento strutturati e una libreria aperta, realizzati da un'organizzazione no profit 501(c)(3) indipendente in modo che chiunque possa comprendere l'intelligenza artificiale moderna.

117Guide gratuite
1Tracce di argomenti
~2 minPer guida
~4hTempo di lettura

Inizia qui

Cinque Corsi basati sui risultati

Ogni corso include risultati espliciti, competenze mappate, attività di pratica e un capstone applicato.

Tracce di argomenti

Sfoglia per traccia

Entra nell'area che ti interessa. Ogni traccia ha più guide in inglese semplice.

Libreria completa

Tutte le guide

117 di 1019 guide mostrate. Filtra per traccia o cerca sopra.

IA audio

Separazione dello stelo spleeter

Spleeter è uno strumento open source di Deezer che divide una canzone finita in tracce separate (voce, batteria, basso e altro) utilizzando il deep learning.

2 minimo lettoLeggi
IA audio

Stima del passo CREPE

CREPE è un modello di deep learning che stima la frequenza fondamentale (altezza) di un segnale audio monofonico direttamente dalla sua forma d'onda grezza.

2 minimo lettoLeggi
IA audio

Metriche della qualità del parlato PESQ e STOI

PESQ e STOI sono parametri oggettivi standard che valutano quanto bene il parlato elaborato suoni e quanto sia comprensibile, senza bisogno di ascoltatori umani.

2 minimo lettoLeggi
IA audio

Vocodifica e WORLD del filtro sorgente

Un vocoder è uno strumento che scompone il discorso nei suoi elementi costitutivi e lo ricostruisce.

2 minimo lettoLeggi
IA audio

Valutazione del punteggio medio di opinione

Il Mean Opinion Score (MOS) è una valutazione media da 1 a 5 da parte di ascoltatori umani che misura la qualità dei suoni audio sintetizzati o trasmessi.

2 minimo lettoLeggi
IA audio

Trasformazione a Q costante per l'audio

La trasformazione a Q costante (CQT) è un'analisi di frequenza che utilizza contenitori distanziati logaritmicamente abbinati all'altezza musicale, invece dei contenitori equidistanti...

2 minimo lettoLeggi
IA audio

Funzionalità Filterbank e PLP

Le funzionalità Filterbank e Perceptual Linear Prediction (PLP) sono modi per riassumere un segnale vocale in numeri compatti e percettivamente significativi che la macchina...

2 minimo lettoLeggi
IA audio

StyleTTS 2 Diffusione di stili

StyleTTS 2 è un modello di sintesi vocale che tratta lo "stile" della voce (prosodia, emozione e timbro dell'oratore) come una variabile casuale campionata con un modello di diffusione...

2 minimo lettoLeggi
IA audio

TTS con controllo dell'intonazione FastPitch

FastPitch è un modello di sintesi vocale veloce e non autoregressivo che prevede esplicitamente il tono (frequenza fondamentale) di ogni token di input, consentendoti...

2 minimo lettoLeggi
IA audio

Generazione vocale con abbinamento del flusso di Voicebox

Voicebox è il modello di generazione vocale guidata da testo di Meta addestrato con un obiettivo di corrispondenza del flusso per "riempire" l'audio mascherato, consentendo a un modello di eseguire la voce zero-shot...

2 minimo lettoLeggi
IA audio

Sfida di soppressione del rumore profondo

La sfida Deep Noise Suppression (DNS) è una competizione Microsoft che spinge i ricercatori a costruire reti neurali in grado di eliminare il rumore di fondo...

2 minimo lettoLeggi
IA audio

Sottrazione spettrale e filtraggio di Wiener

La sottrazione spettrale e il filtraggio di Wiener sono i classici cavalli di battaglia della riduzione del rumore pre-apprendimento profondo.

2 minimo lettoLeggi

Hai finito di leggere? Dimostralo.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.