Biblioteca de IA gratuita

IA de áudio guiasLivre para sempre.

117 guias em inglês simples, caminhos de aprendizagem estruturados e uma biblioteca aberta — criada por uma organização sem fins lucrativos 501(c)(3) independente para que qualquer pessoa possa entender a IA moderna.

117Guias gratuitos
1Faixas de tópico
~2 minPor guia
~4hTempo de leitura

Comece aqui

Cinco cursos baseados em resultados

Cada curso inclui resultados explícitos, competências mapeadas, atividades práticas e um objetivo final aplicado.

Faixas de tópico

Navegue por faixa

Entre na área de seu interesse. Cada faixa tem vários guias em inglês simples.

Biblioteca completa

Todos os guias

117 de 1019 guias mostrados. Filtre por faixa ou pesquise acima.

IA de áudio

Compressão de áudio EnCodec

EnCodec é o codec de áudio neural de alta fidelidade do Meta que compacta fala e música em taxas de bits muito baixas com qualidade que rivaliza com formatos muito mais pesados.

2 minutos de leituraLeia
IA de áudio

Quantização vetorial residual

A quantização vetorial residual (RVQ) é a técnica que transforma incorporações contínuas de áudio em uma pilha compacta de códigos discretos, quantizando repetidamente…

2 minutos de leituraLeia
IA de áudio

Reconhecimento de alto-falante ECAPA-TDNN

ECAPA-TDNN é uma arquitetura de rede neural que transforma qualquer clipe de fala em uma incorporação compacta de 'impressão de voz', permitindo que as máquinas saibam quem está falando.

2 minutos de leituraLeia
IA de áudio

Antifalsificação de alto-falante e ASVspoof

Anti-spoofing é a camada defensiva que detecta vozes falsas ou repetidas que tentam enganar os sistemas de autenticação de voz.

2 minutos de leituraLeia
IA de áudio

Eliminação de Ruído de Fala com RNNoise

RNNoise é uma rede neural pequena e rápida que elimina o ruído de fundo da fala em tempo real.

2 minutos de leituraLeia
IA de áudio

Incorporações de áudio e aprendizagem de representação

Os embeddings de áudio transformam o som em vetores numéricos compactos que capturam significado, para que as máquinas possam comparar, pesquisar e classificar o áudio da mesma forma que os humanos reconhecem…

2 minutos de leituraLeia
IA de áudio

Cancelamento de eco acústico

O cancelamento de eco acústico (AEC) é a tecnologia que impede que você ouça sua própria voz durante uma chamada.

2 minutos de leituraLeia
IA de áudio

Separação de fala e o problema do coquetel

A separação de fala é a tarefa de separar vozes individuais de uma gravação onde várias pessoas falam ao mesmo tempo.

2 minutos de leituraLeia
IA de áudio

Treinamento Invariante de Permutação

O treinamento invariante de permutação (PIT) é um truque de treinamento inteligente que permite que um modelo separe múltiplas vozes sem se importar em qual slot de saída cada voz pousa…

2 minutos de leituraLeia
IA de áudio

Recuperação de informações musicais

Recuperação de informações musicais (MIR) é o campo que ensina computadores a analisar, compreender e pesquisar músicas a partir de sinais de áudio e partituras.

2 minutos de leituraLeia
IA de áudio

Separação de fontes musicais Demucs e HT-Demucs

Aprenda como Demucs e HT-Demucs separam a música em vocais e hastes de instrumentos usando forma de onda, espectrograma e modelagem de transformador.

2 minutos de leituraLeia
IA de áudio

Reconhecimento de acordes de áudio

O reconhecimento de acordes de áudio é a tarefa de rotular automaticamente os acordes tocados em uma música diretamente de seu áudio.

2 minutos de leituraLeia

Terminou de ler? Prove.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.