Biblioteca de IA gratuita

IA de áudio guiasLivre para sempre.

117 guias em inglês simples, caminhos de aprendizagem estruturados e uma biblioteca aberta — criada por uma organização sem fins lucrativos 501(c)(3) independente para que qualquer pessoa possa entender a IA moderna.

117Guias gratuitos
1Faixas de tópico
~2 minPor guia
~4hTempo de leitura

Comece aqui

Cinco cursos baseados em resultados

Cada curso inclui resultados explícitos, competências mapeadas, atividades práticas e um objetivo final aplicado.

Faixas de tópico

Navegue por faixa

Entre na área de seu interesse. Cada faixa tem vários guias em inglês simples.

Biblioteca completa

Todos os guias

117 de 1019 guias mostrados. Filtre por faixa ou pesquise acima.

IA de áudio

Suno e Áudio

Suno e Udio são os dois principais geradores de música de IA para consumidores que transformam um pequeno prompt de texto em uma música completa com qualidade quase de estúdio - completa com vocais…

2 minutos de leituraLeia
IA de áudio

Geração de Música Simbólica

A geração de música simbólica cria música como notação estruturada – notas, tons, durações e tempo (geralmente como MIDI) – em vez de áudio bruto.

2 minutos de leituraLeia
IA de áudio

Coeficientes Cepstrais de Mel-Frequência

Os Coeficientes Cepstrais de Mel-Frequência (MFCCs) são um conjunto compacto de números que resumem a forma do espectro de frequência de um som da maneira como os ouvidos humanos percebem…

2 minutos de leituraLeia
IA de áudio

WaveNet

WaveNet, introduzida pela DeepMind em 2016, foi uma rede neural inovadora que gera áudio bruto, uma amostra por vez, produzindo uma fala surpreendentemente natural…

2 minutos de leituraLeia
IA de áudio

Tacotron 2

Tacotron 2 é um sistema de conversão de texto em fala de ponta a ponta de Google (2017) que transforma texto escrito diretamente em um espectrograma mel, que um vocoder neural converte…

2 minutos de leituraLeia
IA de áudio

Detecção de Deepfake de Áudio

A detecção de deepfake de áudio é o conjunto de técnicas usadas para saber se uma gravação de voz foi falada por um ser humano real ou sintetizada/clonada por IA.

2 minutos de leituraLeia
IA de áudio

Modelagem de Prosódia

A modelagem da prosódia ensina às máquinas a melodia da fala, o ritmo, o tom, a ênfase e o ritmo que acompanham as palavras.

2 minutos de leituraLeia
IA de áudio

Síntese de Fala Emocional

A síntese de fala emocional gera vozes que soam felizes, tristes, zangadas ou calmas, não apenas inteligíveis, mas sentidas de forma confiável.

2 minutos de leituraLeia
IA de áudio

Conversão de voz

A conversão de voz transforma a fala gravada de uma pessoa para que pareça ter sido falada por outra pessoa, mantendo as palavras e o tempo originais.

2 minutos de leituraLeia
IA de áudio

Diarização de alto-falante

A diarização do locutor responde à pergunta "quem falou quando?" dividindo uma gravação de áudio em segmentos rotulados pela identidade do locutor.

2 minutos de leituraLeia
IA de áudio

Verificação de alto-falante

A verificação do locutor confirma se uma voz corresponde a uma identidade reivindicada específica, agindo como uma senha baseada em voz.

2 minutos de leituraLeia
IA de áudio

Detecção de atividade de voz

A Detecção de Atividade de Voz (VAD) decide, momento a momento, se um sinal de áudio contém fala humana ou apenas silêncio e ruído.

2 minutos de leituraLeia

Terminou de ler? Prove.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.

Audio AI AI Guides — Page 9 of 10 | AI Understanding