Biblioteca de IA gratuita

IA de áudio guiasLivre para sempre.

117 guias em inglês simples, caminhos de aprendizagem estruturados e uma biblioteca aberta — criada por uma organização sem fins lucrativos 501(c)(3) independente para que qualquer pessoa possa entender a IA moderna.

117Guias gratuitos
1Faixas de tópico
~2 minPor guia
~4hTempo de leitura

Comece aqui

Cinco cursos baseados em resultados

Cada curso inclui resultados explícitos, competências mapeadas, atividades práticas e um objetivo final aplicado.

Faixas de tópico

Navegue por faixa

Entre na área de seu interesse. Cada faixa tem vários guias em inglês simples.

Biblioteca completa

Todos os guias

117 de 1019 guias mostrados. Filtre por faixa ou pesquise acima.

IA de áudio

Legendas de áudio

A legendagem de áudio gera uma frase em linguagem natural que descreve o conteúdo de um clipe de áudio, como 'uma buzina de trem toca ao passar por uma passagem de nível.

2 minutos de leituraLeia
IA de áudio

Reconhecimento de fala por sussurro

Whisper é o sistema de reconhecimento automático de fala de código aberto da OpenAI que transforma áudio em texto em mais de 90 idiomas.

2 minutos de leituraLeia
IA de áudio

Wav2Vec 2.0

Wav2Vec 2.0 é Meta o modelo de fala auto-supervisionado da IA ​​que aprende representações de áudio poderosas a partir de gravações brutas e sem rótulos.

2 minutos de leituraLeia
IA de áudio

Discurso auto-supervisionado HuBERT

HuBERT (Hidden-Unit BERT) é Meta o modelo de fala auto-supervisionado da IA que aprende prevendo unidades de áudio agrupadas para segmentos mascarados, estilo BERT.

2 minutos de leituraLeia
IA de áudio

Vocodificadores Neurais

Um vocoder neural é um modelo que transforma uma representação acústica compacta, geralmente um espectrograma mel, em uma forma de onda audível real.

2 minutos de leituraLeia
IA de áudio

Codecs de áudio neural

Os codecs de áudio neural usam aprendizado profundo para compactar o som em pequenos fluxos de tokens discretos e reconstruí-los com alta fidelidade.

2 minutos de leituraLeia
IA de áudio

Modelos de linguagem VALL-E e Codec

VALL-E reformulou a conversão de texto em fala como um problema de modelagem de linguagem em tokens de codec de áudio, permitindo a clonagem de voz a partir de apenas três segundos de uma amostra.

2 minutos de leituraLeia
IA de áudio

OpenAI Sussurro

Whisper é o sistema de reconhecimento automático de fala de código aberto da OpenAI que transcreve e traduz áudio falado em dezenas de idiomas.

2 minutos de leituraLeia
IA de áudio

Transcrição Automática de Música

A Transcrição Automática de Música (AMT) converte uma gravação de áudio bruta de música em uma notação simbólica, como partituras, MIDI ou um rolo de piano.

2 minutos de leituraLeia
IA de áudio

Acompanhamento de batida e andamento

O rastreamento de batida e andamento é a tarefa de encontrar o pulso constante na música: onde cada batida cai e quão rápido a música se move em batidas por minuto (BPM).

2 minutos de leituraLeia
IA de áudio

Impressão digital de áudio

A impressão digital de áudio cria uma assinatura digital compacta e resistente a ruídos de um som para que possa ser reconhecida mais tarde, mesmo através de ruído de fundo…

2 minutos de leituraLeia
IA de áudio

Juke-box

Jukebox é a rede neural OpenAI de 2020 que gera áudio musical bruto - completo com vozes cantadas, instrumentos e até letras no estilo específico…

2 minutos de leituraLeia

Terminou de ler? Prove.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.