Biblioteca de IA gratuita

IA de audio guíasGratis para siempre.

117 Guías en inglés sencillo, rutas de aprendizaje estructuradas y una biblioteca abierta, creada por una organización sin fines de lucro independiente 501(c)(3) para que cualquiera pueda comprender la IA moderna.

117Guías gratuitas
1Pistas temáticas
~2 minPor guía
~4hReading time

Empieza aquí

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Pistas temáticas

Navegar por pista

Salta al área que te interesa. Cada pista tiene varias guías en inglés sencillo.

biblioteca completa

Todas las guías

117 de 1019 guías mostradas. Filtrar por pista o buscar arriba.

IA de audio

Subtítulos de audio

Los subtítulos de audio generan una oración en lenguaje natural que describe el contenido de un clip de audio, como "la bocina de un tren suena al pasar por un paso a nivel".

2 lectura mínimaleer
IA de audio

Reconocimiento de voz susurrada

Whisper es el sistema de reconocimiento automático de voz de código abierto de OpenAI que convierte audio en texto en más de 90 idiomas.

2 lectura mínimaleer
IA de audio

Wav2Vec 2.0

Wav2Vec 2.0 es Meta el modelo de voz autosupervisado de IA que aprende poderosas representaciones de audio a partir de grabaciones sin procesar y sin etiquetar.

2 lectura mínimaleer
IA de audio

Discurso autosupervisado de HuBERT

HuBERT (BERT de unidad oculta) es Meta el modelo de voz autosupervisado de IA que aprende prediciendo unidades de audio agrupadas para segmentos enmascarados, estilo BERT.

2 lectura mínimaleer
IA de audio

Vocodificadores neuronales

Un vocodificador neuronal es un modelo que convierte una representación acústica compacta, generalmente un espectrograma de mel, en una forma de onda audible real.

2 lectura mínimaleer
IA de audio

Códecs de audio neuronales

Los códecs de audio neuronales utilizan el aprendizaje profundo para comprimir el sonido en pequeños flujos de tokens discretos y reconstruirlo con alta fidelidad.

2 lectura mínimaleer
IA de audio

Modelos de lenguaje VALL-E y Codec

VALL-E reformuló la conversión de texto a voz como un problema de modelado del lenguaje a través de tokens de códec de audio, permitiendo la clonación de voz a partir de solo tres segundos de una muestra.

2 lectura mínimaleer
IA de audio

OpenAI Susurro

Whisper es el sistema de reconocimiento automático de voz de código abierto de OpenAI que transcribe y traduce audio hablado en docenas de idiomas.

2 lectura mínimaleer
IA de audio

Transcripción automática de música

La transcripción automática de música (AMT) convierte una grabación de audio sin procesar de música en una notación simbólica como partituras, MIDI o un rollo de piano.

2 lectura mínimaleer
IA de audio

Seguimiento de ritmo y tempo

El seguimiento del ritmo y el tempo es la tarea de encontrar el pulso constante en la música: dónde cae cada tiempo y qué tan rápido se mueve la canción en tiempos por minuto (BPM).

2 lectura mínimaleer
IA de audio

Huellas dactilares de audio

La huella digital de audio crea una firma digital compacta y resistente al ruido de un sonido para que pueda ser reconocido más tarde, incluso a través del ruido de fondo...

2 lectura mínimaleer
IA de audio

máquina de discos

Jukebox es la red neuronal 2020 de OpenAI que genera audio musical sin procesar, completo con voces, instrumentos e incluso letras en el estilo de específico...

2 lectura mínimaleer

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.