Biblioteca de IA gratuita

IA de audio guíasGratis para siempre.

117 Guías en inglés sencillo, rutas de aprendizaje estructuradas y una biblioteca abierta, creada por una organización sin fines de lucro independiente 501(c)(3) para que cualquiera pueda comprender la IA moderna.

117Guías gratuitas
1Pistas temáticas
~2 minPor guía
~4hReading time

Empieza aquí

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Pistas temáticas

Navegar por pista

Salta al área que te interesa. Cada pista tiene varias guías en inglés sencillo.

biblioteca completa

Todas las guías

117 de 1019 guías mostradas. Filtrar por pista o buscar arriba.

IA de audio

Compresión de audio EnCodec

EnCodec es el códec de audio neuronal de alta fidelidad de Meta que comprime voz y música a tasas de bits muy bajas con una calidad que rivaliza con formatos mucho más pesados.

2 lectura mínimaleer
IA de audio

Cuantización del vector residual

La cuantización de vector residual (RVQ) es la técnica que convierte incrustaciones de audio continuas en una pila compacta de códigos discretos cuantizando repetidamente...

2 lectura mínimaleer
IA de audio

Reconocimiento de Oradores ECAPA-TDNN

ECAPA-TDNN es una arquitectura de red neuronal que convierte cualquier clip de voz en una "huella de voz" compacta, lo que permite a las máquinas saber quién está hablando.

2 lectura mínimaleer
IA de audio

Anti-Spoofing de oradores y ASVspoof

La lucha contra la suplantación de identidad es la capa defensiva que detecta voces falsas o repetidas que intentan engañar a los sistemas de autenticación de voz.

2 lectura mínimaleer
IA de audio

Eliminación de ruido del habla con RNNoise

RNNoise es una red neuronal pequeña y rápida que elimina el ruido de fondo del habla en tiempo real.

2 lectura mínimaleer
IA de audio

Incorporaciones de audio y aprendizaje de representación

Las incrustaciones de audio convierten el sonido en vectores numéricos compactos que capturan el significado, para que las máquinas puedan comparar, buscar y clasificar el audio de la forma en que los humanos reconocen...

2 lectura mínimaleer
IA de audio

Cancelación de eco acústico

La cancelación de eco acústico (AEC) es la tecnología que le impide escuchar su propia voz rebotar durante una llamada.

2 lectura mínimaleer
IA de audio

La separación de discursos y el problema del cóctel

La separación del habla es la tarea de separar voces individuales de una grabación en la que varias personas hablan a la vez.

2 lectura mínimaleer
IA de audio

Entrenamiento invariante de permutación

El entrenamiento invariante de permutación (PIT) es un truco de entrenamiento inteligente que permite a un modelo separar múltiples voces sin importar en qué ranura de salida aterriza cada voz...

2 lectura mínimaleer
IA de audio

Recuperación de información musical

La recuperación de información musical (MIR) es el campo que enseña a las computadoras a analizar, comprender y buscar música a partir de señales de audio y partituras.

2 lectura mínimaleer
IA de audio

Separación de fuentes de música Demucs y HT-Demucs

Descubra cómo Demucs y HT-Demucs separan la música en voces y raíces de instrumentos mediante modelado de formas de onda, espectrograma y transformadores.

2 lectura mínimaleer
IA de audio

Reconocimiento de acordes de audio

El reconocimiento de acordes de audio es la tarea de etiquetar automáticamente los acordes reproducidos a lo largo de una canción directamente desde su audio.

2 lectura mínimaleer

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.