免费人工智能库

音频人工智能 指南永远免费。

117 简明英语指南、结构化学习路径和开放图书馆——由独立的 501(c)(3) 非营利组织构建,以便任何人都可以理解现代人工智能。

117免费指南
1主题曲目
~2 min根据指南
~4h阅读时间

从这里开始

成果导向课程

每门课程都包含明确的成果、能力规划、实践活动和应用毕业设计。

主题曲目

按曲目浏览

跳入您关心的领域。每条赛道都有多个简单的英文指南。

全库

所有指南

117 1019 显示指南。按曲目过滤或在上方搜索。

音频人工智能

编码解码器音频压缩

EnCodec 是 Meta 的高保真神经音频编解码器,它以极低的比特率压缩语音和音乐,其质量可与更重的格式相媲美。

2 最小阅读量阅读
音频人工智能

残差矢量量化

残差矢量量化 (RVQ) 是一种通过重复量化将连续音频嵌入转换为紧凑的离散代码堆栈的技术……

2 最小阅读量阅读
音频人工智能

ECAPA-TDNN说话人识别

ECAPA-TDNN 是一种神经网络架构,可将任何语音片段转换为紧凑的“声纹”嵌入,使机器能够辨别谁在说话。

2 最小阅读量阅读
音频人工智能

扬声器反欺骗和 ASVspoof

反欺骗是检测试图欺骗语音认证系统的虚假或重播声音的防御层。

2 最小阅读量阅读
音频人工智能

使用 RNNoise 进行语音去噪

RNNoise 是一种微小、快速的神经网络,可以实时去除语音中的背景噪声。

2 最小阅读量阅读
音频人工智能

音频嵌入和表示学习

音频嵌入将声音转换为捕获含义的紧凑数字向量,因此机器可以按照人类识别的方式对音频进行比较、搜索和分类……

2 最小阅读量阅读
音频人工智能

声学回声消除

回声消除 (AEC) 是一项可阻止您在通话过程中听到自己的声音反弹的技术。

2 最小阅读量阅读
音频人工智能

语音分离和鸡尾酒会问题

语音分离是将个人声音从几个人同时说话的录音中分离出来的任务。

2 最小阅读量阅读
音频人工智能

排列不变训练

排列不变训练(PIT)是一种聪明的训练技巧,它可以让模型分离多个语音,而无需关心每个语音落在哪个输出槽......

2 最小阅读量阅读
音频人工智能

音乐信息检索

音乐信息检索 (MIR) 是教计算机从音频信号和乐谱中分析、理解和搜索音乐的领域。

2 最小阅读量阅读
音频人工智能

Democs 和 HT-Demucs 音乐源分离

了解 Demucs 和 HT-Demucs 如何使用波形、频谱图和变压器建模将音乐分离为人声和乐器主干。

2 最小阅读量阅读
音频人工智能

音频和弦识别

音频和弦识别是直接从音频自动标记歌曲中演奏的和弦的任务。

2 最小阅读量阅读

读完了吗?证明给我看。

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.

Audio AI AI Guides — Page 3 of 10 | AI Understanding