人工智能基金会
了解什么是人工智能,系统如何学习,哪些地方失误,以及如何在不夸大的情况下判断主张。
免费人工智能库
117 简明英语指南、结构化学习路径和开放图书馆——由独立的 501(c)(3) 非营利组织构建,以便任何人都可以理解现代人工智能。
从这里开始
每门课程都包含明确的成果、能力规划、实践活动和应用毕业设计。
了解什么是人工智能,系统如何学习,哪些地方失误,以及如何在不夸大的情况下判断主张。
在保护隐私、核查输出和保持人类问责的同时,高效使用人工智能。
评估工作场所用例,运行安全试点,衡量价值,负责任地沟通变更。
通过权利、公平、治理、安全和公共利益结果分析人工智能系统。
通过实用的系统设计,理解语言模型、检索、代理、评估、成本和部署保障。
主题曲目
跳入您关心的领域。每条赛道都有多个简单的英文指南。
全库
117 的 1019 显示指南。按曲目过滤或在上方搜索。
波束成形使用多个麦克风在选定的方向上监听,放大来自目标的声音,同时抑制其他声音。
音频人工智能Riffusion 是一种巧妙的技巧,通过将声音视为图片来生成音乐:它微调稳定扩散图像模型来绘制频谱图,然后……
音频人工智能了解 Google MusicLM 如何使用分层语义和声学标记、SoundStream 和 MuLan 将文本提示转换为连贯的音乐。
音频人工智能Noise2Noise 是一种训练技巧,通过从成对的不同噪声中学习,模型可以在没有看到干净参考的情况下学习消除噪声......
音频人工智能Conv-TasNet 是一种神经网络,它通过直接处理原始声音波形来分离混合音频(就像两个人同时说话)......
音频人工智能双路径 RNN (DPRNN) 是一种音频分离架构,它将很长的音频特征序列分割成短的重叠块并处理它们......
音频人工智能Open-Unmix (UMX) 是一种开源深度学习系统,它将歌曲分成几个部分:人声、鼓、贝斯和其他乐器。
音频人工智能Whisper 单词对齐将每个转录单词固定到音频中的准确开始和结束时间。
音频人工智能音乐标签使用 Transformer 模型来聆听歌曲并预测描述性标签,例如流派、情绪、乐器和节奏。
音频人工智能起始点检测可找到音频信号中音符、节拍或声音开始的精确时刻。
音频人工智能MelGAN 是一种基于 GAN 的全卷积声码器,可在单次快速前向传递中将梅尔声谱图转换为原始音频波形。
音频人工智能UnivNet 是一种 GAN 声码器,它使用在不同 STFT 分辨率下计算的多个频谱图来判断生成的音频,从而锐化高频细节。