人工智能基金会
了解什么是人工智能,系统如何学习,哪些地方失误,以及如何在不夸大的情况下判断主张。
免费人工智能库
117 简明英语指南、结构化学习路径和开放图书馆——由独立的 501(c)(3) 非营利组织构建,以便任何人都可以理解现代人工智能。
从这里开始
每门课程都包含明确的成果、能力规划、实践活动和应用毕业设计。
了解什么是人工智能,系统如何学习,哪些地方失误,以及如何在不夸大的情况下判断主张。
在保护隐私、核查输出和保持人类问责的同时,高效使用人工智能。
评估工作场所用例,运行安全试点,衡量价值,负责任地沟通变更。
通过权利、公平、治理、安全和公共利益结果分析人工智能系统。
通过实用的系统设计,理解语言模型、检索、代理、评估、成本和部署保障。
主题曲目
跳入您关心的领域。每条赛道都有多个简单的英文指南。
全库
117 的 1019 显示指南。按曲目过滤或在上方搜索。
歌声合成(SVS)是一种人工智能,可将书面旋律和歌词转化为完整的演唱声乐表演。
音频人工智能AudioLM 是一个 Google 研究框架,通过将声音视为语言并预测它的标记来生成逼真的音频(语音或钢琴音乐)......
音频人工智能MusicGen 是 Meta 的 AI 模型,它根据文本描述生成音乐,还可以选择您哼唱或上传的旋律。
音频人工智能关键字识别是一种始终监听的技术,让设备在弹出之前等待单个触发短语,例如“Hey Siri”或“Alexa”……
音频人工智能强制对齐会自动将已知的文字记录与其音频对齐,准确标记每个单词或声音的开始和结束时间。
音频人工智能梅尔声谱图是声音随时间变化的图像,其频率间隔与人耳感知音调的方式相同。
音频人工智能连接主义时间分类 (CTC) 是一种损失函数和解码方法,可让神经网络将长音频序列转换为文本,而无需……
音频人工智能RNN-Transducer (RNN-T) 是一种流友好的语音识别架构,它修复了 CTC 的最大弱点——无法对依赖关系进行建模……
音频人工智能Conformer 是一个神经网络模块,它将卷积与自注意力融合在一起,捕获细粒度的局部声音模式和远程上下文……