免费人工智能库

学习人工智能。永远免费。

1019 简明英语指南、结构化学习路径和开放图书馆——由独立的 501(c)(3) 非营利组织构建,以便任何人都可以理解现代人工智能。

1019免费指南
9主题曲目
~2 min根据指南
~34h阅读时间

从这里开始

成果导向课程

每门课程都包含明确的成果、能力规划、实践活动和应用毕业设计。

主题曲目

按曲目浏览

跳入您关心的领域。每条赛道都有多个简单的英文指南。

全库

所有指南

1019 1019 显示指南。按曲目过滤或在上方搜索。

公司

Salesforce爱因斯坦

Salesforce Einstein 是 Salesforce 客户关系管理 (CRM) 平台中内置的 AI 层,添加预测、建议……

2 最小阅读量阅读
技术的

FP8 和低精度格式

FP8 是一种 8 位浮点数格式,允许 AI 模型使用标准 32 位数字四分之一的内存来存储权重并运行数学。

2 最小阅读量阅读
技术的

PagedAttention 和 vLLM

PagedAttention 是一种内存管理技术,它将语言模型的注意力缓存存储在可重用的小块中,而不是一个大的连续块中。

2 最小阅读量阅读
技术的

连续配料

连续批处理是一种服务技术,可以从正在运行的批处理中逐个令牌添加和删除请求,而不是等待整个固定批处理……

2 最小阅读量阅读
音频人工智能

神经声码器

神经声码器是一种将紧凑的声学表示(通常是梅尔频谱图)转换为实际可听波形的模型。

2 最小阅读量阅读
音频人工智能

神经音频编解码器

神经音频编解码器使用深度学习将声音压缩为离散标记的微小流,并以高保真度重建它。

2 最小阅读量阅读
音频人工智能

VALL-E 和编解码器语言模型

VALL-E 将文本到语音重新定义为音频编解码器令牌上的语言建模问题,从而可以从仅三秒的样本中克隆语音。

2 最小阅读量阅读
语言人工智能

闪光注意

FlashAttention 是一种节省内存的算法,它计算与标准 Transformer 完全相同的注意力,但无需编写巨大的注意力......

2 最小阅读量阅读
语言人工智能

分组查询注意力

分组查询注意力(GQA)是一种通过让多个查询头共享相同的键和值头来缩小文本生成过程中所需内存的方法。

2 最小阅读量阅读
语言人工智能

旋转位置嵌入

旋转位置嵌入 (RoPE) 通过将查询向量和键向量旋转与位置成比例的角度,对每个标记在序列中的位置进行编码。

2 最小阅读量阅读
公司

休谟人工智能

Hume AI 是一家研究实验室和初创公司,致力于打造“情商”语音人工智能,能够读取人类语音的语气、节奏和韵律,而不仅仅是……

2 最小阅读量阅读
公司

OpenAI Sora

Sora 是 OpenAI 的文本到视频模型,可根据书面提示生成逼真的、长达一分钟的视频剪辑。

2 最小阅读量阅读

读完了吗?证明给我看。

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.