免费人工智能库

技术的 指南永远免费。

177 简明英语指南、结构化学习路径和开放图书馆——由独立的 501(c)(3) 非营利组织构建,以便任何人都可以理解现代人工智能。

177免费指南
1主题曲目
~2 min根据指南
~6h阅读时间

从这里开始

成果导向课程

每门课程都包含明确的成果、能力规划、实践活动和应用毕业设计。

主题曲目

按曲目浏览

跳入您关心的领域。每条赛道都有多个简单的英文指南。

全库

所有指南

177 1019 显示指南。按曲目过滤或在上方搜索。

技术的

推测流和多令牌预测

推测流和多令牌预测通过一次猜测多个未来令牌并在单个......中验证它们来加速语言模型的生成。

2 最小阅读量阅读
技术的

BERTcore 和语义评估

BERTScore 通过比较含义而不是确切的单词来衡量机器生成的文本与参考的匹配程度。

2 最小阅读量阅读
技术的

线性注意力和表演者核

线性注意力用随序列长度线性缩放的数学技巧取代了 Transformers 中的二次 softmax 注意力。

2 最小阅读量阅读
技术的

YaRN 和上下文长度扩展

YaRN(另一种 RoPE 扩展)是一种有效的技术,可以将模型的可用上下文窗口扩展到远远超出其训练范围的范围。

2 最小阅读量阅读
技术的

长上下文的位置插值

位置插值 (PI) 是一种简单、有影响力的技术,它通过将新的位置索引压缩到范围内来扩展 Transformer 的上下文窗口……

2 最小阅读量阅读
技术的

LoRA 专家的混合体

LoRA 专家混合体 (MoLE) 将许多小型、训练成本低廉的适配器与学习路由器相结合,因此单个基本模型可以灵活地专业化……

2 最小阅读量阅读
技术的

代码模型的推测性编辑

推测性编辑通过预测文件的大部分内容将保持不变并仅验证不同的小部分,使 AI 代码编辑感觉即时。

2 最小阅读量阅读
技术的

激活指导和表示工程

激活控制通过在运行时直接在其隐藏激活内添加或减去向量来推动模型的行为,无需重新训练。

2 最小阅读量阅读
技术的

用于可解释性的稀疏自动编码器

稀疏自动编码器 (SAE) 是一种工具,可将神经网络错综复杂的内部激活分解为更大的清洁集合......

2 最小阅读量阅读
技术的

人工智能可解释性中的叠加和多义性

学习人工智能可解释性中的叠加和多语义:为什么模型将特征打包到共享方向,为什么神经元变得多语义......

2 最小阅读量阅读
技术的

罗吉特透镜和调谐透镜

Logit 透镜和调谐透镜是可解释性技术,可以逐层查看 Transformer 的隐藏状态,以了解模型在“思考”什么……

2 最小阅读量阅读
技术的

DeepSpeed 和 Megatron 训练堆栈

DeepSpeed (Microsoft) 和 Megatron-LM (NVIDIA) 是软件堆栈,可在数千个 GPU 上创建具有数十亿参数的训练模型……

2 最小阅读量阅读

读完了吗?证明给我看。

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.

Technical AI Guides — Page 10 of 15 | AI Understanding