免费人工智能库

语言人工智能 指南永远免费。

155 简明英语指南、结构化学习路径和开放图书馆——由独立的 501(c)(3) 非营利组织构建,以便任何人都可以理解现代人工智能。

155免费指南
1主题曲目
~2 min根据指南
~5h阅读时间

从这里开始

成果导向课程

每门课程都包含明确的成果、能力规划、实践活动和应用毕业设计。

主题曲目

按曲目浏览

跳入您关心的领域。每条赛道都有多个简单的英文指南。

全库

所有指南

155 1019 显示指南。按曲目过滤或在上方搜索。

语言人工智能

直接偏好优化

直接偏好优化(DPO)是一种使语言模型与人类偏好保持一致的方法,无需训练单独的奖励模型或运行......

2 最小阅读量阅读
语言人工智能

奖励模型

奖励模型是一种经过训练的神经网络,可以预测人工智能的反应有多好,充当人类判断的自动替代品。

2 最小阅读量阅读
语言人工智能

近端策略优化

近端策略优化 (PPO) 是与根据人类反馈微调语言模型最相关的强化学习算法。

2 最小阅读量阅读
语言人工智能

波束搜索

集束搜索是一种解码策略,它在每一步中保留几个最有希望的部分序列,而不是贪婪地致力于一个。

2 最小阅读量阅读
语言人工智能

Nucleus 和 Top-k 采样

Nucleus (top-p) 和 top-k 采样是通过限制可以选择的标记来为文本生成添加受控随机性的解码方法。

2 最小阅读量阅读
语言人工智能

掩码语言建模

蒙面语言模型教导人工智能使用完整的周围上下文(左右)来填充故意隐藏的单词。

2 最小阅读量阅读
语言人工智能

下一个令牌预测

下一个标记预测是 GPT 风格模型背后看似简单的目标:给定到目前为止的所有内容,猜测下一个文本块。

2 最小阅读量阅读
语言人工智能

序列到序列模型

序列到序列模型将一个序列映射到另一个可能不同长度的序列,例如翻译句子或总结文档。

2 最小阅读量阅读
语言人工智能

编码器-解码器架构

编码器-解码器架构将模型分为两半:一半读取输入并将其压缩为丰富的内部表示,另一半......

2 最小阅读量阅读
语言人工智能

交叉注意力

交叉注意力是一种让一个序列查看另一个序列的机制:生成文本的解码器可以关注编码器的输入表示。

2 最小阅读量阅读
语言人工智能

灾难性遗忘

灾难性遗忘是指神经网络学习一项新任务并突然失去执行已经掌握的任务的能力。

2 最小阅读量阅读

读完了吗?证明给我看。

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.

Language AI AI Guides — Page 13 of 13 | AI Understanding