免费人工智能库

学习人工智能。永远免费。

1019 简明英语指南、结构化学习路径和开放图书馆——由独立的 501(c)(3) 非营利组织构建,以便任何人都可以理解现代人工智能。

1019免费指南
9主题曲目
~2 min根据指南
~34h阅读时间

从这里开始

成果导向课程

每门课程都包含明确的成果、能力规划、实践活动和应用毕业设计。

主题曲目

按曲目浏览

跳入您关心的领域。每条赛道都有多个简单的英文指南。

全库

所有指南

1019 1019 显示指南。按曲目过滤或在上方搜索。

视觉人工智能

DreamFusion 和分数蒸馏采样

DreamFusion 使用 2D 图像扩散模型作为批评者,从文本生成 3D 对象,从不训练任何 3D 数据。

2 最小阅读量阅读
视觉人工智能

Magic3D 文本到 3D 管道

Magic3D 是 NVIDIA 针对 DreamFusion 的两阶段解决方案,可更快地生成更高分辨率、更详细的 3D 内容。

2 最小阅读量阅读
语言人工智能

无分词器的字节级模型

无分词器的模型放弃了单词片段的固定词汇,直接对原始字节进行操作,让一个模型可以处理任何语言、代码,甚至是嘈杂的......

2 最小阅读量阅读
语言人工智能

函数向量和任务表示

函数向量是语言模型隐藏状态内的紧凑方向,用于编码整个任务,例如“翻译成法语”或“返回反义词”。

2 最小阅读量阅读
语言人工智能

N 次最佳采样和重新排序

Best-of-N 采样从模型中生成多个候选答案,然后使用单独的评分步骤选择最佳答案。

2 最小阅读量阅读
音频人工智能

StyleTTS 2 风格扩散

StyleTTS 2 是一种文本转语音模型,它将语音“风格”(韵律、情感和说话者音色)视为使用扩散模型采样的随机变量……

2 最小阅读量阅读
音频人工智能

FastPitch 音调可控 TTS

FastPitch 是一种快速、非自回归的文本转语音模型,可显式预测每个输入标记的音调(基本频率),让您……

2 最小阅读量阅读
音频人工智能

Voicebox 流程匹配语音生成

Voicebox 是 Meta 的文本引导语音生成模型,通过流匹配目标进行训练,以“填充”屏蔽音频,让一个模型执行零样本语音……

2 最小阅读量阅读
技术的

SmoothQuant 和激活量化

SmoothQuant 是一种技术,可以将大型语言模型的权重和激活压缩为 8 位整数,而无需……

2 最小阅读量阅读
技术的

结构化剪枝和层丢弃

结构化剪枝删除了神经网络的整个组件,例如注意力头、神经元或整个层,因此更精简的模型运行得更快......

2 最小阅读量阅读
技术的

推测流和多令牌预测

推测流和多令牌预测通过一次猜测多个未来令牌并在单个......中验证它们来加速语言模型的生成。

2 最小阅读量阅读
公司

OpenAI GPT-4.5 和 GPT-5

GPT-4.5 和 GPT-5 是 OpenAI 的旗舰大语言模型,为 ChatGPT 及其 API 提供支持。

2 最小阅读量阅读

读完了吗?证明给我看。

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.