免费人工智能库

学习人工智能。永远免费。

1019 简明英语指南、结构化学习路径和开放图书馆——由独立的 501(c)(3) 非营利组织构建,以便任何人都可以理解现代人工智能。

1019免费指南
9主题曲目
~2 min根据指南
~34h阅读时间

从这里开始

成果导向课程

每门课程都包含明确的成果、能力规划、实践活动和应用毕业设计。

主题曲目

按曲目浏览

跳入您关心的领域。每条赛道都有多个简单的英文指南。

全库

所有指南

1019 1019 显示指南。按曲目过滤或在上方搜索。

语言人工智能

词形还原和词干提取

词干提取和词形还原都将单词简化为基本形式,以便“running”、“ran”和“runs”可以被视为一个概念。

2 最小阅读量阅读
语言人工智能

TF-IDF 和词袋模型

词袋将文本转换为忽略顺序的字数统计,而 TF-IDF 对这些字数进行加权,因此罕见的、独特的单词比常见的单词更重要。

2 最小阅读量阅读
视觉人工智能

机器人视觉-语言-动作模型

视觉-语言-动作(VLA)模型是大型神经网络,它接收相机图像和书面指令并直接输出机器人电机命令。

2 最小阅读量阅读
视觉人工智能

机器人控制的扩散策略

扩散策略将稳定扩散等图像生成器背后的相同去噪思想应用于机器人控制:而不是预测单个下一个动作......

2 最小阅读量阅读
基础知识

世界模型和学习模拟器

世界模型是一种神经网络,它学习预测环境如何随时间变化,让人工智能在行动之前“想象”未来的结果。

2 最小阅读量阅读
语言人工智能

交叉编码器与双编码器

神经模型比较文本的两种方式:双编码器分别嵌入每个片段以进行快速搜索,而交叉编码器将两个文本一起读取以获得更高的……

2 最小阅读量阅读
语言人工智能

抽象总结与提取总结

缩小文本的两种策略:提取摘要逐字复制最重要的句子,而抽象摘要则写入新的……

2 最小阅读量阅读
技术的

ROUGE 和 BLEU 评估指标

ROUGE 和 BLEU 是将机器生成的文本与人类参考进行比较的主要自动指标。

2 最小阅读量阅读
视觉人工智能

制作视频文本转视频

Make-A-Video 是 Meta 的 2022 年系统,可将文本提示转换为短视频剪辑,而无需对标记的文本-视频对进行训练。

2 最小阅读量阅读
视觉人工智能

Imagen 视频级联

Imagen Video 是 Google 的 2022 年文本转视频系统,它通过级联七个扩散模型构建剪辑,每个模型都会添加更多帧或更高的分辨率。

2 最小阅读量阅读
视觉人工智能

CogVideo 和 CogVideoX

CogVideo (2022) 是第一个大规模开放的文本到视频模型,CogVideoX (2024) 是清华/智普人工智能的更强大的开源继承者。

2 最小阅读量阅读
应用领域

音乐母带和混音中的人工智能

AI 母带处理和混音工具分析音轨的频率平衡、响度和动态,然后自动应用 EQ、压缩和限制以使其......

2 最小阅读量阅读

读完了吗?证明给我看。

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.