免费人工智能库

学习人工智能。永远免费。

1019 简明英语指南、结构化学习路径和开放图书馆——由独立的 501(c)(3) 非营利组织构建,以便任何人都可以理解现代人工智能。

1019免费指南
9主题曲目
~2 min根据指南
~34h阅读时间

从这里开始

成果导向课程

每门课程都包含明确的成果、能力规划、实践活动和应用毕业设计。

主题曲目

按曲目浏览

跳入您关心的领域。每条赛道都有多个简单的英文指南。

全库

所有指南

1019 1019 显示指南。按曲目过滤或在上方搜索。

音频人工智能

CREPE 间距估计

CREPE 是一种深度学习模型,可直接从原始波形估计单声道音频信号的基频(音调)。

2 最小阅读量阅读
音频人工智能

PESQ 和 STOI 语音质量指标

PESQ 和 STOI 是标准的客观指标,可以对处理后的语音声音的好坏程度以及语音的可理解性进行评分,而无需人类听众。

2 最小阅读量阅读
音频人工智能

源过滤器声码和 WORLD

声码器是一种将语音分解为构建块并重建它的工具。

2 最小阅读量阅读
公司

NVIDIA Cosmos 世界基础模型

NVIDIA Cosmos 是一系列“世界基础模型”,可生成和预测物理逼真的视频,旨在教授机器人和自动驾驶汽车……

2 最小阅读量阅读
公司

统一实验室和Qwen Research

统易实验室是阿里巴巴的人工智能研究小组,支持 Qwen 系列开放权重大语言模型。

2 最小阅读量阅读
公司

Wayve LINGO 驾驶语言模型

Wayve 的 LINGO 模型将自动驾驶系统与自然语言推理相结合,因此汽车可以解释它所看到的内容以及它的行为原因。

2 最小阅读量阅读
公司

NVIDIA Isaac 机器人平台

NVIDIA Isaac 是一个完整的软件和硬件堆栈,用于构建、模拟和部署人工智能驱动的机器人。

2 最小阅读量阅读
公司

雪花北极模型

Snowflake Arctic 是由数据云公司 Snowflake 构建的开放大型语言模型,针对 SQL 生成和编码等企业任务进行了调整。

2 最小阅读量阅读
视觉人工智能

LaMa 分辨率-稳健修复

LaMa(大掩模修复)是一种快速、轻量级的神经网络,即使孔很大,也能干净地填充图像中缺失或删除的区域。

2 最小阅读量阅读
视觉人工智能

稳定的视频扩散

稳定视频扩散 (SVD) 是 Stability AI 的开放基础模型,可将单个静态图像转换为简短、平滑移动的视频剪辑。

2 最小阅读量阅读
视觉人工智能

卢米埃尔时空视频生成

Lumiere 是来自 Google Research 的文本到视频扩散模型,它使用时空 U-Net 一次性生成整个视频剪辑。

2 最小阅读量阅读
基础知识

神经网络的缩放定律

缩放定律是经验公式,表明随着模型大小、数据集大小和计算的增加,神经网络的损失可预测地下降。

2 最小阅读量阅读

读完了吗?证明给我看。

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.