免费人工智能库

技术的 指南永远免费。

177 简明英语指南、结构化学习路径和开放图书馆——由独立的 501(c)(3) 非营利组织构建,以便任何人都可以理解现代人工智能。

177免费指南
1主题曲目
~2 min根据指南
~6h阅读时间

从这里开始

成果导向课程

每门课程都包含明确的成果、能力规划、实践活动和应用毕业设计。

主题曲目

按曲目浏览

跳入您关心的领域。每条赛道都有多个简单的英文指南。

全库

所有指南

177 1019 显示指南。按曲目过滤或在上方搜索。

技术的

TensorRT 和推理引擎

TensorRT 是 NVIDIA 的库,它将经过训练的神经网络编译成高度优化的引擎,在 NVIDIA GPU 上运行速度要快得多。

2 最小阅读量阅读
技术的

Triton 推理服务器

Triton 推理服务器是 NVIDIA 的开源平台,用于在生产中大规模部署和服务 AI 模型。

2 最小阅读量阅读
技术的

Ray 用于分布式人工智能

Ray 是一个开源框架,可以轻松地将 Python 和 AI 工作负载从笔记本电脑扩展到包含数千台机器的集群。

2 最小阅读量阅读
技术的

完全分片数据并行

完全分片数据并行 (FSDP) 是一种分布式训练技术,可将模型的参数、梯度和优化器状态拆分到多个 GPU 上,以便……

2 最小阅读量阅读
技术的

梯度检查点

梯度检查点(也称为激活检查点)是一种节省内存的技巧,它会在前向传递过程中丢弃大多数中间激活......

2 最小阅读量阅读
技术的

ONNX 和模型互操作性

ONNX(开放神经网络交换)是一种用于表示机器学习模型的开放标准格式,以便它们可以在框架之间自由移动......

2 最小阅读量阅读
技术的

张量核心

张量核心是现代 NVIDIA GPU 内的专用硬件单元,可以极快地执行矩阵乘法和累加运算。

2 最小阅读量阅读
技术的

高带宽内存

高带宽内存 (HBM) 是放置在 GPU 旁边的堆叠内存,其传输数据的速度比普通 RAM 快得多。

2 最小阅读量阅读
技术的

NVLink 和 GPU 互连

NVLink 和相关互连是高速链路,可让许多 GPU 直接快速地相互通信。

2 最小阅读量阅读
技术的

模型合并

模型合并将两个或多个经过训练的神经网络的权重合并为一个模型 - 无需任何重新训练或访问原始训练......

2 最小阅读量阅读
技术的

混合模型和稀疏模型

Mixtral 是 Mistral AI 的开放式专家混合模型,能够以小模型速度提供大模型质量。

2 最小阅读量阅读
技术的

GPU 与 TPU 的 AI 对比

GPU 和 TPU 是训练和运行人工智能的两种主要芯片类型。

2 最小阅读量阅读

读完了吗?证明给我看。

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.