免费人工智能库

视觉人工智能 指南永远免费。

133 简明英语指南、结构化学习路径和开放图书馆——由独立的 501(c)(3) 非营利组织构建,以便任何人都可以理解现代人工智能。

133免费指南
1主题曲目
~2 min根据指南
~4h阅读时间

从这里开始

成果导向课程

每门课程都包含明确的成果、能力规划、实践活动和应用毕业设计。

主题曲目

按曲目浏览

跳入您关心的领域。每条赛道都有多个简单的英文指南。

全库

所有指南

133 1019 显示指南。按曲目过滤或在上方搜索。

视觉人工智能

CycleGAN 不配对翻译

CycleGAN 学习在两个视觉域之间转换图像(例如将马转换为斑马,或将照片转换为绘画),而无需匹配前后……

2 最小阅读量阅读
视觉人工智能

SPADE语义图像合成

SPADE(空间自适应标准化)变成了一个简单的标记布局,就像孩子的着色书地图“这里是天空,那里是草地,这里是树”......

2 最小阅读量阅读
视觉人工智能

DragGAN 交互式编辑

DragGAN 让您可以通过直接拖动点来编辑图像:抓住一个点并将其拖动到目标,图片就会真实地变形,改变姿势……

2 最小阅读量阅读
视觉人工智能

扩散变压器

Diffusion Transformers (DiTs) 将图像和视频生成器核心的卷积 U-Net 替换为 Transformer 主干。

2 最小阅读量阅读
视觉人工智能

特征金字塔网络

特征金字塔网络(FPN)让探测器通过廉价地构建多尺度特征“金字塔”来发现尺寸截然不同的物体。

2 最小阅读量阅读
视觉人工智能

非极大值抑制

非极大值抑制 (NMS) 是一个清理步骤,它将一堆杂乱的重叠检测框变成每个对象一个整洁的框。

2 最小阅读量阅读
视觉人工智能

空间变换网络

空间变换网络 (STN) 是可学习的模块,可让神经网络主动扭曲、旋转、裁剪或重新缩放其输入,以专注于……

2 最小阅读量阅读
视觉人工智能

立体深度估计

立体深度估计通过比较两个稍微偏移的相机视图来恢复物体的距离,就像您的两只眼睛一样。

2 最小阅读量阅读
视觉人工智能

点云处理

点云是一组 3D 点(X、Y、Z),通常通过 LiDAR 或深度传感器捕获真实物体和空间的形状。

2 最小阅读量阅读
视觉人工智能

有符号距离函数

带符号距离函数 (SDF) 通过告诉您空间中任何点到最近表面的距离来描述 3D 形状,并用一个符号表示……

2 最小阅读量阅读
视觉人工智能

可变形卷积

可变形卷积让神经网络弯曲其采样网格以遵循对象的实际形状,而不是强迫它通过刚性的方形窗口。

2 最小阅读量阅读
视觉人工智能

恐龙自蒸馏

DINO 是一种自我监督方法,通过网络自学来训练视觉转换器理解完全没有标签的图像。

2 最小阅读量阅读

读完了吗?证明给我看。

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.

Visual AI AI Guides — Page 3 of 12 | AI Understanding