免费人工智能库

视觉人工智能 指南永远免费。

133 简明英语指南、结构化学习路径和开放图书馆——由独立的 501(c)(3) 非营利组织构建,以便任何人都可以理解现代人工智能。

133免费指南
1主题曲目
~2 min根据指南
~4h阅读时间

从这里开始

成果导向课程

每门课程都包含明确的成果、能力规划、实践活动和应用毕业设计。

主题曲目

按曲目浏览

跳入您关心的领域。每条赛道都有多个简单的英文指南。

全库

所有指南

133 1019 显示指南。按曲目过滤或在上方搜索。

视觉人工智能

视频理解

视频理解分析跨时间的视觉信息,有时还分析音频信息。

2 最小阅读量阅读
视觉人工智能

多模式搜索

Multimodal search retrieves information across forms such as text, images, audio, and video.

2 最小阅读量阅读
视觉人工智能

文档人工智能

Document AI 从表单、报告、发票和扫描页面等文件中提取和解释信息。

2 最小阅读量阅读
视觉人工智能

瓦瑟斯坦 GAN

Wasserstein GAN (WGAN) 是对 GAN 训练目标的重新设计,它使用 Wasserstein 距离而不是原始的最小-最大损失。

2 最小阅读量阅读
视觉人工智能

条件 GAN

条件 GAN (cGAN) 通过向生成器和判别器提供额外信息(例如类标签或文本)来扩展普通 GAN。

2 最小阅读量阅读
视觉人工智能

Pix2Pix 图像到图像翻译

Pix2Pix 是一种条件 GAN,它学习将一种类型的图像转换为另一种类型的图像,例如将草图转换为照片或将地图转换为卫星视图。

2 最小阅读量阅读
视觉人工智能

图像着色

图像着色使用人工智能为黑白照片和胶片添加合理、逼真的色彩。

2 最小阅读量阅读
视觉人工智能

运动结构

运动结构 (SfM) 根据从不同视点拍摄的一组重叠 2D 照片重建 3D 场景几何形状和相机位置。

2 最小阅读量阅读
视觉人工智能

多视图立体

多视图立体 (MVS) 拍摄场景的多张校准照片,并通过估计几乎每个像素的深度来生成密集的 3D 重建。

2 最小阅读量阅读
视觉人工智能

DDPM 和 DDIM 采样器

DDPM 和 DDIM 是运行扩散模型的逆过程的两种方法,将随机噪声逐步转化为图像。

2 最小阅读量阅读
视觉人工智能

基于分数的生成模型

基于分数的生成模型通过学习数据分布的梯度来创建数据——该方向使任何噪声样本看起来更像真实的......

2 最小阅读量阅读
视觉人工智能

弗雷谢起始距离

Fréchet 起始距离 (FID) 是判断一组生成图像的真实性和多样性的标准指标。

2 最小阅读量阅读

读完了吗?证明给我看。

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.