免费人工智能库

视觉人工智能 指南永远免费。

133 简明英语指南、结构化学习路径和开放图书馆——由独立的 501(c)(3) 非营利组织构建,以便任何人都可以理解现代人工智能。

133免费指南
1主题曲目
~2 min根据指南
~4h阅读时间

从这里开始

成果导向课程

每门课程都包含明确的成果、能力规划、实践活动和应用毕业设计。

主题曲目

按曲目浏览

跳入您关心的领域。每条赛道都有多个简单的英文指南。

全库

所有指南

133 1019 显示指南。按曲目过滤或在上方搜索。

视觉人工智能

新颖的视图合成

新颖的视图合成从从未实际拍摄过的视点生成场景的照片级真实图像。

2 最小阅读量阅读
视觉人工智能

Muse 蒙面生成成像

Muse 是来自 Google 的文本到图像模型,它通过一次性填充蒙版图像标记来生成图片,使其比一步一步快得多......

2 最小阅读量阅读
视觉人工智能

部分通路自回归成像

Parti(自回归文本到图像的路径)以语言模型编写句子的方式生成图片:一次一个图像标记,预测下一个图像标记......

2 最小阅读量阅读
视觉人工智能

Imagen 2 和奖励调整扩散

Imagen 2 是 Google 的基于扩散的真实感文本到图像模型,通过奖励调整进行改进,使其输出更好地匹配人们的实际需求。

2 最小阅读量阅读
视觉人工智能

LaMa 分辨率-稳健修复

LaMa(大掩模修复)是一种快速、轻量级的神经网络,即使孔很大,也能干净地填充图像中缺失或删除的区域。

2 最小阅读量阅读
视觉人工智能

稳定的视频扩散

稳定视频扩散 (SVD) 是 Stability AI 的开放基础模型,可将单个静态图像转换为简短、平滑移动的视频剪辑。

2 最小阅读量阅读
视觉人工智能

卢米埃尔时空视频生成

Lumiere 是来自 Google Research 的文本到视频扩散模型,它使用时空 U-Net 一次性生成整个视频剪辑。

2 最小阅读量阅读
视觉人工智能

Mip-NeRF 和抗锯齿辐射场

Mip-NeRF 修复了当您以不同距离或分辨率渲染场景时困扰原始 NeRF 的模糊、锯齿状伪像。

2 最小阅读量阅读
视觉人工智能

Plenoxels 和体素辐射场

Plenoxels 表明,您可以重建具有 NeRF 质量结果的 3D 场景,而无需任何神经网络——只需存储颜色的体素网格......

2 最小阅读量阅读
视觉人工智能

DUSt3R 密集 3D 重建

DUSt3R 可从少量普通照片重建密集的 3D 几何结构,无需已知的相机位置或校准。

2 最小阅读量阅读
视觉人工智能

调整视频一次性编辑

Tune-A-Video 在单个视频上微调预训练的文本到图像扩散模型,以便它可以根据新的文本提示重新编辑该剪辑。

2 最小阅读量阅读
视觉人工智能

DreamFusion 和分数蒸馏采样

DreamFusion 使用 2D 图像扩散模型作为批评者,从文本生成 3D 对象,从不训练任何 3D 数据。

2 最小阅读量阅读

读完了吗?证明给我看。

通过主题测验检查您学到了什么,然后探索我们的结构化课程或努力获得证书。每本指南都可以免费阅读。

视觉 AI AI 指南 — 第 5 页,共 12 页 | AI Understanding