免费人工智能库

视觉人工智能 指南永远免费。

133 简明英语指南、结构化学习路径和开放图书馆——由独立的 501(c)(3) 非营利组织构建,以便任何人都可以理解现代人工智能。

133免费指南
1主题曲目
~2 min根据指南
~4h阅读时间

从这里开始

成果导向课程

每门课程都包含明确的成果、能力规划、实践活动和应用毕业设计。

主题曲目

按曲目浏览

跳入您关心的领域。每条赛道都有多个简单的英文指南。

全库

所有指南

133 1019 显示指南。按曲目过滤或在上方搜索。

视觉人工智能

Magic3D 文本到 3D 管道

Magic3D 是 NVIDIA 针对 DreamFusion 的两阶段解决方案,可更快地生成更高分辨率、更详细的 3D 内容。

2 最小阅读量阅读
视觉人工智能

去噪和去模糊网络

去噪和去模糊网络是一种神经模型,可以清除噪声或模糊图像,从杂乱的输入中恢复清晰的细节。

2 最小阅读量阅读
视觉人工智能

GFPGAN人脸恢复

GFPGAN 是一种专门的模型,可以将低质量、模糊或旧脸照片恢复为清晰、逼真的肖像。

2 最小阅读量阅读
视觉人工智能

CodeFormer 稳健的人脸恢复

CodeFormer 是一种人脸恢复模型,旨在处理极端退化问题,从严重损坏、微小或模糊的输入中恢复可识别的人脸。

2 最小阅读量阅读
视觉人工智能

GigaGAN 规模化生成器

GigaGAN 是一个十亿参数的 GAN,它证明生成对抗网络可以扩展到文本到图像的生成,与扩散模型相媲美……

2 最小阅读量阅读
视觉人工智能

VQGAN 和 Codebook 图像合成

VQGAN 将图像压缩成从学习的密码本中提取的离散标记网格,让转换器以与语言模型相同的方式生成图像......

2 最小阅读量阅读
视觉人工智能

MaskGIT 并行令牌解码

MaskGIT 通过一次预测许多标记并首先填充最有信心的标记来生成图像,取代缓慢的从左到右生成......

2 最小阅读量阅读
视觉人工智能

零一到三新奇观扩散

使用以相机为条件的扩散模型,从零到三将单个物体的照片转换为从任何新角度看到的同一物体的图像......

2 最小阅读量阅读
视觉人工智能

DMTet 混合 3D 表示

DMTet(深度行进四面体)是一种混合 3D 形状表示,它将可变形四面体网格与带符号距离场相结合,因此神经......

2 最小阅读量阅读
视觉人工智能

即时 NGP 哈希编码

Instant-NGP 是 NVIDIA 的技术,通过存储可学习的内容,可以在几秒而不是几小时内训练神经辐射场和其他神经图形基元……

2 最小阅读量阅读
视觉人工智能

DepthAnything 单眼深度

DepthAnything 是一个基础模型,无需特殊硬件即可估计每个像素与单张普通照片的距离。

2 最小阅读量阅读
视觉人工智能

万寿菊扩散深度估计

Marigold 重新利用预训练的图像生成扩散模型(稳定扩散)来预测高度详细的深度图。

2 最小阅读量阅读

读完了吗?证明给我看。

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.