免费人工智能库

视觉人工智能 指南永远免费。

133 简明英语指南、结构化学习路径和开放图书馆——由独立的 501(c)(3) 非营利组织构建,以便任何人都可以理解现代人工智能。

133免费指南
1主题曲目
~2 min根据指南
~4h阅读时间

从这里开始

成果导向课程

每门课程都包含明确的成果、能力规划、实践活动和应用毕业设计。

主题曲目

按曲目浏览

跳入您关心的领域。每条赛道都有多个简单的英文指南。

全库

所有指南

133 1019 显示指南。按曲目过滤或在上方搜索。

视觉人工智能

图像抠图

图像抠图是一门以像素完美、半透明边缘从照片中剪切主题的艺术,捕捉每一缕缕头发或运动模糊。

2 最小阅读量阅读
视觉人工智能

用于图像提示的 IP 适配器

IP-Adapter 是一个轻量级附加组件,可让稳定扩散等扩散模型接受图像作为提示,而不仅仅是文本。

2 最小阅读量阅读
视觉人工智能

Imagen 文本到图像

Imagen 是 Google 的文本到图像系统,可将书面描述转化为逼真的图片。

2 最小阅读量阅读
视觉人工智能

滑翔扩散模型

GLIDE 是一种早期的 OpenAI 文本到图像扩散模型,它显示提示加上“无分类器指导”,可以击败早期基于 GAN 的系统。

2 最小阅读量阅读
视觉人工智能

知觉损失和 LPIPS

感知损失通过比较深度神经网络特征而不是原始像素来衡量两幅图像与人类的相似程度。

2 最小阅读量阅读
视觉人工智能

StyleGAN架构

StyleGAN 是 NVIDIA 的生成对抗网络,通过在每一层注入风格信息来生成极其逼真的面孔和物体。

2 最小阅读量阅读
视觉人工智能

GAN 的逐步发展

渐进式生长通过从微小分辨率开始并逐渐添加层以达到高分辨率图像来训练 GAN。

2 最小阅读量阅读
视觉人工智能

AnimateDiff 运动生成

AnimateDiff 是一种为现有文本到图像扩散模型(例如稳定扩散)添加运动的技术,将静态图像生成器转变为短视频……

2 最小阅读量阅读
视觉人工智能

DETR 变压器检测

DETR(DEtection TRansformer)将目标检测重新定义为使用变压器解决的直接集合预测问题,删除了锚点等手工设计的步骤......

2 最小阅读量阅读
视觉人工智能

开放词汇目标检测

开放词汇对象检测允许模型查找并框出由任意文本描述的对象,包括在训练期间从未见过的标记类别。

2 最小阅读量阅读
视觉人工智能

摄影测量

摄影测量将普通的重叠照片转变为精确的 3D 模型、地图和测量结果。

2 最小阅读量阅读
视觉人工智能

视觉里程计

视觉里程计通过跟踪图像在帧与帧之间的变化来估计相机如何在世界中移动。

2 最小阅读量阅读

读完了吗?证明给我看。

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.

Visual AI AI Guides — Page 4 of 12 | AI Understanding