免费人工智能库

视觉人工智能 指南永远免费。

133 简明英语指南、结构化学习路径和开放图书馆——由独立的 501(c)(3) 非营利组织构建,以便任何人都可以理解现代人工智能。

133免费指南
1主题曲目
~2 min根据指南
~4h阅读时间

从这里开始

成果导向课程

每门课程都包含明确的成果、能力规划、实践活动和应用毕业设计。

主题曲目

按曲目浏览

跳入您关心的领域。每条赛道都有多个简单的英文指南。

全库

所有指南

133 1019 显示指南。按曲目过滤或在上方搜索。

视觉人工智能

自回归图像生成

自回归图像生成一次构建一张图片,从之前生成的所有内容中预测每个标记。

2 最小阅读量阅读
视觉人工智能

VQ-VAE 和离散潜伏

VQ-VAE 将图像、音频或视频压缩为从学习的码本中提取的离散代码的小网格,而不是连续的数字。

2 最小阅读量阅读
视觉人工智能

分段任何模型

分段任意模型 (SAM) 是 Meta AI 用于图像分割的基础模型:给定点、框或粗略提示,它会立即勾勒出轮廓……

2 最小阅读量阅读
视觉人工智能

文本倒装

文本倒置通过学习一个新单词来教会图像生成器一个全新的概念——比如特定的猫、艺术风格或产品,而无需……

2 最小阅读量阅读
视觉人工智能

梦想展位

DreamBooth 可对少量照片上的整个图像模型进行微调,以便它能够深刻地“记住”特定主题(您的脸、宠物或产品),并可以将其放置......

2 最小阅读量阅读
视觉人工智能

修复和修复

修复填充或替换图像内的遮罩区域,而修复则将图像延伸到其原始边界之外。

2 最小阅读量阅读
视觉人工智能

动作识别

动作识别是教计算机识别视频中的人或物体“在做什么”——跑步、挥手、摔倒、开门——而不是……的任务。

2 最小阅读量阅读
视觉人工智能

视频帧插值

视频帧插值从现有帧中生成新的中间帧,使视频更流畅或更慢 — 将 30fps 的镜头变成 60fps...

2 最小阅读量阅读
视觉人工智能

多目标跟踪

多对象跟踪 (MOT) 在视频帧中跟踪许多对象(行人、汽车、玩家),随着时间的推移,为每个对象提供一致的身份。

2 最小阅读量阅读
视觉人工智能

医学影像中的人工智能

医学成像中的人工智能使用计算机视觉来读取 X 射线、CT 扫描、MRI、超声波和乳房 X 光检查,发现异常情况并优先处理紧急病例。

2 最小阅读量阅读
视觉人工智能

图像超分辨率

图像超分辨率利用人工智能通过智能地创造合理的细节,将低分辨率、模糊的图像变成清晰、高分辨率的图像。

2 最小阅读量阅读
视觉人工智能

流量匹配

流匹配是一种训练生成模型的新方法,它可以学习将随机噪声直接传递给实际数据的平滑“速度场”。

2 最小阅读量阅读

读完了吗?证明给我看。

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.