免费人工智能库

视觉人工智能 指南永远免费。

133 简明英语指南、结构化学习路径和开放图书馆——由独立的 501(c)(3) 非营利组织构建,以便任何人都可以理解现代人工智能。

133免费指南
1主题曲目
~2 min根据指南
~4h阅读时间

从这里开始

成果导向课程

每门课程都包含明确的成果、能力规划、实践活动和应用毕业设计。

主题曲目

按曲目浏览

跳入您关心的领域。每条赛道都有多个简单的英文指南。

全库

所有指南

133 1019 显示指南。按曲目过滤或在上方搜索。

视觉人工智能

神经辐射场

神经辐射场 (NeRF) 从几张普通照片重建完整的 3D 场景,让您将相机带到全新的视角。

2 最小阅读量阅读
视觉人工智能

高斯泼溅

高斯泼溅将 3D 场景表示为数百万个可以实时渲染的微小、彩色、半透明斑点。

2 最小阅读量阅读
视觉人工智能

屏蔽自动编码器

掩码自动编码器 (MAE) 是一种自监督方法,可教导视觉模型在大部分图片被隐藏后重建图像。

2 最小阅读量阅读
视觉人工智能

图像字幕

图像字幕是自动生成描述图片内容的自然语言句子的任务。

2 最小阅读量阅读
视觉人工智能

视觉问答

视觉问答 (VQA) 让系统回答有关图像的自由形式的自然语言问题,例如“有多少人戴着帽子?”

2 最小阅读量阅读
视觉人工智能

YOLO实时检测

YOLO(你只看一次)是一系列对象检测模型,它通过一次神经网络传递足够快地查找和标记图像中的每个对象......

2 最小阅读量阅读
视觉人工智能

全景分割

全景分割为图像中的每个像素提供一个标签,将“这个区域是什么”与“这是哪个特定对象”统一起来。

2 最小阅读量阅读
视觉人工智能

人体姿势估计

人体姿势估计检测身体关节的位置,例如肘部、膝盖和肩膀,以根据图像构建人的数字骨架......

2 最小阅读量阅读
视觉人工智能

通量图像模型

FLUX 是 Black Forest Labs 的一系列开放式文本到图像模型,以清晰的细节、强大的提示跟踪性和令人惊讶的准确渲染文本而闻名。

2 最小阅读量阅读
视觉人工智能

残差网络

残差网络 (ResNet) 是深度神经网络,它添加了“跳跃连接”,让各层学习小的调整而不是完整的转换。

2 最小阅读量阅读
视觉人工智能

基于区域的 CNN

基于区域的 CNN (R-CNN) 是一系列目标检测器,它们首先提出图像中的候选区域,然后使用 CNN 进行分类和精确装箱……

2 最小阅读量阅读
视觉人工智能

斯温变压器

Swin Transformer 是一种视觉 Transformer,可以在移动的分层窗口中处理图像,使注意力足够有效地扩展到……

2 最小阅读量阅读

读完了吗?证明给我看。

通过主题测验检查您学到了什么,然后探索我们的结构化课程或努力获得证书。每本指南都可以免费阅读。