免费人工智能库

视觉人工智能 指南永远免费。

133 简明英语指南、结构化学习路径和开放图书馆——由独立的 501(c)(3) 非营利组织构建,以便任何人都可以理解现代人工智能。

133免费指南
1主题曲目
~2 min根据指南
~4h阅读时间

从这里开始

成果导向课程

每门课程都包含明确的成果、能力规划、实践活动和应用毕业设计。

主题曲目

按曲目浏览

跳入您关心的领域。每条赛道都有多个简单的英文指南。

全库

所有指南

133 1019 显示指南。按曲目过滤或在上方搜索。

视觉人工智能

用于图像编辑的 LoRA 滑块

LoRA 滑块是微小的附加模块,可让您连续拨盘向上或向下推动图像的单个属性,例如年龄、微笑或铁锈,而无需……

2 最小阅读量阅读
视觉人工智能

InstructPix2Pix 指令编辑

InstructPix2Pix 允许您通过输入简单的命令(例如“让它成为冬天”或“把猫变成狗”)来编辑照片,无需遮罩或选择工具。

2 最小阅读量阅读
视觉人工智能

提示到提示交叉注意编辑

Prompt-to-Prompt 通过调整文本提示来编辑生成的图像,同时重用模型的内部注意力图,因此更改一个单词交换......

2 最小阅读量阅读
视觉人工智能

ESRGAN 和 GAN 超分辨率

ESRGAN 使用生成器与鉴别器竞赛来在放大图像时创造真实的细节,超越模糊插值。

2 最小阅读量阅读
视觉人工智能

Real-ESRGAN 实用修复

Real-ESRGAN 扩展了 ESRGAN 来处理现实世界照片的混乱、未知的退化,而不是干净的合成模糊。

2 最小阅读量阅读
视觉人工智能

SwinIR 变压器恢复

SwinIR 将 Swin Transformer 的平移窗口注意力应用于图像恢复任务,例如超分辨率、去噪和 JPEG 伪影去除。

2 最小阅读量阅读
视觉人工智能

潜在一致性模型

潜在一致性模型 (LCM) 是一种让扩散图像生成器只需一到四个步骤即可生成高质量图片的技术……

2 最小阅读量阅读
视觉人工智能

视觉变形金刚

视觉变压器 (ViTs) 将为 ChatGPT 提供支持的变压器架构应用于图像,将图片视为补丁序列而不是网格......

2 最小阅读量阅读
视觉人工智能

Stable Diffusion

Stable Diffusion 是 Stability AI 于 2022 年发布的一种开源文本到图像模型,它通过逐渐消除随机图像中的噪声来生成图片……

2 最小阅读量阅读
视觉人工智能

Midjourney

Midjourney 是一种流行的商业文本到图像服务,以其引人注目的、高度美观的结果及其起源于 Discord 机器人而闻名。

2 最小阅读量阅读
视觉人工智能

DALL-E

DALL-E 是 OpenAI 的文本到图像模型系列,可将书面描述转换为原始图片。

2 最小阅读量阅读
视觉人工智能

CLIP 和视觉语言模型

CLIP 是来自 OpenAI 的模型,它通过将图像和文本放置在同一数学空间中来学习连接图像和文本。

2 最小阅读量阅读

读完了吗?证明给我看。

通过主题测验检查您学到了什么,然后探索我们的结构化课程或努力获得证书。每本指南都可以免费阅读。