免費人工智慧庫

視覺人工智慧 指南永遠免費。

133 簡明英語指南、結構化學習路徑和開放圖書館——由獨立的 501(c)(3) 非營利組織構建,以便任何人都可以理解現代人工智慧。

133免費指南
1主題曲目
~2 min根據指南
~4h閱讀時間

從這裡開始

基於結果的課程

每門課程都包括明確的成果、映射的能力、實踐活動和應用的頂點。

主題曲目

按曲目瀏覽

跳入您關心的領域。每條賽道都有多個簡單的英文指南。

全庫

所有指南

133 1019 顯示指南。按曲目過濾或上方搜尋。

視覺人工智慧

用於影像編輯的 LoRA 滑桿

LoRA 滑桿是微小的附加模組,可讓您連續撥盤向上或向下推展影像的單一屬性,例如年齡、微笑或鐵鏽,而無需…

2 最小閱讀量閱讀
視覺人工智慧

InstructPix2Pix 指令編輯

InstructPix2Pix 讓您可以透過輸入簡單的命令(例如「讓它成為冬天」或「把貓變成狗」)來編輯照片,無需遮罩或選擇工具。

2 最小閱讀量閱讀
視覺人工智慧

提示到提示交叉注意編輯

Prompt-to-Prompt 透過調整文字提示來編輯產生的圖像,同時重複使用模型的內部注意力圖,因此更改一個單字交換...

2 最小閱讀量閱讀
視覺人工智慧

ESRGAN 和 GAN 超分辨率

ESRGAN 使用生成器與鑑別器競賽來在放大影像時創造真實的細節,超越模糊插值。

2 最小閱讀量閱讀
視覺人工智慧

Real-ESRGAN 實用修復

Real-ESRGAN 擴展了 ESRGAN 來處理現實世界照片的混亂、未知的退化,而不是乾淨的合成模糊。

2 最小閱讀量閱讀
視覺人工智慧

SwinIR 變壓器恢復

SwinIR 將 Swin Transformer 的平移視窗注意力應用於影像復原任務,例如超解析度、去噪和 JPEG 偽影去除。

2 最小閱讀量閱讀
視覺人工智慧

潛在一致性模型

潛在一致性模型 (LCM) 是一種讓擴散影像產生器只需一到四個步驟即可產生高品質圖片的技術…

2 最小閱讀量閱讀
視覺人工智慧

視覺變形金剛

視覺變壓器 (ViTs) 將為 ChatGPT 提供支援的變壓器架構應用於影像,將圖片視為補丁序列而不是網格...

2 最小閱讀量閱讀
視覺人工智慧

Stable Diffusion

Stable Diffusion 是 Stability AI 於 2022 年發布的開源文字到圖像模型,它透過逐漸消除隨機圖像中的雜訊來產生圖片…

2 最小閱讀量閱讀
視覺人工智慧

Midjourney

Midjourney 是一種流行的商業文本到圖像服務,以其引人注目的、高度美觀的結果及其起源於 Discord 機器人而聞名。

2 最小閱讀量閱讀
視覺人工智慧

DALL-E

DALL-E 是 OpenAI 的文字到圖像模型系列,可將書面描述轉換為原始圖片。

2 最小閱讀量閱讀
視覺人工智慧

CLIP 和視覺語言模型

CLIP 是來自 OpenAI 的模型,它透過將圖像和文字放置在同一數學空間中來學習連接圖像和文字。

2 最小閱讀量閱讀

讀完了嗎?證明一下。

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.

Visual AI AI Guides — Page 8 of 12 | AI Understanding