免費人工智慧庫

視覺人工智慧 指南永遠免費。

133 簡明英語指南、結構化學習路徑和開放圖書館——由獨立的 501(c)(3) 非營利組織構建,以便任何人都可以理解現代人工智慧。

133免費指南
1主題曲目
~2 min根據指南
~4h閱讀時間

從這裡開始

基於結果的課程

每門課程都包括明確的成果、映射的能力、實踐活動和應用的頂點。

主題曲目

按曲目瀏覽

跳入您關心的領域。每條賽道都有多個簡單的英文指南。

全庫

所有指南

133 1019 顯示指南。按曲目過濾或上方搜尋。

視覺人工智慧

影片理解

Video understanding analyzes visual and sometimes audio information across time.

2 最小閱讀量閱讀
視覺人工智慧

多模式搜尋

多模態搜尋能跨文字、圖片、音訊和影片等形式檢索資訊。

2 最小閱讀量閱讀
視覺人工智慧

文件人工智慧

Document AI extracts and interprets information from files such as forms, reports, invoices, and scanned pages.

2 最小閱讀量閱讀
視覺人工智慧

瓦瑟斯坦 GAN

Wasserstein GAN (WGAN) 是對 GAN 訓練目標的重新設計,它使用 Wasserstein 距離而不是原始的最小-最大損失。

2 最小閱讀量閱讀
視覺人工智慧

條件 GAN

條件 GAN (cGAN) 透過向生成器和判別器提供額外資訊(例如類別標籤或文字)來擴充普通 GAN。

2 最小閱讀量閱讀
視覺人工智慧

Pix2Pix 影像到影像翻譯

Pix2Pix 是一種條件 GAN,它學習將一種類型的圖像轉換為另一種類型的圖像,例如將草圖轉換為照片或將地圖轉換為衛星視圖。

2 最小閱讀量閱讀
視覺人工智慧

圖像著色

影像著色使用人工智慧為黑白照片和膠片添加合理、逼真的色彩。

2 最小閱讀量閱讀
視覺人工智慧

运动结构

運動結構 (SfM) 根據從不同視點拍攝的一組重疊 2D 照片重建 3D 場景幾何形狀和相機位置。

2 最小閱讀量閱讀
視覺人工智慧

多視圖立體

多視圖立體 (MVS) 拍攝場景的多張校準照片,並透過估計幾乎每個像素的深度來產生密集的 3D 重建。

2 最小閱讀量閱讀
視覺人工智慧

DDPM 和 DDIM 採樣器

DDPM 和 DDIM 是運行擴散模型的逆過程的兩種方法,將隨機雜訊逐步轉換為影像。

2 最小閱讀量閱讀
視覺人工智慧

基於分數的生成模型

基於分數的生成模型透過學習資料分佈的梯度來創建資料——該方向使任何雜訊樣本看起來更像真實的...

2 最小閱讀量閱讀
視覺人工智慧

弗雷謝起始距離

Fréchet 起始距離 (FID) 是判斷一組產生影像的真實性和多樣性的標準指標。

2 最小閱讀量閱讀

讀完了嗎?證明一下。

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.