免費人工智慧庫

視覺人工智慧 指南永遠免費。

133 簡明英語指南、結構化學習路徑和開放圖書館——由獨立的 501(c)(3) 非營利組織構建,以便任何人都可以理解現代人工智慧。

133免費指南
1主題曲目
~2 min根據指南
~4h閱讀時間

從這裡開始

基於結果的課程

每門課程都包括明確的成果、映射的能力、實踐活動和應用的頂點。

主題曲目

按曲目瀏覽

跳入您關心的領域。每條賽道都有多個簡單的英文指南。

全庫

所有指南

133 1019 顯示指南。按曲目過濾或上方搜尋。

視覺人工智慧

Magic3D 文字到 3D 管道

Magic3D 是 NVIDIA 針對 DreamFusion 的兩階段解決方案,可更快產生更高解析度、更詳細的 3D 內容。

2 最小閱讀量閱讀
視覺人工智慧

去雜訊和去模糊網絡

去雜訊和去模糊網路是一種神經模型,可以清除雜訊或模糊影像,從雜亂的輸入中恢復清晰的細節。

2 最小閱讀量閱讀
視覺人工智慧

GFPGAN人臉恢復

GFPGAN 是一種專門的模型,可以將低品質、模糊或舊臉照片恢復為清晰、逼真的肖像。

2 最小閱讀量閱讀
視覺人工智慧

CodeFormer 穩健的人臉恢復

CodeFormer 是一種人臉恢復模型,旨在處理極端退化問題,從嚴重損壞、微小或模糊的輸入中恢復可識別的人臉。

2 最小閱讀量閱讀
視覺人工智慧

GigaGAN 規模化產生器

GigaGAN 是一個十億參數的 GAN,它證明生成對抗網路可以擴展到文字到圖像的生成,與擴散模型相媲美…

2 最小閱讀量閱讀
視覺人工智慧

VQGAN 和 Codebook 影像合成

VQGAN 將圖像壓縮成從學習的密碼本中提取的離散標記網格,讓轉換器以與語言模型相同的方式生成圖像...

2 最小閱讀量閱讀
視覺人工智慧

MaskGIT 並行令牌解碼

MaskGIT 透過一次預測許多標記並首先填充最有信心的標記來產生影像,取代緩慢的從左到右生成...

2 最小閱讀量閱讀
視覺人工智慧

零一到三新奇觀擴散

使用以相機為條件的擴散模型,從零到三將單個物體的照片轉換為從任何新角度看到的同一物體的圖像...

2 最小閱讀量閱讀
視覺人工智慧

DMTet 混合 3D 表示

DMTet(深度行進四面體)是一種混合 3D 形狀表示,它將可變形四面體網格與帶符號距離場結合,因此神經...

2 最小閱讀量閱讀
視覺人工智慧

即時 NGP 哈希編碼

Instant-NGP 是 NVIDIA 的技術,透過儲存可學習的內容,可以在幾秒鐘而不是幾小時內訓練神經輻射場和其他神經圖形基元…

2 最小閱讀量閱讀
視覺人工智慧

DepthAnything 單眼深度

DepthAnything 是一個基礎模型,無需特殊硬體即可估計每個像素與單張普通照片的距離。

2 最小閱讀量閱讀
視覺人工智慧

萬壽菊擴散深度估計

Marigold 重新利用預先訓練的影像產生擴散模型(穩定擴散)來預測高度詳細的深度圖。

2 最小閱讀量閱讀

讀完了嗎?證明一下。

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.

Visual AI AI Guides — Page 6 of 12 | AI Understanding