免費人工智慧庫

視覺人工智慧 指南永遠免費。

133 簡明英語指南、結構化學習路徑和開放圖書館——由獨立的 501(c)(3) 非營利組織構建,以便任何人都可以理解現代人工智慧。

133免費指南
1主題曲目
~2 min根據指南
~4h閱讀時間

從這裡開始

基於結果的課程

每門課程都包括明確的成果、映射的能力、實踐活動和應用的頂點。

主題曲目

按曲目瀏覽

跳入您關心的領域。每條賽道都有多個簡單的英文指南。

全庫

所有指南

133 1019 顯示指南。按曲目過濾或上方搜尋。

視覺人工智慧

新穎的視圖合成

新穎的視圖合成從從未實際拍攝過的視點生成場景的照片級真實影像。

2 最小閱讀量閱讀
視覺人工智慧

Muse 蒙面產生成像

Muse 是來自 Google 的文字到圖像模型,它透過一次性填充蒙版圖像標記來產生圖片,使其比一步一步快得多...

2 最小閱讀量閱讀
視覺人工智慧

部分通路自回歸影像

Parti(自回歸文字到圖像的路徑)以語言模型編寫句子的方式產生圖片:一次一個圖像標記,預測下一個圖像標記...

2 最小閱讀量閱讀
視覺人工智慧

Imagen 2 和獎勵調整擴散

Imagen 2 是 Google 的基於擴散的真實感文本到圖像模型,透過獎勵調整進行改進,使其輸出更好地匹配人們的實際需求。

2 最小閱讀量閱讀
視覺人工智慧

LaMa 解析度-穩健修復

LaMa(大掩模修复)是一种快速、轻量级的神经网络,即使孔很大,也能干净地填充图像中缺失或删除的区域。

2 最小閱讀量閱讀
視覺人工智慧

穩定的視訊擴散

穩定視訊擴散 (SVD) 是 Stability AI 的開放基礎模型,可將單一靜態影像轉換為簡短、平滑移動的影片剪輯。

2 最小閱讀量閱讀
視覺人工智慧

盧米埃爾時空影片生成

Lumiere 是來自 Google Research 的文本到視訊擴散模型,它使用時空 U-Net 一次生成整個視訊剪輯。

2 最小閱讀量閱讀
視覺人工智慧

Mip-NeRF 與抗鋸齒輻射場

Mip-NeRF 修正了當您以不同距離或解析度渲染場景時困擾原始 NeRF 的模糊、鋸齒狀偽影。

2 最小閱讀量閱讀
視覺人工智慧

Plenoxels 和體素輻射場

Plenoxels 表明,您可以重建具有 NeRF 品質結果的 3D 場景,而無需任何神經網路——只需儲存顏色的體素網格...

2 最小閱讀量閱讀
視覺人工智慧

DUSt3R 密集 3D 重建

DUSt3R 可從少量普通照片重建密集的 3D 幾何結構,無需已知的相機位置或校準。

2 最小閱讀量閱讀
視覺人工智慧

調整影片一次編輯

Tune-A-Video 在單一影片上微調預先訓練的文字到影像擴散模型,以便它可以根據新的文字提示重新編輯該剪輯。

2 最小閱讀量閱讀
視覺人工智慧

DreamFusion 和分數蒸餾採樣

DreamFusion 使用 2D 影像擴散模型作為批評者,從文字產生 3D 對象,從不訓練任何 3D 資料。

2 最小閱讀量閱讀

讀完了嗎?證明一下。

透過主題測驗檢查您學到了什麼,然後探索我們的結構化課程或努力獲得證書。每本指南都可以免費閱讀。