免費人工智慧庫

視覺人工智慧 指南永遠免費。

133 簡明英語指南、結構化學習路徑和開放圖書館——由獨立的 501(c)(3) 非營利組織構建,以便任何人都可以理解現代人工智慧。

133免費指南
1主題曲目
~2 min根據指南
~4h閱讀時間

從這裡開始

基於結果的課程

每門課程都包括明確的成果、映射的能力、實踐活動和應用的頂點。

主題曲目

按曲目瀏覽

跳入您關心的領域。每條賽道都有多個簡單的英文指南。

全庫

所有指南

133 1019 顯示指南。按曲目過濾或上方搜尋。

視覺人工智慧

光學字元辨識

光學字元辨識 (OCR) 將文字影像(掃描文件、標誌照片、PDF)轉換為機器可讀、可編輯的文字。

2 最小閱讀量閱讀
視覺人工智慧

光流

光流估計每個像素如何在連續視訊影格之間移動,產生運動向量的密集圖。

2 最小閱讀量閱讀
視覺人工智慧

單目深度估計

單眼深度估計可預測每個像素與單張普通照片的距離 - 無需立體相機、光達或深度感測器。

2 最小閱讀量閱讀
視覺人工智慧

潛在擴散模型

潛在擴散模型透過在壓縮的潛在空間而不是原始像素中運行擴散過程來產生影像,從而大幅削減計算成本。

2 最小閱讀量閱讀
視覺人工智慧

控制網

ControlNet 是一個附加元件,可為影像生成模型提供精確的結構控制,讓您可以透過邊緣、姿勢、深度圖或塗鴉來控制輸出。

2 最小閱讀量閱讀
視覺人工智慧

無分類器指導

無分類器指導是一種使擴散模型真正遵循您的提示的技術,用一些多樣性換取更強的依從性。

2 最小閱讀量閱讀
視覺人工智慧

視覺SLAM

視覺 SLAM 讓移動攝影機建構未知空間的地圖,同時追蹤其自身在該地圖內的位置。

2 最小閱讀量閱讀
視覺人工智慧

Sora 和文字轉視頻

Sora 是 OpenAI 的文字轉影片模型,可將書面提示轉換為簡短的高解析度影片剪輯。

2 最小閱讀量閱讀
視覺人工智慧

視訊擴散模型

視訊擴散模型透過逐漸將隨機雜訊轉換為連貫影格來產生運動影像,將擴散思想從圖片擴展到時間。

2 最小閱讀量閱讀
視覺人工智慧

文字轉 3D 生成

文字轉 3D 生成將「老式皮革扶手椅」等書面提示轉變為完整的 3D 模型,您可以旋轉、點亮並放入遊戲或場景中。

2 最小閱讀量閱讀
視覺人工智慧

可微渲染

可微渲染使得將 3D 場景轉換為 2D 影像的過程完全可微,因此您可以根據渲染的像素計算梯度…

2 最小閱讀量閱讀
視覺人工智慧

U-Net架構

U-Net 是一種形狀像「U」的捲積神經網絡,擅長產生像素精確的輸出,最初用於生物醫學影像分割。

2 最小閱讀量閱讀

讀完了嗎?證明一下。

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.