免費人工智慧庫

視覺人工智慧 指南永遠免費。

133 簡明英語指南、結構化學習路徑和開放圖書館——由獨立的 501(c)(3) 非營利組織構建,以便任何人都可以理解現代人工智慧。

133免費指南
1主題曲目
~2 min根據指南
~4h閱讀時間

從這裡開始

基於結果的課程

每門課程都包括明確的成果、映射的能力、實踐活動和應用的頂點。

主題曲目

按曲目瀏覽

跳入您關心的領域。每條賽道都有多個簡單的英文指南。

全庫

所有指南

133 1019 顯示指南。按曲目過濾或上方搜尋。

視覺人工智慧

圖像協調與合成

影像協調會自動調整貼上的前景對象,使其顏色、燈光和色調與新背景相匹配,使合成影像看起來更真實。

2 最小閱讀量閱讀
視覺人工智慧

SDXL 和級聯擴散

SDXL 是 Stability AI 的高解析度文字到圖像模型,它將強大的基礎生成器與精煉器配對,而級聯擴散鏈多個…

2 最小閱讀量閱讀
視覺人工智慧

GLIGEN 接地一代

GLIGEN(接地語言到影像產生)可讓您透過輸入模型邊界框來精確控制物件在生成的影像中出現的位置...

2 最小閱讀量閱讀
視覺人工智慧

用於多條件擴散控制的 T2I 適配器

了解用於多條件擴散控制的 T2I-Adapter:它如何使用輕量級…控制邊緣、深度、姿勢和其他條件下的穩定擴散…

2 最小閱讀量閱讀
視覺人工智慧

空文本反轉

空白文字反轉是一種技術,可讓您使用文字驅動的擴散模型(如穩定擴散)編輯真實照片,同時保留您所...

2 最小閱讀量閱讀
視覺人工智慧

客製化擴散多概念調音

自訂擴散是一種輕量級微調方法,可以教授文字到圖像模型新的個人概念,例如您的狗或特定的椅子,從…

2 最小閱讀量閱讀
視覺人工智慧

潛在混合和圖像插值

潛在混合透過在模型的潛在空間內組合影像的壓縮表示來混合影像,而不是平均原始像素。

2 最小閱讀量閱讀
視覺人工智慧

機器人視覺-語言-動作模型

視覺-語言-動作(VLA)模型是大型神經網絡,它接收相機影像和書面指令並直接輸出機器人馬達指令。

2 最小閱讀量閱讀
視覺人工智慧

機器人控制的擴散策略

擴散策略將穩定擴散等影像產生器背後的相同去噪思想應用於機器人控制:而不是預測單一下一個動作...

2 最小閱讀量閱讀
視覺人工智慧

製作視頻文字轉視頻

Make-A-Video 是 Meta 的 2022 年系統,可將文字提示轉換為短影片剪輯,而無需對標記的文字-影片對進行訓練。

2 最小閱讀量閱讀
視覺人工智慧

Imagen 視訊級聯

Imagen Video 是 Google 的 2022 年文字轉視訊系統,它透過級聯七個擴散模型建立剪輯,每個模型都會添加更多幀或更高的解析度。

2 最小閱讀量閱讀
視覺人工智慧

CogVideo 和 CogVideoX

CogVideo (2022) 是第一個大規模開放的文本到視訊模型,CogVideoX (2024) 是清華/智普人工智慧的更強大的開源繼承者。

2 最小閱讀量閱讀

讀完了嗎?證明一下。

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.