人工智慧基礎
了解人工智慧是什麼、系統如何學習、失敗的地方以及如何在不炒作的情況下判斷主張。
免費人工智慧庫
133 簡明英語指南、結構化學習路徑和開放圖書館——由獨立的 501(c)(3) 非營利組織構建,以便任何人都可以理解現代人工智慧。
從這裡開始
每門課程都包括明確的成果、映射的能力、實踐活動和應用的頂點。
了解人工智慧是什麼、系統如何學習、失敗的地方以及如何在不炒作的情況下判斷主張。
有效率地使用人工智慧,同時保護隱私、檢查輸出並維持人類責任。
評估工作場所用例、運行安全試點、衡量價值並負責任地傳達變更。
透過權利、公平、治理、安全和公共利益結果來分析人工智慧系統。
透過實務系統設計,了解語言模型、檢索、代理、評估、成本及部署保障。
主題曲目
跳入您關心的領域。每條賽道都有多個簡單的英文指南。
全庫
133 的 1019 顯示指南。按曲目過濾或上方搜尋。
光學字元辨識 (OCR) 將文字影像(掃描文件、標誌照片、PDF)轉換為機器可讀、可編輯的文字。
視覺人工智慧光流估計每個像素如何在連續視訊影格之間移動,產生運動向量的密集圖。
視覺人工智慧單眼深度估計可預測每個像素與單張普通照片的距離 - 無需立體相機、光達或深度感測器。
視覺人工智慧潛在擴散模型透過在壓縮的潛在空間而不是原始像素中運行擴散過程來產生影像,從而大幅削減計算成本。
視覺人工智慧ControlNet 是一個附加元件,可為影像生成模型提供精確的結構控制,讓您可以透過邊緣、姿勢、深度圖或塗鴉來控制輸出。
視覺人工智慧無分類器指導是一種使擴散模型真正遵循您的提示的技術,用一些多樣性換取更強的依從性。
視覺人工智慧視覺 SLAM 讓移動攝影機建構未知空間的地圖,同時追蹤其自身在該地圖內的位置。
視覺人工智慧Sora 是 OpenAI 的文字轉影片模型,可將書面提示轉換為簡短的高解析度影片剪輯。
視覺人工智慧視訊擴散模型透過逐漸將隨機雜訊轉換為連貫影格來產生運動影像,將擴散思想從圖片擴展到時間。
視覺人工智慧文字轉 3D 生成將「老式皮革扶手椅」等書面提示轉變為完整的 3D 模型,您可以旋轉、點亮並放入遊戲或場景中。
視覺人工智慧可微渲染使得將 3D 場景轉換為 2D 影像的過程完全可微,因此您可以根據渲染的像素計算梯度…
視覺人工智慧U-Net 是一種形狀像「U」的捲積神經網絡,擅長產生像素精確的輸出,最初用於生物醫學影像分割。