免費人工智慧庫

科技 指南永遠免費。

177 簡明英語指南、結構化學習路徑和開放圖書館——由獨立的 501(c)(3) 非營利組織構建,以便任何人都可以理解現代人工智慧。

177免費指南
1主題曲目
~2 min根據指南
~6h閱讀時間

從這裡開始

基於結果的課程

每門課程都包括明確的成果、映射的能力、實踐活動和應用的頂點。

主題曲目

按曲目瀏覽

跳入您關心的領域。每條賽道都有多個簡單的英文指南。

全庫

所有指南

177 1019 顯示指南。按曲目過濾或上方搜尋。

科技

序列並行性與環注意力

序列平行性沿著標記(時間)維度將單一長輸入序列拆分到多個 GPU 上,而環注意力機制可以讓這些 GPU 進行計算…

2 最小閱讀量閱讀
科技

啟動重新計算權衡

啟動重新計算(梯度或啟動檢查點)透過丟棄前向傳遞中的中間活化來節省訓練期間的 GPU 記憶體...

2 最小閱讀量閱讀
科技

集團相關政策優化

組相對策略最佳化(GRPO)是一種強化學習方法,用於微調語言模型,根據組來判斷每個答案...

2 最小閱讀量閱讀
科技

標準化流程

歸一化流是生成模型,它透過一系列可逆、可微的…將簡單的雜訊(如高斯)轉化為複雜的資料。

2 最小閱讀量閱讀
科技

基於能量的模型

基於能量的模型 (EBM) 學習標量「能量」函數,該函數為合理的數據分配低值,為不合理的數據分配高值,定義…

2 最小閱讀量閱讀
科技

優化器狀態卸載到 CPU 和 NVMe

節省記憶體的技巧,將繁重的訓練記錄(優化器狀態、梯度,有時是權重)存放在 CPU RAM 或 NVMe SSD 上…

2 最小閱讀量閱讀
科技

檢查點分片和可恢復訓練

將模型的訓練狀態儲存為片段(分片)的技術,以便可以儲存和重新載入巨型模型,而不會阻塞記憶體或磁碟限制,等等...

2 最小閱讀量閱讀
科技

GPU 記憶體管理和碎片

AI 框架如何分配、重複使用和回收 GPU 上的有限內存,以及為什麼剩餘間隙(碎片)甚至會導致內存不足錯誤…

2 最小閱讀量閱讀
科技

多執行個體GPU分區

多執行個體 GPU (MIG) 是一項 NVIDIA 技術,可將單一實體 GPU 分割為多個獨立的硬體分割區。

2 最小閱讀量閱讀
科技

GPU調度和叢集編排

GPU 調度決定哪些作業在哪些加速器上運行以及何時運行,而編排則在整個機器叢集上協調這些作業。

2 最小閱讀量閱讀
科技

用於 AI 訓練集群的 Slurm

Slurm 是一個開源工作負載管理器,可以在高效能運算叢集上調度並運行作業,它已成為大型 AI 的預設選擇...

2 最小閱讀量閱讀
科技

計劃與解決提示

計劃與解決(PS)提示告訴語言模型首先設計一個明確的計劃,然後逐步執行它,修復明顯的失敗...

2 最小閱讀量閱讀

讀完了嗎?證明一下。

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.