免費人工智慧庫

科技 指南永遠免費。

177 簡明英語指南、結構化學習路徑和開放圖書館——由獨立的 501(c)(3) 非營利組織構建,以便任何人都可以理解現代人工智慧。

177免費指南
1主題曲目
~2 min根據指南
~6h閱讀時間

從這裡開始

基於結果的課程

每門課程都包括明確的成果、映射的能力、實踐活動和應用的頂點。

主題曲目

按曲目瀏覽

跳入您關心的領域。每條賽道都有多個簡單的英文指南。

全庫

所有指南

177 1019 顯示指南。按曲目過濾或上方搜尋。

科技

推測流和多令牌預測

推測流和多令牌預測通過一次猜測多個未來令牌並在單一......中驗證它們來加速語言模型的生成。

2 最小閱讀量閱讀
科技

BERTcore 和語義評估

BERTScore 透過比較意義而不是確切的單字來衡量機器產生的文字與參考的匹配程度。

2 最小閱讀量閱讀
科技

線性注意力和表演者核

線性注意力以隨序列長度線性縮放的數學技巧取代了 Transformers 中的二次 softmax 注意力。

2 最小閱讀量閱讀
科技

YaRN 和上下文長度擴展

YaRN(另一種 RoPE 擴展)是一種有效的技術,可以將模型的可用上下文視窗擴展到遠遠超出其訓練範圍的範圍。

2 最小閱讀量閱讀
科技

長上下文的位置插值

位置插值 (PI) 是一種簡單、有影響力的技術,它透過將新的位置索引壓縮到範圍內來擴展 Transformer 的上下文視窗…

2 最小閱讀量閱讀
科技

LoRA 專家的混合體

LoRA 專家混合體 (MoLE) 將許多小型、訓練成本低廉的適配器與學習路由器相結合,因此單一基本模型可以靈活地專業化…

2 最小閱讀量閱讀
科技

程式碼模型的推測性編輯

推測性編輯透過預測文件的大部分內容將保持不變並僅驗證不同的小部分,使 AI 程式碼編輯感覺即時。

2 最小閱讀量閱讀
科技

啟動指導和表示工程

激活控制透過在運行時直接在其隱藏激活內添加或減去向量來推動模型的行為,無需重新訓練。

2 最小閱讀量閱讀
科技

用於可解釋性的稀疏自動編碼器

稀疏自動編碼器 (SAE) 是一種工具,可將神經網路錯綜複雜的內部活化分解為更大的清潔集合...

2 最小閱讀量閱讀
科技

人工智慧可解釋性中的疊加和多義性

學習人工智慧可解釋性中的疊加和多語義:為什麼模型將特徵打包到共享方向,為什麼神經元變得多語義...

2 最小閱讀量閱讀
科技

羅吉特透鏡與調諧透鏡

Logit 透鏡和調諧透鏡是可解釋性技術,可逐層查看 Transformer 的隱藏狀態,以了解模型在「思考」什麼…

2 最小閱讀量閱讀
科技

DeepSpeed 和 Megatron 訓練堆疊

DeepSpeed (Microsoft) 和 Megatron-LM (NVIDIA) 是軟體堆疊,可在數千個 GPU 上建立具有數十億參數的訓練模型…

2 最小閱讀量閱讀

讀完了嗎?證明一下。

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.