免費人工智慧庫

語言人工智慧 指南永遠免費。

155 簡明英語指南、結構化學習路徑和開放圖書館——由獨立的 501(c)(3) 非營利組織構建,以便任何人都可以理解現代人工智慧。

155免費指南
1主題曲目
~2 min根據指南
~5h閱讀時間

從這裡開始

基於結果的課程

每門課程都包括明確的成果、映射的能力、實踐活動和應用的頂點。

主題曲目

按曲目瀏覽

跳入您關心的領域。每條賽道都有多個簡單的英文指南。

全庫

所有指南

155 1019 顯示指南。按曲目過濾或上方搜尋。

語言人工智慧

直接偏好優化

直接偏好最佳化(DPO)是一種使語言模型與人類偏好保持一致的方法,無需訓練單獨的獎勵模型或運行...

2 最小閱讀量閱讀
語言人工智慧

獎勵模型

獎勵模型是一種經過訓練的神經網絡,可以預測人工智慧的反應有多好,充當人類判斷的自動替代品。

2 最小閱讀量閱讀
語言人工智慧

近端策略優化

近端策略最佳化 (PPO) 是與根據人類回饋微調語言模型最相關的強化學習演算法。

2 最小閱讀量閱讀
語言人工智慧

波束搜尋

集束搜尋是一種解碼策略,它在每一步中保留幾個最有希望的部分序列,而不是貪婪地致力於一個。

2 最小閱讀量閱讀
語言人工智慧

Nucleus 和 Top-k 採樣

Nucleus (top-p) 和 top-k 採樣是透過限制可以選擇的標記來為文字產生添加受控隨機性的解碼方法。

2 最小閱讀量閱讀
語言人工智慧

掩碼語言建模

蒙面語言模型教導人工智慧使用完整的周圍上下文(左右)來填充故意隱藏的單字。

2 最小閱讀量閱讀
語言人工智慧

下一個令牌預測

下一個標記預測是 GPT 風格模型背後看似簡單的目標:給定到目前為止的所有內容,猜測下一個文字區塊。

2 最小閱讀量閱讀
語言人工智慧

序列到序列模型

序列到序列模型將一個序列映射到另一個可能不同長度的序列,例如翻譯句子或總結文件。

2 最小閱讀量閱讀
語言人工智慧

編碼器-解碼器架構

編碼器-解碼器架構將模型分為兩半:一半讀取輸入並將其壓縮為豐富的內部表示,另一半...

2 最小閱讀量閱讀
語言人工智慧

交叉注意力

交叉注意力是一種讓一個序列查看另一個序列的機制:產生文字的解碼器可以專注於編碼器的輸入表示。

2 最小閱讀量閱讀
語言人工智慧

災難性遺忘

災難性遺忘是指神經網路學習一項新任務並突然失去執行已經掌握的任務的能力。

2 最小閱讀量閱讀

讀完了嗎?證明一下。

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.

Language AI AI Guides — Page 13 of 13 | AI Understanding