免費人工智慧庫

學習人工智慧。永遠免費。

1019 簡明英語指南、結構化學習路徑和開放圖書館——由獨立的 501(c)(3) 非營利組織構建,以便任何人都可以理解現代人工智慧。

1019免費指南
9主題曲目
~2 min根據指南
~34h閱讀時間

從這裡開始

基於結果的課程

每門課程都包括明確的成果、映射的能力、實踐活動和應用的頂點。

主題曲目

按曲目瀏覽

跳入您關心的領域。每條賽道都有多個簡單的英文指南。

全庫

所有指南

1019 1019 顯示指南。按曲目過濾或上方搜尋。

視覺人工智慧

DreamFusion 和分數蒸餾採樣

DreamFusion 使用 2D 影像擴散模型作為批評者,從文字產生 3D 對象,從不訓練任何 3D 資料。

2 最小閱讀量閱讀
視覺人工智慧

Magic3D 文字到 3D 管道

Magic3D 是 NVIDIA 針對 DreamFusion 的兩階段解決方案,可更快產生更高解析度、更詳細的 3D 內容。

2 最小閱讀量閱讀
語言人工智慧

無分詞器的位元組級模型

無分詞器的模型放棄了單字片段的固定詞彙,直接對原始位元組進行操作,讓一個模型可以處理任何語言、程式碼,甚至是吵雜的...

2 最小閱讀量閱讀
語言人工智慧

函數向量和任務表示

函數向量是語言模型隱藏狀態內的緊湊方向,用於編碼整個任務,例如“翻譯成法語”或“返回反義詞”。

2 最小閱讀量閱讀
語言人工智慧

N 次最佳採樣和重新排序

Best-of-N 取樣從模型中產生多個候選答案,然後使用單獨的評分步驟選擇最佳答案。

2 最小閱讀量閱讀
音訊人工智慧

StyleTTS 2 風格擴散

StyleTTS 2 是一種文字轉語音模型,它將語音「風格」(韻律、情緒和說話者音色)視為使用擴散模型取樣的隨機變數…

2 最小閱讀量閱讀
音訊人工智慧

FastPitch 音調可控制 TTS

FastPitch 是一種快速、非自回歸的文字轉語音模型,可明確預測每個輸入標記的音調(基本頻率),讓您…

2 最小閱讀量閱讀
音訊人工智慧

Voicebox 流程匹配語音生成

Voicebox 是 Meta 的文字引導語音生成模型,透過流匹配目標進行訓練,以「填充」屏蔽音頻,讓一個模型執行零樣本語音…

2 最小閱讀量閱讀
科技

SmoothQuant 和激活量化

SmoothQuant 是一種技術,將大型語言模型的權重和活化壓縮為 8 位元整數,而無需…

2 最小閱讀量閱讀
科技

結構化剪枝和層丟棄

結構化剪枝刪除了神經網路的整個組件,例如注意力頭、神經元或整個層,因此更精簡的模型運行得更快...

2 最小閱讀量閱讀
科技

推測流和多令牌預測

推測流和多令牌預測通過一次猜測多個未來令牌並在單一......中驗證它們來加速語言模型的生成。

2 最小閱讀量閱讀
公司

OpenAI GPT-4.5 和 GPT-5

GPT-4.5 和 GPT-5 是 OpenAI 的旗艦大語言模型,為 ChatGPT 及其 API 提供支援。

2 最小閱讀量閱讀

讀完了嗎?證明一下。

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.