免費人工智慧庫

學習人工智慧。永遠免費。

1019 簡明英語指南、結構化學習路徑和開放圖書館——由獨立的 501(c)(3) 非營利組織構建,以便任何人都可以理解現代人工智慧。

1019免費指南
9主題曲目
~2 min根據指南
~34h閱讀時間

從這裡開始

基於結果的課程

每門課程都包括明確的成果、映射的能力、實踐活動和應用的頂點。

主題曲目

按曲目瀏覽

跳入您關心的領域。每條賽道都有多個簡單的英文指南。

全庫

所有指南

1019 1019 顯示指南。按曲目過濾或上方搜尋。

科技

Kubernetes 上的 KServe 和模型服務

KServe 是一個標準化的 Kubernetes 原生平台,用於大規模服務機器學習模型。

2 最小閱讀量閱讀
科技

Seldon 核心與推理圖

Seldon Core 是一個用於在 Kubernetes 上部署機器學習模型的開源平台,具有一個突出的功能:推理圖。

2 最小閱讀量閱讀
視覺人工智慧

用於影像提示的 IP 適配器

IP-Adapter 是一個輕量級附加元件,可讓穩定擴散等擴散模型接受影像作為提示,而不僅僅是文字。

2 最小閱讀量閱讀
視覺人工智慧

Imagen 文字到圖像

Imagen 是 Google 的文字到圖像系統,可將書面描述轉換為逼真的圖片。

2 最小閱讀量閱讀
視覺人工智慧

滑翔擴散模型

GLIDE 是一種早期的 OpenAI 文字到圖像擴散模型,它顯示提示加上“無分類器指導”,可以擊敗早期基於 GAN 的系統。

2 最小閱讀量閱讀
音訊人工智慧

音樂自動標記

音樂自動標記使用機器學習來聽歌曲並自動附加描述性標籤,例如流派、情緒、樂器和節奏。

2 最小閱讀量閱讀
音訊人工智慧

音樂音色轉移

音色轉換重塑了音頻的“音色”,使一種樂器聽起來像另一種樂器,將哼唱的旋律變成小提琴或小號線......

2 最小閱讀量閱讀
音訊人工智慧

聲學場景分類

聲學場景分類 (ASC) 訓練機器識別錄音的環境,繁忙的街道、安靜的公園、火車、咖啡館…

2 最小閱讀量閱讀
音訊人工智慧

NVIDIA Riva 和 NeMo 語音

NVIDIA Riva 是一款用於生產語音 AI(ASR、TTS 和翻譯)的 GPU 加速 SDK,而 NeMo 是用於訓練和微調的開源工具包…

2 最小閱讀量閱讀
音訊人工智慧

深度語音架構

DeepSpeech 是百度於 2014 年推出的端對端語音辨識模型,它使用循環神經網路將原始音訊特徵直接映射到文字...

2 最小閱讀量閱讀
音訊人工智慧

X 向量揚聲器嵌入

X 向量是由神經網路產生的說話者聲音的固定長度數位指紋,用於判斷誰在說話,無論他們說什麼。

2 最小閱讀量閱讀
語言人工智慧

密集通道檢索

密集段落檢索 (DPR) 透過比較問題和段落的含義(作為數字向量,而不是匹配單字)來尋找相關文本。

2 最小閱讀量閱讀

讀完了嗎?證明一下。

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.