免費人工智慧庫

音訊人工智慧 指南永遠免費。

117 簡明英語指南、結構化學習路徑和開放圖書館——由獨立的 501(c)(3) 非營利組織構建,以便任何人都可以理解現代人工智慧。

117免費指南
1主題曲目
~2 min根據指南
~4h閱讀時間

從這裡開始

基於結果的課程

每門課程都包括明確的成果、映射的能力、實踐活動和應用的頂點。

主題曲目

按曲目瀏覽

跳入您關心的領域。每條賽道都有多個簡單的英文指南。

全庫

所有指南

117 1019 顯示指南。按曲目過濾或上方搜尋。

音訊人工智慧

編碼解碼器音訊壓縮

EnCodec 是 Meta 的高保真神經音訊編解碼器,它以極低的比特率壓縮語音和音樂,其品質可與更重的格式相媲美。

2 最小閱讀量閱讀
音訊人工智慧

殘差向量量化

殘差向量量化 (RVQ) 是一種透過重複量化將連續音訊嵌入轉換為緊湊的離散程式碼堆疊的技術…

2 最小閱讀量閱讀
音訊人工智慧

ECAPA-TDNN說話者識別

ECAPA-TDNN 是一種神經網路架構,可將任何語音片段轉換為緊湊的「聲紋」嵌入,使機器能夠辨別誰在說話。

2 最小閱讀量閱讀
音訊人工智慧

揚聲器反欺騙和 ASVspoof

反欺騙是偵測試圖欺騙語音認證系統的虛假或重播聲音的防禦層。

2 最小閱讀量閱讀
音訊人工智慧

使用 RNNoise 進行語音去噪

RNNoise 是一種微小、快速的神經網絡,可即時去除語音中的背景噪音。

2 最小閱讀量閱讀
音訊人工智慧

音訊嵌入和表示學習

音訊嵌入將聲音轉換為捕獲含義的緊湊數位向量,因此機器可以按照人類識別的方式對音訊進行比較、搜尋和分類…

2 最小閱讀量閱讀
音訊人工智慧

聲學迴聲消除

迴聲消除 (AEC) 是一項可阻止您在通話過程中聽到自己的聲音反彈的技術。

2 最小閱讀量閱讀
音訊人工智慧

語音分離和雞尾酒會問題

語音分離是將個人聲音從幾個人同時說話的錄音中分離出來的任務。

2 最小閱讀量閱讀
音訊人工智慧

排列不變訓練

排列不變訓練(PIT)是一種聰明的訓練技巧,它可以讓模型分離多個語音,而無需關心每個語音落在哪個輸出槽...

2 最小閱讀量閱讀
音訊人工智慧

音樂資訊檢索

音樂資訊檢索 (MIR) 是教導電腦從音訊訊號和樂譜中分析、理解和搜尋音樂的領域。

2 最小閱讀量閱讀
音訊人工智慧

Democs 和 HT-Demucs 音樂來源分離

了解 Demucs 和 HT-Demucs 如何使用波形、频谱图和变压器建模将音乐分离为人声和乐器主干。

2 最小閱讀量閱讀
音訊人工智慧

音訊和弦識別

音訊和弦辨識是直接從音訊自動標記歌曲中演奏的和弦的任務。

2 最小閱讀量閱讀

讀完了嗎?證明一下。

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.