人工智慧基礎
了解人工智慧是什麼、系統如何學習、失敗的地方以及如何在不炒作的情況下判斷主張。
免費人工智慧庫
117 簡明英語指南、結構化學習路徑和開放圖書館——由獨立的 501(c)(3) 非營利組織構建,以便任何人都可以理解現代人工智慧。
從這裡開始
每門課程都包括明確的成果、映射的能力、實踐活動和應用的頂點。
了解人工智慧是什麼、系統如何學習、失敗的地方以及如何在不炒作的情況下判斷主張。
有效率地使用人工智慧,同時保護隱私、檢查輸出並維持人類責任。
評估工作場所用例、運行安全試點、衡量價值並負責任地傳達變更。
透過權利、公平、治理、安全和公共利益結果來分析人工智慧系統。
透過實務系統設計,了解語言模型、檢索、代理、評估、成本及部署保障。
主題曲目
跳入您關心的領域。每條賽道都有多個簡單的英文指南。
全庫
117 的 1019 顯示指南。按曲目過濾或上方搜尋。
波束成形使用多個麥克風在選定的方向上監聽,放大來自目標的聲音,同時抑制其他聲音。
音訊人工智慧Riffusion 是一種巧妙的技巧,透過將聲音視為圖片來產生音樂:它微調穩定擴散影像模型來繪製頻譜圖,然後…
音訊人工智慧了解 Google MusicLM 如何使用分層語意和聲學標記、SoundStream 和 MuLan 將文字提示轉換為連貫的音樂。
音訊人工智慧Noise2Noise 是一種訓練技巧,透過從成對的不同噪音中學習,模型可以在沒有看到乾淨參考的情況下學習消除噪音…
音訊人工智慧Conv-TasNet 是一種神經網絡,它透過直接處理原始聲音波形來分離混音音訊(就像兩個人同時說話)...
音訊人工智慧雙路徑 RNN (DPRNN) 是一種音訊分離架構,它將很長的音訊特徵序列分割成短的重疊區塊並處理它們...
音訊人工智慧Open-Unmix (UMX) 是一種開源深度學習系統,它將歌曲分成幾個部分:人聲、鼓、貝斯和其他樂器。
音訊人工智慧Whisper 單字對齊將每個轉錄單字固定到音訊中的準確開始和結束時間。
音訊人工智慧音樂標籤使用 Transformer 模型來聆聽歌曲並預測描述性標籤,例如流派、情緒、樂器和節奏。
音訊人工智慧起始點偵測可找到音訊訊號中音符、節拍或聲音開始的精確時刻。
音訊人工智慧MelGAN 是一種基於 GAN 的全卷積聲碼器,可在單次快速前向傳遞中將梅爾聲譜圖轉換為原始音訊波形。
音訊人工智慧UnivNet 是一種 GAN 聲碼器,它使用在不同 STFT 解析度下計算的多個頻譜圖來判斷產生的音頻,從而銳化高頻細節。