Perpustakaan AI gratis

Audio AI panduanGratis selamanya.

117 panduan berbahasa Inggris sederhana, jalur pembelajaran terstruktur, dan perpustakaan terbuka — dibuat oleh lembaga nonprofit 501(c)(3) independen sehingga siapa pun dapat memahami AI modern.

117Panduan gratis
1Trek topik
~2 minSesuai panduan
~4hReading time

Mulai di sini

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Trek topik

Jelajahi berdasarkan trek

Lompatlah ke area yang Anda minati. Setiap trek memiliki beberapa panduan berbahasa Inggris.

Perpustakaan lengkap

Semua panduan

117 dari 1019 panduan yang ditampilkan. Filter berdasarkan trek atau cari di atas.

Audio AI

Array Beamforming dan Mikrofon

Beamforming menggunakan beberapa mikrofon untuk mendengarkan arah yang dipilih, memperkuat suara dari target sekaligus meredam suara lainnya.

2 min bacaBaca
Audio AI

Difusi Spektogram Rifusi

Riffusion adalah peretasan cerdas yang menghasilkan musik dengan memperlakukan suara sebagai gambar: Riffusion menyempurnakan model gambar Difusi Stabil untuk melukiskan spektogram, lalu…

2 min bacaBaca
Audio AI

MusicLM: Token Semantik dan Akustik Hierarki

Pelajari bagaimana Google MusicLM menggunakan token semantik dan akustik hierarki, SoundStream, dan MuLan untuk mengubah perintah teks menjadi musik yang koheren.

2 min bacaBaca
Audio AI

Peningkatan Ucapan Noise2Noise

Noise2Noise adalah trik pelatihan yang memungkinkan model belajar menghilangkan kebisingan tanpa pernah melihat referensi yang bersih, dengan belajar dari pasangan kebisingan yang berbeda…

2 min bacaBaca
Audio AI

Pemisahan Domain Waktu Konv-TasNet

Conv-TasNet adalah jaringan saraf yang memisahkan audio campuran (seperti dua orang berbicara sekaligus) dengan bekerja langsung pada bentuk gelombang suara mentah…

2 min bacaBaca
Audio AI

Pemisahan RNN Jalur Ganda

Dual-Path RNN (DPRNN) adalah arsitektur pemisahan audio yang membagi rangkaian fitur audio yang sangat panjang menjadi potongan-potongan pendek yang tumpang tindih dan memprosesnya…

2 min bacaBaca
Audio AI

Pemisahan Musik Terbuka-Unmix

Open-Unmix (UMX) adalah sistem pembelajaran mendalam sumber terbuka yang membagi lagu menjadi beberapa bagian: vokal, drum, bass, dan instrumen lainnya.

2 min bacaBaca
Audio AI

Penyelarasan Kata dengan Stempel Waktu Bisikan

Penyelarasan kata bisikan menyematkan setiap kata yang ditranskripsikan ke waktu mulai dan berakhir yang tepat dalam audio.

2 min bacaBaca
Audio AI

Penandaan Musik dengan Transformers

Penandaan musik menggunakan model transformator untuk mendengarkan lagu dan memprediksi label deskriptif seperti genre, suasana hati, instrumen, dan tempo.

2 min bacaBaca
Audio AI

Deteksi Onset dalam Audio

Deteksi permulaan menemukan momen yang tepat ketika nada, ketukan, atau suara dimulai dalam sinyal audio.

2 min bacaBaca
Audio AI

Vocoder Generatif MelGAN

MelGAN adalah vocoder berbasis GAN yang sepenuhnya konvolusional yang mengubah mel-spektogram menjadi bentuk gelombang audio mentah dalam satu fast forward pass.

2 min bacaBaca
Audio AI

Vocoder Multi-Resolusi UnivNet

UnivNet adalah vocoder GAN yang menilai audio yang dihasilkan menggunakan beberapa spektogram yang dihitung pada resolusi STFT berbeda, sehingga mempertajam detail frekuensi tinggi.

2 min bacaBaca

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.