Perpustakaan AI percuma

AI Audio panduanPercuma selamanya.

117 panduan bahasa Inggeris biasa, laluan pembelajaran berstruktur dan perpustakaan terbuka — dibina oleh 501(c)(3) bukan untung bebas supaya sesiapa sahaja boleh memahami AI moden.

117Panduan percuma
1Jejak topik
~2 minSetiap panduan
~4hMasa membaca

Mulakan di sini

Lima kursus berasaskan hasil

Setiap kursus merangkumi hasil yang jelas, kompetensi yang dipetakan, aktiviti latihan, dan capstone terapan.

Jejak topik

Semak imbas mengikut trek

Lompat ke kawasan yang anda minati. Setiap trek mempunyai berbilang panduan bahasa Inggeris biasa.

Perpustakaan penuh

Semua panduan

117 daripada 1019 panduan yang ditunjukkan. Tapis mengikut trek atau carian di atas.

AI Audio

Pembentukan Pancaran dan Tatasusunan Mikrofon

Pembentukan pancaran menggunakan berbilang mikrofon untuk mendengar ke arah yang dipilih, menguatkan bunyi daripada sasaran sambil menekan semua yang lain.

2 min bacaBaca
AI Audio

Resapan Spektrogram Riffusion

Riffusion ialah hack pintar yang menjana muzik dengan menganggap bunyi sebagai gambar: ia memperhalusi model imej Stable Diffusion untuk melukis spektrogram, kemudian…

2 min bacaBaca
AI Audio

MusicLM: Token Semantik dan Akustik Hierarki

Ketahui cara Google MusicLM menggunakan token semantik dan akustik hierarki, SoundStream dan MuLan untuk menukar gesaan teks kepada muzik yang koheren.

2 min bacaBaca
AI Audio

Peningkatan Pertuturan Noise2Noise

Noise2Noise ialah helah latihan yang membolehkan model belajar membuang hingar tanpa melihat rujukan yang bersih, dengan belajar daripada pasangan bising yang berbeza…

2 min bacaBaca
AI Audio

Pemisahan Masa-Domain Conv-TasNet

Conv-TasNet ialah rangkaian saraf yang memisahkan audio bercampur (seperti dua orang bercakap serentak) dengan bekerja terus pada bentuk gelombang bunyi mentah…

2 min bacaBaca
AI Audio

Pemisahan RNN Dwi Laluan

Dual-Path RNN (DPRNN) ialah seni bina pemisahan audio yang membahagikan jujukan ciri audio yang sangat panjang kepada ketulan bertindih pendek dan memprosesnya…

2 min bacaBaca
AI Audio

Pemisahan Muzik Open-Unmix

Open-Unmix (UMX) ialah sistem pembelajaran dalam sumber terbuka yang membahagikan lagu kepada bahagiannya: vokal, dram, bes dan instrumen lain.

2 min bacaBaca
AI Audio

Penjajaran Perkataan Dicap Masa Bisikan

Penjajaran perkataan berbisik menyematkan setiap perkataan yang ditranskripsikan kepada masa mula dan tamat yang tepat dalam audio.

2 min bacaBaca
AI Audio

Penandaan Muzik dengan Transformers

Penandaan muzik menggunakan model pengubah untuk mendengar lagu dan meramalkan label deskriptif seperti genre, mood, instrumen dan tempo.

2 min bacaBaca
AI Audio

Pengesanan Permulaan dalam Audio

Pengesanan permulaan mencari detik yang tepat apabila nota, rentak atau bunyi bermula dalam isyarat audio.

2 min bacaBaca
AI Audio

Vokoder Generatif MelGAN

MelGAN ialah vokoder berasaskan GAN konvolusi sepenuhnya yang menukar spektrogram mel kepada bentuk gelombang audio mentah dalam satu hantaran ke hadapan pantas.

2 min bacaBaca
AI Audio

Vokoder Berbilang Resolusi UnivNet

UnivNet ialah vocoder GAN yang menilai audio yang dijana menggunakan berbilang spektrogram yang dikira pada resolusi STFT yang berbeza, menajamkan perincian frekuensi tinggi.

2 min bacaBaca

Sudah habis membaca? Buktikan.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.