Perpustakaan AI gratis

Audio AI panduanGratis selamanya.

117 panduan berbahasa Inggris sederhana, jalur pembelajaran terstruktur, dan perpustakaan terbuka — dibuat oleh lembaga nonprofit 501(c)(3) independen sehingga siapa pun dapat memahami AI modern.

117Panduan gratis
1Trek topik
~2 minSesuai panduan
~4hReading time

Mulai di sini

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Trek topik

Jelajahi berdasarkan trek

Lompatlah ke area yang Anda minati. Setiap trek memiliki beberapa panduan berbahasa Inggris.

Perpustakaan lengkap

Semua panduan

117 dari 1019 panduan yang ditampilkan. Filter berdasarkan trek atau cari di atas.

Audio AI

Pemisahan Batang Spleeter

Sleeter adalah alat sumber terbuka dari Deezer yang membagi lagu jadi menjadi trek terpisah (vokal, drum, bass, dan lainnya) menggunakan pembelajaran mendalam.

2 min bacaBaca
Audio AI

Estimasi Pitch CREPE

CREPE adalah model pembelajaran mendalam yang memperkirakan frekuensi dasar (pitch) sinyal audio monofonik langsung dari bentuk gelombang mentahnya.

2 min bacaBaca
Audio AI

Metrik Kualitas Ucapan PESQ dan STOI

PESQ dan STOI adalah metrik objektif standar yang menilai seberapa baik proses ucapan terdengar dan seberapa mudah dimengerti, tanpa memerlukan pendengar manusia.

2 min bacaBaca
Audio AI

Vocoding Sumber-Filter dan DUNIA

Vocoder adalah alat yang memisahkan ucapan menjadi blok-blok penyusunnya dan membangunnya kembali.

2 min bacaBaca
Audio AI

Evaluasi Skor Opini Berarti

Mean Opinion Score (MOS) adalah nilai rata-rata 1 hingga 5 dari pendengar manusia yang mengukur seberapa bagus suara audio yang disintesis atau ditransmisikan.

2 min bacaBaca
Audio AI

Transformasi Constant-Q untuk Audio

Constant-Q Transform (CQT) adalah analisis frekuensi yang menggunakan nampan dengan jarak logaritmik yang disesuaikan dengan nada musik, bukan nampan dengan jarak yang sama…

2 min bacaBaca
Audio AI

Fitur Filterbank dan PLP

Fitur Filterbank dan Perceptual Linear Prediction (PLP) adalah cara meringkas sinyal ucapan menjadi angka-angka yang ringkas dan bermakna secara persepsi yang mesin…

2 min bacaBaca
Audio AI

Difusi Gaya StyleTTS 2

StyleTTS 2 adalah model text-to-speech yang memperlakukan 'gaya' suara — prosodi, emosi, dan timbre pembicara — sebagai variabel acak yang diambil sampelnya dengan model difusi…

2 min bacaBaca
Audio AI

TTS yang Dapat Dikendalikan Pitch FastPitch

FastPitch adalah model text-to-speech non-autoregresif yang secara eksplisit memprediksi nada (frekuensi dasar) dari setiap token masukan, sehingga memungkinkan Anda…

2 min bacaBaca
Audio AI

Pembuatan Ucapan Pencocokan Aliran Kotak Suara

Voicebox adalah model pembuatan ucapan berpanduan teks dari Meta yang dilatih dengan tujuan pencocokan aliran untuk 'mengisi' audio yang disamarkan, sehingga satu model dapat melakukan suara zero-shot…

2 min bacaBaca
Audio AI

Tantangan Peredam Kebisingan Dalam

Tantangan Deep Noise Suppression (DNS) adalah kompetisi yang diselenggarakan oleh Microsoft yang mendorong para peneliti untuk membangun jaringan saraf yang menghilangkan kebisingan latar belakang…

2 min bacaBaca
Audio AI

Pengurangan Spektral dan Penyaringan Wiener

Pengurangan spektral dan pemfilteran Wiener adalah metode klasik pengurangan kebisingan sebelum pembelajaran mendalam.

2 min bacaBaca

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.