Perpustakaan AI gratis

Audio AI panduanGratis selamanya.

117 panduan berbahasa Inggris sederhana, jalur pembelajaran terstruktur, dan perpustakaan terbuka — dibuat oleh lembaga nonprofit 501(c)(3) independen sehingga siapa pun dapat memahami AI modern.

117Panduan gratis
1Trek topik
~2 minSesuai panduan
~4hReading time

Mulai di sini

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Trek topik

Jelajahi berdasarkan trek

Lompatlah ke area yang Anda minati. Setiap trek memiliki beberapa panduan berbahasa Inggris.

Perpustakaan lengkap

Semua panduan

117 dari 1019 panduan yang ditampilkan. Filter berdasarkan trek atau cari di atas.

Audio AI

Suno dan Udio

Suno dan Udio adalah dua generator musik AI konsumen terkemuka yang mengubah perintah teks pendek menjadi lagu lengkap dengan kualitas mendekati studio — lengkap dengan vokal…

2 min bacaBaca
Audio AI

Generasi Musik Simbolik

Generasi musik simbolik menciptakan musik sebagai notasi terstruktur — nada, nada, durasi, dan pengaturan waktu (seringkali disebut MIDI) — bukan sebagai audio mentah.

2 min bacaBaca
Audio AI

Koefisien Cepstral Frekuensi Mel

Koefisien Cepstral Frekuensi Mel (MFCCs) adalah sekumpulan angka kompak yang merangkum bentuk spektrum frekuensi suara sesuai dengan persepsi telinga manusia…

2 min bacaBaca
Audio AI

GelombangNet

WaveNet, diperkenalkan oleh DeepMind pada tahun 2016, merupakan terobosan jaringan saraf yang menghasilkan audio mentah satu sampel dalam satu waktu, menghasilkan ucapan yang sangat alami…

2 min bacaBaca
Audio AI

Tacotron 2

Tacotron 2 adalah sistem text-to-speech ujung ke ujung dari Google (2017) yang mengubah teks tertulis langsung menjadi mel-spektogram, yang diubah oleh vocoder saraf…

2 min bacaBaca
Audio AI

Deteksi Audio Deepfake

Deteksi audio deepfake adalah serangkaian teknik yang digunakan untuk mengetahui apakah rekaman suara diucapkan oleh manusia sungguhan atau disintesis/dikloning oleh AI.

2 min bacaBaca
Audio AI

Pemodelan Prosodi

Pemodelan prosodi mengajarkan mesin melodi ucapan, ritme, nada, tekanan, dan tempo yang mengikuti kata-kata.

2 min bacaBaca
Audio AI

Sintesis Pidato Emosional

Sintesis ucapan emosional menghasilkan suara-suara yang terdengar bahagia, sedih, marah, atau tenang, tidak hanya dapat dimengerti tetapi juga dapat dirasakan.

2 min bacaBaca
Audio AI

Konversi Suara

Konversi suara mengubah rekaman ucapan seseorang sehingga terdengar seperti diucapkan oleh orang lain, sekaligus mempertahankan kata dan waktu aslinya.

2 min bacaBaca
Audio AI

Diarisasi Pembicara

Diarisasi pembicara menjawab pertanyaan "siapa yang berbicara kapan?" dengan membagi rekaman audio menjadi segmen-segmen yang diberi label berdasarkan identitas pembicara.

2 min bacaBaca
Audio AI

Verifikasi Pembicara

Verifikasi pembicara mengonfirmasi apakah suatu suara cocok dengan identitas spesifik yang diklaim, dan bertindak sebagai kata sandi berbasis suara.

2 min bacaBaca
Audio AI

Deteksi Aktivitas Suara

Deteksi Aktivitas Suara (VAD) menentukan, dari waktu ke waktu, apakah sinyal audio berisi ucapan manusia atau hanya keheningan dan kebisingan.

2 min bacaBaca

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.