Perpustakaan AI percuma

AI Audio panduanPercuma selamanya.

117 panduan bahasa Inggeris biasa, laluan pembelajaran berstruktur dan perpustakaan terbuka — dibina oleh 501(c)(3) bukan untung bebas supaya sesiapa sahaja boleh memahami AI moden.

117Panduan percuma
1Jejak topik
~2 minSetiap panduan
~4hMasa membaca

Mulakan di sini

Lima kursus berasaskan hasil

Setiap kursus merangkumi hasil yang jelas, kompetensi yang dipetakan, aktiviti latihan, dan capstone terapan.

Jejak topik

Semak imbas mengikut trek

Lompat ke kawasan yang anda minati. Setiap trek mempunyai berbilang panduan bahasa Inggeris biasa.

Perpustakaan penuh

Semua panduan

117 daripada 1019 panduan yang ditunjukkan. Tapis mengikut trek atau carian di atas.

AI Audio

Suno dan Udio

Suno dan Udio ialah dua penjana muzik AI pengguna terkemuka yang menukar gesaan teks pendek menjadi lagu penuh, hampir-kualiti studio — lengkap dengan vokal…

2 min bacaBaca
AI Audio

Penjanaan Muzik Simbolik

Penjanaan muzik simbolik mencipta muzik sebagai notasi berstruktur — nota, nada, tempoh dan masa (selalunya sebagai MIDI) — bukannya sebagai audio mentah.

2 min bacaBaca
AI Audio

Pekali Cepstral Frekuensi Mel

Mel-Frequency Cepstral Coefficients (MFCCs) ialah set nombor padat yang meringkaskan bentuk spektrum frekuensi bunyi seperti cara telinga manusia melihat…

2 min bacaBaca
AI Audio

WaveNet

WaveNet, yang diperkenalkan oleh DeepMind pada 2016, merupakan rangkaian neural terobosan yang menjana audio mentah satu sampel pada satu masa, menghasilkan pertuturan yang sangat semula jadi…

2 min bacaBaca
AI Audio

Tacotron 2

Tacotron 2 ialah sistem teks-ke-pertuturan hujung ke hujung daripada Google (2017) yang menukar teks bertulis terus kepada mel-spektrogram, yang ditukar oleh vocoder saraf…

2 min bacaBaca
AI Audio

Pengesanan Deepfake Audio

Pengesanan palsu dalam audio ialah set teknik yang digunakan untuk mengetahui sama ada rakaman suara dituturkan oleh manusia sebenar atau disintesis/diklon oleh AI.

2 min bacaBaca
AI Audio

Pemodelan Prosody

Pemodelan prosodi mengajar mesin melodi pertuturan, irama, pic, tekanan, dan rentak yang sesuai dengan perkataan.

2 min bacaBaca
AI Audio

Sintesis Pertuturan Emosi

Sintesis pertuturan emosi menjana suara yang kedengaran gembira, sedih, marah atau tenang, bukan sahaja boleh difahami tetapi boleh dirasai.

2 min bacaBaca
AI Audio

Penukaran Suara

Penukaran suara mengubah pertuturan seseorang yang dirakam supaya ia kelihatan seperti dituturkan oleh orang lain, sambil mengekalkan perkataan dan masa asal.

2 min bacaBaca
AI Audio

Diarisasi pembesar suara

Diarisasi pembesar suara menjawab soalan "siapa yang bercakap bila?" dengan membahagikan rakaman audio kepada segmen yang dilabel mengikut identiti pembesar suara.

2 min bacaBaca
AI Audio

Pengesahan Penceramah

Pengesahan pembesar suara mengesahkan sama ada suara sepadan dengan identiti yang dituntut khusus, bertindak sebagai kata laluan berasaskan suara.

2 min bacaBaca
AI Audio

Pengesanan Aktiviti Suara

Pengesanan Aktiviti Suara (VAD) memutuskan, dari semasa ke semasa, sama ada isyarat audio mengandungi pertuturan manusia atau hanya senyap dan hingar.

2 min bacaBaca

Sudah habis membaca? Buktikan.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.