Perpustakaan AI gratis

Audio AI panduanGratis selamanya.

117 panduan berbahasa Inggris sederhana, jalur pembelajaran terstruktur, dan perpustakaan terbuka — dibuat oleh lembaga nonprofit 501(c)(3) independen sehingga siapa pun dapat memahami AI modern.

117Panduan gratis
1Trek topik
~2 minSesuai panduan
~4hReading time

Mulai di sini

Five outcome-based courses

Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.

Trek topik

Jelajahi berdasarkan trek

Lompatlah ke area yang Anda minati. Setiap trek memiliki beberapa panduan berbahasa Inggris.

Perpustakaan lengkap

Semua panduan

117 dari 1019 panduan yang ditampilkan. Filter berdasarkan trek atau cari di atas.

Audio AI

Teks Audio

Pemberian teks audio menghasilkan kalimat dalam bahasa alami yang mendeskripsikan konten klip audio, seperti 'klakson kereta api berbunyi saat melewati perlintasan sebidang.

2 min bacaBaca
Audio AI

Pengenalan Ucapan Bisikan

Whisper adalah sistem pengenalan ucapan otomatis sumber terbuka OpenAI yang mengubah audio menjadi teks dalam 90+ bahasa.

2 min bacaBaca
Audio AI

Wav2Vec 2.0

Wav2Vec 2.0 adalah Meta model ucapan AI yang diawasi sendiri dan mempelajari representasi audio yang kuat dari rekaman mentah dan tidak berlabel.

2 min bacaBaca
Audio AI

Pidato dengan Pengawasan Mandiri HuBERT

HuBERT (Hidden-Unit BERT) adalah Meta model ucapan mandiri AI yang belajar dengan memprediksi unit audio berkerumun untuk segmen bertopeng, gaya BERT.

2 min bacaBaca
Audio AI

Vocoder Neural

Vocoder saraf adalah model yang mengubah representasi akustik kompak, biasanya spektogram mel, menjadi bentuk gelombang suara yang sebenarnya.

2 min bacaBaca
Audio AI

Codec Audio Neural

Codec audio neural menggunakan pembelajaran mendalam untuk mengompresi suara menjadi aliran kecil token terpisah dan merekonstruksinya dengan fidelitas tinggi.

2 min bacaBaca
Audio AI

VALL-E dan Model Bahasa Codec

VALL-E membingkai ulang text-to-speech sebagai masalah pemodelan bahasa melalui token codec audio, memungkinkan kloning suara hanya dari sampel tiga detik.

2 min bacaBaca
Audio AI

OpenAI Bisikan

Whisper adalah sistem pengenalan ucapan otomatis sumber terbuka OpenAI yang mentranskripsikan dan menerjemahkan audio lisan dalam berbagai bahasa.

2 min bacaBaca
Audio AI

Transkripsi Musik Otomatis

Transkripsi Musik Otomatis (AMT) mengubah rekaman audio mentah musik menjadi notasi simbolis seperti lembaran musik, MIDI, atau piano roll.

2 min bacaBaca
Audio AI

Pelacakan Ketukan dan Tempo

Pelacakan ketukan dan tempo adalah tugas untuk menemukan denyut yang stabil dalam musik: di mana setiap ketukan jatuh dan seberapa cepat lagu bergerak dalam ketukan per menit (BPM).

2 min bacaBaca
Audio AI

Sidik Jari Audio

Sidik jari audio menghasilkan tanda tangan digital yang ringkas dan tahan kebisingan sehingga dapat dikenali di kemudian hari, bahkan melalui kebisingan latar belakang…

2 min bacaBaca
Audio AI

kotak juke

Jukebox adalah jaringan saraf OpenAI tahun 2020 yang menghasilkan audio musik mentah — lengkap dengan suara nyanyian, instrumen, dan bahkan lirik dalam gaya tertentu…

2 min bacaBaca

Finished reading? Prove it.

Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.