Yayasan AI
Understand what AI is, how systems learn, where they fail, and how to judge claims without hype.
Perpustakaan AI gratis
117 panduan berbahasa Inggris sederhana, jalur pembelajaran terstruktur, dan perpustakaan terbuka — dibuat oleh lembaga nonprofit 501(c)(3) independen sehingga siapa pun dapat memahami AI modern.
Mulai di sini
Each course includes explicit outcomes, mapped competencies, practice activities, and an applied capstone.
Understand what AI is, how systems learn, where they fail, and how to judge claims without hype.
Use AI productively while protecting privacy, checking outputs, and preserving human accountability.
Evaluate workplace use cases, run safe pilots, measure value, and communicate changes responsibly.
Analyze AI systems through rights, equity, governance, safety, and public-interest outcomes.
Understand language models, retrieval, agents, evaluation, cost, and deployment safeguards through practical system design.
Trek topik
Lompatlah ke area yang Anda minati. Setiap trek memiliki beberapa panduan berbahasa Inggris.
Perpustakaan lengkap
117 dari 1019 panduan yang ditampilkan. Filter berdasarkan trek atau cari di atas.
Mimi adalah codec audio saraf yang memampatkan ucapan menjadi aliran kecil token terpisah secara real-time, sehingga model AI dapat mendengarkan dan berbicara dengan kecepatan sangat rendah…
Audio AIListen, Attend and Spell (LAS) adalah jaringan saraf penting tahun 2015 yang mentranskripsikan ucapan langsung menjadi karakter, tanpa pengucapan buatan tangan…
Audio AISpecAugment adalah metode augmentasi data yang sederhana namun kuat yang menutupi dan membengkokkan spektogram ucapan untuk membuat model pengenalan lebih kuat.
Audio AIPemberian tag otomatis musik menggunakan pembelajaran mesin untuk mendengarkan lagu dan secara otomatis melampirkan label deskriptif seperti genre, suasana hati, instrumen, dan tempo.
Audio AITransfer timbre membentuk kembali 'warna nada' audio sehingga satu instrumen terdengar seperti instrumen lainnya, mengubah melodi yang disenandungkan menjadi biola atau baris terompet…
Audio AIKlasifikasi adegan akustik (ASC) melatih mesin untuk mengenali lingkungan tempat rekaman dibuat, jalan yang sibuk, taman yang sepi, kereta api, kafe…
Audio AINVIDIA Riva adalah SDK dengan akselerasi GPU untuk produksi AI ucapan (ASR, TTS, dan terjemahan), sedangkan NeMo adalah perangkat sumber terbuka untuk pelatihan dan penyempurnaan…
Audio AIDeepSpeech adalah model pengenalan ucapan ujung ke ujung yang diperkenalkan oleh Baidu pada tahun 2014 yang memetakan fitur audio mentah langsung ke teks menggunakan jaringan saraf berulang…
Audio AIVektor X adalah sidik jari numerik dengan panjang tetap dari suara pembicara yang dihasilkan oleh jaringan saraf, digunakan untuk mengetahui siapa yang berbicara, apa pun yang mereka katakan.
Audio AIGlow-TTS adalah model text-to-speech yang belajar menyelaraskan teks ke ucapan menggunakan trik pencarian cerdas, sehingga menghilangkan kebutuhan akan perata terpisah.
Audio AIParallel WaveGAN adalah vocoder saraf cepat yang mengubah spektogram mel menjadi bentuk gelombang audio mentah menggunakan GAN kecil, menghasilkan semua sampel sekaligus.
Audio AIWaveGlow adalah vocoder saraf berbasis aliran dari NVIDIA yang mensintesis bentuk gelombang ucapan dari mel-spektogram dalam satu lintasan tanpa autoregresi.
Check what you learned with topic quizzes, then explore our structured courses and current certification requirements. Core guides remain free to read.