Asas AI
Fahami apa itu AI, bagaimana sistem belajar, di mana ia gagal, dan bagaimana menilai tuntutan tanpa keterujaan.
Perpustakaan AI percuma
117 panduan bahasa Inggeris biasa, laluan pembelajaran berstruktur dan perpustakaan terbuka — dibina oleh 501(c)(3) bukan untung bebas supaya sesiapa sahaja boleh memahami AI moden.
Mulakan di sini
Setiap kursus merangkumi hasil yang jelas, kompetensi yang dipetakan, aktiviti latihan, dan capstone terapan.
Fahami apa itu AI, bagaimana sistem belajar, di mana ia gagal, dan bagaimana menilai tuntutan tanpa keterujaan.
Gunakan AI secara produktif sambil melindungi privasi, memeriksa hasil, dan mengekalkan akauntabiliti manusia.
Nilai kes penggunaan di tempat kerja, jalankan perintis selamat, ukur nilai, dan komunikasikan perubahan dengan bertanggungjawab.
Analisis sistem AI melalui hak, kesakadilan, tadbir urus, keselamatan, dan hasil kepentingan awam.
Fahami model bahasa, pengambilan, ejen, penilaian, kos, dan perlindungan pelaksanaan melalui reka bentuk sistem yang praktikal.
Jejak topik
Lompat ke kawasan yang anda minati. Setiap trek mempunyai berbilang panduan bahasa Inggeris biasa.
Perpustakaan penuh
117 daripada 1019 panduan yang ditunjukkan. Tapis mengikut trek atau carian di atas.
Pengenalan lagu muka depan mengesan apabila dua rakaman bunyi yang sangat berbeza sebenarnya adalah lagu asas yang sama — versi akustik langsung, campuran semula…
AI AudioDDSP (Pemprosesan Isyarat Digital Boleh Dibezakan) menggabungkan blok binaan pensintesis klasik dengan rangkaian saraf, supaya pembelajaran mendalam boleh mengawal pengayun…
AI AudioVITS ialah model teks ke pertuturan yang menukar teks terus kepada bentuk gelombang audio mentah dalam satu sistem terlatih, melangkau saluran paip dua peringkat biasa.
AI AudioFastSpeech menjana keseluruhan spektrogram pertuturan secara selari dan bukannya satu bingkai pada satu masa, menjadikan sintesis secara dramatik lebih pantas dan lebih stabil.
AI AudioNaturalSpeech ialah barisan penyelidikan TTS Microsoft yang menyasarkan kualiti pertuturan peringkat manusia, dengan versi yang lebih baru menggunakan penyebaran terpendam untuk menjana kaya, semula jadi…
AI AudioSpeech Emotion Recognition (SER) ialah AI yang mengesan keadaan emosi penceramah — kemarahan, kegembiraan, kesedihan, kekecewaan — daripada bunyi suara mereka, bukan hanya…
AI AudioMoshi ialah AI suara masa nyata sumber terbuka daripada Kyutai yang bercakap dan mendengar pada masa yang sama — dupleks penuh — dan bukannya mengambil giliran yang ketat.
AI AudioTerjemahan Pertuturan ke Pertuturan (S2ST) mengambil perkataan yang dituturkan dalam satu bahasa dan menghasilkan perkataan yang dituturkan dalam bahasa yang lain — idealnya mengekalkan suara, nada…
AI AudioHiFi-GAN ialah vokoder permusuhan generatif yang menukar spektrogram mel menjadi bentuk gelombang audio mentah hampir serta-merta, menghasilkan pertuturan berkualiti studio jauh…
AI AudioPenukaran grafem-ke-fonem (G2P) menterjemah huruf bertulis kepada bunyi yang sepatutnya disebut oleh sistem pertuturan.
AI AudioNormalisasi teks ialah langkah hadapan yang menulis semula teks bertulis mentah menjadi perkataan yang dituturkan sepenuhnya sebelum sistem pertuturan menyebutnya.
AI AudioSoundStream ialah codec audio saraf hujung ke hujung Google yang memampatkan pertuturan dan muzik kepada kadar bit yang sangat rendah sambil mengekalkan kualiti.
Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.