มูลนิธิเอไอ
เข้าใจว่า AI คืออะไร ระบบเรียนรู้อย่างไร จุดที่ล้มเหลว และวิธีตัดสินข้อกล่าวหาโดยไม่โฆษณาเกินจริง
ห้องสมุด AI ฟรี
117 คู่มือภาษาอังกฤษธรรมดา เส้นทางการเรียนรู้ที่มีโครงสร้าง และห้องสมุดเปิด — สร้างโดยองค์กรอิสระ 501(c)(3) เพื่อให้ทุกคนสามารถเข้าใจ AI สมัยใหม่ได้
เริ่มที่นี่
แต่ละหลักสูตรประกอบด้วยผลลัพธ์ที่ชัดเจน สมรรถนะที่วางแผนไว้ กิจกรรมฝึกปฏิบัติ และสรุปผลประยุกต์
เข้าใจว่า AI คืออะไร ระบบเรียนรู้อย่างไร จุดที่ล้มเหลว และวิธีตัดสินข้อกล่าวหาโดยไม่โฆษณาเกินจริง
ใช้ AI อย่างมีประสิทธิภาพในขณะที่ปกป้องความเป็นส่วนตัว ตรวจสอบผลลัพธ์ และรักษาความรับผิดชอบของมนุษย์
ประเมินกรณีการใช้งานในที่ทำงาน ดำเนินการนำร่องอย่างปลอดภัย วัดคุณค่า และสื่อสารการเปลี่ยนแปลงอย่างมีความรับผิดชอบ
วิเคราะห์ระบบ AI ผ่านผลลัพธ์ด้านสิทธิ ความเท่าเทียม การกำกับดูแล ความปลอดภัย และผลประโยชน์สาธารณะ
ทำความเข้าใจโมเดลภาษา การดึงข้อมูล ตัวแทน การประเมิน ต้นทุน และการป้องกันการใช้งานผ่านการออกแบบระบบที่ใช้งานได้จริง
แทร็กหัวข้อ
กระโดดเข้าไปในพื้นที่ที่คุณสนใจ ทุกแทร็กมีไกด์ภาษาอังกฤษธรรมดาหลายเล่ม
ห้องสมุดเต็มรูปแบบ
117 ของ 1019 คำแนะนำที่แสดง กรองตามเพลงหรือค้นหาด้านบน
Mimi เป็นตัวแปลงสัญญาณเสียงแบบนิวรัลที่บีบอัดคำพูดเป็นสตรีมโทเค็นแยกส่วนเล็กๆ ในแบบเรียลไทม์ ดังนั้นโมเดล AI จึงสามารถฟังและพูดด้วยความถี่ที่ต่ำมาก...
เสียงเอไอListen, Attend and Spell (LAS) คือโครงข่ายประสาทเทียมที่สำคัญในปี 2015 ที่ถอดเสียงคำพูดเป็นอักขระโดยตรง โดยไม่ต้องออกเสียงด้วยมือ...
เสียงเอไอSpecAugment เป็นวิธีการเพิ่มข้อมูลที่เรียบง่ายแต่ทรงพลัง ซึ่งปิดบังและบิดเบือนสเปกตรัมของเสียงพูด เพื่อทำให้โมเดลการรู้จำมีประสิทธิภาพมากขึ้น
เสียงเอไอการแท็กอัตโนมัติของเพลงใช้การเรียนรู้ของเครื่องเพื่อฟังเพลงและแนบป้ายกำกับที่อธิบาย เช่น แนวเพลง อารมณ์ เครื่องดนตรี และจังหวะโดยอัตโนมัติ
เสียงเอไอการถ่ายโอน Timbre จะปรับ 'โทนสี' ของเสียงใหม่ เพื่อให้เครื่องดนตรีชิ้นหนึ่งมีเสียงเหมือนอีกชิ้นหนึ่ง โดยเปลี่ยนทำนองฮัมเพลงให้เป็นไวโอลินหรือแนวทรัมเป็ต...
เสียงเอไอการจำแนกฉากอะคูสติก (ASC) ฝึกเครื่องให้จดจำสภาพแวดล้อมในการบันทึก ถนนที่พลุกพล่าน สวนสาธารณะที่เงียบสงบ รถไฟ ร้านกาแฟ...
เสียงเอไอNVIDIA Riva เป็น SDK ที่เร่งด้วย GPU สำหรับการผลิตคำพูด AI (ASR, TTS และการแปล) ในขณะที่ NeMo เป็นชุดเครื่องมือโอเพ่นซอร์สสำหรับการฝึกอบรมและการปรับแต่ง...
เสียงเอไอDeepSpeech คือโมเดลการรู้จำคำพูดแบบ end-to-end ที่เปิดตัวโดย Baidu ในปี 2014 ซึ่งจับคู่คุณสมบัติเสียงดิบกับข้อความโดยตรงโดยใช้ระบบประสาทที่เกิดซ้ำ
เสียงเอไอเวกเตอร์ X คือลายนิ้วมือตัวเลขที่มีความยาวคงที่ของเสียงของผู้พูดที่ผลิตโดยโครงข่ายประสาทเทียม ซึ่งใช้เพื่อบอกว่าใครกำลังพูดไม่ว่าพวกเขาจะพูดอะไรก็ตาม
เสียงเอไอGlow-TTS คือโมเดลการอ่านออกเสียงข้อความที่เรียนรู้ที่จะจัดข้อความเป็นคำพูดด้วยตัวเองโดยใช้เคล็ดลับการค้นหาที่ชาญฉลาด โดยไม่จำเป็นต้องใช้เครื่องมือจัดตำแหน่งแยกต่างหาก
เสียงเอไอParallel WaveGAN เป็นตัวแปลงเสียงแบบนิวรอลที่รวดเร็ว ซึ่งเปลี่ยนเมลสเปกโตรแกรมให้กลายเป็นรูปคลื่นเสียงดิบโดยใช้ GAN ขนาดเล็ก เพื่อสร้างตัวอย่างทั้งหมดในคราวเดียว
เสียงเอไอWaveGlow คือเครื่องแปลงเสียงแบบนิวรัลแบบโฟลว์จาก NVIDIA ที่สังเคราะห์รูปคลื่นคำพูดจากเมลสเปกโตรแกรมในการส่งผ่านครั้งเดียวโดยไม่มีการถดถอยอัตโนมัติ
Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.