ห้องสมุด AI ฟรี

เสียงเอไอ คำแนะนำฟรีตลอดไป

117 คู่มือภาษาอังกฤษธรรมดา เส้นทางการเรียนรู้ที่มีโครงสร้าง และห้องสมุดเปิด — สร้างโดยองค์กรอิสระ 501(c)(3) เพื่อให้ทุกคนสามารถเข้าใจ AI สมัยใหม่ได้

117คำแนะนำฟรี
1แทร็กหัวข้อ
~2 minต่อไกด์
~4hเวลาการอ่าน

เริ่มที่นี่

ห้า หลักสูตรที่เน้นผลลัพธ์

แต่ละหลักสูตรประกอบด้วยผลลัพธ์ที่ชัดเจน สมรรถนะที่วางแผนไว้ กิจกรรมฝึกปฏิบัติ และสรุปผลประยุกต์

01

มูลนิธิเอไอ

เข้าใจว่า AI คืออะไร ระบบเรียนรู้อย่างไร จุดที่ล้มเหลว และวิธีตัดสินข้อกล่าวหาโดยไม่โฆษณาเกินจริง

  1. 1เอไอคืออะไร?
  2. 2AI เรียนรู้อย่างไร
  3. 3อธิบายโมเดล AI
  4. 4เกณฑ์มาตรฐาน AI
~4h เพื่อเติมเต็มดูหลักสูตร
02

ผู้ใช้ AI ที่มีความรับผิดชอบ

ใช้ AI อย่างมีประสิทธิภาพในขณะที่ปกป้องความเป็นส่วนตัว ตรวจสอบผลลัพธ์ และรักษาความรับผิดชอบของมนุษย์

  1. 1Prompt Engineering
  2. 2AI ภาพหลอน
  3. 3AI และความเป็นส่วนตัว
  4. 4AI ในชีวิตประจำวัน
~5h เพื่อเติมเต็มดูหลักสูตร
03

AI ในงาน

ประเมินกรณีการใช้งานในที่ทำงาน ดำเนินการนำร่องอย่างปลอดภัย วัดคุณค่า และสื่อสารการเปลี่ยนแปลงอย่างมีความรับผิดชอบ

  1. 1AI เวิร์กโฟลว์อัตโนมัติ
  2. 2เกณฑ์มาตรฐาน AI
  3. 3AI และงาน
  4. 4ธรรมาภิบาลของ AI
~6h เพื่อเติมเต็มดูหลักสูตร
04

นโยบาย AI และสังคม

วิเคราะห์ระบบ AI ผ่านผลลัพธ์ด้านสิทธิ ความเท่าเทียม การกำกับดูแล ความปลอดภัย และผลประโยชน์สาธารณะ

  1. 1จริยธรรม AI
  2. 2AI และความเป็นส่วนตัว
  3. 3ระเบียบเอไอ
  4. 4ตำนานเกี่ยวกับ AI
~6h เพื่อเติมเต็มดูหลักสูตร
05

การสร้างด้วยระบบ AI

ทำความเข้าใจโมเดลภาษา การดึงข้อมูล ตัวแทน การประเมิน ต้นทุน และการป้องกันการใช้งานผ่านการออกแบบระบบที่ใช้งานได้จริง

  1. 1ChatGPT และ LLM
  2. 2คุณภาพการดึงข้อมูล
  3. 3ตัวแทนเอไอ
  4. 4เกณฑ์มาตรฐาน AI
~8h เพื่อเติมเต็มดูหลักสูตร

แทร็กหัวข้อ

เรียกดูตามแทร็ก

กระโดดเข้าไปในพื้นที่ที่คุณสนใจ ทุกแทร็กมีไกด์ภาษาอังกฤษธรรมดาหลายเล่ม

ความรู้พื้นฐานแนวคิดหลัก: AI ทำงานอย่างไรในระดับสูง84 คำแนะนำ ภาษาเอไอLLM, NLP, ChatGPT, การกระตุ้นเตือน และการทำความเข้าใจข้อความ155 คำแนะนำ วิชวลเอไอการสร้างภาพ คอมพิวเตอร์วิทัศน์ วีดิทัศน์ และการออกแบบ133 คำแนะนำ เสียงเอไอเสียง เพลง พ็อดแคสต์ และ AI ที่เน้นเสียงเป็นอันดับแรก117 คำแนะนำ บริษัทโปรไฟล์ของ OpenAI, Anthropic, Google, Meta และอื่นๆ121 คำแนะนำ การใช้งานAI ปรากฏในการเขียนโค้ด การค้นหา เจ้าหน้าที่ และชีวิตประจำวันอย่างไร111 คำแนะนำ อุตสาหกรรมAI ในด้านการดูแลสุขภาพ การเงิน การศึกษา พลังงาน และอื่นๆ91 คำแนะนำ เทคนิคชิป, การปรับแต่งแบบละเอียด, RAG, เวกเตอร์ และโครงสร้างพื้นฐาน AI177 คำแนะนำ สังคมอคติ ความเป็นส่วนตัว ลิขสิทธิ์ ความปลอดภัย และอนาคตของ AI30 คำแนะนำ

ห้องสมุดเต็มรูปแบบ

คำแนะนำทั้งหมด

117 ของ 1019 คำแนะนำที่แสดง กรองตามเพลงหรือค้นหาด้านบน

เสียงเอไอ

DiffWave การแพร่กระจาย Vocoder

DiffWave เป็นโวโคเดอร์แบบกระจายที่สังเคราะห์เสียงโดยการลดสัญญาณรบกวนแบบสุ่มซ้ำๆ ให้กลายเป็นรูปคลื่น โดยมีเงื่อนไขบนเมลสเปกโตรแกรม

2 นาทีอ่านอ่าน
เสียงเอไอ

โมเดลเสียง Bark Generative

Bark เป็นโมเดลการแปลงข้อความเป็นเสียงโอเพ่นซอร์สจาก Suno ที่ไม่เพียงสร้างคำพูดเท่านั้น แต่ยังสร้างเสียงหัวเราะ เสียงถอนหายใจ ดนตรี และเสียงเอฟเฟกต์โดยตรงจากข้อความแจ้ง

2 นาทีอ่านอ่าน
เสียงเอไอ

การสังเคราะห์แบบถดถอยอัตโนมัติของเต่า TTS

Tortoise TTS คือระบบการอ่านออกเสียงข้อความแบบโอเพ่นซอร์สที่ได้รับรางวัลจากเสียงที่เป็นธรรมชาติและเต็มไปด้วยอารมณ์และการโคลนเสียงที่หนักแน่นจากโปรแกรมสั้น ๆ เพียงไม่กี่รายการ

2 นาทีอ่านอ่าน
เสียงเอไอ

การโคลนเสียงข้ามภาษา XTTS

XTTS คือโมเดลการอ่านออกเสียงข้อความหลายภาษาของ Coqui ที่สามารถโคลนเสียงจากคลิปสั้น ๆ แล้วพูดในภาษาต่างๆ มากมาย ในขณะที่ยังคง...

2 นาทีอ่านอ่าน
เสียงเอไอ

การสร้างเสียงแบบขนาน SoundStorm

SoundStorm คือโมเดลการสร้างเสียง Google ที่สร้างเสียงพูดและเสียงแบบขนานแทนที่จะเป็นโทเค็นทีละอัน ทำให้การสังเคราะห์เสียงคุณภาพสูง...

2 นาทีอ่านอ่าน
เสียงเอไอ

การสังเคราะห์ข้อความเป็นเสียง AudioGen

AudioGen เป็นโมเดล Meta ที่เปลี่ยนคำอธิบายข้อความให้เป็นเสียงสิ่งแวดล้อมและเอฟเฟกต์เสียงที่สมจริง เช่น "สุนัขเห่าในขณะที่นกร้องเจี๊ยก ๆ"

2 นาทีอ่านอ่าน
เสียงเอไอ

การกระจายเสียงแฝงที่เสถียร

Stable Audio คือระบบแปลงข้อความเป็นเสียงของ Stability AI ที่ใช้การแพร่กระจายแฝงเพื่อสร้างเพลงและเอฟเฟกต์เสียง พร้อมการควบคุมความยาวคลิปอย่างชัดเจน

2 นาทีอ่านอ่าน
เสียงเอไอ

ชุดเครื่องมือรู้จำเสียง Kaldi

Kaldi เป็นชุดเครื่องมือโอเพ่นซอร์สฟรีที่กลายเป็นแพลตฟอร์มการวิจัยที่โดดเด่นสำหรับการสร้างระบบการรู้จำเสียง

2 นาทีอ่านอ่าน
เสียงเอไอ

Wav2Letter ASR แบบหมุนวน

Wav2Letter เป็นระบบรู้จำเสียงตั้งแต่ต้นทางถึงปลายทางจาก Facebook AI ที่ใช้เฉพาะโครงข่ายประสาทเทียมแบบหมุนวนเท่านั้น โดยไม่มีการทำซ้ำ

2 นาทีอ่านอ่าน
เสียงเอไอ

แจสเปอร์และ QuartzNet ASR

Jasper และ QuartzNet เป็นโมเดลการรู้จำเสียงพูดแบบ end-to-end ของ NVIDIA โดยที่ QuartzNet เป็นการออกแบบใหม่ที่มีขนาดเล็กลงอย่างมากและมีประสิทธิภาพ...

2 นาทีอ่านอ่าน
เสียงเอไอ

แบบจำลองการแพร่กระจายสำหรับเสียง

โมเดลการแพร่กระจายจะสร้างเสียงโดยการเรียนรู้ที่จะย้อนกลับกระบวนการส่งเสียงรบกวนทีละขั้นตอน เปลี่ยนเสียงรบกวนแบบสุ่มให้เป็นคำพูด เพลง หรือเอฟเฟกต์เสียงที่สอดคล้องกัน

2 นาทีอ่านอ่าน
เสียงเอไอ

การตรวจจับเหตุการณ์เสียง

การตรวจจับเหตุการณ์เสียง (SED) ระบุเสียงที่เกิดขึ้นในสตรีมเสียง และเวลาที่เสียงเริ่มและหยุดอย่างชัดเจน

2 นาทีอ่านอ่าน

อ่านจบหรือยัง?พิสูจน์สิ

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.

Audio AI AI Guides — Page 7 of 10 | AI Understanding