ข้ามไปที่เนื้อหา
เรียนรู้
ข่าว
เครื่องมือ
งาน
ภารกิจ
ค้นหา
⌘K
English
บริจาค
เมนู
เริ่มที่นี่
เริ่มเรียนรู้
เรียนรู้
ไปที่ เรียนรู้
หลักสูตร
คู่มือ
ติวเตอร์ AI
ห้องสมุดพร้อมท์
ควิซ
ใบรับรอง
อภิธาน
ข่าว
ไปที่ ข่าว
ข่าวเอไอล่าสุด
เครื่องมือติดตามหัวข้อ
การวิจัยและชุดข้อมูล
Blog
มาตรฐานบรรณาธิการ
การแก้ไขข้อมูล
เครื่องมือ
ไปที่ เครื่องมือ
ไดเรกทอรีเครื่องมือ
รายการที่ดีที่สุด
เปรียบเทียบเครื่องมือ
เครื่องคำนวณต้นทุน
ช่างกลั่นพร้อมท์
ส่งเครื่องมือ
งาน
ไปที่ งาน
เรียกดูงาน AI
ลงประกาศงาน
สปอนเซอร์ AIU
ภารกิจ
ไปที่ ภารกิจ
ภารกิจ
ผลกระทบและสถิติ
ผู้เขียน
ศูนย์ช่วยเหลือ
มีอะไรใหม่
ช่วยเหลือ
บริจาค
บ้าน
/
อภิธานศัพท์
/
การเรียนรู้แบบเสริมกำลัง
คำศัพท์อภิธานศัพท์ AI
คืออะไร
การเรียนรู้แบบเสริมกำลัง
?
คำนิยาม
การฝึกอบรมโดยให้รางวัลเป็นสัญญาณว่าตัวแทนเรียนรู้การกระทำที่เพิ่มผลตอบแทนในระยะยาวสูงสุด
ข้อกำหนดที่เกี่ยวข้อง
การเรียนรู้การเสริมกำลังจากผลตอบรับของมนุษย์ (RLHF)
วิธีการฝึกอบรมที่ใช้สัญญาณความชอบของมนุษย์เพื่อกำหนดรูปแบบพฤติกรรมของโมเดล
โมเดลรางวัล
แบบจำลองที่ให้คะแนนเอาต์พุตตามสัญญาณการตั้งค่า ซึ่งมักใช้ในไปป์ไลน์ RLHF
ตัวแทนเอไอ
ระบบซอฟต์แวร์ที่สามารถสังเกต ให้เหตุผล และดำเนินการเพื่อให้บรรลุเป้าหมาย โดยมักใช้เครื่องมือและหน่วยความจำ
AI รัฐธรรมนูญ
แนวทางการฝึกอบรมและการกำหนดพฤติกรรมโดยที่ผลลัพธ์ของแบบจำลองได้รับการชี้นำโดยหลักการที่เป็นลายลักษณ์อักษรชุดตายตัว
เอเจนติค ลูป
วงจรวนซ้ำที่เจ้าหน้าที่ AI สังเกต วางแผน ดำเนินการ และไตร่ตรองจนกว่าจะบรรลุเป้าหมายหรือถึงภาวะหยุด
อ.ส.ค. (การเพิ่มประสิทธิภาพการตั้งค่าโดยตรง)
วิธีการฝึกอบรมที่ปรับแต่งโมเดลโดยตรงตามคู่ความชอบ โดยไม่ต้องใช้โมเดลรางวัลแยกต่างหาก
เรียนรู้เพิ่มเติมในคำแนะนำฟรีของเรา
Deep Learning
Reinforcement Learning
Machine Learning Basics
Supervised Learning
ดูเพิ่มเติม
Red Teaming
Recommendation System
Retrieval
Recall
RAG (Retrieval-Augmented Generation)
Robustness
Quantization
Safety Filter
Previous
Red Teaming
Next
Reinforcement Learning from Human Feedback (RLHF)
เรียกดูอภิธานศัพท์ AI ฉบับเต็ม
สำรวจคำแนะนำ AI ฟรีทั้งหมด