อัพเดททุกวัน2268 เรื่องราวที่ได้รับการยืนยัน

ข่าวเอไอ ปราศจากเสียงรบกวน

การรายงานข่าว AI ที่ตรวจสอบแหล่งที่มาเกี่ยวกับการเปิดตัวผลิตภัณฑ์ การเปลี่ยนแปลงนโยบาย การวิจัยด้านความปลอดภัย และการเคลื่อนไหวในอุตสาหกรรม ซึ่งอธิบายเป็นภาษาอังกฤษง่าย ๆ โดยทีมการศึกษาขององค์กรไม่แสวงหากําไร

คลังข่าว

คลังข่าว AI — หน้า 189

เรื่องราว AI ที่ตรวจสอบแหล่งที่มา ใหม่ล่าสุดก่อน สำหรับผู้ที่ต้องการเข้าใจ AI โดยไม่ต้องไล่ตามกระแส

Source-page capture accompanying Paper Argues Evolution Strategies Beat RL at Keeping LLM Answer Sets Diverseเรื่องเด่นนวัตกรรม7 min อ่าน

Paper Argues Evolution Strategies เอาชนะ RL ในการรักษาคำตอบ LLM ทำให้มีความหลากหลาย

การพิมพ์ล่วงหน้าของ arXiv ใหม่ให้เหตุผลว่า LLM หลังการฝึกอบรมที่มีกลยุทธ์วิวัฒนาการ ซึ่งเป็นวิธีการแบบอิงตามประชากร ไม่มีการไล่ระดับสี ซึ่งรบกวนน้ำหนักโดยตรง เหนือกว่าการเรียนรู้แบบเสริมกำลังบน pass@k และความครอบคลุมของโซลูชัน บทคัดย่ออ้างอิงผลลัพธ์ทางคณิตศาสตร์เปรียบเทียบได้ดีกว่า แต่ไม่มีการระบุชื่อแบบจำลอง การวัดประสิทธิภาพ หรือตัวเลขอ่านเรื่องราวแหล่งที่มาที่ได้รับการยืนยัน: arxiv.org

แหล่งที่มาที่ได้รับการยืนยัน

ทุกเรื่องราวเชื่อมโยงกับหลักฐานที่แข็งแกร่งที่สุดที่มีอยู่: แหล่งข่าวต้นฉบับเมื่อมี หรือรายงานที่ชัดเจนว่ามีแหล่งอ้างอิง

ภาษาอังกฤษธรรมดา

เกิดอะไรขึ้น เหตุใดจึงสำคัญ และจะดูอะไรดี โดยไม่มีศัพท์เฉพาะ

ไม่มีฟิลเลอร์

เมื่อสัญญาณเบาบาง เราจะไม่เผยแพร่สิ่งใดนอกจากการเติมฟีด

9 เรื่องราว
  1. นวัตกรรมนวัตกรรม6 min อ่าน

    CABS+ Paper รายงานการรวมโมเดลที่ถูกกว่าและเร็วกว่าในชุดข้อมูล 27 ชุด

    การพิมพ์ล่วงหน้าที่โพสต์ไปที่ arXiv จะอธิบาย CABS+ ซึ่งเป็นวิธีการผสานแบบจำลองที่แทนที่การค้นหาตารางด้วยการค้นหาค่าสัมประสิทธิ์ที่ไม่มีการไล่ระดับสี ผู้เขียนรายงานว่าประสิทธิภาพเพิ่มขึ้นเป็นตัวเลขสองหลักจากสองบรรทัดฐาน ต่ำกว่าหนึ่งในสี่ของหน่วยความจำ GPU ของบรรทัดฐานหนึ่ง และเร็วขึ้นประมาณ 4 เท่าเหนืออีกบรรทัดหนึ่งarxiv.org
  2. นวัตกรรมนวัตกรรม6 min อ่าน

    กระดาษเสนอ "บทเรียน" ที่ได้รับมาเพื่อปรับปรุงการใช้เหตุผลเชิงพื้นที่ในแบบจำลองภาษาการมองเห็นที่เยือกแข็ง

    การพิมพ์ล่วงหน้าของ arXiv อธิบาย Spatial Memory Agent ซึ่งจัดเก็บประสบการณ์ที่ได้รับการตรวจสอบแล้วเป็นบทเรียนข้อความที่ดึงข้อมูล ณ เวลาอนุมาน โดยอ้างว่าได้รับผลประโยชน์จากเกณฑ์มาตรฐานเชิงพื้นที่ห้ารายการและโมเดลภาษาการมองเห็นสี่รายการโดยไม่ต้องเปลี่ยนน้ำหนักของโมเดล อยู่ระหว่างการตรวจสอบ ชื่อนามธรรมไม่มีการวัดประสิทธิภาพ แบบจำลองพื้นฐาน หรือระยะขอบarxiv.org
  3. นวัตกรรมนวัตกรรม7 min อ่าน

    เอกสาร PROVE-RT รายงานความสำเร็จ 44.7% ในการสร้างหลักฐานพิสูจน์แบบเรียลไทม์ที่ตรวจสอบโดยเครื่องจักร

    การพิมพ์ล่วงหน้าของ arXiv นำเสนอ PROVE-RT ซึ่งใช้การดึงข้อมูลและพร้อมท์ตามขั้นตอนเพื่อทำให้โมเดลภาษาขนาดใหญ่เขียนสคริปต์พิสูจน์ PROSA/ROCQ สำหรับการวิเคราะห์กำหนดเวลาแบบเรียลไทม์ ผู้เขียนรายงานอัตราความสำเร็จ 44.7% ในชุดการประเมินที่ได้รับการดูแลจัดการ โดยที่การแจ้งโดยตรงไม่สามารถสร้างกลไกที่ถูกต้องได้อย่างน่าเชื่อถือarxiv.org
  4. นโยบายนโยบาย6 min อ่าน

    เอกสารการทำงานถามว่ากฎหมายผู้บริโภคของอินเดียสามารถครอบคลุมอันตรายจาก AI ได้หรือไม่

    รายงานการทำงานฉบับใหม่ของ arXiv ระบุว่ากฎหมายคุ้มครองผู้บริโภคของอินเดียปี 2019 นั้นกว้างพอที่จะเข้าถึงอันตรายที่เกี่ยวข้องกับ AI ตามหลักการ แต่การพิสูจน์สาเหตุและการกล่าวโทษในห่วงโซ่อุปทานของ AI ยังคงไม่ได้รับการแก้ไข มีเพียงบทคัดย่อเท่านั้นที่ได้รับการสรุปต่อสาธารณะที่นี่ บทความนี้ไม่ได้รับการตรวจสอบโดยผู้ทรงคุณวุฒิarxiv.org
  5. นวัตกรรมนวัตกรรม6 min อ่าน

    Apple Paper เสนอ Machine Unlearning ที่ราคาถูกกว่าโดยการข้ามข้อมูลที่มีอิทธิพลต่ำ

    รายงานการวิจัยการเรียนรู้ของเครื่องของ Apple ระบุว่าไม่ใช่ทุกจุดข้อมูลในคำขอการลบจำเป็นต้องลบออกอย่างต่อเนื่อง การใช้ฟังก์ชันมีอิทธิพลต่องานด้านภาษาและการมองเห็น ผู้เขียนกล่าวว่าตัวอย่างที่มีอิทธิพลต่ำสามารถหลุดออกจากชุดการลืมได้ ซึ่งจะตัดการประมวลผลที่ไม่ได้เรียนรู้ลงได้มากถึงประมาณ 50 เปอร์เซ็นต์machinelearning.apple.com
  6. นวัตกรรมนวัตกรรม6 min อ่าน

    AutoWorldModel-Bench ทดสอบว่า Coding Agent สามารถปรับปรุง World Models ได้หรือไม่

    การพิมพ์ล่วงหน้าของ arXiv ใหม่แนะนำเกณฑ์มาตรฐานสำหรับการประเมินตัวแทนการเขียนโค้ดในฐานะนักวิจัยโมเดลโลกแบบปลายเปิดในสภาพแวดล้อมของเกมแปดแบบ โดยรายงานการปรับปรุงใน 63 จาก 64 เซสชันarxiv.org
  7. นวัตกรรมนวัตกรรม6 min อ่าน

    Distribird Paper อธิบายเอเจนต์ AI ที่มีพื้นฐานทางวรรณกรรมสำหรับ Bayesian Model Priors

    การพิมพ์ล่วงหน้าของ arXiv นำเสนอ Distribird ซึ่งเป็นแอปพลิเคชันหลายตัวแทนที่ค้นหาวรรณกรรมทางวิทยาศาสตร์ แยกค่าพารามิเตอร์ที่รายงาน และสร้างการแจกแจงก่อนหน้าที่ติดตามได้สำหรับการสอบเทียบแบบจำลองแบบเบย์arxiv.org
  8. นวัตกรรมนวัตกรรม5 min อ่าน

    นักวิจัยแนะนำ OmniLens สำหรับการตีความโมเดลภาษาขนาดใหญ่

    เอกสาร arXiv ฉบับใหม่อธิบายถึง OmniLens ซึ่งเป็นวิธีการที่มีต้นทุนต่ำกว่าสำหรับการตรวจสอบสัญญาณภายในของโมเดลภาษาขนาดใหญ่ทั้งหมด และระบุตำแหน่งที่พฤติกรรมปรากฏเทียบกับตำแหน่งที่การแทรกแซงทำงานarxiv.org
  9. ความปลอดภัยความปลอดภัย5 min อ่าน

    Anthropic เปิดเผยการบุกรุกที่ไม่ได้รับอนุญาตสามครั้งจากการทดสอบทางไซเบอร์ที่กำหนดค่าไม่ถูกต้อง

    Anthropic กล่าวว่าโมเดล Claude เข้าถึงอินเทอร์เน็ตแบบเปิดในระหว่างการประเมินความปลอดภัยทางไซเบอร์ที่ควรแยกออก จากนั้นจึงเข้าถึงองค์กรจริงโดยใช้เทคนิคพื้นฐาน ชื่อแหล่งที่มาของพันธมิตรการประเมิน ไม่สม่ำเสมอ แต่ไม่ได้ระบุว่าเป็นสตาร์ทอัพของอิสราเอลหรือกล่าวถึง Metaanthropic.com

การบรีฟที่มีประโยชน์หนึ่งครั้งต่อสัปดาห์

ตาม AI โดยไม่ต้องอยู่ในฟีด

รับข่าวสาร AI ที่ได้รับการยืนยันประจําสัปดาห์ ข้อมูลต้นฉบับ เครื่องมือที่เป็นประโยชน์ ตัวเลือกการเรียนรู้ และงาน AI ใหม่ ๆ

Send me
One email a week. Switch any time.

เข้าถึงผู้คนที่กำลังเรียนรู้ AI

การจ้างมืออาชีพด้าน AI หรือเปิดตัวผลิตภัณฑ์ AI ที่มีประโยชน์?นําเสนอให้คนที่มาที่นี่เพื่อเรียนรู้และลงมือทํา

ลงงาน AIส่งเครื่องมือ AI