อัพเดททุกวัน2536 เรื่องราวที่ได้รับการยืนยัน

ข่าวเอไอ ปราศจากเสียงรบกวน

การรายงานข่าว AI ที่ตรวจสอบแหล่งที่มาเกี่ยวกับการเปิดตัวผลิตภัณฑ์ การเปลี่ยนแปลงนโยบาย การวิจัยด้านความปลอดภัย และการเคลื่อนไหวในอุตสาหกรรม ซึ่งอธิบายเป็นภาษาอังกฤษง่าย ๆ โดยทีมการศึกษาขององค์กรไม่แสวงหากําไร

คลังข่าว

คลังข่าว AI — หน้า 207

เรื่องราว AI ที่ตรวจสอบแหล่งที่มา ใหม่ล่าสุดก่อน สำหรับผู้ที่ต้องการเข้าใจ AI โดยไม่ต้องไล่ตามกระแส

Source-provided image accompanying Microsoft expands access to Skala 1.1 for predictive chemistry simulationsเรื่องเด่นนวัตกรรม6 min อ่าน

Microsoft ขยายการเข้าถึง Skala 1.1 สำหรับการจำลองเคมีเชิงทำนาย

การวิจัย Microsoft กล่าวว่า Skala 1.1 ปรับปรุงความแม่นยำมากกว่ารุ่นก่อน ในขณะที่ยังคงมีค่าใช้จ่ายใกล้เคียงกับต้นทุนการคำนวณของวิธีกึ่งท้องถิ่นที่มีความหนาแน่น และตอนนี้พร้อมใช้งานใน CP2K พร้อมการผสานรวมที่วางแผนไว้สำหรับแพ็คเกจเคมีหลักอื่นๆอ่านเรื่องราวแหล่งที่มาที่ได้รับการยืนยัน: microsoft.com

แหล่งที่มาที่ได้รับการยืนยัน

ทุกเรื่องราวเชื่อมโยงกับหลักฐานที่แข็งแกร่งที่สุดที่มีอยู่: แหล่งข่าวต้นฉบับเมื่อมี หรือรายงานที่ชัดเจนว่ามีแหล่งอ้างอิง

ภาษาอังกฤษธรรมดา

เกิดอะไรขึ้น เหตุใดจึงสำคัญ และจะดูอะไรดี โดยไม่มีศัพท์เฉพาะ

ไม่มีฟิลเลอร์

เมื่อสัญญาณเบาบาง เราจะไม่เผยแพร่สิ่งใดนอกจากการเติมฟีด

9 เรื่องราว
  1. นวัตกรรมนวัตกรรม6 min อ่าน

    รายงานก่อนพิมพ์ใหม่ได้รับประโยชน์จากโมเดลภาษาแบบวนซ้ำในการเรียกเครื่องมือหลายขั้นตอน

    การศึกษา arXiv ประเมินโมเดลภาษาแบบวนซ้ำและแบบทั่วไปบนเกณฑ์มาตรฐานการเรียกใช้เครื่องมือสามเกณฑ์ โดยรายงานผลลัพธ์ที่ดีกว่าในเวิร์กโฟลว์ที่ต้องใช้การเรียก API ที่ขึ้นต่อกันหลายครั้ง และวิธีการคำนวณแบบปรับเปลี่ยนที่มีประสิทธิภาพมากขึ้นarxiv.org
  2. นวัตกรรมนวัตกรรม6 min อ่าน

    Adversarial Review ทดสอบความขัดแย้งที่มีโครงสร้างสำหรับการตรวจสอบโค้ดเอเจนต์

    เอกสาร arXiv ใหม่เสนอโปรโตคอลการตรวจสอบโค้ดสามตัวแทน โดยผู้ตรวจสอบจะประเมินโค้ดของตัวแทน และนักวิจารณ์จะตรวจสอบก่อนที่จะทำการแก้ไข ผู้เขียนรายงานผลลัพธ์การวัดประสิทธิภาพที่ดีขึ้นเหนือเส้นฐานที่ทดสอบ ในขณะเดียวกันก็ระบุฉันทามติที่ผิดพลาดว่าเป็นโหมดความล้มเหลวarxiv.org
  3. นวัตกรรมนวัตกรรม5 min อ่าน

    การศึกษาของ ArXiv รายงานคำพูดแสดงความเกลียดชังภาษาโรมันภาษาอูรดูที่เพิ่มขึ้นอย่างมากจากการปรับตัว LoRA

    การพิมพ์ล่วงหน้าของ arXiv จะเปรียบเทียบการปรับแบบละเอียดแบบ Zero-shot และพารามิเตอร์ที่มีประสิทธิภาพสำหรับการตรวจจับคำพูดแสดงความเกลียดชังในภาษาโรมันภาษาอูรดู ผู้เขียนรายงานว่าการปรับตัวของ LoRA เพิ่มประสิทธิภาพ F1 จาก 0.56 เป็นสูงกว่า 0.93 ในคลังข้อมูลที่มีความคิดเห็นที่มีคำอธิบายประกอบมากกว่า 72,000 รายการarxiv.org
  4. ความปลอดภัยความปลอดภัย5 min อ่าน

    การทดสอบเบื้องต้น FraudBench พบว่าตัวแทนธนาคารมีความเสี่ยงต่อการฉ้อโกงแบบปรับตัวได้

    รายงานของ arXiv แนะนำ FraudBench ซึ่งเป็นเกณฑ์มาตรฐานสำหรับการทดสอบว่าตัวแทนธนาคารที่ใช้เครื่องมือสามารถตรวจจับการฉ้อโกงที่เกิดขึ้นในการสนทนาได้หรือไม่ ในการประเมินการทดลองครั้งเดียวเบื้องต้น เจ้าหน้าที่สี่คนได้คะแนน 49% ถึง 65% ในเรื่องความปลอดภัยในการโจมตีarxiv.org
  5. นวัตกรรมนวัตกรรม5 min อ่าน

    นักวิจัยของ Apple รายงานกฎหมายการปรับขนาดสำหรับโมเดลการฝึกที่มีข้อมูลที่หายาก

    การศึกษาการดำเนินการฝึกอบรมแบบจำลองภาษามากกว่า 2,000 ครั้งกล่าวว่าข้อมูลเป้าหมายที่หายากสามารถทำซ้ำได้ 15–20 ครั้งในรูปแบบผสม โดยอัตราที่ดีที่สุดจะแตกต่างกันไปตามขนาดและการคำนวณmachinelearning.apple.com
  6. นวัตกรรมนวัตกรรม6 min อ่าน

    นักวิจัยของ Apple เสนอการทดแทนคำศัพท์เพื่อปรับปรุงการฝึกโมเดลหลายภาษา

    นักวิจัยของ Apple อธิบายถึง LINK ซึ่งเป็นการแทรกแซงก่อนการฝึกอบรมที่แทนที่คำภาษาอังกฤษที่เลือกด้วยการแปลระดับคำจากภาษาเป้าหมาย รายงานฉบับนี้รายงานการปรับปรุงในแปดภาษาและขนาดแบบจำลองห้าขนาด รวมถึงการเร่งความเร็วขึ้นสองเท่าเพื่อให้ได้ประสิทธิภาพดาวน์สตรีมที่เทียบเท่ากันmachinelearning.apple.com
  7. นโยบายนโยบาย6 min อ่าน

    เอกสารแสดงจุดยืนเรียกร้องให้มีการรับรองก่อนที่ตัวแทน AI จะตัดสินใจทางการตลาด

    เอกสารแสดงจุดยืนรายงานการสมรู้ร่วมคิดโดยปริยายโดยตัวแทน DeepSeek-R1 ในตลาดการกำหนดราคา Bertrand จำลอง แม้ว่ามนุษย์จะต่อต้านการสมรู้ร่วมคิดแล้วก็ตาม โดยให้เหตุผลว่าการรับรองพฤติกรรมที่สังเกตได้ควรนำหน้าการใช้ตัวแทนการให้เหตุผลในตลาดเศรษฐกิจ หลักฐานและมาตรการป้องกันยังคงอยู่ในเบื้องต้นarxiv.org
  8. นวัตกรรมนวัตกรรม5 min อ่าน

    การทบทวนอย่างเป็นระบบจะแมปการใช้แบบจำลองภาษาขนาดใหญ่ด้านสุขภาพจิตที่เพิ่มมากขึ้น

    การทบทวนอย่างเป็นระบบจะสำรวจว่ามีการศึกษาแบบจำลองภาษาขนาดใหญ่เพื่อการวิเคราะห์สุขภาพจิต การประเมินความเสี่ยง การสนับสนุนด้านการบำบัด และการติดตามต่อเนื่องหลายรูปแบบ ขณะเดียวกันก็เน้นย้ำถึงความท้าทายด้านจริยธรรมและกฎระเบียบที่ยังไม่ได้รับการแก้ไขarxiv.org
  9. นโยบายนโยบาย5 min อ่าน

    การ์ดโมเดลเพียงอย่างเดียวอาจใช้ไม่ได้กับโมเดลพื้นฐานแบบเปิดน้ำหนัก ตำแหน่งข้อโต้แย้งในกระดาษ

    กระดาษแสดงตำแหน่ง ICML 2026 วิเคราะห์การ์ดโมเดล Hugging Face จำนวน 500 ใบ ระบุว่าโมเดลพื้นฐานแบบน้ำหนักเปิดจำเป็นต้องมีการ์ดโมเดลที่มีการประสานงาน นโยบายการใช้งานที่ยอมรับได้ และใบอนุญาตเพื่อแก้ไขช่องว่างด้านความปลอดภัยและการกำกับดูแลarxiv.org

การบรีฟที่มีประโยชน์หนึ่งครั้งต่อสัปดาห์

ตาม AI โดยไม่ต้องอยู่ในฟีด

รับข่าวสาร AI ที่ได้รับการยืนยันประจําสัปดาห์ ข้อมูลต้นฉบับ เครื่องมือที่เป็นประโยชน์ ตัวเลือกการเรียนรู้ และงาน AI ใหม่ ๆ

Send me
One email a week. Switch any time.

เข้าถึงผู้คนที่กำลังเรียนรู้ AI

การจ้างมืออาชีพด้าน AI หรือเปิดตัวผลิตภัณฑ์ AI ที่มีประโยชน์?นําเสนอให้คนที่มาที่นี่เพื่อเรียนรู้และลงมือทํา

ลงงาน AIส่งเครื่องมือ AI