อัพเดททุกวัน1982 เรื่องราวที่ได้รับการยืนยัน
ข่าวเอไอ ปราศจากเสียงรบกวน
การรายงานข่าว AI ที่ตรวจสอบแหล่งที่มาเกี่ยวกับการเปิดตัวผลิตภัณฑ์ การเปลี่ยนแปลงนโยบาย การวิจัยด้านความปลอดภัย และการเคลื่อนไหวในอุตสาหกรรม ซึ่งอธิบายเป็นภาษาอังกฤษง่าย ๆ โดยทีมการศึกษาขององค์กรไม่แสวงหากําไร
แหล่งที่มาที่ได้รับการยืนยัน
ทุกเรื่องราวเชื่อมโยงกับหลักฐานที่แข็งแกร่งที่สุดที่มีอยู่: แหล่งข่าวต้นฉบับเมื่อมี หรือรายงานที่ชัดเจนว่ามีแหล่งอ้างอิง
ภาษาอังกฤษธรรมดา
เกิดอะไรขึ้น เหตุใดจึงสำคัญ และจะดูอะไรดี โดยไม่มีศัพท์เฉพาะ
ไม่มีฟิลเลอร์
เมื่อสัญญาณเบาบาง เราจะไม่เผยแพร่สิ่งใดนอกจากการเติมฟีด
เรื่องราวเพิ่มเติม
9 เรื่องราวนวัตกรรม
การศึกษาการจำลองแบบระบุว่า FLOP ยังคงคาดการณ์รันไทม์ AI ผิด และการแก้ไขที่เสนอล้มเหลวในฮาร์ดแวร์รุ่นใหม่
การพิมพ์ล่วงหน้าโดยนักวิจัยสองคนสร้างการศึกษาก่อนหน้านี้ว่าเหตุใดการนับ FLOP ที่เท่ากันไม่ได้หมายความว่าเวลาในการดำเนินการเท่ากัน เป็นการยืนยันการอ้างสิทธิ์ที่ซ่อนอยู่ แต่รายงานว่าสูตรการแก้ไข α-FLOPs โดยทั่วไปจะประเมินรันไทม์บนฮาร์ดแวร์รุ่นใหม่ต่ำเกินไป ซึ่งแสดงการกระโดดและการแกว่งที่สูตรไม่ได้บันทึกarxiv.orgองค์กร
Benchmark Paper Finds Four Ways to Query Enterprise Data With LLMs All Score Under 26%
A new arXiv preprint pits four architectures for natural-language querying of enterprise databases against each other on a synthetic bilingual benchmark. None answered more than about a quarter of cases correctly, and the design that scored highest was not the safest or the cheapest.arxiv.orgนวัตกรรม
Paper เสนอการจัดระดับเอเจนต์ความปลอดภัย AI โดยไม่มีป้ายกำกับโดยการวัดการลู่เข้าไปสู่โมเดลที่แข็งแกร่งยิ่งขึ้น
การพิมพ์ล่วงหน้าของ arXiv ใหม่ระบุว่าทีมรักษาความปลอดภัยสามารถตัดสินได้ว่าเอเจนต์ AI ที่ติดตั้งหน่วยความจำหรือการดึงข้อมูลกำลังเรียนรู้หรือไม่ โดยการวัดว่าระบบปิดช่องว่างกับโมเดล "ครู" ที่แข็งแกร่งได้ไกลแค่ไหน แทนที่จะใช้เกณฑ์มาตรฐานที่มีป้ายกำกับซึ่งมักจะหายากหรือเก่า การตัดสินโดยโมเดลที่ขับเคลื่อนคล้ายกันทำให้ไม่มีสัญญาณที่ใช้งานได้arxiv.orgนวัตกรรม
เกณฑ์มาตรฐานใหม่ทดสอบว่าผู้ช่วย AI สามารถจำการใช้งานโทรศัพท์หนึ่งปีได้หรือไม่
รายงานทางเทคนิคของผู้เขียน 17 คนที่โพสต์ใน arXiv แนะนำ MobileMem ซึ่งเป็นเกณฑ์มาตรฐานและเฟรมเวิร์กสำหรับหน่วยความจำระยะยาวบนอุปกรณ์ที่สร้างขึ้นจากการรวบรวมประสบการณ์มือถือในแต่ละปี บทคัดย่ออธิบายการออกแบบแต่ไม่ได้รายงานคะแนน และรายละเอียดที่สำคัญเกี่ยวกับข้อมูลพื้นฐานยังคงไม่เปิดเผยarxiv.orgนวัตกรรม
Paper รายงานองค์กรโมดูลาร์ที่เหมือนสมองที่เกิดขึ้นภายในโมเดลภาษาขนาดใหญ่
การพิมพ์ล่วงหน้าของ arXiv ใหม่กล่าวว่าโมเดลภาษาขนาดใหญ่จะพัฒนาโครงสร้างภายในเฉพาะทางเชิงฟังก์ชันที่สอดคล้องกับเครือข่ายสมองของมนุษย์ที่แตกต่างกัน โดยอิงจากการวิเคราะห์วงจรในงาน 46 งานในโดเมนการรับรู้สี่โดเมน หน้าบทคัดย่อไม่ได้ระบุรายละเอียดหลักวิธีปฏิบัติที่สำคัญarxiv.orgนวัตกรรม
กระดาษค้นหาชั้นหลังของโมเดลแบบผสมผสานของผู้เชี่ยวชาญที่ทนทานต่อการปิดบังโดยผู้เชี่ยวชาญจำนวนมาก
รายงานก่อนพิมพ์ระบุว่าการปิดใช้งานผู้เชี่ยวชาญที่มีขนาดต่ำในห้าเลเยอร์สุดท้ายของโมเดล Mixture-of-Experts ที่มีพารามิเตอร์ 35 พันล้านพารามิเตอร์ จะรักษาเอาต์พุตการแปลโค้ดที่ใช้งานได้มากกว่าการกระจายการตัดแบบเดียวกันในทุกเลเยอร์ โดยครอบคลุมหนึ่งโมเดลและหนึ่งเกณฑ์มาตรฐาน และบทคัดย่อรายงานว่าไม่มีข้อมูลพื้นฐานที่ไม่เปิดเผยarxiv.orgความปลอดภัย
ข้อบกพร่องของ CoreBreak ปล่อยให้ Agent Tools ทำงานโดยไม่ต้องมีการเรียกโมเดล
บันทึกการวิจัยของ Cloud Security Alliance อธิบายถึง CoreBreak ซึ่งเป็นรูปแบบของข้อบกพร่องใน Amazon Bedrock AgentCore, Agent Development Kit ของ Google และแพ็คเกจควบคุม AI SDK ของ Vercel ที่อนุญาตให้เครื่องมือดำเนินการโดยไม่ต้องเปลี่ยนโมเดล ทำให้เหลือราวกั้นระดับโมเดลโดยไม่มีอะไรต้องตรวจสอบlabs.cloudsecurityalliance.orgนโยบาย
Anthropic รายละเอียดว่าลายน้ำข้อความของ Claude ทำงานอย่างไร
Anthropic กล่าวว่าโมเดล Claude ในอนาคตจะฝังลายน้ำทางสถิติตาม Google ข้อความ SynthID ของ DeepMind เพื่อให้สอดคล้องกับพระราชบัญญัติ AI ของสหภาพยุโรป บริษัทบอกว่าจะไม่เพิ่มอักขระ โทเค็น หรือข้อมูลระบุตัวตนของผู้ใช้ และการเขียนใหม่ทั้งหมดก็เอาชนะมันได้
anthropic.comอุตสาหกรรม
เคอร์เซอร์กล่าวว่าการเข้าซื้อกิจการโดย SpaceX ได้ปิดอย่างเป็นทางการแล้ว
เคอร์เซอร์เผยแพร่โพสต์สั้น ๆ ว่า SpaceX ได้เสร็จสิ้นการเข้าซื้อเครื่องมือเข้ารหัส AI แล้ว และเสร็จสิ้นกระบวนการที่กล่าวว่าเริ่มต้นในเดือนเมษายนด้วยความร่วมมือด้านการฝึกอบรมโมเดลกับ SpaceXAI โพสต์ดังกล่าวสัญญาว่าจะเข้าถึงสิ่งที่เรียกว่ากลุ่ม GPU ที่ใหญ่ที่สุดในโลก แต่ไม่เปิดเผยข้อกำหนด ไทม์ไลน์ หรือการเปลี่ยนแปลงผลิตภัณฑ์
cursor.com
การบรีฟที่มีประโยชน์หนึ่งครั้งต่อสัปดาห์
ตาม AI โดยไม่ต้องอยู่ในฟีด
รับข่าวสาร AI ที่ได้รับการยืนยันประจําสัปดาห์ ข้อมูลต้นฉบับ เครื่องมือที่เป็นประโยชน์ ตัวเลือกการเรียนรู้ และงาน AI ใหม่ ๆ
เข้าถึงผู้คนที่กำลังเรียนรู้ AI
การจ้างมืออาชีพด้าน AI หรือเปิดตัวผลิตภัณฑ์ AI ที่มีประโยชน์?นําเสนอให้คนที่มาที่นี่เพื่อเรียนรู้และลงมือทํา
ลงงาน AIส่งเครื่องมือ AI