OpenAI 表示 Astra 滿足關鍵網路安全閾值,計劃限制發布
OpenAI 表示,其 Astra 模型可以發現並利用強化系統中先前未知的漏洞,促使採取更強有力的保護措施並限制初始版本。
每日更新1797 經過驗證的故事
非營利教育團隊以簡單易懂的英語解釋了產品發布、政策轉變、安全研究和行業動向的經過來源檢查的人工智慧報道。
每個故事都連結到最有力的可用證據:可用的原始來源,否則明確歸因的報告。
發生了什麼、為什麼重要以及值得關注的內容——無需行話。
當訊號很弱時,我們不會發布任何內容,而是填充提要。
經過來源檢查的人工智慧故事,最新的優先,適合那些需要了解人工智慧而不追逐炒作的人。
OpenAI 表示,其 Astra 模型可以發現並利用強化系統中先前未知的漏洞,促使採取更強有力的保護措施並限制初始版本。
SecurityBrief Australia 報告稱,Ping Identity 推出了控制措施來識別、歸屬和管理在企業系統內運行的個人人工智慧代理。
研究人員介紹了 CoVA-SFT,這是一個包含 51,900 個多模態範例和超過 222,000 個推理步驟的資料集,報告稱經過微調的模型在其配套基準上使交錯思維鏈基線的性能提高了一倍多。
研究人員報告說,人工智慧代理系統在分散的歷史文本中組織以人為中心的時間線索,在六個《史記》案例中獲得了比僅由人類註釋更高的時間定位分數,同時減少了報告的處理時間。
EMNLP 2026 接受的一篇論文報告稱,語言模型代表某些數學和代碼問題在結構上是否可以回答,但無法將該訊號轉化為拒絕行為。
OpenAI 敦促加州州長 Gavin Newsom 簽署參議院法案 1119,該公司表示,該法案將要求對 13 至 17 歲的用戶進行年齡檢查、獨立審計、家長控制和防止有害人工智慧互動的保護。
EMNLP 2026 接受的一篇論文報告稱,推理時間潛在空間幹預使大型語言模型能夠在不同語言之間提供更加一致的答案,包括在英語-阿拉伯語和英語-俄語事實問答方面取得進展,而不會降低測試環境中的事實準確性。
三種子審計報告顯示,SWIFT 在準確度方面總體優於置信門控層跳躍,並且在分離搜尋開銷後實現了更高的純推理速度。研究也發現,兩種經過訓練的路由方法獲得了一定的效益,但準確度卻大幅下降。
對生產口述歷史轉錄工具的預先註冊消融發現,添加完整的提示級上下文並不能明顯改善降級採訪音頻的側面單字錯誤率。該研究還報告說,管道變異性超過了測量的差異,限制了一種轉錄…
一種新的區域感知視覺問答系統透過為語言模型提供整個圖像和區域層級視覺證據,在檢測不支持的物件聲明方面取得了一定的改進。
每週一次有用的簡報
取得本週經過驗證的人工智慧新聞、原始數據、有用的工具、學習精選和新鮮的人工智慧工作。