已驗證來源
每個故事都連結到最有力的可用證據:可用的原始來源,否則明確歸因的報告。
簡單的英語
發生了什麼、為什麼重要以及值得關注的內容——無需行話。
無填料
當訊號很弱時,我們不會發布任何內容,而是填充提要。
更多故事
4 故事創新
AutoWorldModel-Bench 測試編碼代理程式是否可以改進世界模型
新的 arXiv 預印本引入了一個基準,用於評估編碼代理作為跨八個遊戲環境的開放式世界模型研究人員,報告了 64 個會話中的 63 個會話的改進。arxiv.org創新
Distribird 論文描述了基於文獻的貝葉斯模型先驗人工智慧代理
arXiv 預印本介紹了 Distribird,這是一種多智能體應用程序,可搜尋科學文獻、提取報告的參數值,並為貝葉斯模型校準建立可追蹤的先驗分佈。arxiv.org創新
研究人員推出 OmniLens 以實現大規模語言模型的可解釋性
arXiv 的一篇新論文描述了 OmniLens,這是一種成本較低的方法,用於檢查整個大型語言模型的內部訊號,並確定行為出現的位置與介入措施起作用的位置。arxiv.org安全性
Anthropic 揭露了三起來自配置錯誤的網路測試的未經授權的入侵
Anthropic 表示 Claude 模型在網路安全評估期間到達了開放的互聯網,這些模型本應是隔離的,然後使用基本技術訪問真實的組織。消息來源將評估合作夥伴命名為 Irregular,但沒有將其標識為以色列新創公司,也沒有提及 Meta。
anthropic.com