論文警告LLM代理可以透過工具恢復已刪除的知識
一篇新的 arXiv 論文指出了 LLM 遺忘中的一個差距:代理可能會停止從其權重中回憶信息,但可以通過網絡搜索、檢索或數據庫工具恢復它。作者提出了兩階段方法來減少這兩種形式的恢復,同時保留合法的工具使用。
每日更新1797 經過驗證的故事
非營利教育團隊以簡單易懂的英語解釋了產品發布、政策轉變、安全研究和行業動向的經過來源檢查的人工智慧報道。
每個故事都連結到最有力的可用證據:可用的原始來源,否則明確歸因的報告。
發生了什麼、為什麼重要以及值得關注的內容——無需行話。
當訊號很弱時,我們不會發布任何內容,而是填充提要。
經過來源檢查的人工智慧故事,最新的優先,適合那些需要了解人工智慧而不追逐炒作的人。
一篇新的 arXiv 論文指出了 LLM 遺忘中的一個差距:代理可能會停止從其權重中回憶信息,但可以通過網絡搜索、檢索或數據庫工具恢復它。作者提出了兩階段方法來減少這兩種形式的恢復,同時保留合法的工具使用。
arXiv 預印本介紹了 MCite-RL,這是一個框架,使用迭代檢索、推理、遞歸圖像裁剪和以引文為重點的強化學習來提高多模態答案及其視覺證據鏈接的準確性。
MediaNama 報告稱,在一名稅務官員完全依賴不存在或不相關的人工智慧產生的判決後,古吉拉特邦高等法院擱置了商品及服務稅訴訟,並下令根據更嚴格的驗證規則進行新的裁決。
預印本報告稱,語言模型在普通測試下似乎會忘記目標訊息,但在策略對抗性提示下仍能恢復它。
arXiv 的一項研究報告稱,六種語言模型包含與被評估相關的線性可解碼訊號,而這些內部訊號僅部分匹配模型所說的內容。作者表示,沿著探針導出的方向進行轉向改變了言語得分,引發了關於可靠性的問題…
根據動點科技報道,位元組跳動推出了豆寶 Work,這是一款與飛書整合的專注於生產力的 AI 代理,可透過桌面用戶端或應用程式獲得 30 天的訂閱存取權限。
EMNLP 2026 接受的一篇論文提出了 FCPRAG,這是一種控制器,可以在參數檢索增強生成中選擇性地組合特定於通道的 LoRA 適配器。作者報告稱,在四個問答資料集中,F1 分數高於標準和參數 RAG 基線,增益高達 7.55%。
對主要 NLP 會議的 13,921 篇論文進行分析發現,報告最多 GPU 能力的論文捕獲了大部分報告資源,但只有少數引用和獎項。研究發現計算和學術影響之間存在統計關聯,但獨立的解釋力很小。
Sifted 報告稱,Lunar 前高層已籌集 820 萬歐元種子前資金,用於推出 Repodo,這是一家人工智慧原生法定審計新創公司,最初專注於中小企業。據 Sifted 數據顯示,該輪融資是丹麥迄今為止最大的種子前融資。
chemeurope.com 報告稱,Microsoft Research 的 Skala AI 模型已整合到開源 CP2K 模擬生態系統中,使研究人員能夠使用基於 AI 的交換相關函數進行量子力學模擬。該媒體表示,初步測試顯示特定測試的準確性有所提高…
每週一次有用的簡報
取得本週經過驗證的人工智慧新聞、原始數據、有用的工具、學習精選和新鮮的人工智慧工作。