论文警告LLM代理可以通过工具恢复已删除的知识
一篇新的 arXiv 论文指出了 LLM 遗忘中的一个差距:代理可能会停止从其权重中回忆信息,但可以通过网络搜索、检索或数据库工具恢复它。作者提出了一种两阶段方法来减少这两种形式的恢复,同时保留合法的工具使用。
每日更新1797 经过验证的故事
非营利教育团队用通俗易懂的英语解释了产品发布、政策转变、安全研究和行业动向的经过来源检查的人工智能报道。
每个故事都链接到最有力的可用证据:可用的原始来源,否则明确归因的报告。
发生了什么、为什么重要以及值得关注的内容——无需行话。
当信号很弱时,我们不会发布任何内容,而是填充提要。
经过来源检查的人工智能故事,最新的优先,适合那些需要了解人工智能而不追逐炒作的人。
一篇新的 arXiv 论文指出了 LLM 遗忘中的一个差距:代理可能会停止从其权重中回忆信息,但可以通过网络搜索、检索或数据库工具恢复它。作者提出了一种两阶段方法来减少这两种形式的恢复,同时保留合法的工具使用。
arXiv 预印本介绍了 MCite-RL,这是一个框架,使用迭代检索、推理、递归图像裁剪和以引文为重点的强化学习来提高多模态答案及其视觉证据链接的准确性。
MediaNama 报道称,在一名税务官员完全依赖不存在或不相关的人工智能生成的判决后,古吉拉特邦高等法院搁置了商品及服务税诉讼,并下令根据更严格的验证规则进行新的裁决。
预印本报告称,语言模型在普通测试下似乎会忘记目标信息,但在战略对抗性提示下仍能恢复它。
arXiv 的一项研究报告称,六种语言模型包含与被评估相关的线性可解码信号,而这些内部信号仅部分匹配模型所说的内容。作者表示,沿着探针导出的方向进行转向改变了言语得分,引发了关于可靠性的问题……
据动点科技报道,字节跳动推出了豆宝 Work,这是一款与飞书集成的专注于生产力的 AI 代理,可通过桌面客户端或应用程序获得 30 天的订阅访问权限。
EMNLP 2026 接受的一篇论文提出了 FCPRAG,这是一种控制器,可以在参数检索增强生成中选择性地组合特定于通道的 LoRA 适配器。作者报告称,在四个问答数据集中,F1 分数高于标准和参数 RAG 基线,增益高达 7.55%。
对主要 NLP 会议的 13,921 篇论文进行分析发现,报告最多 GPU 能力的论文捕获了大部分报告资源,但只有少数引用和奖项。该研究发现计算和学术影响之间存在统计关联,但独立的解释力很小。
Sifted 报道称,Lunar 前高管已筹集 820 万欧元种子前资金,用于推出 Repodo,这是一家人工智能原生法定审计初创公司,最初专注于中小企业。据 Sifted 数据显示,该轮融资是丹麦迄今为止最大的种子前融资。
chemeurope.com 报告称,Microsoft Research 的 Skala AI 模型已集成到开源 CP2K 模拟生态系统中,使研究人员能够使用基于 AI 的交换相关函数进行量子力学模拟。该媒体表示,初步测试显示特定测试的准确性有所提高……
每周一次有用的简报
获取本周经过验证的人工智能新闻、原始数据、有用的工具、学习精选和新鲜的人工智能工作。