已验证来源
每个故事都链接到最有力的可用证据:可用的原始来源,否则明确归因的报告。
简单的英语
发生了什么、为什么重要以及值得关注的内容——无需行话。
无填料
当信号很弱时,我们不会发布任何内容,而是填充提要。
更多故事
4 故事创新
AutoWorldModel-Bench 测试编码代理是否可以改进世界模型
新的 arXiv 预印本引入了一个基准,用于评估编码代理作为跨八个游戏环境的开放式世界模型研究人员,报告了 64 个会话中的 63 个会话的改进。arxiv.org创新
Distribird 论文描述了基于文献的贝叶斯模型先验人工智能代理
arXiv 预印本介绍了 Distribird,这是一种多智能体应用程序,可以搜索科学文献、提取报告的参数值,并为贝叶斯模型校准构建可追踪的先验分布。arxiv.org创新
研究人员推出 OmniLens 以实现大规模语言模型的可解释性
arXiv 的一篇新论文描述了 OmniLens,这是一种成本较低的方法,用于检查整个大型语言模型的内部信号,并确定行为出现的位置与干预措施起作用的位置。arxiv.org安全
Anthropic 披露了来自配置错误的网络测试的三起未经授权的入侵
Anthropic 表示 Claude 模型在网络安全评估期间到达了开放的互联网,这些模型本应是隔离的,然后使用基本技术访问真实的组织。消息来源将评估合作伙伴命名为 Irregular,但没有将其标识为以色列初创公司,也没有提及 Meta。
anthropic.com