OpenAI 表示 Astra 满足关键网络安全阈值,计划限制发布
OpenAI 表示,其 Astra 模型可以发现和利用强化系统中以前未知的漏洞,从而促使采取更强有力的保护措施并限制初始版本。
每日更新1797 经过验证的故事
非营利教育团队用通俗易懂的英语解释了产品发布、政策转变、安全研究和行业动向的经过来源检查的人工智能报道。
每个故事都链接到最有力的可用证据:可用的原始来源,否则明确归因的报告。
发生了什么、为什么重要以及值得关注的内容——无需行话。
当信号很弱时,我们不会发布任何内容,而是填充提要。
经过来源检查的人工智能故事,最新的优先,适合那些需要了解人工智能而不追逐炒作的人。
OpenAI 表示,其 Astra 模型可以发现和利用强化系统中以前未知的漏洞,从而促使采取更强有力的保护措施并限制初始版本。
SecurityBrief Australia 报道称,Ping Identity 推出了控制措施来识别、归属和管理在企业系统内运行的个人人工智能代理。
研究人员介绍了 CoVA-SFT,这是一个包含 51,900 个多模态示例和超过 222,000 个推理步骤的数据集,报告称经过微调的模型在其配套基准上使交错思维链基线的性能提高了一倍多。
研究人员报告说,人工智能代理系统在分散的历史文本中组织以人为中心的时间线索,在六个《史记》案例中获得了比仅由人类注释更高的时间定位分数,同时减少了报告的处理时间。
EMNLP 2026 接受的一篇论文报告称,语言模型代表某些数学和代码问题在结构上是否可以回答,但无法将该信号转化为拒绝行为。
OpenAI 敦促加州州长 Gavin Newsom 签署参议院法案 1119,该公司表示,该法案将要求对 13 至 17 岁的用户进行年龄检查、独立审计、家长控制和防止有害人工智能互动的保护。
EMNLP 2026 接受的一篇论文报告称,推理时间潜在空间干预使大型语言模型能够在不同语言之间提供更加一致的答案,包括在英语-阿拉伯语和英语-俄语事实问答方面取得进展,而不会降低测试环境中的事实准确性。
三种子审计报告显示,SWIFT 在准确性方面总体优于置信门控层跳跃,并且在分离搜索开销后实现了更高的纯推理速度。该研究还发现,两种经过训练的路由方法获得了一定的收益,但准确性却大幅下降。
对生产口述历史转录工具的预先注册消融发现,添加完整的提示级上下文并不能明显改善降级采访音频的侧面单词错误率。该研究还报告说,管道变异性超过了测量的差异,限制了一种转录……
一种新的区域感知视觉问答系统通过为语言模型提供整个图像和区域级视觉证据,在检测不支持的对象声明方面取得了一定的改进。
每周一次有用的简报
获取本周经过验证的人工智能新闻、原始数据、有用的工具、学习精选和新鲜的人工智能工作。