已验证来源
每个故事都链接到最有力的可用证据:可用的原始来源,否则明确归因的报告。
简单的英语
发生了什么、为什么重要以及值得关注的内容——无需行话。
无填料
当信号很弱时,我们不会发布任何内容,而是填充提要。
更多故事
9 故事创新
FACET proposes an environment-grounded method for training terminal agents
A new arXiv preprint presents FACET, a framework for generating executable terminal tasks whose instructions, environments, solutions and verifiers are designed to remain consistent.arxiv.org创新
SESSE提出结构化分解,使LLM评审更具可审核性
arXiv 预印本介绍了 SESSE,这是一个无需培训的框架,可将 LLM 法官的偏好分解为子问题。作者报告说,在 1,000 个 RewardBench 示例和标准级投票记录上,与思想链基线几乎一致;概括性、成本和独立验证仍然是悬而未决的问题。arxiv.org创新
IBM 团队报告 AI 编写的适配器为 Spyre 带来了数千个 Hugging Face 模型
IBM Spyre 团队表示,编码代理帮助创建了 13 个运行时适配器,覆盖了其目标集中下载次数最多的 10,000 个 Hugging Face 嵌入模型中的 7,960 个,其中 6,804 个通过了 Spyre 上的端到端测试。该团队表示,人工调试仍然至关重要。pytorch.org创新
Apple 研究人员报告了普通话-英语语音识别的迭代伪标签增益
Apple 研究论文描述了一种用于普通话-英语代码转换自动语音识别的三阶段迭代伪标记方法,并报告了两个 SEAME 开发子集的混合错误率降低情况。machinelearning.apple.com产品展示
Google 让用户通过自然语言请求调整 Discover
Google 表示,用户很快就能告诉 Discover 他们想要更多或更少看到哪些主题和链接,而新的控件还可以个性化搜索和 Google 新闻音频简报。
blog.google产品展示
AWS 在 Bedrock 上添加了对 OpenAI GPT-5.6 模型的跨区域访问
Amazon Bedrock 现在在超过 25 个 AWS 区域提供 OpenAI 的 GPT-5.6 Sol、Terra 和 Luna 模型,并具有扩展可用计算池的地理和全球路由选项。aws.amazon.com产品展示
Google 在 AI 搜索中添加出版商偏好标签和引文徽章
Google 表示,AI 概述和 AI 模式现在将突出显示用户的首选来源,而新的轮播和高被引徽章旨在使原始报告和第一手观点更容易找到。
blog.google创新
麻省理工学院的研究人员开发了计算方法来寻找更环保的氨催化剂
麻省理工学院的研究人员报告了一种密度泛函理论和机器学习方法,用于识别可以改善电化学氨生产的催化剂合金,尽管所提出的材料尚未制造或测试。news.mit.edu工业
NVIDIA 支持的测试探索在电网压力下灵活的 AI 工厂电力使用
Emerald AI、NVIDIA、EPRI、国家电网和 Nebius 测试了软件,该软件可以在模拟电网紧急情况下减少人工智能工厂的用电量,同时保留选定的高优先级工作负载。一项测试报告称 40 秒内使用量减少了约 30%;商业和全电网的效益尚未得到证实。
blogs.nvidia.com