BanglaVeilGuard 测试六种孟加拉语形式的安全差距
一篇新论文介绍了 BanglaVeilGuard,这是一种基准和轻量级提示防护,旨在测试跨标准、罗马化、代码混合、噪音和方言形式的孟加拉语言模型。作者在评估中报告了攻击成功率大幅降低,但也发现警卫过度拒绝了一些良性的……
每日更新1797 经过验证的故事
非营利教育团队用通俗易懂的英语解释了产品发布、政策转变、安全研究和行业动向的经过来源检查的人工智能报道。
每个故事都链接到最有力的可用证据:可用的原始来源,否则明确归因的报告。
发生了什么、为什么重要以及值得关注的内容——无需行话。
当信号很弱时,我们不会发布任何内容,而是填充提要。
经过来源检查的人工智能故事,最新的优先,适合那些需要了解人工智能而不追逐炒作的人。
一篇新论文介绍了 BanglaVeilGuard,这是一种基准和轻量级提示防护,旨在测试跨标准、罗马化、代码混合、噪音和方言形式的孟加拉语言模型。作者在评估中报告了攻击成功率大幅降低,但也发现警卫过度拒绝了一些良性的……
Cloudflare 高管告诉 Chosunbiz,其网络上的 AI 代理流量同比增长超过 1,700%,并敦促公司加强访问控制、管理 MCP 连接并为后量子密码学做好准备。流量数据、方法和安全测试结果并不是独立的……
Technology.org 报道称,英国和乌克兰签署了一项国防人工智能合作伙伴关系,使英国研究人员能够访问乌克兰的复仇者人工智能实验室及其战场数据平台。该报告称,首批项目将重点关注军事设施传感和无人机低功耗芯片,尽管这些说法并未……
Chosunbiz 报道称,韩国计划将主要公共服务与人工智能相结合,提供多语言灾害信息,部署部门专用系统,并要求对所有公职人员进行人工智能培训。
新的 arXiv 基准测试跨不同指令、分子表示和八个任务类别评估以化学为中心的大型语言模型,报告大量的提示敏感性、表示依赖性和不均匀的性能。
据 American Bazaar 报道,Kita 筹集了由 BoxGroup 和 Y Combinator 领投的 450 万美元种子轮资金,以扩大对贷方的人工智能信用评估。该公司表示,其技术已用于多个市场,并已处理超过 1.3 亿美元的贷款额,但这些运营声明并未......
预印本引入了证据状态可靠性,这是一种用于测试中间证据在语言模型管道处理降级输入时是否仍然可用的衡量标准。在使用 GLM-5.2 的一项受控评估中,解析器有效的输出持续存在,但阶段成功率下降。
一项新的 arXiv 研究评估了 11 个安全数据集中的 53 个语言模型,并报告称,模型的强度因危害类别而异,而对话安全性仍未得到解决。
据《南华早报》报道,尽管利润疲软、零部件成本上升,但小米仍推出了用于智能手机人工智能、大语言模型加速和自动驾驶的新型 Xring 芯片。
ToSCA 提出了一个分层强化学习框架,将策略选择与令牌级响应生成分开。作者报告说,与日常和情感支持对话中的几个基线相比,策略选择和响应质量得到了改善。
《财富》杂志援引 Ramp 的支付处理器数据报道称,在发布两个月后,《Claude Fable 5》占企业在 Anthropic 型号上的支出的 11%,但此后该份额已陷入停滞。该报告称,这种模式可能会迫使前沿人工智能公司在价格上更加积极地竞争,尽管 Ramp 的……
arXiv 研究报告称,当搜索检索之前生成的文档时,语言模型系统可能会进入故障模式。在作者的模拟中,1,528 次运行中有 79.6% 以论文所称的“RAG 崩溃”结束。
每周一次有用的简报
获取本周经过验证的人工智能新闻、原始数据、有用的工具、学习精选和新鲜的人工智能工作。