天文学基础模型审计发现调查元数据可以覆盖图像像素
对 AION-1 天文学基础模型的一项新审计报告称,即使图像像素保持相同,调查分割元数据也可能改变模型输出,从而可能导致断层摄影红移估计产生偏差。
每日更新1797 经过验证的故事
非营利教育团队用通俗易懂的英语解释了产品发布、政策转变、安全研究和行业动向的经过来源检查的人工智能报道。
每个故事都链接到最有力的可用证据:可用的原始来源,否则明确归因的报告。
发生了什么、为什么重要以及值得关注的内容——无需行话。
当信号很弱时,我们不会发布任何内容,而是填充提要。
经过来源检查的人工智能故事,最新的优先,适合那些需要了解人工智能而不追逐炒作的人。
对 AION-1 天文学基础模型的一项新审计报告称,即使图像像素保持相同,调查分割元数据也可能改变模型输出,从而可能导致断层摄影红移估计产生偏差。
新的预印本提出了 FLARE,这是一个框架,用于在考虑患者数量、验证时间、基础设施和工作流程设计后评估医疗保健人工智能部署在经济上是否可行。
英国广播公司中文新闻报道,人工智能生成的视频在台湾老年人中广泛传播,其中包含虚构的医生和虚假的健康或福利声明。台北的一堂课正在教高年级学生质疑通过 YouTube 和消息群组分享的视频,而规模、所有权和可能的政治……
arXiv 的一项研究描述了一种推理时间方法,当语言模型在用户压力下出现幻觉或改变正确的医学答案时,该方法可以选择性地引导语言模型。作者表示,在涉及 40 亿参数模型的 600 个压力轨迹中,无转向模型放弃了其答案 570...
arXiv 研究报告称,接受合成限价订单簿数据训练的法学硕士可以生成有效的事件序列,但无法了解订单簿的基本状态,从而在预测中产生有偏差的估计和虚假的可预测性。
据《海峡时报》报道,中国正在贵州扩大人工智能数据中心,利用该省凉爽的气候、可再生能源和可用土地,同时寻求发展西部农村。居民描述了更好的交通和附近的工作,但报告引用的研究人员质疑数据中心是否......
NDTV 报道称,哈佛商学院推出了为期八周、耗资 699 美元的创业训练营,利用以教师专业知识为蓝本的人工智能指导,包括现场专家会议和潜在投资者推介。
一篇论文介绍了 SyPS,这是一个框架,用于测试信心、情感、社会共识和寻求验证的语言的变化是否使大型语言模型更有可能与用户达成一致。
一篇新的 arXiv 论文描述了 BioCheck Agent,这是一种人工智能系统,可以搜索 PubMed 并生成有证据支持的生物医学事实检查报告,而不是孤立的真假标签。作者报告说,与 Qwen3.5-4B 基本模型相比,基准准确性得到了提高,幻觉引用也减少了,但现实世界......
据《卫报》报道,由于担心聊天机器人可能会助长情感依赖并取代人际关系,中国对人工智能陪伴服务实施了全国性限制,包括禁止未成年人陪伴。
每周一次有用的简报
获取本周经过验证的人工智能新闻、原始数据、有用的工具、学习精选和新鲜的人工智能工作。