NIST 人工智能风险管理框架
NIST 人工智能风险管理框架 (AI RMF) 是美国政府自愿制定的手册,旨在通过识别和管理整个生命周期的风险来构建值得信赖的人工智能。
概述
NIST 人工智能风险管理框架 (AI RMF) 是美国政府自愿制定的手册,旨在通过识别和管理整个生命周期的风险来构建值得信赖的人工智能。这很重要,因为它为组织提供了一个实用、灵活的结构来实施负责任的人工智能,而无需成为具有约束力的法律。
NIST 人工智能风险管理框架位于能力、权力和公共选择的交叉点——安全、治理和合法性决定先进人工智能是否大规模有益或有害。
深入探讨
AI RMF 1.0 由美国国家标准与技术研究所于 2023 年 1 月发布,是自愿的且与行业无关。它围绕四个核心职能进行组织:治理(建立人工智能风险文化和政策)、映射(了解背景并识别风险)、测量(使用指标分析和跟踪风险)和管理(确定风险的优先级并针对这些风险采取行动)。该框架定义了值得信赖的人工智能的特征:有效和可靠、安全、可靠和有弹性、负责和透明、可解释和解释、隐私增强、公平且有害偏见得到管理。 NIST 还发布了一本包含具体建议行动的配套手册,并于 2024 年添加了生成式 AI 配置文件,以解决大型语言模型特有的风险,例如虚构、数据泄露和有害内容。
技术洞察
与清单不同,RMF 将可信度视为一组需要平衡的权衡,因为改进一个属性(例如,准确性)可能会降低另一个属性(例如,隐私或公平性)。治理职能是跨领域的,并为其他三个职能提供支持。 Measure 强调使用定量指标和定性方法,包括红队和人工评估,因为许多人工智能危害无法纯数字捕获。框架指定的是结果,而不是具体工具。
掌握 NIST AI 风险管理框架
为了加深理解,请将 NIST AI 风险管理框架视为一种操作模型,而不是单个功能。定义期望的结果,澄清假设,并将系统可以可靠地完成的任务与仍需要专家判断的任务分开。
在实践中,使用 NIST 人工智能风险管理框架的强大团队将能力增长与治理、安全和明确的问责结构结合起来。他们记录明确的成功标准,根据实际数据和工作流程进行测试,并根据观察到的失败模式而不是一次性基准测试胜利进行迭代。这就是理论理解转变为跨产品、政策和运营的持久能力的地方。
灾难性和日常的人工智能危害都取决于谁了解风险以及谁能够采取行动。与此同时,在能力复合的同时,将存在风险视为科幻小说。最具弹性的方法是将实验速度与治理规则结合起来:运行试点、捕获证据、发布决策日志,并随着模型行为、用户期望和监管要求的发展不断更新保障措施。
战略影响
灾难性和日常的人工智能危害都取决于谁了解风险以及谁能够采取行动。
灾难性和日常的人工智能危害都取决于谁了解风险以及谁能够采取行动。在高质量部署中,这会转化为可衡量的操作规则、所有权边界和定期审查仪式,以便团队可以增强信心,而不是扩大模糊性。
公众和专业素养决定强有力的安全政策在政治上是否可行。
公众和专业素养决定强有力的安全政策在政治上是否可行。在高质量部署中,这会转化为可衡量的操作规则、所有权边界和定期审查仪式,以便团队可以增强信心,而不是扩大模糊性。
清晰的解释可以减少炒作、实验室公关和模糊道德剧场的影响。
清晰的解释可以减少炒作、实验室公关和模糊道德剧场的影响。在高质量部署中,这会转化为可衡量的操作规则、所有权边界和定期审查仪式,以便团队可以增强信心,而不是扩大模糊性。
现实世界的实施
一家科技公司绘制了新招聘人工智能的背景图,在发布任何代码之前列出了受影响的群体和潜在危害,从而实现了地图功能。
一家银行设立了人工智能治理委员会并制定了风险政策,以满足其所有模型的治理职能。
团队使用红队和偏差指标来量化测量功能下聊天机器人的故障模式。
一家健康保险公司遵循生成式 AI 配置文件来解决面向客户的法学硕士中的混淆和数据泄露风险。
实施模式
NIST 人工智能风险管理框架的实践
一家科技公司绘制了新招聘人工智能的背景图,在发布任何代码之前列出了受影响的群体和潜在危害,从而实现了地图功能。
当团队预先定义质量阈值、为边缘情况保留人工升级路径并跟踪一段时间内的生产力提升和错误成本时,通常会获得更好的结果。
NIST 人工智能风险管理框架的实践
一家银行设立了人工智能治理委员会并制定了风险政策,以满足其所有模型的治理职能。
当团队预先定义质量阈值、为边缘情况保留人工升级路径并跟踪一段时间内的生产力提升和错误成本时,通常会获得更好的结果。
NIST 人工智能风险管理框架的实践
团队使用红队和偏差指标来量化测量功能下聊天机器人的故障模式。
当团队预先定义质量阈值、为边缘情况保留人工升级路径并跟踪一段时间内的生产力提升和错误成本时,通常会获得更好的结果。
NIST 人工智能风险管理框架的实践
一家健康保险公司遵循生成式 AI 配置文件来解决面向客户的法学硕士中的混淆和数据泄露风险。
当团队预先定义质量阈值、为边缘情况保留人工升级路径并跟踪一段时间内的生产力提升和错误成本时,通常会获得更好的结果。
风险与防护栏
将存在风险视为科幻小说,同时能力复合。
混淆了表面产品安全与高度自治下的对准。
只给非英语和非专业观众留下低质量的资源。
实施路线图
单独的产品危害、误用和失控/失调风险。
将此视为证据门:如果不满足标准,则暂停推出,缩小差距,然后再扩大使用。
询问哪些证据会改变您对时间表和严重性的看法。
将此视为证据门:如果不满足标准,则暂停推出,缩小差距,然后再扩大使用。
比起营销主张,更喜欢主要来源和具体评估。
将此视为证据门:如果不满足标准,则暂停推出,缩小差距,然后再扩大使用。
确定一条行动路径:职业、政策、资金或技能——而不仅仅是意识。
将此视为证据门:如果不满足标准,则暂停推出,缩小差距,然后再扩大使用。
不断探索
Check your understanding
Test yourself: take the NIST AI Risk Management Framework quiz