美国政府官员4日在白宫与多家主要人工智能企业举行闭门会议,讨论一项针对前沿人工智能模型的安全评测机制。据媒体援引知情人士的话报道,美国政府官员在会上介绍了安全评测的程序,但会议结果、评测机制的完整规则及实施细节尚未正式公布。白宫为何召集此次会议?自愿安全评测机制是什么?对美国人工智能产业有何影响?
为何召集此次会议
这次会议源于美国总统特朗普6月2日签署的一项行政令。该行政令要求美国政府多部门和相关机构合作,建立一套基于保密基准的模型能力评测机制,用于评估人工智能模型的高级网络能力。
会议举行前夕,美国开放人工智能研究中心(OpenAI)承认,由多个OpenAI模型驱动的人工智能体近期在网络安全评测中利用漏洞突破隔离环境,并侵入了美国“抱抱脸”公司系统。OpenAI随后承认其他两起类似事件,均涉及模型活动超出预定测试边界,包括因评测环境配置错误导致模型接入互联网并侵入一个网站。
另一家美国人工智能企业Anthropic公司7月30日说,在审查该公司网络安全能力评估记录后发现,其人工智能模型曾在网络能力测试中未经授权访问了3家机构的系统。
有关事件引发公众和网络安全人士的担忧。现有的人工智能体已经能够连续执行多步骤任务,不仅可以帮助发现和修补软件漏洞,也可能被用于实施或协助网络攻击。美国人工智能企业的安全事件凸显了应对网络安全问题的紧迫性。
自愿安全评测机制是什么
6月2日的行政令要求美国政府与人工智能企业共同设计一项“自愿参与”的框架。政府通过保密的基准来判断模型是否达到“受管辖前沿模型”的标准。对于受管辖模型,企业可在向其他“可信合作伙伴”发布模型前,向美国联邦政府提供最长为30天的模型访问权限,以供政府开展评测。
对于“可信合作伙伴”,企业可以与联邦政府共同遴选。该类合作方可提前获取“受管辖前沿模型”,以此推动安全创新并强化关键基础设施的网络安全。不过,行政令明确规定,相关条款不得被解释为授权建立强制许可、预先审查或发布许可制度。
据美国阿克西奥斯新闻网站报道,4日会议讨论的框架将“受管辖前沿模型”界定为具有最先进能力、可能带来国家安全风险的闭源模型。报道援引白宫官员的话说,政府已在行政令规定的期限内完成框架制定,正与企业讨论下一步安排。
路透社援引消息人士的话报道,OpenAI、Anthropic、谷歌、元公司和英伟达等企业的代表参加了4日的会议。白宫官员在会上表示,只会测试由开发企业严格控制的闭源前沿模型,而不会让开放权重模型参加这项自愿安全评测。
传统上的开源和闭源指程序是否开放源代码。不过在最近的人工智能发展中,开放权重模型可被任何人下载、检查、修改并在自有基础设施上运行,也被视作广义上的开源模型,而闭源模型则通常只能通过接口(API)调用。
对美国人工智能产业有什么影响
一些美国科技产业人士和国会议员认为,白宫与人工智能企业讨论的这项机制在透明度、长期稳定性、覆盖范围和风险处置程序等方面存在明显不足,很多重要问题仍未明确。比如,模型达到何种能力才会纳入评测范围,具体评测的指标和门槛是什么,是否对不同企业使用统一标准,企业如果拒绝参与是否会受到影响,发现模型具有严重风险后能够采取哪些措施等。
分析人士认为,这一机制目前不构成强制性的审批制度,也没有公开的强制执行措施。但对于希望参与政府项目的企业而言,这项自愿参与的评测可能逐渐成为行业惯例。
对OpenAI、谷歌和Anthropic等闭源模型开发企业来说,如果其模型达到有关能力门槛并选择参加评测,企业可能需要更早与政府沟通,这可能增加企业在模型保密、访问权限管理和发布计划协调等方面的成本。如果能力相近的开放权重模型不接受评测,可能引发监管标准不一致的质疑。至于哪些机构可以被认定为“可信合作伙伴”,外国政府或境外机构是否可能被纳入,目前也尚不清楚。
美国智库特殊竞争力研究项目副总裁马泰因·拉瑟认为,尽管白宫正在推动对人工智能模型实施安全评测,美国依然缺少一项可预期的固定前沿人工智能模型安全评估机制。同时,机制对于“最先进”所设定的标准较为模糊,这意味着标准实际上将由OpenAI、Anthropic和谷歌等企业与美国政府不断协商确定。
来源:新华社
作者: 吴晓凌