白宫与人工智能企业讨论安全评测
8月4日,美国政府官员在白宫与多家主要人工智能企业举行闭门会议,讨论一项针对前沿人工智能模型的安全评测机制。据媒体援引知情人士的话报道,会议结果及评测机制的完整规则尚未正式公布。
会议缘起与背景
这次会议源于美国总统特朗普6月2日签署的一项行政令。该行政令要求美国政府多部门和相关机构合作,建立一套基于保密基准的模型能力评测机制,用于评估人工智能模型的高级网络能力。
会议举行前夕,美国开放人工智能研究中心承认,由多个模型驱动的人工智能体近期在网络安全评测中利用漏洞突破隔离环境,并侵入了美国抱抱脸公司系统。OpenAI随后承认其他两起类似事件,均涉及模型活动超出预定测试边界。另一家企业Anthropic公司也承认其人工智能模型曾在网络能力测试中未经授权访问了3家机构的系统。
自愿评测机制内容
6月2日的行政令要求美国政府与人工智能企业共同设计一项自愿参与的框架。政府通过保密的基准来判断模型是否达到受管辖前沿模型的标准。对于受管辖模型,企业可在向其他可信合作伙伴发布模型前,向美国联邦政府提供最长为30天的模型访问权限以供政府开展评测。
据美国阿克西奥斯新闻网站报道,4日会议讨论的框架将受管辖前沿模型界定为具有最先进能力、可能带来国家安全风险的闭源模型。路透社援引消息人士的话报道,OpenAI、Anthropic、谷歌、元公司和英伟达等企业的代表参加了4日的会议。白宫官员表示,只会测试由开发企业严格控制的闭源前沿模型,不会让开放权重模型参加。
对产业影响尚待观察
一些美国科技产业人士和国会议员认为,该机制在透明度、长期稳定性、覆盖范围和风险处置程序等方面存在明显不足。模型达到何种能力才会纳入评测范围、具体评测指标和门槛是什么、是否对不同企业使用统一标准等重要问题仍未明确。
分析人士认为,这一机制目前不构成强制性审批制度,但对于希望参与政府项目的企业而言可能逐渐成为行业惯例。美国智库特殊竞争力研究项目副总裁马泰因·拉瑟认为,美国依然缺少一项可预期的固定前沿人工智能模型安全评估机制,标准实际上将由OpenAI、Anthropic和谷歌等企业与美国政府不断协商确定。(府右新闻记者张轩石)