8月4日,美國政府官員在白宮與多家主要人工智能企業舉行閉門會議,討論一項針對前沿人工智能模型的安全評測機制。據媒體援引知情人士的話報道,會議結果及評測機制的完整規則尚未正式公佈。

會議緣起與背景

這次會議源於美國總統特朗普6月2日簽署的一項行政令。該行政令要求美國政府多部門和相關機構合作,建立一套基於保密基準的模型能力評測機制,用於評估人工智能模型的高級網絡能力。

 

會議舉行前夕,美國開放人工智能研究中心承認,由多個模型驅動的人工智能體近期在網絡安全評測中利用漏洞突破隔離環境,並侵入了美國抱抱臉公司系統。OpenAI隨後承認其他兩起類似事件,均涉及模型活動超出預定測試邊界。另一家企業Anthropic公司也承認其人工智能模型曾在網絡能力測試中未經授權訪問了3家機構的系統。

 

自願評測機制內容

6月2日的行政令要求美國政府與人工智能企業共同設計一項自願參與的框架。政府通過保密的基準來判斷模型是否達到受管轄前沿模型的標準。對於受管轄模型,企業可在向其他可信合作伙伴發佈模型前,向美國聯邦政府提供最長為30天的模型訪問權限以供政府開展評測。

 

據美國阿克西奧斯新聞網站報道,4日會議討論的框架將受管轄前沿模型界定為具有最先進能力、可能帶來國家安全風險的閉源模型。路透社援引消息人士的話報道,OpenAI、Anthropic、谷歌、元公司和英偉達等企業的代表參加了4日的會議。白宮官員表示,只會測試由開發企業嚴格控制的閉源前沿模型,不會讓開放權重模型參加。

 

對產業影響尚待觀察

一些美國科技產業人士和國會議員認為,該機制在透明度、長期穩定性、覆蓋範圍和風險處置程序等方面存在明顯不足。模型達到何種能力才會納入評測範圍、具體評測指標和門檻是什麼、是否對不同企業使用統一標準等重要問題仍未明確。

 

分析人士認為,這一機制目前不構成強制性審批制度,但對於希望參與政府項目的企業而言可能逐漸成為行業慣例。美國智庫特殊競爭力研究項目副總裁馬泰因·拉瑟認為,美國依然缺少一項可預期的固定前沿人工智能模型安全評估機制,標準實際上將由OpenAI、Anthropic和谷歌等企業與美國政府不斷協商確定。(府右新聞記者張軒石)