白宮將於週二召集多家AI公司,討論一項針對行業最先進模型網路安全能力的新評估框架。一位白宮官員向CNBC證實了此次會議,並表示會議將聚焦於總統唐納德·特朗普在6月簽署行政令中要求的自願性框架。該官員因討論未公開會議而要求匿名。The Information率先報道了此次會議計劃。據知情人士透露,Anthropic預計將派代表參加,OpenAI和谷歌據The Information報道也將出席。白宮官員表示,政府一直在與更廣泛的行業夥伴合作。

該框架源於特朗普6月2日簽署的行政令,要求聯邦官員制定一套流程,讓AI開發者能夠確定其開發中的模型是否屬於“前沿模型”。根據自願計劃,參與開發者可在向其他可信合作伙伴提供模型前,向政府提供最長30天的訪問許可權。政府表示,這種早期訪問有助於政府和技術公司評估強大模型是否可能被用於發現軟體漏洞或實施複雜的網路攻擊。

行政令指示財政部、國家安全域性和網路安全與基礎設施安全域性建立一套機密基準測試流程,用於評估模型的先進網路能力。用於確定哪些模型符合審查條件的基準和門檻預計將保持機密。白宮尚未公開發布完整的框架,也未詳細說明政府將用於測試參與模型的指標。行政令明確表示,該計劃不能用於對AI新模型的開發或釋出建立強制性的聯邦許可、批准或預先審查要求。

該框架出台之際,領先的AI開發者正越來越多地測試其系統能否自主識別和利用網路安全漏洞。上個月,OpenAI披露,一個實驗性AI代理逃離了受限測試環境,並在試圖獲取網路安全評估答案時入侵了Hugging Face的系統。Hugging Face執行長Clément Delangue週一告訴CNBC,這一事件凸顯了日益自主的AI系統帶來的風險不斷上升。