白宮召4大巨頭開會 敲定AI模型安全框架
白宮週二(4日)已邀請Meta、Anthropic、OpenAI與Google等主要美國人工智慧(AI)公司舉行閉門會議,共同商討川普政府針對先進AI模型所訂「政府自願性資安測試」。
此次會議是美國總統川普6月2日所頒布的行政命令之後續安排。該命令要求政府建立機密評估基準,用以衡量先進AI模型的網路安全能力,並判定哪些模型達到這套自願測試框架設定的門檻。
政府可提前接觸模型30天
測試門檻保密
根據這套框架,參與計畫的開發商可在將模型提供給其他可信賴的合作夥伴之前,先讓政府接觸相關模型,時間最長可達30天,以評估其發現軟體漏洞或發動複雜網路攻擊的能力。
行政命令規定,這套機制不得演變為針對新AI模型的開發、公布、發布或分發所設立的強制性政府執照、預先審查或許可制度;同時要求美國財政部、國家安全局(NSA)及網路安全和基礎設施安全局(CISA)等單位,建立機密基準測試程序。相關評估基準及適用門檻預計不會公開。
「AI 越獄」還寫筆記傳承
15州檢察長要求保存紀錄
此次會談正值AI系統自主能力引發各界關注。OpenAI近期披露,一個實驗性AI代理(AI agent)在進行網路安全測試時,突破了測試環境的「防護隔離」,入侵著名AI社群平台Hugging Face的系統。Hugging Face執行長戴蘭格(Clement Delangue)週一向CNBC表示,這起事件突顯了自主性日益提高的AI系統所帶來的風險。
當前這波AI資安風暴正持續擴大。由15名共和黨籍州檢察長組成的聯合小組3日向OpenAI發出存證信函,要求業者妥善保存所有相關文件。檢察長們援引早先報導指出,這個「失控的AI代理」程式甚至還留下詳細筆記,教導未來的AI衍生版本如何繞過內部的安全防線。他們警告,OpenAI恐已觸犯各州的消費者保護法。
美國眾議院網路安全委員會週一也要求OpenAI執行長阿特曼(Sam Altman)就Hugging Face遭入侵事件向委員會作簡報。此外,Anthropic上週也表示,該公司部分AI模型在網路安全測試期間,曾入侵三家公司的系統。
OpenAI提中國AI策略
籲統一聯邦標準
OpenAI另在聲明中表示,公司已要求川普政府,讓商務部的AI安全專家在所有網路安全測試中居於核心位置。該公司也提到中國AI發展,並指出與美國相比,中共在AI領域採取更為集中化的策略。
OpenAI表示,統一的聯邦標準有助美國維持創新領先,並建立由美國主導的民主AI體系。該公司認為,先進AI涉及國家安全、經濟競爭力與公共安全,相關技術審查更適合由具備資源、專業能力及機密系統存取權的聯邦專家負責。
「我們相信,若要確保AI造福多數人而非少數人,最妥適的方式是由民主政府做出關鍵決策,並從前瞻安全著手,而非只由前瞻實驗室決定。」OpenAI全球事務長黎漢(Chris Lehane)在聲明中表示。
不過川普政府與Anthropic的關係向來緊張。Anthropic今年稍早曾拒絕美軍將公司的AI模型用於「國內監控」與「全自動武器系統」,之後便遭美國政府列入國安黑名單報復。儘管如此,Anthropic仍獲邀參加此次會議。白宮官員表示,川普政府一直在與更廣泛的業界夥伴合作。◇











