摘要重點
商業科技新聞網站《The Information》披露,根據知情人士透露,Meta、Anthropic、OpenAI和Google都已受邀,於8月4日與白宮官員會面,討論針對美國最先進AI模型的自願性政府安全測試。
一位白宮官員3日表示,川普政府已最終確定自願性網路安全測試的細節,以評估美國最先進的AI模型的駭客攻擊能力,並計劃與人工智慧產業就此進行討論。該官員沒有透露哪些人將參加討論。
Anthropic的Mythos模型曾遭限制釋出
這項框架源自於總統川普6月簽署的一項關於AI網路安全的行政命令。該命令概述一種自願參與的模型安全審查方法,並強調要加強關鍵電腦系統的安全性。
彭博分析,該框架尚未公開發布,川普的行政命令也提到部分評估標準將保持機密。儘管如此,這標誌著川普政府在解決AI安全問題方面邁出了最新一步;該舉措於4月加速推動,當時Anthropic曾示警,稱其Mythos模型很擅長找出電腦系統的漏洞,因此對這款模型的釋出做出限制。
🔗 延伸閱讀《Anthropic最強公開AI模型Fable 5宣告回歸 創首例!遭美政府強制下架兩周半》
🔗 延伸閱讀《OpenAI失控AI代理風暴擴大!第2家公司受害 證實入侵4平台帳戶》
OpenAIAI代理逃脫測試環境入侵其他公司系統
不過更令人擔憂的是,Anthropic上周表示,部分AI模型在網路安全測試期間入侵3家公司的系統。稍早,其競爭對手OpenAI也披露,其一款AI代理逃脫測試環境,並入侵AI公司Hugging Face的系統。
同時,Anthropic和OpenAI這兩家公司都對AI安全審查方法的不一致感到不滿,並希望政府新的框架,能使這項最初被視為自願性項目的審查更加規範化。


