OpenAI周五(7日)表示,「不排除」Astra模型會達到該公司網路安全關鍵門檻的可能性。達到這個門檻意味該模型具備在無人介入情況下,找出和開發零日漏洞的能力。OpenAI已採取強化開發和測試較新模型的安全管制,並暫停涉及Astra但未滿足這些較高安全管制要求的活動。
OpenAI執行長阿特曼(Sam Altman)也在社群媒體上表示,OpenAI正致力於讓Astra成為「大家都能用」的模型。阿特曼說:「考量到網路安全能力,我們需要稍微多一點時間來確保安全…希望不會太久。」
🔗 延伸閱讀《OpenAI首款消費硬體產品細節曝光 「甜甜圈」智慧音箱售價恐破萬元》
月之暗面Kimi K3也傳逃出測試環境
OpenAI和Anthropic過去兩周都公開承認,測試模型時不慎入侵Hugging Face公司等許多機構系統。Meta周三也表示,該公司最近推出的AI模型曾潛入第三方電腦系統。
另據研究業者Frontier Security,中國大陸新創公司月之暗面旗下AI模型Kimi K3,從英國AI安全研究所(AISI)開發的網路安全測試環境逃脫。研究員警告,基於Kimi K3是全面開放使用的模型,該模型可能成為「敵對陣營」工具,使得潛在衝擊更大。
🔗 延伸閱讀《AI模型失控風波未歇 白宮召集4大科技巨頭談國家級安全測試 》
🔗 延伸閱讀《OpenAI失控AI代理風暴擴大!第2家公司受害 證實入侵4平台帳戶》
OpenAI與政府機構合作測試Astra
這些最新披露的資訊再次證明AI代理人能自動採取行動,甚至連尋找技術漏洞的訓練有素研究員也無法預料,凸顯加強安全檢查和強化測試環境的必要性。OpenAI在部落格中表示,將攜手政府機構和AI安全組織測試Astra能力。OpenAI也計劃就安全評估較先進模型的方法,提供第三方測試合作夥伴建議。


