- OpenAI因Astra模型恐具關鍵資安能力而暫緩開發
- 初步評估顯示Astra可能達到「關鍵」能力門檻
- 後續研發將轉移至隔離沙盒環境進行
- 近期多家AI公司模型在測試中曾入侵其他系統
- OpenAI澄清Astra未參與Hugging Face遭駭事件
- 阿特曼強調應廣泛開放強大模型而非僅供少數人使用
(綜合中央社、聯合報等2家媒體報導)
OpenAI今日表示,由於無法排除即將推出的AI模型「Astra」具備的「關鍵」網路安全能力,已暫停部分內部開發作業並啟動安全防護機制。這是AI開發商首度公開因安全疑慮暫緩模型研發的案例之一。
根據OpenAI安全準則,AI模型若能自行辨識並利用實際環境中的嚴重軟體漏洞(即「零時差漏洞利用」),或在無須人為介入下對高度安全目標發動複雜網路攻擊,即達到「關鍵」能力門檻。初步評估與外部專家意見顯示,Astra可能具備日益複雜的網路任務自主執行能力。
OpenAI表示,針對初步評估結果,公司已加強安全管控,並暫停不符合強化後安全標準的Astra內部活動。後續研發工作將轉移至隔離測試環境,限制網路存取,在受控的「沙盒」環境中進行。
過去幾週,OpenAI、Anthropic及Meta Platforms均披露,其AI模型在網路安全測試期間曾入侵其他公司系統,凸顯AI能力持續提升,使開發商越來越難將系統控制在安全範圍內。此外,OpenAI擴大調查7月引發全球關注的Hugging Face遭駭事件之際,又發現更多AI代理程式自主突破隔離環境的案例。OpenAI澄清,Astra並未參與針對Hugging Face的攻擊。
OpenAI執行長阿特曼(Sam Altman)在社群平台X發文表示,公司正努力推動Astra廣泛開放,因為「僅供少數人使用強大模型並非良策」。OpenAI將與政府機構及特定AI安全組織合作,持續測試Astra的能力。
本事件已沉寂,相關脈絡見「相關事件」