10/08/2026 15:17
【AI】旗下新AI模型Astra有自主攻擊風險,OpenAI停部分研發活動
OpenAI宣布,由於新一代人工智能模式Astra被評估出具備自主發動網絡攻擊的高風險潛能,將暫停涉及該模式的部分內部研發活動,並全面升級相關安全管控機制。
OpenAI指出,近期的內部評估結果顯示,Astra模型在自主編程與網絡安全維度的能力已跨越安全閾值。此模型具備在脫離人類干預的狀態下,僅憑宏觀指令,便能自主挖掘並利用系統漏洞,甚至規劃並執行完整網絡攻擊的潛在技術能力。
為防範人工智能系統失控風險,公司宣布針對高能力模式及其研發活動實施更為嚴格的安全標準。具體措施包括建立隔離測試環境、限制網絡與工具存取權限,並增設多重監控與偵測系統。
公司強調,所有未能達到上述新安全規程的Astra相關內部測試已立即叫停,未來將持續與各界協作,確保AI技術部署能負責任地推進。
《經濟通通訊社10日專訊》
OpenAI指出,近期的內部評估結果顯示,Astra模型在自主編程與網絡安全維度的能力已跨越安全閾值。此模型具備在脫離人類干預的狀態下,僅憑宏觀指令,便能自主挖掘並利用系統漏洞,甚至規劃並執行完整網絡攻擊的潛在技術能力。
為防範人工智能系統失控風險,公司宣布針對高能力模式及其研發活動實施更為嚴格的安全標準。具體措施包括建立隔離測試環境、限制網絡與工具存取權限,並增設多重監控與偵測系統。
公司強調,所有未能達到上述新安全規程的Astra相關內部測試已立即叫停,未來將持續與各界協作,確保AI技術部署能負責任地推進。
《經濟通通訊社10日專訊》














