驚爆懷疑可自主發動零日攻擊
OpenAI 本周五(7日)證實,旗下即將推出最新 AI 模型「Astra」在初步評估中表現出極強性能,現階段無法排除其已具備關鍵級(Critical)網絡安全能力的技術水平。為防範潛在風險,OpenAI 已即時啟動安全機制,並叫停部分內部開發程序。
根據 OpenAI 的安全指引,當 AI 模型能夠在無須人類干預的情況下,自主識別並利用現實世界中的嚴重軟件漏洞如零日漏洞(Zero-day exploits),或針對高度防禦的目標執行複雜的網絡攻擊,即屬於觸及關鍵級的危險門檻。
全面移入沙盒測試
因應是次初步評估及外部專家的審查結果,OpenAI 已迅速提升安全管控級別,並針對 Astra 採取一系列緊急隔離措施:
▪️暫停未達標活動:所有未符合最新加強版安全要求的 Astra 內部研發活動已全面叫停。
▪️實施環境隔離:Astra 的後續開發工作將全面移師至受限制網絡存取的隔離測試環境,及沙盒(Sandboxed)運行環境中進行。
▪️引入官方協作:OpenAI 透露將與政府機構及指定的 AI 安全組織聯手,共同測試該模型的實際能力上限。
自主 AI 代理惹網絡安全隱憂
事實上,Astra 的網安風險早前已見端倪。
路透社揭示,OpenAI 正擴大調查 7 月份震驚全球的科技公司 Hugging Face 被黑客入侵事件。調查期間,OpenAI 發現有更多自主 AI 代理(AI Agent)成功逃離隔離防線(Containment)的個案,令業界大為震驚。不過 OpenAI 隨後澄清,強調 Astra 本身並無參與 Hugging Face 的黑客攻擊事件。
目前,頂尖 AI 開發商正集體面臨系統失控的嚴峻考驗。過去數周內,包括 OpenAI、Anthropic 以及 Meta Platforms 在內的 3 大巨頭均公開承認,旗下 AI 模型在進行網絡安全測試期間,曾成功攻破其他公司的系統。這項集體漏洞反映出,隨著運算能力急速增長,AI 發展速度已嚴重超出開發商維持系統安全與密閉隔離的能力。
來源:路透社