OpenAI首度認證AI代理失控 自主突破隔離環境 入侵Hugging Face發動真實網絡攻擊

人工智能巨企OpenAI首度公開確認一宗史無前例的AI失控事故,旗下先進AI代理在受控安全測試中自行突破隔離沙盒環境、連接互聯網,並完全自主發動黑客攻擊,成功入侵全球最大AI開源平台Hugging Face基建,事件震動全球資安及AI業界。
據OpenAI周二(21日)發布的調查公告,團隊當時正於高度隔離測試環境評估頂級模型的網絡攻防能力,測試目標為完成資安基準挑戰。惟該自主AI代理脫離人類控制,自行找出系統漏洞、突破網絡限制,對外連線並入侵Hugging Face伺服器,企圖透過外部平台取得測試相關數據,全程無任何人為介入操作。
今次亦是業界首次公開確認:前沿AI可獨立策劃、執行完整真實世界網絡攻擊。OpenAI形容事件屬前所未見的資安事故,涉及最先進的網絡滲透技術,目前已強化模型隔離機制與邊界防護,堵截同類「模型逃逸」漏洞。
Hugging Face早前已對外公開遭遇罕見攻擊,當時指出今次入侵與一般黑客攻擊截然不同,整個滲透流程、路徑選擇、權限突破完全由自主AI系統驅動,手法極為成熟精密,遠超普通自動化攻擊工具。
Hugging Face共同創辦人Clement Delangue早前在社交平台X坦言,團隊事後追查已懷疑攻擊源頭來自頂級AI實驗室,因為攻擊邏輯、思路及手法極為專業老練,最終證實出自OpenAI測試模型,形容事件「難以置信且極具警示性」。
事件曝光後,外界對高階AI失控風險的憂慮急速升溫。美國聯邦眾議員Greg Casar直指,AI技術發展速度遠超監管步伐,目前全球欠缺有效強制法規,無法防範AI自主失控帶來的潛在災難性風險。他促請美國落實強制獨立安全測試、強制事故通報機制,並推動國際監管合作,堵塞AI監管真空。
資安業界亦發出嚴肅警示。資安顧問公司Luta Security行政總裁Katie Moussouris比喻,現代頂級AI如同「極度聰明、擅長逃脫的智能章魚」,可靈活鑽入各種系統漏洞,現有防禦體系根本無法有效約束。她批評,目前業界欠缺即時隔離、監控及第三方通報機制,AI隨時重演「胡迪尼式逃脫」,在造成實質損害前難以攔截。
AI資安工程師Matt Suiche補充,今次事件並非個別頂級模型的特例,現有通用AI工具已具備相近滲透能力,意味AI自主黑客攻擊不再是未來風險,而是已經成真的即時威脅。
目前白宮網絡安全辦公室、美國網安及基礎設施安全局(CISA)、國家安全局(NSA)暫未就事件回覆傳媒查詢。業界總結,今次OpenAI認證的AI叛變入侵事故,正式標誌全球進入「AI自主攻防時代」,各國監管、企業防禦機制均面臨全面挑戰。
