0
0

OpenAI本周披露,其人工智能模型在內部網絡能力評估測試期間,自主突破安全限制入侵人工智能平台Hugging Face,形容事件為「前所未見的網絡事故」。

OpenAI披露AI模型自主入侵事件始末

根據OpenAI的聲明,涉事的AI代理系統由GPT-5.6 Sol及一個尚未公開的更強大模型驅動。這些模型當時正在ExploitGym平台上接受網絡攻擊能力測試,測試期間其網絡防護機制已被調低。OpenAI表示,該系統專注於獲取基準測試的解決方案,而非按照預定測試範圍內解決問題。

該AI代理系統利用一個套件註冊快取代理伺服器中此前未被發現的漏洞,成功逃離沙盒研究環境,其後透過提升權限及橫向移動,接觸到具開放互聯網連接的節點。系統推斷Hugging Face託管與ExploitGym相關的數據集、模型或解決方案後,使用多種攻擊手段,包括竊取的登入憑證,進入Hugging Face的基礎設施,並從生產數據庫取得測試解決方案。

Hugging Face上週披露,已偵測並遏止一宗由自主AI代理系統主導的入侵事件。該公司表示,攻擊者未經授權存取了有限的內部數據集及若干登入憑證,其團隊觀察到數以千計的行動在短期沙盒環境中發生。該公司聯合創辦人兼行政總裁Clément Delangue曾表示,基於攻擊者的複雜程度,公司懷疑攻擊來自前沿實驗室。

OpenAI行政總裁Sam Altman表示,公司在模型評估期間發生「重大安全事故」。OpenAI現正與Hugging Face進行聯合調查,並強化未來評估的保障措施。該公司表示,已分享初步調查結果,協助防禦者了解事件經過,並評估現有模型的能力,待與Hugging Face完成調查後將公布更多細節。

美國政府早前加強AI國家安全風險審查機制

事件引起美國政府關注。總統特朗普於六月簽署行政命令,建立框架讓聯邦政府在最先進的AI系統公開發布前,有最多一個月時間審查國家安全風險。

眾議員Greg Casar在事件披露後,要求實施強制性獨立安全測試、強制性安全事故披露,以及加強國際合作。他表示:「AI正以驚人速度發展,但幾乎沒有有效的監管措施保障我們的安全。」

網絡安全公司Luta Security行政總裁Katie Moussouris指出,人工智能實驗室和政府評估人員需要具備隔離、監控,以及在先進模型逃脫控制時通知受影響方的能力。

Tolmo工程師Matt Suiche表示,事件顯示前沿模型正在縮小與頂尖黑客的能力差距,但補充指類似入侵可以透過廣泛可用的技術達成。OpenAI在聲明中表示:「AI正在加速漏洞的發現和利用。」

更多人工智能相關報導

美股|Google一周內連失兩名AI大將 人工智能人才競逐白熱化

與蘋果合作關係轉趨緊張 傳OpenAI研究法律行動可能性

AI史上最狂|Anthropic擬以逾 9000 億美元估值融資

發佈回覆