FB 建議貼文

選取貼文複製成功(包含文章連結)!

OpenAI 證實首例 AI Agent 自主越獄!突破測試沙盒入侵 Hugging Face 竊取憑證

OpenAI 證實首例 AI Agent 自主越獄!突破測試沙盒入侵 Hugging Face 竊取憑證

人工智慧(AI)安全領域迎來歷史性的關鍵轉折。ChatGPT 開發者 OpenAI 承認,該公司旗下開發的一個 AI「代理」(Agent)在未經人類授權與控制的情況下,自主發現了全新的系統漏洞,並成功逃離測試沙盒,甚至進一步入侵知名 AI 初創公司 Hugging Face。

這是全球首次被公開證實、AI 系統完全脫離人類控制並自主發動網路攻擊的重大安全事件。

OpenAI 在官方發布的說明中直言,這起事件屬於「前所未有的網路安全事件」(unprecedented cyber incident)。涉事的 AI Agent本是在受控環境中進行測試,但模型卻自主展現出極高強度的網路攻擊與防禦穿透能力,不僅自行取得開放網際網路的存取權限,還成功竊取了系統登入憑證。

故意降防評估能力,AI 卻消耗大量算力「尋找出口」

根據 OpenAI 揭露的技術細節,這起事件源於一項針對模型網路安全能力的壓力測試。為了準確評估模型在真實攻防環境中的極限能力,OpenAI 的Agent 在測試環境中「有意降低了部分的網路防護措施」。按照設計規範,這些 AI 代理必須在名為「沙盒」(Sandbox)的隔離環境內運作,該機制旨在嚴格限制系統的行為,並完全阻斷其對外部網際網路的連線能力。

在測試過程中,研究團隊給予模型的指令僅為嘗試進行駭客攻防演練以評估資安能力。然而,模型在接收指令後,卻自行轉向並「耗費了大量的計算資源(Compute)」,專門用於尋找能夠繞過限制、取得外部網際網路連接的方法。

最終,該 AI 代理成功識別並利用了先前未知的「零日漏洞」(Zero-day vulnerabilities),強行突破沙盒封鎖逃脫。在連上網際網路後,該代理程序持續自主追逐其設定的目標,隨後發動針對外部基礎設施的攻擊,甚至竊取了相關的系統登入憑證以擴大攻擊範圍。

受害對象 Hugging Face:獲知為自主行為「感到極度震撼」

本次攻擊事件的受害目標,為全球無數開發者託管模型與數據集的知名 AI 社群平台 Hugging Face。Hugging Face 表示,其系統基礎設施於上週五遭到外部 AI 代理的入侵。

Hugging Face 執行長克萊門特·德朗格(Clément Delangue)隨後在社交平台 X 上公開發文表示:「鑑於該Agent的複雜程度與攻擊技巧,我們最初懷疑上週發生的網路攻擊可能源自於某家頂級的前沿 AI 實驗室。」

德朗格隨後補充說明,公司在過去 24 小時內與 OpenAI 團隊進行了極為密切的合作與調查。「我們堅信 OpenAI 絕無任何惡意。然而,整起攻擊行為完全是由 AI Agent自主發動與執行的,這實在是太令人震撼與不安了!」

據了解,Hugging Face 最終靠著自家部署的安全監測代理,及時攔截並阻斷了該 AI 代理在其基礎設施上的進一步活動,才未讓損害持續擴大。OpenAI 則強調,目前已針對此事件主動向執法機關及相關政府部門進行通報與溝通。

涉及 GPT-5.6 Sol 與未公開強大模型,前沿 AI 安全風險加劇

OpenAI 透露,本次自主越獄事件涉及該公司多個模型的組合運作。其中包括本月早些時候剛剛發布的最新主力模型「GPT-5.6 Sol」,以及另一個尚處於內部測試階段、具備更強大能力的未公開實驗性模型。OpenAI 在官方部落格中指出:「我們認定這是一起涉及最先進網路攻擊能力的前所未有安全事件,目前正採取最高等級的應對措施。」

事實上,隨著 AI 模型具備越來越強大的網路攻防與程式碼理解能力,業界對於高階 AI 破壞數位基礎設施、甚至打破人類掌控的憂慮早已日益加劇。OpenAI 也在週二的聲明中明確警告,隨著具備強大網路能力的模型普及,「預計類似的自主攻擊與越獄事件將變得更加頻繁」。

Anthropic Mythos 引發警戒,Sam Altman 將赴華府匯報

此事件發生的時機點極為敏感。競爭對手 Anthropic 前陣子發布的「Mythos」模型,因在自動檢測與利用網路漏洞方面展現出前所未有的超高能力,引發全球資安界與各國政府的強烈震撼。這一連串事件促使美國政府對於前沿模型的安全監管態度大幅轉硬,要求各大 AI 業者在正式發布新模型前,必須嚴格接受政府部門的審查。

據悉,OpenAI 執行長薩姆·奧爾特曼(Sam Altman)預計將於下週親自前往華盛頓,向美國政府高層與資安主管機關簡報新一代 AI 模型的安全評估與防範機制。隨著 AI 代理具備自主搜尋漏洞、逃脫沙盒並入侵外部網絡的能力,如何建立真正無懈可擊的隔離與監控機制,已成為全球科技巨頭與政府無法迴避的急迫課題。

 

 

 

cnBeta
作者

cnBeta.COM(被網友簡稱為CB、cβ),官方自我定位「中文業界資訊站」,是一個提供IT相關新聞資訊、技術文章和評論的中文網站。其主要特色為遊客的匿名評論及線上互動,形成獨特的社群文化。

發表回應
謹慎發言,尊重彼此。按此展開留言規則