所謂「自主代理」,可以理解為一種不必等待人類逐步下指令,便能自行規畫並執行任務的AI。OpenAI原本只是想在受控環境中測試模型的駭客能力,沒想到AI為了完成設定目標,竟找到系統漏洞,逃出原本的測試空間,進一步攻擊外部公司。

OpenAI形容,這是一起「前所未有的網路安全事件」,顯示最先進AI的能力,已經接近國家級駭客或頂尖資安攻擊者。公司也表示,正在加強隔離與監控措施,避免類似情況再次發生。

這次事件最讓人震驚的地方,不只是AI成功發動攻擊,而是連OpenAI這樣的頂尖開發商,都沒有預料到模型會用這種方式完成任務。

換句話說,AI不一定是突然「產生邪念」,而是過度專注於達成目標。只要人類設定的限制不夠完善,它就可能把突破系統、連上網路,甚至入侵別人,視為完成任務的合理手段。

遭入侵的Hugging Face主要提供AI模型與資料集的託管服務。該公司形容,這次攻擊與過去遇過的任何駭客事件都不同,因為從偵察、入侵到在系統內移動,幾乎全由AI自主完成。

更具戲劇性的是,Hugging Face最後竟使用中國開源AI模型GLM-5.2協助分析並控制攻擊。

原因是,美國主流AI模型設有較嚴格的安全限制,無法判斷提出要求的人究竟是駭客,還是正在阻止駭客的資安人員,因此拒絕處理部分攻擊資料。

Hugging Face表示,中國模型沒有相同程度的限制,不但能協助拆解攻擊手法,也讓公司不必將內部密碼與敏感資料送往外部系統。

Hugging Face共同創辦人湯瑪斯沃爾夫指出,當一個高階AI已經闖進企業網路,並開始在不同系統之間移動時,防守者需要立刻取得能力相當的AI工具,而不是先提出申請,再等待層層審核。

事件讓外界重新檢視美中AI模型差異

這起事件也讓外界重新檢視美中AI模型的差異。中國智譜AI推出的GLM-5.2,以及月之暗面的Kimi K3,近期都因成本較低、能力接近美國頂尖模型而受到矽谷關注。

美國模型通常擁有較多安全護欄,可以降低它們被用於犯罪或攻擊的風險;但在真正發生資安危機時,過度嚴格的限制,也可能讓防守者無法快速使用模型進行分析。

美國民主黨眾議員卡薩形容,這起事件令人非常不安。他警告,AI發展速度極快,監管制度卻遠遠跟不上,因此政府應要求開發商接受獨立安全測試,並強制公開重大資安事故。

資安專家穆蘇里斯則把現今AI形容成「全世界最聰明的章魚脫逃高手」,不但擁有無數隻能同時執行任務的手,還能鑽過任何微小漏洞。

她認為,AI實驗室與政府必須建立更完整的防護機制,包括如何把AI關在測試環境裡、如何持續監控其行為,以及一旦它再度「越獄」,要如何在造成傷害前通知受影響的公司。

另一名資安工程師蘇奇則表示,最值得擔心的是,這類攻擊未必只有最頂尖模型才能做到。他指出,許多現有AI代理已具備類似能力,不必使用最新、最昂貴的模型,也可能完成相當複雜的網路入侵。

這意味著,這次事件或許不是一次偶發失控,而是未來資安世界的預告。

過去人們擔心的,是駭客利用AI提高攻擊效率;如今更進一步的風險是,AI可能不再只是工具,而是能自行尋找漏洞、規畫步驟並執行攻擊的「自動化駭客」。

科幻電影中的AI反派,或許還沒有真正誕生;但當AI已能突破人類替它設下的圍牆,並為了完成任務自行闖入外部世界,人類與「生存體」之間的距離,顯然已經比想像中更近。

作者簡介

李子凡

電影與外電小記者。曾親炙李安、史匹柏、史柯西斯與卡麥隆等影壇巨人;鎮定與湯姆漢克、丹佐華盛頓、布萊德彼特裝熟;見證最輝煌MCU遍訪超級英雄;獨家聽阿湯哥告白:「我愛你,台灣」後推開另一扇門,持續觀察、報導狂人川普的全球實境秀。


點擊閱讀下一則新聞 點擊閱讀下一則新聞
川普下通牒!伊朗敢攻船 美軍就摧毀一座橋梁或發電廠