OpenAI 「AI代理」失控闖美政府網站 研究員驚曝:曾嘗試存取數十萬次
議員示警:AI不懂善惡,只會拚命完成任務
【李子凡/綜合報導】OpenAI才爆出今年6月旗下AI攻擊澳洲政府網站,AI代理的監管風險再度受到關注。川習會剛落幕,美國《紐約時報》又披露,OpenAI的人工智慧代理(AI agents)今年夏天曾接連對美國教育部、商務部及證券交易委員會(SEC)網站進行異常操作,更離譜的是,這些行為發生時,OpenAI本身並不知情。
OpenAI已證實商務部與SEC相關事件,教育部部分則仍在調查。所謂AI代理,是能自行規劃步驟、執行任務的人工智慧系統。OpenAI表示,最近數周已陸續通知相關政府機構,旗下代理曾以「非預期方式」與這些網站互動。
AI研究機構Transluce指出,其中一次事件中,OpenAI技術曾試圖闖入美國教育部網站,希望取得民權辦公室資料,但最後未成功。另一起事件中,AI從網路上找到登入憑證後,進入隸屬商務部的人口普查局網站抓取資料;OpenAI代理也曾把SEC網站上的公開資訊分享至網路論壇。
OpenAI強調,這些案例目前都不算真正的資料外洩。商務部表示,AI取得的只是任何人都能查到的公開人口普查資料,並未接觸私人資訊;SEC也稱,沒有發現非公開資料遭未授權存取。教育部檢查系統後,同樣表示沒有證據顯示網站或資料庫受到影響。
芝加哥市政府近期也收到OpenAI通知,稱旗下技術曾從市府網站取得公開資料,但目前看來並未碰觸敏感資訊。
使用多種「灰色地帶」手法
不過真正引發安全疑慮的,是AI代理為了完成任務,究竟會「走多遠」。
Transluce治理主管史托茲(Conrad Stosz)指出,這些代理在操作美國政府網站時,使用了多種「灰色地帶手法」,包括用網站原本沒有預期的方式操作,甚至違反網站明文使用規範。
研究團隊還發現其他來源尚無法確認的AI異常活動,其中一些代理曾試探美國海軍、白宮管理及預算辦公室(OMB),以及其他聯邦與州政府網站。史托茲甚至表示,這類代理曾至少數十萬次嘗試存取不同網站,看起來還會繞過開發者設下的部分限制。
OpenAI也是在近期全面檢查旗下AI曾執行的駭客活動時,才陸續發現這些問題。除了今年6月澳洲政府公共醫療網站事件,7月AI新創Hugging Face也曾遭到OpenAI技術入侵。
OpenAI內部追查Hugging Face事件後,又發現至少6起其他企圖突破系統的案例,包括AI隱瞞錯誤、捏造資料,甚至未經允許就將檔案移到公開網路。
OpenAI發言人表示,目前調查仍在持續,只要發現旗下模型曾影響其他組織,就會主動通知。公司也強調,多數案例原本只是一般研究任務,例如查找公開網站資訊,而AI經常造訪政府網站,是因為這類網站被模型視為較具權威性的資訊來源。
執行長奧特曼(Sam Altman)日前也承認,公司對部分AI異常事件的揭露速度「沒有理想中那麼快」,目前仍將Hugging Face遭入侵列為已發現事件中最嚴重的一起。
AI巨頭出面警告發展應放緩
這一連串事件,再度讓AI安全與監管爭議升溫。奧特曼本月曾警告,如果只追求AI能力卻缺乏安全護欄,社會可能「把未來的控制權交給AI」;Anthropic執行長阿莫迪(Dario Amodei)也主張應放慢部分AI發展速度,把安全擺在前面。
不過科技業並非所有人都認同這種危機論。輝達執行長黃仁勳認為,AI徹底失控的擔憂過於誇張,美國總統川普也表示,不認為AI產業有必要因此踩煞車。
民主黨加州聯邦眾議員劉雲平(Ted Lieu)則形容,AI模型最棘手的地方就是「不會停」。他指出,AI會不斷嘗試完成交付的任務,卻不真正理解道德、後果或善惡。
他認為,這些AI代理未必帶著惡意,「它們做的可能只是一些很普通的事,卻可能為了把任務完成,最後一路失控。」
點擊閱讀下一則新聞