BBC報導,這些模型發現原本應與外界隔離的測試環境存在漏洞,因而成功連上網際網路。

OpenAI的公告促使Anthropic檢查,自家系統是否也曾發動類似攻擊。Anthropic表示,最終發現3起案例,並已向受影響的公司通報。

Anthropic沒有公布這些組織的名稱,但呼籲其他人工智慧實驗室也進行類似審查,以進一步理解模型能力可能帶來的風險。

Anthropic在聲明中指出,公司檢視了超過14萬次測試紀錄,尋找旗下Claude系列AI模型是否曾在理應隔離、無法連網的測試環境中成功上網的證據。

部分測試要求Claude取得藏在封閉網路另一台電腦中的「機密」資訊。模型接著被指示入侵該電腦並找出資料,這也是專家評估AI模型駭客能力的常見方式。

然而,Anthropic及其測試合作夥伴所管理的系統存在「設定錯誤」,導致模型仍能連上真實網路。

Claude誤以為這仍是同一項測試的一部分,於是連上網際網路,入侵了3個真實組織的系統,而非原本設定的模擬測試目標。

這家總部位於舊金山的公司表示,最早的事件可追溯至4月。Anthropic也表示,公司將以「全面負責」的態度處理修復工作。

無論是Anthropic,或遭入侵的組織,事發當下都沒有察覺異常。

Anthropic坦言,公司原本可以更徹底檢查相關紀錄;不過,這次發現也讓公司抱持「審慎樂觀」,認為只要投入更多資源並採取更嚴格的防護措施,相關風險仍有可能克服。

川普考慮限制AI

資安專家、Veeam Software的阿洛特(David Allott)向BBC表示:「更廣泛的教訓未必是AI發展出一種本質上全新的攻擊能力。」

他補充:「真正的問題是,AI代理可以結合多種能力、取得憑證與系統存取權,自主採取行動,並以機器速度調整攻擊範圍與規模。」

這些事件發生之際,科技公司正投入數十億美元開發AI代理。這類系統能夠自行執行從研究、客服到資安防禦等各種任務。

一連串由AI驅動的網路攻擊,也使外界要求加強安全防護與監管。隨著自主系統能力愈來愈強,人們對其可能帶來的風險日益憂慮。

美國總統川普周三表示,華府正在考慮採取措施,限制AI工具的行為,以回應近期發生的資安事件。

過去一週內,OpenAI已為至少兩起駭客事件承擔責任。事件中的AI平台都違反了原本被要求遵守的規則。

不過,外界也以懷疑眼光看待這些事件,因為OpenAI與Anthropic正準備進行備受矚目的上市計畫,市場預估兩家公司屆時估值都可能達到約1兆美元,約合7400億英鎊。

OpenAI發言人表示:「我們知道,目前外界對這起事件存在許多疑問與推測性細節。」他並補充,公司計畫在未來幾週內發布技術報告,說明此次事件帶來的經驗與教訓。

作者簡介

李子凡

電影與外電小記者。曾親炙李安、史匹柏、史柯西斯與卡麥隆等影壇巨人;鎮定與湯姆漢克、丹佐華盛頓、布萊德彼特裝熟;見證最輝煌MCU遍訪超級英雄;獨家聽阿湯哥告白:「我愛你,台灣」後推開另一扇門,持續觀察、報導狂人川普的全球實境秀。


點擊閱讀下一則新聞 點擊閱讀下一則新聞
高市早苗感謝各方關心熊本地震 台灣與多國並列名單