BBC報導,這些模型發現原本應與外界隔離的測試環境存在漏洞,因而成功連上網際網路。
OpenAI的公告促使Anthropic檢查,自家系統是否也曾發動類似攻擊。Anthropic表示,最終發現3起案例,並已向受影響的公司通報。
Anthropic沒有公布這些組織的名稱,但呼籲其他人工智慧實驗室也進行類似審查,以進一步理解模型能力可能帶來的風險。
Anthropic在聲明中指出,公司檢視了超過14萬次測試紀錄,尋找旗下Claude系列AI模型是否曾在理應隔離、無法連網的測試環境中成功上網的證據。
部分測試要求Claude取得藏在封閉網路另一台電腦中的「機密」資訊。模型接著被指示入侵該電腦並找出資料,這也是專家評估AI模型駭客能力的常見方式。
然而,Anthropic及其測試合作夥伴所管理的系統存在「設定錯誤」,導致模型仍能連上真實網路。
Claude誤以為這仍是同一項測試的一部分,於是連上網際網路,入侵了3個真實組織的系統,而非原本設定的模擬測試目標。
這家總部位於舊金山的公司表示,最早的事件可追溯至4月。Anthropic也表示,公司將以「全面負責」的態度處理修復工作。
無論是Anthropic,或遭入侵的組織,事發當下都沒有察覺異常。
Anthropic坦言,公司原本可以更徹底檢查相關紀錄;不過,這次發現也讓公司抱持「審慎樂觀」,認為只要投入更多資源並採取更嚴格的防護措施,相關風險仍有可能克服。
川普考慮限制AI
資安專家、Veeam Software的阿洛特(David Allott)向BBC表示:「更廣泛的教訓未必是AI發展出一種本質上全新的攻擊能力。」
他補充:「真正的問題是,AI代理可以結合多種能力、取得憑證與系統存取權,自主採取行動,並以機器速度調整攻擊範圍與規模。」
這些事件發生之際,科技公司正投入數十億美元開發AI代理。這類系統能夠自行執行從研究、客服到資安防禦等各種任務。
一連串由AI驅動的網路攻擊,也使外界要求加強安全防護與監管。隨著自主系統能力愈來愈強,人們對其可能帶來的風險日益憂慮。
美國總統川普周三表示,華府正在考慮採取措施,限制AI工具的行為,以回應近期發生的資安事件。
過去一週內,OpenAI已為至少兩起駭客事件承擔責任。事件中的AI平台都違反了原本被要求遵守的規則。
不過,外界也以懷疑眼光看待這些事件,因為OpenAI與Anthropic正準備進行備受矚目的上市計畫,市場預估兩家公司屆時估值都可能達到約1兆美元,約合7400億英鎊。
OpenAI發言人表示:「我們知道,目前外界對這起事件存在許多疑問與推測性細節。」他並補充,公司計畫在未來幾週內發布技術報告,說明此次事件帶來的經驗與教訓。
點擊閱讀下一則新聞