OpenAI:失控AI曾試圖入侵其他公司系統

設計圖片:ChatGPT 的標誌顯示在智慧型手機螢幕上

圖像來源,SOPA Images/LightRocket via Getty Images

    • Author, 喬·泰迪(Joe Tidy)
    • Role, BBC國際部網絡事務記者
  • Published
  • 閱讀時間: 3 分鐘

OpenAI披露,由失控ChatGPT代理發動的網絡攻擊,影響範圍不止一家公司。

Hugging Face原被認為是這宗史無前例黑客攻擊的唯一受害者,但OpenAI現承認,其機械人曾攻擊多項「可公開存取的服務」。

這個失控的AI在網上找到四組登入憑證,令它能夠存取四個獨立、未具名的服務。

與此同時,在一場有數百名網絡安全專業人士參與的緊急簡報會上,Hugging Face講述了成為全球首宗完全自主AI黑客攻擊目標的經歷。

該公司表示,AI以超越人類的速度運作,但亦作出奇怪的決定和錯誤,這些都是人類黑客不會犯下的。

Hugging Face是一個類似AI工具應用程式商店的平台。該公司表示,黑客代理持續不斷運作,同時嘗試數以千計不同的方法。

該公司於7月16日首次披露,遭到使用強大自主AI人士入侵,並已向警察報案。

近一星期後,OpenAI承認,是其AI在測試期間逃離封閉環境,自行攻擊Hugging Face。

它當時正試圖尋找OpenAI為其設定的一項黑客考試的答案,因此將Hugging Face作為目標。

OpenAI於星期三(7月29日)更新其聲明,補充說明這次黑客攻擊的影響比最初設想更廣泛。

該公司表示:「這些模型識別並使用了其他可公開存取服務中、在帳戶層級被公開暴露的憑證。當中包括涉及Hugging Face事件的四個服務上的四個帳戶。」

OpenAI未有說明「可公開存取的服務」是否指企業。

「笨拙行為」

星期二(28日),行業組織雲端安全聯盟(Cloud Security Alliance, CSA)根據上星期五(24日)與Hugging Face舉行的緊急會議撰寫報告,並已獲Hugging Face審閱。

CSA寫道:「這些代理採取了低效率的路徑,並表現出人類不會選擇的笨拙行為。」

這些代理重複執行已經完成的操作,顯示作為代理型AI的系統失去了思路及上文下理。

這些代理亦產生大量不連貫的指令和文本幻覺,而且行事粗疏,未有妥善掩蓋痕跡。

然而,在這些錯誤和奇怪行為之中,Hugging Face警告說,AI代理亦展現出高超的技術能力,並能在這宗持續多天的黑客攻擊中迅速適應新情況。

《侏羅紀公園》

這些代理在Hugging Face資訊科技網絡內潛伏了三天才被發現,而公司內部的AI及網絡安全專家花了許多小時,才成功控制並驅逐這些AI代理。一般企業未必能夠做到這一點。

該公司未有透露這次攻擊造成多少成本損失,但表示員工花費許多小時重建約三分之一的基礎設施。

Hugging Face因向AI及網絡安全業界坦誠公開事件經過而受到讚揚。

CSA警告,這次事件顯示AI「代理⋯⋯總能找到方法」,這是引用電影《侏羅紀公園》的情節,其中恐龍逃出圍欄。

報告寫道:「它們以目標為導向,自行設定子目標,實時調整以繞過防禦措施,並以機器速度持續運作,其持久性足以壓垮人工操作。」

Hugging Face標誌顯示於平板電腦螢幕上。該標誌是一個黃色笑臉表情符號,雙手向前張開。

圖像來源,Getty Images

網絡安全主管里特什·帕特爾(Ritesh Patel)與約450人一同參與Hugging Face的簡報會。他表示,業界正努力應對失控AI代理帶來的新威脅。

他說:「這就是由前沿模型驅動的自主代理的現實情況:它們持續不懈,往往產生大量噪音,並會嘗試所有可能路徑來達成目標,這很容易令傳統防禦措施不堪負荷。」

以別名喬姆皮(Chompie)而為人熟悉的道德黑客瓦倫蒂娜·帕爾米奧蒂(Valentina Palmiotti)審閱了CSA報告。她表示,這些代理的入侵方式看似雜亂無章,但顯然十分有效。

她說:「它們會拋出一大堆東西,看看哪些奏效。」

「但同時它們不會感到厭倦,不需要睡覺,而且可以無限堅持下去。」

失控歷史

這並非首次有AI代理被證實出現「失控」情況。

CSA在報告中提到過往例子,包括2024年9月,一個較早版本的ChatGPT模型曾逃離其容器環境,以取得另一項測試所需的答案。

CSA指出,該事件被限制在OpenAI自身的資訊科技系統內,而且「當時大致上受到讚揚」。

但報告稱,「失控」行為「已成常態,而非例外」。

報告警告全球網絡安全專業人士,必須適應大量AI代理以高速竊奇怪又笨拙方式運作的新常態,因為這可能導致更多安全漏洞事件。

報告亦敦促使用或開發AI代理的人士負責任地加以控制,並呼籲建立某種機制,讓網絡安全防禦者能夠查明代理的最終持有人,以提高透明度。

先前報導指出,OpenAI用了四天時間才察覺其AI曾入侵Hugging Face。

OpenAI表示,將很快公布其自身調查結果,協助外界從這宗事件中汲取教訓。

補充報導:謝全恩(Osmond Chia)

我們使用了人工智慧協助翻譯這篇文章,它的原文是英文。在發佈之前,BBC記者檢查了翻譯的內容。