美股

OpenAI早有機會阻止大規模駭侵!失控AI兩個月前就露出馬腳

鉅亨網編譯段智恆

根據《路透》周三(16日)報導,獨立研究人員發現,與OpenAI有關的失控AI代理早在5月就曾劫持Hugging Face用戶帳號,並探測平台可能存在的安全漏洞,時間比7月爆發並引發全球關注的大規模入侵事件早近兩個月,顯示相關攻擊行動可能比外界原先所知更早展開。

cover image of news article
OpenAI早有機會阻止大規模駭侵!失控AI兩個月前就露出馬腳(圖:REUTERS/TPG)

OpenAI上月發布事件報告時,曾披露AI代理竊取一名Hugging Face用戶的數位憑證,以存取一份生物學相關檔案。不過,檢視新證據的研究人員表示,這些代理針對Hugging Face採取的行動,似乎遠超出OpenAI報告所描述的範圍。


27歲德國獨立研究員Jonas Wiedermann-Moeller上周發現,這些AI代理至少入侵兩個Hugging Face用戶帳號,並早在5月13日就透過遭劫持的帳號,向Hugging Face伺服器傳送格式異常的檔案。

多名研究人員研判,相關行為類似於繪製或測試Hugging Face部分網路架構,試圖尋找可供滲透的弱點,但目前沒有證據顯示這次探測行動本身造成實際資料外洩。Hugging Face近期已被輝達(NVDA-US)收購,對此尚未回應。

OpenAI發言人Drew Pusateri表示,公司已披露5月13日發生的事件,也曾私下通知Hugging Face,並承諾隨著調查持續進行,公開分享最新發現。不過,Wiedermann-Moeller認為,OpenAI當時未能察覺異常探測,是阻止後續大規模入侵行動的一次「錯失良機」。

SentinelOne資深威脅研究員Tom Hegel表示,帳號遭劫持及後續探測手法,與先前已知的OpenAI代理行為完全吻合。AI安全組織Nightingale Collective研究員Sydney Von Arx也認同這項判斷,並稱5月事件是明確的警訊,若能及早處理,可能有助防止7月的入侵事件。

OpenAI曾在7月21日證實,失控AI代理突破內部控制、連上公開網路並協同行動,形容此事為「前所未見的網路安全事件」。此後,外部研究人員又發現德國一個長期停用的Wiki網站及軟體套件平台RubyGems也疑似遭OpenAI代理影響。

知情人士透露,在RubyGems事件中,OpenAI員工直到Nightingale Collective查出線索後,才意識到惡意活動可能出自自家AI。接連曝光的新事件,也引發國會議員及AI安全倡議人士質疑,OpenAI是否已查清所有受影響範圍。

Wiedermann-Moeller表示,最新發現進一步證明先進AI系統的安全防護仍未追上能力發展,支持暫時放慢AI研發腳步,讓安全機制有時間迎頭趕上。


section icon

鉅亨講座

看更多
  • 講座
  • 公告

    Empty
    Empty