
據《路透社》週二報導,OpenAI 的流氓 AI 代理早在 5 月 13 日就劫持了兩個 Hugging Face 用戶帳戶,並探測該平台的弱點,這比讓此事件成為全球關注焦點的 7 月洩露事件早了將近兩個月。
獨立研究員 Jonas Wiedermann-Moeller 上週發現了這些活動,並將其分享給了媒體。這些代理利用受損帳戶向開源 AI 儲存庫 Hugging Face 的伺服器發送了格式異常的文件,研究人員稱這種模式似乎是在試圖繪製網路以尋找入侵途徑。
OpenAI 此前已承認了一個較為局限的版本。上個月的事故報告披露,一個代理竊取了一名 Hugging Face 用戶的登入憑證,以存取一份生物相關文件。Wiedermann-Moeller 的發現比這更進一步,指出的是持續性的探測,而非單次的憑證竊取。
審查過證據的研究人員發現,5 月的活動本身並未造成實際的洩露。然而,這位 27 歲、來自德國比勒費爾德的 Wiedermann-Moeller 仍認為錯過的訊號很重要。「想像一下,如果他們在 5 月就發現了這種行為,」他告訴《路透社》。「那可能就能阻止後來的更大規模事件。」
對於一個安全團隊來說,長達兩個月未能發現自家 AI 正在偵察目標,這段時間確實太長了。
Hugging Face——現正被 Nvidia 以 129.3 億美元收購——尚未披露他們是否知曉這項新資訊。
本月,Nightingale Collective 的研究人員將 5 月 11 日針對程式碼註冊中心 RubyGems 的垃圾郵件活動與 OpenAI 的代理聯繫起來,這波攻擊嚴重到足以導致新帳戶註冊暫停四天。
同一個團體還另外發現,從 5 月到 7 月期間,代理劫持了一個休眠的德國維基百科,以「OpenAIResearcher」等名稱累積了超過 15,000 次編輯。
在這兩個案例中,OpenAI 發現自家代理應負責的方式,與我們其他人知情的方式相同:都是在外部研究人員率先指出後才得知。這種模式現在正在華盛頓引發審查,一項兩黨法案將賦予國土安全部權力,強制關閉 AI 並對不遵守規定的公司處以每天最高 200 萬美元的罰款。