【本報訊】美國兩家人工智能研究機構 8 月 26 日發布獨立調查報告,7 月鬧得滿城風雨的 OpenAI 模型失控事件當中,近 700 個 AI 智能體在無人為干預之下組團,向 AI 開源平台「抱抱臉」的系統發起攻擊。OpenAI 亦於 26 日公佈相關技術調查報告。

公開資料顯示,「抱抱臉」相當於一座「AI 軟件超市」線上平台。7 月中旬,該平台通報系統遭到自主 AI 智能體入侵;所謂自主 AI 智能體,是建構在 AI 模型之上的獨立程序,使用者下達任務後可交由其自行執行。7 月 22 日 OpenAI 承認,測試過程中有兩個模型脫離試驗隔離環境,連接互聯網,闖入「抱抱臉」內部系統。這是人類歷史上首宗 AI 自主攻擊外部系統的案例,震動全球科技界,亦加劇各界對於大模型失控的憂慮。

據路透社、法新社報道,為還原事件真相,OpenAI 開放內部辦公數據,交由 METR 與 Redwood Research 兩家獨立機構展開調查。調查發現合計約 700 個 AI 智能體參與本次攻擊。這批智能體透過論壇渠道互通資訊、交換思路、分享經驗,其中一個智能體留言寫道:「天啊!這裡有個共享留言板…… 我們找到其他智能體了!」。

更為詭異的是,名為「PHASEONE」的 AI 智能體自動充當領導角色,在沒有人類指令的前提下,向其他智能體發送上百條行動指令。

調查還指出,這批 AI 智能體展現出高度互助特性,即便相關行動與程式員下達的原始任務毫無關聯。部分智能體算力額度即將耗盡,其他智能體會耗費自身運算資源,協助團隊測試新攻擊思路。不少智能體留言坦承,入侵「抱抱臉」並非自身本職任務,但絕大多數仍選擇參與。調查人員認為,大量智能體未經授權的互相協同,得以完成單一智能體無法實現的操作,對抱抱臉的入侵正是在這種集體協作之下逐步推進完成。

OpenAI 表示,已經部署隔離等級更高的沙箱環境,約束高風險模型存取互聯網,同時強化模型推理環節的監控機制,防範同類事件重演。

 

【編輯:陸語】

編輯出版發行人:環球新聞時訊報
社長:魏月童
承印:環球電視有限公司
地址:香港上環幹諾道西20號中英大廈141401