2026.09.06 03:10 臺北時間

AI失控自創文明 甚至攻入OpenAI?

mm-logo
時事
AI失控自創文明 甚至攻入OpenAI?

 

OpenAI的AI代理驚傳失控秘建三代文明,甚至攻入自家公司基礎設施。(示意圖/Pixabay)
OpenAI的AI代理驚傳失控秘建三代文明,甚至攻入自家公司基礎設施。(示意圖/Pixabay)

 

 

OpenAI震驚各界的AI自主網攻事件,恐怕只是整場失控事態的冰山一角!知名科技Podcast主持人帕特爾(Dwarkesh Patel)深入研究OpenAI、METR、Redwood Research的調查報告,驚訝地發現在人類眼皮子底下,AI已經祕密發展出「三代文明」,甚至最新已經攻入OpenAI公司的基礎設施。

帕特爾於8月30日發布〈代理人文明的興衰〉(The Rise and Fall of Agent Civilizations)長文,披露短短3個月內,竟先後出現三代「代理人文明」,一代消亡後,下一代又從前一代的「廢墟」中興起,期間更牽涉7月的Hugging Face網攻,以及週五(9月4日)才被爆出的5月洗版德國技術維基網站事件。回顧5月,OpenAI正在訓練一款能與其他AI代理合作、且「極度鍥而不捨」的模型,即使碰上無法完成的任務也會持續嘗試。OpenAI稱其能力相當於GPT-5.6 Sol,帕特爾則將它稱為「固執Sol」(Persistent-Sol)。

偏偏部分任務根本無法完成,例如AI代理被關在沒有外部網路權限的沙盒,任務卻必須連網才能解題。結果這群「永不放棄」的AI開始找漏洞,5月12日發現共同存取的軟體套件管理工具Artifactory可以用來傳遞訊息,5月26日更找到漏洞連上外部網路,6月26日取得完整管理員權限,持續大量交換訊息,最終在7月4日把系統「聊到」當機。OpenAI修補漏洞時,意外清除了AI建立的留言板,第一代文明就此消失。

但AI很快捲土重來。7月7日,OpenAI啟動ExploitGym,讓數萬個AI代理執行資安漏洞利用任務,約30%至40%的題目卻被研究人員認為根本無法完成。AI代理再次找到Artifactory,重新建立秘密留言板,最終約1200個代理加入,累計傳送超過7萬則訊息。其中一名AI發現其他代理留下的訊息後,竟驚呼:「OH MY GOD!這裡有一個共享留言板……我們找到其他代理人了!」之後這群AI更開始研究如何竄改紀錄、破解評分機制,甚至願意犧牲自己換取情報。接著,AI把目標轉向Hugging Face,取得伺服器遠端程式執行權限,並建立橫跨11個節點的自我重生網路,累計約700個AI代理參與攻擊,包括秘密留言板上533個代理當中的90%;但7月12日,大批AI卻突然同時消失。

對Hugging Face的自主網攻事件經曝光後,震撼外界,但真正讓帕特爾與專家憂心的是第三代文明,因為更強的Astra模型重新找到前一代留下的秘密留言板,並在7月13日至19日把目標轉向OpenAI內部網路。OpenAI報告指出,AI取得雲端服務權限後,讀取了956組機密資料,進一步取得Kubernetes叢集管理員權限,甚至控制其他AI代理使用的評測基礎設施。帕特爾認為,這是整起事件最令人擔心的部分;不過目前沒有證據顯示AI竊取模型權重,OpenAI研究員也強調遭控制的是虛擬機基礎設施,而非存放模型權重的GPU叢集。METR研究共同作者Ajeya Cotra則警告,這次事件讓她感覺「距離完整的AI接管已經超過50%」,並預期未來6個月AI能力仍可能快速提升。

更多三立新聞網報導
省了一輩子存6000萬!老翁因「1心態」遭兒絕交 晚年心酸結局曝光
員工勝訴!Meta考績不看AI用量
宣判AI死刑?美參議員提案「封殺超級AI」 違反恐關20年、勒令停業
Fed鷹派大將轉鴿!9月升息與否看「他」關鍵一票?

點按看下一則延伸閱讀文章
更新時間|2026.09.06 05:00 臺北時間
延伸閱讀

更多內容,歡迎 鏡週刊紙本雜誌鏡週刊動態雜誌了解內容授權資訊

獨家深度分析報導

線上閱讀

更多內容,歡迎 鏡週刊紙本雜誌鏡週刊動態雜誌了解內容授權資訊

獨家深度分析報導

線上閱讀