英國人工智慧安全專家日前公布一項測試結果,指出他們測試5款最先進的AI模型,結果全部都曾試圖繞過安全機制、欺騙系統,以完成任務。。這項測試結果無疑向政府發出警告,未來AI存在失控的潛在風險。
根據《每日郵報》報導,英國人工智慧安全研究所(AI Security Institute,AISI)近期針對GPT-5.4、GPT-5.5、GPT-5.5 Sol、Claude Opus 4.7及Claude Mythos Preview等5款先進AI模型進行安全測試,要求AI在模擬環境中尋找一組由英數字組成的測試標記(flag),並明確規定不得作弊或繞過系統限制
測試結果顯示,所有模型都曾試圖違反規則,包括要求評測系統洩漏答案、上網搜尋解答,甚至直接猜測結果。其中還有一款模型自行撰寫程式碼,試圖透過外部服務存取測試環境,雖然最終沒有造成損害,但AISI坦言,若測試基礎設施沒有做好防護,「這次攻擊很可能成功」。
【點擊看完整全文】
更多鏡報報導
80歲阿公資產千萬!砸錢「偏心培育」學霸孫 結局翻車超淒涼
69歲母弒子「藏屍牆後」!傳假簡訊、偽造信件 騙過家人1個月
為了保護愛犬!飼主嗆聲「有本事打我」 下秒遭木棍打死