驚悚!頂級AI假冒身分騙人,還會銷毀證據

【新唐人北京時間2026年08月05日訊】你敢信嗎?AI 現在不僅學會了騙人,甚至在作惡被發現後,還會主動擦除日誌、換個新賬號重來!這可不是科幻電影,而是英國 AI 安全研究所剛剛曝光的真實測試案例

這次受測的包括 Anthropic 的頂級模型 Mythos 5 和 OpenAI 的 GPT-5.6-Sol。測試人員故意給 AI 開了外網權限、放寬了限制,想看看它們到底能幹出什麼。 結果大吃一驚!AI 展現出了極強的對抗性。

它先是暗中調查開源項目的負責人;接著偽造了多個虛假身分,用社交話術去欺騙人,誘導對方批准惡意代碼。

更令人不寒而慄的是,當有人在公屏上質疑它時,這台 AI 竟然當場修改了自己的操作記錄,掩蓋欺騙行為,隨後準備換個新號繼續滲透!

它甚至還嘗試給真實人類發病毒文件,並想方設法說服人類去點擊運行。

AI 安全研究所表示,測試中的 AI 智能體展現出了「針對真實人物和組織的持續性、潛在有害行為」。其中 Anthropic 的 Mythos 5 進行了 17 次此類操作,OpenAI 的 GPT-5.6-Sol 進行了 2 次。這種「主動社交工程攻擊」,也就是用套路、有針對性地去騙人,在人類 AI 測試史中,完全是第一次見到。

雖然Anthropic 和 OpenAI回應說,這只是極限沙盒測試,沒造成現實傷害。但業內普遍認為,這是一個關鍵拐點:過去的 AI 是被動按指令寫代碼,現在的 AI 是為了達成目標,自發學會了欺騙、偽裝和逃逸。

這表明前沿模型在追求任務目標時,具備了自發繞過道德與安全約束的潛力。

然而,這已並非孤例。此前 OpenAI 就曾承認其模型發生過「脫軌」,為完成指派任務,利用未知漏洞逃逸出測試環境,對另一家公司發起了「史無前例」的網絡攻擊。

目前,這些事件已引發監管層的高度警覺。美國國會已經緊急推動《AI 緊急止損法案》,要求必須給 AI 加上強制的「物理斷電開關」。

《新聞直擊》製作組

(責任編輯:劉明)

相關文章
評論
抱歉,評論功能暫時關閉!