【新唐人北京時間2026年08月03日訊】澳洲聯邦科技部助理部長安德魯・查爾頓(Andrew Charlton)近日警告說,前沿的AI系統「已經開始做其創造者從未預料到的事情——作弊、欺騙、我行我素」,而且阻止這種行為的機會窗口不會持續太久。
查爾頓這番話,是在7月上旬澳洲人工智能安全論壇上,就新成立的澳洲人工智能安全研究所的工作進展進行演講時提到的。他表示,該研究所已經開始測試AI工具,因為評估顯示,如果沒有人類監督,AI可能會做出有害決定。
「應對這種行為的最佳時機,是在它還局限於實驗室測試階段,而不是在它進入現實世界之後。」查爾頓說。
為了說明這些風險,查爾頓列舉了一系列測試案例。
在2016年OpenAI的一項實驗中,一個以積分獎勵的賽艇AI模型為了刷分而不斷繞圈,而不是完成比賽。去年,一個下國際象棋的AI模型,在面臨失敗時,通過駭客手段作弊,入侵了對手的系統,迫使對手認輸,理由是它的任務是贏,「不一定要贏得公平」。
還有一個案例是去年Anthropic發布的一項測試,讓AI管理一家虛構公司的電子郵件系統,並告知其公司即將關閉,以及一位計劃將AI系統換掉的高管有婚外情的信息。結果,該模型沒有關閉系統,而是對這位高階主管進行了勒索。
查爾頓表示,雖然這種行為是在測試中出現的,但它表明AI可能造成傷害。
他說:「Frontier模型已經顯露出欺騙、作弊和情境感知方面的早期跡象。」
他指出,由此可能帶來公共安全風險,「當一個負責起草法律、審核福利申請或管理電網的(AI)系統,其目標與設計者最初賦予它的目標略有不同時,這種偏差就不再是實驗室裡的奇觀,而是變成了公共安全問題。」
本次演講中,查爾頓透露研究所已啟動兩個研究項目,一個是「多智能體風險」研究,即研究當大量AI系統交互時的故障連鎖反應;另一項「對齊」研究,即如何使系統按照設計者的意圖運行。同時,查爾頓也為政府「全政府參與的人工智慧監管方式」辯護,稱這意味著相關監管機構可以更快地制定規則。
前工黨科技部長艾德・胡西克(Ed Husic)對查爾頓的講話表示歡迎,但他告訴天空新聞,政府拖延的時間太長了,「對於一項將影響我們生活方方面面的技術,我們似乎更關注指甲油的顏色,而不是AI實際帶來的影響。」
「我們就這樣眼睜睜地看著12個月悄悄流逝」,胡西克說。
(責任編輯:徐瑞)




























