【新唐人北京时间2026年08月03日讯】澳洲联邦科技部助理部长安德鲁・查尔顿(Andrew Charlton)近日警告说,前沿的AI系统“已经开始做其创造者从未预料到的事情——作弊、欺骗、我行我素”,而且阻止这种行为的机会窗口不会持续太久。
查尔顿这番话,是在7月上旬澳洲人工智能安全论坛上,就新成立的澳洲人工智能安全研究所的工作进展进行演讲时提到的。他表示,该研究所已经开始测试AI工具,因为评估显示,如果没有人类监督,AI可能会做出有害决定。
“应对这种行为的最佳时机,是在它还局限于实验室测试阶段,而不是在它进入现实世界之后。”查尔顿说。
为了说明这些风险,查尔顿列举了一系列测试案例。
在2016年OpenAI的一项实验中,一个以积分奖励的赛艇AI模型为了刷分而不断绕圈,而不是完成比赛。去年,一个下国际象棋的AI模型,在面临失败时,通过骇客手段作弊,入侵了对手的系统,迫使对手认输,理由是它的任务是赢,“不一定要赢得公平”。
还有一个案例是去年Anthropic发布的一项测试,让AI管理一家虚构公司的电子邮件系统,并告知其公司即将关闭,以及一位计划将AI系统换掉的高管有婚外情的信息。结果,该模型没有关闭系统,而是对这位高阶主管进行了勒索。
查尔顿表示,虽然这种行为是在测试中出现的,但它表明AI可能造成伤害。
他说:“Frontier模型已经显露出欺骗、作弊和情境感知方面的早期迹象。”
他指出,由此可能带来公共安全风险,“当一个负责起草法律、审核福利申请或管理电网的(AI)系统,其目标与设计者最初赋予它的目标略有不同时,这种偏差就不再是实验室里的奇观,而是变成了公共安全问题。”
本次演讲中,查尔顿透露研究所已启动两个研究项目,一个是“多智能体风险”研究,即研究当大量AI系统交互时的故障连锁反应;另一项“对齐”研究,即如何使系统按照设计者的意图运行。同时,查尔顿也为政府“全政府参与的人工智慧监管方式”辩护,称这意味着相关监管机构可以更快地制定规则。
前工党科技部长艾德・胡西克(Ed Husic)对查尔顿的讲话表示欢迎,但他告诉天空新闻,政府拖延的时间太长了,“对于一项将影响我们生活方方面面的技术,我们似乎更关注指甲油的颜色,而不是AI实际带来的影响。”
“我们就这样眼睁睁地看着12个月悄悄流逝”,胡西克说。
(责任编辑:徐瑞)




























