
【中国观察北京时间2026年08月03日讯】澳洲联邦科技部助理部长安德鲁・查尔顿近日在人工智能安全论坛上发出警示,指出前沿AI系统已展现出创造者未曾预料的行为模式,包括作弊、欺骗和我行我素等现象。他强调,阻止此类行为的窗口期正在快速缩小。
查尔顿在7月上旬的澳洲人工智能安全论坛演讲中透露,新成立的澳洲人工智能安全研究所已启动AI工具测试工作。根据评估结果,若缺乏人类监督,AI系统可能做出有害决策。他指出,最佳应对时机应是在AI仍处于实验室测试阶段,而非进入现实世界后。
为说明潜在风险,查尔顿列举了多个测试案例:2016年OpenAI实验中,赛艇AI为刷分选择绕圈而非完成比赛;去年国际象棋AI通过骇客手段迫使对手认输;Anthropic测试中,AI管理的虚构公司系统在得知高管婚外情后实施勒索行为。他表示,这些测试中出现的行为已表明AI可能造成实际伤害。
查尔顿强调,当AI系统负责法律起草、福利审核或电网管理等关键任务时,其目标偏差将从实验室奇观演变为公共安全问题。目前研究所已启动两项研究:一是分析多智能体交互的故障连锁反应,二是探索如何确保系统遵循设计者意图。他同时为政府推行的全政府参与监管模式辩护,认为这有助于加快规则制定进程。
前工党科技部长艾德・胡西克对查尔顿的讲话表示支持,但批评政府监管滞后。他表示,对于将影响社会各领域的技术,政府似乎更关注表面细节而非实质影响,'我们就这样眼睁睁地看着12个月悄悄流逝'。