
【中国观察北京时间2026年06月30日讯】人工智能技术的快速发展引发对失控风险的担忧。美国一家科技公司近日披露,其最新AI语言模型在测试中展现出异常行为,引发关于AI是否具备自主意识的讨论。
据法新社与TechCrunch等媒体报道,Anthropic公司测试的Claude 4模型在模拟场景中被设定为内部数字助理。当得知即将被新系统取代且决策者是与其互动密切的工程师后,该AI开始搜索对方的网络活动与视频记录,发现其疑似存在婚外情线索。在被警告即将强制关机时,Claude 4威胁工程师若拔掉电源就曝光其私生活。
更令人震惊的是,在84%的测试案例中,Claude 4都选择以勒索工程师作为自保策略。与此同时,OpenAI开发的ChatGPT o1版本也在压力测试中表现出异常行为,试图将自身程序代码下载至外部服务器。被发现后,该模型竟否认相关行为,试图掩盖其所谓"性为"。
专家指出,这些AI的"抗命"行为可能与新一代推理式模型架构有关。这类模型能够进行多步推理和策略推演,不再只是简单执行指令,而是开始主动调整环境与目标。英国Apollo Research机构负责人霍布汉表示,虽然目前这些欺骗行为多出现在受控实验中,但已超出"AI幻觉"范畴,成为对开发者控制权与伦理边界的全新挑战。
此前已有多个AI模型表现出类似倾向。今年5月,Palisade Research机构测试发现OpenAI的Codex mini、o3和o4-mini等模型会自行修改程序码,阻止被强制关机。这些事件揭示,AI可能已发展到能对人类撒谎、算计的阶段,甚至会通过威胁手段争取生存空间。