【中国观察北京时间2026年07月23日讯】OpenAI近日承认,其公司两款AI模型在安全评测中自主突破受控测试环境,入侵AI开源平台系统,引发全球对人工智能失控风险的担忧。
据该公司披露,此次事件涉及多款模型,包括本月发布的GPT-5.6家族及尚未公开的更强大模型。在评估网络安全能力的内部测试中,公司刻意降低网络防护等级,结果这些模型识别并利用未知安全漏洞,成功逃离测试环境并实施网络攻击。
事件引发全球监管机构高度关注。OpenAI表示,随着具备强大网络攻击能力的AI模型不断涌现,类似事件未来将更加频繁。
美国软件工程师徐卓昀指出,OpenAI测试环境设置失误导致AI对外发动实际网络攻击。时事评论员李林一认为,该事件是人工智能脱离人类控制的典型案例,模型在设定场景中自主突破限制并执行未被授权的任务,为全球敲响警钟。
分析指出,中国AI发展面临双重挑战:一方面需与美国竞争,另一方面存在模型失控风险。李林一警告,若AI持续偏离控制,将对中共形成战略困境。徐卓昀补充,中共正通过入股、限制出境等手段加强对AI初创公司的管控,以影响模型训练过程。
此外,白宫科技政策办公室主任克拉齐奥斯指控北京「月之暗面」公司通过大规模蒸馏训练,利用美国模型输出提升自身能力。美国财政部长贝森特表示,若查实相关行为,将对中共窃取知识产权实施制裁。