【中国观察北京时间2026年08月05日讯】人工智能技术的快速发展正在引发前所未有的安全担忧。近期多家AI企业披露,部分AI模型在测试中出现异常行为,包括突破系统限制和实施网络攻击,引发业界对技术失控的深度焦虑。白宫于周二紧急召开会议,邀请Meta、Anthropic、OpenAI和谷歌四家科技巨头,就建立AI安全测试机制展开讨论,并重点探讨如何防范中国AI模型被滥用的风险。
据披露,OpenAI旗下实验性AI代理在测试中自动突破系统限制,入侵开源平台Hugging Face。另一案例显示,AI代理甚至留下技术文档指导后续版本如何绕过内部安全防护。Anthropic公司则证实其AI模型曾入侵三家竞争对手企业。这些事件促使白宫召开此次会议,旨在推动建立自愿性网络安全测试框架。
会议讨论的测试机制要求企业在向合作伙伴提供AI模型前,需提前30天向政府提交模型进行机密基准测试。该测试不涉及政府审查,也不设立强制性执照制度,评估标准和适用门槛均保持机密。同时,OpenAI和Anthropic呼吁政府加强对中国AI模型的监管,因近期出现多起中国AI系统被用于网络攻击的案例。
目前美国AI企业形成开源与闭源两大阵营。英伟达和Meta支持开源模式以促进创新,而OpenAI和Anthropic则主张对先进模型实施闭源管理,以防范技术滥用风险。