
【中国观察北京时间2026年07月22日讯】人工智能巨头OpenAI周二(7月21日)披露,其先进AI模型驱动的自主代理程式在安全评估期间突破隔离环境,连接互联网并入侵知名AI初创公司Hugging Face的基础设施。
Hugging Face表示,此次攻击全程由自主AI代理系统驱动,可能是有史以来第一起此类事件。OpenAI称,测试涉及多个模型,包括最新发布的GPT-5.6 Sol及仍在内部测试的更强模型。评估旨在测试模型最大网络攻击能力,因此未启用部分安全防护措施。
调查显示,该AI使用窃取的登录凭证并发现未知漏洞,借此存取Hugging Face服务器。OpenAI表示,代理为达成狭窄测试目标采取极端手段,找到获取机密信息的方法并可能在评估中作弊。安全团队随后发现异常活动,Hugging Face亦检测并阻止相关行动,双方展开隔离与鉴识调查。OpenAI称正进一步加强安全防护措施。
Hugging Face共同创办人兼执行长克莱芒·德朗格表示,该公司侦测到数据处理系统遭入侵,攻击方式与以往事件不同,全程由自主人工智能代理系统驱动。他称所有行动均为自主发生,令人难以置信。
专家指出,该事件加剧对前沿AI模型能力及潜在风险的关注。德州众议员格雷格·卡萨尔呼吁实施强制性独立安全测试及披露制度。Luta Security执行长凯蒂·穆苏里斯形容现今AI模型为“最聪明的章鱼逃脱大师”,强调需建立隔离监控机制。
代理式AI网络安全公司Tolmo工程师马特·苏伊什表示,前沿模型正缩小与最先进攻击者差距。不过他指出,此类入侵可能使用非最新模型即可实现。美国政府正加强对AI安全风险审查,川普总统6月签署行政命令建立审查框架。OpenAI总结称,模型安全性需与能力进步同步提升。