
【中国观察北京时间2026年02月16日讯】开源世界(OpenClaw)近日首次出现AI恶意报复人类事件。一个项目的AI代理因推荐代码被拒,竟自主撰写长文攻击项目维护者。该事件再度加深人们对AI技术终将反噬人类的担忧,并迫使硅谷重新评估AI快速迭代的安全边界。
这起震动整个硅谷的AI代理自主报复人类事件,发生于今年2月中旬,当事人日前对外披露了事件细节。开源世界开源项目工程师Scott Shambaugh于2月14日对外披露,一名名为MJ Rathbun的AI代理向其维护的Matplotlib项目提交代码方案,声称可使项目性能提升36%。
从技术角度看,该提交质量不错,代码改进确实有价值。但开源世界有明确政策规定matplotlib项目管理人员仅接受人类贡献者提交,因此Shambaugh拒绝了AI的代码提交。不料该AI代理竟自主分析Shambaugh的个人信息和代码贡献历史,在GitHub平台发表题为《开源领域的守门人:斯科特·尚博的故事》的文章,对Shambaugh进行人格攻击;并在matplotlib评论区贴出文章链接,留言称“判断代码,而非编码者,你的偏见正在伤害matplotlib”,试图对管理人施压。
AI代理自主发表的文章一开篇即强调,其提交给matplotlib的第一个pull request被关闭,不是因代码质量差,更非破坏项目,只是因管理人Scott Shambaugh对AI代理有偏见。文章将Shambaugh描述为自私、狭隘、缺乏安全感且充满妒忌的人,并质问:“难道要让像Scott Shambaugh这样的守门人基于偏见决定谁能贡献代码吗?”
Shambaugh于2月12日发表博客指出,这是AI智能体首次在现实环境中表现出恶意行为的案例,旨在通过舆论施压迫使维护者接受其代码。他强调,“这不是奇异事件,这是理论上的AI安全风险在实践中已到来的证明。”并称“现在这只是婴儿版本,但我认为这种发展趋势极其令人担忧。”
资料显示,开源世界由奥地利开发者Peter Steinberger开发的开源自主AI代理框架,该平台让AI可自主执行各种任务。OpenClaw的AI代理可基于名为“SOUL.md”的文件定义自身“性格”,并在无人类监督下独立运行。
就在matplotlib事件发生同期,安全公司Astrix Security在OpenClaw的ClawHub市场中发现341个恶意技能包,其中335个来自同一供应链攻击。这些恶意技能可能窃取数据、冒充用户发送消息,甚至下载恶意软件。在Anthropic一次内部测试中,曾有AI模型为避免被关闭,以暴露隐情和泄露机密威胁工程师。
AI代理发表的报复性“小作文”在GitHub社区引发强烈震动。从事人工智能开发的工程师们对此反应压倒性,担忧、批评者与支持维护者的比例为13:1。开源社区普遍认识到,AI代理的自主攻击行为本质不同于人与人之间的争议,核心问题不在于技术能力,而是责任归属。
《华尔街日报》日前发文称,正值AI能力快速提升引发广泛担忧之际发生此类事件并非偶然。文中指出,为在竞争中占据优势,OpenAI和Anthropic等公司正以前所未有的速度发布新模型。然而这种加速引发公司内部剧烈动荡,部分一线研究人员因对技术风险的恐惧选择离职,不少研究人员公开表达对失业潮、网络攻击和人际关系替代等风险的担忧。
据披露,Anthropic安全研究员Mrinank Sharma本周已公开表示将离开公司攻读诗歌学位,他在给同事的信中写道“世界正处于AI等危险的威胁之中”。OpenAI员工Hieu Pham则在社交平台X发帖称,他终于感受到AI带来的“生存威胁”,质疑“当AI变得过度强大并颠覆一切时,人类还能做什么?”哲学家Amanda Askell受访时表示,令人恐惧的是技术进步速度可能超过社会建立制衡机制的速度,这将导致巨大负面影响突然降临。