
【中国观察北京时间2026年06月05日讯】总部位于旧金山的人工智能公司Anthropic周四发文,呼吁全球主要AI实验室考虑放缓甚至暂停最先进AI系统的开发。公司研究人员认为,若能实现'放缓或临时暂停前沿AI开发',将有助于让社会治理与安全研究跟上技术发展的速度。
该文章由Anthropic研究院负责人马里纳·法瓦罗及联合创始人杰克·克拉克共同撰写。文中指出,当前人工智能模型的能力进步速度极快,正朝向'递归自我改进'方向发展,即AI能够自主优化与升级自身系统,而不再需要大量人工参与。此机制被视为AI跨越人类智慧门槛并引发'智慧爆炸'的核心关键,已成为Google DeepMind与Anthropic等顶尖实验室的研发重心。
Anthropic表示,目前尚未真正出现这种情况,但其到来'可能比大多数政府与机构预测得更早'。公司指出:'现有证据表明,在人工智能开发过程中的每一步,人类的角色都在不断收窄'。为实现全球暂停AI开发,需美国与中国等主要人工智能国家,以及一系列巨头科技公司共同参与,同时建立可核查的监督系统。
Anthropic近年因推出Claude系列模型而崛起,并在与OpenAI等企业的竞争中受到市场关注。据媒体报道,公司近期完成新一轮融资,估值接近1万亿美元,并已秘密启动上市程序。不过,其长期强调人工智能安全问题,在业界引发争议。风险投资人、川普政府非正式顾问大卫·萨克斯曾批评Anthropic,认为其表面以'安全'为名,实则试图通过监管限制竞争对手发展。
部分批评人士指出,Anth比尔反复强调旗下最新AI模型存在潜在安全危险,也具有一定市场营销效果。2026年4月,Anthropic推出最先进且神秘的预览版模型Claude Mythos,该模型展现出极为强大甚至令安全界震惊的自主网络安全能力。测试证实,Claude Mythos能够自主发现并串联多个'零日漏洞',其挖掘与利用安全漏洞的能力远超以往的AI模型(如Claude 4.6 Opus等)。它甚至在各大作业系统与浏览器中,找出了隐藏数十年、连人类专家和自动化工具都未曾发现的系统安全漏洞。
由于担心该模型若被骇客武器化,可能引发灾难性网络攻击,Anthropic拒绝向公众开放Mythos。相反,采取严格限制的封闭发布策略,通过Project Glasswing计划,将该AI模型仅提供给少数(最初约40-50家,后于2026年6月扩大至约150家)特定的大型科技公司、资安机构及关键基础设施联盟(如微软、苹果、亚马逊、CrowdStrike、欧盟资安局ENISA等)进行防御性漏洞修复。此举也被一些专业人士解读为展示技术实力的方式。
目前,人工智能行业对AI是否已接近'通用人工智能'(AGI)仍存在巨大分歧。所谓AGI,是指接近、具备甚至超越人类智慧的理论系统,能够理解、学习并执行人类能完成的任何智力任务的AI系统。人工智能领域知名学者、元平台前首席人工智能科学家杨·勒丘恩表示,现有大型语言模型难以真正达到人类智能水平。他此前曾形容,目前人工智能的智能程度更接近'猫的水平',远远不如人类。
但Anthropic首席执行官达里奥·阿莫代伊则多次警告,人工智能可能加剧社会不平等,甚至取代大量初级白领工作。公司表示,未来数月将与政策制定者、研究人员及其它人工智能公司展开讨论,研究建立全球协调机制,以应对人工智能快速发展带来的风险。