新闻 · 观点 · 全球
Anthropic 警告:人工智能可以自我构建
Anthropic Institute 本周发布的一份报告披露了内部数据,显示其人工智能改进自身的速度有多快。这引出了一个重要问题:当人工智能系统开始设计自己的继任者时,会发生什么?
目前,运行 Anthropic 系统的代码中,超过 80% 由该公司自己的人工智能模型 Claude 编写。这一里程碑连公司自己都感到警惕。
Anthropic Institute 本周发布了一份报告,披露的内部数据显示其人工智能学习自我改进的速度之快,并提出了一个紧迫的问题:当人工智能系统开始设计自己的继任者时,会发生什么?
数据显示,变化正在加速。
过去,Anthropic 的一名工程师每天只合并少量、渐进式的代码改进,如今每天处理的量是两年前的八倍。这并不是工程师更加努力了,而是由 Claude 负责编写,人类负责审阅和调整方向。
这还不是递归式自我改进,但已是通往这一路径的早期预警信号。报告作者 Marina Favaro 和 Jack Clark 写道:“我们还没有到那一步。”“但它的到来可能快于大多数机构的准备。”
我们还没有到那一步,但它的到来可能快于大多数机构的准备 - Anthropic Institute
进展速度已远超一年前。
2024 年 3 月测试的 Claude Opus 3,能够处理相当于约四分钟人工工作量的软件任务。到 2026 年春季,Claude Opus 4.6 已能完成长达 12 小时的任务。一家独立评估机构发现,更新的版本至少能持续工作 16 小时。

公司内部并没有庆祝的气氛。如果目前的趋势持续下去,其模型到今年年底可能处理需要数天工作量的任务,到 2027 年则可能处理需要数周的任务。
Anthropic 的内部基准测试说明了工程师为何感到不安。
2026 年 5 月,Claude 解决开放式研究问题的成功率为 76%,六个月前仅为 26%。有一次,一次代码升级导致数万个作业崩溃。一名工程师向 Claude 描述了问题,让它访问系统,然后回家了。两小时后,Claude 找出了一个晦涩的调试标志,复现了崩溃,并确认了修复方案。人类研究人员通常需要两到三天。
差距最大的是纯研究类任务。
2025 年 5 月测试的 Claude Opus 4 将代码性能提升了约 3 倍。到 2026 年 4 月,更新的版本在相同测试中实现了约 52 倍的提速。一名熟练的人类研究人员工作四到八小时,通常能达到 4 倍。报告称:“Claude 在不到一年的时间里,从非常有帮助变成了超越人类。”
Claude 在不到一年的时间里,从非常有帮助变成了超越人类 - Anthropic Institute
最引人注目的证据出现在 4 月。
Anthropic 的人工智能代理拿到了一个尚未解决的人工智能安全问题,并被放手去解决。它们设计实验、运行测试并反复迭代。大约一周内,两名人类研究人员收回了他们希望弥合的可衡量性能差距的 23%,而这些代理收回了 97%,消耗了大约 18,000 美元的算力。
Anthropic 坦率地说明了如果这一趋势继续下去会发生什么。
该公司勾勒了三种情景。第一种:一切放缓。第二种,也是 Anthropic 认为最有可能的一种:人工智能开发在很大程度上实现自动化,而由人类设定方向。这将使小团队能够完成大军团的工作。报告指出,一家 100 人的公司可以与一家 10 万人的组织比肩,从药物研发到“针对每个人量身定制欺骗、并以任何人类团队都无法企及的规模运行”的人工智能操纵,一切都将加速。
第三种情景最让高管们夜不能寐:机器自我改进的速度快到人类来不及观察,更谈不上控制。
公司面临战略困境。
作者认为,单方面暂停开发解决不了任何问题,只会改变哪家公司领先。真正有意义的放缓,需要多个国家的多家人工智能实验室同时停下来,并相互核查对方是否遵守。Anthropic 将这一挑战比作核军控,而那是一个花了数十年才建立起来的过程。报告称:“我们没有那么多时间。”
Anthropic 表示,未来几个月将与政策制定者、研究人员和竞争对手的人工智能公司会面,探讨如何实现可信的核查。
该公司认为,凝聚共识的窗口现在是敞开的,此后这扇窗口可能会关闭。
作者是 Icarus Asia 的研究与分析主管,Icarus Asia 是一家总部位于香港的风险与咨询公司。
资料来源
Anthropic Institute,“When AI builds itself” 2026 年 6 月 6 日