————评Anthropic《当AI开始构建自己》兼论我们时代的认知诱惑
摘要
Anthropic近期发布的《当AI开始构建自己》一文,以前所未有的内部数据,揭示了AI系统正在加速参与AI研发本身的惊人趋势。本文在承认其数据价值的同时,试图指出该文在论证上存在的三重逻辑断裂:从“代码产量”到“创造性工程能力”的势能误认、从“模式识别”到“研究品味”的概念偷换,以及从“工具加速”到“自主进化”的叙述飞轮。这些断裂,根源于一种深层的认知诱惑——将高度优化的专业工具系统的协作,误认为一个有自我意志的“存在者”正在崛起。文章最后提出,Anthropic的悖论在于,它一面建造着人类认知最精密的镜子,一面又被镜中过于逼真的影像所惊动。真正的清醒,或许在于承认:我们看见的,仍然是我们自身能力的极致投射,而非一个他者的诞生。
2026年6月,Anthropic公司发布了一篇注定将载入AI政策讨论史册的文章:《当AI开始构建自己》。这篇文章的冲击力,不在于它提出了什么新奇的理论,而在于它用来自公司内部的、详尽的工程与科研数据,为那个长久以来盘旋在AI话语边缘的幽灵——递归自我改进——提供了第一份公开的、来自前沿实验室内部的进度报告。
文章的核心叙事简洁而令人眩晕:在Anthropic,超过80%的合并代码已由AI生成,工程师人均产出量在两年内增长了8倍;AI独立完成任务的能力每四个月翻一番;在优化代码的研究实验中,AI实现了52倍加速,而人类研究者需要4-8小时才能达到4倍;甚至在“研究判断”的测试中,AI给出比人类研究者更优的“下一步”建议的比例,已从51%升至64%。
基于这些数据,文章推演出三种未来情境,其中最极端的一种是:AI系统将实现完全的递归自我改进,其发展速度将“脱离人类决策速度”。文章作者——Anthropic的联合创始人——随即呼吁,世界需要认真考虑建立一个全球协调的、可验证的“暂停”机制。
这篇文章的价值是毋庸置疑的。它是来自技术风暴眼内部的最坦诚的警告之一,它迫使政策制定者和公众正视一个正在加速的现实:AI已不再仅仅是人类研究的对象,它正在成为AI研究的主体之一。然而,在承认其数据真实性和警示意义的同时,我们必须指出,这篇文章在论证上存在着几个关键的逻辑断裂。而这些断裂,恰恰暴露了我们这个时代在面对技术奇观时,一种根深蒂固的认知诱惑。
断裂一:代码产量与工程能力的叙事势能
论文最震撼的数据——8倍代码产出、80%贡献率——被放置在一个强烈的叙事势能中,让读者不自觉地推导出:一个能够进行复杂、创造性软件工程的自主智能体,已经呼之欲出。
然而,“代码产量”与“创造性工程能力”之间存在着一道尚未被跨越的鸿沟。我们有充分的理由推测,这8倍的增长,大部分集中在那些高度模式化、可清晰定义的编程任务上——编写符合API规范的调用代码、生成标准化的单元测试、实现成熟的算法逻辑。这些是软件工程中不可缺失的“体力活”,但并非其创造性的核心。设计一个全新的分布式系统架构、发明一种尚未被命名的算法、在相互矛盾的需求之间做出根本性的权衡——这些行为的认知本质,与自动化已知模式的生产,不属于同一个范畴。前者仍然是人类工程师在AI的辅助下完成的,其认知投入被“80%”这个数字系统性地遮蔽了。
断裂二:“研究品味”的度量谬误
论文中那个“研究判断”的提升数据,被用来暗示AI正在获得某种“研究品味”。这是一个极具误导性的概念偷换。
这个测试的设计是:在人类研究者已经走过一遍、事后复盘认为当时“走错了路”的节点上,让AI重新选择下一步。AI的成功,本质上是基于历史数据的模式识别任务——在已知的最优路径图上,找到那个被人类错过的路标。这当然是令人印象深刻的智能,但它更接近于事后诸葛亮的极致化。
而真正的研究品味,是一种截然不同的认知能力。它是在没有地图、没有已知最优路径的未知领域中,提出那个从未被问过的好问题;是依靠多年沉浸所获得的、难以言说的直觉,去感知某个方向虽然困难但“对劲”;是在万千可能性中,做出一种带有美学和信仰色彩的、无法被还原为概率判断的选择。AI展示的,是在人类设定的棋盘上走出精妙一步的能力;而品味,是决定我们为什么要下这盘棋,乃至要不要掀翻棋盘、另辟战场的那种决断。
断裂三:从工具加速到自主进化的叙述飞轮
最根本的逻辑断裂,在于文章将一系列令人惊叹的工具性进步——写代码更快、做实验更快、复盘更准——打包成一个巨大的叙述飞轮,直接推向了“递归自我改进”和“脱离人类决策”的未来图景。
这个飞轮的启动,需要一个它目前完全不具备、论文也未提供任何证据表明其正在涌现的前提:一个统一的、能够理解并设定自己目标的“自我”。目前的系统,是一组由专门化Agent组成的、被人类研究者精心编排和调度的工作集群。它之所以高效,正是因为人类的编排始终在场——设定总体目标、定义成功标准、在多个实验方向中做出选择、在对话偏离航道时将其拉回。论文中唯一被明确保留给人类的角色——“方向设定”——恰恰是整个认知链条中最具杠杆效应、最不能也不应被自动化的那个环节。
将一组高度优化的专业工具的高效协作,叙述为一个有自我意志的“存在”正在崛起,这正是那个让读者感到“太兴奋和冲动”的根源。它模糊了“强大的工具”和“自主的行动者”之间的本体论界限。
结语:造镜者的悖论
这篇文章之所以值得我们如此细致地审视,恰恰因为Anthropic本身是一个极具象征意义的角色。在我们的整个讨论中,LLM被反复比喻为一面对人类认知的镜子——它以其对语言形式的完美复刻,照出了语言中那部分永远无法被技术化的人文灵魂。而Anthropic,正是这面镜子最前沿的打磨者之一。
现在,造镜者本身,被镜中那过于逼真的、正在加速运动的影像所惊动了。
这篇论文,或许展现了人类认知在面对自身造物时的一个经典弱点:我们太容易被“类人”的表象和指数级的量化增长所震撼,以至于在逻辑上跳过关键步骤,自己补完了那个“它要活过来了”的故事。这种兴奋的叙事,固然可以推动紧迫的政策讨论,但也可能让我们在尚未想清楚“我们究竟在恐惧什么”之前,就做出冲动的、被恐惧而非理性驱动的回应。
因此,这篇论文的真正价值,或许不在于它那个关于“自我构建”的宏大叙事,而在于它所暴露出的那些具体数据——关于人机协作新界面的位移、关于人类认知劳动正在被如何重新配置的数据。真正的思考,应该从这篇论文的叙事结束、我们合上屏幕的那一刻开始。
我们需要问的,不是“它什么时候会超过我们”——这个问题的前提假设本身就值得商榷。我们需要问的是:在一个AI可以如此高效地执行、优化、复盘的世界上,人类认知劳动中那部分“不可压缩”的核心究竟是什么?是“设定方向”吗?如果有一天,“设定方向”也被模仿得真假难辨呢?
Anthropic的文章,是一面镜子中的镜子。它照出的,不仅是AI在加速构建自身这一事实,更是我们人类在面对这一事实时,那种渴望赋予它一个“他者”身份的深层冲动。保持清醒,或许就意味着抵抗这种冲动的诱惑,坚持在每一次惊叹之后,追问那个最冷静的问题:我们看见的,究竟是一个正在醒来的“他者”,还是我们自身力量与焦虑的又一次极致投射?