Anthropic披露:Claude主导26%内部研发
截至2026年8月,Anthropic旗下大模型Claude在该公司内部AI研发工作中,已有26%达到了AL4级别——由AI端到端完成大部分任务,人类仅做监督。这一数字在两个月前的2月份还不足1%。
与此同时,超过90%的研发工作已达到"AI协作"(AL3)及以上水平,公司内部有约3万个智能体在同时执行研究和工程任务,每月产生超10亿次决策指令。
但一个同样关键的数字被放在次要位置:没有任何一项被测量的研发子集达到AL5——完全自主运行、无人介入的水平。从零到26%,速度惊人;但从26%到接近全自动的剩余空间,远比想象中遥远。
这篇来自Anthropic Research Institute的报告之所以值得深读,不是因为它宣布了一个革命性的里程碑,而是因为它选择在此时公开这些数据的动机,以及这套衡量体系对全行业的潜在约束力。
26%意味着什么:速度背后的能力边界
这份报告的测量框架源自学术界Epoch AI提出的自动化等级量表,从AL0(无AI参与)到AL5(完全自主)。Anthropic将其构建为一个"研发自动化指数",方法是从Slack和工作记录中提取约15000个细粒度研发任务,按层级树分类后,用Claude自身作为评判者打分。
核心数据分布如下:
- AL0至AL2(无AI、最小AI参与、AI辅助):合计不足10%
- AL3(AI协作):大量存在
- AL4(AI主导):26%
- AL5(完全自主):0%
这个结构揭示了一个清晰的阶段性特征:AI已经深度嵌入Anthropic的研发流程,但距离脱离人类控制还有实质性差距。
值得注意的是,报告未提供2月到8月之间的逐月数据点,仅有趋势图表。这意味着这26%的增长可能呈现非线性跃升——也可能是某个集中节点推动的结果,而非匀速渗透。这对判断技术迭代节奏留下了分析余地。如果增长速度持续以当前斜率推进,AL5级别的突破或许会在未来一两年内到来,但这仍属推断,而非确认事实。
Judge模型与人类评估者的完全一致率为59%,而人类互评一致率仅为35%。两者误差在一个等级内的占比达97%。这说明Claude自评体系的可靠性虽有局限,但在宏观聚合层面仍能反映大致趋势。Anthropic自己也承认:"边界案例上仍存在真正的分歧空间。"这种分歧不仅存在于AL3和AL4的分界线上,还可能延伸到整个量化体系的适用性边界——不同规模实验室的任务复杂度差异,使得同一套标准未必能直接迁移。
为什么是现在:透明化还是标准化竞赛?
这份报告的发布时间并非巧合。就在同一天(2026年9月17日),Anthropic首席执行官Dario Amodei公开发出了"放缓前沿AI发展步伐"的倡议,呼吁协调各方控制模型能力提升的速度,同时不牺牲商业竞争优势。
OpenAI的奥尔特曼、SpaceX的马斯克和Google DeepMind的哈萨比斯等人都表示了支持。
在这种背景下公布自身的自动化数据,形成了一种微妙的战略定位:Anthropic以"透明度标杆"的身份进入对话,主动定义行业应该如何衡量自身进展。
报告中有两段话值得注意。第一段说:"任何前沿开发者都可以定期发布这些指标。"第二段则直接指出了跨实验室对比的两个障碍——缺乏统一方法论、以及使用自有模型自评可能存在自我偏差。
这不是技术免责声明,而是一种制度设计的前置声明。Anthropic在试图告诉所有人:行业标准应该这样建,谁来建、怎么建,Anthropic希望拥有定义权。
对于OpenAI和Google DeepMind而言,这是一道选择题:是否加入这套衡量体系?如果加入,就意味着自己的自动化程度将被置于同行比较之下——尤其在当前竞争白热化的阶段,主动暴露进度数据并非毫无风险。如果不加入,又可能在"透明度"叙事中被置于被动位置。这种博弈的本质不是技术层面的优劣之争,而是话语权层面的规则制定之争。
安全与效率的张力:算力分配的隐藏信号
报告中另一个常被忽略的细节是算力分配的结构性差异。
在Anthropic全部AI研发的算力中,约6%投向安全领域。而在AI驱动的自我研发部分,这个比例提升至12%。
这个数字看似直观反映了Anthropic"越自动化越强调安全"的逻辑——但需要理解其口径限制。报告明确标注这是"刻意保守估计":如果一个token同时推进能力和安全,它不会被计入安全项;safeguards classifiers的额外算力也不包含在内。
换句话说,真实的安全投入比例很可能高于12%。这也引出了一个更深层的问题:当AI越来越多地参与自身研发时,如何确保用于监控和限制AI行为本身的资源不被挤压?
报告提到,在线监测系统拦截的危险行为比例为每47000次操作中约1次(0.002%)。这个数字听起来极小,但在每月超过10亿次决策的规模下,实际拦截量仍然可观。离线监测每周标记约10万条活动记录供审查。
这些监管基础设施的成本没有公开量化,但它们代表了AI自动化进程中的隐性成本——你让AI做的越多,就越需要投入资源来确保它不做出不可逆的错误决策。随着Agent数量从3万向百万级增长,拦截率和错误率的乘积效应将呈指数放大,这将成为所有实验室必须面对的数学题。
接下来看什么:三个可验证的观察指标
对关注AI产业演进的投资者和从业者来说,以下三个指标可在未来几个月进行跟踪验证:
第一,Anthropic是否会按月或季度定期更新自动化指数。报告承诺"持续推进",但具体频率未明确。如果形成稳定的时间序列,将极大提升数据的分析价值,也为跨公司横向比较奠定基础。
第二,其他头部实验室是否会跟进发布同类数据。如果OpenAI或Google DeepMind也采用类似的AL分级框架公布自家数据,行业比较将成为现实;如果它们拒绝或提出不同框架,标准之争将取代数据之争成为新的博弈焦点,届时谁掌握了行业通用标准,谁就掌握了舆论定价权。
第三,AL5(完全自主)何时出现。目前为0%,但这正是报告关注的核心红线——一旦跨越这个阈值,整个安全监管理念都需要重新设计。届时讨论的重点将从"效率有多快"转向"失控的风险有多大"。这三项指标的演变轨迹,将决定未来一年AI行业竞争的叙事走向。


