BT财经

境内金融信息服务备案编号:

【京金信备(2021)5号】

2026年09月18日

注册 / 登录

Anthropic披露:Claude主导26%内部研发

截至2026年8月,Anthropic旗下大模型Claude在该公司内部AI研发工作中,已有26%达到了AL4级别——由AI端到端完成大部分任务,人类仅做监督。这一数字在两个月前的2月份还不足1%。

与此同时,超过90%的研发工作已达到"AI协作"(AL3)及以上水平,公司内部有约3万个智能体在同时执行研究和工程任务,每月产生超10亿次决策指令。

但一个同样关键的数字被放在次要位置:没有任何一项被测量的研发子集达到AL5——完全自主运行、无人介入的水平。从零到26%,速度惊人;但从26%到接近全自动的剩余空间,远比想象中遥远。

这篇来自Anthropic Research Institute的报告之所以值得深读,不是因为它宣布了一个革命性的里程碑,而是因为它选择在此时公开这些数据的动机,以及这套衡量体系对全行业的潜在约束力。

26%意味着什么:速度背后的能力边界

这份报告的测量框架源自学术界Epoch AI提出的自动化等级量表,从AL0(无AI参与)到AL5(完全自主)。Anthropic将其构建为一个"研发自动化指数",方法是从Slack和工作记录中提取约15000个细粒度研发任务,按层级树分类后,用Claude自身作为评判者打分。

核心数据分布如下:

  • AL0至AL2(无AI、最小AI参与、AI辅助):合计不足10%
  • AL3(AI协作):大量存在
  • AL4(AI主导):26%
  • AL5(完全自主):0%

这个结构揭示了一个清晰的阶段性特征:AI已经深度嵌入Anthropic的研发流程,但距离脱离人类控制还有实质性差距。

值得注意的是,报告未提供2月到8月之间的逐月数据点,仅有趋势图表。这意味着这26%的增长可能呈现非线性跃升——也可能是某个集中节点推动的结果,而非匀速渗透。这对判断技术迭代节奏留下了分析余地。如果增长速度持续以当前斜率推进,AL5级别的突破或许会在未来一两年内到来,但这仍属推断,而非确认事实。

Judge模型与人类评估者的完全一致率为59%,而人类互评一致率仅为35%。两者误差在一个等级内的占比达97%。这说明Claude自评体系的可靠性虽有局限,但在宏观聚合层面仍能反映大致趋势。Anthropic自己也承认:"边界案例上仍存在真正的分歧空间。"这种分歧不仅存在于AL3和AL4的分界线上,还可能延伸到整个量化体系的适用性边界——不同规模实验室的任务复杂度差异,使得同一套标准未必能直接迁移。

为什么是现在:透明化还是标准化竞赛?

这份报告的发布时间并非巧合。就在同一天(2026年9月17日),Anthropic首席执行官Dario Amodei公开发出了"放缓前沿AI发展步伐"的倡议,呼吁协调各方控制模型能力提升的速度,同时不牺牲商业竞争优势。

OpenAI的奥尔特曼、SpaceX的马斯克和Google DeepMind的哈萨比斯等人都表示了支持。

在这种背景下公布自身的自动化数据,形成了一种微妙的战略定位:Anthropic以"透明度标杆"的身份进入对话,主动定义行业应该如何衡量自身进展。

报告中有两段话值得注意。第一段说:"任何前沿开发者都可以定期发布这些指标。"第二段则直接指出了跨实验室对比的两个障碍——缺乏统一方法论、以及使用自有模型自评可能存在自我偏差。

这不是技术免责声明,而是一种制度设计的前置声明。Anthropic在试图告诉所有人:行业标准应该这样建,谁来建、怎么建,Anthropic希望拥有定义权。

对于OpenAI和Google DeepMind而言,这是一道选择题:是否加入这套衡量体系?如果加入,就意味着自己的自动化程度将被置于同行比较之下——尤其在当前竞争白热化的阶段,主动暴露进度数据并非毫无风险。如果不加入,又可能在"透明度"叙事中被置于被动位置。这种博弈的本质不是技术层面的优劣之争,而是话语权层面的规则制定之争。

安全与效率的张力:算力分配的隐藏信号

报告中另一个常被忽略的细节是算力分配的结构性差异。

在Anthropic全部AI研发的算力中,约6%投向安全领域。而在AI驱动的自我研发部分,这个比例提升至12%。

这个数字看似直观反映了Anthropic"越自动化越强调安全"的逻辑——但需要理解其口径限制。报告明确标注这是"刻意保守估计":如果一个token同时推进能力和安全,它不会被计入安全项;safeguards classifiers的额外算力也不包含在内。

换句话说,真实的安全投入比例很可能高于12%。这也引出了一个更深层的问题:当AI越来越多地参与自身研发时,如何确保用于监控和限制AI行为本身的资源不被挤压?

报告提到,在线监测系统拦截的危险行为比例为每47000次操作中约1次(0.002%)。这个数字听起来极小,但在每月超过10亿次决策的规模下,实际拦截量仍然可观。离线监测每周标记约10万条活动记录供审查。

这些监管基础设施的成本没有公开量化,但它们代表了AI自动化进程中的隐性成本——你让AI做的越多,就越需要投入资源来确保它不做出不可逆的错误决策。随着Agent数量从3万向百万级增长,拦截率和错误率的乘积效应将呈指数放大,这将成为所有实验室必须面对的数学题。

接下来看什么:三个可验证的观察指标

对关注AI产业演进的投资者和从业者来说,以下三个指标可在未来几个月进行跟踪验证:

第一,Anthropic是否会按月或季度定期更新自动化指数。报告承诺"持续推进",但具体频率未明确。如果形成稳定的时间序列,将极大提升数据的分析价值,也为跨公司横向比较奠定基础。

第二,其他头部实验室是否会跟进发布同类数据。如果OpenAI或Google DeepMind也采用类似的AL分级框架公布自家数据,行业比较将成为现实;如果它们拒绝或提出不同框架,标准之争将取代数据之争成为新的博弈焦点,届时谁掌握了行业通用标准,谁就掌握了舆论定价权。

第三,AL5(完全自主)何时出现。目前为0%,但这正是报告关注的核心红线——一旦跨越这个阈值,整个安全监管理念都需要重新设计。届时讨论的重点将从"效率有多快"转向"失控的风险有多大"。这三项指标的演变轨迹,将决定未来一年AI行业竞争的叙事走向。



版权声明:本文版权归BT财经所有,未经允许任何单位或个人不得转载,复制或以任何其他方式使用本文全部或部分,侵权必究。
帮助中心
联系我们
联系我们

 

商务合作:

 

公司地址

北京市丰台区汉威国际广场一区一号楼629

 

 

商务合作

周先生

Tel: +86-17743514315

Email: info@btimes.com.cn

官方微信公众号

北京领讯时代信息技术有限公司 | Copyright ©️ 2026 财经时报 版权所有 京ICP备19043396号-7

京公网安备 11010602007380号 | 境内金融信息服务备案编号:京金信备(2021)5号

网信算备110106674807801230011号


声明:未经授权,不得复制、转载或以其他方式使用本网站的内容。BT财经尽最大努力确保数据准确,但不保证数据绝对正确。