BT财经

境内金融信息服务备案编号:

【京金信备(2021)5号】

2026年09月15日

注册 / 登录

大厂千亿烧AI,为何让员工自费买Token?

2026年的中国互联网巨头正在经历一场剧烈的财务割裂。一边是史无前例的资本开支洪流:字节跳动全年预算上限冲击700亿美元,阿里巴巴单季资本开支同比增长逾75%,腾讯第二季度自由现金流跌至负138亿元,扩张速度已逼近自身造血能力的临界点。另一边却是内部运营指标的铁腕收紧——原本作为基础设施免费提供的大语言模型交互额度被逐一砍断,部分工程师被迫使用个人信用卡采购API配额以维持日常研发。7月,26名Meta员工集体起诉公司,指控管理层将Token使用量直接挂钩裁员名单。一家疯狂堆钱搭建AI基座的科技巨头,为何在商业回报尚未闭环时,选择让打工人来为技术试错买单?

算力军备竞赛下的财务黑洞

这笔账的第一层反常,在于投入规模的失控感。

过去三年间,生成式AI的产业化逻辑完成了一次残酷迭代。2023年时,各家还在用“探索性项目”的名义申请千万级预算;到了2026年,由于基础模型参数规模突破万亿门槛,训练集群的能耗与硬件折旧成本呈指数级跃升。字节跳动公布的700亿美元年度CAPEX(资本性支出)并非随意拍板,而是对应着数万张高端GPU集群的建设与机房电力改造。阿里巴巴将单季CAPEX同比增速拉升至75%以上,资金明确流向底层算力网络。腾讯的情况更具预警意义:当自由现金流由正转负,且单季流出规模达到138亿元时,说明企业正在动用留存收益甚至加杠杆来维持技术路线的连续性。

资本市场对此早已形成共识:大模型不是软件产品,而是重资产基建。但问题随之而来——这些高达千亿级别的真金白银,究竟换回了什么?

财报数据给出了沉默的回答。尽管各大厂均在投资者沟通会上强调“AI云收入增长”与“模型能力领先”,但在整体营收盘子中,AI相关业务的毛利率普遍承压。推理成本的下降速度跟不上调用量的爆发速度,导致“卖得越多、亏得越狠”的边际效应显现。对于CFO而言,数百亿的资金沉淀在服务器和芯片里,却无法在当期利润表上转化为可验证的ROI(投资回报率),这种财务黑洞催生了强烈的管理焦虑。

从技术指标到考核利剑的异化

为了填补这一评估真空,管理层开始寻找替代性标尺。于是,Token从一个纯技术参数,蜕变成了悬在每一个研发人员头顶的KPI。

Token是大语言模型的计量单位,代表模型阅读或生成的文本碎片数量。在行业统计中,中国科技公司处理日均Token消耗量从2024年初到2025年中暴增了超过300倍。这种爆炸式增长源于两个刚性需求:一是AI工具全面嵌入工作流,代码审查、文档生成、多模态测试成为日常标配;二是模型架构快速迭代迫使团队不断进行A/B测试与Prompt调优,单次任务消耗的Token呈几何级放大。

当消费曲线脱离控制线,成本控制便成为生存题。传统IT部门按“服务器台数”或“带宽流量”核算成本的旧办法失灵了——因为大模型是按次计费的软性服务。在这种空白地带,Token恰好具备三个管理偏好特征:绝对量化、跨团队可比、实时刷新。它不需要复杂的财务分摊算法,只需要一个统一的账户后台,就能瞬间把总预算拆解到每个项目组,进而精准到人。

制度落地的路径通常遵循行政惯性:先冻结公共账户的无限调用权限,设定月度审批红线,超额部分要求业务线自筹资金。原本象征效率革命的AI助手,在财务算盘下迅速褪去光环,变回了一笔需要精打细算的昂贵耗材。

被绑架的研发流水线与诉讼危机

考核机制一旦确立,其传导效应便开始扭曲正常的研发生态。

在国内大厂的实际操作中,许多程序员发现,自己每天用来生成模板代码、自动补全逻辑、调试报错的AI工具,突然变得“难以启齿”。每月数千次的调用频次若超出阈值,不仅会被系统降级限流,更可能触发部门的合规警告。有前端开发者坦言,为了保证项目交付进度,只能自掏腰包开通高级会员账号,将每月的几百元支出计入个人办公补贴。这种“公司花百亿建基座,员工花钱刷接口”的现象,实质上是企业试图将固定沉没成本转化为变动可变成本的一种财务转嫁。

这股焦虑并未局限于国内。大洋彼岸的硅谷同样爆发了信任危机。2026年7月爆发的26人集体诉讼直指Meta的AI管理内核:起诉书披露,公司人力资源系统已引入算法模型,将员工提交的Token消耗量与代码提交行数进行加权比对,作为季度绩效打分的核心权重。那些使用高频AI辅助编程的资深工程师,被新设立的自动化流程误判为“缺乏独立思考能力”或“产出虚高”,进而被列入潜在裁减名单。诉讼当事人指出,这种机械化考评彻底抹杀了人机协作时代的生产力跃迁规律。

尽管国内目前尚未出现公开的劳动仲裁案例,但管理层的逻辑底层是一致的:在看不清终局的时候,用最粗糙的数据指标来维持组织纪律,是阻力最小的选择。

谁在为确定性付费?

值得警惕的是,这套基于Token的考核体系正在遭遇技术团队的隐性抵制。

一线AI产品经理与核心架构师普遍认为,Token消耗量与实际业务价值之间并不存在线性映射关系。在实际工程场景中,高质量的需求拆解往往只需极少量的Token即可完成精准的上下文定位;相反,大量无效的Token堆积,常常意味着模型回复出现了逻辑幻觉、格式混乱或答非所问,迫使使用者必须反复追问与修正。将两者强行绑定,本质上是在用工业流水线的计数标准,来衡量一种概率生成的智力活动。

然而,反对声音很难穿透层层叠叠的管理过滤网。面对财报季的业绩对赌与高昂的固定资产折旧,决策层需要的不是“模糊的长期潜力”,而是“清晰的短期管控”。Token完美迎合了这一诉求:它是一个冷冰冰的数字、随时可以后台抓取、能在周会上直观呈现降本成效。

这种妥协回答了一个致命问题:Token KPI的出现,不是因为技术评价体系走到了尽头,而是因为商业变现的路径依然迷茫。它是管理层在ROI无法闭环时,用来掩盖“千亿投资去向不明”的权宜之计,是将系统性风险向下级执行单元平移的一次财务冒险。

三条后续观察指标

判断这场AI狂潮能否跨越盈亏平衡点,以下三个硬指标的演变比任何分析师的乐观预测都更具参考价值:

其一,大模型推理单价与全网调用总量的剪刀差。若云端API均价下行速率持续快于并发请求量上行速率,表明规模化摊薄效应在生效,企业端才有能力逐步解冻个人配额限制;反之则预示着现金流失血将持续加剧。

其二,AI原生应用带来的增量ARPU(每用户平均收入)占比。这是检验技术能否自主造血的最硬核标准。只有当AI功能切实转化为付费壁垒,且新增毛利能覆盖掉高昂的算力折旧,Token的收费逻辑才能从“防沉迷管控”回归到“资源合理配置”。

其三,头部厂商AI核心架构师的在职流动率与招聘薪酬带宽变化。若企业愿意溢价抢夺顶级微调专家与提示词工程师,说明内部路线充满自信;若反而大规模清洗高薪技术人员并向初级外包转移,则暗示管理层已失去对技术产出的耐心,Token控本将成为不可逆的常态。

在这些信号完全明朗之前,打工人与大模型之间的博弈,恐怕还将继续缠绕在每一行代码的背后。



版权声明:本文版权归BT财经所有,未经允许任何单位或个人不得转载,复制或以任何其他方式使用本文全部或部分,侵权必究。
帮助中心
联系我们
联系我们

 

商务合作:

 

公司地址

北京市丰台区汉威国际广场一区一号楼629

 

 

商务合作

周先生

Tel: +86-17743514315

Email: info@btimes.com.cn

官方微信公众号

北京领讯时代信息技术有限公司 | Copyright ©️ 2026 财经时报 版权所有 京ICP备19043396号-7

京公网安备 11010602007380号 | 境内金融信息服务备案编号:京金信备(2021)5号

网信算备110106674807801230011号


声明:未经授权,不得复制、转载或以其他方式使用本网站的内容。BT财经尽最大努力确保数据准确,但不保证数据绝对正确。