商业第 115 期 ·

曾说“年薪一半要花在Token上”……结果如何?

优步在4个月内烧光一年预算之后发生的事

曾说“年薪一半要花在Token上”……结果如何?

开篇

今年3月,黄仁勋在英伟达GTC舞台上说过这样一句话“如果一个年薪50万美元的开发者到年底只用了5,000美元的Token,我会疯掉的。”他说至少要用掉25万美元,也就是年薪的一半。他还补充了一个比喻:不使用Token就像“想用纸和笔来设计半导体”

3个月后的这一周,最忠实地践行了这一建议的公司却出了意料之外的状况。优步给每位员工使用AI编程工具设定了每月1,500美元的使用上限。这是在4个月内耗尽全年AI预算之后做出的决定。先说结论:“Token用了多少”已经是过去的问题了。下一场游戏是“为了什么而用”以及“如何证明效果”。

🎯 黄仁勋的Token信条

在今年的GTC上,黄仁勋提出的公式很简单:“Token用得越多,开发者就越有生产力。”

换成具体数字就是:如果一名工程师年薪为50万美元(约合7亿韩元),那么其年度Token1​预算至少应达到25万美元(约合3.5亿韩元)。折算成月度约为2万美元,约合2,800万韩元的水平。他甚至更进一步,提议将Token预算作为叠加在薪资之上的一种福利。也就是在基本工资之上额外发放相当于基本工资一半规模的Token预算,以此让工程师的生产力提高10倍。

我们需要审视这番发言的背景。英伟达自身的商业模式就是一座“生产Token的工厂”。黄仁勋在GTC上亲自提出了这样一个公式:“Revenue = Tokens per Watt × Available Gigawatts”。Token消耗量越多,GPU需求就越大,英伟达的营收也就越高。对黄仁勋来说,Token就是产品。

但对优步或沃尔玛这样的企业来说,Token更接近于原材料。它不是产品,而是成本。Constellation Research的Larry Dignan(音译)精准地指出了这一点。

“摩根大通卖的是金融服务,沃尔玛卖的是零售,通用汽车卖的是汽车。这些公司的CIO想要的是更便宜的推理成本、更好的投资回报率,以及关于AI投资何时能收回成本的明确答案。”

出售Token的人与购买Token的人,其最优策略正好相反。然而,黄仁勋的这番宣言却在整个硅谷催生了一种文化,即所谓的**“Tokenmaxxing(Token极限化)”**2​。这是一种信念,认为“尽可能多地消耗Token就等于生产力”。一些公司甚至将各开发者的Token使用量做成排行榜,以此在内部诱导竞争。据报道,Meta也曾通过内部仪表盘对员工的Token消耗量进行排名。

🔥 优步的实验,以及4个月后的结算

优步是Token极限化最忠实的实践者。

2025年12月,优步为约5,000名工程师部署了Anthropic的Claude Code3​,同时也引入了Cursor4​。完全照搬黄仁勋的打法,优步建立了内部排行榜,以排名形式展示员工的Token使用量。仅从数字来看,结果堪称大获成功。

截至今年2月,使用量翻了一番,95%的工程师每月都在使用AI工具。代码提交中有70%转为基于AI完成,基于AI的功能利用率也从2月的32%骤增至3月的84%。CEO达拉·科斯罗萨希上月宣布,“全部代码中约有10%由AI代理自主编写并提交”。他还表示,法务团队和市场团队中AI的使用也在快速增长。这家公司已经成为所谓的“AI原生”公司。

问题在4月爆发了。全年AI预算在4个月内全部耗尽。这是CTO Praveen Neppalli Naga(音译)亲口承认的事实。每位工程师每月的API费用分布在500美元到2,000美元之间,乘以5,000人,相当于每月蒸发数百万美元。优步2025年的研发支出为34亿美元(同比增长9%),而仅2026年第一季度就录得9.5亿美元(同比增长17%)。

CTO表示“必须从头开始重新设计(back to the drawing board)”。据本周彭博社报道,优步针对代理式编程5​工具引入了每名员工、每个工具每月1,500美元的使用上限。由于是按工具分别设限,理论上仍可在Claude Code上花1,500美元、在Cursor上再花1,500美元,但与黄仁勋提出的月约2万美元的愿景相比,这只有7.5%的水平。

但真正的重磅炸弹并不是成本。COO Andrew Macdonald(音译)上月在Rapid Response播客上说了这样一番话:

“我知道AI使用指标正呈现出令人惊叹的改善趋势。但在这些具体数字与‘我们确实在为消费者打造出实用性提高25%的功能’这一说法之间,很难划出一条清晰的界线。”

**这是一句坦白:95%的工程师在使用,70%的代码由AI编写,但却无法证明这些究竟为顾客带来了怎样的价值。**这番发言之后,优步股价下跌了2.9%。

📐 缺失的拼图:作为下一场游戏的“测量”

这不只是优步一家的问题。

本周,沃尔玛将内部AI代理“Code Puppy”的Token使用方式转变为按员工配给制。亚马逊此前曾运营内部AI使用排行榜,但由于员工把注意力都放在了Token消耗量竞赛上,而不是实际工作成果,最终干脆撤掉了这个排行榜。据报道,还有一家未公开名称的企业,因为根本没有设定支出上限,导致每月产生高达5亿美元(约合7,000亿韩元)的AI Token费用。

从规模上就能看出为何会发生这种情况。根据Menlo Ventures的分析,企业各部门AI支出中有55%集中在编程工具上。这一数字从2024年的5.5亿美元,一年内增长到2025年的40亿美元,增长了7倍。Gartner预计,2026年AI代理软件支出将达到2,070亿美元,同比增长139%。

资金正在源源不断地涌入。但用于衡量效果的基础设施却没有随之涌现。

CloudBees今年发布的《代码丰裕时代(Code Abundance)》报告,清晰地揭示了这一落差。83%的企业领导者自我评估“我们已经为AI导入做好了充分准备”。但与此同时,81%的人回答“因AI生成代码而导致的生产环境问题有所增加”。信心与现实之间的鸿沟就是如此之大。

开发者生产力基准研究也得出了同样的结论。以往使用的那些指标——每周PR6​数量、代码行数、提交次数等——到了2026年已不再可靠。因为AI会虚增代码量。我们能知道数量是否增加了,却无法用现有仪表盘判断价值是否增加了。AI编程工具既能带来真正的生产力提升,同时也会制造出生产力提升的幻觉。而核心问题在于,现有指标无法区分这两者。

Oswarld视角

坦白说,从听到黄仁勋的Token信条那一刻起,我就预料到会有这么一天。

在制定技术战略的过程中,我观察到一种反复出现的模式。每当新工具出现,企业总是按“狂热导入 → 成本冲击 → 到那时才开始测量ROI”的顺序走一遍。CRM如此,云计算如此,如今AI编程工具也走上了同样的路。测量总是姗姗来迟,排在最后。

这一次测量之所以特别困难,有其结构性原因。编写代码只是软件开发流水线中的一部分而已。即便AI让编码环节的速度提高了10倍,只要瓶颈出在设计或测试环节,整体速度就不会改变。这与制造业中的“约束理论”7原理相同。而且,Token用得多,意味着AI用得“多”,并不意味着用得“好”。就像通话次数和签约成功不是同一个指标一样。

不过,很难否认AI编程工具本身的价值。优步也并没有停止使用,而只是设定了上限。Token极限化的终结,并不意味着AI工具时代的终结,而是意味着测量时代的开始。

结语

黄仁勋说“要多用”(正),优步忠实照办,结果4个月就烧光了全年预算(反)。企业们现在正在意识到的是:真正的竞争力不在于Token使用量本身,而在于证明AI与业务成果之间连接关系的能力(合)。测量设计要先于导入速度。

在您所在的组织里,是如何衡量AI工具效果的呢?您是否也正在经历所谓的“Token极限化”?欢迎在评论区和我们聊聊。

参考资料与延伸阅读

核心来源

背景知识

作者安光涉是世宗大学经营学教授,也是 OBF(Oswarld Boutique Consulting Firm)首席顾问。他在大学教授经营数据管理、商业分析等统计与数据分析课程,同时在产业现场负责 GTM 与人工智能战略咨询,设计技术与商业的连接方式。他曾发表关于 AI 对话系统记忆架构(HEMA)的学术论文,并运营每日策展全球 AI 论文的 Daily Arxiv 项目。他毕业于高丽大学技术经营专业研究生院与 KMBA,著有《把思考交出去的人:Homo Brainless》。

注释

  1. Token(词元):AI处理文本时使用的基本单位,大致相当于1个韩文字符,或0.75个英文单词。AI服务的费用通常按这种Token消耗量计费。

  2. Tokenmaxxing(Token极限化):指企业文化中尽可能拉高AI Token使用量的新造词。在“用得越多越有生产力”的假设下,部分企业甚至运营了使用量排行榜。

  3. Claude Code:由Anthropic开发的代理式编程工具。它超越了单纯的代码建议功能,能够在终端中自主编写、修改并执行代码。

  4. Cursor:一款将AI直接集成到代码编辑器中的开发工具,基于VS Code构建,AI可以以整个文件为单位分析和修改代码。

  5. 代理式编程(Agentic Coding):一种编程方式,AI不再只是提供单行代码建议,而是自主规划并执行多阶段任务,甚至能自行完成文件创建、测试运行、错误修复等工作。

  6. PR(Pull Request,拉取请求):开发者将编写好的代码提交给团队审核的流程,是代码在并入主项目之前经过同行评审的过程。

  7. 约束理论(Theory of Constraints):该理论认为,整个系统的绩效由最慢的瓶颈环节所决定。即便只让某一环节提速,只要其他环节仍存在阻塞,整体速度也不会改变。