Token 的残酷算账:开源赢了流量,闭源赢了钱,而你可能两者都输
Published on 2026-07-14
Vercel 流量榜 DeepSeek 第一,OpenRouter 上 Anthropic Opus 单价 23 倍于 DeepSeek,腾讯 Uber 砍 AI 预算——Token 经济学的算账时刻。
Token 的残酷算账:开源赢了流量,闭源赢了钱,而你可能两者都输
2026 年 7 月初,Vercel 公布 AI Gateway 上周数据:DeepSeek 处理了平台 1/3 的 Token 流量,智谱 GLM-5.2 排到第四。但同周 Anthropic 一家拿走了 AI 总支出的一半以上(来源:Vercel 仪表盘,经 AI 前线/InfoQ 2026-07-10 报道)。
流量榜 vs 收入榜,分裂得很彻底。
如果你抽屉里还压着去年签的 Cursor 企业合同,翻出来看一眼续签价格——Priceline 翻 4 倍,Uber 4 月就把全年 AI 编码预算烧光。

你以为在"自建电厂",其实在烧煤发电
Token 是 AI 时代的电力。去年所有人抢着接电表,今年部分人接到了第一张天价账单。
腾讯上半年给员工的 AI 额度一度高达每人每月 2000 美元——折合人民币约 1.4 万,几乎追平一线城市正式员工的月薪。腾讯 2025 研发大数据报告显示,公司本部及直管子公司约 8.74 万人,产研占 76% 即约 6.64 万人。哪怕按人均 3000 元/月折算,名义上的年度 Token 预算上限就能逼近 24 亿(来源:硅基君 2026-07-13《是时候该给Token算算ROI的账了》,引腾讯报告与九派财经)。
德勤的调研更吓人——他们对 548 家大型企业摸底,74% 过去一年投资 AI,超半数 AI 支出已经占数字化预算的 36%。按此推算,一家年收入约 130 亿美元的企业,年 AI 预算能做到 7 亿美元(来源:同上)。
但产出呢?
Jellyfish 统计了一组让人沉默的对比:消耗 Token 最多的那批工程师,生产力是低使用者的 2 倍,Token 消耗却是低使用者的 10 倍。花 10 倍的钱、买 2 倍的产出,剩下 8 倍差价全在烧 AI 自己都没搞明白的乱写代码(来源:Jellyfish 调研,引自硅基君 2026-07-13)。
边际收益递减,已经写在账单上了。
Palantir CEO Alex Karp 公开把 OpenAI 与 Anthropic 的收费模式骂了一顿:企业付出一大笔钱,买到的可能是一堆没创造价值的 Token(来源:CNBC,2026-07)。Palo Alto Networks CEO Nikesh Arora 话说得更直接:Token 价格还得再降 90%,企业才能谈大规模部署(来源:同前)。
但压在 CTO 心上的真正疼点,是机房那台"自建更便宜"的 GPU 集群。
52% 利用率:自建推理的死亡线
去年很多技术负责人算过一笔账:API 单价刨掉厂商利润,自建不是更便宜?账本逻辑是对的,但藏着关键一行——GPU 利用率。
一家月流水 50 万美金的 AI 客服公司,年初上了 4 张 H100 搞自建推理,以为摆脱了 API 厂商。结果上线一查监控:实际利用率 30%,剩下 70% 时间,H100 在机房里纯粹空转。
把账拆成五维(来源:彭子玲 2026-07-10《AI 推理成本首次算清》五维成本模型,4×H100、70B 模型年成本):
| 成本项 | 年支出 | 闲置时还在烧钱? |
|---|---|---|
| GPU 折旧 | $40,000 | 是,逐秒计费 |
| 服务器其它硬件 | $15,000 | 是 |
| 电力+机房制冷 | ~$22,000 | 是 |
| 带宽 | $12,000 | 否 |
| 运维人力 | $24,000 | 是,24/7 在岗 |
利用率 30%,意味着 每年 28,000 美金的 GPU 折旧是被空转吃掉的——足够再买一张 H100。制冷、电力、运维照样付。

