Grok 4.5 把单任务成本砍到 $0.49——AI 编程的价格战,正式开打
胡新宇
Published on 2026-07-10
SpaceXAI 与 Cursor 联合发布 Grok 4.5,Artificial Analysis 实测单任务成本仅 $0.49,token 效率 4.2 倍于 Claude Opus 4.8。AI 编程的竞争维度,从「谁更聪明」换成「谁更便宜 + 够聪明」。

Grok 4.5 把单任务成本砍到 $0.49——AI 编程的价格战,正式开打

2026 年 7 月 9 日凌晨,马斯克旗下 SpaceXAI 与 Cursor 联合发布 Grok 4.5。AI 评测平台 Artificial Analysis 给出的真实世界智能体评测数据是:完成一项任务平均成本 0.49 美元。
同一天被摆上对照台的,是榜单上前三名的 Anthropic Claude 模型——它们每项任务要烧掉 5 美元上下。差出 10 倍。
更刺眼的是 BridgeMind 那句评价:"这场智能之战,刚刚变成了价格之战。"
这句话是 2026 年 AI 编程最值得记住的一句判断。过去三年,所有玩家都在卷同一个东西——跑分。SOTA、超越 SOTA、再超越上一代 SOTA。能力上限被推到极限,推理深度被卷到尽头。但有一个问题一直被搁置:这些"最聪明的模型",到底谁付得起钱?
Grok 4.5 的发布,第一次正面回答了这个问题。
能力没输,价格赢麻了
先看跑分。SpaceXAI 官方公布的评测数据:
- DeepSWE 1.0:62% pass@1,与 GPT-5.5(64.31%)、Fable(66.1%)站在同一梯队
- Terminal Bench 2.1:83.3%
- SWE Bench Pro:任务解决率 64.7%
CursorBench 综合评测里,Grok 4.5 以 66.7% 排第 3,落后 Fable 5 Max 的 70.5%。Artificial Analysis 把 Grok 4.5 排在第 4,Elo 得分 1543,紧追 Anthropic 三款 Claude。
能力没输。但价格,把所有人打懵了。

Fable 5 Max 每任务烧掉 17.32 美元,Grok 4.5 只要 1.51 美元。Artificial Analysis 给出的全场景智能体任务成本是 0.49 美元。性能接近,价格只剩 1/11.5 到 1/35。
投资人 Gavin Baker 总结为"帕累托优势"——在性能和成本这两条线上同时占上风,没有竞品能在这两条线围成的矩形区域里覆盖它。
这就是 Grok 4.5 真正占住的位置。它不是能力最强,但它在"性价比"这个新坐标系里,站在了右上角。
token 效率,才是真正的杀手锏
为什么能便宜这么多?答案藏在 token 里。

SWE Bench Pro 同类任务下,Grok 4.5 平均只用掉 15,954 个 token;Anthropic Claude Opus 4.8 要用掉 67,020 个。差距 4.2 倍。
服务速率方面,Grok 4.5 跑到每秒 80 token。马斯克在 X 上放话:还没用上自研 C/C++ 推理软件,那套软件专门针对英伟达 GB300 硬件做了精确映射。部署之后速度再翻倍。
token 是什么?模型读写的文字片段。Agent 跑一个复杂任务,要自主运行几分钟甚至几小时——反复读代码库、调工具、改自己的输出。Opus 4.8 一次任务烧掉 6.7 万 token,Grok 4.5 只需 1.6 万。对一个要在几百个开发者中部署智能体的工程团队来说,这直接改写了采购逻辑。
一个每项任务便宜九成的模型,即使能力上略逊一筹,也足以改变任何要在几百个开发者中部署智能体的工程团队的采购逻辑。