GPT-5.6 用三档切走市场,Ultra 模式提前一年把 Agent 编排推上台面
胡新宇
Published on 2026-07-13
OpenAI 一天发了 3 个 GPT-5.6,把价格砍到 1/16,再用 Ultra 模式默认协调 4 个 Agent 并行。这场发布会讲的不是更大的模型,而是把'模型+算力'切成乐高卖给程序员。程序员的下一个身份是编排师,不是 prompt 工程师。

GPT-5.6 用三档切走市场,Ultra 模式提前一年把 Agent 编排推上台面
摘要:OpenAI 一天发了 3 个 GPT-5.6,把价格砍到 1/16,再用 Ultra 模式默认协调 4 个 Agent 并行。这场发布会讲的不是更大的模型,而是把"模型+算力"切成乐高卖给程序员。程序员的下一个身份是编排师,不是 prompt 工程师。
OpenAI 一天发了 3 个 GPT-5.6,把价格砍到 1/16,再用一个默认协调 4 个 Agent 并行的"Ultra 模式"收口——这场发布会讲的不是更大的模型,而是把"模型+算力"切成乐高卖给程序员。
2026 年 7 月 9 日到 10 日,OpenAI 在 36 小时内做了五件事:发布 GPT-5.6 三档模型 Sol/Terra/Luna、推出桌面版 ChatGPT Work(把 Codex 和 ChatGPT 合并进同一个应用)、上线 Sites beta(AI 直接建站)、在 Responses API 开放 programmatic tool calling 和 multi-agent beta、并在 Codex 里新增一个 "ultra" effort 等级——这个等级默认协调 4 个 Agent 并行工作,用更高的 token 消耗换取更短的任务时间(来源:Latent Space AINews 2026-07-10、OpenAI 官方推文)。
这不是一次例行升级。这是一次产品形态的重新切割。
先看定价阶梯(每百万 token,input/output):
- Sol:$5 / $30(旗舰)
- Terra:$2.5 / $15(GPT-5.5 水平,成本砍半)
- Luna:$1 / $6(最快最便宜的高吞吐选项)
Luna 输出价只有 Sol 的五分之一。首次引入 cache-write 定价,cache-read 保留 90% 折扣(来源:@ArtificialAnlys)。
再看性能阶梯。OpenAI 官方称 Sol 在 Agents' Last Exam 上拿到 53.6 分,比 Claude Fable 5 adaptive 高 13.1 分;medium 推理档下比 Fable 高 11.4 分但成本仅 1/4;Terra 和 Luna 性能仍超 Fable,成本约 1/16。独立测评机构 ArtificialAnlys 给 Sol (max) 打了 59 分 Intelligence Index,仅比 Claude Fable 5 (max) 低 1 分——但单位任务成本只有 Fable 的 1/3。
这三档不是性能递减,是应用场景分流:要天花板选 Sol,要成本选 Luna,要折中选 Terra。这和卖手机不是一个套路——苹果不会同时卖 A18 Pro 和 A18 mini 让开发者自己挑,OpenAI 是把"模型"做成了可替换的算力 SKU。
而 Ultra 模式是这个产品矩阵的真正王炸。OpenAI 的官方描述很克制:"our highest-capability setting, coordinating multiple agents across parallel workstreams to finish complex tasks faster"——翻译过来就是:默认协调 4 个 Agent 并行跑同一件事,token 烧得多但完成更快。
这场发布会的关键信号是:模型规模红利见顶,产品分层和编排红利开始。

黄仁勋 7 月 11 日的最新访谈和 OpenAI 这步棋,刚好撞在同一个判断上。
黄仁勋的原话被翻译成中文后流传很广:"程序员应该开始'造 Agent',公司未来将建在 Harness 之上"(来源:创业邦 2026-07-11 转译报道)。Harness 这个词在英文里是"马具、缰绳"——也就是驾驭系统。把公司建在 Harness 上,意思不是说公司要变成 Agent 公司,而是说公司要变成驾驭 Agent 的公司。
这不是老黄随便说的场面话。三件事叠在一起看:
第一,OpenAI 用 3 档模型 + Ultra 4-Agent 协调把"组合算力"产品化;第二,ChatGPT Work 桌面合并把"问问题"和"改代码"压进同一张办公桌;第三,programmatic tool calling 开放——程序员现在可以用代码动态拼装工具调用链。
这三件事指向同一个方向:单个 Agent 训练师的角色正在被边缘化,编排师走上台面。
之前我们写 Agent Memory、写"最后一公里"、写"技术过剩时代你的核心不是能力",反复讨论的是"单 Agent 如何变强"。那些文章现在看来都还在上一个时代。GPT-5.6 一天之内给出的信号是:。
