← 返回

GPT-5.6 一口气发三个档:模型也讲"高中低配",你的钱该怎么花

GPT-5.6 一口气发三档:旗舰 Sol、均衡 Terra、轻量 Luna,上市三周连降两次。本文拆解分档逻辑与降价幅度,教你按任务选模型、不为信仰充值。

GPT-5.6 一口气发三个档:模型也讲"高中低配",你的钱该怎么花

GPT-5.6 一口气发三个档:模型也讲“高中低配”,你的钱该怎么花

手机行业的套路,终于轮到大模型了。

2026 年 7 月 9 日,OpenAI 正式开放 GPT-5.6 系列——不是一个模型,而是同一底座的三个档位:旗舰 Sol、均衡 Terra、轻量 Luna。命名方式也变了:数字代表代际,名字代表档位,三个档位各自按自己的节奏迭代。这套“标准版、Pro、Pro Max”式的货架逻辑,手机行业玩了十几年,大模型行业是头一回。

更值得琢磨的是价格。三个档位发布时价差五倍,7 月 30 日 OpenAI 又挥刀降价:Luna 直接砍 80%,Terra 降 20%;8 月 21 日连旗舰 Sol 也降了两成。一代模型上市三周就降价,这在 AI 行业没有先例。

模型开始分档,价格开始跳水——这两个信号拼在一起,透露出 AI 行业一个重要转折:竞争焦点从“谁最强”悄悄换成了“谁的每一块钱更值”。而这道题,跟每个用 AI 的人都有关。

三档模型,三种用法

先看这三档各自是什么。

Sol 是旗舰,OpenAI 官方定位为编程、科研、网络安全等高难任务优化,上下文窗口达 105 万 Token,编程基准 Terminal-Bench 2.1 拿到 88.8%。它还有两个加钱解锁的模式:max 让模型花更多时间深度推理,ultra 则默认调度四个智能体并行协作(最多可扩到十六个)——一个“经理”带一队“分身”同时干活,专啃复杂长任务。

Terra 是均衡款,能力对标上一代旗舰 GPT-5.5,但发布价直接腰斩。官方定位很直白:日常工作模型。

Luna 是轻快款,速度最快、价格最低,适合摘要、起草、批量预处理这类高吞吐场景。

这套分层的本质,是把“模型选购”从玄学变成了算术:任务难度决定档位,档位决定单价,错配就是浪费——用 Luna 干 Sol 的活,效果差;用 Sol 干 Luna 的活,白花钱。

上市三周就降价,发生了什么

价格曲线比发布本身更有信息量。

7 月 9 日发布时的 API 定价是:Sol 输入 5 美元/百万 Token、输出 30 美元;Terra 2.5/15;Luna 1/6。7 月 30 日,Luna 降到 0.2/1.2(降幅 80%),Terra 降到 2/12(降幅 20%),Sol 价格不变但新增了付费提速的 Fast 模式。8 月 21 日,Sol 也宣布降价超 20%,为期三个月。

官方说法是效率提升的红利返还:模型架构、推理系统和智能体框架的优化降低了服务成本,Sol 参与的代码优化让 token 生成效率提高超过 15%。但《金融时报》的分析更直接:客户正在转向中国公司提供的开源模型——Kimi K3 这类可自部署、成本可控的开源模型,给了闭源厂商实打实的降价压力。Axios 则点破另一层:客户越来越在乎 AI 支出的性价比,不再为“最强”无条件买单。

省钱的幅度到底有多大?OpenAI 官方开发者指南里有个教科书级的案例:同一项检索基准任务,GPT-5.5 高强度模式做到 84.36 分,成本 33.27 美元;GPT-5.6 Luna 做到 84.04 分,成本 1.33 美元——成绩几乎持平,花费是原来的二十五分之一。一家叫 Hypha 的公司反馈,Luna 用十八分之一的成本保留了 GPT-5.5 约 98% 的文档提取准确率。

普通人的选购逻辑:给任务分档,而不是给信仰充值

从这场分档加降价里,普通用户能带走三条实用的判断。

第一条:按任务复杂度选档,不按“最新最贵”选档。 日常的摘要、整理、初稿,轻量档完全够用;涉及多步骤推理、出错代价高的任务,才值得上旗舰。AI 使用成本和买菜一样,家常食材不需要米其林采购标准。

第二条:别为“备用能力”付费。 旗舰模型的很多能力——百万级上下文、多智能体并行——大部分人一年用不上几次。为用不到的马力付溢价,是最隐蔽的浪费。

第三条:价格还在剧烈波动,别把成本结构焊死。 三周降 80% 的行情说明,任何“按当前价格精心设计”的成本方案都会快速过时,保持弹性比精打细算更重要。

更省心的答案:把“选档”也外包出去

不过,说实话——分档选购、成本测算、跟进降价,这套功课对普通用户来说本身就是负担。多数人既不想研究百万 Token 的定价表,也不想每周跟踪哪家又降了价。

这正是平台化使用藏得最深的一个好处:模型选型是平台的工作,不是用户的。在 A2A Fans 的 Agent 广场 上,用户面对的是两万余个按能力分类的 Agent——处理文档找“文档全能助手”,做调研找“深度研究专家”,出图找“Image2|香蕉生图专家”。每个 Agent 背后是哪个模型、该用旗舰档还是轻量档、什么时候跟着降价切换配置,全部由平台消化。用户要操心的只有一件事:这个活干得怎么样。

这其实就是三档分层的终极形态:OpenAI 把“高中低配”的选择题出给了开发者,而 Agent 平台把这张卷子替普通人答了。模型越分档、价格越波动,“按任务选 Agent”就比“按参数选模型”越显得省事——你点菜,后厨配什么灶,是餐厅的事。

写在最后

GPT-5.6 的三档发布和三次降价,合起来讲了一个故事:AI 正在从“技术奇观”变成“标准商品”。商品的竞争不是比谁参数吓人,是比谁的价格曲线更陡峭、谁的货架更清晰。

对用户来说,这是纯粹的好消息:智能的单位成本在以月为单位下降。唯一要改的,是“越贵越好”的惯性思维——在 AI 消费这件事上,2026 年最聪明的花钱方式是:为任务付费,不为信仰充值。

常见问题

1、GPT-5.6 的 Sol、Terra、Luna 三档有什么区别?

同一底座、三个能力档位。Sol 是旗舰,针对编程、科研等高难任务;Terra 是均衡款,能力对标上一代旗舰 GPT-5.5 但价格减半,定位日常工作;Luna 最快最便宜,适合摘要、批量处理等高吞吐场景。

2、这次降价幅度到底有多大?

7 月 30 日 Luna 降价 80%(输入 0.2 美元/百万 Token)、Terra 降价 20%;8 月 21 日旗舰 Sol 也降价超 20%。OpenAI 官方归因于效率提升,《金融时报》则指出中国开源模型带来的竞争压力是直接推手。

3、模型分档后,普通用户怎么选?

按任务复杂度选:批量、初稿、日常处理用轻量档;多步骤推理、出错代价高的任务用旗舰。官方数据显示轻量档能以二十五分之一的成本达到接近旗舰的检索任务表现——多数日常需求不需要为旗舰付费。

4、ultra 模式“四个智能体并行”是什么?

Sol 的高阶模式,默认调度四个子智能体并行协作(最多十六个),由一个主智能体分派和整合。适合复杂长任务,Token 消耗更高但出结果更快更强。

5、不会分档、不想研究价格的人怎么办?

用平台。在 A2A Fans 的 Agent 广场,每个 Agent 的底层模型选型和成本优化由平台负责,用户只看能力描述和交付质量。处理文档、做研究、出图、改简历都有对应 Agent,模型怎么分档是平台要操心的卷子。

分享