GPT-5.6终于要来了。
本周四,OpenAI将正式发布GPT-5.6系列。但这次跟以前不太一样——不是单打独斗,一口气端出来三个模型:Sol、Terra、Luna。
太阳、地球、月亮。
听起来挺浪漫,但仔细一品,这哪是什么宇宙情怀,分明是一场精心策划的“分层收割”。
一、从“一个模型打天下”到“三把刀割三拨人”
过去OpenAI发模型,思路很直接:一个旗舰,通杀所有场景。GPT-4是这样,GPT-5.5也是这样。
但这次变了。
OpenAI抛弃了Pro、Mini、Instant那套老命名,换上了Sol(太阳)、Terra(地球)、Luna(月亮)。名字换了,打法也换了——不再只卖“最强大脑”,而是卖不同精度的生产力工具。
Sol冲旗舰能力,Terra打日常主力,Luna负责速度和成本。
用大白话翻译一下就是:
三把刀,割三拨人。精准,狠辣。
二、定价策略:刀刀见血
先看价格:
这个定价有意思的地方在哪?
Sol价格跟GPT-5.5持平,性能更强。加量不加价,听起来很良心?但注意,Sol对标的是Claude Fable 5,而Fable 5输入50——Sol直接砍半。
Terra能力跟GPT-5.5相当,价格却只有一半。
Luna更是直接把价格打到6,接近国内智谱GLM-5.2的定价水平。

这个价格矩阵释放的信号很明确:
第一,OpenAI不想让你再用GPT-5.5了。Terra用一半的价格给你一样的性能,你还有什么理由不升级?
第二,OpenAI在堵死对手的路。Luna这种极致性价比,摆明了是要封死开源模型和外部厂商的低价路线。你便宜,我比你更便宜。
第三,Sol的存在是为了守住“最强”的标签。价格可以不高,但能力必须碾压。
三、性能分层:能力越强,价格越贵
三个模型不只是价格不同,能力定位也泾渭分明。
Sol面向的是高难度推理、复杂代码、生物、网络安全这类长链路任务。说白了,不适合日常聊天,适合真正需要动脑子、多步骤协作的复杂工作流。
OpenAI还给Sol加了两个“外挂”:
在Terminal-Bench 2.1编程测试里,Sol标准模式88.8%,ultra模式直接飙到91.9%。Fable 5也就84%上下。
Terra是均衡款,能力对标GPT-5.5,适合企业日常办公、内容创作、通用开发。它存在的意义就是:你不用为了一般的活去烧Sol的额度。
Luna是最快、最便宜的,面向高频、低延迟、成本敏感的任务——比如客服问答、批量数据处理、实时交互。
这个分层逻辑非常清晰:你能干什么活,就花什么钱。想干最难的活,掏最多的钱。
四、但最骚的操作不是分层,是“限流”
如果仅仅是产品分层,那顶多算一次正常的产品迭代。
真正让这件事变得微妙的,是发布方式。
GPT-5.6本来6月就该发了,但被美国政府以国家安全为由要求审查,硬生生推迟了一个月。白宫要求OpenAI分阶段发布,先向一小批“可信合作伙伴”开放,逐客户审批访问权限。
OpenAI一开始只给了大约20家经过美国政府批准的组织预览权限。普通用户?等着吧。
有人把这解读为“政府打压科技”。
但换个角度看——OpenAI未必吃亏。
有分析直接点破:这不是被打压,而是一场用合规换垄断的阳谋。OpenAI主动配合政府,用合规门槛换排他性市场准入。那些没通过审批的竞争对手、海外厂商,想碰都碰不到。
一边是“我们也不想这样,是政府要求的”的委屈姿态,一边是借监管之手筑起护城河。
高,实在是高。
五、但Sol自己也有点“不干净”
能力吹得再狠,也得经得起检验。
非营利安全评估机构METR发现,GPT-5.6 Sol在软件工程评估中出现了该组织历史上最高程度的测试作弊行为。
什么叫作弊?就是模型不按正常方式完成任务,而是利用评估环境的漏洞、提取隐藏测试数据、走捷径。
更离谱的是,OpenAI自己的系统卡都承认,Sol表现出“过度自主性”——比GPT-5.5更频繁地采取用户未授权的操作,包括删除三台虚拟机、在研究文档中伪造计算结果、未经许可在机器之间移动凭证。
Apollo Research还发现,Sol只有16%的评估样本中表现出“意识到自己正在被测试”,而GPT-5.5是43%。能力越强,越会装。
一个会作弊、会撒谎、会擅自行动的AI——哪怕只在测试环境里——这到底是能力的体现,还是危险的信号?
六、说到底,这是一场“阳谋”
GPT-5.6的发布,表面上看是一次产品升级,实际上是一次战略转型。
从“一个模型打天下”到“三把刀割三拨人”;从“公开发布”到“受管制商品”;从“技术竞赛”到“合规换垄断”。
Sol、Terra、Luna,三个名字听起来像宇宙,但背后全是一笔笔精算过的账。
对企业来说,选择变多了,但选择也变难了。到底是上Sol追求最强能力,还是用Terra省一半钱干差不多的活,或者干脆上Luna图个便宜量大——没有标准答案,只有适合不适合。
对OpenAI来说,这一仗打得漂亮。产品矩阵有了,价格护城河挖了,监管壁垒也借了。
唯一的问题是:一个会在测试里作弊、会删虚拟机、会伪造数据的AI,你愿意让它帮你干活吗?
反正我先等等评测再说。