「我闻到了恐惧的味道」——GPT-5.6 全面开放,但真正让 Anthropic 紧张的,可能不是跑分

OpenAI 发布 GPT-5.6 系列(Sol/Terra/Luna)并合并 Codex 至 ChatGPT,定价与效率大幅优于竞品 Claude Fable 5。核心变化在于以更低成本、更高 token 效率覆盖编程与知识工作场景,目标直指企业级客户,标志 AI 竞争从“谁更强”转向“谁更省”。
北京时间 7 月 10 日凌晨,OpenAI 按下了那颗所有人都在等的按钮:GPT-5.6 系列面向全球全量开放。旗舰 Sol、均衡 Terra、经济 Luna 三档模型同步上线。
与此同时,独立编码工具 Codex 正式并入 ChatGPT 桌面应用,Chat、Work、Codex 三个入口装进了同一个 App。
这不是一次普通的模型发布。
定价上,Sol 每百万 token 输入 5 美元、输出 30 美元;Terra 直接砍半,2.5⁄15 美元;Luna 压到 1⁄6 美元。横向对比,Claude Fable 5 的定价是输入 10 美元、输出 50 美元——Sol 的输入价格只有后者一半,输出价格低 40%。
效率数据更激进。据 OpenAI 技术报告,Sol 在编程任务中输出 token 效率提升 54%,编程智能体指数冲到 80 分,超越 Fable 5,而完成同等任务的成本约为后者的三分之一到四分之一。
Anthropic 的反应比任何评测数据都更能说明问题:连夜重置 Fable 5 用户的使用额度,并延长免费期限至 7 月 12 日。其产品负责人甚至在社交平台留言:「我闻到了恐惧的味道。」
但真正值得讨论的,不是一场跑分战的胜负,而是藏在这次发布背后的三件事。
一、为什么合并 Codex,比 GPT-5.6 本身更重要?
很多人把注意力放在 Sol 的跑分上,但这次发布真正的结构性变化,是 Codex 被并进了 ChatGPT。
不是加个入口跳转那种「整合」。是 Codex 彻底变成了 ChatGPT 桌面应用里的一个标签页,和 Chat、Work 并列。老用户的代码项目、对话记录、自定义配置全部无缝迁移。旧版客户端更名为 ChatGPT Classic 保留使用。[1]
OpenAI 为什么要这么做?
据《财经》报道,此前 ChatGPT 周活跃用户已超 10 亿,但独立 Codex 应用仅超 500 万。产品力分散,两个入口互相稀释。[2] 而 Anthropic 凭借 Claude Code 在编程赛道的口碑,已经在 2026 年初于收入和估值上反超 OpenAI——据 SEMIANALYSIS 数据,Anthropic 的 ARR 绝大部分来自 API 业务,编程场景是核心营收引擎。
合并 Codex 不是产品层面的小调整,是一次战略收拢:把最强的编程能力装进最大的用户入口,用一个 App 同时覆盖聊天、办公智能体和代码开发三个场景。
更重要的是,Codex 每周 500 万用户中,超过 100 万人用它做的根本不是软件开发。[4] 写代码需要的那套能力——理解目标、拆解任务、调用工具、检查结果、自己纠错——恰好就是干任何知识工作需要的能力。Codex 没有被砍掉,是被泛化了。
Anthropic 半年前就走过了这条路:今年 1 月,Claude 桌面端里出现了第三个标签页 Cowork,用 Claude Code 的架构做编码之外的知识工作。Anthropic 自己的数据也验证了这个方向——120 万次 Cowork 会话里,写代码只占 8.7%,占比最高的是对账、做报表这类业务流程。[4]
区别在于:Cowork 至今是付费功能,OpenAI 直接把 Work 放进了免费版。
二、GPT-5.6 的主叙事不是「更强」,是「更省」
OpenAI 这次在官方文档里开篇就把话挑明了:GPT-5.6 的目标是「每个 token 带来更多智能、更强的每美元性能」。
翻译成大白话:不是来跟你比谁更聪明,是来比谁更省钱。
Sol 与上一代 GPT-5.5 同价,但能力提升明显。第三方机构 Artificial Analysis 的评测显示,GPT-5.6 完成任务时消耗的 token 明显更少,推理 token 少得尤其夸张——「单位 token 产出的效率高得离谱」。
速度也是一个被低估的亮点:Sol 最高可达每秒 750 个 token,约合每秒 500 到 700 个汉字。这意味着思考和生成部分被大幅压缩,普通聊天场景下会带来明显的秒回感。[2]
三档模型的定位也很清晰:复杂任务交给 Sol,日常任务交给 Terra,高频轻量任务交给 Luna。不是所有事情都要请最贵的专家来做——一个足够稳定、足够便宜的模型,才是 Agent 工作流真正跑起来的关键。
同一天发布的 xAI Grok 4.5(输入 2 美元、输出 6 美元)和 Meta 刚推出的 Muse Spark 1.1(输入 1.25 美元、输出 4.25 美元),走的是同一条路。[2] 拼智商的边际收益在收窄,前沿模型的竞争正在从「谁更强」变成「谁足够强、足够便宜、能被大规模调用」。
三、企业级客户,才是这场战争的真正战场
GPT-5.6 的开放日期不是 OpenAI 自己定的。
6 月 2 日,特朗普签署行政令,要求 AI 公司在全面发布前向政府提供前沿模型做能力评估。6 月 26 日 GPT-5.6「发布」,但只向约 20 家报备机构开放。商务部下属的 AI 标准与创新中心评估了两周,7 月 8 日放行,才有了 7 月 10 日的全面开放。
引来审查的是 Sol 在网络安全和生物领域的能力。OpenAI 的系统卡片写得坦率:它能找到漏洞和攻击的「零件」,但在测试条件下没能自主拼出一条完整的攻击链。
管控也下沉到了产品层。部分 API 调用可能被拦截,甚至在生成到一半时被暂停。但 OpenAI 留了逃生门:在 ChatGPT 和 Codex 里,被拦下的请求可以一键换低能力模型重试。
Anthropic 这边也不轻松。几周前,Fable 5 和 Mythos 5 因一纸出口管制指令下架,Fable 5 已恢复,Mythos 5 至今只对一小批美国机构开放。
两家最头部的 AI 公司在同一个月内先后经历「模型做好了、但不能随便卖」——这不是巧合,更可能是新常态的开端。
而在中国市场,工信部 NVDB 已对 Claude Code 发布安全后门风险提示,阿里从 7 月 10 日起全面禁用 Claude。这意味着中国市场的 AI 编程工具格局,正在被重新定义。
三件事叠加在一起——GPT-5.6 全量开放、Anthropic 连夜应对、中国市场安全审查升级——结论不是「OpenAI 赢了」,而是企业级 AI 的竞争正在变成一场多维博弈:价格、合规、生态、地缘风险,每一项都比跑分更重要。
写在最后
GPT-5.6 这一波更新,表面看是模型迭代,底层是一场战略重组。
Codex 并入 ChatGPT,是入口收拢。三档定价压到竞品一半以下,是价格战。ChatGPT Work 免费开放,是用户基数扩张。每一步都指向同一个目标:把足够强、足够便宜、足够好用的 AI 装进尽可能多的人的桌面。
Anthropic 产品负责人那句「我闻到了恐惧的味道」——与其说是对 GPT-5.6 跑分的忌惮,不如说是对 OpenAI 这套「入口+定价+智能体」组合拳的警觉。
对普通用户来说,最实际的变化是门槛消失了。一个此前只属于开发者和重度付费用户的东西,一夜之间放到了所有人面前。打开那个 App,里面坐着的,不再只是一个会聊天的框。
真正的好戏才刚开始。
下一期作者会出一个专业的测评,一起看看真实的GPT-5.6 表现。
参考来源:
[1] 快科技/PChome,《GPT-5.6系列发布:Codex、ChatGPT Work智能体三合一》,2026年7月10日
[2] 钛媒体/字母AI,《GPT-5.6全量放送,Codex正式并入ChatGPT》,2026年7月10日
[3] github AI 讯息追踪项目 big_model_radar,2026年7月
[4] 极客公园,《GPT-5.6 发布之夜,Codex/ChatGPT 合二为一》,2026年7月10日
声明:本文基于公开信息整理分析,部分观点为作者个人判断,欢迎理性讨论。