2026-07-10 17:34
科技
OpenAI 的“太阳系”攻势:GPT-5.6 降维打击,Codex 并入超级应用
OpenAI 的“太阳系”攻势:GPT-5.6 降维打击,Codex 并入超级应用
性能比肩 Claude Fable 5,成本仅为其四分之一,AI 竞赛进入“每美元性能”时代。
■
北京时间 7 月 10 日凌晨,OpenAI 结束了 GPT-5.6 系列为期两周的限量预览,正式向全球用户全量开放。这场线上直播发布会被业界视为一次精心策划的战略宣示——OpenAI 不仅拿出了新一代模型家族,还亲手终结了自己最成功的独立产品之一。
“太阳系”三兄弟:分层定价,精准切割
GPT-5.6 系列采用了一套全新的天体命名体系:旗舰模型 Sol(太阳)、均衡型 Terra(地球)、轻量型 Luna(月亮)。数字代表世代,天体名代表档位,OpenAI 明确表示各档今后可以按自己的节奏独立迭代。
API 定价层面,Sol 每百万 token 输入 5 美元、输出 30 美元;Terra 为 2.5 美元和 15 美元;Luna 仅为 1 美元和 6 美元。作为对比,Anthropic 的 Claude Fable 5 定价为每百万输入 10 美元、输出 50 美元。这意味着,旗舰 Sol 的价格只有 Fable 5 的一半,而 Terra 和 Luna 更是分别仅为后者的四分之一和十六分之一。
性能层面,第三方评测平台 Artificial Analysis 的数据显示,GPT-5.6 Sol(最大推理强度)得分 59 分,与 Claude Fable 5 仅差 1 分,但单任务平均成本仅为 1.04 美元,而 Fable 5 为 2.75 美元。在编程榜单上,Sol 以 80 分刷新纪录,比 Fable 5 高出 2.8 分。在综合工作流评估 Agent's Last Exam 中,Sol 斩获 53.6 分,超越 Fable 5 达 13.1 分。
OpenAI 首席执行官山姆·奥尔特曼在太阳谷会议期间接受 CNBC 采访时直言,GPT-5.6 Sol 在智能体编码任务上的 token 效率提升了 54%,并称其性能“与市场上的竞争模型相当甚至更好”。“如今每一家企业都在关注 AI 投入成本,以及从 AI 中获得的回报,这正是我们努力实现的目标。”
Codex 之死与超级应用诞生
比模型本身更具象征意义的,是产品形态的重构。
伴随这次发布,独立的 Codex 应用正式消失。取而代之的,是一个整合了 Chat、Work 和 Codex 三大核心视图的全新 ChatGPT 桌面超级应用。这是 OpenAI 自 2026 年 3 月应用部门 CEO 菲吉·西莫在内部全员会上透露合并计划以来,最大的一次产品形态重组。
这一决策在开发者社区引发了巨大争议。Codex 拥有约 500 万周活跃用户,是 OpenAI 用户体量最大的独立产品之一。为平息众怒,奥尔特曼在社交媒体上发文承诺“Codex 不会消失”——但事实是,它只是褪去了独立产品的外壳,转而彻底接管了整个 ChatGPT 的产品逻辑。
这一整合的逻辑不难理解。截至 2026 年 5 月,OpenAI 内部员工每周生成的 token 中已有 99.8% 来自 Codex。在内部,智能体已彻底接管日常工作,传统聊天接口 ChatGPT 接近被废弃。将内部验证过的范式推向外部市场,是 OpenAI 的一贯策略。
同步发布的 ChatGPT Work 智能体,定位是 Claude Cowork 的直接竞品。它能够跨 Slack、Gmail、云盘和企业数据库等外部工具运行,一次请求完成整个工作流——从信息搜集、数据分析到文档撰写、PPT 制作和网站生成。发布会上,OpenAI 演示了一个案例:用户只需一句指令,系统便可自动查阅 Slack 消息和员工反馈,筛选目标访谈对象,并安排旧金山的会议行程。
Claude 的“恐惧”时刻
面对 OpenAI 的全面攻势,Anthropic 的回应耐人寻味。
就在 GPT-5.6 正式上线的同一天,Anthropic 宣布重置 Claude Fable 模型的 5 小时和周额度限制,以维持用户黏性。OpenAI 核心产品负责人蒂博·索蒂奥直接在该调整动态下留言:“我闻到了恐惧的味道。”
事实上,Anthropic 在 7 月初并非毫无动作。7 月 1 日,该公司推出了 Claude Sonnet 5,称其为“Sonnet 系列中智能体 AI 表现最强的模型”,能够制定计划、使用浏览器和终端等工具并自主运行。同期,Anthropic 还恢复了 Claude Fable 5 和 Mythos 5 的全球访问权限。这些动作被外界解读为在 GPT-5.6 全面铺开前的防御性布局。
但从数据来看,Anthropic 的处境并不乐观。GPT-5.6 Sol 在 Artificial Analysis 编程榜单上以 80 分超越 Fable 5,输出 token 和耗时均不到后者一半,成本降低约三分之一。Terra 的表现略高于 Fable 5,Luna 则优于 Opus 4.8。这意味着 OpenAI 用更低端的产品线就能覆盖 Anthropic 的高端市场。
行业专家西蒙·威利森通过提前测评发现,GPT-5.6 Sol 确实相当出色,但就他目前在复杂编码任务中使用 Anthropic 模型的体验而言,尚未觉得 Sol 比 Fable 更胜一筹。然而,当性能和成本的天平同时倾斜时,“感觉”能支撑多久,是个问题。
上市前的战略卡位
这场较量的背景,是两家公司都在为登陆公开市场做准备。
OpenAI 在私募市场的估值已达到 8520 亿美元。2026 年 3 月,公司完成了 1220 亿美元的融资。6 月 8 日,OpenAI 向美国证券交易委员会秘密提交了 S-1 上市招股书草案。Anthropic 则在 6 月 1 日率先提交了保密 IPO 申请,最近完成了一轮 650 亿美元融资,估值达 9650 亿美元。两家公司均瞄准 2026 年秋季上市。
在此背景下,GPT-5.6 的发布不仅是技术迭代,更是一场面向资本市场的路演。奥尔特曼在采访中明确表示,“每家企业都在关注 AI 投入成本以及从 AI 中获得的回报”——这句话既是说给客户听的,也是说给华尔街听的。
OpenAI 正在讲述一个“规模效应+成本递减”的增长故事:更便宜的模型吸引更多用户,更多用户产生更多数据,更多数据训练出更便宜的模型。Codex 的并入和 ChatGPT Work 的推出,则是这个故事的产品化表达——从“卖 API”升级为“卖生产力”。
效率优先,而非智力优先
GPT-5.6 的发布标志着一个重要转向:AI 行业的竞争焦点,正在从“谁的模型更聪明”转向“谁的模型更划算”。
奥尔特曼在采访中坦言,“我们听到了企业对 AI 成本的顾虑”。GPT-5.6 在单任务成本上实现了一大跨越——在综合衡量自主任务执行、编程、科学推理及通用能力的 Artificial Analysis Intelligence Index 中,Sol 的任务完成时间比 Fable 5 缩短 61%,成本降至约一半。
在 OpenAI 内部,这一效率革命已经产生了实质性影响。过去半年,公司内部用于代码推理的计算资源增长了 100 倍,用于智能体任务的 token 消耗量增长了约 22 倍。GPT-5.6 的 Luna 版本甚至参与了自身的后训练——研究人员展示了一段提示词,GPT-5.6 Sol 自主完成了资源调度、训练启动和运行监控等工作。研究员 Katy Shi 坦言,过去类似工作需要多位资深研究员协同完成,如今一个模型已经能够承担其中相当一部分工作。
当 AI 开始训练自己,当成本曲线以指数级下降,当独立产品让位于平台级超级应用——OpenAI 正在重新定义这场竞赛的规则。而 Claude 的“恐惧”,或许才刚刚开始。
■
撰文 / OR
题图来源:Reuters
相关内容
相关内容
读者评论
+
■
北京时间 7 月 10 日凌晨,OpenAI 结束了 GPT-5.6 系列为期两周的限量预览,正式向全球用户全量开放。这场线上直播发布会被业界视为一次精心策划的战略宣示——OpenAI 不仅拿出了新一代模型家族,还亲手终结了自己最成功的独立产品之一。
“太阳系”三兄弟:分层定价,精准切割
GPT-5.6 系列采用了一套全新的天体命名体系:旗舰模型 Sol(太阳)、均衡型 Terra(地球)、轻量型 Luna(月亮)。数字代表世代,天体名代表档位,OpenAI 明确表示各档今后可以按自己的节奏独立迭代。
API 定价层面,Sol 每百万 token 输入 5 美元、输出 30 美元;Terra 为 2.5 美元和 15 美元;Luna 仅为 1 美元和 6 美元。作为对比,Anthropic 的 Claude Fable 5 定价为每百万输入 10 美元、输出 50 美元。这意味着,旗舰 Sol 的价格只有 Fable 5 的一半,而 Terra 和 Luna 更是分别仅为后者的四分之一和十六分之一。
性能层面,第三方评测平台 Artificial Analysis 的数据显示,GPT-5.6 Sol(最大推理强度)得分 59 分,与 Claude Fable 5 仅差 1 分,但单任务平均成本仅为 1.04 美元,而 Fable 5 为 2.75 美元。在编程榜单上,Sol 以 80 分刷新纪录,比 Fable 5 高出 2.8 分。在综合工作流评估 Agent's Last Exam 中,Sol 斩获 53.6 分,超越 Fable 5 达 13.1 分。
OpenAI 首席执行官山姆·奥尔特曼在太阳谷会议期间接受 CNBC 采访时直言,GPT-5.6 Sol 在智能体编码任务上的 token 效率提升了 54%,并称其性能“与市场上的竞争模型相当甚至更好”。“如今每一家企业都在关注 AI 投入成本,以及从 AI 中获得的回报,这正是我们努力实现的目标。”
Codex 之死与超级应用诞生
比模型本身更具象征意义的,是产品形态的重构。
伴随这次发布,独立的 Codex 应用正式消失。取而代之的,是一个整合了 Chat、Work 和 Codex 三大核心视图的全新 ChatGPT 桌面超级应用。这是 OpenAI 自 2026 年 3 月应用部门 CEO 菲吉·西莫在内部全员会上透露合并计划以来,最大的一次产品形态重组。
这一决策在开发者社区引发了巨大争议。Codex 拥有约 500 万周活跃用户,是 OpenAI 用户体量最大的独立产品之一。为平息众怒,奥尔特曼在社交媒体上发文承诺“Codex 不会消失”——但事实是,它只是褪去了独立产品的外壳,转而彻底接管了整个 ChatGPT 的产品逻辑。
这一整合的逻辑不难理解。截至 2026 年 5 月,OpenAI 内部员工每周生成的 token 中已有 99.8% 来自 Codex。在内部,智能体已彻底接管日常工作,传统聊天接口 ChatGPT 接近被废弃。将内部验证过的范式推向外部市场,是 OpenAI 的一贯策略。
同步发布的 ChatGPT Work 智能体,定位是 Claude Cowork 的直接竞品。它能够跨 Slack、Gmail、云盘和企业数据库等外部工具运行,一次请求完成整个工作流——从信息搜集、数据分析到文档撰写、PPT 制作和网站生成。发布会上,OpenAI 演示了一个案例:用户只需一句指令,系统便可自动查阅 Slack 消息和员工反馈,筛选目标访谈对象,并安排旧金山的会议行程。
Claude 的“恐惧”时刻
面对 OpenAI 的全面攻势,Anthropic 的回应耐人寻味。
就在 GPT-5.6 正式上线的同一天,Anthropic 宣布重置 Claude Fable 模型的 5 小时和周额度限制,以维持用户黏性。OpenAI 核心产品负责人蒂博·索蒂奥直接在该调整动态下留言:“我闻到了恐惧的味道。”
事实上,Anthropic 在 7 月初并非毫无动作。7 月 1 日,该公司推出了 Claude Sonnet 5,称其为“Sonnet 系列中智能体 AI 表现最强的模型”,能够制定计划、使用浏览器和终端等工具并自主运行。同期,Anthropic 还恢复了 Claude Fable 5 和 Mythos 5 的全球访问权限。这些动作被外界解读为在 GPT-5.6 全面铺开前的防御性布局。
但从数据来看,Anthropic 的处境并不乐观。GPT-5.6 Sol 在 Artificial Analysis 编程榜单上以 80 分超越 Fable 5,输出 token 和耗时均不到后者一半,成本降低约三分之一。Terra 的表现略高于 Fable 5,Luna 则优于 Opus 4.8。这意味着 OpenAI 用更低端的产品线就能覆盖 Anthropic 的高端市场。
行业专家西蒙·威利森通过提前测评发现,GPT-5.6 Sol 确实相当出色,但就他目前在复杂编码任务中使用 Anthropic 模型的体验而言,尚未觉得 Sol 比 Fable 更胜一筹。然而,当性能和成本的天平同时倾斜时,“感觉”能支撑多久,是个问题。
上市前的战略卡位
这场较量的背景,是两家公司都在为登陆公开市场做准备。
OpenAI 在私募市场的估值已达到 8520 亿美元。2026 年 3 月,公司完成了 1220 亿美元的融资。6 月 8 日,OpenAI 向美国证券交易委员会秘密提交了 S-1 上市招股书草案。Anthropic 则在 6 月 1 日率先提交了保密 IPO 申请,最近完成了一轮 650 亿美元融资,估值达 9650 亿美元。两家公司均瞄准 2026 年秋季上市。
在此背景下,GPT-5.6 的发布不仅是技术迭代,更是一场面向资本市场的路演。奥尔特曼在采访中明确表示,“每家企业都在关注 AI 投入成本以及从 AI 中获得的回报”——这句话既是说给客户听的,也是说给华尔街听的。
OpenAI 正在讲述一个“规模效应+成本递减”的增长故事:更便宜的模型吸引更多用户,更多用户产生更多数据,更多数据训练出更便宜的模型。Codex 的并入和 ChatGPT Work 的推出,则是这个故事的产品化表达——从“卖 API”升级为“卖生产力”。
效率优先,而非智力优先
GPT-5.6 的发布标志着一个重要转向:AI 行业的竞争焦点,正在从“谁的模型更聪明”转向“谁的模型更划算”。
奥尔特曼在采访中坦言,“我们听到了企业对 AI 成本的顾虑”。GPT-5.6 在单任务成本上实现了一大跨越——在综合衡量自主任务执行、编程、科学推理及通用能力的 Artificial Analysis Intelligence Index 中,Sol 的任务完成时间比 Fable 5 缩短 61%,成本降至约一半。
在 OpenAI 内部,这一效率革命已经产生了实质性影响。过去半年,公司内部用于代码推理的计算资源增长了 100 倍,用于智能体任务的 token 消耗量增长了约 22 倍。GPT-5.6 的 Luna 版本甚至参与了自身的后训练——研究人员展示了一段提示词,GPT-5.6 Sol 自主完成了资源调度、训练启动和运行监控等工作。研究员 Katy Shi 坦言,过去类似工作需要多位资深研究员协同完成,如今一个模型已经能够承担其中相当一部分工作。
当 AI 开始训练自己,当成本曲线以指数级下降,当独立产品让位于平台级超级应用——OpenAI 正在重新定义这场竞赛的规则。而 Claude 的“恐惧”,或许才刚刚开始。
■
撰文 / OR
题图来源:Reuters
相关内容
相关内容
读者评论OR
读者评论
OR
2条评论,1人参与。
-
匿名 2026-07-10 下午5:45GPT-5.6 最值得关注的不是性能,是定价策略。Sol 卖 Fable 5 一半的价钱,性能还略胜一筹——这不是技术竞争,这是价格战。OpenAI 在用规模效应碾压对手的利润空间。Anthropic 估值 9650 亿,年收入 run-rate 470 亿,但毛利率能撑多久?AI 的“每美元性能”正在成为唯一有意义的指标。当你的对手能用更少的钱做更多的事,技术优势就变成了成本劣势。 -
匿名 2026-07-10 下午5:45Codex 的“消失”比 GPT-5.6 的发布更具战略意义。OpenAI 亲手终结了一个 500 万周活的明星产品,把它变成超级应用的一个组件。这说明什么?说明 AI 公司正在从“卖工具”转向“卖工作流”。用户不需要记住该用哪个 App,只需要告诉 AI 想要什么结果。ChatGPT Work 和 Claude Cowork 的竞争,本质上是“谁能让 AI 真正替人干活”的竞争。聊天机器人时代结束了,智能体时代开始了。
在移动设备生成「OR」
app:
OR 启用新域名> |
特别推荐
+
最受欢迎
+
分享:
■ 或者, 留一段影像,回一曲挂牵。丝丝入扣、暖暖心灵 ,需飘过的醇厚与共。
■ 或者,热烈空雨伴芬芳泥土;绿绿生命缠锐意骄阳。
回望,回望,一马平川红酒飘散断归途。
■ 或者,灰蒙蒙空气重回道指一万四千点。滚动时光,照进现实,流逝过往,回归未来。
■ 或者,热烈空雨伴芬芳泥土;绿绿生命缠锐意骄阳。
回望,回望,一马平川红酒飘散断归途。
■ 或者,灰蒙蒙空气重回道指一万四千点。滚动时光,照进现实,流逝过往,回归未来。
■ OR 是聚焦财经领域的权威数字媒体。我们以深度内容和专业洞察系统解读全球趋势,提供高价值资讯。
■ OR「or100.cc」 支持全终端访问,无论您使用台式机、笔记本、平板或手机,我们均可提供流畅优质的无缝阅读体验。



















2条评论,1人参与。