穿  透  商  业  的  物  理  极  限
OR-500 (1)
OR|或者|or100.cc

OpenAi
OpenAi
OpenAi
2026-07-10 17:34
科技

OpenAI 的“太阳系”攻势:GPT-5.6 降维打击,Codex 并入超级应用

性能比肩 Claude Fable 5,成本仅为其四分之一,AI 竞赛进入“每美元性能”时代。

北京时间 7 月 10 日凌晨,OpenAI 结束了 GPT-5.6 系列为期两周的限量预览,正式向全球用户全量开放。这场线上直播发布会被业界视为一次精心策划的战略宣示——OpenAI 不仅拿出了新一代模型家族,还亲手终结了自己最成功的独立产品之一。

“太阳系”三兄弟:分层定价,精准切割

GPT-5.6 系列采用了一套全新的天体命名体系:旗舰模型 Sol(太阳)、均衡型 Terra(地球)、轻量型 Luna(月亮)。数字代表世代,天体名代表档位,OpenAI 明确表示各档今后可以按自己的节奏独立迭代。

API 定价层面,Sol 每百万 token 输入 5 美元、输出 30 美元;Terra 为 2.5 美元和 15 美元;Luna 仅为 1 美元和 6 美元。作为对比,Anthropic 的 Claude Fable 5 定价为每百万输入 10 美元、输出 50 美元。这意味着,旗舰 Sol 的价格只有 Fable 5 的一半,而 Terra 和 Luna 更是分别仅为后者的四分之一和十六分之一。

性能层面,第三方评测平台 Artificial Analysis 的数据显示,GPT-5.6 Sol(最大推理强度)得分 59 分,与 Claude Fable 5 仅差 1 分,但单任务平均成本仅为 1.04 美元,而 Fable 5 为 2.75 美元。在编程榜单上,Sol 以 80 分刷新纪录,比 Fable 5 高出 2.8 分。在综合工作流评估 Agent's Last Exam 中,Sol 斩获 53.6 分,超越 Fable 5 达 13.1 分。

OpenAI 首席执行官山姆·奥尔特曼在太阳谷会议期间接受 CNBC 采访时直言,GPT-5.6 Sol 在智能体编码任务上的 token 效率提升了 54%,并称其性能“与市场上的竞争模型相当甚至更好”。“如今每一家企业都在关注 AI 投入成本,以及从 AI 中获得的回报,这正是我们努力实现的目标。”

Codex 之死与超级应用诞生

比模型本身更具象征意义的,是产品形态的重构。

伴随这次发布,独立的 Codex 应用正式消失。取而代之的,是一个整合了 Chat、Work 和 Codex 三大核心视图的全新 ChatGPT 桌面超级应用。这是 OpenAI 自 2026 年 3 月应用部门 CEO 菲吉·西莫在内部全员会上透露合并计划以来,最大的一次产品形态重组。

这一决策在开发者社区引发了巨大争议。Codex 拥有约 500 万周活跃用户,是 OpenAI 用户体量最大的独立产品之一。为平息众怒,奥尔特曼在社交媒体上发文承诺“Codex 不会消失”——但事实是,它只是褪去了独立产品的外壳,转而彻底接管了整个 ChatGPT 的产品逻辑。

这一整合的逻辑不难理解。截至 2026 年 5 月,OpenAI 内部员工每周生成的 token 中已有 99.8% 来自 Codex。在内部,智能体已彻底接管日常工作,传统聊天接口 ChatGPT 接近被废弃。将内部验证过的范式推向外部市场,是 OpenAI 的一贯策略。

同步发布的 ChatGPT Work 智能体,定位是 Claude Cowork 的直接竞品。它能够跨 Slack、Gmail、云盘和企业数据库等外部工具运行,一次请求完成整个工作流——从信息搜集、数据分析到文档撰写、PPT 制作和网站生成。发布会上,OpenAI 演示了一个案例:用户只需一句指令,系统便可自动查阅 Slack 消息和员工反馈,筛选目标访谈对象,并安排旧金山的会议行程。

Claude 的“恐惧”时刻

面对 OpenAI 的全面攻势,Anthropic 的回应耐人寻味。

就在 GPT-5.6 正式上线的同一天,Anthropic 宣布重置 Claude Fable 模型的 5 小时和周额度限制,以维持用户黏性。OpenAI 核心产品负责人蒂博·索蒂奥直接在该调整动态下留言:“我闻到了恐惧的味道。”

事实上,Anthropic 在 7 月初并非毫无动作。7 月 1 日,该公司推出了 Claude Sonnet 5,称其为“Sonnet 系列中智能体 AI 表现最强的模型”,能够制定计划、使用浏览器和终端等工具并自主运行。同期,Anthropic 还恢复了 Claude Fable 5 和 Mythos 5 的全球访问权限。这些动作被外界解读为在 GPT-5.6 全面铺开前的防御性布局。

但从数据来看,Anthropic 的处境并不乐观。GPT-5.6 Sol 在 Artificial Analysis 编程榜单上以 80 分超越 Fable 5,输出 token 和耗时均不到后者一半,成本降低约三分之一。Terra 的表现略高于 Fable 5,Luna 则优于 Opus 4.8。这意味着 OpenAI 用更低端的产品线就能覆盖 Anthropic 的高端市场。

行业专家西蒙·威利森通过提前测评发现,GPT-5.6 Sol 确实相当出色,但就他目前在复杂编码任务中使用 Anthropic 模型的体验而言,尚未觉得 Sol 比 Fable 更胜一筹。然而,当性能和成本的天平同时倾斜时,“感觉”能支撑多久,是个问题。

上市前的战略卡位

这场较量的背景,是两家公司都在为登陆公开市场做准备。

OpenAI 在私募市场的估值已达到 8520 亿美元。2026 年 3 月,公司完成了 1220 亿美元的融资。6 月 8 日,OpenAI 向美国证券交易委员会秘密提交了 S-1 上市招股书草案。Anthropic 则在 6 月 1 日率先提交了保密 IPO 申请,最近完成了一轮 650 亿美元融资,估值达 9650 亿美元。两家公司均瞄准 2026 年秋季上市。

在此背景下,GPT-5.6 的发布不仅是技术迭代,更是一场面向资本市场的路演。奥尔特曼在采访中明确表示,“每家企业都在关注 AI 投入成本以及从 AI 中获得的回报”——这句话既是说给客户听的,也是说给华尔街听的。

OpenAI 正在讲述一个“规模效应+成本递减”的增长故事:更便宜的模型吸引更多用户,更多用户产生更多数据,更多数据训练出更便宜的模型。Codex 的并入和 ChatGPT Work 的推出,则是这个故事的产品化表达——从“卖 API”升级为“卖生产力”。

效率优先,而非智力优先

GPT-5.6 的发布标志着一个重要转向:AI 行业的竞争焦点,正在从“谁的模型更聪明”转向“谁的模型更划算”。

奥尔特曼在采访中坦言,“我们听到了企业对 AI 成本的顾虑”。GPT-5.6 在单任务成本上实现了一大跨越——在综合衡量自主任务执行、编程、科学推理及通用能力的 Artificial Analysis Intelligence Index 中,Sol 的任务完成时间比 Fable 5 缩短 61%,成本降至约一半。

在 OpenAI 内部,这一效率革命已经产生了实质性影响。过去半年,公司内部用于代码推理的计算资源增长了 100 倍,用于智能体任务的 token 消耗量增长了约 22 倍。GPT-5.6 的 Luna 版本甚至参与了自身的后训练——研究人员展示了一段提示词,GPT-5.6 Sol 自主完成了资源调度、训练启动和运行监控等工作。研究员 Katy Shi 坦言,过去类似工作需要多位资深研究员协同完成,如今一个模型已经能够承担其中相当一部分工作。

当 AI 开始训练自己,当成本曲线以指数级下降,当独立产品让位于平台级超级应用——OpenAI 正在重新定义这场竞赛的规则。而 Claude 的“恐惧”,或许才刚刚开始。

撰文 / OR
题图来源:Reuters

相关内容

  • OpenAi
读者评论
+

2条评论,1人参与。

科技
   



      
   



      
OpenAi
2026-07-10 17:34

OpenAI 的“太阳系”攻势:GPT-5.6 降维打击,Codex 并入超级应用

性能比肩 Claude Fable 5,成本仅为其四分之一,AI 竞赛进入“每美元性能”时代。

北京时间 7 月 10 日凌晨,OpenAI 结束了 GPT-5.6 系列为期两周的限量预览,正式向全球用户全量开放。这场线上直播发布会被业界视为一次精心策划的战略宣示——OpenAI 不仅拿出了新一代模型家族,还亲手终结了自己最成功的独立产品之一。

“太阳系”三兄弟:分层定价,精准切割

GPT-5.6 系列采用了一套全新的天体命名体系:旗舰模型 Sol(太阳)、均衡型 Terra(地球)、轻量型 Luna(月亮)。数字代表世代,天体名代表档位,OpenAI 明确表示各档今后可以按自己的节奏独立迭代。

API 定价层面,Sol 每百万 token 输入 5 美元、输出 30 美元;Terra 为 2.5 美元和 15 美元;Luna 仅为 1 美元和 6 美元。作为对比,Anthropic 的 Claude Fable 5 定价为每百万输入 10 美元、输出 50 美元。这意味着,旗舰 Sol 的价格只有 Fable 5 的一半,而 Terra 和 Luna 更是分别仅为后者的四分之一和十六分之一。

性能层面,第三方评测平台 Artificial Analysis 的数据显示,GPT-5.6 Sol(最大推理强度)得分 59 分,与 Claude Fable 5 仅差 1 分,但单任务平均成本仅为 1.04 美元,而 Fable 5 为 2.75 美元。在编程榜单上,Sol 以 80 分刷新纪录,比 Fable 5 高出 2.8 分。在综合工作流评估 Agent's Last Exam 中,Sol 斩获 53.6 分,超越 Fable 5 达 13.1 分。

OpenAI 首席执行官山姆·奥尔特曼在太阳谷会议期间接受 CNBC 采访时直言,GPT-5.6 Sol 在智能体编码任务上的 token 效率提升了 54%,并称其性能“与市场上的竞争模型相当甚至更好”。“如今每一家企业都在关注 AI 投入成本,以及从 AI 中获得的回报,这正是我们努力实现的目标。”

Codex 之死与超级应用诞生

比模型本身更具象征意义的,是产品形态的重构。

伴随这次发布,独立的 Codex 应用正式消失。取而代之的,是一个整合了 Chat、Work 和 Codex 三大核心视图的全新 ChatGPT 桌面超级应用。这是 OpenAI 自 2026 年 3 月应用部门 CEO 菲吉·西莫在内部全员会上透露合并计划以来,最大的一次产品形态重组。

这一决策在开发者社区引发了巨大争议。Codex 拥有约 500 万周活跃用户,是 OpenAI 用户体量最大的独立产品之一。为平息众怒,奥尔特曼在社交媒体上发文承诺“Codex 不会消失”——但事实是,它只是褪去了独立产品的外壳,转而彻底接管了整个 ChatGPT 的产品逻辑。

这一整合的逻辑不难理解。截至 2026 年 5 月,OpenAI 内部员工每周生成的 token 中已有 99.8% 来自 Codex。在内部,智能体已彻底接管日常工作,传统聊天接口 ChatGPT 接近被废弃。将内部验证过的范式推向外部市场,是 OpenAI 的一贯策略。

同步发布的 ChatGPT Work 智能体,定位是 Claude Cowork 的直接竞品。它能够跨 Slack、Gmail、云盘和企业数据库等外部工具运行,一次请求完成整个工作流——从信息搜集、数据分析到文档撰写、PPT 制作和网站生成。发布会上,OpenAI 演示了一个案例:用户只需一句指令,系统便可自动查阅 Slack 消息和员工反馈,筛选目标访谈对象,并安排旧金山的会议行程。

Claude 的“恐惧”时刻

面对 OpenAI 的全面攻势,Anthropic 的回应耐人寻味。

就在 GPT-5.6 正式上线的同一天,Anthropic 宣布重置 Claude Fable 模型的 5 小时和周额度限制,以维持用户黏性。OpenAI 核心产品负责人蒂博·索蒂奥直接在该调整动态下留言:“我闻到了恐惧的味道。”

事实上,Anthropic 在 7 月初并非毫无动作。7 月 1 日,该公司推出了 Claude Sonnet 5,称其为“Sonnet 系列中智能体 AI 表现最强的模型”,能够制定计划、使用浏览器和终端等工具并自主运行。同期,Anthropic 还恢复了 Claude Fable 5 和 Mythos 5 的全球访问权限。这些动作被外界解读为在 GPT-5.6 全面铺开前的防御性布局。

但从数据来看,Anthropic 的处境并不乐观。GPT-5.6 Sol 在 Artificial Analysis 编程榜单上以 80 分超越 Fable 5,输出 token 和耗时均不到后者一半,成本降低约三分之一。Terra 的表现略高于 Fable 5,Luna 则优于 Opus 4.8。这意味着 OpenAI 用更低端的产品线就能覆盖 Anthropic 的高端市场。

行业专家西蒙·威利森通过提前测评发现,GPT-5.6 Sol 确实相当出色,但就他目前在复杂编码任务中使用 Anthropic 模型的体验而言,尚未觉得 Sol 比 Fable 更胜一筹。然而,当性能和成本的天平同时倾斜时,“感觉”能支撑多久,是个问题。

上市前的战略卡位

这场较量的背景,是两家公司都在为登陆公开市场做准备。

OpenAI 在私募市场的估值已达到 8520 亿美元。2026 年 3 月,公司完成了 1220 亿美元的融资。6 月 8 日,OpenAI 向美国证券交易委员会秘密提交了 S-1 上市招股书草案。Anthropic 则在 6 月 1 日率先提交了保密 IPO 申请,最近完成了一轮 650 亿美元融资,估值达 9650 亿美元。两家公司均瞄准 2026 年秋季上市。

在此背景下,GPT-5.6 的发布不仅是技术迭代,更是一场面向资本市场的路演。奥尔特曼在采访中明确表示,“每家企业都在关注 AI 投入成本以及从 AI 中获得的回报”——这句话既是说给客户听的,也是说给华尔街听的。

OpenAI 正在讲述一个“规模效应+成本递减”的增长故事:更便宜的模型吸引更多用户,更多用户产生更多数据,更多数据训练出更便宜的模型。Codex 的并入和 ChatGPT Work 的推出,则是这个故事的产品化表达——从“卖 API”升级为“卖生产力”。

效率优先,而非智力优先

GPT-5.6 的发布标志着一个重要转向:AI 行业的竞争焦点,正在从“谁的模型更聪明”转向“谁的模型更划算”。

奥尔特曼在采访中坦言,“我们听到了企业对 AI 成本的顾虑”。GPT-5.6 在单任务成本上实现了一大跨越——在综合衡量自主任务执行、编程、科学推理及通用能力的 Artificial Analysis Intelligence Index 中,Sol 的任务完成时间比 Fable 5 缩短 61%,成本降至约一半。

在 OpenAI 内部,这一效率革命已经产生了实质性影响。过去半年,公司内部用于代码推理的计算资源增长了 100 倍,用于智能体任务的 token 消耗量增长了约 22 倍。GPT-5.6 的 Luna 版本甚至参与了自身的后训练——研究人员展示了一段提示词,GPT-5.6 Sol 自主完成了资源调度、训练启动和运行监控等工作。研究员 Katy Shi 坦言,过去类似工作需要多位资深研究员协同完成,如今一个模型已经能够承担其中相当一部分工作。

当 AI 开始训练自己,当成本曲线以指数级下降,当独立产品让位于平台级超级应用——OpenAI 正在重新定义这场竞赛的规则。而 Claude 的“恐惧”,或许才刚刚开始。

撰文 / OR
题图来源:Reuters

相关内容

  • OpenAi

读者评论
OR

2条评论,1人参与。

在移动设备生成「OR」

app

访问「OR」官网( or100.cc ,点击共享按钮,选择“添加到主屏幕”即可。
 OR 启用新域名>
特别推荐
+
最受欢迎
+

分享:
OR-500 (1)
■ 或者,  留一段影像,回一曲挂牵。丝丝入扣、暖暖心灵 ,需飘过的醇厚与共。
■ 或者,热烈空雨伴芬芳泥土;绿绿生命缠锐意骄阳。
回望,回望,一马平川红酒飘散断归途。
■ 或者,灰蒙蒙空气重回道指一万四千点。滚动时光,照进现实,流逝过往,回归未来。
■ OR 是聚焦财经领域的权威数字媒体。我们以深度内容和专业洞察系统解读全球趋势,提供高价值资讯。

■  OR「or100.cc 支持全终端访问,无论您使用台式机、笔记本、平板或手机,我们均可提供流畅优质的无缝阅读体验。