GPT-5.6正式发布:OpenAI不再只卖大模型,而是在打造AI操作系统

현재 언어 번역이 없어 원문을 표시합니다.
7月10日,OpenAI正式发布GPT-5.6系列模型,并结束此前的有限预览,全面向公众开放,这次发布并非简单推出一个新模型,而是一口气带来了旗舰版Sol、均衡版Terra以及轻量版Luna三款模型,同时覆盖ChatGPT、Codex和API三大平台。此外,OpenAI还同步推出ChatGPT Work智能体、开放多Agent能力测试版,并将Codex、浏览器等产品进一步整合至ChatGPT生态。

作者:Climber,CryptoPulse Labs

7月10日,OpenAI正式发布GPT-5.6系列模型,并结束此前的有限预览,全面向公众开放。

这次发布并非简单推出一个新模型,而是一口气带来了旗舰版Sol、均衡版Terra以及轻量版Luna三款模型,同时覆盖ChatGPT、Codex和API三大平台。此外,OpenAI还同步推出ChatGPT Work智能体、开放多Agent能力测试版,并将Codex、浏览器等产品进一步整合至ChatGPT生态。

如果说GPT-4时代,OpenAI竞争的是"全球最强大模型",那么GPT-5.6时代,它争夺的已经是整个AI时代的入口。从模型到Agent、从开发工具到浏览器再到企业办公,OpenAI正在试图构建属于自己的AI操作系统。

一、从"一个模型"到"一个模型家族",OpenAI开始复制云计算的商业模式

过去三年,大模型行业的竞争逻辑十分简单。谁拥有最强模型,谁就拥有最大的市场关注度。

GPT-3、GPT-4、Claude、Gemini,每一次更新几乎都是围绕着一个旗舰模型展开,行业讨论也集中在参数规模、推理能力、上下文长度以及各项Benchmark成绩。

然而,GPT-5.6系列改变了这一逻辑。OpenAI没有再推出一个"万能模型",而是一次性发布了三种规格。

Sol:旗舰性能版本,面向科研、高端Agent、复杂代码和高精度推理任务。Terra:性能与成本平衡,更适合企业级应用。Luna:轻量低成本版本,瞄准海量调用和消费级市场。

与此同时,三款模型采用完全不同的价格体系。GPT-5.6 模型按每百万 Token 计费,包含 3 种模型规格:Sol 模型输入为 5 美元,输出为 30 美元;Terra 模型输入为 2.50 美元,输出为 15 美元;Luna 模型输入为 1 美元,输出为 6 美元。

这一变化意味着,大模型开始像云计算资源一样,被划分为不同等级。

这一思路其实非常像AWS。AWS不会只有一种EC2实例,而是提供几十种规格,开发者根据预算、计算需求和业务场景自由选择。同样,英伟达不会只卖一种GPU,而是拥有消费级RTX、专业级RTX Pro以及数据中心H100、B300等多个产品线。

OpenAI如今正在复制这一模式。未来,开发者选择模型时,不再只是问哪个模型最强,而是开始考虑我的业务是否真的需要旗舰模型?是否可以用Terra降低成本?客服机器人是否使用Luna即可?

这意味着大模型产业开始真正进入产品分层时代,模型不再只是技术产品,而成为标准化基础设施。

对于OpenAI来说,这不仅能覆盖更多用户群体,也能够提高整体收入结构——旗舰模型赚利润,轻量模型赚规模,中间型号赚企业市场。

这种模式远比单一模型更加稳定,也更符合企业软件的发展规律。

二、Agent成为真正主角,OpenAI开始重新定义AI软件

相比模型更新,更值得关注的是OpenAI此次对于Agent产品的布局。GPT-5.6发布会上,真正的核心关键词其实不是GPT,而是Agent。

数据显示,在专业Agent评测Agents' Last Exam中,GPT-5.6 Sol获得53.6分,领先Claude Fable 5达到13.1分。即使采用中等推理强度,依然领先11.4分,而估算成本仅为竞争对手的四分之一。

在Artificial Analysis编程Agent指数中,Sol同样取得80分,不仅超过Claude Fable 5,而且输出Token数量不到后者一半,运行时间缩短近一半,成本降低约三分之一。

这些数据释放出一个重要信号,行业竞争指标已经发生变化。

过去,大模型比的是谁回答得更聪明。如今,真正决定价值的是谁能够完成任务。二者看似相似,本质却完全不同。聊天机器人负责回答问题,Agent则负责执行任务。

例如用户说"帮我整理本周所有会议,并发送给团队",传统聊天机器人只能告诉你应该怎么做,Agent则能够读取日历、查找邮件、生成会议纪要、自动发送邮件,最后告诉你已经完成。

因此,未来AI竞争已经从Chat进入Work。

OpenAI此次推出的ChatGPT Work正体现了这一变化,它支持跨应用连续工作,可以调用多个软件完成完整任务,并直接交付最终成果。这意味着ChatGPT开始从聊天工具演变为工作平台。

与此同时,OpenAI还推出了Ultra模式。

传统模型一次只进行一条推理链,Ultra模式则默认启动4个Agent并行工作。多个Agent分别分析、推理、验证,再汇总结果。

这种架构类似于一个由四位专家组成的小团队,而不是单独一位专家。它用更多Token换来更高准确率、更短响应时间和更强鲁棒性。

未来,Agent很可能成为企业购买AI服务时最重要的指标,而模型本身则逐渐退居幕后。

三、真正的竞争已经不是模型,而是AI生态系统

如果把GPT-5.6发布会所有内容放在一起观察,会发现OpenAI正在完成一次产品整合。

此次同步宣布的几项动作包括ChatGPT Work正式推出、Codex App并入ChatGPT桌面端、免费用户即可体验Codex、独立Atlas浏览器逐步停役、浏览器能力迁移至Chrome扩展、API开放多Agent能力等等。

这些动作看似彼此独立,其实共同指向一个目标,那就是所有AI能力最终汇聚到ChatGPT。

这说明ChatGPT不再只是一个聊天应用,而是整个OpenAI生态的统一入口。

未来,用户可能在ChatGPT里完成写代码、浏览网页、办公协作、数据分析、调用企业系统、控制Agent,甚至操作机器人。

这一战略与微软Office的发展路径颇为相似。

Office最初只是Word、后来加入Excel再加入PowerPoint,随后整合Teams、OneDrive、Copilot,最终形成完整办公平台。

OpenAI正在复制这一模式,模型只是底层引擎,真正形成竞争壁垒的是生态。开发者越多,插件越丰富、企业接入越多,数据反馈越多、Agent越多,应用场景越丰富、用户越多,模型训练越完善。

这种网络效应一旦形成,后来者即便拥有性能接近的大模型,也很难撼动平台优势。

事实上,当前全球AI竞争正在进入新的阶段。Anthropic重点强化企业Agent;Google持续推进Gemini与Workspace、Android深度融合;Meta依靠Llama开源生态扩大开发者基础;

微软则借助Windows和Office推动Copilot普及。

竞争的焦点已经从谁拥有最强模型,转向谁拥有最大的AI生态。

未来,大模型或许会越来越像CPU一样重要,但不会成为用户直接感知的核心。真正决定胜负的,将是运行在其上的应用、Agent、工作流以及开发者生态。

结语

GPT-5.6的发布,表面上是一次模型迭代,实际上更像是OpenAI商业战略的一次升级。从Sol、Terra、Luna构成的模型矩阵,到ChatGPT Work、多Agent协同、Codex整合以及浏览器能力并入ChatGPT,OpenAI正在将原本分散的产品线整合为一个统一的平台。

这背后反映出AI产业竞争逻辑的变化,模型性能依然重要,但已不再是唯一决定因素。成本效率、Agent执行能力、跨应用协同以及生态覆盖,正在成为新的竞争维度。未来企业选择AI服务时,比较的可能不只是模型参数,而是整个智能工作平台能够创造的生产力。

공유하기:

작성자: CryptoPulse

이 글은 PANews 입주 칼럼니스트의 관점으로, PANews의 입장을 대표하지 않으며 법적 책임을 지지 않습니다.

글 및 관점은 투자 조언을 구성하지 않습니다

이미지 출처: CryptoPulse. 권리 침해가 있을 경우 저자에게 삭제를 요청해 주세요.

PANews 공식 계정을 팔로우하고 함께 상승장과 하락장을 헤쳐나가세요
관련 특집
PANews APP
트럼프 행정부의 새로운 AI 규제 기관에 관한 행정명령이 정체되어 있다
PANews 속보