business 7 分钟阅读

OpenAI 让自家高端模型瞬间显得昂贵

OpenAI 在初代 GPT-6.1 发布仅一周后推出 GPT-6.1 Sol,承诺以五分之一成本提供同等 Astra 级性能。真正引人注目的并非基准测试数字——而是一步精心设计的定价策略,或将对手逼入死角。

  • Noam Shazeer
  • Anthropic
  • 智谱
  • Opus 5
  • AI竞争

没人请求的降价

9月29日,OpenAI 发布了 GPT-6.1 Sol——恰好在上一代产品发布一周之后。营销口径直白:以五分之一的成本,实现逼近 GPT-6 Astra 的性能。这种叙事框架的意义,比基准测试数据本身更重要。

OpenAI 不只是在发布一个更快的模型。它正在实时重新定位自己的产品线,让高端型号在任何人眼中都显得性价比不佳——只要他们不需要榨干每一项能力。其战略意味,比新闻稿所暗示的更加尖锐。

定价到底怎么算

API 数据说明了问题。GPT-6.1 Sol 的输入 token 价格为每百万 2 美元,缓存输入 0.10 美元,输出 token 每百万 10 美元。与之对比的是 GPT-6 Astra——OpenAI 将其定位为最高性能模型。差距并非边际性的,而是结构性的。

在编程基准 DeepSWE v1.1 上,GPT-6.1 Sol 以约五分之一的单任务成本追平了 Astra 的表现。在文档阅读基准 GDP.pdf 上,同一模式依然成立。在多步骤工作流测试 AutomationBench 上,GPT-6.1 Sol 以中等推理力度超越 Anthropic 的 Claude Opus 5.5,成本约为后者的三分之一。在衡量计算机操作能力的 OSWorld 2.0 上,该模型与 Astra 的差距已缩至 2.1 分,每任务成本约为 Astra 的七分之一。

这些并非边缘案例的结果。它们横跨编码、文档解析、工作流自动化和交互式系统控制——这正是企业规划最大投资回报率赌注的类别。

为什么一周很重要

从 GPT-6 Sol 到 GPT-6.1 Sol 仅隔七天,这在当下市场并不寻常。模型的发布节奏要么是 relentless iteration( relentless 迭代),要么是 competitive panic(竞争性恐慌),而细节显示两者兼有。

据《华尔街日报》和路透社报道,OpenAI 原本计划在 10 月发布 GPT-6.1 Astra,但因安全和对齐顾虑推迟了。OpenAI 本身确认,GPT-6.1 Sol 在对齐评估中显著优于 GPT-6 Sol,并正在接近 GPT-6 Astra 的相关指标。Sol 系列正在吸收 Astra 无力承接的发布压力。

这是精心设计的风险分配。高端型号承担品牌和安全包袱;Sol 系列则承担出货量和价格战。

谁赢谁输

赢家: 在 API 之上构建应用的开发者和中型企业。成本降幅足以改变任何大规模运行工作负载的单位经济模型。如果你的应用每天调用 API 一百万次,单次任务成本的五分之一将决定这笔生意能否成立。

ChatGPT Plus、Pro、Business、Enterprise 和 Edu 订阅者通过 ChatGPT Work 和 Codex 可在首日获得使用权限。他们暂不能在主聊天界面中使用——这是刻意的摩擦,在广泛分发新模型的同时,为 Astra 层级保留向上销售的价值空间。

输家: Anthropic 面临最直接的竞争压力。Claude Opus 5.5 曾被定位为需要超越的生产力基准。在三分之一的价格上输掉这场比较,迫使 Anthropic 做出抉择:在性能上匹敌并侵蚀利润率,还是坚守价格并将价值话语让渡给 OpenAI。无论哪种情况,Anthropic 都已陷入被动。

已有 Astra 承诺的企业也可能感到挤压。如果中端型号现在能以 20% 的成本满足 80% 的需求,内部推动力将转向降低工作负载等级——除非 OpenAI 维持足够的能力区隔来为溢价辩护。

真正的问题:这会引发购买潮吗?

日本科技媒体将此称为"价格杀手"。这种说法作为营销简语很有用,但现实更为微妙。

企业买家不是冲动消费者。五倍成本削减固然诱人,但将整个技术栈从一种模型迁移到另一种,涉及集成工作、延迟测试和风险评估。OpenAI 发布时机的选择——正值西方媒体集中报道 Astra 延期——表明公司正试图抢占叙事窗口,在竞争对手做出反应之前。

有趣的是这种"优化策略"本身。通过让较便宜型号好到足以威胁高端型号的关联性,OpenAI 迫使市场重新协商"足够性能"的定义。如果 GPT-6.1 Sol 成为生产级 AI 的新基准,那 Astra 的溢价就不再仅仅关乎性能——而是关乎安全保证、最高可靠性和品牌光环效应。这是一个可以自洽的差异点,但会显著收窄高端型号的target市场。

接下来发生什么

关注两件事。

第一,Anthropic 如何回应。Claude 的降价,或下一代产品性能上的追赶,都将表明 OpenAI 是否永久性地抬高了竞争底线,抑或只是赢得了一轮较量。AutomationBench 的结果只是开局,而非终局。

第二,OpenAI 是否加速 Astra 的发布。导致延期的安全顾虑是真实的——对齐评估并非装饰。但如果 GPT-6.1 Sol 持续缩小能力差距,将 increasingly 施压促使 Astra 尽快上市。延期的每一周,都是让更便宜型号定义市场预期的每一周。

OpenAI 实质上为竞争对手设置了一个定价陷阱。问题是,他们是否也为自身设置了一个——让自己的高端产品看起来越来越难卖。