AI价格战骤然升级——不再单纯比拼算力
Anthropic和OpenAI本周末纷纷推出大幅折扣模型,各自宣称效率优于对方的旗舰产品。这场竞赛已从追逐基准测试转向按任务成本较量。
重新定义中端AI市场的周末
两家公司在同一天发布了新的模型层级。Anthropic率先推出Claude Opus 5.5,OpenAI则反击推出GPT-6 Sol和GPT-6 Luna。双方讲述的是同一个故事:你如今可以花大约一半的价钱,获得接近旗舰级的性能。接下来发生的一切揭示出,AI军备竞赛已经多么远离纯粹的能力比拼,滑向经济战的赛道。
Anthropic的效能策略
Claude Opus 5.5于9月22日上线,覆盖Claude平台、AWS、Google Cloud和Microsoft Azure。Anthropic的说法十分直白:在典型负载下,它的表现与Claude Fable 5.1——公司顶级模型——相当,而运行成本降低40%。API定价也印证了这一点:输入每百万token收费$4,输出$20,较Opus 5下降了20%。缓存读取降至每百万$0.20,降幅达60%。
基准测试数字讲述的是一个喜忧参半的故事。在衡量代理式编码能力的Terminal-Bench 4.0上,Opus 5.5得分66.4%,领先于Fable 5.1的55.8%和OpenAI的GPT-6 Astra(57.9%)。但在AutomationBench(追踪业务工作流任务)和Terminal-Bench-Science 0.1上,GPT-6 Astra反而胜出。这款模型编码能力更锋利,但处理复杂操作流程的推理能力稍逊。
Anthropic同时强调了安全改进,声称内部审计创最佳纪录,相较Opus 5,试图绕过约束的尝试减少了85%。思考模式——部分用户依赖的那种缓慢、审慎的推理步骤——不再对Opus 5.5开放。这一举措凸显出Anthropic正在做出的权衡:在这一层级,速度和成本优先于深度推理。
CEO Dario Amodei此前公开呼吁行业放慢AI发展节奏。Opus 5.5是他表态后的首款发布产品,而大幅降价暗示他押注的是一场赌局:克制与效率,而非单纯的算力,才能赢得客户。
OpenAI的反击
OpenAI在同一天出手,推出GPT-6 Sol和GPT-6 Luna。两者采用与GPT-6 Astra相同的方法训练——后者是9月初发布的旗舰模型——但针对更低成本和更快推理进行了优化。
折扣幅度十分激进。GPT-6 Sol输入$2、输出$10每百万token,较GPT-5.6 Sol砍半。GPT-6 Luna更是降至输入$0.10、输出$0.50,之前分别是$0.20和$1.20。这不是微调,而是重塑了大规模运行AI的单位经济学。
OpenAI声称GPT-6 Sol的错误率仅为GPT-5.6 Sol的一半左右,并缩小了与Astra在一致性上的差距。在衡量实际软件开发的DeepSWE v1.1基准上,Sol得分68.8%,Claude Fable 5为69.9%——差距仅1.1个百分点,而每次任务的成本约为Astra的80%。在AutomationBench上,Sol录得33.2%,击败Claude Opus 5的26.9%,而成本仅为后者的9%。
可用性策略与Anthropic的广泛部署思路一致。ChatGPT Work和Codex立即对Plus、Pro、Business、Enterprise和Edu订阅用户开放。免费版和Go版用户可在桌面端访问GPT-6 Luna。API标识符为gpt-6-sol和gpt-6-luna。值得注意的是,标准ChatGPT界面尚未接入这两款模型。
当价格成为武器,会发生什么
最直接的效果是压缩了几乎所有玩家的利润空间——除了这两家最大规模的企业。Anthropic和OpenAI能够承受这样的降价,因为它们的基建规模让它们能在每个层级将单token成本压低。小型实验室若没有相应的利润率支撑,便无法跟进。
企业采购方短期受益最多。代理编码和工作流自动化的每百万token成本大幅下降。高频调用API的团队账单会明显缩减,而这也会改变部署决策——更多任务从批量处理转向实时流水线,因为经济账现在算得过来了。
开发者预期会经历一段短暂的动荡期,期间各公司都在更新模型路由逻辑。基准排名已经足够接近,提示词设计或缓存策略的微小调整,可能比模型本身的选择更重要。Anthropic在Terminal-Bench领先;OpenAI在AutomationBench领先。该用哪款模型,取决于你在做什么。
更深层的信号
两家公司都将5.5和6 Sol层级定位为新的默认选择。旗舰模型——Fable 5.1和GPT-6 Astra——在研究和前沿领域仍然重要,但商业主战场已经下沉。这是一个 barely existed two years ago 的产品周期中,成熟所呈现的样子。
Anthropic的安全指标和Amodei公开呼吁谨慎,为公司提供了差异化优势。OpenAI的价格战和在工作流任务上的基准领先,则提供了另一条商业路径。未来几周将显示客户会奖赏谨慎叙事,还是成本叙事。即将推出的Claude Sonnet 5.5和Haiku 5.5,以及OpenAI的后续发布,将进一步明确市场走向。
模型迭代迅速,价格走低,竞争真实存在。唯一剩下的问题是:当这场竞赛放缓的脚步重新加速时,谁来买单。