Claude Opus 5.5 发布,OpenAI 火速上新:大模型开始卷“性价比”了

9月22日,Anthropic 突然放出了 Claude Opus 5.5,官方口径是性能追平上一代旗舰 Claude Fable 5.1,运行成本比 Opus 5 低 40%;结果几个小时后,OpenAI 就在官网悄悄上线了 GPT-6 Sol 和 GPT-6 Luna 两款面向专业工作场景的模型。两家头部公司几乎同一天“开炮”,把大模型竞争从“谁更强”直接拉到了“谁更划算”。

为什么重要:这标志着顶配大模型正式进入“效率战”。OpenAI 的 GPT-6 Astra 今年 9 月刚拿下过 AGI 噱头——在 ARC-AGI-3 里刷出 99.9%,但换到统一测试环境下只有 62.7%,评分口径和定价一直有争议;而 Anthropic 这次用“更低单价”贴身回应,OpenAI 立刻跟一组更宽泛、更便宜的产品线。说明双方都把“平价旗舰”当成了下一轮增长的关键。

但“更便宜”这件事不能只看标价。有第三方测算指出,Opus 5.5 每解一道题平均要消耗约 11.9 万 token,其中思考环节就占了 8.4 万,明显高于 Opus 5 的 7.3 万和 Fable 5.1 的 7.8 万,而 GPT-6 Astra 只用 2.7 万。单价降了、token 用多了,真实部署成本到底省没省,得看实际负载。对开发者来说,最靠谱的不是发布会上的百万 token 单价,而是拿自己的任务实测一轮。

更值得玩味的是节奏:Anthropic CEO 上个月刚发长文呼吁“AI 行业要放慢脚步”,转头自家新旗舰就上了。安全叙事、商业竞争、融资与 IPO 压力叠在一起,“想慢也慢不下来”成了头部公司真实的处境。这一轮发布背后,其实是行业对“更快、更强、更便宜”的集体惯性。

对普通人来说,好消息是同样的活可以用更低成本、更快速度跑出结果;但面对“更强更便宜”的官方话术,先别急着全信,拿自己手头的任务去测一测,比看发布会更有用。

主要信息来源