"Opus 5.5升了吗?"
"升了。但我劝你先别看跑分,看价格。"
这是这两天我在几个开发者群里看到最多的对话。9月23日,Anthropic发布Claude Opus 5.5,知乎热榜上也挂着对应的问题。我把凤凰网、网易、36氪、掘金的几篇报道并排核了一遍,核完之后最大的感受是:这次发布真正值得普通人关心的,不是"又变聪明了多少",而是顶级模型的价格开始往下走了。
先把事实摆清楚
据网易财经和新智元的报道,Opus 5.5的API定价是每百万输入token 4美元、输出token 20美元,比上一代Opus 5降了20%;缓存读取价格降到每百万token 0.2美元,降幅达60%。掘金那篇接入实测里算了一笔账:对需要反复读取大代码库的场景,综合使用成本比Opus 5下降约40%——这也是官方宣传"运行成本低40%"的来源。输出速度提高超过30%,在Claude Code里还支持最高2.5倍提速的Fast Mode。
性能这边,36氪整理的官方数据:Terminal-Bench 4.0得分66.4%,高于GPT-6 Astra的57.9%;面向知识工作的GDPval-AA v2.1拿到1846 Elo,超过自家旗舰Fable 5.1的1735。也就是说,一个"次旗舰"在半代升级之后,多数任务上摸到了旗舰的水平,价格反而更便宜。
官方案例里最夸张的一条:有测试者用Opus 5.5在不到一天内完成了68万行代码的迁移,这种任务原本要耗时数周;还有人9.5小时把HAProxy从C语言转译成Rust。当然,它也不是全项领先——AutomationBench上40.0%,略输给GPT-6 Astra的41.4%。
跑分之外,真正该看懂的信号
把时间线拉长一点看,这个9月的画风是:新智元的标题里提到,OpenAI的GPT-6 Sol和Luna在API定价上比上一代直接腰斩50%;Anthropic这边成本降40%。36氪那篇报道的标题就叫《最卷一夜》。
头部厂商不再比"谁更聪明",开始比"谁的聪明更便宜"。 这对普通用户意味着什么?
第一,"用最好的模型"这件事的门槛在快速下降。一年前,顶级模型是奢侈品,普通开发者调一次都心疼;现在同价位能买到的能力,比半年前多了一截。价格战的每一轮,都是把AI实操的入场券往下发了一层。
第二,选模型的逻辑变了。以前看跑分选"最强",现在更该算"每个任务花多少钱"。Opus 5.5缓存读取降60%这条,对跑分毫无影响,但对天天让AI读长文档、翻大代码库的人来说,是实打实的账单变化。跑分是给别人看的,单价是给自己算的。
第三,半代升级会成为常态。Opus 5到5.5之间只隔了几个月,Sonnet 5.5和Haiku 5.5官方也说未来几周陆续推出。模型会像手机一样"年年有小改款",与其纠结"现在用哪个最好",不如建立一套自己随时能切换的用法——工具层面对多个模型保持开放,比押注单一模型更稳妥。
普通人怎么跟上这轮降价
你不需要会写代码,也能吃到这波红利:
- 把手头最费时间的重复任务列出来——整理表格、写周报、总结长文。这类任务对模型能力要求不高,降价后成本几乎可以忽略。
- 用聚合平台代替单一订阅。我在spark1.cn的工具库里收录了各家主流AI工具的入口(/tools/),写作场景可以直接用AI写作间(/ai-writer)对比不同模型的产出,哪家答得好用哪家,不用为每家的会员分别掏钱。
- 关注缓存和上下文成本,不只看单价。以后你评估任何AI服务,多问一句"重复读取同样的资料要不要再付一次钱",就能避开大部分隐性成本。
模型降价这件事,从来不会敲锣打鼓地通知你。它只会悄悄出现在下个月的账单里——而看懂账单的人,永远比追跑分的人先一步把AI用出价值。
💬 评论