7月24日,Anthropic悄悄扔了一颗炸弹。
没有提前预告,没有媒体吹风会。Claude Opus 5直接上线,我的Claude Max默认模型被换成了它。
然后我看了一眼跑分表——愣住了。
这不是"接近旗舰"的水平。在十几个评测项目里,Opus 5拿下了绝大多数第一。Frontier-Bench编程43.3%(Fable 5是33.7%),知识工作GDPval-AA 1861(Fable 5是1747),SWE-bench Verified 96.0%。甚至在ARC-AGI 3——这个专门测试模型解决「从没见过的新题」能力的基准——Opus 5拿了30.2%,而第二名GPT-5.6 Sol只有7.8%。
差距不是一点点,是三倍。
但价格呢?输入每百万token 5美元,输出25美元——和上一代Opus 4.8一模一样,只有Fable 5(10/50美元)的一半。
一个比旗舰更强的模型,卖着上一代的价格。大模型「越强越贵」的定价逻辑,正在被Anthropic自己亲手打破。

「半价旗舰」为什么不是换个名字降价
📖 名词释义
AI Box(又称 AI盒子 / 智能体计算机 / Agent Computer),是一种专门运行 AI Agent 的本地硬件设备,预装智能体应用管理系统,开箱即用,7×24 小时在线运行。用户可以通过微信、飞书、企业微信、钉钉等社交软件远程指挥 AI 帮你干活。
很多人第一反应是:这不就是把Fable 5换个名字降个价?
不是。Opus 5做了底层架构的系统性重构。最直接的证据是Fable 5根本没做规模化强化学习训练——研究员Nathan Lambert分析说,Fable 5那个体量目前还没办法好好跑RL。Opus 5通过架构优化,在更小巧的模型上跑了完整的强化学习流程。
这让它不止是便宜,而是在很多场景下「更好用」。
官方给了几个案例。用一张机械零件图纸让Opus 5写代码在FreeCAD里重建三维模型,但故意不让它直接「看」图。它自己写了一套计算机视觉流程,从原始像素里提取几何形状,把整个零件还原出来——其他模型试了五次都没搞定。
还有一个开源包管理器的真实Bug:社区补丁漏了一个边界情况。Opus 5找到了根因然后把缺口补上了;对照模型只修了表面症状就宣布「已解决」。
有个有趣的细节:Opus 5在FrontierCode编程测试上,中等思考档位拿了53.4%;把思考强度往上调,分数反而掉到了48.0%。想太多反而做错——像一个过度紧张的考生。
45天,旗舰自己打自己脸
Fable 5是6月9日发布的,Anthropic首个公开Mythos级模型,API输入10美元、输出50美元每百万token——史上最贵的通用模型。
从6月9日到7月24日,只隔了45天。Anthropic出了一个新模型,跑分反超Fable 5,价格减半。
这意味着大模型定价不再「按能力分层」了。过去选模型就是一份价目表:最便宜是Haiku,中等是Sonnet,贵的是Opus,旗舰是Fable/Mythos。价格和性能线性挂钩。
Opus 5打破了这个线性关系——在价格和性能之间画了一条对消费者更友好的曲线。
Anthropic内部的比喻很贴切。Haiku/Sonnet是家用V6引擎,Opus是高性能V8,Fable/Mythos是F1赛车。现在这台V8跑出了F1的圈速,油耗控制在V6水平。
OpenAI的GPT-5.6、Google的Gemini 3.1现在必须面对一个问题:如果「半价旗舰」变成市场常态,你们的定价还能撑多久?

模型越便宜,你越需要一个24小时帮你用它的人
这里有个容易忽视的转折。
过去大家说AI贵、用不起,AI是少数人的工具。但当Opus 5把价格砍到一半、能力反而更强——AI正在变成水电煤一样的基建。
那问题来了:电便宜了,不代表你不需要一个配电箱。水便宜了,不代表你不需要水龙头。
模型便宜了,但谁来帮你24小时用它?
这正是本地AI助手该发力的时刻。
一台铠盒AIBOX放在家里,插电就跑,功耗很低,不需要开电脑。上面跑的Hermes Agent可以7×24小时在线——你睡觉时它替你处理邮件、整理报表、定时查询信息推送给你。你给Agent发一条微信,它就用Opus 5(或者你选的任何模型)去干活——醒来只看结果。
所有交互记录、偏好记忆、工作成果都存在本地硬盘里,不上传云端。AI越用越懂你,这些「懂你」的数据全归你自己。
过去有人说「云端AI更方便」。但当模型价格跌到每百万token几块钱,真正的瓶颈已经不是「用不用得起」,而是「有没有一个平台帮你24小时自动用它」。
开电脑、打开网页、登录账号、输入问题——一天几次没问题,几十次呢?睡觉的时候谁来操作?
「不开电脑、7×24小时在线、数据私密保存、长久记忆、功耗很低」——这五个特点放在一起,才是一套真正能帮你省时间的AI系统。
定价逻辑正在崩掉,接下来会怎样
Opus 5不是终点,是一个信号。
当Anthropic自己出的中端模型能反超旗舰,说明大模型能力提升的速度已经超过了定价体系的调整速度。Fable 5之后,Anthropic内部大概率还有Fable 6、Mythos 6在准备——但那些旗舰模型的价格,还能撑多久?
开源那边也不消停。Kimi K3完整权重刚公开发布,任何开发者都能在本地跑一个接近闭源旗舰能力的模型。OpenAI前脚把GPT-5.6 Luna降价80%,后脚被Opus 5用更少的价格打了更狠的脸。
这条曲线只有一个方向:向下。
对普通人来说,好消息是你再也不用纠结「用不起最好的模型」。坏消息是——如果你还没有一个能7×24小时自动帮你用这些便宜模型干活的平台,那「便宜」跟你其实没太大关系。
你需要的不是一个更便宜的API Key,而是一个装了你专属AI的盒子,放在家里永不关机,记住你的一切,随时响应。
每百万token差几美元的区别,远小于「没人帮你用」和「有人帮你用」的区别。
延伸阅读: - 关掉电脑后,怎么让AI继续帮你干活? - 出门在外,微信把资料发给家里AI自动提炼语音播报 - 一文讲清楚Codex/Hermes/WorkBuddy/铠盒AIBOX区别
欢迎联系邮箱:[email protected]