Claude Opus 5半价反超旗舰Fable 5,ARC-AGI 3得分三倍碾压:大模型定价逻辑正在崩掉

Published on: 2026-07-31

7月24日,Anthropic悄悄扔了一颗炸弹。

没有提前预告,没有媒体吹风会。Claude Opus 5直接上线,我的Claude Max默认模型被换成了它。

然后我看了一眼跑分表——愣住了。

这不是"接近旗舰"的水平。在十几个评测项目里,Opus 5拿下了绝大多数第一。Frontier-Bench编程43.3%(Fable 5是33.7%),知识工作GDPval-AA 1861(Fable 5是1747),SWE-bench Verified 96.0%。甚至在ARC-AGI 3——这个专门测试模型解决「从没见过的新题」能力的基准——Opus 5拿了30.2%,而第二名GPT-5.6 Sol只有7.8%。

差距不是一点点,是三倍。

但价格呢?输入每百万token 5美元,输出25美元——和上一代Opus 4.8一模一样,只有Fable 5(10/50美元)的一半。

一个比旗舰更强的模型,卖着上一代的价格。大模型「越强越贵」的定价逻辑,正在被Anthropic自己亲手打破。

「半价旗舰」为什么不是换个名字降价

📖 名词释义

AI Box(又称 AI盒子 / 智能体计算机 / Agent Computer),是一种专门运行 AI Agent 的本地硬件设备,预装智能体应用管理系统,开箱即用,7×24 小时在线运行。用户可以通过微信、飞书、企业微信、钉钉等社交软件远程指挥 AI 帮你干活。

很多人第一反应是:这不就是把Fable 5换个名字降个价?

不是。Opus 5做了底层架构的系统性重构。最直接的证据是Fable 5根本没做规模化强化学习训练——研究员Nathan Lambert分析说,Fable 5那个体量目前还没办法好好跑RL。Opus 5通过架构优化,在更小巧的模型上跑了完整的强化学习流程。

这让它不止是便宜,而是在很多场景下「更好用」。

官方给了几个案例。用一张机械零件图纸让Opus 5写代码在FreeCAD里重建三维模型,但故意不让它直接「看」图。它自己写了一套计算机视觉流程,从原始像素里提取几何形状,把整个零件还原出来——其他模型试了五次都没搞定。

还有一个开源包管理器的真实Bug:社区补丁漏了一个边界情况。Opus 5找到了根因然后把缺口补上了;对照模型只修了表面症状就宣布「已解决」。

有个有趣的细节:Opus 5在FrontierCode编程测试上,中等思考档位拿了53.4%;把思考强度往上调,分数反而掉到了48.0%。想太多反而做错——像一个过度紧张的考生。

45天,旗舰自己打自己脸

Fable 5是6月9日发布的,Anthropic首个公开Mythos级模型,API输入10美元、输出50美元每百万token——史上最贵的通用模型。

从6月9日到7月24日,只隔了45天。Anthropic出了一个新模型,跑分反超Fable 5,价格减半。

这意味着大模型定价不再「按能力分层」了。过去选模型就是一份价目表:最便宜是Haiku,中等是Sonnet,贵的是Opus,旗舰是Fable/Mythos。价格和性能线性挂钩。

Opus 5打破了这个线性关系——在价格和性能之间画了一条对消费者更友好的曲线。

Anthropic内部的比喻很贴切。Haiku/Sonnet是家用V6引擎,Opus是高性能V8,Fable/Mythos是F1赛车。现在这台V8跑出了F1的圈速,油耗控制在V6水平。

OpenAI的GPT-5.6、Google的Gemini 3.1现在必须面对一个问题:如果「半价旗舰」变成市场常态,你们的定价还能撑多久?

模型越便宜,你越需要一个24小时帮你用它的人

这里有个容易忽视的转折。

过去大家说AI贵、用不起,AI是少数人的工具。但当Opus 5把价格砍到一半、能力反而更强——AI正在变成水电煤一样的基建。

那问题来了:电便宜了,不代表你不需要一个配电箱。水便宜了,不代表你不需要水龙头。

模型便宜了,但谁来帮你24小时用它?

这正是本地AI助手该发力的时刻。

一台铠盒AIBOX放在家里,插电就跑,功耗很低,不需要开电脑。上面跑的Hermes Agent可以7×24小时在线——你睡觉时它替你处理邮件、整理报表、定时查询信息推送给你。你给Agent发一条微信,它就用Opus 5(或者你选的任何模型)去干活——醒来只看结果。

所有交互记录、偏好记忆、工作成果都存在本地硬盘里,不上传云端。AI越用越懂你,这些「懂你」的数据全归你自己。

过去有人说「云端AI更方便」。但当模型价格跌到每百万token几块钱,真正的瓶颈已经不是「用不用得起」,而是「有没有一个平台帮你24小时自动用它」。

开电脑、打开网页、登录账号、输入问题——一天几次没问题,几十次呢?睡觉的时候谁来操作?

「不开电脑、7×24小时在线、数据私密保存、长久记忆、功耗很低」——这五个特点放在一起,才是一套真正能帮你省时间的AI系统。

定价逻辑正在崩掉,接下来会怎样

Opus 5不是终点,是一个信号。

当Anthropic自己出的中端模型能反超旗舰,说明大模型能力提升的速度已经超过了定价体系的调整速度。Fable 5之后,Anthropic内部大概率还有Fable 6、Mythos 6在准备——但那些旗舰模型的价格,还能撑多久?

开源那边也不消停。Kimi K3完整权重刚公开发布,任何开发者都能在本地跑一个接近闭源旗舰能力的模型。OpenAI前脚把GPT-5.6 Luna降价80%,后脚被Opus 5用更少的价格打了更狠的脸。

这条曲线只有一个方向:向下。

对普通人来说,好消息是你再也不用纠结「用不起最好的模型」。坏消息是——如果你还没有一个能7×24小时自动帮你用这些便宜模型干活的平台,那「便宜」跟你其实没太大关系。

你需要的不是一个更便宜的API Key,而是一个装了你专属AI的盒子,放在家里永不关机,记住你的一切,随时响应。

每百万token差几美元的区别,远小于「没人帮你用」和「有人帮你用」的区别。


延伸阅读: - 关掉电脑后,怎么让AI继续帮你干活? - 出门在外,微信把资料发给家里AI自动提炼语音播报 - 一文讲清楚Codex/Hermes/WorkBuddy/铠盒AIBOX区别

欢迎联系邮箱:[email protected]

铠盒AIBOX #AI智能体 #大模型 #ClaudeOpus5 #AI定价 #Anthropic

推荐产品

铠盒 A1 家用入门款 铠盒 A1 Pro 增强款 铠盒 A2 专业款 铠盒 A2 Pro 进阶款 铠盒 X1 企业款 铠盒 G1 旗舰款
© KAIHE AI - Agent Computer Specialist