首页 > 教程攻略 > ai教程 >Opus 5只要Fable一半价格,我准备把Claude续上了

Opus 5只要Fable一半价格,我准备把Claude续上了

来源:互联网 时间:2026-07-27 07:29:39

今天早上看到Claude Opus 5发布,Claude这个账号,确实该续上了。

上一次真正深度使用Claude,还是Opus 4.7。后面的Opus 4.8、Fable 5,包括今天刚发布的Opus 5,都没有放进真实项目里认真跑过。

说起来有点尴尬。一边在做AI编程相关内容,一边看着Claude接连发布Opus 4.8、Fable 5和Opus 5,Fable 5甚至被很多人称为目前最强的模型,但了解主要还是来自官方资料、榜单和别人的评测——榜单能看,参数也能整理,可这跟自己真正用过是两回事。别人已经在拿Fable 5、Opus 5跑真实项目,自己还在外面看热闹,这事确实有点说不过去了。

为什么一直没有续Claude

原因很直接:公司配了Codex。

工作中接近100%的AI编程任务,主力是GPT-5.6 Sol。真实的Ja va后端需求、复杂调用链排查、代码修改、问题定位,GPT-5.6已经足够强,而且公司提供额度,没有必要放着不用,再自己花钱养一套Claude。

所以看到Opus 5发布,并不存在什么“GPT不能用了”、“工作要全部切到Claude”的焦虑。就算Opus 5在部分任务上更强,这一点差距也不会让后端工作突然发生翻天覆地的变化。公司项目里,GPT-5.6依然会是主力。

真正驱动续回Claude的,是工作之外的另外两件事。

第一件是写作。GPT-5.6写代码很强,但写文章,经常让人不满意。最明显的问题就是人味太差,AI味和机构腔太重。不管怎么强调真实、个人感和口语化,它写着写着还是会回到熟悉的模板里,每句话都很正确,连在一起就是不像一个真人在说话。到目前为止,从写作的角度看,Opus 4.6依然是最佳选择。这个判断来自长期实际使用中最直接的感受。

第二件是最近正在探索的AI出海方向。还在找方向、验证关键词、做MVP的阶段,已经上线了两个练手网站。实话实说,目前基本都没有流量,就是拿来学习和验证想法的产品。功能上,GPT-5.6可以把网站做出来。但到了产品落地页和前端设计,它的审美经常达不到直接上线的标准。有些第一版不能说功能不能用,但那个UI真的就是不忍直视,连自己都不愿意把它发到线上。试过把别人做得特别好的产品页直接发给它,让它照着复刻。参考已经摆在面前了,最后做出来还是差着一截。布局能对上,组件也都有,但整体气质、留白、层级和细节就是不对。为了改善这个问题,还找了不少提升前端效果的Skills。用了以后确实会好一点,但离真正满意依然有距离。

这正是为什么一直惦记Claude。Opus 4.6、4.7的时候,亲自拿Claude和GPT做过前端对比,Claude确实更稳。现在做个人产品,这部分能力又需要了。

Opus 5这次到底强在哪

先搞清楚Anthropic对Opus 5的定位:接近Fable 5的前沿能力,但价格只有一半。

API输入价格是每百万Token 5美元,输出25美元,和Opus 4.8保持一致;Fable 5是输入10美元、输出50美元。GPT-5.6 Sol则是输入5美元、输出30美元。也就是说,Opus 5的输入价格和GPT-5.6 Sol一样,输出还便宜5美元;和Fable 5相比,输入、输出都是正好一半。

在Claude聊天里,Opus 5对所有付费计划都支持100万Token上下文;放到Claude Code里也支持100万,但Pro用户需要开启usage credits。它还有一个Fast Mode,速度大约提升到2.5倍,代价是价格也翻倍。需要快速出结果时可以开,但日常一直挂着跑,额度肯定也扛不住。

能力上,这次最明显的提升是更会把事情做完。

这张综合评测表更能说明Opus 5现在的位置。Frontier-Bench上,Opus 5是43.3%,Fable 5是33.7%;AutomationBench是26.0%对17.4%;OSWorld是70.6%对66.1%。但它也不是每项都赢:DeepSWE上GPT-5.6 Sol最高,FrontierCode上Fable 5只领先0.1%。所以更准确的说法不是“Opus 5全面超过谁”,而是它已经在很多真实任务上进入第一梯队,而且各有胜负。

官方放出的案例里,有一个细节很值得注意:Opus 5修开源软件的Bug,不只修掉表面报错,还找到了社区原补丁遗漏的边界问题。另一个模型只把症状压下去,就告诉用户已经修好了。这正好对应日常最看重的能力。后端开发真正麻烦的从来不是写一个函数,而是顺着调用链找到根因,知道一个改动会影响哪些模块,方案有没有漏掉并发、数据量和后续扩展。老系统撑不住新业务时,也不是改几行代码,而是要重新审视架构,再决定怎么改造。

Opus 5这次重点提升的判断、验证、根因分析和长任务执行,确实很对胃口。前端也是一样。Anthropic这次专门强调了Opus 5的视觉输出,早期测试里有人提到,它会自己打开页面,在桌面和手机尺寸下检查,发现内容掉到首屏外、按钮跑出屏幕以后再修掉。OpenAI也说GPT-5.6的设计判断有明显提升,但至少在上线的两个网站里,这个提升还没有达到标准。Opus 5能不能解决做落地页时的审美问题,得自己跑过才知道。

Opus 5、Fable 5和GPT-5.6怎么选

先看一个粗略位置。Artificial Analysis的综合指数里,Opus 5、Fable 5、GPT-5.6 Sol分别是61、60、59分,三者最大只差2分,基本已经站在同一梯队。

这张图说明Opus 5已经逼近顶级模型,但它不能直接替我们做选择,因为综合分会把具体场景、价格和额度都压平。

Fable 5在Anthropic的产品层级里仍然高于Opus,面向最难、最长、可以持续几天的研究、编程和异步Agent任务。不过产品层级更高,不等于每一项评测都稳赢;至少在这张综合榜单里,Opus 5还领先1分。在API里,Fable 5是Opus 5的两倍价格。订阅里也不是所有人都能随便用:Max用户最多可以把每周额度的50%用在Fable 5上,Pro用户则要一开始就使用额外的usage credits。

Opus 5更像日常真正拿来干活的主力。它是Claude Pro能直接使用的最强模型,也是Max的默认模型。编程、Agent、电脑操作、根因排查、代码审查都已经逼近Fable 5,价格和额度却舒服得多。

GPT-5.6 Sol依然是非常强的工程模型。OpenAI自己公布的数据里,它在Coding Agent、DeepSWE和Terminal-Bench这些编程评测上仍然处于第一梯队,有些成绩还超过Fable 5。对大型代码库、复杂后端任务和长时间工程执行,实际使用也证明了它足够可靠。

从评审角度看,对三者的预期也不一样。GPT-5.6更适合顺着真实工程链路往下追,然后把代码改完;Opus 5这次强调的是判断、根因分析和交付前验证;Fable 5则把能力上限放在最难、最长、需要反复推翻错误判断的任务上。只有第一条是长期使用后的体感,后两条还要等自己验证。

额度也不能只看API单价。Codex Plus使用GPT-5.6 Sol时,官方给出的范围是每5小时大约15到90条本地消息,任务越复杂、上下文越长,消耗越快,另外还可能有周限制。OpenAI目前还提供Pro 5x和20x档。Claude同样有5小时窗口和周额度,所以真正选模型时,公司有没有提供账号、自己用什么套餐,往往比每百万Token差几美元更现实。

所以这三者不是简单的第一、第二、第三。如果主要做公司里的后端开发,尤其已经有Codex额度,GPT-5.6 Sol没必要换掉。如果是个人开发者,要做完整产品、前端页面、设计还原,又希望兼顾复杂代码和Agent执行,Opus 5可能是现在最值得认真看的模型。如果遇到特别难的架构设计、超长任务或者其他模型始终解决不了的问题,而且不太在意价格,再考虑Fable 5。

至于自己的安排,已经比较明确了。公司的后端项目继续优先用GPT-5.6。Claude主要用在自己出海产品、前端设计和写作上;公司项目里遇到复杂方案,也可以让Claude做一次独立审查,和GPT-5.6互相验证。等GPT-5.6额度用完,Claude也能接着干活。

今天这篇不是Opus 5实测,也不会装成已经用过以后给它下结论。但看到Opus 5把能力推到接近Fable 5,价格又压回Opus这一档,确实觉得,继续站在外面看已经不太合适了。Claude这个账号,值得重新续上。

后面会把Opus 5、Fable 5真正放进自己的Ja va项目、架构方案和个人产品里使用。什么时候能形成值得写的结论,真用出东西了,再和大家聊。至少下一次再说哪个Claude最强时,希望这个判断不只是来自榜单。