
本文来自微信公众号: 数字生命卡兹克 ,作者:数字生命卡兹克,原文标题:《Claude Opus 5深夜发布,以一半价格逼近Fable 5。》
左等右等,Claude Opus 5,就在这个周六的凌晨,正式发布了。

目前,已经全量上线,在所有Claude产品里,全线可用。

100万上下文,知识最新截止时间来到了2026年的5月,新的不得了。
本来在Codex上挂了几个/goal的目标任务,准备早睡了,结果这一激灵,直接停了,然后所有的任务取消,挂到Claude里,全部用Opus 5重跑。
甚至今天做的很多的任务,Fable 5额度用光了,使用GPT-5.6 sol执行的,现在,我也准备再用Opus 5重跑一遍了。

主要是,给你们看看这个Claude Opus 5的跑分,你们就知道这个模型,有多离谱了。

咱们客观的说,Anthropic这家公司,从上到下天天被人骂,坏事做尽,天天当小丑,来来回回耍猴,但是吧,你不得不说,他们的模型确实好,确实是牛逼。。。
所以如今出现了很诡异的风气,包括我自己也是,我真的很讨厌Anthropic,但是为了产品、为了工作、为了效率,身体又很诚实,每次紧巴巴的把Claude Fable 5额度用完的时候,总是有一种戒断反应。
然后只能去发发牢骚。

相信我,用习惯了Fable 5之后,再让你去用Claude Opus 4.8,你会觉得,这是什么蠢东西。
这一个月的时间,我的人生好像被按下了加速键,Claude Fable 5下线又上线,GPT-5.6 Sol的接棒和几乎无限的重置,Kimi K3的国产崛起,再加上今天Claude Opus 5的上线。
我感觉我做的产品、我的代码,几乎每一周就要大幅的优化一遍,因为我是外行也是个菜逼,模型的进步,几乎也代表着我的产品的进步。
这背后的工作,其实每一个点,都可以拎出来分享万字长文了,任何东西你想把它做好,背后花费的心力真的不是一点两点。
所以很多人总说,新模型上线就你天天激动,我每次都想回,我能不激动吗,因为这代表着我的产品、我的工作,又能更快速的进步、给大家带来更好的体验,也能做出更多我想做的功能了呀。
回到Claude Opus 5上。
Anthropic给Opus 5的定位非常清楚,它在很多领域已经逼近Fable 5了。
就像上面那张跑分图。

甚至在ARC-AGI-3上,是最夸张的,Opus 5是30.2%,GPT-5.6 Sol是7.8%,Opus 4.8只有1.5%,可惜Fable 5没有这块的跑分,不知道能到都多少。

它相当于直接做到了第二名的接近四倍。
这种抽象推理、动态适应和陌生任务泛化,一直是模型最容易露怯的。
因为过去的模型经常能复述世界,能模仿答案,但是一旦规则没见过,立刻开始犯蠢了,所以ARC-AGI-3,在现在的时间点,挺能代表一个模型真正的智力和泛化程度的。
甚至在AA的跑分上,居然比Fable 5还要强。

但是价格只有Fable 5的一半。
输入每百万Token 5美元,输出每百万Token 25美元,价格跟Opus 4.8一样。
还有一个Fast Mode,速度大约提升到2.5倍,价格翻倍。
我知道你现在想说,我靠,Claude Opus 5比Claude Fable 5都要强了?那我还用个屁的Claude Fable 5啊,又贵又垃圾。
但是,我想说,现在模型厂商的伎俩吧,其实都是有误导性的,你只看到了他们放出来的这些评测集,基本都是代码、Agent、办公等等。
但是,真正的跑分,在Opus 5的系统卡里和过去Fable 5(也就是Mythos 5)的对比里,我全整理了出来,可以看看实际的情况。

所以,从这里就可以看出,Fable 5更像一颗更大的纯大脑,擅长无工具推理、原生视觉理解、专业医疗表达、高难编程,以及网络安全等极难专业任务。
而Opus 5更像一个执行系统成熟的Agent,特别会使用工具、检查结果、发现错误、重新尝试,最终任务完成率更高。
如果硬要我说,一个感觉是新预训练带来的版本之子,一个是当下RL的版本之子。
所以,在较难的工程任务、Agent任务、真实任务里,Claude Opus 5的实现效果可能会更好,但是从方案设计、规划的角度来说,依然是Claude Fable 5效果最好。
所以如果只问Opus 5有没有把Fable 5彻底淘汰,答案很简单,暂时没有。
可如果问它是不是当前最适合大规模拿来干活的Claude,我个人已经准备直接切了。
尤其是那些过去觉得Fable最好用,又实在舍不得额度,最后只能咬牙退回Opus 4.8的任务,主要还是每周的Token额度Fable 5只能用50%,另外50%不用光,那是真的就浪费掉了。
这次终于有一个舒服得多的中间解了,50%额度的Claude Fable 5+50%额度的Claude Opus 5,而且效果确实不错。
因为Fable 5我的额度用完了,于是我用了一个邪修的方式,直接让ChatGPT网页版的GPT-5.6 Sol Pro来干了,这个其实是一个小技巧,就是在Review深度、思考深度上,都比Codex本地的Max或者Ultra更好用,而且,还不烧你的Codex额度。

这个东西搞完以后,我其实把方案扔给了Codex上的GPT-5.6 Sol、Kimi K3、Opus 4.8,让三者来深度Review,看看这个方案对不对,是不是能解决本质问题,还有没有可以优化的空间。
这三者给的答复几乎就是没啥问题,只能硬挑一点小问题。
然后我就直接给GPT-5.6 Sol Ultra设了个目标,让他自己去干了,大概3个小时,不知道开了多少个Agent,干完了。

又用K3、GPT-5.6 Sol自己开了对抗式审查,看看有没有BUG和漏洞啥的,基本也就一些小的无关痛痒的,我以为就没啥问题了。
结果刚刚用Claude Opus 5跑了一下,给我吓得一身冷汗,验证了一下,确实对的,赶紧改。。。
而且这个问题还挺严重的。。。

除了体验之外,又发现了漏洞。

第一个漏洞给我吓尿了,我现在看到什么击穿边缘缓存几个字我就PTSD,两周前被各种攻击爬流量给我账单干崩就是这么干出来的。。。
立马就直接开修去了。
确实能感觉到,更聪明一点,有一点Fable 5那个味了,虽然Fable 5经常看完我之前做的东西,就会跟我说,你之前做的是一坨屎,有更好的办法,我觉得你可以重构。。。
而且在配合Claude Design以后,我觉得UI设计的细节也变得更好了一些,比如为了配合新的API啥的上线,我就把Agent接入界面也给重做了一些,之前GPT-5.6 Sol真的设计的就是一坨屎,给我干完长这样,我人都麻了,我想骂人。

Opus 4.8设计了一版,也不是特别好看,晚上拿Claude Opus 5重设计了一下,正常多了。

写作这块大家也不用看了,继续拉完了。
依然还是Claude Opus 4.6最好。
然后这一次,因为Opus 5在编程任务上的强大,在整个Claude Code的使用上,带来了一个很大的变化。
官方也直接写了一个教程。

这个我觉得反而是更加重要的。
因为随着模型的能力的进化,我们其实会发现,很多的约束、很多的Skill,已经变得毫无用处了。
比如说我几个月前给大家安利的一个开发的插件,叫Superpowers,坦率的讲,在几个月后的今天,模型进步到今天这个智力程度,那玩意已经几乎没啥用了,还有很多很多很多的Skills。
我现在的本地里,Skills只有6个了,几乎全部是我自己做的。
模型越进步,所需要的外面的限制就要越少。
所以这一次,Anthropic为了Opus 5和Fable 5,直接把这个版本的Claude Code的System Prompt删掉了80%以上,然后发现,编码评测没有出现可测量的下降。
文章第一张核心图,画的是一个Claude真正看到的完整上下文。
System Prompt里写着根据情况留下文档,Skill里写着禁止添加注释,用户又说做得跟旧版本一样。

这活就没法干了。
模型当然可以理解,可它必须花思考Token去调和冲突,猜哪条优先,猜所谓旧版本到底包括哪些东西。
上下文越长,类似的小冲突越多。
所以呢,Anthropic把Claude 5时代的变化总结成六组心法:
过去给规则,现在给判断空间。
过去给大量示例,现在设计好接口。
过去把全部内容塞在最前面,现在按需展开。
过去在不同地方重复提醒,现在把工具说明写得简单清楚。
过去把记忆塞进CLAUDE.md,现在交给自动记忆。
过去只写一份简单规格,现在直接提供代码、测试、HTML原型和完整参考物。
其实你会发现,就是从手册制,你给模型规划好任务的方案,变成了设计Harness,设计一个让模型自己完成目标的工作环境。
真正强的Harness,会把状态、权限、约束和反馈做进环境里,把目标和判断留给模型。
X上的大佬其实也提到了。

我因为一直几乎是裸的,除了几个自己的Skills,几个MCP,几个官方的插件,一些规范化的文档,其实就没啥了,所以我一上手的体验反而非常好。
这里其实官方也感受到了这个问题,所以他们非常推荐大家在Claude Code里,先运行一下/doctor这个命令,来帮大家清除一些垃圾。
是时候,简化你的Agent和工作流了,模型,会吞噬一切。
最后,在今天这个时间点,也简单的再给大家分享一下我的工作流和使用的模型吧。
大体量重构方案规划和底层研究:Claude Fable 5。
常规方案设计+Review:Claude Opus 5。
代码执行+BUG修复:Claude Opus 5或GPT-5.6 Sol(看人在电脑前还是不在电脑前,在电脑前我选Claude,人在外面我选GPT)
大型代码Review:ChaGPT网页版上的GPT-5.6 Sol Pro。
UI设计:Claude Design+Claude Opus 5。
部分项目的展示站:Kimi K3(直出前端太好看了)。
大概就是这样。
感觉这个列表,未来会轮动的越来越快,模型进化的速度,好像迈过了某种奇点。
就像Grok在收购了Cursor之后,模型能力瞬间起飞,迭代速度也变得极其恐怖,接下来,真的就是两周一更新了。

几乎每天一睁眼,我们就有新模型用,我们的能力边界,又再进一步扩宽。
真的,好像没有比这更幸福的事了。
如涉及版权问题请联系 hezuo@huxiu.com,我们将及时核实并处理。