首页财产ai正文 Claude Opus 5深夜发布,以一半价格迫近Fable 5 本周六凌晨Claude Opus 5发布并全量上线,其于多范畴迫近Fable 5,价格上风较着,作者分享了差别使命合用模子和自身事情流。 2026-07-27 14:38 ·微信公家号:数字生命卡兹克 数字生命卡兹克 数字生命卡兹克 AI投资人解读· Claude Opus 5上线,100万上下文,常识最新截止到2026年5月。其于多范畴迫近Fable 5,如ARC-AGI-3跑分30.2%,远超GPT-5.6 Sol及Opus 4.8,AA跑分比Fable 5还有强,且价格只有其一半,还有有Fast Mode。于工程等使命中实现效果好。 · 模子厂商评测有误导性差别模子合用场景有差异。 总结:Claude Opus 5机能精彩、价格上风较着,于多使命中体现佳,但需留意模子评测局限性和合用场景,可联合自身需求选择。
左等右等,Claude Opus 5,就于这个周六的凌晨,正式发布了。

今朝,已经经全量上线,于所有Claude产物里,全线可用。

100万上下文,常识最新截止时间来到了2026年的5月,新的不患了。
原来于Codex上挂了几个/goal的方针使命,预备早睡了,成果这一激灵,直接停了,然后所有的使命取缔,挂到Claude里,全数用Opus 5重跑。
甚至今天做的许多的使命,Fable 5额度用光了,利用GPT-5.6 sol履行的,此刻,我也预备再用Opus 5重跑一遍了。
重要是,给你们看看这个Claude Opus 5的跑分,你们就知道这个模子,有多离谱了。
我们客不雅的说,Anthropic这家公司,从上到下每天被人骂,坏事做尽,每天当小丑,来往返回耍猴,可是吧,你不能不说,他们的模子确凿好,确凿是牛逼。。。
以是如今呈现了很诡异的民风,包括我本身也是,我真的很厌恶Anthropic,可是为了产物、为了事情、为了效率,身体又很老实,每一次紧巴巴的把Claude Fable 5额度用完的时辰,老是有一种戒断反映。
然后只能去发发怨言。

信赖我,用习气了Fable 5以后,再让你去用Claude Opus 4.8,你会感觉,这是甚么蠢工具。
这一个月的时间,我的人生似乎被按下了加快键,Claude Fable 5下线又上线,GPT-5.6 Sol的接棒及险些无穷的重置,Kimi K3的国产突起,再加之今天Claude Opus 5的上线。
我觉得我做的产物、我的代码,险些每一一周就要年夜幅的优化一遍,由于我是生手也是个菜逼,模子的前进,险些也代表着我的产物的前进。
而这一个月的时间,我做的AI资讯平台AIHOT的月活也翻了一倍,正式到达了60万的月活,这还有是一个很让我开心的工作,感激AI时代,感激年夜模子,痴顽、生手如我,也能摸索本身的产物,做出对于别人有益的工具。
这暗地里的事情,实在每个点,均可以拎出来分享万字长文了,任何工具你想把它做好,暗地里破费的心力真的不是一点两点。

以是许多人总说,新模子上线就你每天冲动,我每一次都想回,我能不冲动吗,由于这代表着我的产物、我的事情,又能更快速的前进、给各人带来更好的体验,也能做出更多我想做的功效了呀。
回到Claude Opus 5上。
Anthropic给Opus 5的定位很是清晰,它于许多范畴已经经迫近Fable 5了。
就像上面那张跑分图。

甚至于ARC-AGI-3上,是最夸张的,Opus 5是30.2%,GPT-5.6 Sol是7.8%,Opus 4.8只有1.5%,惋惜Fable 5没有这块的跑分,不知道能到都几多。

它相称在直接做到了第二名的靠近四倍。
这类抽象推理、动态顺应及生疏使命泛化,一直是模子最轻易露怯的。
由于已往的模子常常能复述世界,能模拟谜底,可是一旦法则没见过,马上最先犯蠢了,以是ARC-AGI-3,于此刻的时间点,挺能代表一个模子真实的智力及泛化水平的。
甚至于AA的跑分上,竟然比Fable 5还有要强。

可是价格只有Fable 5的一半。
输入每一百万Token 5美元,输出每一百万Token 25美元,价格跟Opus 4.8同样。
还有有一个Fast Mode,速率约莫晋升到2.5倍,价格翻倍。
我知道你此刻想说,我靠,Claude Opus 5比Claude Fable 5都要强了?那我还有用个屁的Claude Fable 5啊,又贵又垃圾。
可是,我想说,此刻模子厂商的手法吧,实在都是有误导性的,你只看到了他们放出来的这些评测集,基本都是代码、Agent、办公等等。
可是,真实的跑分,于Opus 5的体系卡里及已往Fable 5(也就是Mythos 5)的对于比里,我全收拾了出来,可以看看现实的环境。

以是,从这里就能够看出,Fable 5更像一颗更年夜的纯年夜脑,擅长无东西推理、原生视觉理解、专业医疗表达、高难编程,以和收集安全等极难专业使命。
而Opus 5 更像一个履行体系成熟的Agent,尤其会利用东西、查抄成果、发明过错、从头测验考试,终极使命完成率更高。
假如硬要我说,一个觉得是新预练习带来的版本之子,一个是当下RL的版本之子。
以是,于较难的工程使命、Agent使命、真实使命里,Claude Opus 5的实现效果可能会更好,可是从方案设计、计划的角度来讲,依然是Claude Fable 5效果最 好。
以是假如只问Opus 5有无把Fable 5完全裁减,谜底很简朴,暂时没有。
可假如问它是否是当前最合适年夜范围拿来干活的Claude,我小我私家已经经预备直接切了。
特别是那些已往感觉Fable最 好用,又其实舍不患上额度,末了只能咬牙退回Opus 4.8的使命,重要还有是每一周的Token额度Fable 5只能用50%,别的50%不消光,那是真的就华侈失了。
此次终究有一个惬意患上多的中间解了,50%额度的Claude Fable 5+50%额度的Claude Opus 5,并且效果确凿不错。
好比我今天重构了一下AIHOT的整个API、RSS还有有Skill,那玩意实在以前推出的太匆匆了,效果不是很好,以是呢,就是为了让各人哀求起来体验更好,同时也降低对于我办事器的哀求次数,让我压力更小点,就重弄了一下。
由于Fable 5我的额度用完了,在是我用了一个邪修的方式,直接让ChatGPT网页版的GPT-5.6 Sol Pro来干了,这个实在是一个小技巧,就是于Review深度、思索深度上,都比Codex当地的Max或者者Ultra更好用,并且,还有不烧你的Codex额度。
这个工具弄完之后,我实在把方案扔给了Codex上的GPT-5.6 Sol、Kimi K三、Opus 4.8,让三者来深度Review,看看这个方案对于不合错误,是否是能解决素质问题,还有有无可以优化的空间。
这三者给的回复险些就是没啥问题,只能硬挑一点小问题。
然后我就直接给GPT-5.6 Sol Ultra设了个方针,让他本身去干了,年夜概3个小时,不知道开了几多个Agent,干完了。
又用K三、GPT-5.6 Sol本身开了匹敌式审查,看看有无BUG及缝隙啥的,基本也就一些小的无关痛痒的,我以为就没啥问题了。
成果方才用Claude Opus 5跑了一下,给我吓患上一身盗汗,验证了一下,确凿对于的,赶快改。。。
并且这个问题还有挺严峻的。。。

除了了体验以外,又发明了缝隙。

第 一个缝隙给我吓尿了,我此刻看到甚么击穿边沿缓存几个字我就PTSD,两周前被各类进犯爬流量给我账单干崩就是这么干出来的。。。
立马就直接开修去了。
确凿能觉得到,更智慧一点,有一点Fable 5阿谁味了,虽然Fable 5常常看完我以前做的工具,就会跟我说,你以前做的是一坨屎,有更好的措施,我感觉你可以重构。。。
并且于共同Claude Design之后,我感觉UI设计的细节也变患上更好了一些,好比为了共同新的API啥的上线,我就把Agent接入界面也给重做了一些,以前GPT-5.6 Sol真的设计的就是一坨屎,给我干完长如许,我人都麻了,我想骂人。

Opus 4.8设计了一版,也不是尤其都雅,晚上拿Claude Opus 5重设计了一下,正常多了。

写作这块各人也不消看了,继承拉完了。
依然还有是Claude Opus 4.6最 好。
然后这一次,由于Opus 5于编程使命上的强盛,于整个Claude Code的利用上,带来了一个很年夜的变化。
官方也直接写了一个教程。

这个我感觉反而是越发主要的。
由于跟着模子的能力的进化,咱们实在会发明,许多的约束、许多的Skill,已经经变患上毫无用场了。
好比说我几个月前给各人安利的一个开发的插件,叫Superpowers,坦率的讲,于几个月后的今天,模子前进到今天这个智力水平,那玩意已经经险些没啥用了,还有有许多许多许多的Skills。
我此刻的当地里,Skills只有6个了,险些全数是我本身做的。
模子越前进,所需要的外面的限定就要越少。
以是这一次,Anthropic为了Opus 5及Fable 5,直接把这个版本的Claude Code的System Prompt删失了80%以上,然后发明,编码评测没有呈现可丈量的降落。
文章第 一张焦点图,画的是一个Claude真正看到的完备上下文。
System Prompt里写着按照环境留下文档,Skill里写着禁止添加解释,用户又说做患上跟旧版本同样。

这活就无法干了。
模子固然可以理解,可它必需花思索Token去和谐冲突,猜哪条优先,猜所谓旧版本到底包括哪些工具。
上下文越长,近似的小冲突越多。
以是呢,Anthropic把Claude 5时代的变化总结成六组心法:
已往给法则,此刻给判定空间。
已往给年夜量示例,此刻设计好接口。
已往把全数内容塞于最前面,此刻按需睁开。
已往于差别处所反复提示,此刻把东西申明写患上简朴清晰。
已往把影象塞进CLAUDE.md,此刻交给主动影象。
已往只写一份简朴规格,此刻直接提供代码、测试、HTML原型及完备参考物。
实在你会发明,就是从手册制,你给模子计划好使命的方案,酿成了设计Harness,设计一个让模子本身完成方针的事情情况。
真正强的Harness,会把状况、权限、约束及反馈做进情况里,把方针及判定留给模子。
X上的年夜佬实在也提到了。

我由于一直险些是裸的,除了了几个本身的Skills,几个MCP,几个官方的插件,一些规范化的文档,实在就没啥了,以是我一上手的体验反而很是好。
这里实在官方也感触感染到了这个问题,以是他们很是保举各人于Claude Code里,先运行一下/doctor这个号令,来帮各人断根一些垃圾。
是时辰,简化你的Agent及事情流了,模子,会吞噬一切。
末了,于今天这个时间点,也简朴的再给各人分享一下我的事情流及利用的模子吧。
大要量重构方案计划及底层研究:Claude Fable 5。
通例方案设计+Review:Claude Opus 5。
代码履行+BUG修复:Claude Opus 5或者GPT-5.6 Sol(看人于电脑前还有是不于电脑前,于电脑前我选Claude,人于外面我选GPT)
年夜型代码Review:ChaGPT网页版上的GPT-5.6 Sol Pro。
UI设计:Claude Design + Claude Opus 5。
部门项目的展示站:Kimi K3(直出前端太都雅了)。
年夜概就是如许。
觉得这个列表,将来会轮动的愈来愈快,模子进化的速率,似乎迈过了某种奇点。
就像Grok于收购了Cursor以后,模子能力刹时腾飞,迭代速率也变患上极为可骇,接下来,真的就是两周一更新了。

险些天天一睁眼,咱们就有新模子用,咱们的能力界限,又再进一步扩宽。
真的,似乎没有比这更幸福的事了。
【本文由投资界互助伙伴微信公家号:数字生命卡兹克授权发布,本平台仅提供信息存储办事。】【免责声明】:本文不组成任何投资建议。市场有危害,投资需审慎。若有任何疑难,请接洽(editor@zero2ipo.com.cn)投资界处置惩罚。
-lehu乐虎88国际