首页财产ai正文 别再无脑开高推理!Opus 5高配会私自重构代码乱加戏 有人用FrontierCode基准测试Opus 5推理档位,发明medium是机能颠峰。Anthropic提醒按需调解,切换档位会清空缓存,建议锁订单一档位。 2026-07-29 16:19 ·微信公家号:量子位 闻乐 闻乐 AI投资人解读· 用FrontierCode基准测试Opus 5发明,medium档位机能最好,高等位会使模子重复校验、偏离需求,还有会私自重构代码。Anthropic虽于提醒词指南中建议调低推理强度,但Opus 5默许值设为high。 · 调解推理强度简朴,但切换档位会清空缓存,增长成本。 总结:Opus 5于推理强度选择上有非凡性,利用时需留意合理设置档位并防止频仍切换,以均衡机能与成本,不然可能因缓存问题增长开消。

别无脑把Opus 5推理强度拉到max当冤年夜头。

有人拿FrontierCode编程基准把Opus 5推理档位从低到高扫了一遍。

成果扫出一条很不合错误劲的曲线,机能天花板底子不是拉满的顶配档位,medium才是机能颠峰。

按我们对于年夜模子的直觉,推理档位这个油门踩患上越深应该跑患上越快,可Opus 5踩到底反而熄了火…

咋回事?

0一、一言分歧就重构代码

这个档位油门实在是推理强度拨盘,及模子智商倒没多年夜瓜葛,从low、medium、high一直到xhigh、max素质上是推理预算的闸门。

档位越高就申明你给模子思索的余量越年夜,它动手前就想患上久、想患上深。

听上去像是功德,多想一想总不会错吧?

但问题偏偏出于多想这个历程里。

当一个使命自己用不了那末多思索量的时辰,那笔多出来的预算必然要给本身找点活儿。

抵牾也由此孕育发生,信息提取、分类、文档撰写这种界限清楚的简朴使命,low及high输出质量险些无不同。

但用户假如选了高等位,那过剩的推理预算只会让模子重复校验、反复梳理已经有结论。

而且太长推理链还有会偏离原始需求。

更离谱的是代码场景,假如是只需要修复几行函数bug的时辰,低档位就只会针对于性输出补钉;

然而拉高强度以后,模子充裕的算力会差遣它私自重构无关函数、调解导入、重定名变量,甚至去优化无关代码。

一份小问题直接扩成为了完备PR…你多给的预算反而成为了承担。

并且这个痛点于Opus 5身上还有极其较着,一言分歧就给本身“加戏”。

Anthropic于本身的提醒词指南里险些是明着劝你把推理闸门往下拧:

只要评测能证实质量不失,就年夜面积用low及medium去压成本及延迟,高等位留给真正硬核的长周期使命。

但Opus 5发布那天,A社却把Opus 5的推理默许值设于了high……

0二、一句话解决

固然了,把effort从high调回medium也简朴。

走API的改一下output_config.effort,用Claude Code的于配置里可以把默许档换失。

改完马上能觉得到模子再也不满地撒欢,输出token年夜幅缩水,而那些布局化使命的质量非但没失,往往还有更好了。

要是想统筹效果与成本,最惬意的做法是按使命分层。

格局化、信息提取这种不消过剩思索的机械活丢给low;

一样平常编码、代码审查用medium或者high,均衡不变与开消;

只有那种需要永劫间自立推理、连着跑几十步的长周期Agent使命,才值患上把xhigh甚至max请出来。

但这里有个极易被纰漏的缓存成本陷阱。

effort档位是缓存匹配标识,会话中切换档位会直接清空全数上下文缓存,强迫模子重读整段对于话汗青。

哪怕从high切到low以后单轮单价看似降落,但缓存掉效会带来反复上下文加载,总体总成本反而可能上浮。

以是较好的一种计谋是设置装备摆设完备的事情流,然后给这个事情流锁订单一档位,全程不半途调解,让其连续掷中缓存来压缩总体开消。

Opus 5智慧是智慧,但万万别让它使劲过猛了。

【本文由投资界互助伙伴微信公家号:量子位授权发布,本平台仅提供信息存储办事。】【免责声明】:本文不组成任何投资建议。市场有危害,投资需审慎。若有任何疑难,请接洽(editor@zero2ipo.com.cn)投资界处置惩罚。

-lehu乐虎88国际