做一个「健身记录 App」的需求,Opus 5.5 用 low 档跑 1 分半出活,用 max 档跑 67 分钟才做出带热力图的版本 — 44 倍差距。Anthropic 把这个差别做成了官方提示词指南。本周我们想说的是:AI 公司不再只卖模型,开始卖「怎么省着用」的方法论。

这是什么

Anthropic 这周发布 Claude Opus 5.5 和 Sonnet 5.5,同时出了一份官方提示词指南。三件事值得拎出来:

第一,删掉「think carefully」「一步一步想」这类指令。官方说法是 Opus 5.5 每次回复前自己会决定想多少,加了反而让回复变慢、质量却没提升。第二,新增的 effort 参数(也就是「想多深」的档位)从 low 到 max 共五档,默认 medium,但官方测试显示 medium 在编码和知识工作上已追平甚至超过老版 Opus 5 的 high 档。第三,把目标写清楚 — 包括「做到什么程度算完成」和「什么时候停下来问你」。

说白了,Anthropic 在用官方教程告诉你:怎么省着用它。

行业怎么看

看好的认为,这是大模型公司第一次把「成本-质量」权衡公开摆上桌。开发者 Addy Osmani 的实测印证了这一点:同一任务,high 档比 medium 档多烧约 20K token(约 0.4 美元,相当于 10 轮重试成本),但修 bug 这类需要验证边界的活,high 档明显更稳。

反对意见也有。开发者社区指出,medium 档修代码只改函数本身、不动调用方;官方也承认「思路一开始错了,调多高都救不回来」。更尖锐的看法是:Anthropic 不降价,转而教你降档使用 — 这本质上是把模型太「卖力」的代价转嫁给用户。

对普通人的影响

  • 对企业 IT:以前采购 Claude 按 token 计费,现在 prompt 工程里要多管一道 effort 参数,运维复杂度上升。
  • 对个人职场:用 Claude 写代码或做研究的朋友,值得花半小时重读自己 CLAUDE.md(Claude Code 的个人配置文件)和 Skill(预设技能包),可能直接砍掉一半支出。
  • 对消费市场:AI 厂商接下来很可能按「思考量」分档定价,基础功能更便宜,深度推理依然贵。