Claude Opus 5 上線後,prompt 與 agent harness 要反向校準:少叫它自查、限制委派、用 effort 控成本
Threads @drpwchen 以 Claude Opus 5 官方指南做了一次 Claude Code 基礎設施校準。官方文件確認 Opus 5 具備 1M context、128k max output、thinking 預設開啟、low/medium effort 成本效率提升、code review precision/recall 強,以及更常自我驗證與主動派 subagent。本文整理成 Allen/Hermes 可用的 agent harness 調整清單:少寫 double-check、不要用「只報 high severity」、限制委派、明確壓輸出長度,並補充 claude-pacer 作為 Claude Code usage pacing 的周邊工具。
Threads 重點:把官方指南丟給 Claude,讓它反查自己的基礎設施
@drpwchen 的流程很直接:新模型上線後,把官方使用說明交給 Claude,要求它檢查目前的 CLAUDE.md、Skill、Memory、dispatch protocol 等基礎設施,回答三件事:
- 模型呼叫時機是否要改。
- Opus 5 有哪些使用者必須知道的行為差異。
- 既有記憶、技能與 dispatch 協定是否需要更新。
這個方法比「憑直覺換成新模型」更穩,因為模型供應商官方文件通常包含新版本的反直覺行為;沒有記下來,下一個 session 很容易用舊 prompting 常識做錯。
官方查證:Opus 5 的可確認變化
| 項目 | 官方文件確認 | 對 agent harness 的意義 |
|---|---|---|
| Model ID | claude-opus-5 | 從 Opus 4.8 遷移時要更新 model ID;若工具有 alias,需確認 alias 實際指向。 |
| Context / output | 1M token context 是 default 也是 maximum;max output 128k。 | 長上下文更穩,但不是叫它無限制寫長文;輸出長度仍要明確控制。 |