全球程式設計師都在給Anthropic白送錢!官方終於看不下去了
2026年8月17日2 分鐘閱讀👁 1
Anthropic 近日發布官方指南,旨在協助 Claude Code 開發者降低 Token 消耗成本。該指南揭露了輸出 Token 價格遠高於輸入的計價邏輯,並強調「提示快取」是省錢關鍵,只要命中快取可降低 90% 讀取費用。官方建議開發者透過 /clear 頻繁清理對話、固定模型參數、使用 @ 引用文件及子 Agent 隔離大輸出等六大策略來「瘦身」上下文。
六大省錢心法
- 任務做完就 /clear: 修完一個 bug 就清掉當前對話,別讓上一個任務讀過的檔案和命令輸出拖進下一個任務裡。
- 開局就定好模型和推理強度: 中途切換的話,之前積累的提示快取會全部失效,要按全價重新計算。
- 用 @ 引用檔案,別手打路徑: 用 @ 直接把檔案附到消息裡,Claude 不用再花一次工具呼叫去讀。
- 給輸出多的命令加 quiet flag: 在 CLAUDE.md 裡配置 --reporter=dot,讓測試輸出只列印摘要而非幾百行詳情。
- /compact 在休息前做: 對話還在快取裡時壓縮,成本只有正常的十分之一。
- 大輸出任務扔給子 Agent: 子 Agent 在獨立上下文窗口裡運行,做完只傳結論回來,過程不進入主對話。
Token 計價邏輯
Prefill(預填充)是平行的,一次性把輸入 token 過一遍 GPU;Decode(解碼)是序列的,每吐一個 token 都要跑一次模型。因此輸出 token 比輸入 token 貴 5 倍。
- Opus 5:輸入 5 美元/百萬 token,輸出 25 美元
- Sonnet 5:輸入 2 美元,輸出 10 美元
- Haiku 4.5:輸入 1 美元,輸出 5 美元
提示快取是最大利器
快取讀取只要正常輸入價的 0.1 倍(省 90%)。寫入快取最高 2 倍,但只發生一次,後面每一輪都享受 0.1 倍讀取。
六種讓快取失效的情況:
- /model 切換模型
- /effort 切換推理強度
- 開關 Fast mode
- /compact 壓縮對話
- 快取過期(訂閱用戶 1 小時,API 用戶 5 分鐘)
- 恢復舊會話
對話正在偷偷變胖
每次 Claude 讀一個檔案,內容追加到對話;每次跑命令,輸出也追加。這個增長接近 O(n²)——第 40 輪在重新傳送第 1 到 39 輪的全部累積內容。
命令輸出超過 30000 字元才會被寫到臨時檔案,否則全部進入對話歷史跟著重傳。