AI Agent
Claude Managed Agents 新功能:Dreaming、Outcomes、Multiagent Orchestration 的產品化意義
Anthropic 2026 年 5 月推出 Claude Managed Agents 的 dreaming、outcomes、multiagent orchestration;Akira 文章另整理 /ultrareview。官方重點是讓 agent 具備三種產品化能力:跨 session 學習、用 rubric 自評並重試、複雜任務多 agent 並行。這代表 agent 正從 prompt tool 走向可治理、可評分、可追蹤的工作系統。
2026年5月20日1 分鐘閱讀👁 4
Anthropic · Managed Agents · Agent Reliability
Claude Managed Agents:Agent 產品化的三個缺口正在被補上
Akira 文章整理 Anthropic 近期 Agent 功能:/ultrareview、Dreaming、Outcomes、Multiagent Orchestration。核對 Claude 官方 blog 後,Managed Agents 的主線很清楚:讓 agent 能從過去任務中學習、能用 outcome rubric 判斷自己是否達標、能把大任務拆給多個 specialists 並行處理。
Dreaming
在閒置時回顧過去 session,萃取跨任務規律、filetype workaround、工具使用習慣,寫入可審核的記憶/流程。
Outcomes
用 rubric 定義成功標準;agent 完成後由獨立 grader 評分,不達標就重試。官方稱內部測試最多提升 10 points,docx +8.4%、pptx +10.1%。
Multiagent Orchestration
lead agent 將任務拆給不同 model、prompt、tools 的 specialists;共享檔案系統並保留事件 trace。
/ultrareview
Akira 文中整理為 Claude Code 的多 reviewer code review 指令,適合作為 merge 前最後一道 AI review;此點需以實際 Claude Code 版本與官方文件為準。
產品化意義:這些功能不是單純「模型更聰明」,而是把 agent 的失敗模式制度化處理:記憶漂移靠 Dreaming,品質不穩靠 Outcomes,任務太大靠 Multiagent,程式碼變更風險靠 review pipeline。
| 功能 | 解決的 Agent 痛點 | 適合 BigIntTech / Hermes 類工作流借鏡 |
|---|---|---|
| Dreaming | 每次新 session 都重教背景 | 把反覆踩坑自動萃取成 memory / skill,但需人工審核避免污染。 |
| Outcomes | 完成了但不知道夠不夠好 | 為 KB 上架、MR review、文件輸出、測試修復建立 rubric + retry。 |
| Multiagent | 單 agent context 過長、任務漏查 | 專案調查、incident review、research batch 可拆給平行 subagents。 |
| Webhook | 長任務需要人盯 | 任務完成、失敗、需決策時才回報,降低 Telegram 中斷成本。 |
導入時要守的治理線
- Dreaming 的記憶更新先 review-before-apply,避免錯誤偏好永久化。
- Outcomes rubric 要具體可驗證,不要寫成「品質要好」。
- Multiagent 子任務要明確定義工具權限、輸入輸出與合併責任。
- 所有 agent trace、rubric 分數與重試原因都應保留,方便事後稽核。