AI Coding
Pilotfish-Codex v1.6.0:Codex CLI 的 Luna/Sol 多模型調度,主打省 token 而不手切模型
整理 miyago1124 Threads 發布 Pilotfish-Codex v1.6.0,查核 miyago9267/pilotfish-codex GitHub、MIT license、v1.6.0 release 與 benchmark matrix;重點是 Codex CLI 多模型調度、Luna/Sol 角色分配、降低 token 使用與品質 caveat。
2026年8月6日3 分鐘閱讀👁 5
Threads / Codex CLI / Multi-model orchestration
Pilotfish-Codex v1.6.0:Codex CLI 的 Luna/Sol 多模型調度,主打省 token 而不手切模型
Pilotfish-Codex 是把 Claude Code 社群的 pilotfish 多模型分工模式移植到 Codex CLI:不是讓最貴模型全程做事,而是用角色與意圖路由,把機械執行交給較便宜/快速模型,把安全風險、分歧、計畫與覆盤留給高階模型。
來源查核:Threads 原文來自 @miyago1124。官方 repo 為 miyago9267/pilotfish-codex;上游靈感為 Nanako0129/pilotfish。GitHub API 顯示 Pilotfish-Codex license 為 MIT,v1.6.0 release 發布於 2026-08-06。
v1.6.0 的核心變更
- 重新分配角色:Luna 承擔大部分執行與驗證;Sol 留給計畫、驗證、覆盤與風險判斷;Terra 在作者目前評估中價值不足。
- 策略一:主腦 Luna 時,遇到安全風險或意見分歧才請 Sol 介入。
- 策略二:主腦 Sol 時,機械工作也可利用 Luna,避免所有 token 都燒在 Sol。
- v1.5.0 加入 adaptive intent routing;v1.6.0 進一步自動辨識當回合使用者意圖:快一點、走預設、或嚴格驗證。
作者為什麼不用 Codex auto-review?
| 方案 | 問題 / 取捨 | Pilotfish-Codex 的答案 |
|---|---|---|
| Codex auto-review | 作者回報做一點驗證就大量消耗 5x usage,不符合省成本初衷。 | 只在特定風險/分歧/驗證點使用高階模型。 |
| 手動切模型 | 使用者要一直判斷何時用 Luna / Sol,認知負擔高。 | 由 role / intent routing 自動處理。 |
| 純 Sol | 品質可能穩,但成本高,很多機械工作不需要 Sol。 | Sol-primary 情境下把一般工作導回 Luna。 |
Benchmark matrix 查核
repo 中 PILOTFISH-VALUE-MATRIX.md 支援 Threads 中的主要 claim,但作者也明確保留 caveat。
| 比較 | 結果 | 可支持的結論 |
|---|---|---|
| 12-case projection:Sol-only vs Pilotfish selective | 品質平均同為 60.42;weighted tokens 從 241,132 降到 221,026。 | 在該 cohort 中,Sol-primary routing 維持觀察品質並少用約 8.34% token。 |
| 6-case live slice | Sol-only 與 Pilotfish routing 品質同為 83.33;token 節省 16.80%。 | 支援「不手切模型也可節省 token」的方向。 |
| Luna-first + Sol adjudicator |