← ClaudeAtlas

token-optimizerlisted

多代理編排的 token/配額節流規則。任何要呼叫 Agent tool 或 Workflow 派工之前——不論使用者有沒有提到省 token、單一 subagent 也算——先讀本 skill 再動手。使用者說「省 token」「配額」「別燒爆額度」時也觸發。觸發詞:workflow、多代理、fan-out��subagent、派工、編排、省 token、配額、token optimizer。 English triggers: "save tokens", "quota", "don't burn my limit", "token optimizer".
SanHsien/agent-astromech · ★ 0 · AI & Automation · score 65
Install: claude install-skill SanHsien/agent-astromech
# Token Optimizer — 多代理編排節流規則 > 改寫自 [kieiken/ultracode-token-optimization](https://github.com/kieiken/ultracode-token-optimization)(MIT),2026-07 適配全 Claude 環境並泛化。 > 核心洞察:**省 token 的重點不是壓單價,是消滅「返工循環」與「context 灌爆」**—— > 改→審→再改→再審的迴圈、以及把原始 diff/log 灌回主編排者,才是真正的大宗浪費。 ## 0. 為什麼 - 訂閱制(如 Claude Max)用戶:省 token ≠ 省錢,是**省用量配額**。配額燒完=所有 session 一起停擺,比錢痛。 - **旗艦檔模型配額燒得比中檔快得多**。這讓「模型分層」從 nice-to-have 變成鐵則。 - 本 skill 管兩個場景:① Workflow script(`agent()`/`parallel()`/`pipeline()`)② 一般 session 用 Agent tool 開 subagent。兩者同一套原則。 ## 1. 模型分層表(鐵則) | 角色 | 指定 | 理由 | |---|---|---| | 主編排者(session 本體) | 跟著 session 走,不動 | 只做判斷與仲裁 | | 執行者(寫 code/改檔) | 中檔(如 `sonnet`) | 品質夠、配額友善 | | 審查者(找碴/review) | 中檔,預設 | 高風險領域才升旗艦(見下) | | 機械工作(摘要/格式化/grep 彙整) | 低檔(如 `haiku`)或中檔+`effort: 'low'` | 不需判斷力的活別用貴模型 | | 仲裁/最終判斷 | 不指定(繼承 session) | **唯一例外,必須加註解說明為什麼** | **審查者升旗艦的門檻**(符合任一才升):認證/金流/資料遺失風險/資安/併發/持久化/公開 API/大型重構。 **🔴 絕對規則:session 模型是旗艦檔時,每一個 `agent()` 呼叫都必須明確指定 `model`**(仲裁 lane 除外,且要註解)。漏指定=整包 fan-out 全繼承貴檔,配額瞬間蒸發。這是本 skill 存在的第一理由。 > 判準是「**session 跑的比中檔貴就適用**」,不是特定型號名——新模型上市不用改這條。 **⚙️ 進階兜底(Claude Code CLI 專屬——其他工具沒有 `settings.json`/這個環境變數,直接跳過本段)**:在 `settings.json` 設 `env.CLAUDE_CODE_SUBAGENT_MODEL=sonnet` 可以把所有 subagent 硬鎖在中檔(實測是硬上限——呼叫時指定別的檔也會被蓋掉),漏指定不再燒旗艦。要臨時全力跑:在**該專案**寫 `.claude/settings.local.json` 的 env 蓋掉它(只影響該專案、即時生效),任務完刪掉回落。優先序:專案 local > user 全局 > process env > 呼叫參數。 ## 2. 執行結果壓縮再上報(鐵則) - 子代理的回報格式在 prompt 裡就寫死:**「只回:完成/未完成+變更檔案清單+測試結果,三行摘要」**。 - 原始 diff、完整 log、大 JSON **絕不**灌回主編排者的 context——需