取得 AX Code · 免費文件

本頁譯自英文文件。指令、識別名稱與範例保持原樣。執行環境 7.24.4 · SDK 2.6.7。 英文原文

多模型路由的最佳做法

狀態:有效 範圍:公開、現行狀態 上次審閱:2026-09-13 負責人:ax-code runtime

本指南記錄以高階推理模型,加上同一供應商較便宜的輔助模型來執行 ax-code 的建議方式。

核心原則

昂貴的模型用於推理密集的工作,便宜的模型用於機械性或唯讀工作。真正的節省來自上下文過濾:高階模型只看到由較便宜的模型或子 agent 準備好的精煉上下文。

層 模型類別 典型 agents 與任務
工作者/執行者 可用時使用已連接的 flash SKU(例如 DeepSeek Flash) 未釘選的工作階段、build、general、scout、test、devops、perf
顧問/推理 較強的已連接模型(例如 DeepSeek V4 Pro) plan、architect、security、debug
便宜/唯讀輔助 同一個 flash SKU explore、compaction、標題、回顧、低複雜度分類

釘選已連接的 provider/model ID。已停用的第一方計畫 ID (alibaba-token-plan、deepseek、zai-coding-plan、minimax-coding-plan) 仍會依 SKU 解析,但每次呼叫會先嘗試已停用的供應商並 警告。Qwen 3.8 Max 是有效的明確選擇,不是產品或範例 預設;沒有 config.model 時,隱含預設會依這個順序走訪已連接的目錄: deepseek-flash、glm-5.3-flash、qwen3.8-flash、MiniMax-M3、grok-4.6、 claude-sonnet-5、gpt-6、gemini-3.8-flash、qwen3.8-27b。

設定範本

見儲存庫根目錄的 ax-code.json.example,那是具體範例:DeepSeek Flash 為預設,推理 agents 使用 Pro。

Codex CLI 輔助模型

Codex 模型是否可用,取決於帳戶的登入方式與用戶端,不只 取決於目錄的文字或工具能力。因此 AX Code 不會從名稱或家族中繼資料推斷 codex-cli 小型模型。若沒有明確的 small_model 或壓縮 agent 模型,壓縮會使用工作階段模型。

若你設定輔助模型,請用同一個 Codex 登入驗證它能運作。 當 Codex 明確拒絕某模型不支援 ChatGPT 帳戶時, 壓縮可以嘗試工作階段模型一次,並略過其他小型模型。 被拒絕的嘗試仍留在工作階段歷史。其他的身分驗證、 計費、校驗、取消與上下文溢位失敗,保留 既有處理;本機供應商的隱私防護仍然適用。

對於受影響的較舊安裝,移除不相容的 small_model 或 agent.compaction.model 覆寫,並明確把 agent.compaction.model 釘到已用該 Codex 帳戶驗證過的模型。只改可見的 工作階段模型,不會覆寫另行釘選的壓縮模型。

依任務類型的自動路由規則

不要把所有低價值任務都自動路由到便宜模型。依失敗成本拆開:

  • 可以自動路由(唯讀,或人可以審閱):
    • 儲存庫探索、grep 與搜尋分類、檔案分類
    • 程式摘要、日誌摘要、程式說明
    • 為高階模型準備上下文
    • 文件
  • 僅選擇加入(可以機械驗證,但可能藏住行為變化):
    • 樣板程式、lint 修復
  • 預設永不自動路由(沉默的錯誤很貴):
    • 單元測試
    • 重新命名與重構
    • 簡單 SQL
    • API 包裝
    • 簡單 CRUD

最後這一組應留在工作階段模型,除非使用者明確釘選較便宜的模型。

操作手冊

  1. 非平凡任務以 plan 模式開始,讓顧問在工作者寫程式前驗證設計。
  2. 若工作者陷入迴圈,或驗證失敗兩次,帶著失敗訊號切換到 debug。
  3. 當兩個修復都說得通時,使用 council 做獨立診斷,而不是用來完成任務。
  4. 手動切換模型留給少數推理很重的回合;之後切回來。

已知的 ax-code 限制

  • Provider.getSmallModel() 回傳 undefined,對象是目錄既未標記帶層級的 family、也不符合硬編碼優先清單的供應商;輔助呼叫接著退回工作階段模型(記錄為「no small model for provider」)。
  • 沒有從卡住的工作者在執行中途升級到更強模型的機制。