このページは英語版ドキュメントの翻訳です。コマンド、識別子、例はそのままです。ランタイム 7.24.4 · SDK 2.6.7。 英語版
マルチモデル経路のベストプラクティス
状態: 有効
範囲: 公開、現行状態
最終確認: 2026-09-13
担当: ax-code runtime
このガイドは、プレミアムな推論モデルと、同じプロバイダーのより安い補助モデルで ax-code を動かす推奨の方法をまとめます。
中核の原則
高価なモデルは推論が密な作業に使い、安いモデルは機械的または読み取り専用の作業に使ってください。本当の節約は コンテキストの選別 から来ます。プレミアムモデルが見るのは、より安いモデルまたはサブエージェントが整えた蒸留済みコンテキストだけです。
推奨する層の分割
| 層 | モデルの区分 | 典型的なエージェント / タスク |
|---|---|---|
| ワーカー / 実行役 | 接続できるとき flash SKU(例: DeepSeek Flash) | ピンされていないセッション、build、general、scout、test、devops、perf |
| 助言 / 推論 | より強い接続モデル(例: DeepSeek V4 Pro) | plan、architect、security、debug |
| 安い / 読み取り専用の補助 | 同じ flash SKU | explore、compaction、タイトル、要約、低複雑度の分類 |
接続されている provider/model の ID をピンしてください。無効化されたファーストパーティのプラン ID(alibaba-token-plan、deepseek、zai-coding-plan、minimax-coding-plan)は SKU ではなお解決しますが、各呼び出しはまず無効なプロバイダーを試し、警告します。Qwen 3.8 Max は明示的な選択として有効であり、製品や例の既定ではありません。config.model がないとき、暗黙の既定は接続済みカタログを次の順で歩きます。deepseek-flash、glm-5.3-flash、qwen3.8-flash、MiniMax-M3、grok-4.6、claude-sonnet-5、gpt-6、gemini-3.8-flash、qwen3.8-27b。
設定テンプレート
リポジトリルートの ax-code.json.example を見てください。推論エージェントには Pro、既定は DeepSeek Flash という具体例です。
Codex CLI の補助モデル
Codex のモデル可用は、アカウントのサインイン方法とクライアントに依存し、カタログのテキストやツール能力だけでは決まりません。そのため AX Code は、名前やファミリーのメタデータから codex-cli の小さいモデルを推論しません。明示的な small_model またはコンパクション用エージェントモデルがないとき、コンパクションはセッションモデルを使います。
補助モデルを構成するなら、同じ Codex ログインで動くことを確認してください。ChatGPT アカウントではモデルが非対応だという明示的な Codex の拒否があると、コンパクションは他の小さいモデルを飛ばし、セッションモデルを 1 回試せます。拒否された試行はセッション履歴に残ります。その他の認証、課金、検証、取り消し、コンテキストあふれの失敗は、既存の扱いを保ちます。ローカルプロバイダーのプライバシー防護もなお適用されます。
影響を受ける古いインストールでは、非互換な small_model または agent.compaction.model の上書きを取り除き、その Codex アカウントで既に確認済みのモデルへ agent.compaction.model を明示的にピンしてください。見えるセッションモデルだけを変えても、別にピンされたコンパクションモデルは上書きされません。
タスク種別の自動経路規則
失敗コストで分けてください。低価値なタスクをすべて安いモデルへ自動経路 しない でください。
- 自動経路して安全(読み取り専用、または人がレビューできる):
- リポジトリ探索、grep や検索の振り分け、ファイル分類
- コード要約、ログ要約、コード説明
- プレミアムモデル向けのコンテキスト準備
- 文書
- オプトインのみ(機械的に検証できるが、振る舞いの変化を隠し得る):
- ボイラープレート、lint 修正
- 既定では自動経路しない(黙った誤りは高価):
- 単体テスト
- 名前変更やリファクタ
- 単純な SQL
- API ラッパー
- 単純な CRUD
最後の群は、利用者がより安いモデルを明示的にピンしない限り、セッションモデルに留めてください。
運用手順
- 自明でないタスクは
planモードで始めてください。ワーカーがコードを書く前に、助言役が設計を検証します。 - ワーカーがループする、または検証に 2 回失敗したら、失敗の信号とともに
debugへ切り替えてください。 - 2 つの修正がもっともらしいときの独立した診断には
councilを使ってください。タスクを終えるためではありません。 - 手動のモデル切替は、まれな推論の重いターンのために取っておき、その後は戻してください。
AX Code の既知の制限
Provider.getSmallModel()はundefinedを返します。対象は、階層を持つfamilyにタグを付けず、ハードコードされた優先リストにも一致しないカタログのプロバイダーです。補助呼び出しはそのときセッションモデルへ戻ります(ログは “no small model for provider”)。- 行き詰まったワーカーから、より強いモデルへの実行途中の昇格はありません。