AX Code を入手 · 無料ドキュメント

このページは英語版ドキュメントの翻訳です。コマンド、識別子、例はそのままです。ランタイム 7.24.4 · SDK 2.6.7。 英語版

対応プロバイダーとモデル

ステータス: 現行 対象範囲: 現在の状態 最終確認: 2026-09-19 所有者: ax-code runtime

このページは、既定のセットアップ手順で AX Code が提示するプロバイダープリセットを一覧します。信頼できる情報源は、ランタイムのプロバイダー許可リスト packages/ax-code/src/provider/default-setup-providers.ts、同梱のモデルスナップショット packages/ax-code/src/provider/models-snapshot.json、ローカルランタイムのプリセット packages/ax-code/src/provider/local-runtime.ts、および AX Engine の定義 packages/ax-code/src/provider/ax-engine/constants.ts です。

ターミナル UI では /connect を、対話的なセットアップでは ax-code providers login <provider-id> を使います。ヘッドレス環境と CI でも、記載された環境変数を渡せます。

接続済みプロバイダーの管理

セッション画面には、セッション ID(クリックでコピー)、タイトル、ライブステータスを示す上部バーがあり、その後に接続数を示す プロバイダー 項目が続きます。そこをクリックするか 管理 を選ぶとプロバイダーマネージャーが開きます。同じ画面は /providers コマンドからも開けます。そこからモデルの選択、各プロバイダーの無効化または切断、あるいは完全な /connect フローへの移動ができます。

  • キーの置き換え: /connect でプロバイダーを選び キーを置き換え を選ぶか、ax-code providers login <provider-id> を再実行します。
  • 一時的に無効化: /providers または /connect で 無効化 を選ぶか、ax-code providers disable <provider-id> を実行します。これによりグローバル設定の disabled_providers へプロバイダーが追加され、保存済みの認証情報は残ります。無効化されたプロバイダーは /providers と、/connect の 無効 の下に表示されたままで、有効化 または ax-code providers enable <provider-id> で再びオンにできます。
  • 恒久的に切断: /providers または /connect で 切断 を選ぶか、ax-code providers logout <provider-id> を実行します。これにより auth.json から保存済みの認証情報が削除されます。

ホスト型のモデルカタログは各 AX Code リリースに同梱され、コーディングエージェントとして使える能力で絞り込まれます。インストール済みリリースの正式なモデル ID は ax-code models <provider-id> を実行して確認してください。生のレジストリやコピーされたウェブ上の一覧には、テキスト出力やツール呼び出しがないため AX Code が隠すモデルが含まれることがあります。プロバイダープリセットがあることは、すべてのモデルが無料であることや、すべてのアカウントで利用できることを意味しません。

ランタイムの選択

バージョンを指定せずにモデルを選ぶ

TUI と ax-code run はいずれも、大文字と小文字を区別しない次の --model ファミリー名を受け付けます。

ファミリー モデル
deepseek deepseek-flash
glm glm-5.3-flash
qwen qwen3.8-flash

たとえば ax-code --model glm は GLM Flash で TUI を開き、ax-code run --model qwen -- "Review this change" は Qwen Flash を要求します。プロンプトは -- の後に置きます(または --prompt / --prompt-file を渡します)。--file はファイルを添付するためのもので、プロンプトファイルではありません。ax-code models は使える provider/model の ID を一覧します。ファミリー名は、ネイティブのプロバイダー、または同じモデルを提供する接続済みゲートウェイを通じて解決されます。プロバイダー名を明示することもできます。例: --model my-gateway/glm。特定のバージョンや階層を要求するには、my-gateway/glm-5.3 のような完全な ID を使います。

--model を省略すると、設定済みの選択、エージェント、セッション、および最近のモデル選択が維持されます。使える選択がない場合、共有のフォールバック順は、接続済みプロバイダーを横断して DeepSeek Flash、GLM Flash、その次に Qwen Flash から始まります。プロバイダーのセットアップには独自の既定があります。Alibaba Coding Plan は qwen3-coder-plus を、Alibaba Token Plan は qwen3.8-flash を使います。

ランタイムへ接続する

/connect の選択肢は、API クラウドプロバイダー、CLI プロバイダー、AX-Engine ランタイム、ローカル LLM ランタイム、プライベート GPU クラウド、AX Trust の順です。AX-Engine ランタイムは、ローカルモデルの選択とランタイム管理を直接開きます。ローカル LLM ランタイムは、次の選択肢を順に並べます。

メニュー項目 プロバイダー ID 既定のエンドポイント ホスト環境変数
Ollama ollama http://localhost:11434/v1 OLLAMA_HOST
LMStudio lmstudio http://localhost:1234/v1 LMSTUDIO_HOST
MTPLX mtplx http://localhost:8000/v1 MTPLX_HOST
oMLX omlx http://localhost:8000/v1 OMLX_HOST
AX-Studio ax-studio http://localhost:18080/v1 AX_STUDIO_HOST
その他 local-llm OpenAI 互換のエンドポイントを入力 LOCAL_LLM_HOST

MTPLX と oMLX のプリセットはソースチェックアウトで利用できます。v7.19.3 のパッケージ済みバイナリには含まれません。ツール能力の設定、任意の認証、および共有の既定ポートに関する注意は MTPLX と oMLX のセットアップ を参照してください。

ローカルサーバーを起動し、そのメニュー項目を選び、エンドポイントを確認または編集します。省略されている場合、AX Code は /v1 を補います。その他は、設定可能なエンドポイントを 1 つ local-llm に保存します。再度選ぶとエンドポイントを変更できます。LMStudio とその他は、API トークンの入力を求めず、既存のローカルセットアップ手順を使います。LM Studio は モデル一覧エンドポイント を文書化しています。

セットアップの選択肢は enabled_providers と disabled_providers を尊重します。ピッカーを開いただけでは、これらのローカルサーバーは有効化も探査もされません。検出された外部のローカルモデルは、保守的な能力の既定を保ちます。コーディングエージェントのワークフローで選べるようにするには、モデルがツール呼び出しに対応している必要があります。

クラウド API プロバイダー

これらのプロバイダーは、ホスト型の API、またはホスト型アカウントプランのエンドポイントを呼び出します。

プロバイダー ID 表示名 認証情報の環境変数
google Google GOOGLE_API_KEY、GOOGLE_GENERATIVE_AI_API_KEY、GEMINI_API_KEY
deepseek DeepSeek DEEPSEEK_API_KEY
meta Meta (Muse Spark) MODEL_API_KEY、META_MODEL_API_KEY
groq GroqCloud GROQ_API_KEY
openrouter OpenRouter OPENROUTER_API_KEY
huggingface Hugging Face HF_TOKEN
unorouter UnoRouter UNOROUTER_API_KEY
alibaba-coding-plan Alibaba Coding Plan ALIBABA_CODING_PLAN_INTL_API_KEY、ALIBABA_CODING_PLAN_API_KEY
alibaba-coding-plan-cn Alibaba Coding Plan (China) ALIBABA_CODING_PLAN_CN_API_KEY、ALIBABA_CODING_PLAN_API_KEY
alibaba-token-plan Alibaba Token Plan ALIBABA_TOKEN_PLAN_INTL_API_KEY、ALIBABA_TOKEN_PLAN_API_KEY
alibaba-token-plan-cn Alibaba Token Plan (China) ALIBABA_TOKEN_PLAN_CN_API_KEY、ALIBABA_TOKEN_PLAN_API_KEY
github-copilot GitHub Copilot GITHUB_TOKEN
zai Z.AI ZHIPU_API_KEY
zai-coding-plan Z.AI Coding Plan ZHIPU_API_KEY
minimax-coding-plan MiniMax Token Plan MINIMAX_TOKEN_PLAN_API_KEY、MINIMAX_API_KEY
minimax-cn-coding-plan MiniMax Token Plan (China) MINIMAX_TOKEN_PLAN_CN_API_KEY、MINIMAX_API_KEY

MiniMax は Coding Plan を Token Plan に改称しました。プロバイダー ID は models.dev と OpenCode に合わせるため、minimax-coding-plan / minimax-cn-coding-plan のままです。Token Plan のキー(sk-cp-…)は、国際向けの platform.minimax.io、または中国向けの platform.minimaxi.com から取得します。

huggingface は ホスト型の Serverless Inference Providers ルーター(https://router.huggingface.co/v1)です。 AX Engine がダウンロード済みのローカルモデルを保存する、ローカルの Hugging Face スナップショットキャッシュとは無関係です。huggingface を接続しても、ローカルエンジンは起動せず、必須にもなりません。

費用をかけずに最初の実行をする場合は 無料枠 API クイックスタート を参照してください。プロバイダー側の無料提供と AX Code の互換性を区別し、外部の無料 API カタログそのものがサポート一覧ではない理由を説明しています。

Grok は、下記に挙げる grok-build-cli プロバイダーを通じてのみサポートされます。AX Code には、直接の xai クラウド API プロバイダーはもう含まれていません。既存の Grok API 認証情報では接続は作られません。

github-copilot は GitHub Copilot アカウントへのブリッジです。一部の無料 API ディレクトリが挙げる、別個の github-models API ではありません。

OpenAI 互換および Anthropic 互換のゲートウェイも、カスタムプロバイダー設定を通じてサポートされます。カスタムプロバイダーとゲートウェイ を参照してください。

プライベート GPU クラウド

これらのプロバイダーは、ローカル LLM ランタイムの後、プライベート GPU クラウド の下にある /connect に表示されます。

独自の OpenAI 互換 GPU エンドポイントへ接続するには カスタムプロバイダー を選びます。URL と API キーを入力すると、AX Code は /v1/models からモデルを検出し、キーを暗号化された認証ストレージへ保存します。保存された接続はプライベート GPU クラウドに残ります。再度選ぶと、モデルの選択、エンドポイントの置き換え、または切断ができます。この項目は、設定可能なエンドポイントを 1 つ custom-private-gpu に保存します。

カタログ(API キー)

OpenCode 形式のホスト型 GPU カタログです。モデルは同梱の models.dev スナップショットから来ます。API キーで接続します。

プロバイダー ID 表示名 認証情報の環境変数
nebius Nebius Token Factory NEBIUS_API_KEY
fireworks-ai Fireworks AI FIREWORKS_API_KEY
togetherai Together AI(ホステッド) TOGETHER_API_KEY
baseten Baseten BASETEN_API_KEY
nvidia NVIDIA NIM NVIDIA_API_KEY
deepinfra Deep Infra DEEPINFRA_API_KEY

ホスト型の Hugging Face ルーター(huggingface / HF_TOKEN)は、クラウド API プロバイダーに残ります。専用の Hugging Face Inference Endpoints は下記に一覧します。

専用エンドポイント(URL とトークン)

PAI 形式の専用 GPU エンドポイントです。OpenAI 互換の URL とトークンを貼り付けると、AX Code は GET …/models を呼び出し、デプロイ済みのモデル ID を使います。これらは Alibaba Coding Plan / Token Plan(DashScope)のプロバイダーではありません。

プロバイダー ID 表示名 認証情報の環境変数
alibaba-pai Alibaba PAI-EAS ALIBABA_PAI_API_KEY、ALIBABA_PAI_BASE_URL
runpod RunPod RUNPOD_API_KEY、RUNPOD_BASE_URL
huggingface-endpoints Hugging Face Endpoints HF_ENDPOINTS_TOKEN、HF_ENDPOINTS_BASE_URL
sagemaker Amazon SageMaker SAGEMAKER_API_KEY、SAGEMAKER_BASE_URL
volcengine-ark Volcengine Ark ARK_API_KEY、ARK_BASE_URL
modelarts Huawei ModelArts MODELARTS_API_KEY、MODELARTS_BASE_URL
tencent-ti Tencent TI TENCENT_TI_API_KEY、TENCENT_TI_BASE_URL
custom-private-gpu カスタムプロバイダー CUSTOM_PRIVATE_GPU_API_KEY、CUSTOM_PRIVATE_GPU_BASE_URL

sagemaker は、SageMaker の前段にある OpenAI 互換 URL(vLLM / TGI / API Gateway)向けです。AWS SigV4 には署名しません。

AX Trust の接続

AX Trust は、プライベート GPU クラウドの後、/connect の最後のカテゴリです。AX Trust を接続 を選び、/v1 を含むゲートウェイのベース URL を入力し、クライアント API キーを渡します。AX Code はゲートウェイのモデルを検出し、キーを暗号化された認証ストレージへ保存します。保存された接続では、モデル選択、エンドポイントの更新、モデルの再取得、削除ができます。

既存の URL へ再接続するとき、トークンを空のままにすると、そのプロバイダー ID、モデル、保存済みキーが保持されます。カスタム名であっても、プロバイダーは AX Trust に残ります。従来の ax-trust と ax-trust-* の ID もこのカテゴリに表示されます。AX Trust は引き続き、ゲートウェイのポリシー、承認、監査を所有します。AX Code は、これらの接続で既定によりセッションアフィニティのヘッダーを送ります。

CLI プロバイダー

CLI プロバイダーは、ホスト型 API キーを AX Code に保存する代わりに、ローカルのベンダー CLI とそのログインまたはセッションを再利用します。

プロバイダー ID 表示名 必要なローカルコマンド 対応モデル ID
claude-code Anthropic (Claude Code) claude claude-code
codex-cli OpenAI (Codex CLI) codex codex-cli
grok-build-cli Grok Build CLI grok grok-build-cli
muse-cli Muse Code CLI muse muse-cli

必要なら先にベンダー CLI へログインし、その後 ax-code providers login <provider-id> を実行します。AX Code は CLI コマンドを探査し、探査が成功したあと、ローカルのマーカー認証情報を保存します。

Muse Code では、ローカルの muse バイナリをインストールし、muse login を実行する(または META_API_KEY を設定する)してから ax-code providers login muse-cli を実行します。AX Code は、ホスト型の Meta API キーを保存せず、Muse CLI のセッション(~/.config/muse)を再利用します。ホスト型の meta API プロバイダーは、別の接続のままです。

ホスト型の MiniMax Token Plan は、minimax-coding-plan / minimax-cn-coding-plan として引き続き利用できます。同梱の MiniMax Code CLI や Kimi Code CLI プロバイダーはありません。

AX Engine のローカルプロバイダー

ax-engine は組み込みのローカル推論プロバイダーです。対象となる Apple Silicon の Mac でのみ利用でき、提供するのは AutomatosX Tiel Coder と Cyber-Tiel Coder 35B A3B MXFP4 MTP の開発パックだけです。ネイティブの能力は、モデルの起動時に確認されます。

プロバイダー ID モデル ID 選択内容 コンテキスト 出力
ax-engine tiel-coder-35b-axq-mxfp4 Tiel Coder 35B A3B MXFP4 MTP(既定) 65,536 8,192
ax-engine cyber-tiel-coder-35b-axq-mxfp4 Cyber-Tiel Coder 35B A3B MXFP4 MTP 65,536 8,192

Qwen3.8 27B、Ornith、Qwen3-Coder-Next、およびその他すべてのリポジトリは、管理された選択から除外されます。過去の記録は、状態確認とクリーンアップのために読み取れるままです。

既定のローカルモデルは tiel-coder-35b-axq-mxfp4 です。選択されるリポジトリ、メモリ、ディスクの正確な案内は AX Engine のモデル選択 を参照してください。

別に設定済みの既存ループバック接続インターフェースについては、/v1/models が正式です。AX Code は、稼働中のモデル ID、コンテキストと出力の上限、モダリティ、構造化ツール呼び出しのサポートを検出します。構造化ツール呼び出しを告知しないモデルは、コーディングエージェントのリクエストには使いません。

AX Engine は既定で、コンパクトな core ツールプロファイル(bash、ファイルの検出・読み取り・編集・書き込み、およびスキル)を使います。完全なツールレジストリを収める十分なコンテキストがあるカスタム配置でのみ、provider.ax-engine.options.toolProfile を full に設定してください。

エンジンをインストールする

ローカル推論には AX Engine 7.5.7 以降が必要です。Apple Silicon Mac のインストーラーには、自己完結の AX Engine サイドカー(CLI ランタイムの隣にある engine/<version>/)がすでに含まれているため、まっさらな Mac でも Homebrew は不要です。

その後 AX Code は、次の順でバイナリを解決します。

  1. provider.ax-engine.options.binaryPath を ax-code.json の中で探します(検証済みバージョンが少なくとも 7.5.7 であること)
  2. AX_ENGINE_BIN 環境変数(検証済みバージョンが少なくとも 7.5.7 であること)
  3. ax-engine を、お使いの PATH 上で探します(検証済みバージョンが少なくとも 7.5.7 であること)
  4. AX Code が管理するオーバーレイインストール(ax-code providers ax-engine install。こちらも少なくとも 7.5.7 が必要)
  5. 現在の Mac ランタイムに同梱されたサイドカー

最初に --version を確認し、見つからなければ install.version へ戻ります。その参照元は ax-engine doctor --json です。Doctor の終了コードはホストの準備状況(Metal ツールチェーンと MLX ファイル)を報告するため、その JSON にバージョンが含まれていれば、ゼロ以外の終了でも数えられます。サーバーの起動は AX Code が所有し、通常は ax-engine serve を 127.0.0.1:31418 上で起動します。任意の Homebrew formula は、brew が所有するエンジンを望む利用者向けの代替であり、必須ではありません。

管理された Tiel の起動は、カタログのウィンドウ(コンテキスト 65,536 トークン、出力 8,192 トークン)を使います。これはエージェントのプロンプトが収まるよう、ax-engine serve 組み込みの 16,384 トークン既定より大きくしてあります。どちらの予算も provider.ax-engine.options.contextTokens と provider.ax-engine.options.maxOutputTokens で縮小できます(outputTokens は同じ出力用のつまみです)。環境変数名は AX_ENGINE_CONTEXT_TOKENS と AX_ENGINE_MAX_OUTPUT_TOKENS です(AX_ENGINE_OUTPUT_TOKENS は別名です)。上書きできるのはカタログ上限を狭めることだけです。より大きい値や無効な値は報告されたうえで無視され、1,024 の倍数でない Tiel または Qwen3.8 のウィンドウは、プレフィックスキャッシュのブロックが 1,024 トークンのままになるよう切り下げられます。同じ数値が、稼働中のサーバーとモデル上限が使う値です。ライブの /v1/models カードはそのウィンドウをさらに縮小できますが、引き上げることはできません。設定されたオプションが優先され、環境変数の値が無視されるとき AX Code は警告します。同じ警告は、binaryPath が AX_ENGINE_BIN を無視するとき、または connectionMode / baseURL が AX_ENGINE_HOST を無視するときにも出ます。より小さいウィンドウは、完全なエージェントプロンプトには小さすぎることがあります。その場合 AX Code は、サーバーが保持できないプロンプトを送らず、そのモデルを拒否します。

Tiel と Cyber-Tiel は構造化ツール呼び出しを告知します。サーバーの稼働後は、ライブの /v1/models カードがその告知を上書きします。mtpPolicy: disabled は、バイナリのバージョンを読めない場合でも MTP をオフにします。auto と required には、引き続き AX Engine 7.4.0 以降が必要です。

libmlx.dylib / mlx.metallib が欠けている PATH またはオーバーレイのインストールは拒否されます。同梱アーカイブとオーバーレイアーカイブは、自己完結の 7.5.7 macOS ペイロードです。

エンジンをインストールしてもモデルはダウンロードされません。その後、Desktop の モデル ページ、または ax-code providers ax-engine prepare でモデルを選んでダウンロードします。Hugging Face キャッシュに、完全で互換性のあるベーススナップショットがすでにある場合、直接デコードに受け入れられます。prepare --download は、利用できるならカタログが推奨する MTP パッケージを使います。

/connect → AX-Engine ランタイム → モデルを選択 を使います。選択したモデルが必要になると、AX Code はローカルランタイムを自動で設定して起動します。URL も API キーも不要です。ステータスを表示、ローカルランタイムを停止、無効化 がローカルランタイムを管理します。モデルを選ぶと、従来の手動接続設定も、管理されたローカルセットアップへ置き換わります。

エンジンが提供されるのは Apple Silicon の macOS だけです。他のホストでは、ホスト型プロバイダー、または OpenAI 互換のプロバイダーゲートウェイを使ってください。AX Code のサーバーはローカル専用です。