本頁譯自英文文件。指令、識別名稱與範例保持原樣。執行環境 7.24.4 · SDK 2.6.7。 英文原文
支援的供應商與模型
狀態:有效 範圍:目前狀態 上次審閱:2026-09-19 負責人:ax-code runtime
本頁列出 AX Code 在預設設定流程中提供的供應商預設集。權威來源是
packages/ax-code/src/provider/default-setup-providers.ts 中的執行環境供應商允許清單、
packages/ax-code/src/provider/models-snapshot.json 中隨附的模型快照、
packages/ax-code/src/provider/local-runtime.ts 中的本機執行環境預設集,以及
packages/ax-code/src/provider/ax-engine/constants.ts 中的 AX Engine 定義。
在終端機介面使用 /connect,或使用 ax-code providers login <provider-id> 進行互動式設定。無頭與 CI 環境也可以提供列出的環境變數。
管理已連接的供應商
工作階段檢視保留上方列,顯示工作階段 ID(按一下可複製)、標題與即時狀態,接著是顯示已連接數量的 供應商 項目;按一下它或 管理 可開啟供應商管理員,該管理員也是 /providers 指令。從那裡可以選擇模型、停用或中斷每個供應商的連線,或跳到完整的 /connect 流程。
- 更換金鑰:在
/connect中選取供應商並選擇 更換金鑰,或重新執行ax-code providers login <provider-id>。 - 暫時停用:在
/providers或/connect中選擇 停用,或執行ax-code providers disable <provider-id>。這會把該供應商加入全域設定的disabled_providers,並保留已儲存的憑證。停用的供應商仍會出現在/providers,以及/connect的 已停用 之下,並可用 啟用 或ax-code providers enable <provider-id>重新開啟。 - 永久中斷連線:在
/providers或/connect中選擇 中斷連線,或執行ax-code providers logout <provider-id>——這會從auth.json刪除已儲存的憑證。
託管模型目錄隨每個 AX Code 發行版本附帶,並篩選出可用於程式開發 agent 的能力。執行
ax-code models <provider-id> 可取得你所安裝版本中的權威模型 ID;原始登錄與複製的
網頁清單可能包含 AX Code 隱藏的模型,因為它們缺少文字輸出或工具呼叫。供應商預設集並不
表示每個模型都免費,或在每個帳號上都可用。
執行環境選擇
不指定版本來選擇模型
TUI 與 ax-code run 都接受這些不區分大小寫的 --model 家族名稱:
| 家族 | 模型 |
|---|---|
deepseek |
deepseek-flash |
glm |
glm-5.3-flash |
qwen |
qwen3.8-flash |
例如,ax-code --model glm 會以 GLM Flash 開啟 TUI,
ax-code run --model qwen -- "Review this change" 會請求 Qwen Flash。
把提示放在 -- 之後(或傳入 --prompt/--prompt-file);--file 會附加
檔案,而不是提示檔。ax-code models 列出可用的 provider/model ID。
家族名稱會透過原生供應商,或提供相同模型的已連接閘道來解析。
你也可以指名供應商:--model my-gateway/glm。
使用完整 ID(例如 my-gateway/glm-5.3)可請求特定版本或等級。
省略 --model 會保留已設定、agent、工作階段與最近的模型選擇。
沒有可用選擇時,共用的備援順序會從已連接供應商中的 DeepSeek Flash、
GLM Flash,再到 Qwen Flash 開始。供應商設定有自己的
預設:Alibaba Coding Plan 使用 qwen3-coder-plus;Alibaba Token Plan 使用
qwen3.8-flash。
連接執行環境
/connect 中的選擇依序為 API 雲端供應商、CLI 供應商、
AX-Engine 執行環境、本機 LLM 執行環境、私有 GPU 雲端與 AX Trust。
AX-Engine 執行環境會直接開啟本機模型選擇與執行環境管理。
本機 LLM 執行環境依序列出這些選擇:
| 選單選項 | 供應商 id | 預設端點 | 主機環境變數 |
|---|---|---|---|
| Ollama | ollama |
http://localhost:11434/v1 |
OLLAMA_HOST |
| LMStudio | lmstudio |
http://localhost:1234/v1 |
LMSTUDIO_HOST |
| MTPLX | mtplx |
http://localhost:8000/v1 |
MTPLX_HOST |
| oMLX | omlx |
http://localhost:8000/v1 |
OMLX_HOST |
| AX-Studio | ax-studio |
http://localhost:18080/v1 |
AX_STUDIO_HOST |
| 其他 | local-llm |
輸入你的 OpenAI 相容端點 | LOCAL_LLM_HOST |
MTPLX 與 oMLX 預設集可在原始碼檢出中使用;v7.19.3 封裝的二進位檔不包含它們。 工具能力設定、選用驗證,以及共用預設連接埠的注意事項,見 MTPLX 與 oMLX 設定。
啟動本機伺服器,選取其選單項目,並確認或編輯端點。
若省略,AX Code 會加上 /v1。其他會在
local-llm 下儲存一個可設定的端點;再次選取它即可變更端點。LMStudio 與其他使用
既有的本機設定流程,不會提示 API 權杖。LM Studio 記載了其
模型清單端點。
設定選擇會遵守 enabled_providers 與 disabled_providers。只是開啟
選擇器並不會啟動或探測這些本機伺服器。探索到的外部
本機模型保留保守的能力預設;模型必須支援工具
呼叫,才能在程式開發 agent 工作流程中被選取。
雲端 API 供應商
這些供應商呼叫託管 API 或託管帳號方案端點。
| 供應商 id | 顯示名稱 | 憑證環境變數 |
|---|---|---|
google |
GOOGLE_API_KEY、GOOGLE_GENERATIVE_AI_API_KEY、GEMINI_API_KEY |
|
deepseek |
DeepSeek | DEEPSEEK_API_KEY |
meta |
Meta(Muse Spark) | MODEL_API_KEY、META_MODEL_API_KEY |
groq |
GroqCloud | GROQ_API_KEY |
openrouter |
OpenRouter | OPENROUTER_API_KEY |
huggingface |
Hugging Face | HF_TOKEN |
unorouter |
UnoRouter | UNOROUTER_API_KEY |
alibaba-coding-plan |
Alibaba Coding Plan | ALIBABA_CODING_PLAN_INTL_API_KEY、ALIBABA_CODING_PLAN_API_KEY |
alibaba-coding-plan-cn |
Alibaba Coding Plan(中國) | ALIBABA_CODING_PLAN_CN_API_KEY、ALIBABA_CODING_PLAN_API_KEY |
alibaba-token-plan |
Alibaba Token Plan | ALIBABA_TOKEN_PLAN_INTL_API_KEY、ALIBABA_TOKEN_PLAN_API_KEY |
alibaba-token-plan-cn |
Alibaba Token Plan(中國) | ALIBABA_TOKEN_PLAN_CN_API_KEY、ALIBABA_TOKEN_PLAN_API_KEY |
github-copilot |
GitHub Copilot | GITHUB_TOKEN |
zai |
Z.AI | ZHIPU_API_KEY |
zai-coding-plan |
Z.AI Coding Plan | ZHIPU_API_KEY |
minimax-coding-plan |
MiniMax Token Plan | MINIMAX_TOKEN_PLAN_API_KEY、MINIMAX_API_KEY |
minimax-cn-coding-plan |
MiniMax Token Plan(中國) | MINIMAX_TOKEN_PLAN_CN_API_KEY、MINIMAX_API_KEY |
MiniMax 已把 Coding Plan 重新命名為 Token Plan。供應商 ID 仍是 minimax-coding-plan/
minimax-cn-coding-plan,以符合 models.dev 與 OpenCode。請使用 Token Plan 金鑰
(sk-cp-…),來源為 platform.minimax.io
(國際)或 platform.minimaxi.com(中國)。
huggingface是託管的 Serverless Inference Providers 路由器(https://router.huggingface.co/v1)。 它與 AX Engine 用來儲存已下載本機模型的本機 Hugging Face 快照快取無關——連接huggingface絕不會啟動或需要本機引擎。
若要零成本的第一次執行,見免費方案 API 快速開始。它區分供應商的免費 方案與 AX Code 的相容性,並說明為什麼外部免費 API 目錄本身不是支援矩陣。
Grok 只透過下方列出的 grok-build-cli 供應商支援。AX Code 不再包含直接的 xai 雲端 API 供應商;既有的 Grok API 憑證不會建立連線。
github-copilot 是 GitHub Copilot 帳號橋接。它不是某些
免費 API 目錄列出的獨立 github-models API。
OpenAI 相容與 Anthropic 相容閘道也可透過自訂供應商設定支援。見自訂與閘道供應商。
私有 GPU 雲端
這些供應商出現在 /connect 的 私有 GPU 雲端 之下,位於本機 LLM 執行環境之後。
選擇 自訂供應商 以連接你自己的 OpenAI 相容 GPU 端點。
輸入其 URL 與 API 金鑰;AX Code 會從 /v1/models 探索模型,並把
金鑰存在加密的驗證儲存中。已儲存的連線會留在私有 GPU
雲端。再次選取它即可選擇模型、更換端點或中斷連線。
此項目在 custom-private-gpu 下儲存一個可設定的端點。
目錄(API 金鑰)
OpenCode 風格的託管 GPU 目錄。模型來自隨附的 models.dev 快照。以 API 金鑰連接。
| 供應商 id | 顯示名稱 | 憑證環境變數 |
|---|---|---|
nebius |
Nebius Token Factory | NEBIUS_API_KEY |
fireworks-ai |
Fireworks AI | FIREWORKS_API_KEY |
togetherai |
Together AI | TOGETHER_API_KEY |
baseten |
Baseten | BASETEN_API_KEY |
nvidia |
NVIDIA NIM | NVIDIA_API_KEY |
deepinfra |
Deep Infra | DEEPINFRA_API_KEY |
託管的 Hugging Face 路由器(huggingface/HF_TOKEN)留在雲端 API 供應商。專用的 Hugging Face Inference Endpoints 列於下方。
專用(URL + 權杖)
PAI 風格的專用 GPU 端點。貼上 OpenAI 相容 URL 與權杖;AX Code 會呼叫 GET …/models 並使用已部署的模型 ID。這些不是 Alibaba Coding Plan/Token Plan(DashScope)供應商。
| 供應商 id | 顯示名稱 | 憑證環境變數 |
|---|---|---|
alibaba-pai |
Alibaba PAI-EAS | ALIBABA_PAI_API_KEY、ALIBABA_PAI_BASE_URL |
runpod |
RunPod | RUNPOD_API_KEY、RUNPOD_BASE_URL |
huggingface-endpoints |
Hugging Face Endpoints | HF_ENDPOINTS_TOKEN、HF_ENDPOINTS_BASE_URL |
sagemaker |
Amazon SageMaker | SAGEMAKER_API_KEY、SAGEMAKER_BASE_URL |
volcengine-ark |
Volcengine Ark | ARK_API_KEY、ARK_BASE_URL |
modelarts |
Huawei ModelArts | MODELARTS_API_KEY、MODELARTS_BASE_URL |
tencent-ti |
Tencent TI | TENCENT_TI_API_KEY、TENCENT_TI_BASE_URL |
custom-private-gpu |
自訂供應商 | CUSTOM_PRIVATE_GPU_API_KEY、CUSTOM_PRIVATE_GPU_BASE_URL |
sagemaker 用於 SageMaker 前方的 OpenAI 相容 URL(vLLM/TGI/API Gateway)。它不會簽署 AWS SigV4。
AX Trust
AX Trust 是 /connect 中的最後一個類別,位於私有 GPU 雲端之後。選擇
連接 AX Trust,輸入包含 /v1 的閘道基底 URL,並提供
用戶端 API 金鑰。AX Code 會探索閘道的模型,並把金鑰
存在加密的驗證儲存中。已儲存的連線提供模型選擇、端點
更新、模型重新整理與刪除。
重新連接既有 URL 時,若權杖留白,會保留其供應商 ID、模型與已儲存的金鑰。
即使使用自訂名稱,供應商仍留在 AX Trust。舊版 ax-trust 與 ax-trust-* ID 也會出現在此類別。
AX Trust 繼續擁有閘道原則、核准與稽核。
AX Code 預設會在這些連線上送出工作階段親和性標頭。
CLI 供應商
CLI 供應商重用本機廠商 CLI 及其登入/工作階段,而不是在 AX Code 中儲存託管 API 金鑰。
| 供應商 id | 顯示名稱 | 必要的本機指令 | 支援的模型 id |
|---|---|---|---|
claude-code |
Anthropic(Claude Code) | claude |
claude-code |
codex-cli |
OpenAI(Codex CLI) | codex |
codex-cli |
grok-build-cli |
Grok Build CLI | grok |
grok-build-cli |
muse-cli |
Muse Code CLI | muse |
muse-cli |
必要時先執行廠商 CLI 登入,然後執行 ax-code providers login <provider-id>。AX Code 會探測 CLI 指令,並在探測成功後儲存本機標記憑證。
對於 Muse Code,請安裝本機 muse 二進位檔,執行 muse login(或設定 META_API_KEY),然後 ax-code providers login muse-cli。AX Code 重用 Muse CLI 工作階段(~/.config/muse),而不是儲存託管的 Meta API 金鑰。託管的 meta API 供應商仍是獨立連線。
託管的 MiniMax Token Plan 仍可作為 minimax-coding-plan/minimax-cn-coding-plan 使用。沒有隨附的 MiniMax Code CLI 或 Kimi Code CLI 供應商。
AX Engine 本機供應商
ax-engine 是內建的本機推論供應商。它只在符合條件的 Apple Silicon Mac 上可用,並且只提供 AutomatosX Tiel Coder 與 Cyber-Tiel Coder 35B A3B MXFP4 MTP 開發套件。模型啟動時會檢查原生能力。
| 供應商 id | 模型 id | 選擇 | 上下文 | 輸出 |
|---|---|---|---|---|
ax-engine |
tiel-coder-35b-axq-mxfp4 |
Tiel Coder 35B A3B MXFP4 MTP(預設) | 65,536 | 8,192 |
ax-engine |
cyber-tiel-coder-35b-axq-mxfp4 |
Cyber-Tiel Coder 35B A3B MXFP4 MTP | 65,536 | 8,192 |
Qwen3.8 27B、Ornith、Qwen3-Coder-Next 與所有其他儲存庫都排除在受管選擇之外。歷史紀錄仍可讀取,供狀態與清理使用。
預設本機模型是 tiel-coder-35b-axq-mxfp4。精確的選定儲存庫、記憶體與磁碟指引見 AX Engine 模型選擇。
對於既有、另行設定的 loopback 附加介面,/v1/models 是權威來源:AX Code 會探索即時模型 ID、上下文/輸出上限、模態,以及結構化工具呼叫支援。未宣告結構化工具呼叫的模型不會用於程式開發 agent 請求。
AX Engine 預設使用精簡的 core 工具設定檔(bash、檔案探索/讀取/編輯/寫入,以及技能)。只有在自訂部署有足夠上下文容納完整工具登錄時,才把 provider.ax-engine.options.toolProfile 設為 full。
安裝引擎
本機推論需要 AX Engine 7.5.7 或更新版本。Apple Silicon Mac 安裝程式已包含自足的 AX Engine 附屬程式(CLI 執行環境旁的 engine/<version>/),因此乾淨的 Mac 不需要 Homebrew。
AX Code 接著依此順序解析二進位檔:
provider.ax-engine.options.binaryPath,位於ax-code.json(需要已驗證版本至少為 7.5.7)AX_ENGINE_BIN環境變數(需要已驗證版本至少為 7.5.7)ax-engine,位於你的PATH(需要已驗證版本至少為 7.5.7)- AX Code 管理的覆蓋安裝(
ax-code providers ax-engine install;同樣需要至少 7.5.7) - 目前 Mac 執行環境中隨附的附屬程式
它會先檢查 --version,再退回到 install.version,其來源是 ax-engine doctor --json。Doctor 的結束代碼回報主機就緒狀態(Metal 工具鏈、MLX 檔案),因此當該 JSON 含有版本時,非零結束代碼仍算數。AX Code 負責伺服器啟動,通常啟動 ax-engine serve,位址為 127.0.0.1:31418。選用的 Homebrew formula 仍是想要由 brew 擁有引擎的使用者的替代方案;它不是必要的。
受管 Tiel 啟動使用目錄視窗(65,536 個上下文 token 與 8,192 個輸出 token),這大於 ax-engine serve 內建的 16,384 token 預設,以便容納 agent 提示。可用 provider.ax-engine.options.contextTokens 與 provider.ax-engine.options.maxOutputTokens 縮小任一預算(outputTokens 是同一個輸出調整項)。環境名稱是 AX_ENGINE_CONTEXT_TOKENS 與 AX_ENGINE_MAX_OUTPUT_TOKENS(AX_ENGINE_OUTPUT_TOKENS 是別名)。覆寫只能收窄目錄上限:較大或無效的值會被回報並忽略,而且不是 1,024 倍數的 Tiel 或 Qwen3.8 視窗會向下對齊,使前綴快取區塊維持 1,024 個 token。相同數字就是執行中伺服器與模型上限所使用的數字。即時的 /v1/models 卡片可以進一步縮小該視窗,但不能提高它。已設定的選項優先,當環境值被忽略時 AX Code 會警告。當 binaryPath 忽略 AX_ENGINE_BIN,或當 connectionMode/baseURL 忽略 AX_ENGINE_HOST 時,也會發出相同警告。較小的視窗可能小到放不下完整的 agent 提示;AX Code 會拒絕該模型,而不是送出伺服器無法容納的提示。
Tiel 與 Cyber-Tiel 宣告結構化工具呼叫。伺服器執行後,即時的 /v1/models 卡片仍會覆寫該宣告。即使無法讀取二進位檔版本,mtpPolicy: disabled 也會關閉 MTP;auto 與 required 仍需要 AX Engine 7.4.0 或更新版本。
缺少 libmlx.dylib/mlx.metallib 的 PATH 或覆蓋安裝會被拒絕。隨附與覆蓋封存是自足的 7.5.7 macOS 承載。
安裝引擎並不會下載模型。請事後從 Desktop 的 模型 頁,或以 ax-code providers ax-engine prepare 挑選並下載模型。Hugging Face 快取中已存在的完整相容基礎快照,可接受用於直接解碼;prepare --download 會在可用時使用目錄所偏好的 MTP 套件。
使用 /connect -> AX-Engine 執行環境 -> 選擇模型。需要所選模型時,AX Code 會自動設定
並啟動本機執行環境;
不需要 URL 或 API 金鑰。檢視狀態、停止本機執行環境與
停用 管理本機執行環境。選擇模型也會以受管本機設定取代舊版
手動附加設定。
引擎只針對 Apple Silicon macOS 提供。在其他主機上,請使用託管供應商或 OpenAI 相容供應商閘道;AX Code 伺服器僅限本機。