本页译自英文文档。命令、标识符和示例保持原样。运行时 7.24.4 · SDK 2.6.7。 英文原文
支持的提供商与模型
状态:生效 范围:当前状态 最近审阅:2026-09-19 负责人:ax-code 运行时
本页列出 AX Code 在默认设置流程中提供的提供商预设。权威来源是运行时提供商允许列表
packages/ax-code/src/provider/default-setup-providers.ts、随版本打包的模型快照
packages/ax-code/src/provider/models-snapshot.json、本地运行时预设
packages/ax-code/src/provider/local-runtime.ts,以及 AX Engine 定义
packages/ax-code/src/provider/ax-engine/constants.ts。
在终端界面使用 /connect,或使用 ax-code providers login <provider-id> 进行交互式设置。无头环境与 CI 环境也可以提供所列的环境变量。
管理已连接的提供商
会话视图保留一条顶栏,其中包含会话 ID(点击即可复制)、标题和实时状态,其后是显示已连接数量的 提供商 条目;点击它或 管理 即可打开提供商管理器,该管理器也可通过 /providers 命令打开。在那里可以选择模型、禁用或断开各个提供商,或跳转到完整的 /connect 流程。
- 更换密钥:在
/connect中选择该提供商并选择 更换密钥,或重新运行ax-code providers login <provider-id>。 - 暂时禁用:在
/providers或/connect中选择 禁用,或运行ax-code providers disable <provider-id>。这会把该提供商加入全局配置中的disabled_providers,并保留已保存的凭据。被禁用的提供商仍会显示在/providers中,以及/connect下的 已禁用 分组中,并可通过 启用 或ax-code providers enable <provider-id>重新打开。 - 永久断开:在
/providers或/connect中选择 断开连接,或运行ax-code providers logout <provider-id>— 这会从auth.json中删除已存储的凭据。
托管模型目录随每个 AX Code 版本打包,并按可用于编程代理的能力进行筛选。运行
ax-code models <provider-id> 可获得当前已安装版本中的权威模型 ID;原始注册表和复制的
网页列表可能包含 AX Code 因缺少文本输出或工具调用而隐藏的模型。提供商预设并不
表示每个模型都免费,或在每个账户上都可用。
运行时选择
不指定版本地选择模型
TUI 与 ax-code run 都接受这些不区分大小写的 --model 系列名称:
| 系列 | 模型 |
|---|---|
deepseek |
deepseek-flash |
glm |
glm-5.3-flash |
qwen |
qwen3.8-flash |
例如,ax-code --model glm 会以 GLM Flash 打开 TUI,而
ax-code run --model qwen -- "Review this change" 会请求 Qwen Flash。
把提示词放在 -- 之后(或传入 --prompt / --prompt-file);--file 用于附加
文件,并不是提示词文件。ax-code models 列出可用的 provider/model ID。
系列名称通过原生提供商,或通过提供同一模型的已连接网关进行解析。也可以指定提供商:--model my-gateway/glm。
使用完整 ID(例如 my-gateway/glm-5.3)可请求特定版本或档位。
省略 --model 会保留已配置的、代理的、会话的以及最近的模型选择。
当没有可用选择时,共享回退顺序从 DeepSeek Flash 开始,
然后是 GLM Flash,再是已连接提供商中的 Qwen Flash。提供商设置有自己的
默认值:Alibaba Coding Plan 使用 qwen3-coder-plus;Alibaba Token Plan 使用
qwen3.8-flash。
连接运行时
/connect 中的选项顺序为 API 云提供商、CLI 提供商、
AX-Engine 运行时、本地 LLM 运行时、私有 GPU 云 和 AX Trust。
AX-Engine 运行时直接打开本地模型选择和运行时管理。
本地 LLM 运行时按以下顺序列出这些选项:
| 菜单选项 | 提供商 id | 默认端点 | 主机环境变量 |
|---|---|---|---|
| Ollama | ollama |
http://localhost:11434/v1 |
OLLAMA_HOST |
| LMStudio | lmstudio |
http://localhost:1234/v1 |
LMSTUDIO_HOST |
| MTPLX | mtplx |
http://localhost:8000/v1 |
MTPLX_HOST |
| oMLX | omlx |
http://localhost:8000/v1 |
OMLX_HOST |
| AX-Studio | ax-studio |
http://localhost:18080/v1 |
AX_STUDIO_HOST |
| 其他 | local-llm |
输入你的 OpenAI 兼容端点 | LOCAL_LLM_HOST |
MTPLX 与 oMLX 预设在源码检出中可用;v7.19.3 打包的二进制文件不包含它们。 工具能力配置、可选身份验证以及共享默认端口的注意事项,见 MTPLX 与 oMLX 设置。
先启动本地服务器,选择对应菜单项,然后确认或编辑端点。
若省略,AX Code 会补上 /v1。其他会在
local-llm 下保存一个可配置端点;再次选择它即可更改端点。LMStudio 与其他使用
现有的本地设置流程,不会提示输入 API 令牌。LM Studio 记录了它的
模型列表端点。
设置选项会遵守 enabled_providers 与 disabled_providers。仅仅打开
选择器并不会激活或探测这些本地服务器。已发现的外部
本地模型保留保守的能力默认值;模型必须支持工具
调用,才能被选用于编程代理工作流。
云 API 提供商
这些提供商调用托管 API 或托管账户方案端点。
| 提供商 id | 显示名称 | 凭据环境变量 |
|---|---|---|
google |
〔英〕Google | GOOGLE_API_KEY, GOOGLE_GENERATIVE_AI_API_KEY, GEMINI_API_KEY |
deepseek |
〔英〕DeepSeek | DEEPSEEK_API_KEY |
meta |
〔英〕Meta (Muse Spark) | MODEL_API_KEY, META_MODEL_API_KEY |
groq |
〔英〕GroqCloud | GROQ_API_KEY |
openrouter |
〔英〕OpenRouter | OPENROUTER_API_KEY |
huggingface |
〔英〕Hugging Face | HF_TOKEN |
unorouter |
〔英〕UnoRouter | UNOROUTER_API_KEY |
alibaba-coding-plan |
〔英〕Alibaba Coding Plan | ALIBABA_CODING_PLAN_INTL_API_KEY, ALIBABA_CODING_PLAN_API_KEY |
alibaba-coding-plan-cn |
〔英〕Alibaba Coding Plan (China) | ALIBABA_CODING_PLAN_CN_API_KEY, ALIBABA_CODING_PLAN_API_KEY |
alibaba-token-plan |
〔英〕Alibaba Token Plan | ALIBABA_TOKEN_PLAN_INTL_API_KEY, ALIBABA_TOKEN_PLAN_API_KEY |
alibaba-token-plan-cn |
〔英〕Alibaba Token Plan (China) | ALIBABA_TOKEN_PLAN_CN_API_KEY, ALIBABA_TOKEN_PLAN_API_KEY |
github-copilot |
〔英〕GitHub Copilot | GITHUB_TOKEN |
zai |
〔英〕Z.AI | ZHIPU_API_KEY |
zai-coding-plan |
〔英〕Z.AI Coding Plan | ZHIPU_API_KEY |
minimax-coding-plan |
〔英〕MiniMax Token Plan | MINIMAX_TOKEN_PLAN_API_KEY, MINIMAX_API_KEY |
minimax-cn-coding-plan |
〔英〕MiniMax Token Plan (China) | MINIMAX_TOKEN_PLAN_CN_API_KEY, MINIMAX_API_KEY |
MiniMax 已将 Coding Plan 更名为 Token Plan。提供商 ID 仍为 minimax-coding-plan /
minimax-cn-coding-plan,以匹配 models.dev 与 OpenCode。请使用 Token Plan 密钥
(sk-cp-…),来自 platform.minimax.io
(国际)或 platform.minimaxi.com(中国)。
huggingface是 托管的 Serverless Inference Providers 路由器(https://router.huggingface.co/v1)。 它与 AX Engine 用来存放已下载本地模型的本地 Hugging Face 快照缓存无关 — 连接huggingface绝不会启动或要求本地引擎。
若要零成本地首次运行,请参阅 免费层 API 快速入门。它区分提供商的免费 产品与 AX Code 的兼容性,并说明外部免费 API 目录本身并不是支持矩阵。
Grok 仅通过下方列出的 grok-build-cli 提供商获得支持。AX Code 不再包含直接的 xai 云 API 提供商;现有的 Grok API 凭据不会建立连接。
github-copilot 是 GitHub Copilot 账户桥接。它不是某些
免费 API 目录所列出的独立 github-models API。
OpenAI 兼容与 Anthropic 兼容网关也可通过自定义提供商配置获得支持。见 自定义与网关提供商。
私有 GPU 云
这些提供商出现在 /connect 的 私有 GPU 云 下,位于本地 LLM 运行时之后。
选择 自定义提供商 以连接你自己的 OpenAI 兼容 GPU 端点。
输入其 URL 与 API 密钥;AX Code 会从 /v1/models 发现模型,并把
密钥存放在加密的身份验证存储中。已保存的连接仍留在私有 GPU
云中。再次选择它即可选择模型、更换端点或断开连接。
该条目在 custom-private-gpu 下存储一个可配置端点。
目录(API 密钥)
OpenCode 风格的托管 GPU 目录。模型来自随附的 models.dev 快照。使用 API 密钥连接。
| 提供商 id | 显示名称 | 凭据环境变量 |
|---|---|---|
nebius |
〔英〕Nebius Token Factory | NEBIUS_API_KEY |
fireworks-ai |
〔英〕Fireworks AI | FIREWORKS_API_KEY |
togetherai |
〔英〕Together AI | TOGETHER_API_KEY |
baseten |
〔英〕Baseten | BASETEN_API_KEY |
nvidia |
〔英〕NVIDIA NIM | NVIDIA_API_KEY |
deepinfra |
〔英〕Deep Infra | DEEPINFRA_API_KEY |
托管的 Hugging Face 路由器(huggingface / HF_TOKEN)仍位于云 API 提供商中。专用的 Hugging Face Inference Endpoints 列在下方。
专用(URL + 令牌)
PAI 风格的专用 GPU 端点。粘贴 OpenAI 兼容 URL 与令牌;AX Code 会调用 GET …/models 并使用已部署的模型 ID。这些不是 Alibaba Coding Plan / Token Plan(DashScope)提供商。
| 提供商 id | 显示名称 | 凭据环境变量 |
|---|---|---|
alibaba-pai |
〔英〕Alibaba PAI-EAS | ALIBABA_PAI_API_KEY, ALIBABA_PAI_BASE_URL |
runpod |
〔英〕RunPod | RUNPOD_API_KEY, RUNPOD_BASE_URL |
huggingface-endpoints |
〔英〕Hugging Face Endpoints | HF_ENDPOINTS_TOKEN, HF_ENDPOINTS_BASE_URL |
sagemaker |
〔英〕Amazon SageMaker | SAGEMAKER_API_KEY, SAGEMAKER_BASE_URL |
volcengine-ark |
〔英〕Volcengine Ark | ARK_API_KEY, ARK_BASE_URL |
modelarts |
〔英〕Huawei ModelArts | MODELARTS_API_KEY, MODELARTS_BASE_URL |
tencent-ti |
〔英〕Tencent TI | TENCENT_TI_API_KEY, TENCENT_TI_BASE_URL |
custom-private-gpu |
自定义提供商 | CUSTOM_PRIVATE_GPU_API_KEY, CUSTOM_PRIVATE_GPU_BASE_URL |
sagemaker 用于 SageMaker 前面的 OpenAI 兼容 URL(vLLM / TGI / API Gateway)。它不会签署 AWS SigV4。
AX Trust
AX Trust 是 /connect 中的最后一个类别,位于私有 GPU 云之后。选择
连接 AX Trust,输入包含 /v1 的网关基址 URL,并提供
客户端 API 密钥。AX Code 会发现该网关的模型,并把密钥
存放在加密的身份验证存储中。已保存的连接提供模型选择、端点
更新、模型刷新和删除。
重新连接已有 URL 时,若令牌留空,会保留其提供商 ID、模型与已保存密钥。
即使使用自定义名称,该提供商仍位于 AX Trust 中。遗留的 ax-trust 与 ax-trust-* ID 也会出现在此类别中。
AX Trust 继续负责网关策略、批准与审计。
AX Code 默认在这些连接上发送会话亲和性标头。
CLI 提供商
CLI 提供商复用本地厂商 CLI 及其登录/会话,而不是在 AX Code 中存储托管 API 密钥。
| 提供商 id | 显示名称 | 所需本地命令 | 支持的模型 id |
|---|---|---|---|
claude-code |
〔英〕Anthropic (Claude Code) | claude |
claude-code |
codex-cli |
〔英〕OpenAI (Codex CLI) | codex |
codex-cli |
grok-build-cli |
〔英〕Grok Build CLI | grok |
grok-build-cli |
muse-cli |
〔英〕Muse Code CLI | muse |
muse-cli |
需要时先运行厂商 CLI 登录,然后运行 ax-code providers login <provider-id>。AX Code 会探测该 CLI 命令,并在探测成功后存储一个本地标记凭据。
对于 Muse Code,请安装本地 muse 二进制文件,运行 muse login(或设置 META_API_KEY),然后运行 ax-code providers login muse-cli。AX Code 复用 Muse CLI 会话(~/.config/muse),而不是存储托管的 Meta API 密钥。托管的 meta API 提供商仍然是单独的连接。
托管的 MiniMax Token Plan 仍可通过 minimax-coding-plan / minimax-cn-coding-plan 使用。没有捆绑的 MiniMax Code CLI 或 Kimi Code CLI 提供商。
AX Engine 本地提供商
ax-engine 是内置的本地推理提供商。它仅在符合条件的 Apple Silicon Mac 上可用,并且只提供 AutomatosX Tiel Coder 与 Cyber-Tiel Coder 35B A3B MXFP4 MTP 开发包。模型启动时会检查原生能力。
| 提供商 id | 模型 id | 选择 | 上下文 | 输出 |
|---|---|---|---|---|
ax-engine |
tiel-coder-35b-axq-mxfp4 |
Tiel Coder 35B A3B MXFP4 MTP(默认) | 65,536 | 8,192 |
ax-engine |
cyber-tiel-coder-35b-axq-mxfp4 |
Cyber-Tiel Coder 35B A3B MXFP4 MTP | 65,536 | 8,192 |
Qwen3.8 27B、Ornith、Qwen3-Coder-Next 以及所有其他仓库都不在托管选择之列。历史记录仍可读取,用于查看状态和清理。
默认本地模型是 tiel-coder-35b-axq-mxfp4。确切的所选仓库、内存与磁盘指引见 AX Engine 模型选择。
对于现有的、单独配置的回环挂接接口,/v1/models 是权威来源:AX Code 会发现实时模型 ID、上下文/输出限制、模态以及结构化工具调用支持。未声明支持结构化工具调用的模型不会用于编程代理请求。
AX Engine 默认使用紧凑的 core 工具配置档(bash、文件发现/读取/编辑/写入,以及技能)。仅当自定义部署有足够上下文容纳完整工具注册表时,才把 provider.ax-engine.options.toolProfile 设为 full。
安装引擎
本地推理需要 AX Engine 7.5.7 或更高版本。Apple Silicon Mac 安装包已经包含自包含的 AX Engine 边车(CLI 运行时旁边的 engine/<version>/),因此一台全新的 Mac 不需要 Homebrew。
随后 AX Code 按以下顺序解析二进制文件:
provider.ax-engine.options.binaryPath,位于ax-code.json中(要求已验证版本至少为 7.5.7)AX_ENGINE_BIN环境变量(要求已验证版本至少为 7.5.7)ax-engine,位于你的PATH上(要求已验证版本至少为 7.5.7)- 由 AX Code 管理的叠加安装(
ax-code providers ax-engine install;同样要求至少 7.5.7) - 当前 Mac 运行时中捆绑的边车
它首先检查 --version,并回退到 install.version,其来源是 ax-engine doctor --json。Doctor 的退出码报告主机就绪情况(Metal 工具链、MLX 文件),因此当该 JSON 包含版本时,非零退出仍然算数。AX Code 负责服务器启动,通常启动 ax-engine serve,监听 127.0.0.1:31418。可选的 Homebrew formula 仍是希望由 brew 管理引擎的用户的替代方案;它不是必需的。
托管的 Tiel 启动使用目录窗口(65,536 个上下文 token 与 8,192 个输出 token),这大于 ax-engine serve 内置的 16,384 token 默认值,以便放下代理提示词。可用 provider.ax-engine.options.contextTokens 与 provider.ax-engine.options.maxOutputTokens 缩小任一预算(outputTokens 是同一个输出调节项)。环境变量名称是 AX_ENGINE_CONTEXT_TOKENS 与 AX_ENGINE_MAX_OUTPUT_TOKENS(AX_ENGINE_OUTPUT_TOKENS 是别名)。覆盖只能收窄目录上限:更大或无效的值会被报告并忽略,并且不是 1,024 倍数的 Tiel 或 Qwen3.8 窗口会向下对齐,以便前缀缓存块保持 1,024 个 token。同样的数字也是正在运行的服务器与模型限制所使用的数字。一张实时的 /v1/models 卡片可以进一步缩小该窗口,但不能提高它。已配置的选项优先,当某个环境变量值被忽略时,AX Code 会发出警告。当 binaryPath 忽略 AX_ENGINE_BIN,或当 connectionMode / baseURL 忽略 AX_ENGINE_HOST 时,也会发出同样的警告。更小的窗口可能小到放不下完整的代理提示词;此时 AX Code 会拒绝该模型,而不是发送服务器无法容纳的提示词。
Tiel 与 Cyber-Tiel 声明支持结构化工具调用。服务器运行后,实时的 /v1/models 卡片仍会覆盖该声明。即使无法读取二进制版本,mtpPolicy: disabled 也会关闭 MTP;auto 与 required 仍需要 AX Engine 7.4.0 或更高版本。
缺少 libmlx.dylib / mlx.metallib 的 PATH 或叠加安装会被拒绝。捆绑与叠加归档是自包含的 7.5.7 macOS 载荷。
安装引擎并不会下载模型。之后请从桌面 模型 页面或使用 ax-code providers ax-engine prepare 挑选并下载模型。Hugging Face 缓存中已有的完整兼容基础快照会被接受用于直接解码;prepare --download 在可用时使用目录首选的 MTP 包。
使用 /connect -> AX-Engine 运行时 -> 选择模型。当需要所选模型时,AX Code 会自动配置
并启动本地运行时;
不需要 URL 或 API 密钥。查看状态、停止本地运行时 和
禁用 用于管理本地运行时。选择模型也会用托管的本地设置替换遗留的
手动挂接设置。
该引擎仅面向 Apple Silicon macOS 发布。在其他主机上,请使用托管提供商或 OpenAI 兼容的提供商网关;AX Code 服务器仅限本地。