获取 AX Code · 免费文档

本页译自英文文档。命令、标识符和示例保持原样。运行时 7.24.4 · SDK 2.6.7。 英文原文

支持的提供商与模型

状态:生效 范围:当前状态 最近审阅:2026-09-19 负责人:ax-code 运行时

本页列出 AX Code 在默认设置流程中提供的提供商预设。权威来源是运行时提供商允许列表 packages/ax-code/src/provider/default-setup-providers.ts、随版本打包的模型快照 packages/ax-code/src/provider/models-snapshot.json、本地运行时预设 packages/ax-code/src/provider/local-runtime.ts,以及 AX Engine 定义 packages/ax-code/src/provider/ax-engine/constants.ts。

在终端界面使用 /connect,或使用 ax-code providers login <provider-id> 进行交互式设置。无头环境与 CI 环境也可以提供所列的环境变量。

管理已连接的提供商

会话视图保留一条顶栏,其中包含会话 ID(点击即可复制)、标题和实时状态,其后是显示已连接数量的 提供商 条目;点击它或 管理 即可打开提供商管理器,该管理器也可通过 /providers 命令打开。在那里可以选择模型、禁用或断开各个提供商,或跳转到完整的 /connect 流程。

  • 更换密钥:在 /connect 中选择该提供商并选择 更换密钥,或重新运行 ax-code providers login <provider-id>。
  • 暂时禁用:在 /providers 或 /connect 中选择 禁用,或运行 ax-code providers disable <provider-id>。这会把该提供商加入全局配置中的 disabled_providers,并保留已保存的凭据。被禁用的提供商仍会显示在 /providers 中,以及 /connect 下的 已禁用 分组中,并可通过 启用 或 ax-code providers enable <provider-id> 重新打开。
  • 永久断开:在 /providers 或 /connect 中选择 断开连接,或运行 ax-code providers logout <provider-id> — 这会从 auth.json 中删除已存储的凭据。

托管模型目录随每个 AX Code 版本打包,并按可用于编程代理的能力进行筛选。运行 ax-code models <provider-id> 可获得当前已安装版本中的权威模型 ID;原始注册表和复制的 网页列表可能包含 AX Code 因缺少文本输出或工具调用而隐藏的模型。提供商预设并不 表示每个模型都免费,或在每个账户上都可用。

运行时选择

不指定版本地选择模型

TUI 与 ax-code run 都接受这些不区分大小写的 --model 系列名称:

系列 模型
deepseek deepseek-flash
glm glm-5.3-flash
qwen qwen3.8-flash

例如,ax-code --model glm 会以 GLM Flash 打开 TUI,而 ax-code run --model qwen -- "Review this change" 会请求 Qwen Flash。 把提示词放在 -- 之后(或传入 --prompt / --prompt-file);--file 用于附加 文件,并不是提示词文件。ax-code models 列出可用的 provider/model ID。 系列名称通过原生提供商,或通过提供同一模型的已连接网关进行解析。也可以指定提供商:--model my-gateway/glm。 使用完整 ID(例如 my-gateway/glm-5.3)可请求特定版本或档位。

省略 --model 会保留已配置的、代理的、会话的以及最近的模型选择。 当没有可用选择时,共享回退顺序从 DeepSeek Flash 开始, 然后是 GLM Flash,再是已连接提供商中的 Qwen Flash。提供商设置有自己的 默认值:Alibaba Coding Plan 使用 qwen3-coder-plus;Alibaba Token Plan 使用 qwen3.8-flash。

连接运行时

/connect 中的选项顺序为 API 云提供商、CLI 提供商、 AX-Engine 运行时、本地 LLM 运行时、私有 GPU 云 和 AX Trust。 AX-Engine 运行时直接打开本地模型选择和运行时管理。 本地 LLM 运行时按以下顺序列出这些选项:

菜单选项 提供商 id 默认端点 主机环境变量
Ollama ollama http://localhost:11434/v1 OLLAMA_HOST
LMStudio lmstudio http://localhost:1234/v1 LMSTUDIO_HOST
MTPLX mtplx http://localhost:8000/v1 MTPLX_HOST
oMLX omlx http://localhost:8000/v1 OMLX_HOST
AX-Studio ax-studio http://localhost:18080/v1 AX_STUDIO_HOST
其他 local-llm 输入你的 OpenAI 兼容端点 LOCAL_LLM_HOST

MTPLX 与 oMLX 预设在源码检出中可用;v7.19.3 打包的二进制文件不包含它们。 工具能力配置、可选身份验证以及共享默认端口的注意事项,见 MTPLX 与 oMLX 设置。

先启动本地服务器,选择对应菜单项,然后确认或编辑端点。 若省略,AX Code 会补上 /v1。其他会在 local-llm 下保存一个可配置端点;再次选择它即可更改端点。LMStudio 与其他使用 现有的本地设置流程,不会提示输入 API 令牌。LM Studio 记录了它的 模型列表端点。

设置选项会遵守 enabled_providers 与 disabled_providers。仅仅打开 选择器并不会激活或探测这些本地服务器。已发现的外部 本地模型保留保守的能力默认值;模型必须支持工具 调用,才能被选用于编程代理工作流。

云 API 提供商

这些提供商调用托管 API 或托管账户方案端点。

提供商 id 显示名称 凭据环境变量
google 〔英〕Google GOOGLE_API_KEY, GOOGLE_GENERATIVE_AI_API_KEY, GEMINI_API_KEY
deepseek 〔英〕DeepSeek DEEPSEEK_API_KEY
meta 〔英〕Meta (Muse Spark) MODEL_API_KEY, META_MODEL_API_KEY
groq 〔英〕GroqCloud GROQ_API_KEY
openrouter 〔英〕OpenRouter OPENROUTER_API_KEY
huggingface 〔英〕Hugging Face HF_TOKEN
unorouter 〔英〕UnoRouter UNOROUTER_API_KEY
alibaba-coding-plan 〔英〕Alibaba Coding Plan ALIBABA_CODING_PLAN_INTL_API_KEY, ALIBABA_CODING_PLAN_API_KEY
alibaba-coding-plan-cn 〔英〕Alibaba Coding Plan (China) ALIBABA_CODING_PLAN_CN_API_KEY, ALIBABA_CODING_PLAN_API_KEY
alibaba-token-plan 〔英〕Alibaba Token Plan ALIBABA_TOKEN_PLAN_INTL_API_KEY, ALIBABA_TOKEN_PLAN_API_KEY
alibaba-token-plan-cn 〔英〕Alibaba Token Plan (China) ALIBABA_TOKEN_PLAN_CN_API_KEY, ALIBABA_TOKEN_PLAN_API_KEY
github-copilot 〔英〕GitHub Copilot GITHUB_TOKEN
zai 〔英〕Z.AI ZHIPU_API_KEY
zai-coding-plan 〔英〕Z.AI Coding Plan ZHIPU_API_KEY
minimax-coding-plan 〔英〕MiniMax Token Plan MINIMAX_TOKEN_PLAN_API_KEY, MINIMAX_API_KEY
minimax-cn-coding-plan 〔英〕MiniMax Token Plan (China) MINIMAX_TOKEN_PLAN_CN_API_KEY, MINIMAX_API_KEY

MiniMax 已将 Coding Plan 更名为 Token Plan。提供商 ID 仍为 minimax-coding-plan / minimax-cn-coding-plan,以匹配 models.dev 与 OpenCode。请使用 Token Plan 密钥 (sk-cp-…),来自 platform.minimax.io (国际)或 platform.minimaxi.com(中国)。

huggingface 是 托管的 Serverless Inference Providers 路由器(https://router.huggingface.co/v1)。 它与 AX Engine 用来存放已下载本地模型的本地 Hugging Face 快照缓存无关 — 连接 huggingface 绝不会启动或要求本地引擎。

若要零成本地首次运行,请参阅 免费层 API 快速入门。它区分提供商的免费 产品与 AX Code 的兼容性,并说明外部免费 API 目录本身并不是支持矩阵。

Grok 仅通过下方列出的 grok-build-cli 提供商获得支持。AX Code 不再包含直接的 xai 云 API 提供商;现有的 Grok API 凭据不会建立连接。

github-copilot 是 GitHub Copilot 账户桥接。它不是某些 免费 API 目录所列出的独立 github-models API。

OpenAI 兼容与 Anthropic 兼容网关也可通过自定义提供商配置获得支持。见 自定义与网关提供商。

私有 GPU 云

这些提供商出现在 /connect 的 私有 GPU 云 下,位于本地 LLM 运行时之后。

选择 自定义提供商 以连接你自己的 OpenAI 兼容 GPU 端点。 输入其 URL 与 API 密钥;AX Code 会从 /v1/models 发现模型,并把 密钥存放在加密的身份验证存储中。已保存的连接仍留在私有 GPU 云中。再次选择它即可选择模型、更换端点或断开连接。 该条目在 custom-private-gpu 下存储一个可配置端点。

目录(API 密钥)

OpenCode 风格的托管 GPU 目录。模型来自随附的 models.dev 快照。使用 API 密钥连接。

提供商 id 显示名称 凭据环境变量
nebius 〔英〕Nebius Token Factory NEBIUS_API_KEY
fireworks-ai 〔英〕Fireworks AI FIREWORKS_API_KEY
togetherai 〔英〕Together AI TOGETHER_API_KEY
baseten 〔英〕Baseten BASETEN_API_KEY
nvidia 〔英〕NVIDIA NIM NVIDIA_API_KEY
deepinfra 〔英〕Deep Infra DEEPINFRA_API_KEY

托管的 Hugging Face 路由器(huggingface / HF_TOKEN)仍位于云 API 提供商中。专用的 Hugging Face Inference Endpoints 列在下方。

专用(URL + 令牌)

PAI 风格的专用 GPU 端点。粘贴 OpenAI 兼容 URL 与令牌;AX Code 会调用 GET …/models 并使用已部署的模型 ID。这些不是 Alibaba Coding Plan / Token Plan(DashScope)提供商。

提供商 id 显示名称 凭据环境变量
alibaba-pai 〔英〕Alibaba PAI-EAS ALIBABA_PAI_API_KEY, ALIBABA_PAI_BASE_URL
runpod 〔英〕RunPod RUNPOD_API_KEY, RUNPOD_BASE_URL
huggingface-endpoints 〔英〕Hugging Face Endpoints HF_ENDPOINTS_TOKEN, HF_ENDPOINTS_BASE_URL
sagemaker 〔英〕Amazon SageMaker SAGEMAKER_API_KEY, SAGEMAKER_BASE_URL
volcengine-ark 〔英〕Volcengine Ark ARK_API_KEY, ARK_BASE_URL
modelarts 〔英〕Huawei ModelArts MODELARTS_API_KEY, MODELARTS_BASE_URL
tencent-ti 〔英〕Tencent TI TENCENT_TI_API_KEY, TENCENT_TI_BASE_URL
custom-private-gpu 自定义提供商 CUSTOM_PRIVATE_GPU_API_KEY, CUSTOM_PRIVATE_GPU_BASE_URL

sagemaker 用于 SageMaker 前面的 OpenAI 兼容 URL(vLLM / TGI / API Gateway)。它不会签署 AWS SigV4。

AX Trust

AX Trust 是 /connect 中的最后一个类别,位于私有 GPU 云之后。选择 连接 AX Trust,输入包含 /v1 的网关基址 URL,并提供 客户端 API 密钥。AX Code 会发现该网关的模型,并把密钥 存放在加密的身份验证存储中。已保存的连接提供模型选择、端点 更新、模型刷新和删除。

重新连接已有 URL 时,若令牌留空,会保留其提供商 ID、模型与已保存密钥。 即使使用自定义名称,该提供商仍位于 AX Trust 中。遗留的 ax-trust 与 ax-trust-* ID 也会出现在此类别中。 AX Trust 继续负责网关策略、批准与审计。 AX Code 默认在这些连接上发送会话亲和性标头。

CLI 提供商

CLI 提供商复用本地厂商 CLI 及其登录/会话,而不是在 AX Code 中存储托管 API 密钥。

提供商 id 显示名称 所需本地命令 支持的模型 id
claude-code 〔英〕Anthropic (Claude Code) claude claude-code
codex-cli 〔英〕OpenAI (Codex CLI) codex codex-cli
grok-build-cli 〔英〕Grok Build CLI grok grok-build-cli
muse-cli 〔英〕Muse Code CLI muse muse-cli

需要时先运行厂商 CLI 登录,然后运行 ax-code providers login <provider-id>。AX Code 会探测该 CLI 命令,并在探测成功后存储一个本地标记凭据。

对于 Muse Code,请安装本地 muse 二进制文件,运行 muse login(或设置 META_API_KEY),然后运行 ax-code providers login muse-cli。AX Code 复用 Muse CLI 会话(~/.config/muse),而不是存储托管的 Meta API 密钥。托管的 meta API 提供商仍然是单独的连接。

托管的 MiniMax Token Plan 仍可通过 minimax-coding-plan / minimax-cn-coding-plan 使用。没有捆绑的 MiniMax Code CLI 或 Kimi Code CLI 提供商。

AX Engine 本地提供商

ax-engine 是内置的本地推理提供商。它仅在符合条件的 Apple Silicon Mac 上可用,并且只提供 AutomatosX Tiel Coder 与 Cyber-Tiel Coder 35B A3B MXFP4 MTP 开发包。模型启动时会检查原生能力。

提供商 id 模型 id 选择 上下文 输出
ax-engine tiel-coder-35b-axq-mxfp4 Tiel Coder 35B A3B MXFP4 MTP(默认) 65,536 8,192
ax-engine cyber-tiel-coder-35b-axq-mxfp4 Cyber-Tiel Coder 35B A3B MXFP4 MTP 65,536 8,192

Qwen3.8 27B、Ornith、Qwen3-Coder-Next 以及所有其他仓库都不在托管选择之列。历史记录仍可读取,用于查看状态和清理。

默认本地模型是 tiel-coder-35b-axq-mxfp4。确切的所选仓库、内存与磁盘指引见 AX Engine 模型选择。

对于现有的、单独配置的回环挂接接口,/v1/models 是权威来源:AX Code 会发现实时模型 ID、上下文/输出限制、模态以及结构化工具调用支持。未声明支持结构化工具调用的模型不会用于编程代理请求。

AX Engine 默认使用紧凑的 core 工具配置档(bash、文件发现/读取/编辑/写入,以及技能)。仅当自定义部署有足够上下文容纳完整工具注册表时,才把 provider.ax-engine.options.toolProfile 设为 full。

安装引擎

本地推理需要 AX Engine 7.5.7 或更高版本。Apple Silicon Mac 安装包已经包含自包含的 AX Engine 边车(CLI 运行时旁边的 engine/<version>/),因此一台全新的 Mac 不需要 Homebrew。

随后 AX Code 按以下顺序解析二进制文件:

  1. provider.ax-engine.options.binaryPath,位于 ax-code.json 中(要求已验证版本至少为 7.5.7)
  2. AX_ENGINE_BIN 环境变量(要求已验证版本至少为 7.5.7)
  3. ax-engine,位于你的 PATH 上(要求已验证版本至少为 7.5.7)
  4. 由 AX Code 管理的叠加安装(ax-code providers ax-engine install;同样要求至少 7.5.7)
  5. 当前 Mac 运行时中捆绑的边车

它首先检查 --version,并回退到 install.version,其来源是 ax-engine doctor --json。Doctor 的退出码报告主机就绪情况(Metal 工具链、MLX 文件),因此当该 JSON 包含版本时,非零退出仍然算数。AX Code 负责服务器启动,通常启动 ax-engine serve,监听 127.0.0.1:31418。可选的 Homebrew formula 仍是希望由 brew 管理引擎的用户的替代方案;它不是必需的。

托管的 Tiel 启动使用目录窗口(65,536 个上下文 token 与 8,192 个输出 token),这大于 ax-engine serve 内置的 16,384 token 默认值,以便放下代理提示词。可用 provider.ax-engine.options.contextTokens 与 provider.ax-engine.options.maxOutputTokens 缩小任一预算(outputTokens 是同一个输出调节项)。环境变量名称是 AX_ENGINE_CONTEXT_TOKENS 与 AX_ENGINE_MAX_OUTPUT_TOKENS(AX_ENGINE_OUTPUT_TOKENS 是别名)。覆盖只能收窄目录上限:更大或无效的值会被报告并忽略,并且不是 1,024 倍数的 Tiel 或 Qwen3.8 窗口会向下对齐,以便前缀缓存块保持 1,024 个 token。同样的数字也是正在运行的服务器与模型限制所使用的数字。一张实时的 /v1/models 卡片可以进一步缩小该窗口,但不能提高它。已配置的选项优先,当某个环境变量值被忽略时,AX Code 会发出警告。当 binaryPath 忽略 AX_ENGINE_BIN,或当 connectionMode / baseURL 忽略 AX_ENGINE_HOST 时,也会发出同样的警告。更小的窗口可能小到放不下完整的代理提示词;此时 AX Code 会拒绝该模型,而不是发送服务器无法容纳的提示词。

Tiel 与 Cyber-Tiel 声明支持结构化工具调用。服务器运行后,实时的 /v1/models 卡片仍会覆盖该声明。即使无法读取二进制版本,mtpPolicy: disabled 也会关闭 MTP;auto 与 required 仍需要 AX Engine 7.4.0 或更高版本。

缺少 libmlx.dylib / mlx.metallib 的 PATH 或叠加安装会被拒绝。捆绑与叠加归档是自包含的 7.5.7 macOS 载荷。

安装引擎并不会下载模型。之后请从桌面 模型 页面或使用 ax-code providers ax-engine prepare 挑选并下载模型。Hugging Face 缓存中已有的完整兼容基础快照会被接受用于直接解码;prepare --download 在可用时使用目录首选的 MTP 包。

使用 /connect -> AX-Engine 运行时 -> 选择模型。当需要所选模型时,AX Code 会自动配置 并启动本地运行时; 不需要 URL 或 API 密钥。查看状态、停止本地运行时 和 禁用 用于管理本地运行时。选择模型也会用托管的本地设置替换遗留的 手动挂接设置。

该引擎仅面向 Apple Silicon macOS 发布。在其他主机上,请使用托管提供商或 OpenAI 兼容的提供商网关;AX Code 服务器仅限本地。