Esta página é uma tradução da documentação em inglês. Comandos, identificadores e exemplos permanecem iguais. Runtime 7.24.4 · SDK 2.6.7. Original em inglês
Provedores e modelos com suporte
Status: Ativo Escopo: estado atual Última revisão: 2026-09-19 Responsável: ax-code runtime
Esta página lista os presets de provedor que o AX Code expõe nos fluxos padrão de configuração. A fonte da verdade é a lista de permissão de provedores do runtime em
packages/ax-code/src/provider/default-setup-providers.ts, o instantâneo empacotado de modelos em
packages/ax-code/src/provider/models-snapshot.json, os presets de runtime local em
packages/ax-code/src/provider/local-runtime.ts e as definições do AX Engine em
packages/ax-code/src/provider/ax-engine/constants.ts.
Use /connect na interface do terminal ou ax-code providers login <provider-id> para a configuração interativa. Ambientes headless e de CI também podem fornecer as variáveis de ambiente listadas.
Administrar provedores conectados
A vista da sessão mantém uma barra superior com o ID da sessão (clique para copiar), o título e o status ao vivo, seguida de uma entrada Provedores que mostra a contagem conectada; clique nela ou em administrar para abrir o gerenciador de provedores, que também está disponível como o comando /providers. Dali você pode selecionar um modelo, desativar ou desconectar cada provedor, ou saltar para o fluxo completo /connect.
- Substituir uma chave: selecione o provedor em
/connecte escolha Substituir chave, ou execute de novoax-code providers login <provider-id>. - Desativar por um tempo: escolha Desativar em
/providersou/connect, ou executeax-code providers disable <provider-id>. Isso acrescenta o provedor adisabled_providersna configuração global e conserva as credenciais salvas. Provedores desativados continuam visíveis em/providerse em Desativados em/connect, e podem ser religados com Ativar ouax-code providers enable <provider-id>. - Desconectar de forma permanente: escolha Desconectar em
/providersou/connect, ou executeax-code providers logout <provider-id>— isso apaga a credencial armazenada deauth.json.
Os catálogos de modelo hospedados vêm com cada versão do AX Code e são filtrados para capacidades utilizáveis de agente de código. Execute
ax-code models <provider-id> para os IDs autoritativos de modelo na versão instalada; o registro bruto e as listas
copiadas da web podem conter modelos que o AX Code oculta porque não têm saída de texto nem chamada de ferramenta. Um preset de provedor não
implica que todo modelo seja gratuito ou esteja disponível em toda conta.
Escolhas de runtime
Selecionar um modelo sem versão
Tanto a TUI quanto ax-code run aceitam estes nomes de família --model, sem distinção de maiúsculas:
| Família | Modelo |
|---|---|
deepseek |
deepseek-flash |
glm |
glm-5.3-flash |
qwen |
qwen3.8-flash |
Por exemplo, ax-code --model glm abre a TUI com GLM Flash, e
ax-code run --model qwen -- "Review this change" pede Qwen Flash.
Coloque o prompt depois de -- (ou passe --prompt / --prompt-file); --file anexa
arquivos e não é um arquivo de prompt. ax-code models lista IDs utilizáveis de provider/model.
Os nomes de família resolvem pelo provedor nativo ou por um gateway conectado que sirva
o mesmo modelo. Você também pode nomear o provedor: --model my-gateway/glm.
Use um ID completo, como my-gateway/glm-5.3, para pedir uma versão ou um nível específico.
Omitir --model preserva as escolhas configuradas, de agente, de sessão e recentes de modelo.
Quando não existe uma escolha utilizável, a ordem compartilhada de alternativa começa com DeepSeek Flash,
GLM Flash e depois Qwen Flash, entre os provedores conectados. A configuração de provedor tem os próprios
padrões: o Alibaba Coding Plan usa qwen3-coder-plus; o Alibaba Token Plan usa
qwen3.8-flash.
Conectar um runtime
As escolhas em /connect estão ordenadas como provedor de API na nuvem, provedor de CLI,
runtime AX-Engine, runtime de LLM local, nuvem de GPU privada e AX Trust.
O runtime AX-Engine abre direto a seleção de modelo local e a administração do runtime.
O runtime de LLM local lista estas escolhas, nesta ordem:
| Opção do menu | Id do provedor | Endpoint padrão | Variável de ambiente do host |
|---|---|---|---|
| Ollama | ollama |
http://localhost:11434/v1 |
OLLAMA_HOST |
| LMStudio | lmstudio |
http://localhost:1234/v1 |
LMSTUDIO_HOST |
| MTPLX | mtplx |
http://localhost:8000/v1 |
MTPLX_HOST |
| oMLX | omlx |
http://localhost:8000/v1 |
OMLX_HOST |
| AX-Studio | ax-studio |
http://localhost:18080/v1 |
AX_STUDIO_HOST |
| Outros | local-llm |
Informe o seu endpoint compatível com a OpenAI | LOCAL_LLM_HOST |
Os presets de MTPLX e oMLX estão disponíveis no checkout do código-fonte; os binários empacotados da v7.19.3 não os incluem. Veja Configuração de MTPLX e oMLX para a configuração de capacidade de ferramenta, a autenticação opcional e a ressalva da porta padrão compartilhada.
Inicie o servidor local, selecione a entrada do menu e confirme ou edite o endpoint.
O AX Code acrescenta /v1 se for omitido. Outros salva um endpoint configurável em
local-llm; selecione-o de novo para mudar o endpoint. LMStudio e Outros usam o
fluxo local já existente de configuração, sem um prompt de token de API. O LM Studio documenta o
endpoint de lista de modelos.
As escolhas de configuração respeitam enabled_providers e disabled_providers. Só abrir
o seletor não ativa nem sonda estes servidores locais. Modelos locais externos
descobertos conservam padrões conservadores de capacidade; os modelos precisam aceitar chamada de
ferramenta para serem selecionáveis em fluxos de agente de código.
Provedores de API na nuvem
Estes provedores chamam APIs hospedadas ou endpoints de plano de conta hospedado.
| Id do provedor | Nome de exibição | Variáveis de ambiente da credencial |
|---|---|---|
google |
Google, nome mostrado | GOOGLE_API_KEY, GOOGLE_GENERATIVE_AI_API_KEY, GEMINI_API_KEY |
deepseek |
DeepSeek, nome mostrado | DEEPSEEK_API_KEY |
meta |
Meta (Muse Spark), nome mostrado | MODEL_API_KEY, META_MODEL_API_KEY |
groq |
GroqCloud, nome mostrado | GROQ_API_KEY |
openrouter |
OpenRouter, nome mostrado | OPENROUTER_API_KEY |
huggingface |
Hugging Face, nome mostrado | HF_TOKEN |
unorouter |
UnoRouter, nome mostrado | UNOROUTER_API_KEY |
alibaba-coding-plan |
Alibaba Coding Plan, nome mostrado | ALIBABA_CODING_PLAN_INTL_API_KEY, ALIBABA_CODING_PLAN_API_KEY |
alibaba-coding-plan-cn |
Alibaba Coding Plan (China), nome mostrado | ALIBABA_CODING_PLAN_CN_API_KEY, ALIBABA_CODING_PLAN_API_KEY |
alibaba-token-plan |
Alibaba Token Plan, nome mostrado | ALIBABA_TOKEN_PLAN_INTL_API_KEY, ALIBABA_TOKEN_PLAN_API_KEY |
alibaba-token-plan-cn |
Alibaba Token Plan (China), nome mostrado | ALIBABA_TOKEN_PLAN_CN_API_KEY, ALIBABA_TOKEN_PLAN_API_KEY |
github-copilot |
GitHub Copilot, nome mostrado | GITHUB_TOKEN |
zai |
Z.AI, nome mostrado | ZHIPU_API_KEY |
zai-coding-plan |
Z.AI Coding Plan, nome mostrado | ZHIPU_API_KEY |
minimax-coding-plan |
MiniMax Token Plan, nome mostrado | MINIMAX_TOKEN_PLAN_API_KEY, MINIMAX_API_KEY |
minimax-cn-coding-plan |
MiniMax Token Plan (China), nome mostrado | MINIMAX_TOKEN_PLAN_CN_API_KEY, MINIMAX_API_KEY |
A MiniMax renomeou Coding Plan para Token Plan. Os IDs de provedor continuam minimax-coding-plan /
minimax-cn-coding-plan para casar com models.dev e o OpenCode. Use uma chave de Token Plan
(sk-cp-…) de platform.minimax.io
(internacional) ou platform.minimaxi.com (China).
huggingfaceé o roteador hospedado Serverless Inference Providers (https://router.huggingface.co/v1). Ele não tem relação com o cache local de instantâneo da Hugging Face que o AX Engine usa para guardar modelos locais baixados — conectarhuggingfacenunca inicia nem exige o motor local.
Para uma primeira execução sem custo, veja Início rápido das APIs de nível gratuito. Ele distingue a oferta gratuita de um provedor da compatibilidade do AX Code e explica por que um catálogo externo de API gratuita não é, por si, uma matriz de suporte.
O Grok só tem suporte pelo provedor grok-build-cli listado abaixo. O AX Code não inclui mais um provedor direto de API na nuvem xai; credenciais existentes da API do Grok não criam uma conexão.
github-copilot é a ponte da conta do GitHub Copilot. Não é a API separada github-models listada por alguns
diretórios de API gratuita.
Gateways compatíveis com a OpenAI e com a Anthropic também têm suporte por configuração de provedor personalizado. Veja Provedores personalizados e gateways.
Nuvem de GPU privada
Estes provedores aparecem em /connect em Nuvem de GPU privada, depois do runtime de LLM local.
Escolha Provedor personalizado para conectar o seu próprio endpoint de GPU compatível com a OpenAI.
Informe a URL e a chave de API; o AX Code descobre modelos a partir de /v1/models e guarda
a chave no armazenamento criptografado de autenticação. A conexão salva permanece em Nuvem de GPU
privada. Selecione-a de novo para escolher um modelo, substituir o endpoint ou desconectar.
Esta entrada guarda um endpoint configurável em custom-private-gpu.
Catálogo (chave de API)
Catálogos de GPU hospedada no estilo OpenCode. Os modelos vêm do instantâneo empacotado do models.dev. Conecte com uma chave de API.
| Id do provedor | Nome de exibição | Variáveis de ambiente da credencial |
|---|---|---|
nebius |
Nebius Token Factory, nome mostrado | NEBIUS_API_KEY |
fireworks-ai |
Fireworks AI, nome mostrado | FIREWORKS_API_KEY |
togetherai |
Together AI, nome mostrado | TOGETHER_API_KEY |
baseten |
Baseten, nome mostrado | BASETEN_API_KEY |
nvidia |
NVIDIA NIM, nome mostrado | NVIDIA_API_KEY |
deepinfra |
Deep Infra, nome mostrado | DEEPINFRA_API_KEY |
O roteador hospedado da Hugging Face (huggingface / HF_TOKEN) permanece em Provedores de API na nuvem. Endpoints dedicados de inferência da Hugging Face estão listados abaixo.
Dedicado (URL + token)
Endpoints dedicados de GPU no estilo PAI. Cole a URL compatível com a OpenAI e o token; o AX Code chama GET …/models e usa os IDs do modelo implantado. Estes não são provedores Alibaba Coding Plan / Token Plan (DashScope).
| Id do provedor | Nome de exibição | Variáveis de ambiente da credencial |
|---|---|---|
alibaba-pai |
Alibaba PAI-EAS, nome mostrado | ALIBABA_PAI_API_KEY, ALIBABA_PAI_BASE_URL |
runpod |
RunPod, nome mostrado | RUNPOD_API_KEY, RUNPOD_BASE_URL |
huggingface-endpoints |
Hugging Face Endpoints, nome mostrado | HF_ENDPOINTS_TOKEN, HF_ENDPOINTS_BASE_URL |
sagemaker |
Amazon SageMaker, nome mostrado | SAGEMAKER_API_KEY, SAGEMAKER_BASE_URL |
volcengine-ark |
Volcengine Ark, nome mostrado | ARK_API_KEY, ARK_BASE_URL |
modelarts |
Huawei ModelArts, nome mostrado | MODELARTS_API_KEY, MODELARTS_BASE_URL |
tencent-ti |
Tencent TI, nome mostrado | TENCENT_TI_API_KEY, TENCENT_TI_BASE_URL |
custom-private-gpu |
Provedor personalizado, nome mostrado | CUSTOM_PRIVATE_GPU_API_KEY, CUSTOM_PRIVATE_GPU_BASE_URL |
sagemaker é para uma URL compatível com a OpenAI na frente do SageMaker (vLLM / TGI / API Gateway). Ele não assina AWS SigV4.
AX Trust
O AX Trust é a última categoria em /connect, depois da nuvem de GPU privada. Escolha
Conectar AX Trust, informe a URL base do gateway inclusive /v1 e forneça
a chave de API do cliente. O AX Code descobre os modelos do gateway e guarda a chave
no armazenamento criptografado de autenticação. Conexões salvas oferecem seleção de modelo, atualização
de endpoint, atualização de modelos e exclusão.
Reconectar uma URL existente preserva o ID do provedor, os modelos e a chave salva
quando o token é deixado em branco. O provedor permanece no AX Trust mesmo com um
nome personalizado. IDs legados ax-trust e ax-trust-* também aparecem nesta categoria.
O AX Trust continua sendo dono da política do gateway, das aprovações e da auditoria.
O AX Code envia um cabeçalho de afinidade de sessão nestas conexões, por padrão.
Provedores de CLI
Provedores de CLI reutilizam uma CLI local do fornecedor e o login ou a sessão dela, em vez de guardar uma chave de API hospedada no AX Code.
| Id do provedor | Nome de exibição | Comando local exigido | Id de modelo com suporte |
|---|---|---|---|
claude-code |
Anthropic (Claude Code), nome mostrado | claude |
claude-code |
codex-cli |
OpenAI (Codex CLI), nome mostrado | codex |
codex-cli |
grok-build-cli |
Grok Build CLI, nome mostrado | grok |
grok-build-cli |
muse-cli |
Muse Code CLI, nome mostrado | muse |
muse-cli |
Execute primeiro o login da CLI do fornecedor, quando for exigido, e depois execute ax-code providers login <provider-id>. O AX Code sonda o comando da CLI e guarda uma credencial local de marcador depois que a sonda passa.
Para o Muse Code, instale o binário local muse, execute muse login (ou defina META_API_KEY) e depois ax-code providers login muse-cli. O AX Code reutiliza a sessão da CLI Muse (~/.config/muse), em vez de guardar uma chave de API hospedada da Meta. O provedor de API hospedada meta continua sendo uma conexão separada.
O MiniMax Token Plan hospedado continua disponível como minimax-coding-plan / minimax-cn-coding-plan. Não há um provedor empacotado de MiniMax Code CLI nem de Kimi Code CLI.
Provedor local do AX Engine
ax-engine é o provedor embutido de inferência local. Ele só está disponível em Macs Apple Silicon elegíveis e oferece apenas os pacotes de desenvolvimento AutomatosX Tiel Coder e Cyber-Tiel Coder 35B A3B MXFP4 MTP. As capacidades nativas são conferidas quando o modelo inicia.
| Id do provedor | Id do modelo | Seleção | Contexto | Saída |
|---|---|---|---|---|
ax-engine |
tiel-coder-35b-axq-mxfp4 |
Tiel Coder 35B A3B MXFP4 MTP (padrão) | 65,536 | 8,192 |
ax-engine |
cyber-tiel-coder-35b-axq-mxfp4 |
Cyber-Tiel Coder 35B A3B MXFP4 MTP | 65,536 | 8,192 |
Qwen3.8 27B, Ornith, Qwen3-Coder-Next e todos os outros repositórios ficam de fora da seleção gerenciada. Registros históricos continuam legíveis para status e limpeza.
O modelo local padrão é tiel-coder-35b-axq-mxfp4. Veja Seleção de modelo do AX Engine para os repositórios exatos selecionados e a orientação de memória e de disco.
Para a interface já existente de anexação em loopback, configurada à parte, /v1/models é autoritativo: o AX Code descobre os IDs ao vivo de modelo, os limites de contexto e de saída, as modalidades e o suporte a chamada estruturada de ferramenta. Um modelo que não anuncia chamada estruturada de ferramenta não é usado em solicitações de agente de código.
O AX Engine usa por padrão o perfil compacto de ferramentas core (bash, descoberta, leitura, edição e gravação de arquivo, e skills). Defina provider.ax-engine.options.toolProfile como full somente para uma implantação personalizada com contexto suficiente para o registro completo de ferramentas.
Instalar o motor
A inferência local precisa do AX Engine 7.5.7 ou posterior. Os instaladores de Mac Apple Silicon já incluem um sidecar autossuficiente do AX Engine (engine/<version>/ ao lado do runtime da CLI), então um Mac limpo não precisa de Homebrew.
O AX Code então resolve o binário nesta ordem:
provider.ax-engine.options.binaryPathemax-code.json(exige uma versão verificada de pelo menos 7.5.7)- a variável de ambiente
AX_ENGINE_BIN(exige uma versão verificada de pelo menos 7.5.7) ax-engineno seuPATH(exige uma versão verificada de pelo menos 7.5.7)- uma instalação de sobreposição administrada pelo AX Code (
ax-code providers ax-engine install; também exige pelo menos 7.5.7) - o sidecar empacotado no runtime atual do Mac
Ele confere primeiro --version e recua para install.version a partir de ax-engine doctor --json. O código de saída do doctor informa a prontidão do host (cadeia Metal, arquivos MLX), então uma saída diferente de zero ainda conta quando esse JSON contém uma versão. O AX Code é dono da partida do servidor e, em geral, lança ax-engine serve em 127.0.0.1:31418. A fórmula opcional do Homebrew continua sendo uma alternativa para quem quer um motor de posse do brew; ela não é exigida.
Lançamentos gerenciados do Tiel usam a janela do catálogo (65,536 tokens de contexto e 8,192 tokens de saída), que é maior do que o padrão embutido de 16,384 tokens de ax-engine serve, para que o prompt do agente caiba. Encolha qualquer um dos orçamentos com provider.ax-engine.options.contextTokens e provider.ax-engine.options.maxOutputTokens (outputTokens é o mesmo controle de saída). Os nomes de ambiente são AX_ENGINE_CONTEXT_TOKENS e AX_ENGINE_MAX_OUTPUT_TOKENS (AX_ENGINE_OUTPUT_TOKENS é um alias). Uma substituição só pode estreitar o teto do catálogo: um valor maior ou inválido é informado e ignorado, e uma janela de Tiel ou de Qwen3.8 que não seja múltiplo de 1,024 é arredondada para baixo, para que os blocos de cache de prefixo continuem com 1,024 tokens. Os mesmos números são os que o servidor em execução e o limite do modelo usam. Um cartão ao vivo /v1/models pode encolher mais essa janela, e não pode elevá-la. Opções configuradas prevalecem, e o AX Code avisa quando um valor de ambiente é ignorado. O mesmo aviso é emitido quando binaryPath ignora AX_ENGINE_BIN, ou quando connectionMode / baseURL ignora AX_ENGINE_HOST. Uma janela menor pode ser pequena demais para o prompt completo do agente; o AX Code então recusa o modelo, em vez de enviar um prompt que o servidor não consegue guardar.
Tiel e Cyber-Tiel anunciam chamada estruturada de ferramenta. Um cartão ao vivo /v1/models ainda substitui esse anúncio depois que o servidor está em execução. mtpPolicy: disabled desliga o MTP mesmo quando a versão do binário não pode ser lida; auto e required ainda precisam do AX Engine 7.4.0 ou mais novo.
Uma instalação de PATH ou de sobreposição a que falte libmlx.dylib / mlx.metallib é rejeitada. Os arquivos empacotados e de sobreposição são a carga autossuficiente 7.5.7 do macOS.
Instalar o motor não baixa um modelo. Escolha e baixe um modelo depois, pela página Modelos do Desktop ou com ax-code providers ax-engine prepare. Um instantâneo base completo e compatível que já esteja no cache da Hugging Face é aceito para decodificação direta; prepare --download usa o pacote MTP preferido do catálogo, quando disponível.
Use /connect -> runtime AX-Engine -> Selecionar um modelo. O AX Code configura
e inicia o runtime local de forma automática quando o modelo selecionado é necessário;
não é preciso URL nem chave de API. Ver status, Parar runtime local e
Desativar administram o runtime local. Selecionar um modelo também substitui ajustes legados
de anexação manual pela configuração local gerenciada.
O motor é distribuído só para macOS em Apple Silicon. Em outros hosts, use um provedor hospedado ou um gateway de provedor compatível com a OpenAI; os servidores do AX Code são só locais.