Obter AX Code · GrátisDocumentação

Esta página é uma tradução da documentação em inglês. Comandos, identificadores e exemplos permanecem iguais. Runtime 7.24.4 · SDK 2.6.7. Original em inglês

Provedores e modelos com suporte

Status: Ativo Escopo: estado atual Última revisão: 2026-09-19 Responsável: ax-code runtime

Esta página lista os presets de provedor que o AX Code expõe nos fluxos padrão de configuração. A fonte da verdade é a lista de permissão de provedores do runtime em packages/ax-code/src/provider/default-setup-providers.ts, o instantâneo empacotado de modelos em packages/ax-code/src/provider/models-snapshot.json, os presets de runtime local em packages/ax-code/src/provider/local-runtime.ts e as definições do AX Engine em packages/ax-code/src/provider/ax-engine/constants.ts.

Use /connect na interface do terminal ou ax-code providers login <provider-id> para a configuração interativa. Ambientes headless e de CI também podem fornecer as variáveis de ambiente listadas.

Administrar provedores conectados

A vista da sessão mantém uma barra superior com o ID da sessão (clique para copiar), o título e o status ao vivo, seguida de uma entrada Provedores que mostra a contagem conectada; clique nela ou em administrar para abrir o gerenciador de provedores, que também está disponível como o comando /providers. Dali você pode selecionar um modelo, desativar ou desconectar cada provedor, ou saltar para o fluxo completo /connect.

  • Substituir uma chave: selecione o provedor em /connect e escolha Substituir chave, ou execute de novo ax-code providers login <provider-id>.
  • Desativar por um tempo: escolha Desativar em /providers ou /connect, ou execute ax-code providers disable <provider-id>. Isso acrescenta o provedor a disabled_providers na configuração global e conserva as credenciais salvas. Provedores desativados continuam visíveis em /providers e em Desativados em /connect, e podem ser religados com Ativar ou ax-code providers enable <provider-id>.
  • Desconectar de forma permanente: escolha Desconectar em /providers ou /connect, ou execute ax-code providers logout <provider-id> — isso apaga a credencial armazenada de auth.json.

Os catálogos de modelo hospedados vêm com cada versão do AX Code e são filtrados para capacidades utilizáveis de agente de código. Execute ax-code models <provider-id> para os IDs autoritativos de modelo na versão instalada; o registro bruto e as listas copiadas da web podem conter modelos que o AX Code oculta porque não têm saída de texto nem chamada de ferramenta. Um preset de provedor não implica que todo modelo seja gratuito ou esteja disponível em toda conta.

Escolhas de runtime

Selecionar um modelo sem versão

Tanto a TUI quanto ax-code run aceitam estes nomes de família --model, sem distinção de maiúsculas:

Família Modelo
deepseek deepseek-flash
glm glm-5.3-flash
qwen qwen3.8-flash

Por exemplo, ax-code --model glm abre a TUI com GLM Flash, e ax-code run --model qwen -- "Review this change" pede Qwen Flash. Coloque o prompt depois de -- (ou passe --prompt / --prompt-file); --file anexa arquivos e não é um arquivo de prompt. ax-code models lista IDs utilizáveis de provider/model. Os nomes de família resolvem pelo provedor nativo ou por um gateway conectado que sirva o mesmo modelo. Você também pode nomear o provedor: --model my-gateway/glm. Use um ID completo, como my-gateway/glm-5.3, para pedir uma versão ou um nível específico.

Omitir --model preserva as escolhas configuradas, de agente, de sessão e recentes de modelo. Quando não existe uma escolha utilizável, a ordem compartilhada de alternativa começa com DeepSeek Flash, GLM Flash e depois Qwen Flash, entre os provedores conectados. A configuração de provedor tem os próprios padrões: o Alibaba Coding Plan usa qwen3-coder-plus; o Alibaba Token Plan usa qwen3.8-flash.

Conectar um runtime

As escolhas em /connect estão ordenadas como provedor de API na nuvem, provedor de CLI, runtime AX-Engine, runtime de LLM local, nuvem de GPU privada e AX Trust. O runtime AX-Engine abre direto a seleção de modelo local e a administração do runtime. O runtime de LLM local lista estas escolhas, nesta ordem:

Opção do menu Id do provedor Endpoint padrão Variável de ambiente do host
Ollama ollama http://localhost:11434/v1 OLLAMA_HOST
LMStudio lmstudio http://localhost:1234/v1 LMSTUDIO_HOST
MTPLX mtplx http://localhost:8000/v1 MTPLX_HOST
oMLX omlx http://localhost:8000/v1 OMLX_HOST
AX-Studio ax-studio http://localhost:18080/v1 AX_STUDIO_HOST
Outros local-llm Informe o seu endpoint compatível com a OpenAI LOCAL_LLM_HOST

Os presets de MTPLX e oMLX estão disponíveis no checkout do código-fonte; os binários empacotados da v7.19.3 não os incluem. Veja Configuração de MTPLX e oMLX para a configuração de capacidade de ferramenta, a autenticação opcional e a ressalva da porta padrão compartilhada.

Inicie o servidor local, selecione a entrada do menu e confirme ou edite o endpoint. O AX Code acrescenta /v1 se for omitido. Outros salva um endpoint configurável em local-llm; selecione-o de novo para mudar o endpoint. LMStudio e Outros usam o fluxo local já existente de configuração, sem um prompt de token de API. O LM Studio documenta o endpoint de lista de modelos.

As escolhas de configuração respeitam enabled_providers e disabled_providers. Só abrir o seletor não ativa nem sonda estes servidores locais. Modelos locais externos descobertos conservam padrões conservadores de capacidade; os modelos precisam aceitar chamada de ferramenta para serem selecionáveis em fluxos de agente de código.

Provedores de API na nuvem

Estes provedores chamam APIs hospedadas ou endpoints de plano de conta hospedado.

Id do provedor Nome de exibição Variáveis de ambiente da credencial
google Google, nome mostrado GOOGLE_API_KEY, GOOGLE_GENERATIVE_AI_API_KEY, GEMINI_API_KEY
deepseek DeepSeek, nome mostrado DEEPSEEK_API_KEY
meta Meta (Muse Spark), nome mostrado MODEL_API_KEY, META_MODEL_API_KEY
groq GroqCloud, nome mostrado GROQ_API_KEY
openrouter OpenRouter, nome mostrado OPENROUTER_API_KEY
huggingface Hugging Face, nome mostrado HF_TOKEN
unorouter UnoRouter, nome mostrado UNOROUTER_API_KEY
alibaba-coding-plan Alibaba Coding Plan, nome mostrado ALIBABA_CODING_PLAN_INTL_API_KEY, ALIBABA_CODING_PLAN_API_KEY
alibaba-coding-plan-cn Alibaba Coding Plan (China), nome mostrado ALIBABA_CODING_PLAN_CN_API_KEY, ALIBABA_CODING_PLAN_API_KEY
alibaba-token-plan Alibaba Token Plan, nome mostrado ALIBABA_TOKEN_PLAN_INTL_API_KEY, ALIBABA_TOKEN_PLAN_API_KEY
alibaba-token-plan-cn Alibaba Token Plan (China), nome mostrado ALIBABA_TOKEN_PLAN_CN_API_KEY, ALIBABA_TOKEN_PLAN_API_KEY
github-copilot GitHub Copilot, nome mostrado GITHUB_TOKEN
zai Z.AI, nome mostrado ZHIPU_API_KEY
zai-coding-plan Z.AI Coding Plan, nome mostrado ZHIPU_API_KEY
minimax-coding-plan MiniMax Token Plan, nome mostrado MINIMAX_TOKEN_PLAN_API_KEY, MINIMAX_API_KEY
minimax-cn-coding-plan MiniMax Token Plan (China), nome mostrado MINIMAX_TOKEN_PLAN_CN_API_KEY, MINIMAX_API_KEY

A MiniMax renomeou Coding Plan para Token Plan. Os IDs de provedor continuam minimax-coding-plan / minimax-cn-coding-plan para casar com models.dev e o OpenCode. Use uma chave de Token Plan (sk-cp-…) de platform.minimax.io (internacional) ou platform.minimaxi.com (China).

huggingface é o roteador hospedado Serverless Inference Providers (https://router.huggingface.co/v1). Ele não tem relação com o cache local de instantâneo da Hugging Face que o AX Engine usa para guardar modelos locais baixados — conectar huggingface nunca inicia nem exige o motor local.

Para uma primeira execução sem custo, veja Início rápido das APIs de nível gratuito. Ele distingue a oferta gratuita de um provedor da compatibilidade do AX Code e explica por que um catálogo externo de API gratuita não é, por si, uma matriz de suporte.

O Grok só tem suporte pelo provedor grok-build-cli listado abaixo. O AX Code não inclui mais um provedor direto de API na nuvem xai; credenciais existentes da API do Grok não criam uma conexão.

github-copilot é a ponte da conta do GitHub Copilot. Não é a API separada github-models listada por alguns diretórios de API gratuita.

Gateways compatíveis com a OpenAI e com a Anthropic também têm suporte por configuração de provedor personalizado. Veja Provedores personalizados e gateways.

Nuvem de GPU privada

Estes provedores aparecem em /connect em Nuvem de GPU privada, depois do runtime de LLM local.

Escolha Provedor personalizado para conectar o seu próprio endpoint de GPU compatível com a OpenAI. Informe a URL e a chave de API; o AX Code descobre modelos a partir de /v1/models e guarda a chave no armazenamento criptografado de autenticação. A conexão salva permanece em Nuvem de GPU privada. Selecione-a de novo para escolher um modelo, substituir o endpoint ou desconectar. Esta entrada guarda um endpoint configurável em custom-private-gpu.

Catálogo (chave de API)

Catálogos de GPU hospedada no estilo OpenCode. Os modelos vêm do instantâneo empacotado do models.dev. Conecte com uma chave de API.

Id do provedor Nome de exibição Variáveis de ambiente da credencial
nebius Nebius Token Factory, nome mostrado NEBIUS_API_KEY
fireworks-ai Fireworks AI, nome mostrado FIREWORKS_API_KEY
togetherai Together AI, nome mostrado TOGETHER_API_KEY
baseten Baseten, nome mostrado BASETEN_API_KEY
nvidia NVIDIA NIM, nome mostrado NVIDIA_API_KEY
deepinfra Deep Infra, nome mostrado DEEPINFRA_API_KEY

O roteador hospedado da Hugging Face (huggingface / HF_TOKEN) permanece em Provedores de API na nuvem. Endpoints dedicados de inferência da Hugging Face estão listados abaixo.

Dedicado (URL + token)

Endpoints dedicados de GPU no estilo PAI. Cole a URL compatível com a OpenAI e o token; o AX Code chama GET …/models e usa os IDs do modelo implantado. Estes não são provedores Alibaba Coding Plan / Token Plan (DashScope).

Id do provedor Nome de exibição Variáveis de ambiente da credencial
alibaba-pai Alibaba PAI-EAS, nome mostrado ALIBABA_PAI_API_KEY, ALIBABA_PAI_BASE_URL
runpod RunPod, nome mostrado RUNPOD_API_KEY, RUNPOD_BASE_URL
huggingface-endpoints Hugging Face Endpoints, nome mostrado HF_ENDPOINTS_TOKEN, HF_ENDPOINTS_BASE_URL
sagemaker Amazon SageMaker, nome mostrado SAGEMAKER_API_KEY, SAGEMAKER_BASE_URL
volcengine-ark Volcengine Ark, nome mostrado ARK_API_KEY, ARK_BASE_URL
modelarts Huawei ModelArts, nome mostrado MODELARTS_API_KEY, MODELARTS_BASE_URL
tencent-ti Tencent TI, nome mostrado TENCENT_TI_API_KEY, TENCENT_TI_BASE_URL
custom-private-gpu Provedor personalizado, nome mostrado CUSTOM_PRIVATE_GPU_API_KEY, CUSTOM_PRIVATE_GPU_BASE_URL

sagemaker é para uma URL compatível com a OpenAI na frente do SageMaker (vLLM / TGI / API Gateway). Ele não assina AWS SigV4.

AX Trust

O AX Trust é a última categoria em /connect, depois da nuvem de GPU privada. Escolha Conectar AX Trust, informe a URL base do gateway inclusive /v1 e forneça a chave de API do cliente. O AX Code descobre os modelos do gateway e guarda a chave no armazenamento criptografado de autenticação. Conexões salvas oferecem seleção de modelo, atualização de endpoint, atualização de modelos e exclusão.

Reconectar uma URL existente preserva o ID do provedor, os modelos e a chave salva quando o token é deixado em branco. O provedor permanece no AX Trust mesmo com um nome personalizado. IDs legados ax-trust e ax-trust-* também aparecem nesta categoria. O AX Trust continua sendo dono da política do gateway, das aprovações e da auditoria. O AX Code envia um cabeçalho de afinidade de sessão nestas conexões, por padrão.

Provedores de CLI

Provedores de CLI reutilizam uma CLI local do fornecedor e o login ou a sessão dela, em vez de guardar uma chave de API hospedada no AX Code.

Id do provedor Nome de exibição Comando local exigido Id de modelo com suporte
claude-code Anthropic (Claude Code), nome mostrado claude claude-code
codex-cli OpenAI (Codex CLI), nome mostrado codex codex-cli
grok-build-cli Grok Build CLI, nome mostrado grok grok-build-cli
muse-cli Muse Code CLI, nome mostrado muse muse-cli

Execute primeiro o login da CLI do fornecedor, quando for exigido, e depois execute ax-code providers login <provider-id>. O AX Code sonda o comando da CLI e guarda uma credencial local de marcador depois que a sonda passa.

Para o Muse Code, instale o binário local muse, execute muse login (ou defina META_API_KEY) e depois ax-code providers login muse-cli. O AX Code reutiliza a sessão da CLI Muse (~/.config/muse), em vez de guardar uma chave de API hospedada da Meta. O provedor de API hospedada meta continua sendo uma conexão separada.

O MiniMax Token Plan hospedado continua disponível como minimax-coding-plan / minimax-cn-coding-plan. Não há um provedor empacotado de MiniMax Code CLI nem de Kimi Code CLI.

Provedor local do AX Engine

ax-engine é o provedor embutido de inferência local. Ele só está disponível em Macs Apple Silicon elegíveis e oferece apenas os pacotes de desenvolvimento AutomatosX Tiel Coder e Cyber-Tiel Coder 35B A3B MXFP4 MTP. As capacidades nativas são conferidas quando o modelo inicia.

Id do provedor Id do modelo Seleção Contexto Saída
ax-engine tiel-coder-35b-axq-mxfp4 Tiel Coder 35B A3B MXFP4 MTP (padrão) 65,536 8,192
ax-engine cyber-tiel-coder-35b-axq-mxfp4 Cyber-Tiel Coder 35B A3B MXFP4 MTP 65,536 8,192

Qwen3.8 27B, Ornith, Qwen3-Coder-Next e todos os outros repositórios ficam de fora da seleção gerenciada. Registros históricos continuam legíveis para status e limpeza.

O modelo local padrão é tiel-coder-35b-axq-mxfp4. Veja Seleção de modelo do AX Engine para os repositórios exatos selecionados e a orientação de memória e de disco.

Para a interface já existente de anexação em loopback, configurada à parte, /v1/models é autoritativo: o AX Code descobre os IDs ao vivo de modelo, os limites de contexto e de saída, as modalidades e o suporte a chamada estruturada de ferramenta. Um modelo que não anuncia chamada estruturada de ferramenta não é usado em solicitações de agente de código.

O AX Engine usa por padrão o perfil compacto de ferramentas core (bash, descoberta, leitura, edição e gravação de arquivo, e skills). Defina provider.ax-engine.options.toolProfile como full somente para uma implantação personalizada com contexto suficiente para o registro completo de ferramentas.

Instalar o motor

A inferência local precisa do AX Engine 7.5.7 ou posterior. Os instaladores de Mac Apple Silicon já incluem um sidecar autossuficiente do AX Engine (engine/<version>/ ao lado do runtime da CLI), então um Mac limpo não precisa de Homebrew.

O AX Code então resolve o binário nesta ordem:

  1. provider.ax-engine.options.binaryPath em ax-code.json (exige uma versão verificada de pelo menos 7.5.7)
  2. a variável de ambiente AX_ENGINE_BIN (exige uma versão verificada de pelo menos 7.5.7)
  3. ax-engine no seu PATH (exige uma versão verificada de pelo menos 7.5.7)
  4. uma instalação de sobreposição administrada pelo AX Code (ax-code providers ax-engine install; também exige pelo menos 7.5.7)
  5. o sidecar empacotado no runtime atual do Mac

Ele confere primeiro --version e recua para install.version a partir de ax-engine doctor --json. O código de saída do doctor informa a prontidão do host (cadeia Metal, arquivos MLX), então uma saída diferente de zero ainda conta quando esse JSON contém uma versão. O AX Code é dono da partida do servidor e, em geral, lança ax-engine serve em 127.0.0.1:31418. A fórmula opcional do Homebrew continua sendo uma alternativa para quem quer um motor de posse do brew; ela não é exigida.

Lançamentos gerenciados do Tiel usam a janela do catálogo (65,536 tokens de contexto e 8,192 tokens de saída), que é maior do que o padrão embutido de 16,384 tokens de ax-engine serve, para que o prompt do agente caiba. Encolha qualquer um dos orçamentos com provider.ax-engine.options.contextTokens e provider.ax-engine.options.maxOutputTokens (outputTokens é o mesmo controle de saída). Os nomes de ambiente são AX_ENGINE_CONTEXT_TOKENS e AX_ENGINE_MAX_OUTPUT_TOKENS (AX_ENGINE_OUTPUT_TOKENS é um alias). Uma substituição só pode estreitar o teto do catálogo: um valor maior ou inválido é informado e ignorado, e uma janela de Tiel ou de Qwen3.8 que não seja múltiplo de 1,024 é arredondada para baixo, para que os blocos de cache de prefixo continuem com 1,024 tokens. Os mesmos números são os que o servidor em execução e o limite do modelo usam. Um cartão ao vivo /v1/models pode encolher mais essa janela, e não pode elevá-la. Opções configuradas prevalecem, e o AX Code avisa quando um valor de ambiente é ignorado. O mesmo aviso é emitido quando binaryPath ignora AX_ENGINE_BIN, ou quando connectionMode / baseURL ignora AX_ENGINE_HOST. Uma janela menor pode ser pequena demais para o prompt completo do agente; o AX Code então recusa o modelo, em vez de enviar um prompt que o servidor não consegue guardar.

Tiel e Cyber-Tiel anunciam chamada estruturada de ferramenta. Um cartão ao vivo /v1/models ainda substitui esse anúncio depois que o servidor está em execução. mtpPolicy: disabled desliga o MTP mesmo quando a versão do binário não pode ser lida; auto e required ainda precisam do AX Engine 7.4.0 ou mais novo.

Uma instalação de PATH ou de sobreposição a que falte libmlx.dylib / mlx.metallib é rejeitada. Os arquivos empacotados e de sobreposição são a carga autossuficiente 7.5.7 do macOS.

Instalar o motor não baixa um modelo. Escolha e baixe um modelo depois, pela página Modelos do Desktop ou com ax-code providers ax-engine prepare. Um instantâneo base completo e compatível que já esteja no cache da Hugging Face é aceito para decodificação direta; prepare --download usa o pacote MTP preferido do catálogo, quando disponível.

Use /connect -> runtime AX-Engine -> Selecionar um modelo. O AX Code configura e inicia o runtime local de forma automática quando o modelo selecionado é necessário; não é preciso URL nem chave de API. Ver status, Parar runtime local e Desativar administram o runtime local. Selecionar um modelo também substitui ajustes legados de anexação manual pela configuração local gerenciada.

O motor é distribuído só para macOS em Apple Silicon. Em outros hosts, use um provedor hospedado ou um gateway de provedor compatível com a OpenAI; os servidores do AX Code são só locais.