Esta página es una traducción de la documentación en inglés. Los comandos, identificadores y ejemplos no cambian. Runtime 7.24.4 · SDK 2.6.7. Original en inglés
Proveedores y modelos compatibles
Estado: Activo Alcance: estado actual Última revisión: 2026-09-19 Responsable: runtime de ax-code
Esta página enumera los ajustes predefinidos de proveedores que AX Code muestra en los flujos de configuración predeterminados. La fuente de verdad es la lista de permitidos de proveedores del entorno de ejecución en
packages/ax-code/src/provider/default-setup-providers.ts, la instantánea de modelos incluida en
packages/ax-code/src/provider/models-snapshot.json, los ajustes predefinidos del entorno de ejecución local en
packages/ax-code/src/provider/local-runtime.ts y las definiciones de AX Engine en
packages/ax-code/src/provider/ax-engine/constants.ts.
Usa /connect en la interfaz de terminal o ax-code providers login <provider-id> para la configuración interactiva. Los entornos sin interfaz y de CI también pueden aportar las variables de entorno indicadas.
Gestión de proveedores conectados
La vista de sesión mantiene una barra superior con el ID de sesión (clic para copiar), el título y el estado en vivo, seguida de una entrada Proveedores que muestra el recuento de conexiones; haz clic en ella o en gestionar para abrir el gestor de proveedores, también disponible como el comando /providers. Desde ahí puedes elegir un modelo, desactivar o desconectar cada proveedor, o saltar al flujo completo de /connect.
- Sustituir una clave: selecciona el proveedor en
/connecty elige Sustituir clave, o vuelve a ejecutarax-code providers login <provider-id>. - Desactivar temporalmente: elige Desactivar en
/providerso/connect, o ejecutaax-code providers disable <provider-id>. Esto añade el proveedor adisabled_providersen la configuración global y conserva las credenciales guardadas. Los proveedores desactivados siguen visibles en/providersy bajo Desactivados en/connect, y pueden reactivarse con Activar oax-code providers enable <provider-id>. - Desconectar de forma permanente: elige Desconectar en
/providerso/connect, o ejecutaax-code providers logout <provider-id>: esto borra la credencial almacenada deauth.json.
Los catálogos de modelos alojados se incluyen con cada versión de AX Code y se filtran según capacidades útiles de agente de programación. Ejecuta
ax-code models <provider-id> para obtener los ID de modelo autorizados de tu versión instalada; el registro en bruto y las listas
web copiadas pueden contener modelos que AX Code oculta porque no tienen salida de texto ni llamadas a herramientas. Un ajuste predefinido de proveedor no
implica que todos los modelos sean gratuitos o estén disponibles en todas las cuentas.
Opciones del entorno de ejecución
Selección de un modelo sin versión
Tanto la TUI como ax-code run aceptan estos nombres de familia --model sin distinguir mayúsculas:
| Familia | Modelo |
|---|---|
deepseek |
deepseek-flash |
glm |
glm-5.3-flash |
qwen |
qwen3.8-flash |
Por ejemplo, ax-code --model glm abre la TUI con GLM Flash y
ax-code run --model qwen -- "Review this change" solicita Qwen Flash.
Coloca el prompt después de -- (o pasa --prompt / --prompt-file); --file adjunta
archivos y no es un archivo de prompt. ax-code models enumera los ID provider/model utilizables.
Los nombres de familia se resuelven mediante el proveedor nativo o una pasarela conectada que sirva
el mismo modelo. También puedes nombrar el proveedor: --model my-gateway/glm.
Usa un ID completo como my-gateway/glm-5.3 para pedir una versión o un nivel concretos.
Omitir --model conserva las elecciones de modelo configuradas, del agente, de la sesión y recientes.
Cuando no hay una elección utilizable, el orden de reserva compartido empieza por DeepSeek Flash,
luego GLM Flash y después Qwen Flash entre los proveedores conectados. La configuración de proveedores tiene sus propios
valores predeterminados: Alibaba Coding Plan usa qwen3-coder-plus; Alibaba Token Plan usa
qwen3.8-flash.
Conexión de un entorno de ejecución
Las opciones de /connect se ordenan así: Proveedor de API en la nube, Proveedor CLI,
Entorno de ejecución AX-Engine, Entorno de ejecución de LLM local, Nube de GPU privada y AX Trust.
El entorno de ejecución AX-Engine abre directamente la selección de modelos locales y la gestión del entorno.
El entorno de ejecución de LLM local enumera estas opciones en orden:
| Opción de menú | ID de proveedor | Endpoint predeterminado | Variable de entorno del host |
|---|---|---|---|
| Ollama | ollama |
http://localhost:11434/v1 |
OLLAMA_HOST |
| LMStudio | lmstudio |
http://localhost:1234/v1 |
LMSTUDIO_HOST |
| MTPLX | mtplx |
http://localhost:8000/v1 |
MTPLX_HOST |
| oMLX | omlx |
http://localhost:8000/v1 |
OMLX_HOST |
| AX-Studio | ax-studio |
http://localhost:18080/v1 |
AX_STUDIO_HOST |
| Otros | local-llm |
Introduce tu endpoint compatible con OpenAI | LOCAL_LLM_HOST |
Los ajustes predefinidos de MTPLX y oMLX están disponibles en la copia de trabajo del código fuente; los binarios empaquetados de v7.19.3 no los incluyen. Consulta Configuración de MTPLX y oMLX para la configuración de capacidades de herramientas, la autenticación opcional y la advertencia compartida sobre el puerto predeterminado.
Inicia tu servidor local, selecciona su entrada de menú y confirma o edita el endpoint.
AX Code añade /v1 si se omite. Otros guarda un endpoint configurable bajo
local-llm; selecciónalo de nuevo para cambiar el endpoint. LMStudio y Otros usan el
flujo de configuración local existente sin pedir un token de API. LM Studio documenta su
endpoint de lista de modelos.
Las opciones de configuración respetan enabled_providers y disabled_providers. Abrir
el selector no activa ni sondea estos servidores locales. Los modelos locales externos
descubiertos conservan capacidades predeterminadas conservadoras; los modelos deben admitir llamadas a
herramientas para poder elegirse en flujos de agente de programación.
Proveedores de API en la nube
Estos proveedores llaman a API alojadas o a endpoints de planes de cuenta alojados.
| ID de proveedor | Nombre visible | Variables de entorno de credenciales |
|---|---|---|
google |
Google — nube | GOOGLE_API_KEY, GOOGLE_GENERATIVE_AI_API_KEY y GEMINI_API_KEY |
deepseek |
DeepSeek — nube | DEEPSEEK_API_KEY |
meta |
Meta (Muse Spark) — nube | MODEL_API_KEY y META_MODEL_API_KEY |
groq |
GroqCloud — nube | GROQ_API_KEY |
openrouter |
OpenRouter — nube | OPENROUTER_API_KEY |
huggingface |
Hugging Face — nube | HF_TOKEN |
unorouter |
UnoRouter — nube | UNOROUTER_API_KEY |
alibaba-coding-plan |
Alibaba Coding Plan — internacional | ALIBABA_CODING_PLAN_INTL_API_KEY y ALIBABA_CODING_PLAN_API_KEY |
alibaba-coding-plan-cn |
Alibaba Coding Plan (China) — región China | ALIBABA_CODING_PLAN_CN_API_KEY y ALIBABA_CODING_PLAN_API_KEY |
alibaba-token-plan |
Alibaba Token Plan — internacional | ALIBABA_TOKEN_PLAN_INTL_API_KEY y ALIBABA_TOKEN_PLAN_API_KEY |
alibaba-token-plan-cn |
Alibaba Token Plan (China) — región China | ALIBABA_TOKEN_PLAN_CN_API_KEY y ALIBABA_TOKEN_PLAN_API_KEY |
github-copilot |
GitHub Copilot — cuenta | GITHUB_TOKEN |
zai |
Z.AI — nube | ZHIPU_API_KEY |
zai-coding-plan |
Z.AI Coding Plan — cuenta | ZHIPU_API_KEY |
minimax-coding-plan |
MiniMax Token Plan — internacional | MINIMAX_TOKEN_PLAN_API_KEY y MINIMAX_API_KEY |
minimax-cn-coding-plan |
MiniMax Token Plan (China) — región China | MINIMAX_TOKEN_PLAN_CN_API_KEY y MINIMAX_API_KEY |
MiniMax cambió el nombre de Coding Plan a Token Plan. Los ID de proveedor siguen siendo minimax-coding-plan /
minimax-cn-coding-plan para coincidir con models.dev y OpenCode. Usa una clave de Token Plan
(sk-cp-…) de platform.minimax.io
(internacional) o de platform.minimaxi.com (China).
huggingfacees el enrutador alojado Serverless Inference Providers (https://router.huggingface.co/v1). No tiene relación con la caché local de instantáneas de Hugging Face que AX Engine usa para guardar los modelos locales descargados: conectarhuggingfacenunca inicia ni exige el motor local.
Para una primera ejecución sin coste, consulta Inicio rápido de API de nivel gratuito. Distingue la oferta gratuita de un proveedor de la compatibilidad de AX Code y explica por qué un catálogo externo de API gratuitas no es, por sí mismo, una matriz de soporte.
Grok solo se admite a través del proveedor grok-build-cli indicado más abajo. AX Code ya no incluye un proveedor directo de API en la nube xai; las credenciales existentes de la API de Grok no crean una conexión.
github-copilot es el puente de cuenta de GitHub Copilot. No es la API github-models independiente que enumeran algunos
directorios de API gratuitas.
Las pasarelas compatibles con OpenAI y con Anthropic también se admiten mediante la configuración de un proveedor personalizado. Consulta Proveedores personalizados y de pasarela.
Nube de GPU privada
Estos proveedores aparecen en /connect bajo Nube de GPU privada, después del entorno de ejecución de LLM local.
Elige Proveedor personalizado para conectar tu propio endpoint de GPU compatible con OpenAI.
Introduce su URL y la clave de API; AX Code descubre modelos desde /v1/models y guarda
la clave en el almacenamiento de autenticación cifrado. La conexión guardada permanece en Nube de GPU
privada. Selecciónala de nuevo para elegir un modelo, sustituir el endpoint o desconectar.
Esta entrada guarda un endpoint configurable bajo custom-private-gpu.
Catálogo (clave de API)
Catálogos de GPU alojados al estilo de OpenCode. Los modelos proceden de la instantánea incluida de models.dev. Conéctate con una clave de API.
| ID de proveedor | Nombre visible | Variables de entorno de credenciales |
|---|---|---|
nebius |
Nebius Token Factory — catálogo | NEBIUS_API_KEY |
fireworks-ai |
Fireworks AI — catálogo | FIREWORKS_API_KEY |
togetherai |
Together AI — catálogo | TOGETHER_API_KEY |
baseten |
Baseten — catálogo | BASETEN_API_KEY |
nvidia |
NVIDIA NIM — catálogo | NVIDIA_API_KEY |
deepinfra |
Deep Infra — catálogo | DEEPINFRA_API_KEY |
El enrutador alojado de Hugging Face (huggingface / HF_TOKEN) permanece en Proveedores de API en la nube. Los Inference Endpoints dedicados de Hugging Face se enumeran más abajo.
Dedicado (URL + token)
Endpoints de GPU dedicados al estilo PAI. Pega la URL compatible con OpenAI y el token; AX Code llama a GET …/models y usa los ID del modelo desplegado. No son proveedores de Alibaba Coding Plan / Token Plan (DashScope).
| ID de proveedor | Nombre visible | Variables de entorno de credenciales |
|---|---|---|
alibaba-pai |
Alibaba PAI-EAS — dedicado | ALIBABA_PAI_API_KEY y ALIBABA_PAI_BASE_URL |
runpod |
RunPod — dedicado | RUNPOD_API_KEY y RUNPOD_BASE_URL |
huggingface-endpoints |
Hugging Face Endpoints — dedicado | HF_ENDPOINTS_TOKEN y HF_ENDPOINTS_BASE_URL |
sagemaker |
Amazon SageMaker — dedicado | SAGEMAKER_API_KEY y SAGEMAKER_BASE_URL |
volcengine-ark |
Volcengine Ark — dedicado | ARK_API_KEY y ARK_BASE_URL |
modelarts |
Huawei ModelArts — dedicado | MODELARTS_API_KEY y MODELARTS_BASE_URL |
tencent-ti |
Tencent TI — dedicado | TENCENT_TI_API_KEY y TENCENT_TI_BASE_URL |
custom-private-gpu |
Proveedor personalizado | CUSTOM_PRIVATE_GPU_API_KEY y CUSTOM_PRIVATE_GPU_BASE_URL |
sagemaker sirve para una URL compatible con OpenAI delante de SageMaker (vLLM / TGI / API Gateway). No firma AWS SigV4.
AX Trust
AX Trust es la última categoría de /connect, después de Nube de GPU privada. Elige
Conectar AX Trust, introduce la URL base de la pasarela, incluido /v1, y proporciona
la clave de API del cliente. AX Code descubre los modelos de la pasarela y guarda la clave
en el almacenamiento de autenticación cifrado. Las conexiones guardadas ofrecen selección de modelo, actualización
del endpoint, actualización de modelos y eliminación.
Volver a conectar una URL existente conserva su ID de proveedor, sus modelos y la clave guardada
cuando el token se deja en blanco. El proveedor permanece en AX Trust aunque tenga un
nombre personalizado. Los ID heredados ax-trust y ax-trust-* también aparecen en esta categoría.
AX Trust sigue siendo dueño de la política de la pasarela, las aprobaciones y la auditoría.
AX Code envía de forma predeterminada una cabecera de afinidad de sesión en estas conexiones.
Proveedores CLI
Los proveedores CLI reutilizan una CLI local del fabricante y su inicio de sesión, en lugar de guardar una clave de API alojada en AX Code.
| ID de proveedor | Nombre visible | Comando local requerido | ID de modelo compatible |
|---|---|---|---|
claude-code |
Anthropic (Claude Code) — local | claude |
claude-code |
codex-cli |
OpenAI (Codex CLI) — local | codex |
codex-cli |
grok-build-cli |
Grok Build CLI — local | grok |
grok-build-cli |
muse-cli |
Muse Code CLI — local | muse |
muse-cli |
Ejecuta primero el inicio de sesión de la CLI del fabricante cuando sea necesario y luego ejecuta ax-code providers login <provider-id>. AX Code sondea el comando de la CLI y guarda una credencial marcador local después de que el sondeo tenga éxito.
Para Muse Code, instala el binario local muse, ejecuta muse login (o define META_API_KEY) y luego ax-code providers login muse-cli. AX Code reutiliza la sesión de la CLI de Muse (~/.config/muse) en lugar de guardar una clave de API alojada de Meta. El proveedor de API alojada meta sigue siendo una conexión independiente.
El MiniMax Token Plan alojado sigue disponible como minimax-coding-plan / minimax-cn-coding-plan. No hay un proveedor incluido de MiniMax Code CLI ni de Kimi Code CLI.
Proveedor local de AX Engine
ax-engine es el proveedor de inferencia local integrado. Solo está disponible en Mac con Apple Silicon aptos y ofrece únicamente los paquetes de desarrollo AutomatosX Tiel Coder y Cyber-Tiel Coder 35B A3B MXFP4 MTP. Las capacidades nativas se comprueban cuando arranca el modelo.
| ID de proveedor | ID de modelo | Selección | Contexto | Salida |
|---|---|---|---|---|
ax-engine |
tiel-coder-35b-axq-mxfp4 |
Tiel Coder 35B A3B MXFP4 MTP (predeterminado) | 65,536 | 8,192 |
ax-engine |
cyber-tiel-coder-35b-axq-mxfp4 |
Cyber-Tiel Coder 35B A3B MXFP4 MTP | 65,536 | 8,192 |
Qwen3.8 27B, Ornith, Qwen3-Coder-Next y el resto de repositorios quedan excluidos de la selección gestionada. Los registros históricos siguen siendo legibles para el estado y la limpieza.
El modelo local predeterminado es tiel-coder-35b-axq-mxfp4. Consulta Selección de modelos de AX Engine para los repositorios seleccionados exactos y la orientación de memoria y disco.
Para la interfaz de conexión loopback ya configurada por separado, /v1/models es la autoridad: AX Code descubre los ID de modelo en vivo, los límites de contexto y de salida, las modalidades y la compatibilidad con llamadas a herramientas estructuradas. Un modelo que no anuncie llamadas a herramientas estructuradas no se usa para solicitudes de agente de programación.
AX Engine usa de forma predeterminada el perfil de herramientas compacto core (bash, descubrimiento, lectura, edición y escritura de archivos, y skills). Define provider.ax-engine.options.toolProfile como full solo en un despliegue personalizado con contexto suficiente para el registro completo de herramientas.
Instalación del motor
La inferencia local necesita AX Engine 7.5.7 o posterior. Los instaladores para Mac con Apple Silicon ya incluyen un sidecar autónomo de AX Engine (engine/<version>/ junto al entorno de ejecución de la CLI), así que un Mac limpio no necesita Homebrew.
AX Code resuelve después el binario en este orden:
provider.ax-engine.options.binaryPathenax-code.json(exige una versión verificada de al menos 7.5.7)- la variable de entorno
AX_ENGINE_BIN(exige una versión verificada de al menos 7.5.7) ax-engineen tuPATH(exige una versión verificada de al menos 7.5.7)- una instalación superpuesta gestionada por AX Code (
ax-code providers ax-engine install; también exige al menos 7.5.7) - el sidecar incluido en el entorno de ejecución actual de Mac
Primero comprueba --version y, si falla, usa install.version de ax-engine doctor --json. El código de salida de Doctor informa de la preparación del host (cadena de herramientas Metal, archivos MLX), de modo que una salida distinta de cero sigue contando cuando ese JSON contiene una versión. AX Code controla el arranque del servidor y normalmente lanza ax-engine serve en 127.0.0.1:31418. La fórmula opcional de Homebrew sigue siendo una alternativa para quien quiera un motor propiedad de brew; no es obligatoria.
Los arranques gestionados de Tiel usan la ventana del catálogo (65,536 tokens de contexto y 8,192 tokens de salida), mayor que el valor predeterminado integrado de 16,384 tokens de ax-engine serve para que quepa el prompt del agente. Reduce cualquiera de los dos presupuestos con provider.ax-engine.options.contextTokens y provider.ax-engine.options.maxOutputTokens (outputTokens es el mismo control de salida). Los nombres de entorno son AX_ENGINE_CONTEXT_TOKENS y AX_ENGINE_MAX_OUTPUT_TOKENS (AX_ENGINE_OUTPUT_TOKENS es un alias). Una anulación solo puede estrechar el techo del catálogo: un valor mayor o no válido se informa y se ignora, y una ventana de Tiel o Qwen3.8 que no sea múltiplo de 1,024 se ajusta hacia abajo para que los bloques de caché de prefijo sigan en 1,024 tokens. Esos mismos números son los que usan el servidor en ejecución y el límite del modelo. Una tarjeta /v1/models en vivo puede reducir aún más esa ventana, y no puede ampliarla. Las opciones configuradas prevalecen, y AX Code avisa cuando se ignora un valor de entorno. El mismo aviso se emite cuando binaryPath ignora AX_ENGINE_BIN, o cuando connectionMode / baseURL ignora AX_ENGINE_HOST. Una ventana más pequeña puede ser insuficiente para el prompt completo del agente; AX Code rechaza entonces el modelo en lugar de enviar un prompt que el servidor no puede contener.
Tiel y Cyber-Tiel anuncian llamadas a herramientas estructuradas. Una tarjeta /v1/models en vivo sigue anulando ese anuncio cuando el servidor ya está en marcha. mtpPolicy: disabled desactiva MTP aunque no se pueda leer la versión del binario; auto y required siguen necesitando AX Engine 7.4.0 o posterior.
Se rechaza una instalación de PATH o superpuesta a la que le falten libmlx.dylib / mlx.metallib. Los archivos empaquetados y superpuestos son la carga autónoma 7.5.7 para macOS.
Instalar el motor no descarga un modelo. Elige y descarga un modelo después desde la página Modelos de Desktop o con ax-code providers ax-engine prepare. Una instantánea base compatible y completa que ya esté en la caché de Hugging Face se acepta para el decode directo; prepare --download usa el paquete MTP preferido del catálogo cuando está disponible.
Usa /connect -> Entorno de ejecución AX-Engine -> Seleccionar un modelo. AX Code configura
e inicia el entorno de ejecución local de forma automática cuando hace falta el modelo elegido;
no se requiere URL ni clave de API. Ver estado, Detener el entorno de ejecución local y
Desactivar gestionan el entorno de ejecución local. Elegir un modelo también sustituye los ajustes
heredados de conexión manual por una configuración local gestionada.
El motor solo se distribuye para macOS en Apple Silicon. En otros hosts, usa un proveedor alojado o una pasarela de proveedor compatible con OpenAI; los servidores de AX Code son solo locales.