Obtener AX Code · GratisDocumentación

Esta página es una traducción de la documentación en inglés. Los comandos, identificadores y ejemplos no cambian. Runtime 7.24.4 · SDK 2.6.7. Original en inglés

Proveedores y modelos compatibles

Estado: Activo Alcance: estado actual Última revisión: 2026-09-19 Responsable: runtime de ax-code

Esta página enumera los ajustes predefinidos de proveedores que AX Code muestra en los flujos de configuración predeterminados. La fuente de verdad es la lista de permitidos de proveedores del entorno de ejecución en packages/ax-code/src/provider/default-setup-providers.ts, la instantánea de modelos incluida en packages/ax-code/src/provider/models-snapshot.json, los ajustes predefinidos del entorno de ejecución local en packages/ax-code/src/provider/local-runtime.ts y las definiciones de AX Engine en packages/ax-code/src/provider/ax-engine/constants.ts.

Usa /connect en la interfaz de terminal o ax-code providers login <provider-id> para la configuración interactiva. Los entornos sin interfaz y de CI también pueden aportar las variables de entorno indicadas.

Gestión de proveedores conectados

La vista de sesión mantiene una barra superior con el ID de sesión (clic para copiar), el título y el estado en vivo, seguida de una entrada Proveedores que muestra el recuento de conexiones; haz clic en ella o en gestionar para abrir el gestor de proveedores, también disponible como el comando /providers. Desde ahí puedes elegir un modelo, desactivar o desconectar cada proveedor, o saltar al flujo completo de /connect.

  • Sustituir una clave: selecciona el proveedor en /connect y elige Sustituir clave, o vuelve a ejecutar ax-code providers login <provider-id>.
  • Desactivar temporalmente: elige Desactivar en /providers o /connect, o ejecuta ax-code providers disable <provider-id>. Esto añade el proveedor a disabled_providers en la configuración global y conserva las credenciales guardadas. Los proveedores desactivados siguen visibles en /providers y bajo Desactivados en /connect, y pueden reactivarse con Activar o ax-code providers enable <provider-id>.
  • Desconectar de forma permanente: elige Desconectar en /providers o /connect, o ejecuta ax-code providers logout <provider-id>: esto borra la credencial almacenada de auth.json.

Los catálogos de modelos alojados se incluyen con cada versión de AX Code y se filtran según capacidades útiles de agente de programación. Ejecuta ax-code models <provider-id> para obtener los ID de modelo autorizados de tu versión instalada; el registro en bruto y las listas web copiadas pueden contener modelos que AX Code oculta porque no tienen salida de texto ni llamadas a herramientas. Un ajuste predefinido de proveedor no implica que todos los modelos sean gratuitos o estén disponibles en todas las cuentas.

Opciones del entorno de ejecución

Selección de un modelo sin versión

Tanto la TUI como ax-code run aceptan estos nombres de familia --model sin distinguir mayúsculas:

Familia Modelo
deepseek deepseek-flash
glm glm-5.3-flash
qwen qwen3.8-flash

Por ejemplo, ax-code --model glm abre la TUI con GLM Flash y ax-code run --model qwen -- "Review this change" solicita Qwen Flash. Coloca el prompt después de -- (o pasa --prompt / --prompt-file); --file adjunta archivos y no es un archivo de prompt. ax-code models enumera los ID provider/model utilizables. Los nombres de familia se resuelven mediante el proveedor nativo o una pasarela conectada que sirva el mismo modelo. También puedes nombrar el proveedor: --model my-gateway/glm. Usa un ID completo como my-gateway/glm-5.3 para pedir una versión o un nivel concretos.

Omitir --model conserva las elecciones de modelo configuradas, del agente, de la sesión y recientes. Cuando no hay una elección utilizable, el orden de reserva compartido empieza por DeepSeek Flash, luego GLM Flash y después Qwen Flash entre los proveedores conectados. La configuración de proveedores tiene sus propios valores predeterminados: Alibaba Coding Plan usa qwen3-coder-plus; Alibaba Token Plan usa qwen3.8-flash.

Conexión de un entorno de ejecución

Las opciones de /connect se ordenan así: Proveedor de API en la nube, Proveedor CLI, Entorno de ejecución AX-Engine, Entorno de ejecución de LLM local, Nube de GPU privada y AX Trust. El entorno de ejecución AX-Engine abre directamente la selección de modelos locales y la gestión del entorno. El entorno de ejecución de LLM local enumera estas opciones en orden:

Opción de menú ID de proveedor Endpoint predeterminado Variable de entorno del host
Ollama ollama http://localhost:11434/v1 OLLAMA_HOST
LMStudio lmstudio http://localhost:1234/v1 LMSTUDIO_HOST
MTPLX mtplx http://localhost:8000/v1 MTPLX_HOST
oMLX omlx http://localhost:8000/v1 OMLX_HOST
AX-Studio ax-studio http://localhost:18080/v1 AX_STUDIO_HOST
Otros local-llm Introduce tu endpoint compatible con OpenAI LOCAL_LLM_HOST

Los ajustes predefinidos de MTPLX y oMLX están disponibles en la copia de trabajo del código fuente; los binarios empaquetados de v7.19.3 no los incluyen. Consulta Configuración de MTPLX y oMLX para la configuración de capacidades de herramientas, la autenticación opcional y la advertencia compartida sobre el puerto predeterminado.

Inicia tu servidor local, selecciona su entrada de menú y confirma o edita el endpoint. AX Code añade /v1 si se omite. Otros guarda un endpoint configurable bajo local-llm; selecciónalo de nuevo para cambiar el endpoint. LMStudio y Otros usan el flujo de configuración local existente sin pedir un token de API. LM Studio documenta su endpoint de lista de modelos.

Las opciones de configuración respetan enabled_providers y disabled_providers. Abrir el selector no activa ni sondea estos servidores locales. Los modelos locales externos descubiertos conservan capacidades predeterminadas conservadoras; los modelos deben admitir llamadas a herramientas para poder elegirse en flujos de agente de programación.

Proveedores de API en la nube

Estos proveedores llaman a API alojadas o a endpoints de planes de cuenta alojados.

ID de proveedor Nombre visible Variables de entorno de credenciales
google Google — nube GOOGLE_API_KEY, GOOGLE_GENERATIVE_AI_API_KEY y GEMINI_API_KEY
deepseek DeepSeek — nube DEEPSEEK_API_KEY
meta Meta (Muse Spark) — nube MODEL_API_KEY y META_MODEL_API_KEY
groq GroqCloud — nube GROQ_API_KEY
openrouter OpenRouter — nube OPENROUTER_API_KEY
huggingface Hugging Face — nube HF_TOKEN
unorouter UnoRouter — nube UNOROUTER_API_KEY
alibaba-coding-plan Alibaba Coding Plan — internacional ALIBABA_CODING_PLAN_INTL_API_KEY y ALIBABA_CODING_PLAN_API_KEY
alibaba-coding-plan-cn Alibaba Coding Plan (China) — región China ALIBABA_CODING_PLAN_CN_API_KEY y ALIBABA_CODING_PLAN_API_KEY
alibaba-token-plan Alibaba Token Plan — internacional ALIBABA_TOKEN_PLAN_INTL_API_KEY y ALIBABA_TOKEN_PLAN_API_KEY
alibaba-token-plan-cn Alibaba Token Plan (China) — región China ALIBABA_TOKEN_PLAN_CN_API_KEY y ALIBABA_TOKEN_PLAN_API_KEY
github-copilot GitHub Copilot — cuenta GITHUB_TOKEN
zai Z.AI — nube ZHIPU_API_KEY
zai-coding-plan Z.AI Coding Plan — cuenta ZHIPU_API_KEY
minimax-coding-plan MiniMax Token Plan — internacional MINIMAX_TOKEN_PLAN_API_KEY y MINIMAX_API_KEY
minimax-cn-coding-plan MiniMax Token Plan (China) — región China MINIMAX_TOKEN_PLAN_CN_API_KEY y MINIMAX_API_KEY

MiniMax cambió el nombre de Coding Plan a Token Plan. Los ID de proveedor siguen siendo minimax-coding-plan / minimax-cn-coding-plan para coincidir con models.dev y OpenCode. Usa una clave de Token Plan (sk-cp-…) de platform.minimax.io (internacional) o de platform.minimaxi.com (China).

huggingface es el enrutador alojado Serverless Inference Providers (https://router.huggingface.co/v1). No tiene relación con la caché local de instantáneas de Hugging Face que AX Engine usa para guardar los modelos locales descargados: conectar huggingface nunca inicia ni exige el motor local.

Para una primera ejecución sin coste, consulta Inicio rápido de API de nivel gratuito. Distingue la oferta gratuita de un proveedor de la compatibilidad de AX Code y explica por qué un catálogo externo de API gratuitas no es, por sí mismo, una matriz de soporte.

Grok solo se admite a través del proveedor grok-build-cli indicado más abajo. AX Code ya no incluye un proveedor directo de API en la nube xai; las credenciales existentes de la API de Grok no crean una conexión.

github-copilot es el puente de cuenta de GitHub Copilot. No es la API github-models independiente que enumeran algunos directorios de API gratuitas.

Las pasarelas compatibles con OpenAI y con Anthropic también se admiten mediante la configuración de un proveedor personalizado. Consulta Proveedores personalizados y de pasarela.

Nube de GPU privada

Estos proveedores aparecen en /connect bajo Nube de GPU privada, después del entorno de ejecución de LLM local.

Elige Proveedor personalizado para conectar tu propio endpoint de GPU compatible con OpenAI. Introduce su URL y la clave de API; AX Code descubre modelos desde /v1/models y guarda la clave en el almacenamiento de autenticación cifrado. La conexión guardada permanece en Nube de GPU privada. Selecciónala de nuevo para elegir un modelo, sustituir el endpoint o desconectar. Esta entrada guarda un endpoint configurable bajo custom-private-gpu.

Catálogo (clave de API)

Catálogos de GPU alojados al estilo de OpenCode. Los modelos proceden de la instantánea incluida de models.dev. Conéctate con una clave de API.

ID de proveedor Nombre visible Variables de entorno de credenciales
nebius Nebius Token Factory — catálogo NEBIUS_API_KEY
fireworks-ai Fireworks AI — catálogo FIREWORKS_API_KEY
togetherai Together AI — catálogo TOGETHER_API_KEY
baseten Baseten — catálogo BASETEN_API_KEY
nvidia NVIDIA NIM — catálogo NVIDIA_API_KEY
deepinfra Deep Infra — catálogo DEEPINFRA_API_KEY

El enrutador alojado de Hugging Face (huggingface / HF_TOKEN) permanece en Proveedores de API en la nube. Los Inference Endpoints dedicados de Hugging Face se enumeran más abajo.

Dedicado (URL + token)

Endpoints de GPU dedicados al estilo PAI. Pega la URL compatible con OpenAI y el token; AX Code llama a GET …/models y usa los ID del modelo desplegado. No son proveedores de Alibaba Coding Plan / Token Plan (DashScope).

ID de proveedor Nombre visible Variables de entorno de credenciales
alibaba-pai Alibaba PAI-EAS — dedicado ALIBABA_PAI_API_KEY y ALIBABA_PAI_BASE_URL
runpod RunPod — dedicado RUNPOD_API_KEY y RUNPOD_BASE_URL
huggingface-endpoints Hugging Face Endpoints — dedicado HF_ENDPOINTS_TOKEN y HF_ENDPOINTS_BASE_URL
sagemaker Amazon SageMaker — dedicado SAGEMAKER_API_KEY y SAGEMAKER_BASE_URL
volcengine-ark Volcengine Ark — dedicado ARK_API_KEY y ARK_BASE_URL
modelarts Huawei ModelArts — dedicado MODELARTS_API_KEY y MODELARTS_BASE_URL
tencent-ti Tencent TI — dedicado TENCENT_TI_API_KEY y TENCENT_TI_BASE_URL
custom-private-gpu Proveedor personalizado CUSTOM_PRIVATE_GPU_API_KEY y CUSTOM_PRIVATE_GPU_BASE_URL

sagemaker sirve para una URL compatible con OpenAI delante de SageMaker (vLLM / TGI / API Gateway). No firma AWS SigV4.

AX Trust

AX Trust es la última categoría de /connect, después de Nube de GPU privada. Elige Conectar AX Trust, introduce la URL base de la pasarela, incluido /v1, y proporciona la clave de API del cliente. AX Code descubre los modelos de la pasarela y guarda la clave en el almacenamiento de autenticación cifrado. Las conexiones guardadas ofrecen selección de modelo, actualización del endpoint, actualización de modelos y eliminación.

Volver a conectar una URL existente conserva su ID de proveedor, sus modelos y la clave guardada cuando el token se deja en blanco. El proveedor permanece en AX Trust aunque tenga un nombre personalizado. Los ID heredados ax-trust y ax-trust-* también aparecen en esta categoría. AX Trust sigue siendo dueño de la política de la pasarela, las aprobaciones y la auditoría. AX Code envía de forma predeterminada una cabecera de afinidad de sesión en estas conexiones.

Proveedores CLI

Los proveedores CLI reutilizan una CLI local del fabricante y su inicio de sesión, en lugar de guardar una clave de API alojada en AX Code.

ID de proveedor Nombre visible Comando local requerido ID de modelo compatible
claude-code Anthropic (Claude Code) — local claude claude-code
codex-cli OpenAI (Codex CLI) — local codex codex-cli
grok-build-cli Grok Build CLI — local grok grok-build-cli
muse-cli Muse Code CLI — local muse muse-cli

Ejecuta primero el inicio de sesión de la CLI del fabricante cuando sea necesario y luego ejecuta ax-code providers login <provider-id>. AX Code sondea el comando de la CLI y guarda una credencial marcador local después de que el sondeo tenga éxito.

Para Muse Code, instala el binario local muse, ejecuta muse login (o define META_API_KEY) y luego ax-code providers login muse-cli. AX Code reutiliza la sesión de la CLI de Muse (~/.config/muse) en lugar de guardar una clave de API alojada de Meta. El proveedor de API alojada meta sigue siendo una conexión independiente.

El MiniMax Token Plan alojado sigue disponible como minimax-coding-plan / minimax-cn-coding-plan. No hay un proveedor incluido de MiniMax Code CLI ni de Kimi Code CLI.

Proveedor local de AX Engine

ax-engine es el proveedor de inferencia local integrado. Solo está disponible en Mac con Apple Silicon aptos y ofrece únicamente los paquetes de desarrollo AutomatosX Tiel Coder y Cyber-Tiel Coder 35B A3B MXFP4 MTP. Las capacidades nativas se comprueban cuando arranca el modelo.

ID de proveedor ID de modelo Selección Contexto Salida
ax-engine tiel-coder-35b-axq-mxfp4 Tiel Coder 35B A3B MXFP4 MTP (predeterminado) 65,536 8,192
ax-engine cyber-tiel-coder-35b-axq-mxfp4 Cyber-Tiel Coder 35B A3B MXFP4 MTP 65,536 8,192

Qwen3.8 27B, Ornith, Qwen3-Coder-Next y el resto de repositorios quedan excluidos de la selección gestionada. Los registros históricos siguen siendo legibles para el estado y la limpieza.

El modelo local predeterminado es tiel-coder-35b-axq-mxfp4. Consulta Selección de modelos de AX Engine para los repositorios seleccionados exactos y la orientación de memoria y disco.

Para la interfaz de conexión loopback ya configurada por separado, /v1/models es la autoridad: AX Code descubre los ID de modelo en vivo, los límites de contexto y de salida, las modalidades y la compatibilidad con llamadas a herramientas estructuradas. Un modelo que no anuncie llamadas a herramientas estructuradas no se usa para solicitudes de agente de programación.

AX Engine usa de forma predeterminada el perfil de herramientas compacto core (bash, descubrimiento, lectura, edición y escritura de archivos, y skills). Define provider.ax-engine.options.toolProfile como full solo en un despliegue personalizado con contexto suficiente para el registro completo de herramientas.

Instalación del motor

La inferencia local necesita AX Engine 7.5.7 o posterior. Los instaladores para Mac con Apple Silicon ya incluyen un sidecar autónomo de AX Engine (engine/<version>/ junto al entorno de ejecución de la CLI), así que un Mac limpio no necesita Homebrew.

AX Code resuelve después el binario en este orden:

  1. provider.ax-engine.options.binaryPath en ax-code.json (exige una versión verificada de al menos 7.5.7)
  2. la variable de entorno AX_ENGINE_BIN (exige una versión verificada de al menos 7.5.7)
  3. ax-engine en tu PATH (exige una versión verificada de al menos 7.5.7)
  4. una instalación superpuesta gestionada por AX Code (ax-code providers ax-engine install; también exige al menos 7.5.7)
  5. el sidecar incluido en el entorno de ejecución actual de Mac

Primero comprueba --version y, si falla, usa install.version de ax-engine doctor --json. El código de salida de Doctor informa de la preparación del host (cadena de herramientas Metal, archivos MLX), de modo que una salida distinta de cero sigue contando cuando ese JSON contiene una versión. AX Code controla el arranque del servidor y normalmente lanza ax-engine serve en 127.0.0.1:31418. La fórmula opcional de Homebrew sigue siendo una alternativa para quien quiera un motor propiedad de brew; no es obligatoria.

Los arranques gestionados de Tiel usan la ventana del catálogo (65,536 tokens de contexto y 8,192 tokens de salida), mayor que el valor predeterminado integrado de 16,384 tokens de ax-engine serve para que quepa el prompt del agente. Reduce cualquiera de los dos presupuestos con provider.ax-engine.options.contextTokens y provider.ax-engine.options.maxOutputTokens (outputTokens es el mismo control de salida). Los nombres de entorno son AX_ENGINE_CONTEXT_TOKENS y AX_ENGINE_MAX_OUTPUT_TOKENS (AX_ENGINE_OUTPUT_TOKENS es un alias). Una anulación solo puede estrechar el techo del catálogo: un valor mayor o no válido se informa y se ignora, y una ventana de Tiel o Qwen3.8 que no sea múltiplo de 1,024 se ajusta hacia abajo para que los bloques de caché de prefijo sigan en 1,024 tokens. Esos mismos números son los que usan el servidor en ejecución y el límite del modelo. Una tarjeta /v1/models en vivo puede reducir aún más esa ventana, y no puede ampliarla. Las opciones configuradas prevalecen, y AX Code avisa cuando se ignora un valor de entorno. El mismo aviso se emite cuando binaryPath ignora AX_ENGINE_BIN, o cuando connectionMode / baseURL ignora AX_ENGINE_HOST. Una ventana más pequeña puede ser insuficiente para el prompt completo del agente; AX Code rechaza entonces el modelo en lugar de enviar un prompt que el servidor no puede contener.

Tiel y Cyber-Tiel anuncian llamadas a herramientas estructuradas. Una tarjeta /v1/models en vivo sigue anulando ese anuncio cuando el servidor ya está en marcha. mtpPolicy: disabled desactiva MTP aunque no se pueda leer la versión del binario; auto y required siguen necesitando AX Engine 7.4.0 o posterior.

Se rechaza una instalación de PATH o superpuesta a la que le falten libmlx.dylib / mlx.metallib. Los archivos empaquetados y superpuestos son la carga autónoma 7.5.7 para macOS.

Instalar el motor no descarga un modelo. Elige y descarga un modelo después desde la página Modelos de Desktop o con ax-code providers ax-engine prepare. Una instantánea base compatible y completa que ya esté en la caché de Hugging Face se acepta para el decode directo; prepare --download usa el paquete MTP preferido del catálogo cuando está disponible.

Usa /connect -> Entorno de ejecución AX-Engine -> Seleccionar un modelo. AX Code configura e inicia el entorno de ejecución local de forma automática cuando hace falta el modelo elegido; no se requiere URL ni clave de API. Ver estado, Detener el entorno de ejecución local y Desactivar gestionan el entorno de ejecución local. Elegir un modelo también sustituye los ajustes heredados de conexión manual por una configuración local gestionada.

El motor solo se distribuye para macOS en Apple Silicon. En otros hosts, usa un proveedor alojado o una pasarela de proveedor compatible con OpenAI; los servidores de AX Code son solo locales.