Obtenir AX Code · GratuitDocumentation

Cette page est traduite de la documentation anglaise. Les commandes, identifiants et exemples sont inchangés. Runtime 7.24.4 · SDK 2.6.7. Source anglaise

Fournisseurs et modèles pris en charge

Statut : actif Portée : état actuel Dernière revue : 2026-09-19 Responsable : runtime AX Code

Cette page liste les préréglages de fournisseurs qu’AX Code expose dans les flux de configuration par défaut. La source de vérité est la liste d’autorisation des fournisseurs du runtime dans packages/ax-code/src/provider/default-setup-providers.ts, l’instantané de modèles fourni dans packages/ax-code/src/provider/models-snapshot.json, les préréglages de runtime local dans packages/ax-code/src/provider/local-runtime.ts, et les définitions d’AX Engine dans packages/ax-code/src/provider/ax-engine/constants.ts.

Utilisez /connect dans l’interface de terminal ou ax-code providers login <provider-id> pour une configuration interactive. Les environnements sans interface et de CI peuvent aussi fournir les variables d’environnement listées.

Gérer les fournisseurs connectés

La vue de session conserve une barre supérieure avec l’identifiant de session (cliquez pour copier), le titre et le statut en direct, suivie d’une entrée Fournisseurs qui montre le nombre de connexions ; cliquez dessus ou sur gérer pour ouvrir le gestionnaire de fournisseurs, aussi disponible comme la commande /providers. De là, vous pouvez choisir un modèle, désactiver ou déconnecter chaque fournisseur, ou passer au flux complet /connect.

  • Remplacer une clé : sélectionnez le fournisseur dans /connect et choisissez Remplacer la clé, ou relancez ax-code providers login <provider-id>.
  • Désactiver temporairement : choisissez Désactiver dans /providers ou /connect, ou exécutez ax-code providers disable <provider-id>. Cela ajoute le fournisseur à disabled_providers dans la configuration globale et conserve les authentifiants enregistrés. Les fournisseurs désactivés restent visibles dans /providers et sous Désactivés dans /connect, et peuvent être réactivés avec Activer ou ax-code providers enable <provider-id>.
  • Déconnecter définitivement : choisissez Déconnecter dans /providers ou /connect, ou exécutez ax-code providers logout <provider-id> — cela supprime l’authentifiant stocké de auth.json.

Les catalogues de modèles hébergés sont fournis avec chaque version d’AX Code et filtrés pour les capacités utilisables d’un agent de programmation. Exécutez ax-code models <provider-id> pour les identifiants de modèles qui font autorité dans votre version installée ; le registre brut et les listes web copiées peuvent contenir des modèles qu’AX Code masque parce qu’ils n’ont pas de sortie texte ou d’appel d’outils. Un préréglage de fournisseur n’implique pas que chaque modèle est gratuit ou disponible sur chaque compte.

Choix de runtime

Choisir un modèle sans version

Le TUI et ax-code run acceptent ces noms de famille --model, sans tenir compte de la casse :

Famille Modèle
deepseek deepseek-flash
glm glm-5.3-flash
qwen qwen3.8-flash

Par exemple, ax-code --model glm ouvre le TUI avec GLM Flash, et ax-code run --model qwen -- "Review this change" demande Qwen Flash. Placez l’invite après -- (ou passez --prompt / --prompt-file) ; --file joint des fichiers et n’est pas un fichier d’invite. ax-code models liste les identifiants provider/model utilisables. Les noms de famille se résolvent par le fournisseur natif ou une passerelle connectée qui sert le même modèle. Vous pouvez aussi nommer le fournisseur : --model my-gateway/glm. Utilisez un identifiant complet tel que my-gateway/glm-5.3 pour demander une version ou un niveau précis.

Omettre --model conserve les choix de modèle configurés, d’agent, de session et récents. Lorsqu’aucun choix utilisable n’existe, l’ordre de repli partagé commence par DeepSeek Flash, puis GLM Flash, puis Qwen Flash, parmi les fournisseurs connectés. La configuration des fournisseurs a ses propres défauts : Alibaba Coding Plan utilise qwen3-coder-plus ; Alibaba Token Plan utilise qwen3.8-flash.

Connecter un runtime

Les choix de /connect sont ordonnés ainsi : fournisseur d’API cloud, fournisseur CLI, runtime AX-Engine, runtime LLM local, cloud GPU privé et AX Trust. Le runtime AX-Engine ouvre directement la sélection de modèle local et la gestion du runtime. Le runtime LLM local liste ces choix dans l’ordre :

Option de menu Identifiant de fournisseur Point de terminaison par défaut Variable d’environnement de l’hôte
Ollama ollama http://localhost:11434/v1 OLLAMA_HOST
LMStudio lmstudio http://localhost:1234/v1 LMSTUDIO_HOST
MTPLX mtplx http://localhost:8000/v1 MTPLX_HOST
oMLX omlx http://localhost:8000/v1 OMLX_HOST
AX-Studio ax-studio http://localhost:18080/v1 AX_STUDIO_HOST
Autres local-llm Saisissez votre point de terminaison compatible OpenAI LOCAL_LLM_HOST

Les préréglages MTPLX et oMLX sont disponibles dans le checkout des sources ; les binaires empaquetés v7.19.3 ne les incluent pas. Voir Configuration de MTPLX et d’oMLX pour la configuration des capacités d’outils, l’authentification facultative et la réserve du port par défaut partagé.

Démarrez votre serveur local, sélectionnez son entrée de menu, puis confirmez ou modifiez le point de terminaison. AX Code ajoute /v1 s’il est omis. Autres enregistre un point de terminaison configurable sous local-llm ; sélectionnez-le de nouveau pour changer le point de terminaison. LMStudio et Autres utilisent le flux de configuration locale existant, sans invite de jeton d’API. LM Studio documente son point de terminaison de liste de modèles.

Les choix de configuration respectent enabled_providers et disabled_providers. Ouvrir simplement le sélecteur n’active ni ne sonde ces serveurs locaux. Les modèles locaux externes découverts conservent des défauts de capacité prudents ; les modèles doivent prendre en charge l’appel d’outils pour être sélectionnables dans les flux d’agent de programmation.

Fournisseurs d'API cloud

Ces fournisseurs appellent des API hébergées ou des points de terminaison de forfaits de compte hébergés.

Identifiant de fournisseur Nom affiché Variables d’environnement d’authentifiant
google fournisseur Google GOOGLE_API_KEY, GOOGLE_GENERATIVE_AI_API_KEY, GEMINI_API_KEY
deepseek fournisseur DeepSeek DEEPSEEK_API_KEY
meta fournisseur Meta (Muse Spark) MODEL_API_KEY, META_MODEL_API_KEY
groq fournisseur GroqCloud GROQ_API_KEY
openrouter fournisseur OpenRouter OPENROUTER_API_KEY
huggingface fournisseur Hugging Face HF_TOKEN
unorouter fournisseur UnoRouter UNOROUTER_API_KEY
alibaba-coding-plan fournisseur Alibaba Coding Plan ALIBABA_CODING_PLAN_INTL_API_KEY, ALIBABA_CODING_PLAN_API_KEY
alibaba-coding-plan-cn fournisseur Alibaba Coding Plan (Chine) ALIBABA_CODING_PLAN_CN_API_KEY, ALIBABA_CODING_PLAN_API_KEY
alibaba-token-plan fournisseur Alibaba Token Plan ALIBABA_TOKEN_PLAN_INTL_API_KEY, ALIBABA_TOKEN_PLAN_API_KEY
alibaba-token-plan-cn fournisseur Alibaba Token Plan (Chine) ALIBABA_TOKEN_PLAN_CN_API_KEY, ALIBABA_TOKEN_PLAN_API_KEY
github-copilot fournisseur GitHub Copilot GITHUB_TOKEN
zai fournisseur Z.AI ZHIPU_API_KEY
zai-coding-plan fournisseur Z.AI Coding Plan ZHIPU_API_KEY
minimax-coding-plan fournisseur MiniMax Token Plan MINIMAX_TOKEN_PLAN_API_KEY, MINIMAX_API_KEY
minimax-cn-coding-plan fournisseur MiniMax Token Plan (Chine) MINIMAX_TOKEN_PLAN_CN_API_KEY, MINIMAX_API_KEY

MiniMax a renommé Coding Plan en Token Plan. Les identifiants de fournisseurs restent minimax-coding-plan / minimax-cn-coding-plan pour correspondre à models.dev et à OpenCode. Utilisez une clé Token Plan (sk-cp-…) depuis platform.minimax.io (international) ou platform.minimaxi.com (Chine).

huggingface est le routeur hébergé Serverless Inference Providers (https://router.huggingface.co/v1). Il n’a aucun lien avec le cache local d’instantanés Hugging Face qu’AX Engine utilise pour stocker les modèles locaux téléchargés — connecter huggingface ne démarre ni n’exige le moteur local.

Pour une première exécution sans coût, voir Démarrage rapide des API gratuites. Il distingue l’offre gratuite d’un fournisseur de la compatibilité d’AX Code et explique pourquoi un catalogue externe d’API gratuites n’est pas, en soi, une matrice de prise en charge.

Grok n’est pris en charge que par le fournisseur grok-build-cli listé plus bas. AX Code n’inclut plus de fournisseur d’API cloud direct xai ; les authentifiants d’API Grok existants ne créent pas de connexion.

github-copilot est le pont de compte GitHub Copilot. Ce n’est pas l’API github-models distincte listée par certains répertoires d’API gratuites.

Les passerelles compatibles OpenAI et Anthropic sont aussi prises en charge par une configuration de fournisseur personnalisée. Voir Fournisseurs personnalisés et passerelles.

Cloud GPU privé

Ces fournisseurs apparaissent dans /connect sous Cloud GPU privé, après le runtime LLM local.

Choisissez Fournisseur personnalisé pour connecter votre propre point de terminaison GPU compatible OpenAI. Saisissez son URL et sa clé d’API ; AX Code découvre les modèles depuis /v1/models et stocke la clé dans le stockage d’authentification chiffré. La connexion enregistrée reste dans le cloud GPU privé. Sélectionnez-la de nouveau pour choisir un modèle, remplacer le point de terminaison ou déconnecter. Cette entrée stocke un point de terminaison configurable sous custom-private-gpu.

Catalogue (clé d'API)

Catalogues GPU hébergés de style OpenCode. Les modèles viennent de l’instantané models.dev fourni. Connectez-vous avec une clé d’API.

Identifiant de fournisseur Nom affiché Variables d’environnement d’authentifiant
nebius fournisseur Nebius Token Factory NEBIUS_API_KEY
fireworks-ai fournisseur Fireworks AI FIREWORKS_API_KEY
togetherai fournisseur Together AI TOGETHER_API_KEY
baseten fournisseur Baseten BASETEN_API_KEY
nvidia fournisseur NVIDIA NIM NVIDIA_API_KEY
deepinfra fournisseur Deep Infra DEEPINFRA_API_KEY

Le routeur Hugging Face hébergé (huggingface / HF_TOKEN) reste dans les fournisseurs d’API cloud. Les points de terminaison dédiés Hugging Face Inference Endpoints sont listés plus bas.

Dédié (URL + jeton)

Points de terminaison GPU dédiés de style PAI. Collez l’URL compatible OpenAI et le jeton ; AX Code appelle GET …/models et utilise les identifiants de modèles déployés. Ce ne sont pas les fournisseurs Alibaba Coding Plan / Token Plan (DashScope).

Identifiant de fournisseur Nom affiché Variables d’environnement d’authentifiant
alibaba-pai fournisseur Alibaba PAI-EAS ALIBABA_PAI_API_KEY, ALIBABA_PAI_BASE_URL
runpod fournisseur RunPod RUNPOD_API_KEY, RUNPOD_BASE_URL
huggingface-endpoints fournisseur Hugging Face Endpoints HF_ENDPOINTS_TOKEN, HF_ENDPOINTS_BASE_URL
sagemaker fournisseur Amazon SageMaker SAGEMAKER_API_KEY, SAGEMAKER_BASE_URL
volcengine-ark fournisseur Volcengine Ark ARK_API_KEY, ARK_BASE_URL
modelarts fournisseur Huawei ModelArts MODELARTS_API_KEY, MODELARTS_BASE_URL
tencent-ti fournisseur Tencent TI TENCENT_TI_API_KEY, TENCENT_TI_BASE_URL
custom-private-gpu fournisseur personnalisé CUSTOM_PRIVATE_GPU_API_KEY, CUSTOM_PRIVATE_GPU_BASE_URL

sagemaker sert une URL compatible OpenAI devant SageMaker (vLLM / TGI / API Gateway). Il ne signe pas AWS SigV4.

AX Trust

AX Trust est la dernière catégorie de /connect, après le cloud GPU privé. Choisissez Connecter AX Trust, saisissez l’URL de base de la passerelle, y compris /v1, et fournissez la clé d’API client. AX Code découvre les modèles de la passerelle et stocke la clé dans le stockage d’authentification chiffré. Les connexions enregistrées offrent la sélection de modèle, la mise à jour du point de terminaison, le rafraîchissement des modèles et la suppression.

Reconnecter une URL existante conserve son identifiant de fournisseur, ses modèles et sa clé enregistrée lorsque le jeton est laissé vide. Le fournisseur reste dans AX Trust, même avec un nom personnalisé. Les identifiants hérités ax-trust et ax-trust-* apparaissent aussi dans cette catégorie. AX Trust continue de posséder la politique de passerelle, les approbations et l’audit. AX Code envoie par défaut un en-tête d’affinité de session sur ces connexions.

Fournisseurs CLI

Les fournisseurs CLI réutilisent une CLI locale du vendeur et sa connexion ou session, au lieu de stocker une clé d’API hébergée dans AX Code.

Identifiant de fournisseur Nom affiché Commande locale exigée Identifiant de modèle pris en charge
claude-code fournisseur Anthropic (Claude Code) claude claude-code
codex-cli fournisseur OpenAI (Codex CLI) codex codex-cli
grok-build-cli fournisseur Grok Build CLI grok grok-build-cli
muse-cli fournisseur Muse Code CLI muse muse-cli

Exécutez d’abord la connexion de la CLI du vendeur lorsque c’est exigé, puis exécutez ax-code providers login <provider-id>. AX Code sonde la commande CLI et stocke un authentifiant marqueur local après la réussite de la sonde.

Pour Muse Code, installez le binaire local muse, exécutez muse login (ou définissez META_API_KEY), puis ax-code providers login muse-cli. AX Code réutilise la session de la CLI Muse (~/.config/muse) plutôt que de stocker une clé d’API Meta hébergée. Le fournisseur d’API hébergé meta reste une connexion distincte.

Le forfait MiniMax Token Plan hébergé reste disponible comme minimax-coding-plan / minimax-cn-coding-plan. Il n’y a pas de fournisseur MiniMax Code CLI ni Kimi Code CLI fourni.

Fournisseur local AX Engine

ax-engine est le fournisseur d’inférence locale intégré. Il n’est disponible que sur les Mac Apple Silicon éligibles et n’offre que les paquets de développement AutomatosX Tiel Coder et Cyber-Tiel Coder 35B A3B MXFP4 MTP. Les capacités natives sont contrôlées au démarrage du modèle.

Identifiant de fournisseur Identifiant de modèle Sélection Contexte Sortie
ax-engine tiel-coder-35b-axq-mxfp4 Tiel Coder 35B A3B MXFP4 MTP (défaut) 65 536 8 192
ax-engine cyber-tiel-coder-35b-axq-mxfp4 Cyber-Tiel Coder 35B A3B MXFP4 MTP 65 536 8 192

Qwen3.8 27B, Ornith, Qwen3-Coder-Next et tous les autres dépôts sont exclus de la sélection gérée. Les enregistrements historiques restent lisibles pour le statut et le nettoyage.

Le modèle local par défaut est tiel-coder-35b-axq-mxfp4. Voir Sélection de modèles AX Engine pour les dépôts choisis exacts, et les consignes de mémoire et de disque.

Pour l’interface d’attache en boucle locale configurée séparément, /v1/models fait autorité : AX Code découvre les identifiants de modèles en direct, les limites de contexte et de sortie, les modalités et la prise en charge de l’appel d’outils structuré. Un modèle qui n’annonce pas l’appel d’outils structuré n’est pas utilisé pour les requêtes d’agent de programmation.

AX Engine utilise par défaut le profil d’outils compact core (bash, découverte, lecture, édition et écriture de fichiers, et skills). Ne définissez provider.ax-engine.options.toolProfile sur full que pour un déploiement personnalisé dont le contexte suffit au registre d’outils complet.

Installer le moteur

L’inférence locale exige AX Engine 7.5.7 ou plus récent. Les installateurs Mac Apple Silicon incluent déjà un sidecar AX Engine autonome (engine/<version>/ à côté du runtime CLI), donc un Mac neuf n’a pas besoin de Homebrew.

AX Code résout ensuite le binaire dans cet ordre :

  1. provider.ax-engine.options.binaryPath dans ax-code.json (exige une version vérifiée d’au moins 7.5.7)
  2. la variable d’environnement AX_ENGINE_BIN (exige une version vérifiée d’au moins 7.5.7)
  3. ax-engine sur votre PATH (exige une version vérifiée d’au moins 7.5.7)
  4. une installation de surcouche gérée par AX Code (ax-code providers ax-engine install ; exige aussi au moins 7.5.7)
  5. le sidecar fourni dans le runtime Mac actuel

Il contrôle d’abord --version et se replie sur install.version depuis ax-engine doctor --json. Le code de sortie de Doctor indique la préparation de l’hôte (chaîne d’outils Metal, fichiers MLX), donc une sortie non nulle compte encore lorsque ce JSON contient une version. AX Code possède le démarrage du serveur et lance normalement ax-engine serve sur 127.0.0.1:31418. La formule Homebrew facultative reste une alternative pour qui veut un moteur possédé par brew ; elle n’est pas exigée.

Les lancements Tiel gérés utilisent la fenêtre du catalogue (65 536 jetons de contexte et 8 192 jetons de sortie), plus grande que le défaut intégré de 16 384 jetons de ax-engine serve, afin que l’invite de l’agent tienne. Réduisez l’un ou l’autre budget avec provider.ax-engine.options.contextTokens et provider.ax-engine.options.maxOutputTokens (outputTokens est le même réglage de sortie). Les noms d’environnement sont AX_ENGINE_CONTEXT_TOKENS et AX_ENGINE_MAX_OUTPUT_TOKENS (AX_ENGINE_OUTPUT_TOKENS est un alias). Une surcharge ne peut que resserrer le plafond du catalogue : une valeur plus grande ou invalide est signalée et ignorée, et une fenêtre Tiel ou Qwen3.8 qui n’est pas un multiple de 1 024 est ramenée vers le bas afin que les blocs de cache de préfixe restent de 1 024 jetons. Ce sont les mêmes nombres qu’utilisent le serveur en cours et la limite du modèle. Une carte /v1/models en direct peut encore réduire cette fenêtre, et elle ne peut pas l’augmenter. Les options configurées l’emportent, et AX Code avertit lorsqu’une valeur d’environnement est ignorée. Le même avertissement est émis lorsque binaryPath ignore AX_ENGINE_BIN, ou lorsque connectionMode / baseURL ignore AX_ENGINE_HOST. Une fenêtre plus petite peut être trop étroite pour l’invite complète de l’agent ; AX Code refuse alors le modèle, au lieu d’envoyer une invite que le serveur ne peut pas contenir.

Tiel et Cyber-Tiel annoncent l’appel d’outils structuré. Une carte /v1/models en direct remplace encore cette annonce une fois le serveur lancé. mtpPolicy: disabled coupe MTP même lorsque la version du binaire ne peut pas être lue ; auto et required exigent encore AX Engine 7.4.0 ou plus récent.

Une installation PATH ou de surcouche à laquelle il manque libmlx.dylib / mlx.metallib est rejetée. Les archives fournies et de surcouche sont la charge utile macOS autonome 7.5.7.

Installer le moteur ne télécharge pas de modèle. Choisissez et téléchargez un modèle ensuite, depuis la page Modèles de Desktop ou avec ax-code providers ax-engine prepare. Un instantané de base compatible et complet, déjà dans le cache Hugging Face, est accepté pour le décodage direct ; prepare --download utilise le paquet MTP préféré du catalogue lorsqu’il est disponible.

Utilisez /connect -> runtime AX-Engine -> Choisir un modèle. AX Code configure et démarre le runtime local automatiquement lorsque le modèle choisi est nécessaire ; aucune URL ni clé d’API n’est exigée. Voir le statut, Arrêter le runtime local et Désactiver gèrent le runtime local. Choisir un modèle remplace aussi les anciens réglages d’attache manuelle par la configuration locale gérée.

Le moteur est livré seulement pour macOS Apple Silicon. Sur les autres hôtes, utilisez un fournisseur hébergé ou une passerelle de fournisseur compatible OpenAI ; les serveurs AX Code sont seulement locaux.