Questa pagina è tradotta dalla documentazione inglese. Comandi, identificatori ed esempi restano invariati. Runtime 7.24.4 · SDK 2.6.7. Testo inglese
Provider e modelli supportati
Stato: Attivo Ambito: stato attuale Ultima revisione: 2026-09-19 Responsabile: runtime di ax-code
Questa pagina elenca i preset di provider che AX Code espone nei flussi di configurazione predefiniti. La fonte di verità è l’elenco consentito dei provider di runtime in
packages/ax-code/src/provider/default-setup-providers.ts, l’istantanea dei modelli inclusa in
packages/ax-code/src/provider/models-snapshot.json, i preset di runtime locale in
packages/ax-code/src/provider/local-runtime.ts e le definizioni di AX Engine in
packages/ax-code/src/provider/ax-engine/constants.ts.
Usa /connect nell’interfaccia del terminale o ax-code providers login <provider-id> per la configurazione interattiva. Gli ambienti senza interfaccia e di CI possono anche fornire le variabili di ambiente elencate.
Gestire i provider collegati
La vista della sessione tiene una barra superiore con l’ID di sessione (clic per copiare), il titolo e lo stato vivo, seguita da una voce Providers che mostra il conteggio dei collegati; fai clic su di essa o su manage per aprire il gestore dei provider, disponibile anche come comando /providers. Da lì puoi selezionare un modello, disattivare o scollegare ogni provider, oppure saltare al flusso completo /connect.
- Sostituire una chiave: seleziona il provider in
/connecte scegli Replace key, oppure rieseguiax-code providers login <provider-id>. - Disattivare in modo temporaneo: scegli Disable in
/providerso/connect, oppure eseguiax-code providers disable <provider-id>. Questo aggiunge il provider adisabled_providersnella configurazione globale e conserva le credenziali salvate. I provider disattivati restano visibili in/providerse sotto Disabled in/connect, e si possono riaccendere con Enable oax-code providers enable <provider-id>. - Scollegare in modo permanente: scegli Disconnect in
/providerso/connect, oppure eseguiax-code providers logout <provider-id>: questo cancella la credenziale memorizzata daauth.json.
I cataloghi dei modelli ospitati sono inclusi in ogni rilascio di AX Code e filtrati per le capacità utilizzabili di un agente di programmazione. Esegui
ax-code models <provider-id> per gli ID di modello autorevoli nel rilascio installato; il registry grezzo e gli elenchi
web copiati possono contenere modelli che AX Code nasconde perché non hanno output di testo o chiamate di strumenti. Un preset di provider non
implica che ogni modello sia gratuito o disponibile su ogni account.
Scelte di runtime
Selezionare un modello senza una versione
Sia la TUI sia ax-code run accettano questi nomi di famiglia --model, senza distinzione di maiuscole:
| Famiglia | Modello |
|---|---|
deepseek |
deepseek-flash |
glm |
glm-5.3-flash |
qwen |
qwen3.8-flash |
Per esempio, ax-code --model glm apre la TUI con GLM Flash, e
ax-code run --model qwen -- "Review this change" richiede Qwen Flash.
Metti il prompt dopo -- (oppure passa --prompt / --prompt-file); --file allega
file e non è un file di prompt. ax-code models elenca gli ID provider/model utilizzabili.
I nomi di famiglia si risolvono tramite il provider nativo o un gateway collegato che serve
lo stesso modello. Puoi anche nominare il provider: --model my-gateway/glm.
Usa un ID completo come my-gateway/glm-5.3 per richiedere una versione o un livello specifico.
Omettere --model conserva le scelte di modello configurate, di agente, di sessione e recenti.
Quando non esiste una scelta utilizzabile, l’ordine di ripiego condiviso parte da DeepSeek Flash,
poi GLM Flash, poi Qwen Flash, tra i provider collegati. La configurazione dei provider ha i propri
predefiniti: Alibaba Coding Plan usa qwen3-coder-plus; Alibaba Token Plan usa
qwen3.8-flash.
Collegare un runtime
Le scelte in /connect sono ordinate API Cloud Provider, CLI Provider,
AX-Engine runtime, Local LLM runtime, Private GPU cloud e AX Trust.
AX-Engine runtime apre direttamente la selezione del modello locale e la gestione del runtime.
Local LLM runtime elenca queste scelte in ordine:
| Opzione di menu | ID del provider | Endpoint predefinito | Variabile di ambiente dell’host |
|---|---|---|---|
| Ollama | runtime ollama |
endpoint http://localhost:11434/v1 |
variabile OLLAMA_HOST |
| LMStudio | runtime lmstudio |
endpoint http://localhost:1234/v1 |
variabile LMSTUDIO_HOST |
| MTPLX | runtime mtplx |
endpoint http://localhost:8000/v1 |
variabile MTPLX_HOST |
| oMLX | runtime omlx |
endpoint http://localhost:8000/v1 |
variabile OMLX_HOST |
| AX-Studio | runtime ax-studio |
endpoint http://localhost:18080/v1 |
variabile AX_STUDIO_HOST |
| Others | runtime local-llm |
Inserisci il tuo endpoint compatibile con OpenAI | variabile LOCAL_LLM_HOST |
I preset di MTPLX e oMLX sono disponibili nel checkout dei sorgenti; i binari impacchettati v7.19.3 non li includono. Vedi Configurazione di MTPLX e oMLX per la configurazione della capacità degli strumenti, l’autenticazione facoltativa e l’avvertenza sulla porta predefinita condivisa.
Avvia il server locale, seleziona la sua voce di menu e conferma o modifica l’endpoint.
AX Code aggiunge /v1 se è omesso. Others salva un endpoint configurabile sotto
local-llm; selezionalo di nuovo per cambiare l’endpoint. LMStudio e Others usano il
flusso di configurazione locale esistente, senza una richiesta di token API. LM Studio documenta il suo
endpoint dell’elenco dei modelli.
Le scelte di configurazione rispettano enabled_providers e disabled_providers. Il solo fatto di aprire
il selettore non attiva né sonda questi server locali. I modelli locali esterni
scoperti conservano predefiniti di capacità conservativi; i modelli devono supportare le chiamate di
strumenti per essere selezionabili nei flussi di agente di programmazione.
Provider di API cloud
Questi provider chiamano API ospitate o endpoint di piani di account ospitati.
| ID del provider | Nome visualizzato | Variabili di ambiente delle credenziali |
|---|---|---|
google |
variabili GOOGLE_API_KEY, GOOGLE_GENERATIVE_AI_API_KEY, GEMINI_API_KEY |
|
deepseek |
DeepSeek | variabile DEEPSEEK_API_KEY |
meta |
Meta (Muse Spark) | variabili MODEL_API_KEY, META_MODEL_API_KEY |
groq |
GroqCloud | variabile GROQ_API_KEY |
openrouter |
OpenRouter | variabile OPENROUTER_API_KEY |
huggingface |
Hugging Face | variabile HF_TOKEN |
unorouter |
UnoRouter | variabile UNOROUTER_API_KEY |
alibaba-coding-plan |
Alibaba Coding Plan | variabili ALIBABA_CODING_PLAN_INTL_API_KEY, ALIBABA_CODING_PLAN_API_KEY |
alibaba-coding-plan-cn |
Alibaba Coding Plan (China) | variabili ALIBABA_CODING_PLAN_CN_API_KEY, ALIBABA_CODING_PLAN_API_KEY |
alibaba-token-plan |
Alibaba Token Plan | variabili ALIBABA_TOKEN_PLAN_INTL_API_KEY, ALIBABA_TOKEN_PLAN_API_KEY |
alibaba-token-plan-cn |
Alibaba Token Plan (China) | variabili ALIBABA_TOKEN_PLAN_CN_API_KEY, ALIBABA_TOKEN_PLAN_API_KEY |
github-copilot |
GitHub Copilot | variabile GITHUB_TOKEN |
zai |
Z.AI | variabile ZHIPU_API_KEY |
zai-coding-plan |
Z.AI Coding Plan | variabile ZHIPU_API_KEY |
minimax-coding-plan |
MiniMax Token Plan | variabili MINIMAX_TOKEN_PLAN_API_KEY, MINIMAX_API_KEY |
minimax-cn-coding-plan |
MiniMax Token Plan (China) | variabili MINIMAX_TOKEN_PLAN_CN_API_KEY, MINIMAX_API_KEY |
MiniMax ha rinominato Coding Plan in Token Plan. Gli ID dei provider restano minimax-coding-plan /
minimax-cn-coding-plan per corrispondere a models.dev e OpenCode. Usa una chiave Token Plan
(sk-cp-…) da platform.minimax.io
(internazionale) o platform.minimaxi.com (Cina).
huggingfaceè il router ospitato Serverless Inference Providers (https://router.huggingface.co/v1). Non ha relazione con la cache locale delle istantanee di Hugging Face che AX Engine usa per memorizzare i modelli locali scaricati: collegarehuggingfacenon avvia né richiede il motore locale.
Per una prima esecuzione senza costo, vedi Avvio rapido delle API del livello gratuito. Distingue l’offerta gratuita di un provider dalla compatibilità di AX Code e spiega perché un catalogo esterno di API gratuite non è di per sé una matrice di supporto.
Grok è supportato solo tramite il provider grok-build-cli elencato sotto. AX Code non include più un provider diretto di API cloud xai; le credenziali API Grok esistenti non creano un collegamento.
github-copilot è il ponte dell’account GitHub Copilot. Non è l’API separata github-models elencata da alcune
directory di API gratuite.
Sono supportati anche i gateway compatibili con OpenAI e con Anthropic, tramite la configurazione di un provider personalizzato. Vedi Provider personalizzati e gateway.
Cloud GPU privato
Questi provider compaiono in /connect sotto Private GPU cloud, dopo Local LLM runtime.
Scegli Custom provider per collegare il tuo endpoint GPU compatibile con OpenAI.
Inserisci l’URL e la chiave API; AX Code scopre i modelli da /v1/models e memorizza
la chiave nell’archivio di autenticazione cifrato. Il collegamento salvato resta in Private GPU
cloud. Selezionalo di nuovo per scegliere un modello, sostituire l’endpoint o scollegare.
Questa voce memorizza un endpoint configurabile sotto custom-private-gpu.
Catalogo (chiave API)
Cataloghi GPU ospitati in stile OpenCode. I modelli arrivano dall’istantanea inclusa di models.dev. Collegati con una chiave API.
| ID del provider | Nome visualizzato | Variabili di ambiente delle credenziali |
|---|---|---|
nebius |
Nebius Token Factory | variabile NEBIUS_API_KEY |
fireworks-ai |
Fireworks AI | variabile FIREWORKS_API_KEY |
togetherai |
Together AI | variabile TOGETHER_API_KEY |
baseten |
Baseten | variabile BASETEN_API_KEY |
nvidia |
NVIDIA NIM | variabile NVIDIA_API_KEY |
deepinfra |
Deep Infra | variabile DEEPINFRA_API_KEY |
Il router Hugging Face ospitato (huggingface / HF_TOKEN) resta in Provider di API cloud. Gli Inference Endpoints dedicati di Hugging Face sono elencati sotto.
Dedicato (URL e token)
Endpoint GPU dedicati in stile PAI. Incolla l’URL compatibile con OpenAI e il token; AX Code chiama GET …/models e usa gli ID dei modelli distribuiti. Non sono i provider Alibaba Coding Plan / Token Plan (DashScope).
| ID del provider | Nome visualizzato | Variabili di ambiente delle credenziali |
|---|---|---|
alibaba-pai |
Alibaba PAI-EAS | variabili ALIBABA_PAI_API_KEY, ALIBABA_PAI_BASE_URL |
runpod |
RunPod | variabili RUNPOD_API_KEY, RUNPOD_BASE_URL |
huggingface-endpoints |
Hugging Face Endpoints | variabili HF_ENDPOINTS_TOKEN, HF_ENDPOINTS_BASE_URL |
sagemaker |
Amazon SageMaker | variabili SAGEMAKER_API_KEY, SAGEMAKER_BASE_URL |
volcengine-ark |
Volcengine Ark | variabili ARK_API_KEY, ARK_BASE_URL |
modelarts |
Huawei ModelArts | variabili MODELARTS_API_KEY, MODELARTS_BASE_URL |
tencent-ti |
Tencent TI | variabili TENCENT_TI_API_KEY, TENCENT_TI_BASE_URL |
custom-private-gpu |
Custom provider | variabili CUSTOM_PRIVATE_GPU_API_KEY, CUSTOM_PRIVATE_GPU_BASE_URL |
sagemaker è per un URL compatibile con OpenAI davanti a SageMaker (vLLM / TGI / API Gateway). Non firma AWS SigV4.
AX Trust
AX Trust è l’ultima categoria in /connect, dopo Private GPU cloud. Scegli
Connect AX Trust, inserisci l’URL di base del gateway incluso /v1 e fornisci
la chiave API del client. AX Code scopre i modelli del gateway e memorizza la chiave
nell’archivio di autenticazione cifrato. I collegamenti salvati offrono selezione del modello, aggiornamento
dell’endpoint, aggiornamento dei modelli e cancellazione.
Ricollegare un URL esistente conserva il suo ID di provider, i modelli e la chiave salvata
quando il token viene lasciato vuoto. Il provider resta in AX Trust anche con un
nome personalizzato. Anche gli ID legacy ax-trust e ax-trust-* compaiono in questa categoria.
AX Trust continua a possedere la policy del gateway, le approvazioni e l’audit.
AX Code invia per impostazione predefinita un’intestazione di affinità di sessione su questi collegamenti.
Provider CLI
I provider CLI riusano una CLI locale del fornitore e il suo accesso o la sua sessione, invece di memorizzare in AX Code una chiave API ospitata.
| ID del provider | Nome visualizzato | Comando locale obbligatorio | ID di modello supportato |
|---|---|---|---|
claude-code |
Anthropic (Claude Code) | comando claude |
modello claude-code |
codex-cli |
OpenAI (Codex CLI) | comando codex |
modello codex-cli |
grok-build-cli |
Grok Build CLI | comando grok |
modello grok-build-cli |
muse-cli |
Muse Code CLI | comando muse |
modello muse-cli |
Esegui prima l’accesso della CLI del fornitore, quando è richiesto, poi esegui ax-code providers login <provider-id>. AX Code sonda il comando CLI e memorizza una credenziale marcatore locale dopo che la sonda riesce.
Per Muse Code, installa il binario locale muse, esegui muse login (oppure imposta META_API_KEY), poi ax-code providers login muse-cli. AX Code riusa la sessione della CLI Muse (~/.config/muse) invece di memorizzare una chiave API Meta ospitata. Il provider di API ospitato meta resta un collegamento separato.
Il Token Plan MiniMax ospitato resta disponibile come minimax-coding-plan / minimax-cn-coding-plan. Non c’è un provider incluso MiniMax Code CLI né Kimi Code CLI.
Provider locale AX Engine
ax-engine è il provider di inferenza locale integrato. È disponibile solo sui Mac Apple Silicon idonei e offre solo i pacchetti di sviluppo AutomatosX Tiel Coder e Cyber-Tiel Coder 35B A3B MXFP4 MTP. Le capacità native vengono controllate all’avvio del modello.
| ID del provider | ID del modello | Selezione | Contesto | Output |
|---|---|---|---|---|
ax-engine |
tiel-coder-35b-axq-mxfp4 |
pacchetto Tiel Coder 35B A3B MXFP4 MTP (predefinito) | 65,536 | 8,192 |
ax-engine |
cyber-tiel-coder-35b-axq-mxfp4 |
pacchetto Cyber-Tiel Coder 35B A3B MXFP4 MTP | 65,536 | 8,192 |
Qwen3.8 27B, Ornith, Qwen3-Coder-Next e tutti gli altri repository sono esclusi dalla selezione gestita. I registri storici restano leggibili per lo stato e la pulizia.
Il modello locale predefinito è tiel-coder-35b-axq-mxfp4. Vedi Selezione dei modelli di AX Engine per i repository selezionati esatti e la guida a memoria e disco.
Per l’interfaccia di attach su loopback configurata separatamente, /v1/models fa fede: AX Code scopre gli ID dei modelli vivi, i limiti di contesto e di output, le modalità e il supporto delle chiamate di strumenti strutturate. Un modello che non pubblicizza le chiamate di strumenti strutturate non viene usato per le richieste dell’agente di programmazione.
AX Engine usa per impostazione predefinita il profilo di strumenti compatto core (bash, scoperta, lettura, modifica e scrittura dei file, e skill). Imposta provider.ax-engine.options.toolProfile su full solo per una distribuzione personalizzata con abbastanza contesto per il registry completo degli strumenti.
Installare il motore
L’inferenza locale richiede AX Engine 7.5.7 o successivo. Gli installer per Mac Apple Silicon includono già un sidecar autonomo di AX Engine (engine/<version>/ accanto al runtime CLI), quindi un Mac pulito non ha bisogno di Homebrew.
AX Code risolve poi il binario in questo ordine:
provider.ax-engine.options.binaryPathinax-code.json(richiede una versione verificata di almeno 7.5.7)- la variabile di ambiente
AX_ENGINE_BIN(richiede una versione verificata di almeno 7.5.7) ax-enginenel tuoPATH(richiede una versione verificata di almeno 7.5.7)- un’installazione overlay gestita da AX Code (
ax-code providers ax-engine install; richiede anch’essa almeno 7.5.7) - il sidecar incluso nel runtime Mac corrente
Controlla prima --version e ripiega su install.version da ax-engine doctor --json. Il codice di uscita di Doctor riporta la prontezza dell’host (toolchain Metal, file MLX), quindi un’uscita diversa da zero conta comunque quando quel JSON contiene una versione. AX Code possiede l’avvio del server e di norma lancia ax-engine serve su 127.0.0.1:31418. La formula Homebrew facoltativa resta un’alternativa per chi vuole un motore posseduto da brew; non è obbligatoria.
Gli avvii gestiti di Tiel usano la finestra del catalogo (65,536 token di contesto e 8,192 token di output), più grande del predefinito integrato di 16,384 token di ax-engine serve, così il prompt dell’agente ci sta. Riduci uno dei due budget con provider.ax-engine.options.contextTokens e provider.ax-engine.options.maxOutputTokens (outputTokens è la stessa manopola di output). I nomi di ambiente sono AX_ENGINE_CONTEXT_TOKENS e AX_ENGINE_MAX_OUTPUT_TOKENS (AX_ENGINE_OUTPUT_TOKENS è un alias). Una sostituzione può solo restringere il tetto del catalogo: un valore più grande o non valido viene segnalato e ignorato, e una finestra di Tiel o Qwen3.8 che non è un multiplo di 1,024 viene abbassata al multiplo inferiore, così i blocchi della cache dei prefissi restano di 1,024 token. Gli stessi numeri sono quelli usati dal server in esecuzione e dal limite del modello. Una scheda viva /v1/models può restringere ancora quella finestra, e non può alzarla. Le opzioni configurate prevalgono, e AX Code avvisa quando un valore di ambiente viene ignorato. Lo stesso avviso viene emesso quando binaryPath ignora AX_ENGINE_BIN, oppure quando connectionMode / baseURL ignora AX_ENGINE_HOST. Una finestra più piccola può essere troppo piccola per il prompt completo dell’agente; AX Code allora rifiuta il modello invece di inviare un prompt che il server non può contenere.
Tiel e Cyber-Tiel pubblicizzano le chiamate di strumenti strutturate. Una scheda viva /v1/models scavalca comunque quella pubblicità una volta che il server è in esecuzione. mtpPolicy: disabled spegne MTP anche quando la versione del binario non si può leggere; auto e required richiedono comunque AX Engine 7.4.0 o più recente.
Un’installazione PATH o overlay a cui mancano libmlx.dylib / mlx.metallib viene rifiutata. Gli archivi inclusi e di overlay sono il payload autonomo macOS 7.5.7.
Installare il motore non scarica un modello. Scegli e scarica un modello dopo, dalla pagina Desktop Models oppure con ax-code providers ax-engine prepare. Un’istantanea di base compatibile e completa, già nella cache di Hugging Face, è accettata per la decodifica diretta; prepare --download usa il pacchetto MTP preferito del catalogo quando è disponibile.
Usa /connect, poi AX-Engine runtime, poi Select a model. AX Code configura
e avvia il runtime locale in automatico quando serve il modello selezionato;
non servono URL né chiave API. View status, Stop local runtime e
Disable gestiscono il runtime locale. Selezionare un modello sostituisce anche le impostazioni
legacy di attach manuale con la configurazione locale gestita.
Il motore è distribuito solo per macOS su Apple Silicon. Sugli altri host, usa un provider ospitato o un gateway di provider compatibile con OpenAI; i server di AX Code sono solo locali.