Scarica AX Code · GratuitoDocumentazione

Questa pagina è tradotta dalla documentazione inglese. Comandi, identificatori ed esempi restano invariati. Runtime 7.24.4 · SDK 2.6.7. Testo inglese

Provider e modelli supportati

Stato: Attivo Ambito: stato attuale Ultima revisione: 2026-09-19 Responsabile: runtime di ax-code

Questa pagina elenca i preset di provider che AX Code espone nei flussi di configurazione predefiniti. La fonte di verità è l’elenco consentito dei provider di runtime in packages/ax-code/src/provider/default-setup-providers.ts, l’istantanea dei modelli inclusa in packages/ax-code/src/provider/models-snapshot.json, i preset di runtime locale in packages/ax-code/src/provider/local-runtime.ts e le definizioni di AX Engine in packages/ax-code/src/provider/ax-engine/constants.ts.

Usa /connect nell’interfaccia del terminale o ax-code providers login <provider-id> per la configurazione interattiva. Gli ambienti senza interfaccia e di CI possono anche fornire le variabili di ambiente elencate.

Gestire i provider collegati

La vista della sessione tiene una barra superiore con l’ID di sessione (clic per copiare), il titolo e lo stato vivo, seguita da una voce Providers che mostra il conteggio dei collegati; fai clic su di essa o su manage per aprire il gestore dei provider, disponibile anche come comando /providers. Da lì puoi selezionare un modello, disattivare o scollegare ogni provider, oppure saltare al flusso completo /connect.

  • Sostituire una chiave: seleziona il provider in /connect e scegli Replace key, oppure riesegui ax-code providers login <provider-id>.
  • Disattivare in modo temporaneo: scegli Disable in /providers o /connect, oppure esegui ax-code providers disable <provider-id>. Questo aggiunge il provider a disabled_providers nella configurazione globale e conserva le credenziali salvate. I provider disattivati restano visibili in /providers e sotto Disabled in /connect, e si possono riaccendere con Enable o ax-code providers enable <provider-id>.
  • Scollegare in modo permanente: scegli Disconnect in /providers o /connect, oppure esegui ax-code providers logout <provider-id>: questo cancella la credenziale memorizzata da auth.json.

I cataloghi dei modelli ospitati sono inclusi in ogni rilascio di AX Code e filtrati per le capacità utilizzabili di un agente di programmazione. Esegui ax-code models <provider-id> per gli ID di modello autorevoli nel rilascio installato; il registry grezzo e gli elenchi web copiati possono contenere modelli che AX Code nasconde perché non hanno output di testo o chiamate di strumenti. Un preset di provider non implica che ogni modello sia gratuito o disponibile su ogni account.

Scelte di runtime

Selezionare un modello senza una versione

Sia la TUI sia ax-code run accettano questi nomi di famiglia --model, senza distinzione di maiuscole:

Famiglia Modello
deepseek deepseek-flash
glm glm-5.3-flash
qwen qwen3.8-flash

Per esempio, ax-code --model glm apre la TUI con GLM Flash, e ax-code run --model qwen -- "Review this change" richiede Qwen Flash. Metti il prompt dopo -- (oppure passa --prompt / --prompt-file); --file allega file e non è un file di prompt. ax-code models elenca gli ID provider/model utilizzabili. I nomi di famiglia si risolvono tramite il provider nativo o un gateway collegato che serve lo stesso modello. Puoi anche nominare il provider: --model my-gateway/glm. Usa un ID completo come my-gateway/glm-5.3 per richiedere una versione o un livello specifico.

Omettere --model conserva le scelte di modello configurate, di agente, di sessione e recenti. Quando non esiste una scelta utilizzabile, l’ordine di ripiego condiviso parte da DeepSeek Flash, poi GLM Flash, poi Qwen Flash, tra i provider collegati. La configurazione dei provider ha i propri predefiniti: Alibaba Coding Plan usa qwen3-coder-plus; Alibaba Token Plan usa qwen3.8-flash.

Collegare un runtime

Le scelte in /connect sono ordinate API Cloud Provider, CLI Provider, AX-Engine runtime, Local LLM runtime, Private GPU cloud e AX Trust. AX-Engine runtime apre direttamente la selezione del modello locale e la gestione del runtime. Local LLM runtime elenca queste scelte in ordine:

Opzione di menu ID del provider Endpoint predefinito Variabile di ambiente dell’host
Ollama runtime ollama endpoint http://localhost:11434/v1 variabile OLLAMA_HOST
LMStudio runtime lmstudio endpoint http://localhost:1234/v1 variabile LMSTUDIO_HOST
MTPLX runtime mtplx endpoint http://localhost:8000/v1 variabile MTPLX_HOST
oMLX runtime omlx endpoint http://localhost:8000/v1 variabile OMLX_HOST
AX-Studio runtime ax-studio endpoint http://localhost:18080/v1 variabile AX_STUDIO_HOST
Others runtime local-llm Inserisci il tuo endpoint compatibile con OpenAI variabile LOCAL_LLM_HOST

I preset di MTPLX e oMLX sono disponibili nel checkout dei sorgenti; i binari impacchettati v7.19.3 non li includono. Vedi Configurazione di MTPLX e oMLX per la configurazione della capacità degli strumenti, l’autenticazione facoltativa e l’avvertenza sulla porta predefinita condivisa.

Avvia il server locale, seleziona la sua voce di menu e conferma o modifica l’endpoint. AX Code aggiunge /v1 se è omesso. Others salva un endpoint configurabile sotto local-llm; selezionalo di nuovo per cambiare l’endpoint. LMStudio e Others usano il flusso di configurazione locale esistente, senza una richiesta di token API. LM Studio documenta il suo endpoint dell’elenco dei modelli.

Le scelte di configurazione rispettano enabled_providers e disabled_providers. Il solo fatto di aprire il selettore non attiva né sonda questi server locali. I modelli locali esterni scoperti conservano predefiniti di capacità conservativi; i modelli devono supportare le chiamate di strumenti per essere selezionabili nei flussi di agente di programmazione.

Provider di API cloud

Questi provider chiamano API ospitate o endpoint di piani di account ospitati.

ID del provider Nome visualizzato Variabili di ambiente delle credenziali
google Google variabili GOOGLE_API_KEY, GOOGLE_GENERATIVE_AI_API_KEY, GEMINI_API_KEY
deepseek DeepSeek variabile DEEPSEEK_API_KEY
meta Meta (Muse Spark) variabili MODEL_API_KEY, META_MODEL_API_KEY
groq GroqCloud variabile GROQ_API_KEY
openrouter OpenRouter variabile OPENROUTER_API_KEY
huggingface Hugging Face variabile HF_TOKEN
unorouter UnoRouter variabile UNOROUTER_API_KEY
alibaba-coding-plan Alibaba Coding Plan variabili ALIBABA_CODING_PLAN_INTL_API_KEY, ALIBABA_CODING_PLAN_API_KEY
alibaba-coding-plan-cn Alibaba Coding Plan (China) variabili ALIBABA_CODING_PLAN_CN_API_KEY, ALIBABA_CODING_PLAN_API_KEY
alibaba-token-plan Alibaba Token Plan variabili ALIBABA_TOKEN_PLAN_INTL_API_KEY, ALIBABA_TOKEN_PLAN_API_KEY
alibaba-token-plan-cn Alibaba Token Plan (China) variabili ALIBABA_TOKEN_PLAN_CN_API_KEY, ALIBABA_TOKEN_PLAN_API_KEY
github-copilot GitHub Copilot variabile GITHUB_TOKEN
zai Z.AI variabile ZHIPU_API_KEY
zai-coding-plan Z.AI Coding Plan variabile ZHIPU_API_KEY
minimax-coding-plan MiniMax Token Plan variabili MINIMAX_TOKEN_PLAN_API_KEY, MINIMAX_API_KEY
minimax-cn-coding-plan MiniMax Token Plan (China) variabili MINIMAX_TOKEN_PLAN_CN_API_KEY, MINIMAX_API_KEY

MiniMax ha rinominato Coding Plan in Token Plan. Gli ID dei provider restano minimax-coding-plan / minimax-cn-coding-plan per corrispondere a models.dev e OpenCode. Usa una chiave Token Plan (sk-cp-…) da platform.minimax.io (internazionale) o platform.minimaxi.com (Cina).

huggingface è il router ospitato Serverless Inference Providers (https://router.huggingface.co/v1). Non ha relazione con la cache locale delle istantanee di Hugging Face che AX Engine usa per memorizzare i modelli locali scaricati: collegare huggingface non avvia né richiede il motore locale.

Per una prima esecuzione senza costo, vedi Avvio rapido delle API del livello gratuito. Distingue l’offerta gratuita di un provider dalla compatibilità di AX Code e spiega perché un catalogo esterno di API gratuite non è di per sé una matrice di supporto.

Grok è supportato solo tramite il provider grok-build-cli elencato sotto. AX Code non include più un provider diretto di API cloud xai; le credenziali API Grok esistenti non creano un collegamento.

github-copilot è il ponte dell’account GitHub Copilot. Non è l’API separata github-models elencata da alcune directory di API gratuite.

Sono supportati anche i gateway compatibili con OpenAI e con Anthropic, tramite la configurazione di un provider personalizzato. Vedi Provider personalizzati e gateway.

Cloud GPU privato

Questi provider compaiono in /connect sotto Private GPU cloud, dopo Local LLM runtime.

Scegli Custom provider per collegare il tuo endpoint GPU compatibile con OpenAI. Inserisci l’URL e la chiave API; AX Code scopre i modelli da /v1/models e memorizza la chiave nell’archivio di autenticazione cifrato. Il collegamento salvato resta in Private GPU cloud. Selezionalo di nuovo per scegliere un modello, sostituire l’endpoint o scollegare. Questa voce memorizza un endpoint configurabile sotto custom-private-gpu.

Catalogo (chiave API)

Cataloghi GPU ospitati in stile OpenCode. I modelli arrivano dall’istantanea inclusa di models.dev. Collegati con una chiave API.

ID del provider Nome visualizzato Variabili di ambiente delle credenziali
nebius Nebius Token Factory variabile NEBIUS_API_KEY
fireworks-ai Fireworks AI variabile FIREWORKS_API_KEY
togetherai Together AI variabile TOGETHER_API_KEY
baseten Baseten variabile BASETEN_API_KEY
nvidia NVIDIA NIM variabile NVIDIA_API_KEY
deepinfra Deep Infra variabile DEEPINFRA_API_KEY

Il router Hugging Face ospitato (huggingface / HF_TOKEN) resta in Provider di API cloud. Gli Inference Endpoints dedicati di Hugging Face sono elencati sotto.

Dedicato (URL e token)

Endpoint GPU dedicati in stile PAI. Incolla l’URL compatibile con OpenAI e il token; AX Code chiama GET …/models e usa gli ID dei modelli distribuiti. Non sono i provider Alibaba Coding Plan / Token Plan (DashScope).

ID del provider Nome visualizzato Variabili di ambiente delle credenziali
alibaba-pai Alibaba PAI-EAS variabili ALIBABA_PAI_API_KEY, ALIBABA_PAI_BASE_URL
runpod RunPod variabili RUNPOD_API_KEY, RUNPOD_BASE_URL
huggingface-endpoints Hugging Face Endpoints variabili HF_ENDPOINTS_TOKEN, HF_ENDPOINTS_BASE_URL
sagemaker Amazon SageMaker variabili SAGEMAKER_API_KEY, SAGEMAKER_BASE_URL
volcengine-ark Volcengine Ark variabili ARK_API_KEY, ARK_BASE_URL
modelarts Huawei ModelArts variabili MODELARTS_API_KEY, MODELARTS_BASE_URL
tencent-ti Tencent TI variabili TENCENT_TI_API_KEY, TENCENT_TI_BASE_URL
custom-private-gpu Custom provider variabili CUSTOM_PRIVATE_GPU_API_KEY, CUSTOM_PRIVATE_GPU_BASE_URL

sagemaker è per un URL compatibile con OpenAI davanti a SageMaker (vLLM / TGI / API Gateway). Non firma AWS SigV4.

AX Trust

AX Trust è l’ultima categoria in /connect, dopo Private GPU cloud. Scegli Connect AX Trust, inserisci l’URL di base del gateway incluso /v1 e fornisci la chiave API del client. AX Code scopre i modelli del gateway e memorizza la chiave nell’archivio di autenticazione cifrato. I collegamenti salvati offrono selezione del modello, aggiornamento dell’endpoint, aggiornamento dei modelli e cancellazione.

Ricollegare un URL esistente conserva il suo ID di provider, i modelli e la chiave salvata quando il token viene lasciato vuoto. Il provider resta in AX Trust anche con un nome personalizzato. Anche gli ID legacy ax-trust e ax-trust-* compaiono in questa categoria. AX Trust continua a possedere la policy del gateway, le approvazioni e l’audit. AX Code invia per impostazione predefinita un’intestazione di affinità di sessione su questi collegamenti.

Provider CLI

I provider CLI riusano una CLI locale del fornitore e il suo accesso o la sua sessione, invece di memorizzare in AX Code una chiave API ospitata.

ID del provider Nome visualizzato Comando locale obbligatorio ID di modello supportato
claude-code Anthropic (Claude Code) comando claude modello claude-code
codex-cli OpenAI (Codex CLI) comando codex modello codex-cli
grok-build-cli Grok Build CLI comando grok modello grok-build-cli
muse-cli Muse Code CLI comando muse modello muse-cli

Esegui prima l’accesso della CLI del fornitore, quando è richiesto, poi esegui ax-code providers login <provider-id>. AX Code sonda il comando CLI e memorizza una credenziale marcatore locale dopo che la sonda riesce.

Per Muse Code, installa il binario locale muse, esegui muse login (oppure imposta META_API_KEY), poi ax-code providers login muse-cli. AX Code riusa la sessione della CLI Muse (~/.config/muse) invece di memorizzare una chiave API Meta ospitata. Il provider di API ospitato meta resta un collegamento separato.

Il Token Plan MiniMax ospitato resta disponibile come minimax-coding-plan / minimax-cn-coding-plan. Non c’è un provider incluso MiniMax Code CLI né Kimi Code CLI.

Provider locale AX Engine

ax-engine è il provider di inferenza locale integrato. È disponibile solo sui Mac Apple Silicon idonei e offre solo i pacchetti di sviluppo AutomatosX Tiel Coder e Cyber-Tiel Coder 35B A3B MXFP4 MTP. Le capacità native vengono controllate all’avvio del modello.

ID del provider ID del modello Selezione Contesto Output
ax-engine tiel-coder-35b-axq-mxfp4 pacchetto Tiel Coder 35B A3B MXFP4 MTP (predefinito) 65,536 8,192
ax-engine cyber-tiel-coder-35b-axq-mxfp4 pacchetto Cyber-Tiel Coder 35B A3B MXFP4 MTP 65,536 8,192

Qwen3.8 27B, Ornith, Qwen3-Coder-Next e tutti gli altri repository sono esclusi dalla selezione gestita. I registri storici restano leggibili per lo stato e la pulizia.

Il modello locale predefinito è tiel-coder-35b-axq-mxfp4. Vedi Selezione dei modelli di AX Engine per i repository selezionati esatti e la guida a memoria e disco.

Per l’interfaccia di attach su loopback configurata separatamente, /v1/models fa fede: AX Code scopre gli ID dei modelli vivi, i limiti di contesto e di output, le modalità e il supporto delle chiamate di strumenti strutturate. Un modello che non pubblicizza le chiamate di strumenti strutturate non viene usato per le richieste dell’agente di programmazione.

AX Engine usa per impostazione predefinita il profilo di strumenti compatto core (bash, scoperta, lettura, modifica e scrittura dei file, e skill). Imposta provider.ax-engine.options.toolProfile su full solo per una distribuzione personalizzata con abbastanza contesto per il registry completo degli strumenti.

Installare il motore

L’inferenza locale richiede AX Engine 7.5.7 o successivo. Gli installer per Mac Apple Silicon includono già un sidecar autonomo di AX Engine (engine/<version>/ accanto al runtime CLI), quindi un Mac pulito non ha bisogno di Homebrew.

AX Code risolve poi il binario in questo ordine:

  1. provider.ax-engine.options.binaryPath in ax-code.json (richiede una versione verificata di almeno 7.5.7)
  2. la variabile di ambiente AX_ENGINE_BIN (richiede una versione verificata di almeno 7.5.7)
  3. ax-engine nel tuo PATH (richiede una versione verificata di almeno 7.5.7)
  4. un’installazione overlay gestita da AX Code (ax-code providers ax-engine install; richiede anch’essa almeno 7.5.7)
  5. il sidecar incluso nel runtime Mac corrente

Controlla prima --version e ripiega su install.version da ax-engine doctor --json. Il codice di uscita di Doctor riporta la prontezza dell’host (toolchain Metal, file MLX), quindi un’uscita diversa da zero conta comunque quando quel JSON contiene una versione. AX Code possiede l’avvio del server e di norma lancia ax-engine serve su 127.0.0.1:31418. La formula Homebrew facoltativa resta un’alternativa per chi vuole un motore posseduto da brew; non è obbligatoria.

Gli avvii gestiti di Tiel usano la finestra del catalogo (65,536 token di contesto e 8,192 token di output), più grande del predefinito integrato di 16,384 token di ax-engine serve, così il prompt dell’agente ci sta. Riduci uno dei due budget con provider.ax-engine.options.contextTokens e provider.ax-engine.options.maxOutputTokens (outputTokens è la stessa manopola di output). I nomi di ambiente sono AX_ENGINE_CONTEXT_TOKENS e AX_ENGINE_MAX_OUTPUT_TOKENS (AX_ENGINE_OUTPUT_TOKENS è un alias). Una sostituzione può solo restringere il tetto del catalogo: un valore più grande o non valido viene segnalato e ignorato, e una finestra di Tiel o Qwen3.8 che non è un multiplo di 1,024 viene abbassata al multiplo inferiore, così i blocchi della cache dei prefissi restano di 1,024 token. Gli stessi numeri sono quelli usati dal server in esecuzione e dal limite del modello. Una scheda viva /v1/models può restringere ancora quella finestra, e non può alzarla. Le opzioni configurate prevalgono, e AX Code avvisa quando un valore di ambiente viene ignorato. Lo stesso avviso viene emesso quando binaryPath ignora AX_ENGINE_BIN, oppure quando connectionMode / baseURL ignora AX_ENGINE_HOST. Una finestra più piccola può essere troppo piccola per il prompt completo dell’agente; AX Code allora rifiuta il modello invece di inviare un prompt che il server non può contenere.

Tiel e Cyber-Tiel pubblicizzano le chiamate di strumenti strutturate. Una scheda viva /v1/models scavalca comunque quella pubblicità una volta che il server è in esecuzione. mtpPolicy: disabled spegne MTP anche quando la versione del binario non si può leggere; auto e required richiedono comunque AX Engine 7.4.0 o più recente.

Un’installazione PATH o overlay a cui mancano libmlx.dylib / mlx.metallib viene rifiutata. Gli archivi inclusi e di overlay sono il payload autonomo macOS 7.5.7.

Installare il motore non scarica un modello. Scegli e scarica un modello dopo, dalla pagina Desktop Models oppure con ax-code providers ax-engine prepare. Un’istantanea di base compatibile e completa, già nella cache di Hugging Face, è accettata per la decodifica diretta; prepare --download usa il pacchetto MTP preferito del catalogo quando è disponibile.

Usa /connect, poi AX-Engine runtime, poi Select a model. AX Code configura e avvia il runtime locale in automatico quando serve il modello selezionato; non servono URL né chiave API. View status, Stop local runtime e Disable gestiscono il runtime locale. Selezionare un modello sostituisce anche le impostazioni legacy di attach manuale con la configurazione locale gestita.

Il motore è distribuito solo per macOS su Apple Silicon. Sugli altri host, usa un provider ospitato o un gateway di provider compatibile con OpenAI; i server di AX Code sono solo locali.