Questa pagina è tradotta dalla documentazione inglese. Comandi, identificatori ed esempi restano invariati. Runtime 7.24.4 · SDK 2.6.7. Testo inglese
Sforzo del modello (pensiero / varianti)
Stato: Attivo
Ambito: stato attuale
Ultima revisione: 2026-07-18
Responsabile: runtime di ax-code
AX Code usa lo sforzo (detto anche livello di pensiero) per controllare quanto a fondo ragiona il modello attivo. Lo sforzo non è una modalità di lavoro e non è una modalità di collocamento.
| Asse | Domanda | Esempi |
|---|---|---|
| Modello | Quale modello? | Sonnet, Opus, GPT, Qwen locale |
| Sforzo | Quanto a fondo deve pensare? | Automatico, Veloce, Bilanciato, Profondo, Massimo |
| Modalità di lavoro | Come è strutturato il lavoro? | Agent, Council, Arena |
| Collocamento | Dove gira l’inferenza? | local, cloud, hybrid |
Vedi Modalità di esecuzione per le modalità di lavoro e di collocamento.
Formato sul filo
Il runtime memorizza e invia comunque chiavi di variante compatibili con OpenCode, prese dal catalogo del provider (per esempio low, medium, high, xhigh, max). Le etichette dell’interfaccia sono solo un livello di presentazione:
| Etichetta dell’interfaccia | Chiave tipica sul filo |
|---|---|
| Automatico | (nessuna — predefinito del modello o della policy) |
| Disattivato | none |
| Minimo | minimal |
| Veloce | low |
| Bilanciato | medium |
| Profondo | high |
| Massimo | xhigh, max |
Le chiavi disponibili sono per modello. I modelli senza varianti nascondono il controllo dello sforzo.
Supporto dei provider
I livelli di sforzo vengono generati in automatico per i modelli supportati su questi provider:
| Provider | Meccanismo | Livelli |
|---|---|---|
| Anthropic (Claude) | effort sui modelli attuali; budget di pensiero sui modelli legacy |
Veloce, Bilanciato, Profondo, Massimo (dipende dal modello) |
| OpenAI (GPT-5.x) | reasoningEffort |
Veloce, Bilanciato, Profondo |
| Google (Gemini 3.x) | thinkingConfig.thinkingLevel |
Veloce, Profondo (3.1 aggiunge Bilanciato) |
| Endpoint compatibili con OpenAI | reasoningEffort |
Veloce, Bilanciato, Profondo |
| Venice | reasoningEffort |
Veloce, Bilanciato, Profondo |
| Claude Code CLI | --effort |
Veloce, Bilanciato, Profondo, Massimo |
| Codex CLI | sostituzione della configurazione model_reasoning_effort |
Minimo, Veloce, Bilanciato, Profondo, Massimo |
| Grok Build CLI | --reasoning-effort |
Veloce, Bilanciato, Profondo |
I provider la cui API di sforzo non è verificata o è incompatibile (API ospitata di Groq, OpenRouter, famiglie DeepSeek/Alibaba/MiniMax/GLM/Mistral, provider CLI non supportati e gateway di terze parti) non espongono livelli integrati; /effort lo spiega invece di fallire in silenzio. Definisci livelli personalizzati sotto provider.<id>.models.<model>.variants in ax-code.json quando un provider documenta una forma di opzione supportata.
Come impostare lo sforzo
TUI
- Ciclo:
ctrl+t(associazione tastivariant_cycle) — scorre Automatico → ogni livello disponibile → Automatico - Selettore:
/effort(alias/variant,/thinking); sui modelli senza livelli apre una finestra di spiegazione - Stato: il piè di pagina del prompt mostra il chip dello sforzo corrente quando il modello supporta i livelli; i messaggi inviati mostrano l’etichetta di sforzo nella riga dei metadati
- CLI:
ax-code run --variant high
Desktop
- Controllo del pensiero accanto al selettore del modello
- Ciclo da tastiera (lo stesso percorso di associazione tasti del ciclo delle varianti del modello)
- Le etichette usano la stessa corrispondenza amichevole della TUI
Predefiniti e comportamento automatico
- Automatico significa nessuna sostituzione esplicita dell’utente per quel modello.
- Quando Automatico è attivo, ReasoningPolicy applica una base bilanciata (
medium/ variantedefaultdel provider) così i modelli attivano davvero il pensiero e passano i flag di sforzo, invece di ometterli. - Questo vale sia per i modelli con
reasoning: truesia per i provider che espongono lo sforzo solo come varianti (per esempio le CLI Claude Code / Codex / Grok Build, che riportanoreasoning: falseperché l’output è opaco per l’AI SDK). - La policy può ancora alzare la profondità a Profondo per la modalità piano, la modalità autonoma o i prompt ad alto rischio (e per fallimento ripetuto, alta incertezza o ampio raggio di impatto, quando quei segnali sono forniti).
- Quando l’utente sceglie uno sforzo esplicito, quella sostituzione prevale nei turni successivi (la policy non la contrasta). Anche le opzioni di configurazione o di agente che impostano già il ragionamento/
effort/thinkingvengono lasciate intatte. - Lo sforzo viene ricordato per modello nelle preferenze locali dei modelli (
model.jsonnella directory di stato della TUI).
Configurazione
Fissa un predefinito su un agente:
{
"agent": {
"plan": {
"variant": "high"
}
}
}
Definisci o disattiva le varianti del provider sotto provider.<id>.models.<model>.variants in ax-code.json (stessa forma di OpenCode).
Buone pratiche
- Preferisci Automatico o Bilanciato/Profondo per il lavoro quotidiano; riserva Massimo al debug difficile o all’architettura.
- Non inventare una quarta modalità globale «lite / xfast / max» che entri in concorrenza con Agent/Council/Arena.
- Tieni modello, sforzo e modalità di lavoro come controlli separati nel testo dell’interfaccia.
- Al cambio di modello, uno sforzo memorizzato non valido torna ad Automatico per quel modello.
Correlati
- Modalità di esecuzione — Agent / Council / Arena e collocamento ibrido
- Provider supportati — quali provider espongono modelli
- Varianti di modello di OpenCode: https://opencode.ai/docs/models/