Scarica AX Code · GratuitoDocumentazione

Questa pagina è tradotta dalla documentazione inglese. Comandi, identificatori ed esempi restano invariati. Runtime 7.24.4 · SDK 2.6.7. Testo inglese

Sforzo del modello (pensiero / varianti)

Stato: Attivo
Ambito: stato attuale
Ultima revisione: 2026-07-18
Responsabile: runtime di ax-code

AX Code usa lo sforzo (detto anche livello di pensiero) per controllare quanto a fondo ragiona il modello attivo. Lo sforzo non è una modalità di lavoro e non è una modalità di collocamento.

Asse Domanda Esempi
Modello Quale modello? Sonnet, Opus, GPT, Qwen locale
Sforzo Quanto a fondo deve pensare? Automatico, Veloce, Bilanciato, Profondo, Massimo
Modalità di lavoro Come è strutturato il lavoro? Agent, Council, Arena
Collocamento Dove gira l’inferenza? local, cloud, hybrid

Vedi Modalità di esecuzione per le modalità di lavoro e di collocamento.

Formato sul filo

Il runtime memorizza e invia comunque chiavi di variante compatibili con OpenCode, prese dal catalogo del provider (per esempio low, medium, high, xhigh, max). Le etichette dell’interfaccia sono solo un livello di presentazione:

Etichetta dell’interfaccia Chiave tipica sul filo
Automatico (nessuna — predefinito del modello o della policy)
Disattivato none
Minimo minimal
Veloce low
Bilanciato medium
Profondo high
Massimo xhigh, max

Le chiavi disponibili sono per modello. I modelli senza varianti nascondono il controllo dello sforzo.

Supporto dei provider

I livelli di sforzo vengono generati in automatico per i modelli supportati su questi provider:

Provider Meccanismo Livelli
Anthropic (Claude) effort sui modelli attuali; budget di pensiero sui modelli legacy Veloce, Bilanciato, Profondo, Massimo (dipende dal modello)
OpenAI (GPT-5.x) reasoningEffort Veloce, Bilanciato, Profondo
Google (Gemini 3.x) thinkingConfig.thinkingLevel Veloce, Profondo (3.1 aggiunge Bilanciato)
Endpoint compatibili con OpenAI reasoningEffort Veloce, Bilanciato, Profondo
Venice reasoningEffort Veloce, Bilanciato, Profondo
Claude Code CLI --effort Veloce, Bilanciato, Profondo, Massimo
Codex CLI sostituzione della configurazione model_reasoning_effort Minimo, Veloce, Bilanciato, Profondo, Massimo
Grok Build CLI --reasoning-effort Veloce, Bilanciato, Profondo

I provider la cui API di sforzo non è verificata o è incompatibile (API ospitata di Groq, OpenRouter, famiglie DeepSeek/Alibaba/MiniMax/GLM/Mistral, provider CLI non supportati e gateway di terze parti) non espongono livelli integrati; /effort lo spiega invece di fallire in silenzio. Definisci livelli personalizzati sotto provider.<id>.models.<model>.variants in ax-code.json quando un provider documenta una forma di opzione supportata.

Come impostare lo sforzo

TUI

  • Ciclo: ctrl+t (associazione tasti variant_cycle) — scorre Automatico → ogni livello disponibile → Automatico
  • Selettore: /effort (alias /variant, /thinking); sui modelli senza livelli apre una finestra di spiegazione
  • Stato: il piè di pagina del prompt mostra il chip dello sforzo corrente quando il modello supporta i livelli; i messaggi inviati mostrano l’etichetta di sforzo nella riga dei metadati
  • CLI: ax-code run --variant high

Desktop

  • Controllo del pensiero accanto al selettore del modello
  • Ciclo da tastiera (lo stesso percorso di associazione tasti del ciclo delle varianti del modello)
  • Le etichette usano la stessa corrispondenza amichevole della TUI

Predefiniti e comportamento automatico

  1. Automatico significa nessuna sostituzione esplicita dell’utente per quel modello.
  2. Quando Automatico è attivo, ReasoningPolicy applica una base bilanciata (medium / variante default del provider) così i modelli attivano davvero il pensiero e passano i flag di sforzo, invece di ometterli.
  3. Questo vale sia per i modelli con reasoning: true sia per i provider che espongono lo sforzo solo come varianti (per esempio le CLI Claude Code / Codex / Grok Build, che riportano reasoning: false perché l’output è opaco per l’AI SDK).
  4. La policy può ancora alzare la profondità a Profondo per la modalità piano, la modalità autonoma o i prompt ad alto rischio (e per fallimento ripetuto, alta incertezza o ampio raggio di impatto, quando quei segnali sono forniti).
  5. Quando l’utente sceglie uno sforzo esplicito, quella sostituzione prevale nei turni successivi (la policy non la contrasta). Anche le opzioni di configurazione o di agente che impostano già il ragionamento/effort/thinking vengono lasciate intatte.
  6. Lo sforzo viene ricordato per modello nelle preferenze locali dei modelli (model.json nella directory di stato della TUI).

Configurazione

Fissa un predefinito su un agente:

{
  "agent": {
    "plan": {
      "variant": "high"
    }
  }
}

Definisci o disattiva le varianti del provider sotto provider.<id>.models.<model>.variants in ax-code.json (stessa forma di OpenCode).

Buone pratiche

  • Preferisci Automatico o Bilanciato/Profondo per il lavoro quotidiano; riserva Massimo al debug difficile o all’architettura.
  • Non inventare una quarta modalità globale «lite / xfast / max» che entri in concorrenza con Agent/Council/Arena.
  • Tieni modello, sforzo e modalità di lavoro come controlli separati nel testo dell’interfaccia.
  • Al cambio di modello, uno sforzo memorizzato non valido torna ad Automatico per quel modello.