Esta página é uma tradução da documentação em inglês. Comandos, identificadores e exemplos permanecem iguais. Runtime 7.24.4 · SDK 2.6.7. Original em inglês
Esforço do modelo (raciocínio / variantes)
Status: Ativo
Escopo: estado atual
Última revisão: 2026-07-18
Responsável: ax-code runtime
O AX Code usa esforço (também chamado de nível de raciocínio) para controlar o quanto o modelo ativo raciocina. Esforço não é um modo de trabalho e não é um modo de colocação.
| Eixo | Pergunta | Exemplos |
|---|---|---|
| Modelo | Qual modelo? | Sonnet, Opus, GPT, Qwen local |
| Esforço | Com que intensidade deve pensar? | Auto, Fast, Balanced, Deep, Max |
| Modo de trabalho | Como o trabalho é estruturado? | Agent, Council, Arena |
| Colocação | Onde a inferência executa? | local, nuvem, híbrido |
Veja Modos de execução para os modos de trabalho e de colocação.
Formato no fio
O runtime ainda guarda e envia chaves de variante compatíveis com o OpenCode, vindas do catálogo do provedor (por exemplo low, medium, high, xhigh, max). Os rótulos da interface são apenas uma camada de apresentação:
| Rótulo na interface | Chave típica no fio |
|---|---|
| Auto | (nenhuma — padrão do modelo ou da política) |
| Off | none |
| Minimal | minimal |
| Fast | low |
| Balanced | medium |
| Deep | high |
| Max | xhigh, max |
As chaves disponíveis são por modelo. Modelos sem variantes ocultam o controle de esforço.
Suporte dos provedores
Os níveis de esforço são gerados de forma automática para os modelos com suporte nestes provedores:
| Provedor | Mecanismo | Níveis |
|---|---|---|
| Anthropic (Claude) | effort nos modelos atuais; orçamentos de raciocínio nos modelos legados |
Fast, Balanced, Deep, Max (depende do modelo) |
| OpenAI (GPT-5.x) | reasoningEffort |
Fast, Balanced, Deep |
| Google (Gemini 3.x) | thinkingConfig.thinkingLevel |
Fast, Deep (a 3.1 acrescenta Balanced) |
| Endpoints compatíveis com a OpenAI | reasoningEffort |
Fast, Balanced, Deep |
| Venice | reasoningEffort |
Fast, Balanced, Deep |
| CLI do Claude Code | --effort |
Fast, Balanced, Deep, Max |
| CLI do Codex | substituição de configuração model_reasoning_effort |
Minimal, Fast, Balanced, Deep, Max |
| CLI do Grok Build | --reasoning-effort |
Fast, Balanced, Deep |
Provedores cuja API de esforço não foi verificada ou é incompatível (a API hospedada da Groq, a OpenRouter, as famílias DeepSeek, Alibaba, MiniMax, GLM e Mistral, provedores de CLI sem suporte e gateways de terceiros) não expõem níveis embutidos; /effort explica isso em vez de falhar em silêncio. Defina níveis personalizados em provider.<id>.models.<model>.variants dentro de ax-code.json quando um provedor documentar uma forma de opção com suporte.
Como definir o esforço
TUI
- Ciclo:
ctrl+t(atalhovariant_cycle) — percorre Auto, cada nível disponível e volta a Auto - Seletor:
/effort(apelidos/variant,/thinking); em modelos sem níveis, abre um diálogo de explicação - Status: o rodapé do prompt mostra o selo do esforço atual quando o modelo aceita níveis; as mensagens enviadas mostram o rótulo de esforço na linha de metadados
- CLI:
ax-code run --variant high
Aplicativo de área de trabalho
- Controle de raciocínio ao lado do seletor de modelo
- Ciclo pelo teclado (o mesmo caminho de atalho do ciclo de variante do modelo)
- Os rótulos usam o mesmo mapeamento amigável da TUI
Padrões e comportamento automático
- Auto significa que não há uma substituição explícita do usuário para aquele modelo.
- Com Auto ativo, a ReasoningPolicy aplica uma base equilibrada (variante
medium/defaultdo provedor), para que os modelos de fato liguem o raciocínio e enviem as marcas de esforço, em vez de omiti-las. - Isso vale tanto para modelos com
reasoning: truequanto para provedores que só expõem esforço como variantes (por exemplo as CLIs do Claude Code, do Codex e do Grok Build, que informamreasoning: falseporque a saída é opaca para o AI SDK). - A política ainda pode elevar a profundidade para Deep no modo de plano, no modo autônomo ou em prompts de alto risco (e também diante de falha repetida, alta incerteza ou alto raio de impacto, quando esses sinais são fornecidos).
- Quando o usuário escolhe um esforço explícito, essa substituição vale nos turnos seguintes (a política não a contraria). Opções de configuração ou de agente que já definam raciocínio,
effortouthinkingtambém ficam como estão. - O esforço é lembrado por modelo nas preferências locais de modelo (
model.jsonno diretório de estado da TUI).
Configuração
Fixe um padrão num agente:
{
"agent": {
"plan": {
"variant": "high"
}
}
}
Defina ou desative variantes do provedor em provider.<id>.models.<model>.variants dentro de ax-code.json (o mesmo formato do OpenCode).
Boas práticas
- Prefira Auto ou Balanced/Deep no dia a dia; reserve Max para depuração difícil ou para arquitetura.
- Não invente um quarto modo global do tipo “lite / xfast / max” que concorra com Agent, Council e Arena.
- Mantenha modelo, esforço e modo de trabalho como controles separados no texto da interface.
- Ao trocar de modelo, um esforço armazenado e inválido volta para Auto naquele modelo.
Relacionados
- Modos de execução — Agent, Council, Arena e colocação híbrida
- Provedores com suporte — quais provedores expõem modelos
- Variantes de modelo do OpenCode: https://opencode.ai/docs/models/