Obter AX Code · GrátisDocumentação

Esta página é uma tradução da documentação em inglês. Comandos, identificadores e exemplos permanecem iguais. Runtime 7.24.4 · SDK 2.6.7. Original em inglês

Esforço do modelo (raciocínio / variantes)

Status: Ativo
Escopo: estado atual
Última revisão: 2026-07-18
Responsável: ax-code runtime

O AX Code usa esforço (também chamado de nível de raciocínio) para controlar o quanto o modelo ativo raciocina. Esforço não é um modo de trabalho e não é um modo de colocação.

Eixo Pergunta Exemplos
Modelo Qual modelo? Sonnet, Opus, GPT, Qwen local
Esforço Com que intensidade deve pensar? Auto, Fast, Balanced, Deep, Max
Modo de trabalho Como o trabalho é estruturado? Agent, Council, Arena
Colocação Onde a inferência executa? local, nuvem, híbrido

Veja Modos de execução para os modos de trabalho e de colocação.

Formato no fio

O runtime ainda guarda e envia chaves de variante compatíveis com o OpenCode, vindas do catálogo do provedor (por exemplo low, medium, high, xhigh, max). Os rótulos da interface são apenas uma camada de apresentação:

Rótulo na interface Chave típica no fio
Auto (nenhuma — padrão do modelo ou da política)
Off none
Minimal minimal
Fast low
Balanced medium
Deep high
Max xhigh, max

As chaves disponíveis são por modelo. Modelos sem variantes ocultam o controle de esforço.

Suporte dos provedores

Os níveis de esforço são gerados de forma automática para os modelos com suporte nestes provedores:

Provedor Mecanismo Níveis
Anthropic (Claude) effort nos modelos atuais; orçamentos de raciocínio nos modelos legados Fast, Balanced, Deep, Max (depende do modelo)
OpenAI (GPT-5.x) reasoningEffort Fast, Balanced, Deep
Google (Gemini 3.x) thinkingConfig.thinkingLevel Fast, Deep (a 3.1 acrescenta Balanced)
Endpoints compatíveis com a OpenAI reasoningEffort Fast, Balanced, Deep
Venice reasoningEffort Fast, Balanced, Deep
CLI do Claude Code --effort Fast, Balanced, Deep, Max
CLI do Codex substituição de configuração model_reasoning_effort Minimal, Fast, Balanced, Deep, Max
CLI do Grok Build --reasoning-effort Fast, Balanced, Deep

Provedores cuja API de esforço não foi verificada ou é incompatível (a API hospedada da Groq, a OpenRouter, as famílias DeepSeek, Alibaba, MiniMax, GLM e Mistral, provedores de CLI sem suporte e gateways de terceiros) não expõem níveis embutidos; /effort explica isso em vez de falhar em silêncio. Defina níveis personalizados em provider.<id>.models.<model>.variants dentro de ax-code.json quando um provedor documentar uma forma de opção com suporte.

Como definir o esforço

TUI

  • Ciclo: ctrl+t (atalho variant_cycle) — percorre Auto, cada nível disponível e volta a Auto
  • Seletor: /effort (apelidos /variant, /thinking); em modelos sem níveis, abre um diálogo de explicação
  • Status: o rodapé do prompt mostra o selo do esforço atual quando o modelo aceita níveis; as mensagens enviadas mostram o rótulo de esforço na linha de metadados
  • CLI: ax-code run --variant high

Aplicativo de área de trabalho

  • Controle de raciocínio ao lado do seletor de modelo
  • Ciclo pelo teclado (o mesmo caminho de atalho do ciclo de variante do modelo)
  • Os rótulos usam o mesmo mapeamento amigável da TUI

Padrões e comportamento automático

  1. Auto significa que não há uma substituição explícita do usuário para aquele modelo.
  2. Com Auto ativo, a ReasoningPolicy aplica uma base equilibrada (variante medium / default do provedor), para que os modelos de fato liguem o raciocínio e enviem as marcas de esforço, em vez de omiti-las.
  3. Isso vale tanto para modelos com reasoning: true quanto para provedores que só expõem esforço como variantes (por exemplo as CLIs do Claude Code, do Codex e do Grok Build, que informam reasoning: false porque a saída é opaca para o AI SDK).
  4. A política ainda pode elevar a profundidade para Deep no modo de plano, no modo autônomo ou em prompts de alto risco (e também diante de falha repetida, alta incerteza ou alto raio de impacto, quando esses sinais são fornecidos).
  5. Quando o usuário escolhe um esforço explícito, essa substituição vale nos turnos seguintes (a política não a contraria). Opções de configuração ou de agente que já definam raciocínio, effort ou thinking também ficam como estão.
  6. O esforço é lembrado por modelo nas preferências locais de modelo (model.json no diretório de estado da TUI).

Configuração

Fixe um padrão num agente:

{
  "agent": {
    "plan": {
      "variant": "high"
    }
  }
}

Defina ou desative variantes do provedor em provider.<id>.models.<model>.variants dentro de ax-code.json (o mesmo formato do OpenCode).

Boas práticas

  • Prefira Auto ou Balanced/Deep no dia a dia; reserve Max para depuração difícil ou para arquitetura.
  • Não invente um quarto modo global do tipo “lite / xfast / max” que concorra com Agent, Council e Arena.
  • Mantenha modelo, esforço e modo de trabalho como controles separados no texto da interface.
  • Ao trocar de modelo, um esforço armazenado e inválido volta para Auto naquele modelo.