Obtener AX Code · GratisDocumentación

Esta página es una traducción de la documentación en inglés. Los comandos, identificadores y ejemplos no cambian. Runtime 7.24.4 · SDK 2.6.7. Original en inglés

Esfuerzo del modelo (pensamiento y variantes)

Estado: Activo Alcance: estado actual Última revisión: 2026-07-18 Responsable: runtime de ax-code

AX Code usa el esfuerzo (también llamado nivel de pensamiento) para controlar con qué intensidad razona el modelo activo. El esfuerzo no es un modo de trabajo y no es un modo de colocación.

Eje Pregunta Ejemplos
Modelo ¿Qué modelo? Sonnet, Opus, GPT, Qwen local
Esfuerzo ¿Con qué intensidad debe pensar? Auto, Rápido, Equilibrado, Profundo, Máximo
Modo de trabajo ¿Cómo se estructura el trabajo? Agente, Council, Arena
Colocación ¿Dónde se ejecuta la inferencia? local, nube, híbrido

Consulta Modos de ejecución para los modos de trabajo y de colocación.

Formato de cable

El entorno de ejecución sigue guardando y enviando claves de variante compatibles con OpenCode del catálogo del proveedor (por ejemplo low, medium, high, xhigh, max). Las etiquetas de la interfaz son solo una capa de presentación:

Etiqueta de la interfaz Clave de cable habitual
Auto (ninguna: valor predeterminado del modelo o de la política)
Desactivado none
Mínimo minimal
Rápido low
Equilibrado medium
Profundo high
Máximo xhigh, max

Las claves disponibles son por modelo. Los modelos sin variantes ocultan el control de esfuerzo.

Soporte de proveedores

Los niveles de esfuerzo se generan de forma automática para los modelos compatibles de estos proveedores:

Proveedor Mecanismo Niveles
Anthropic (Claude) effort en los modelos actuales; presupuestos de pensamiento en los modelos heredados Rápido, Equilibrado, Profundo, Máximo (según el modelo)
OpenAI (GPT-5.x) reasoningEffort Rápido, Equilibrado, Profundo
Google (Gemini 3.x) thinkingConfig.thinkingLevel Rápido, Profundo (3.1 añade Equilibrado)
Endpoints compatibles con OpenAI reasoningEffort Rápido, Equilibrado, Profundo
Venice reasoningEffort Rápido, Equilibrado, Profundo
Claude Code CLI --effort Rápido, Equilibrado, Profundo, Máximo
Codex CLI model_reasoning_effort Mínimo, Rápido, Equilibrado, Profundo, Máximo
Grok Build CLI --reasoning-effort Rápido, Equilibrado, Profundo

Los proveedores cuya API de esfuerzo no está verificada o es incompatible (la API alojada de Groq, OpenRouter, las familias DeepSeek/Alibaba/MiniMax/GLM/Mistral, los proveedores CLI no compatibles y las pasarelas de terceros) no exponen niveles integrados; /effort lo explica en lugar de fallar en silencio. Define niveles personalizados bajo provider.<id>.models.<model>.variants en ax-code.json cuando un proveedor documenta una forma de opción compatible.

Cómo definir el esfuerzo

En la TUI

  • Ciclo: ctrl+t (atajo variant_cycle): recorre Auto → cada nivel disponible → Auto
  • Selector: /effort (alias /variant, /thinking); en los modelos sin niveles abre un diálogo de explicación
  • Estado: el pie del prompt muestra la pastilla de esfuerzo actual cuando el modelo admite niveles; los mensajes enviados muestran su etiqueta de esfuerzo en la fila de metadatos
  • CLI: ax-code run --variant high

Escritorio

  • Control de pensamiento junto al selector de modelo
  • Ciclo de teclado (el mismo camino de atajo que el ciclo de variante del modelo)
  • Las etiquetas usan la misma correspondencia amigable que la TUI

Valores predeterminados y comportamiento automático

  1. Auto significa que no hay una anulación explícita del usuario para ese modelo.
  2. Cuando Auto está activo, ReasoningPolicy aplica una línea base equilibrada (medium / variante default del proveedor) para que los modelos activen de verdad el pensamiento y pasen los indicadores de esfuerzo, en lugar de omitirlos.
  3. Esto se aplica tanto a los modelos con reasoning: true como a los proveedores que solo exponen el esfuerzo como variantes (por ejemplo las CLI de Claude Code, Codex y Grok Build, que informan reasoning: false porque la salida es opaca para el SDK de IA).
  4. La política aún puede subir la profundidad a Profundo para el modo de plan, el modo autónomo o los prompts de alto riesgo (y ante un fallo repetido, una incertidumbre alta o un radio de impacto alto cuando se aportan esas señales).
  5. Cuando el usuario elige un esfuerzo explícito, esa anulación prevalece en los turnos siguientes (la política no la contradice). Las opciones de configuración o de agente que ya definen el razonamiento, effort o thinking también se dejan como están.
  6. El esfuerzo se recuerda por modelo en las preferencias locales de modelo (model.json en el directorio de estado de la TUI).

Configuración

Fija un valor predeterminado en un agente:

{
  "agent": {
    "plan": {
      "variant": "high"
    }
  }
}

Define o desactiva las variantes del proveedor bajo provider.<id>.models.<model>.variants en ax-code.json (la misma forma que OpenCode).

Buenas prácticas

  • Prefiere Auto o Equilibrado/Profundo para el trabajo diario; reserva Máximo para una depuración difícil o para la arquitectura.
  • No inventes un cuarto modo global «lite / xfast / max» que compita con Agente/Council/Arena.
  • Mantén el modelo, el esfuerzo y el modo de trabajo como controles separados en el texto de la interfaz.
  • Al cambiar de modelo, un esfuerzo guardado que no sea válido vuelve a Auto para ese modelo.