Esta página es una traducción de la documentación en inglés. Los comandos, identificadores y ejemplos no cambian. Runtime 7.24.4 · SDK 2.6.7. Original en inglés
Esfuerzo del modelo (pensamiento y variantes)
Estado: Activo Alcance: estado actual Última revisión: 2026-07-18 Responsable: runtime de ax-code
AX Code usa el esfuerzo (también llamado nivel de pensamiento) para controlar con qué intensidad razona el modelo activo. El esfuerzo no es un modo de trabajo y no es un modo de colocación.
| Eje | Pregunta | Ejemplos |
|---|---|---|
| Modelo | ¿Qué modelo? | Sonnet, Opus, GPT, Qwen local |
| Esfuerzo | ¿Con qué intensidad debe pensar? | Auto, Rápido, Equilibrado, Profundo, Máximo |
| Modo de trabajo | ¿Cómo se estructura el trabajo? | Agente, Council, Arena |
| Colocación | ¿Dónde se ejecuta la inferencia? | local, nube, híbrido |
Consulta Modos de ejecución para los modos de trabajo y de colocación.
Formato de cable
El entorno de ejecución sigue guardando y enviando claves de variante compatibles con OpenCode del catálogo del proveedor (por ejemplo low, medium, high, xhigh, max). Las etiquetas de la interfaz son solo una capa de presentación:
| Etiqueta de la interfaz | Clave de cable habitual |
|---|---|
| Auto | (ninguna: valor predeterminado del modelo o de la política) |
| Desactivado | none |
| Mínimo | minimal |
| Rápido | low |
| Equilibrado | medium |
| Profundo | high |
| Máximo | xhigh, max |
Las claves disponibles son por modelo. Los modelos sin variantes ocultan el control de esfuerzo.
Soporte de proveedores
Los niveles de esfuerzo se generan de forma automática para los modelos compatibles de estos proveedores:
| Proveedor | Mecanismo | Niveles |
|---|---|---|
| Anthropic (Claude) | effort en los modelos actuales; presupuestos de pensamiento en los modelos heredados |
Rápido, Equilibrado, Profundo, Máximo (según el modelo) |
| OpenAI (GPT-5.x) | reasoningEffort |
Rápido, Equilibrado, Profundo |
| Google (Gemini 3.x) | thinkingConfig.thinkingLevel |
Rápido, Profundo (3.1 añade Equilibrado) |
| Endpoints compatibles con OpenAI | reasoningEffort |
Rápido, Equilibrado, Profundo |
| Venice | reasoningEffort |
Rápido, Equilibrado, Profundo |
| Claude Code CLI | --effort |
Rápido, Equilibrado, Profundo, Máximo |
| Codex CLI | model_reasoning_effort |
Mínimo, Rápido, Equilibrado, Profundo, Máximo |
| Grok Build CLI | --reasoning-effort |
Rápido, Equilibrado, Profundo |
Los proveedores cuya API de esfuerzo no está verificada o es incompatible (la API alojada de Groq, OpenRouter, las familias DeepSeek/Alibaba/MiniMax/GLM/Mistral, los proveedores CLI no compatibles y las pasarelas de terceros) no exponen niveles integrados; /effort lo explica en lugar de fallar en silencio. Define niveles personalizados bajo provider.<id>.models.<model>.variants en ax-code.json cuando un proveedor documenta una forma de opción compatible.
Cómo definir el esfuerzo
En la TUI
- Ciclo:
ctrl+t(atajovariant_cycle): recorre Auto → cada nivel disponible → Auto - Selector:
/effort(alias/variant,/thinking); en los modelos sin niveles abre un diálogo de explicación - Estado: el pie del prompt muestra la pastilla de esfuerzo actual cuando el modelo admite niveles; los mensajes enviados muestran su etiqueta de esfuerzo en la fila de metadatos
- CLI:
ax-code run --variant high
Escritorio
- Control de pensamiento junto al selector de modelo
- Ciclo de teclado (el mismo camino de atajo que el ciclo de variante del modelo)
- Las etiquetas usan la misma correspondencia amigable que la TUI
Valores predeterminados y comportamiento automático
- Auto significa que no hay una anulación explícita del usuario para ese modelo.
- Cuando Auto está activo, ReasoningPolicy aplica una línea base equilibrada (
medium/ variantedefaultdel proveedor) para que los modelos activen de verdad el pensamiento y pasen los indicadores de esfuerzo, en lugar de omitirlos. - Esto se aplica tanto a los modelos con
reasoning: truecomo a los proveedores que solo exponen el esfuerzo como variantes (por ejemplo las CLI de Claude Code, Codex y Grok Build, que informanreasoning: falseporque la salida es opaca para el SDK de IA). - La política aún puede subir la profundidad a Profundo para el modo de plan, el modo autónomo o los prompts de alto riesgo (y ante un fallo repetido, una incertidumbre alta o un radio de impacto alto cuando se aportan esas señales).
- Cuando el usuario elige un esfuerzo explícito, esa anulación prevalece en los turnos siguientes (la política no la contradice). Las opciones de configuración o de agente que ya definen el razonamiento,
effortothinkingtambién se dejan como están. - El esfuerzo se recuerda por modelo en las preferencias locales de modelo (
model.jsonen el directorio de estado de la TUI).
Configuración
Fija un valor predeterminado en un agente:
{
"agent": {
"plan": {
"variant": "high"
}
}
}
Define o desactiva las variantes del proveedor bajo provider.<id>.models.<model>.variants en ax-code.json (la misma forma que OpenCode).
Buenas prácticas
- Prefiere Auto o Equilibrado/Profundo para el trabajo diario; reserva Máximo para una depuración difícil o para la arquitectura.
- No inventes un cuarto modo global «lite / xfast / max» que compita con Agente/Council/Arena.
- Mantén el modelo, el esfuerzo y el modo de trabajo como controles separados en el texto de la interfaz.
- Al cambiar de modelo, un esfuerzo guardado que no sea válido vuelve a Auto para ese modelo.
Relacionado
- Modos de ejecución: Agente / Council / Arena y colocación híbrida
- Proveedores compatibles: qué proveedores exponen modelos
- Variantes de modelo de OpenCode: https://opencode.ai/docs/models/