Эта страница переведена с английской документации. Команды, идентификаторы и примеры не изменены. Среда выполнения 7.24.4 · SDK 2.6.7. Английский оригинал
Усилие модели (рассуждение / варианты)
Статус: активно
Область: текущее состояние
Последняя проверка: 2026-07-18
Владелец: среда выполнения ax-code
AX Code использует усилие (его также называют уровнем рассуждения), чтобы управлять тем, насколько напряжённо рассуждает активная модель. Усилие — не режим работы и не режим размещения.
| Ось | Вопрос | Примеры |
|---|---|---|
| Модель | Какая модель? | Sonnet, Opus, GPT, локальная Qwen |
| Усилие | Насколько напряжённо думать? | Авто, Быстро, Сбалансированно, Глубоко, Максимум |
| Режим работы | Как устроена работа? | Agent, Council, Arena |
| Размещение | Где выполняется вывод? | локально, облако, гибрид |
Режимы работы и размещения см. в Режимах выполнения.
Формат на проводе
Среда выполнения по-прежнему хранит и отправляет ключи варианта, совместимые с OpenCode, из каталога провайдера (например, low, medium, high, xhigh, max). Подписи интерфейса — только слой представления:
| Подпись интерфейса | Типичный ключ на проводе |
|---|---|
| Авто | (нет — модель / значение политики по умолчанию) |
| Выкл | none |
| Минимум | minimal |
| Быстро | low |
| Сбалансированно | medium |
| Глубоко | high |
| Максимум | xhigh, max |
Доступные ключи зависят от модели. У моделей без вариантов элемент управления усилием скрыт.
Поддержка провайдеров
Уровни усилия порождаются автоматически для поддерживаемых моделей у этих провайдеров:
| Провайдер | Механизм | Уровни |
|---|---|---|
| Anthropic (Claude) | effort на текущих моделях; бюджеты рассуждения на устаревших моделях |
Быстро, Сбалансированно, Глубоко, Максимум (зависит от модели) |
| OpenAI (GPT-5.x) | reasoningEffort |
Быстро, Сбалансированно, Глубоко |
| Google (Gemini 3.x) | thinkingConfig.thinkingLevel |
Быстро, Глубоко (3.1 добавляет Сбалансированно) |
| Конечные точки, совместимые с OpenAI | reasoningEffort |
Быстро, Сбалансированно, Глубоко |
| Venice | reasoningEffort |
Быстро, Сбалансированно, Глубоко |
| Claude Code CLI | --effort |
Быстро, Сбалансированно, Глубоко, Максимум |
| Codex CLI | переопределение конфигурации model_reasoning_effort |
Минимум, Быстро, Сбалансированно, Глубоко, Максимум |
| Grok Build CLI | --reasoning-effort |
Быстро, Сбалансированно, Глубоко |
Провайдеры, чей API усилия не проверен или несовместим (размещённый API Groq, OpenRouter, семейства DeepSeek/Alibaba/MiniMax/GLM/Mistral, неподдерживаемые CLI-провайдеры и сторонние шлюзы), не показывают встроенных уровней; /effort объясняет это вместо тихого сбоя. Задайте свои уровни в provider.<id>.models.<model>.variants внутри ax-code.json, когда провайдер документирует поддерживаемую форму параметра.
Как задать усилие
TUI
- Цикл:
ctrl+t(привязкаvariant_cycle) — идёт от Авто к каждому доступному уровню и снова к Авто - Выбор:
/effort(псевдонимы/variant,/thinking); на моделях без уровней открывает диалог с объяснением - Статус: подвал запроса показывает метку текущего усилия, если модель поддерживает уровни; отправленные сообщения показывают подпись усилия в строке метаданных
- CLI:
ax-code run --variant high
Desktop
- Элемент управления рассуждением рядом с выбором модели
- Цикл с клавиатуры (тот же путь привязки, что и цикл варианта модели)
- Подписи используют то же понятное соответствие, что и TUI
Значения по умолчанию и поведение Авто
- Авто означает, что для этой модели нет явного переопределения пользователя.
- Когда активно Авто, ReasoningPolicy применяет базу сбалансированно (вариант
medium/ провайдераdefault), чтобы модели действительно включали рассуждение и передавали флаги усилия, а не опускали их. - Это относится и к моделям с
reasoning: true, и к провайдерам, которые показывают усилие только как варианты (например, CLI Claude Code / Codex / Grok Build, которые сообщаютreasoning: false, потому что вывод непрозрачен для AI SDK). - Политика всё ещё может поднять глубину до Глубоко для режима плана, автономного режима или запросов высокого риска (а также при повторном сбое, высокой неопределённости и большом радиусе поражения, если эти сигналы переданы).
- Когда пользователь выбирает явное усилие, это переопределение побеждает на последующих ходах (политика с ним не спорит). Параметры конфигурации или агента, которые уже задали рассуждение/
effort/thinking, тоже не трогаются. - Усилие запоминается для каждой модели в локальных предпочтениях модели (
model.jsonв каталоге состояния TUI).
Конфигурация
Закрепите значение по умолчанию на агенте:
{
"agent": {
"plan": {
"variant": "high"
}
}
}
Определите или отключите варианты провайдера в provider.<id>.models.<model>.variants внутри ax-code.json (та же форма, что у OpenCode).
Лучшие практики
- Для повседневной работы предпочитайте Авто или Сбалансированно/Глубоко; Максимум оставьте для трудной отладки или архитектуры.
- Не выдумывайте четвёртый глобальный режим «облегчённый / сверхбыстрый / максимум», который соперничает с Agent/Council/Arena.
- В текстах интерфейса держите модель, усилие и режим работы раздельными элементами управления.
- При смене модели недопустимое сохранённое усилие возвращается к Авто для этой модели.
Связанное
- Режимы выполнения — Agent / Council / Arena и гибридное размещение
- Поддерживаемые провайдеры — какие провайдеры показывают модели
- Варианты моделей OpenCode: https://opencode.ai/docs/models/