Получить AX Code · БесплатноДокументация

Эта страница переведена с английской документации. Команды, идентификаторы и примеры не изменены. Среда выполнения 7.24.4 · SDK 2.6.7. Английский оригинал

Лучшие практики маршрутизации нескольких моделей

Статус: активно Область: публично, текущее состояние Последняя проверка: 2026-09-13 Владелец: среда выполнения ax-code

Это руководство описывает рекомендуемый способ запуска ax-code с дорогой моделью рассуждения и более дешёвыми вспомогательными моделями того же провайдера.

Основной принцип

Дорогую модель используйте для работы, плотной по рассуждению, а дешёвые — для механической работы или только чтения. Настоящая экономия приходит от фильтрации контекста: дорогая модель видит только сжатый контекст, который подготовили более дешёвые модели или субагенты.

Слой Класс модели Типичные агенты / задачи
Рабочий / исполнитель Подключённый flash-артикул, если доступен (например, DeepSeek Flash) незакреплённая сессия, build, general, scout, test, devops, perf
Советник / рассуждение Более сильная подключённая модель (например, DeepSeek V4 Pro) plan, architect, security, debug
Дешёвый вспомогательный слой только для чтения Тот же flash-артикул explore, compaction, заголовки, пересказы, классификация низкой сложности

Закрепляйте идентификаторы provider/model, которые подключены. Отключённые идентификаторы собственного плана (alibaba-token-plan, deepseek, zai-coding-plan, minimax-coding-plan) по-прежнему разрешаются по артикулу, но каждый вызов сначала пробует отключённого провайдера и предупреждает. Qwen 3.8 Max — допустимый явный выбор, а не значение продукта или примера по умолчанию; без config.model неявный выбор по умолчанию обходит подключённые каталоги в таком порядке: deepseek-flash, glm-5.3-flash, qwen3.8-flash, MiniMax-M3, grok-4.6, claude-sonnet-5, gpt-6, gemini-3.8-flash, qwen3.8-27b.

Шаблон конфигурации

См. ax-code.json.example в корне репозитория: конкретный пример DeepSeek Flash по умолчанию и Pro на агентах рассуждения.

Вспомогательные модели Codex CLI

Доступность моделей Codex зависит от способа входа в аккаунт и от клиента, а не только от текстовых возможностей каталога или возможностей инструментов. Поэтому AX Code не выводит малую модель codex-cli из имён или метаданных семейства. Без явной модели small_model или модели агента уплотнения уплотнение использует модель сессии.

Если вы настраиваете вспомогательную модель, проверьте, что она работает с тем же входом Codex. Явный отказ Codex, что модель не поддерживается с аккаунтом ChatGPT, позволяет уплотнению один раз попробовать модель сессии, пропуская другие малые модели. Отклонённая попытка остаётся в истории сессии. Прочие сбои аутентификации, оплаты, проверки, отмены и переполнения контекста сохраняют прежнюю обработку; защита приватности локального провайдера по-прежнему действует.

Для затронутой более старой установки уберите несовместимое переопределение small_model или agent.compaction.model и явно закрепите agent.compaction.model на модели, уже проверенной с этим аккаунтом Codex. Смена только видимой модели сессии не перекрывает отдельно закреплённую модель уплотнения.

Правила автоматической маршрутизации по типу задачи

Не отправляйте все малоценные задачи на дешёвую модель автоматически. Делите их по цене ошибки:

  • Безопасно маршрутизировать автоматически (только чтение или доступно для рецензии человеком):
    • исследование репозитория, разбор grep и поиска, классификация файлов
    • краткое изложение кода, краткое изложение журналов, объяснение кода
    • подготовка контекста для дорогой модели
    • документация
  • Только по явному согласию (механически проверяемо, но может скрыть изменение поведения):
    • шаблонный код, исправления линтера
  • Никогда не маршрутизировать автоматически по умолчанию (тихие ошибки дороги):
    • модульные тесты
    • переименование и рефакторинг
    • простой SQL
    • обёртка API
    • простой CRUD

Последняя группа должна оставаться на модели сессии, пока пользователь явно не закрепит более дешёвую модель.

Рабочая инструкция

  1. Нетривиальные задачи начинайте в режиме plan, чтобы советник проверил замысел до того, как рабочий напишет код.
  2. Если рабочий зацикливается или дважды не проходит проверку, переключитесь на debug с сигналом сбоя.
  3. Используйте council для независимой диагностики, когда правдоподобны два исправления, а не чтобы закончить задачу.
  4. Ручную смену модели оставляйте для редких ходов с тяжёлым рассуждением; затем вернитесь обратно.

Известные ограничения ax-code

  • Provider.getSmallModel() возвращает undefined для провайдеров, чей каталог не помечает несущий уровень family и не совпадает с жёстко заданными списками приоритета; вспомогательные вызовы тогда возвращаются к модели сессии (в журнале: «no small model for provider»).
  • Нет повышения посреди запуска от застрявшего рабочего к более сильной модели.