Obtenir AX Code · GratuitDocumentation

Cette page est traduite de la documentation anglaise. Les commandes, identifiants et exemples sont inchangés. Runtime 7.24.4 · SDK 2.6.7. Source anglaise

Effort du modèle (réflexion / variantes)

Statut : actif
Portée : état actuel
Dernière revue : 2026-07-18
Responsable : runtime AX Code

AX Code utilise l’effort (aussi appelé niveau de réflexion) pour régler l’intensité de raisonnement du modèle actif. L’effort n’est pas un mode de travail et n’est pas un mode de placement.

Axe Question Exemples
Modèle Quel modèle ? Sonnet, Opus, GPT, Qwen local
Effort Avec quelle intensité doit-il réfléchir ? Auto, Rapide, Équilibré, Profond, Max
Mode de travail Comment le travail est-il structuré ? Agent, Conseil, Arène
Placement Où l’inférence s’exécute-t-elle ? local, cloud, hybride

Voir Modes d’exécution pour les modes de travail et de placement.

Format transmis

Le runtime enregistre et envoie encore des clés de variante compatibles OpenCode, issues du catalogue du fournisseur (par exemple low, medium, high, xhigh, max). Les libellés d’interface ne sont qu’une couche de présentation :

Libellé d’interface Clé transmise typique
Auto (aucune — défaut du modèle / de la politique)
Désactivé none
Minimal minimal
Rapide low
Équilibré medium
Profond high
Max xhigh, max

Les clés disponibles sont propres à chaque modèle. Les modèles sans variantes masquent le contrôle d’effort.

Prise en charge des fournisseurs

Les niveaux d’effort sont générés automatiquement pour les modèles pris en charge chez ces fournisseurs :

Fournisseur Mécanisme Niveaux
Anthropic (Claude) effort sur les modèles actuels ; budgets de réflexion sur les modèles hérités Rapide, Équilibré, Profond, Max (selon le modèle)
OpenAI (GPT-5.x) reasoningEffort Rapide, Équilibré, Profond
Google (Gemini 3.x) thinkingConfig.thinkingLevel Rapide, Profond (3.1 ajoute Équilibré)
Points de terminaison compatibles OpenAI reasoningEffort Rapide, Équilibré, Profond
Venice reasoningEffort Rapide, Équilibré, Profond
Claude Code CLI --effort Rapide, Équilibré, Profond, Max
Codex CLI forçage de configuration model_reasoning_effort Minimal, Rapide, Équilibré, Profond, Max
Grok Build CLI --reasoning-effort Rapide, Équilibré, Profond

Les fournisseurs dont l’API d’effort n’est pas vérifiée ou est incompatible (API hébergée de Groq, OpenRouter, familles DeepSeek/Alibaba/MiniMax/GLM/Mistral, fournisseurs CLI non pris en charge et passerelles tierces) n’exposent aucun niveau intégré ; /effort l’explique au lieu d’échouer en silence. Définissez des niveaux personnalisés sous provider.<id>.models.<model>.variants dans ax-code.json lorsqu’un fournisseur documente une forme d’option prise en charge.

Comment régler l'effort

TUI

  • Cycle : ctrl+t (raccourci variant_cycle) — parcourt Auto → chaque niveau disponible → Auto
  • Sélecteur : /effort (alias /variant, /thinking) ; sur les modèles sans niveaux, il ouvre un dialogue d’explication
  • Statut : le pied de l’invite montre la pastille d’effort courante lorsque le modèle prend en charge les niveaux ; les messages envoyés affichent leur libellé d’effort dans la ligne de métadonnées
  • CLI : ax-code run --variant high

Bureau

  • Contrôle de réflexion à côté du sélecteur de modèle
  • Cycle au clavier (même chemin de raccourci que le cycle de variante de modèle)
  • Les libellés utilisent le même mappage lisible que le TUI

Défauts et comportement automatique

  1. Auto signifie qu’il n’y a pas de forçage explicite de l’utilisateur pour ce modèle.
  2. Lorsque Auto est actif, ReasoningPolicy applique une base équilibrée (variante medium / default du fournisseur) afin que les modèles activent réellement la réflexion et transmettent les indicateurs d’effort, au lieu de les omettre.
  3. Cela vaut à la fois pour les modèles avec reasoning: true et pour les fournisseurs qui n’exposent l’effort que comme variantes (par exemple les CLI Claude Code / Codex / Grok Build, qui signalent reasoning: false parce que la sortie est opaque pour le SDK d’IA).
  4. La politique peut encore élever la profondeur jusqu’à Profond pour le mode plan, le mode autonome ou les invites à haut risque (et pour un échec répété, une forte incertitude ou un grand rayon d’impact, lorsque ces signaux sont fournis).
  5. Lorsque l’utilisateur choisit un effort explicite, ce forçage l’emporte pour les tours suivants (la politique ne le combat pas). Les options de configuration ou d’agent qui règlent déjà le raisonnement / effort / thinking sont aussi laissées telles quelles.
  6. L’effort est mémorisé par modèle dans les préférences locales de modèle (model.json dans le répertoire d’état du TUI).

Configuration

Épinglez un défaut sur un agent :

{
  "agent": {
    "plan": {
      "variant": "high"
    }
  }
}

Définissez ou désactivez les variantes de fournisseur sous provider.<id>.models.<model>.variants dans ax-code.json (même forme qu’OpenCode).

Bonnes pratiques

  • Préférez Auto ou Équilibré/Profond pour le travail quotidien ; réservez Max au débogage difficile ou à l’architecture.
  • N’inventez pas un quatrième mode global « lite / xfast / max » qui concurrencerait Agent/Conseil/Arène.
  • Gardez le modèle, l’effort et le mode de travail comme contrôles distincts dans les textes d’interface.
  • Au changement de modèle, un effort mémorisé invalide retombe sur Auto pour ce modèle.