Cette page est traduite de la documentation anglaise. Les commandes, identifiants et exemples sont inchangés. Runtime 7.24.4 · SDK 2.6.7. Source anglaise
Effort du modèle (réflexion / variantes)
Statut : actif
Portée : état actuel
Dernière revue : 2026-07-18
Responsable : runtime AX Code
AX Code utilise l’effort (aussi appelé niveau de réflexion) pour régler l’intensité de raisonnement du modèle actif. L’effort n’est pas un mode de travail et n’est pas un mode de placement.
| Axe | Question | Exemples |
|---|---|---|
| Modèle | Quel modèle ? | Sonnet, Opus, GPT, Qwen local |
| Effort | Avec quelle intensité doit-il réfléchir ? | Auto, Rapide, Équilibré, Profond, Max |
| Mode de travail | Comment le travail est-il structuré ? | Agent, Conseil, Arène |
| Placement | Où l’inférence s’exécute-t-elle ? | local, cloud, hybride |
Voir Modes d’exécution pour les modes de travail et de placement.
Format transmis
Le runtime enregistre et envoie encore des clés de variante compatibles OpenCode, issues du catalogue du fournisseur (par exemple low, medium, high, xhigh, max). Les libellés d’interface ne sont qu’une couche de présentation :
| Libellé d’interface | Clé transmise typique |
|---|---|
| Auto | (aucune — défaut du modèle / de la politique) |
| Désactivé | none |
| Minimal | minimal |
| Rapide | low |
| Équilibré | medium |
| Profond | high |
| Max | xhigh, max |
Les clés disponibles sont propres à chaque modèle. Les modèles sans variantes masquent le contrôle d’effort.
Prise en charge des fournisseurs
Les niveaux d’effort sont générés automatiquement pour les modèles pris en charge chez ces fournisseurs :
| Fournisseur | Mécanisme | Niveaux |
|---|---|---|
| Anthropic (Claude) | effort sur les modèles actuels ; budgets de réflexion sur les modèles hérités |
Rapide, Équilibré, Profond, Max (selon le modèle) |
| OpenAI (GPT-5.x) | reasoningEffort |
Rapide, Équilibré, Profond |
| Google (Gemini 3.x) | thinkingConfig.thinkingLevel |
Rapide, Profond (3.1 ajoute Équilibré) |
| Points de terminaison compatibles OpenAI | reasoningEffort |
Rapide, Équilibré, Profond |
| Venice | reasoningEffort |
Rapide, Équilibré, Profond |
| Claude Code CLI | --effort |
Rapide, Équilibré, Profond, Max |
| Codex CLI | forçage de configuration model_reasoning_effort |
Minimal, Rapide, Équilibré, Profond, Max |
| Grok Build CLI | --reasoning-effort |
Rapide, Équilibré, Profond |
Les fournisseurs dont l’API d’effort n’est pas vérifiée ou est incompatible (API hébergée de Groq, OpenRouter, familles DeepSeek/Alibaba/MiniMax/GLM/Mistral, fournisseurs CLI non pris en charge et passerelles tierces) n’exposent aucun niveau intégré ; /effort l’explique au lieu d’échouer en silence. Définissez des niveaux personnalisés sous provider.<id>.models.<model>.variants dans ax-code.json lorsqu’un fournisseur documente une forme d’option prise en charge.
Comment régler l'effort
TUI
- Cycle :
ctrl+t(raccourcivariant_cycle) — parcourt Auto → chaque niveau disponible → Auto - Sélecteur :
/effort(alias/variant,/thinking) ; sur les modèles sans niveaux, il ouvre un dialogue d’explication - Statut : le pied de l’invite montre la pastille d’effort courante lorsque le modèle prend en charge les niveaux ; les messages envoyés affichent leur libellé d’effort dans la ligne de métadonnées
- CLI :
ax-code run --variant high
Bureau
- Contrôle de réflexion à côté du sélecteur de modèle
- Cycle au clavier (même chemin de raccourci que le cycle de variante de modèle)
- Les libellés utilisent le même mappage lisible que le TUI
Défauts et comportement automatique
- Auto signifie qu’il n’y a pas de forçage explicite de l’utilisateur pour ce modèle.
- Lorsque Auto est actif, ReasoningPolicy applique une base équilibrée (variante
medium/defaultdu fournisseur) afin que les modèles activent réellement la réflexion et transmettent les indicateurs d’effort, au lieu de les omettre. - Cela vaut à la fois pour les modèles avec
reasoning: trueet pour les fournisseurs qui n’exposent l’effort que comme variantes (par exemple les CLI Claude Code / Codex / Grok Build, qui signalentreasoning: falseparce que la sortie est opaque pour le SDK d’IA). - La politique peut encore élever la profondeur jusqu’à Profond pour le mode plan, le mode autonome ou les invites à haut risque (et pour un échec répété, une forte incertitude ou un grand rayon d’impact, lorsque ces signaux sont fournis).
- Lorsque l’utilisateur choisit un effort explicite, ce forçage l’emporte pour les tours suivants (la politique ne le combat pas). Les options de configuration ou d’agent qui règlent déjà le raisonnement /
effort/thinkingsont aussi laissées telles quelles. - L’effort est mémorisé par modèle dans les préférences locales de modèle (
model.jsondans le répertoire d’état du TUI).
Configuration
Épinglez un défaut sur un agent :
{
"agent": {
"plan": {
"variant": "high"
}
}
}
Définissez ou désactivez les variantes de fournisseur sous provider.<id>.models.<model>.variants dans ax-code.json (même forme qu’OpenCode).
Bonnes pratiques
- Préférez Auto ou Équilibré/Profond pour le travail quotidien ; réservez Max au débogage difficile ou à l’architecture.
- N’inventez pas un quatrième mode global « lite / xfast / max » qui concurrencerait Agent/Conseil/Arène.
- Gardez le modèle, l’effort et le mode de travail comme contrôles distincts dans les textes d’interface.
- Au changement de modèle, un effort mémorisé invalide retombe sur Auto pour ce modèle.
Voir aussi
- Modes d’exécution — Agent / Conseil / Arène et placement hybride
- Fournisseurs pris en charge — quels fournisseurs exposent des modèles
- Variantes de modèles OpenCode : https://opencode.ai/docs/models/