Diese Seite ist eine Übersetzung der englischen Dokumentation. Befehle, Bezeichner und Beispiele bleiben unverändert. Runtime 7.24.4 · SDK 2.6.7. Englische Fassung
Modellaufwand (Denken / Varianten)
Status: Aktiv
Geltungsbereich: aktueller Stand
Zuletzt geprüft: 2026-07-18
Verantwortlich: ax-code runtime
AX Code nutzt den Aufwand (auch Denkstufe genannt), um zu steuern, wie gründlich das aktive Modell nachdenkt. Aufwand ist kein Arbeitsmodus und keine Art der Platzierung.
| Achse | Frage | Beispiele |
|---|---|---|
| Modell | Welches Modell? | Sonnet, Opus, GPT, lokales Qwen |
| Aufwand | Wie gründlich soll es denken? | Auto, Fast, Balanced, Deep, Max |
| Arbeitsmodus | Wie ist die Aufgabe aufgebaut? | Agent, Council, Arena |
| Platzierung | Wo läuft die Inferenz? | local, cloud, hybrid |
Siehe Ausführungsmodi zu Arbeits- und Platzierungsmodi.
Wire-Format
Die Laufzeit speichert und sendet weiterhin mit OpenCode kompatible Schlüssel der Variante aus dem Anbieterkatalog (zum Beispiel low, medium, high, xhigh, max). Beschriftungen der Oberfläche sind nur eine Darstellungsschicht:
| Beschriftung | Typischer Schlüssel im Wire-Format |
|---|---|
| Auto | (keine — Voreinstellung von Modell oder Richtlinie) |
| Off | none |
| Minimal | minimal |
| Fast | low |
| Balanced | medium |
| Deep | high |
| Max | xhigh, max |
Verfügbare Schlüssel gelten je Modell. Modelle ohne Varianten blenden die Steuerung des Aufwands aus.
Unterstützung durch Anbieter
Aufwandstufen entstehen für unterstützte Modelle bei diesen Anbietern automatisch:
| Anbieter | Mechanismus | Stufen |
|---|---|---|
| Anthropic (Claude) | effort bei aktuellen Modellen; Denkbudgets bei älteren Modellen |
Fast, Balanced, Deep und Max (modellabhängig) |
| OpenAI (GPT-5.x) | reasoningEffort |
Fast, Balanced und Deep |
| Google (Gemini 3.x) | thinkingConfig.thinkingLevel |
Fast und Deep (3.1 ergänzt Balanced) |
| Mit OpenAI kompatible Endpunkte | reasoningEffort |
Fast, Balanced und Deep |
| Venice | reasoningEffort |
Fast, Balanced und Deep |
| Claude Code CLI | --effort |
Fast, Balanced, Deep und Max |
| Codex CLI | model_reasoning_effort als Überschreibung der Konfiguration |
Minimal, Fast, Balanced, Deep und Max |
| Grok Build CLI | --reasoning-effort |
Fast, Balanced und Deep |
Anbieter, deren API für den Aufwand ungeprüft oder inkompatibel ist (die gehostete API von Groq, OpenRouter, die Familien DeepSeek, Alibaba, MiniMax, GLM und Mistral, nicht unterstützte CLI-Anbieter sowie Gateways Dritter), stellen keine eingebauten Stufen bereit. /effort erklärt das, statt still zu scheitern. Definieren Sie eigene Stufen unter provider.<id>.models.<model>.variants in ax-code.json, wenn ein Anbieter eine unterstützte Form der Option dokumentiert.
So legen Sie den Aufwand fest
TUI
- Wechsel:
ctrl+t(Tastenbindungvariant_cycle) — führt von Auto über jede verfügbare Stufe wieder zu Auto - Auswahl:
/effort(Aliase/variant,/thinking); bei Modellen ohne Stufen öffnet sich ein Dialog mit Erklärung - Status: die Fußzeile der Eingabe zeigt den aktuellen Aufwand-Chip, wenn das Modell Stufen unterstützt; gesendete Nachrichten zeigen ihre Aufwand-Beschriftung in der Zeile der Metadaten
- CLI:
ax-code run --variant high
Desktop
- Steuerung für das Denken neben der Modellauswahl
- Wechsel über die Tastatur (derselbe Tastenweg wie beim Wechsel der Modellvariante)
- Die Beschriftungen nutzen dieselbe verständliche Zuordnung wie die TUI
Voreinstellungen und Verhalten von Auto
- Auto bedeutet für dieses Modell keine ausdrückliche Überschreibung durch Sie.
- Ist Auto aktiv, legt ReasoningPolicy eine Basis balanced fest (
medium/ Variantedefaultdes Anbieters), damit Modelle das Denken tatsächlich einschalten und Flags für den Aufwand übergeben, statt sie wegzulassen. - Das gilt für Modelle mit
reasoning: trueund ebenso für Anbieter, die den Aufwand nur als Varianten anbieten (zum Beispiel die CLIs Claude Code, Codex und Grok Build, diereasoning: falsemelden, weil die Ausgabe für das AI SDK undurchsichtig ist). - Die Richtlinie kann die Tiefe für den Planmodus, den autonomen Modus oder Prompts mit hohem Risiko weiterhin auf Deep anheben, auch bei wiederholtem Fehlschlag, hoher Unsicherheit oder hohem Wirkungsradius, wenn diese Signale vorliegen.
- Wählen Sie einen ausdrücklichen Aufwand, gilt diese Überschreibung für die folgenden Runden. Die Richtlinie wirkt nicht dagegen. Konfiguration oder Agentenoptionen, die Reasoning,
effortoderthinkingbereits setzen, bleiben ebenfalls unberührt. - Der Aufwand wird je Modell in den lokalen Voreinstellungen der Modelle gemerkt (
model.jsonim Zustandsverzeichnis der TUI).
Konfiguration
Legen Sie an einem Agenten eine Voreinstellung fest:
{
"agent": {
"plan": {
"variant": "high"
}
}
}
Definieren oder deaktivieren Sie Varianten des Anbieters unter provider.<id>.models.<model>.variants in ax-code.json (dieselbe Form wie bei OpenCode).
Bewährte Praxis
- Bevorzugen Sie Auto oder Balanced/Deep für die tägliche Arbeit und heben Sie Max für schwierige Fehlersuche oder Architektur auf.
- Erfinden Sie keinen vierten globalen Modus „lite / xfast / max“, der mit Agent, Council oder Arena konkurriert.
- Halten Sie Modell, Aufwand und Arbeitsmodus in Texten der Oberfläche als getrennte Steuerungen.
- Beim Wechsel des Modells fällt ein ungültig gespeicherter Aufwand für dieses Modell auf Auto zurück.
Verwandtes
- Ausführungsmodi — Agent, Council, Arena und hybride Platzierung
- Unterstützte Anbieter und Modelle — welche Anbieter Modelle bereitstellen
- Modellvarianten von OpenCode: https://opencode.ai/docs/models/