AX Code holen · KostenlosDokumentation

Diese Seite ist eine Übersetzung der englischen Dokumentation. Befehle, Bezeichner und Beispiele bleiben unverändert. Runtime 7.24.4 · SDK 2.6.7. Englische Fassung

Modellaufwand (Denken / Varianten)

Status: Aktiv
Geltungsbereich: aktueller Stand
Zuletzt geprüft: 2026-07-18
Verantwortlich: ax-code runtime

AX Code nutzt den Aufwand (auch Denkstufe genannt), um zu steuern, wie gründlich das aktive Modell nachdenkt. Aufwand ist kein Arbeitsmodus und keine Art der Platzierung.

Achse Frage Beispiele
Modell Welches Modell? Sonnet, Opus, GPT, lokales Qwen
Aufwand Wie gründlich soll es denken? Auto, Fast, Balanced, Deep, Max
Arbeitsmodus Wie ist die Aufgabe aufgebaut? Agent, Council, Arena
Platzierung Wo läuft die Inferenz? local, cloud, hybrid

Siehe Ausführungsmodi zu Arbeits- und Platzierungsmodi.

Wire-Format

Die Laufzeit speichert und sendet weiterhin mit OpenCode kompatible Schlüssel der Variante aus dem Anbieterkatalog (zum Beispiel low, medium, high, xhigh, max). Beschriftungen der Oberfläche sind nur eine Darstellungsschicht:

Beschriftung Typischer Schlüssel im Wire-Format
Auto (keine — Voreinstellung von Modell oder Richtlinie)
Off none
Minimal minimal
Fast low
Balanced medium
Deep high
Max xhigh, max

Verfügbare Schlüssel gelten je Modell. Modelle ohne Varianten blenden die Steuerung des Aufwands aus.

Unterstützung durch Anbieter

Aufwandstufen entstehen für unterstützte Modelle bei diesen Anbietern automatisch:

Anbieter Mechanismus Stufen
Anthropic (Claude) effort bei aktuellen Modellen; Denkbudgets bei älteren Modellen Fast, Balanced, Deep und Max (modellabhängig)
OpenAI (GPT-5.x) reasoningEffort Fast, Balanced und Deep
Google (Gemini 3.x) thinkingConfig.thinkingLevel Fast und Deep (3.1 ergänzt Balanced)
Mit OpenAI kompatible Endpunkte reasoningEffort Fast, Balanced und Deep
Venice reasoningEffort Fast, Balanced und Deep
Claude Code CLI --effort Fast, Balanced, Deep und Max
Codex CLI model_reasoning_effort als Überschreibung der Konfiguration Minimal, Fast, Balanced, Deep und Max
Grok Build CLI --reasoning-effort Fast, Balanced und Deep

Anbieter, deren API für den Aufwand ungeprüft oder inkompatibel ist (die gehostete API von Groq, OpenRouter, die Familien DeepSeek, Alibaba, MiniMax, GLM und Mistral, nicht unterstützte CLI-Anbieter sowie Gateways Dritter), stellen keine eingebauten Stufen bereit. /effort erklärt das, statt still zu scheitern. Definieren Sie eigene Stufen unter provider.<id>.models.<model>.variants in ax-code.json, wenn ein Anbieter eine unterstützte Form der Option dokumentiert.

So legen Sie den Aufwand fest

TUI

  • Wechsel: ctrl+t (Tastenbindung variant_cycle) — führt von Auto über jede verfügbare Stufe wieder zu Auto
  • Auswahl: /effort (Aliase /variant, /thinking); bei Modellen ohne Stufen öffnet sich ein Dialog mit Erklärung
  • Status: die Fußzeile der Eingabe zeigt den aktuellen Aufwand-Chip, wenn das Modell Stufen unterstützt; gesendete Nachrichten zeigen ihre Aufwand-Beschriftung in der Zeile der Metadaten
  • CLI: ax-code run --variant high

Desktop

  • Steuerung für das Denken neben der Modellauswahl
  • Wechsel über die Tastatur (derselbe Tastenweg wie beim Wechsel der Modellvariante)
  • Die Beschriftungen nutzen dieselbe verständliche Zuordnung wie die TUI

Voreinstellungen und Verhalten von Auto

  1. Auto bedeutet für dieses Modell keine ausdrückliche Überschreibung durch Sie.
  2. Ist Auto aktiv, legt ReasoningPolicy eine Basis balanced fest (medium / Variante default des Anbieters), damit Modelle das Denken tatsächlich einschalten und Flags für den Aufwand übergeben, statt sie wegzulassen.
  3. Das gilt für Modelle mit reasoning: true und ebenso für Anbieter, die den Aufwand nur als Varianten anbieten (zum Beispiel die CLIs Claude Code, Codex und Grok Build, die reasoning: false melden, weil die Ausgabe für das AI SDK undurchsichtig ist).
  4. Die Richtlinie kann die Tiefe für den Planmodus, den autonomen Modus oder Prompts mit hohem Risiko weiterhin auf Deep anheben, auch bei wiederholtem Fehlschlag, hoher Unsicherheit oder hohem Wirkungsradius, wenn diese Signale vorliegen.
  5. Wählen Sie einen ausdrücklichen Aufwand, gilt diese Überschreibung für die folgenden Runden. Die Richtlinie wirkt nicht dagegen. Konfiguration oder Agentenoptionen, die Reasoning, effort oder thinking bereits setzen, bleiben ebenfalls unberührt.
  6. Der Aufwand wird je Modell in den lokalen Voreinstellungen der Modelle gemerkt (model.json im Zustandsverzeichnis der TUI).

Konfiguration

Legen Sie an einem Agenten eine Voreinstellung fest:

{
  "agent": {
    "plan": {
      "variant": "high"
    }
  }
}

Definieren oder deaktivieren Sie Varianten des Anbieters unter provider.<id>.models.<model>.variants in ax-code.json (dieselbe Form wie bei OpenCode).

Bewährte Praxis

  • Bevorzugen Sie Auto oder Balanced/Deep für die tägliche Arbeit und heben Sie Max für schwierige Fehlersuche oder Architektur auf.
  • Erfinden Sie keinen vierten globalen Modus „lite / xfast / max“, der mit Agent, Council oder Arena konkurriert.
  • Halten Sie Modell, Aufwand und Arbeitsmodus in Texten der Oberfläche als getrennte Steuerungen.
  • Beim Wechsel des Modells fällt ein ungültig gespeicherter Aufwand für dieses Modell auf Auto zurück.