Diese Seite ist eine Übersetzung der englischen Dokumentation. Befehle, Bezeichner und Beispiele bleiben unverändert. Runtime 7.24.4 · SDK 2.6.7. Englische Fassung
Auto-Route – automatische Weiterleitung
Status: Aktiv Geltungsbereich: aktueller Stand Zuletzt geprüft: 2026-10-10 Verantwortlich: ax-code runtime
Die Auto-Route steuert zwei unabhängige Arten der Weiterleitung in AX Code:
-
Schlüsselwort-Weiterleitung — standardmäßig aktiv. Sie wechselt den Agenten, wenn eine Nachricht zu Schlüsselwörtern oder Mustern einer Fachrolle passt. Sie löst in unter 1ms aus und braucht keinen LLM-Aufruf. Sie wird übersprungen, wenn die Weiterleitung ausdrücklich abgeschaltet ist, Sie ausdrücklich einen Agenten nennen oder die Nachricht eine synthetische Fortsetzung ist, die den aktuellen Agenten beibehält.
-
Komplexitäts-Weiterleitung — optional, eingeschaltet über den Schalter der Auto-Route. Ein leichter LLM-Aufruf stuft jede Nachricht als Komplexität
low,mediumoderhighein. Nachrichten der Komplexitätlowbedient automatisch das ausdrücklich konfiguriertesmall_modelund senkt so die Latenz bei einfachen Fragen.
Standardmäßig ist die Auto-Route aus. Die Komplexitäts-Weiterleitung ist dann deaktiviert. Die Schlüsselwort-Weiterleitung ist von diesem Schalter getrennt und bleibt standardmäßig aktiv, sofern die Konfiguration sie nicht abschaltet oder eine ausdrückliche Agentenwahl sie umgeht.
Schnellstart
Schalten Sie in der TUI um:
- Geben Sie
/smart-llmin die Eingabe ein, oder - Drücken Sie
Ctrl+Pund suchen Sie nach „Auto-Route“, oder - Klicken Sie auf die Anzeige Auto-Route an/aus in der Statusleiste
Die Statusleiste zeigt den aktuellen Zustand:
- Auto-Route an (violetter Text) — die Komplexitäts-Weiterleitung ist aktiv
- Auto-Route aus (weißer Text) — die Komplexitäts-Weiterleitung ist deaktiviert (Voreinstellung)
Die Einstellung bleibt über Sitzungen hinweg in ax-code.json erhalten.
So funktioniert es
Maßgebliche Quelle
Diese Seite fasst das Verhalten für Anwender zusammen. Wenn sich das Verhalten ändert, prüfen Sie die Dokumentation anhand dieser Stellen:
packages/ax-code/src/agent/router.tsfür die Regeln der Schlüsselwort-Weiterleitung undclassifyComplexity().packages/ax-code/src/session/prompt.tsdafür, wann die Schlüsselwort-Weiterleitung übersprungen wird und wann die Einstufung der Komplexität läuft.packages/ax-code/src/server/routes/smart-llm.tsfür Voreinstellung, Umgebung, Konfiguration und das Speichern.packages/ax-code/src/config/schema.tsfür Felder der Weiterleitungskonfiguration und Hinweise zur Abkündigung.packages/ax-code/src/cli/tui/app.tsxfür Namen von Slash-Befehlen, Aliase, Beschriftungen und Aktionen der Statusleiste.packages/ax-code/test/agent/router.test.tsund die Synchronisationstests der TUI für das erwartete Aktivierungsverhalten.
Beschreiben Sie die Schlüsselwort-Weiterleitung und die Komplexitäts-Weiterleitung über ein schnelles Modell nicht als ein einziges Merkmal. Sie sind absichtlich getrennt.
Schlüsselwort-Weiterleitung (standardmäßig aktiv, <1ms)
Benutzernachrichten werden mit Schlüsselwort- und Regex-Mustern jedes Fachagenten abgeglichen (security, architect, debug, perf, devops, test). Liegt eine Übereinstimmung bei einem Vertrauen von ≥ 0.4, kann der Agent sofort wechseln. Es erfolgt kein LLM-Aufruf. Dieser Weg ist vom Schalter der Auto-Route unabhängig, wird aber übersprungen, wenn die Weiterleitung abgeschaltet ist, Sie ausdrücklich einen Agenten nennen oder die aktuelle Runde einen bestehenden Agenten für eine synthetische Fortsetzung beibehält.
Komplexitäts-Weiterleitung (nur Auto-Route, etwa 200-500ms)
Wenn die Auto-Route aktiv ist, geht jede Nachricht über classifyComplexity() an ein schnelles und günstiges Modell. Dieser LLM-Aufruf liefert eine Schätzung der Komplexität (low / medium / high):
- Nachrichten der Komplexität
lownutzen automatisch das ausdrücklich konfiguriertesmall_model - Nachrichten
mediumundhighnutzen wie gewohnt das Standardmodell - Übersprungen, wenn
small_modelfehlt oder nicht verfügbar ist - Timeout von 1.5 Sekunden — stiller Rückfall, wenn das LLM langsam oder nicht verfügbar ist
- Alle Fehler werden still abgefangen und blockieren Sie nie
Die Komplexitäts-Weiterleitung ist von der Weiterleitung der Agenten unabhängig. Sie stuft nicht ein, welcher Fachagent zu nutzen ist. Das erledigt vollständig die Schlüsselwort-Weiterleitung.
Wobei die Auto-Route hilft
| Szenario | Ohne Auto-Route | Mit Auto-Route |
|---|---|---|
| „Was tut diese Variable?“ | Volles Modell verwendet | Komplexität low → schnelles Modell |
| „Alle Exporte in dieser Datei auflisten“ | Volles Modell verwendet | Komplexität low → schnelles Modell |
| „Nach Schwachstellen suchen“ | Schlüsselwort leitet zu security | Gleich — die Schlüsselwort-Weiterleitung löst immer aus |
| „Das Auth-Modul über 8 Dateien umbauen“ | Standardmodell | Komplexität high → Standardmodell |
| „Diese Funktion ist träge“ | Keine Schlüsselwort-Übereinstimmung, keine Weiterleitung | low/medium → passende Modellstufe |
Die Schlüsselwort-Weiterleitung wählt den Fachagenten anhand technischer Schlüsselwörter. Die Komplexitäts-Weiterleitung wählt die passende Modellstufe danach, wie viel Reasoning die Antwort braucht.
Nachteile und Hinweise
Latenz
Die Komplexitäts-Weiterleitung fügt Nachrichten, die den Einstufungsaufruf auslösen, 200-500ms hinzu. Die Schlüsselwort-Weiterleitung, die immer aktiv ist, bleibt unberührt und antwortet unabhängig davon in <1ms.
Ein kleines Modell ist erforderlich
Die Komplexitäts-Weiterleitung verlangt eine ausdrückliche Konfiguration von small_model. AX Code leitet keinen Helfer aus Modellnamen ab und verschiebt eine nicht verfügbare Festlegung nicht zu einem anderen Anbieter. Ohne nutzbaren Helfer wird die Einstufung übersprungen, und das gewählte Primärmodell bleibt erhalten. Siehe Modellauswahl und Wiederherstellung.
Token-Verbrauch
Jeder Einstufungsaufruf nutzt ungefähr 100-200 Eingabe-Token und 10-20 Ausgabe-Token. Das bleibt gegenüber dem anschließenden Hauptaufruf des LLM gering.
Kein Ersatz für die ausdrückliche Auswahl
Die Auto-Route verbessert die automatische Wahl der Modellstufe, kann aber nicht allein anhand natürlicher Sprache zu Fachagenten leiten. Bei kritischen Aufgaben, bei denen der passende Fachagent zählt, ist die ausdrückliche Wahl über die Agentenauswahl oder die Erwähnung @agent verlässlicher.
Konfiguration
Umschalten in der TUI
Verwenden Sie /smart-llm oder die Befehlspalette (Ctrl+P → „Auto-Route ein- oder ausschalten“). Die Änderung wirkt sofort und wird in ax-code.json Ihres Projekts gespeichert.
Konfigurationsdatei
{
"routing": {
"llm": true
}
}
Umgebungsvariable
AX_CODE_SMART_LLM=true ax-code
Die Umgebungsvariable überschreibt die Einstellung in der Konfigurationsdatei.
Auto-Route und weitere Einstellungen
| Einstellung | Zusammenspiel |
|---|---|
| Autonomer Modus | Die Auto-Route arbeitet unabhängig. Die Weiterleitung der Agenten und die Einstufung der Komplexität geschehen vor den Berechtigungsprüfungen. |
| Sandbox-Modus | Kein Zusammenspiel. Die Auto-Route beeinflusst nur, welcher Agent und welche Modellstufe gewählt werden, und nicht, was der Agent tun darf. |
| Modellauswahl | Nachrichten der Komplexität low nutzen das ausdrücklich konfigurierte small_model, wenn die Auto-Route an ist und kein Modell ausdrücklich festgelegt ist. |
| Ausführungsmodi | Die hybride Platzierung (modes.default: "hybrid") ist getrennt: sie wählt lokal oder Cloud. Siehe Ausführungsmodi. |
Wann Sie die Auto-Route einschalten
Einschalten, wenn:
- Sie einfache Fragen automatisch an ein günstigeres und schnelleres Modell leiten möchten
- Sie die Token-Kosten bei Austausch mit geringer Komplexität senken möchten
- Sie mit einem Anbieter arbeiten, der ein verlässliches kleines oder Flash-Modell bereitstellt
Ausgeschaltet lassen, wenn:
- Sie bei jeder Nachricht ohne zusätzliche Latenz arbeiten möchten
- Sie offline oder mit unzuverlässigem Netzwerk arbeiten
- Sie den Token-Verbrauch möglichst klein halten möchten
- Sie ein Modell immer ausdrücklich festlegen